Context Engineering: Umenie formovať myseľ AI

Context engineering je disciplína, ktorá posúva prompt engineering na vyššiu úroveň — nejde len o to, čo napíšeš do promptu, ale o to, čo presne sa nachádza v celom kontextovom okne modelu pri každom jednom volaní.


1. Čo je Context Engineering?

Context engineering je systematický prístup k riadeniu obsahu kontextového okna jazykového modelu. Kým prompt engineering sa zameriava na formuláciu otázok a inštrukcií, context engineering rieši kompletný vstupný balík — systémový prompt, históriu konverzácie, relevantné dokumenty, výstupy nástrojov, pamäťové záznamy a ďalšie dáta.

Termín sa etabloval v rokoch 2024–2025 ako reakcia na rastúcu komplexitu AI agentov. Keď model nepracuje len s jednou otázkou, ale riadi dlhú agentickú reláciu naprieč nástrojmi a databázami, samotný prompt je len malou časťou celého obrazu.

Komponenty kontextu, ktoré context engineering rieši:

  • Systémový prompt — inštrukcie, persona, obmedzenia modelu
  • História konverzácie — predchádzajúce správy (skomprimované alebo úplné)
  • Získané dokumenty — výstupy RAG pipeline
  • Výstupy nástrojov — výsledky volania API, databáz, kalkulácií
  • Pamäťové záznamy — dlhodobé fakty o používateľovi alebo projekte
  • Príklady (few-shot) — vzorové vstupy a výstupy pre daný formát odpovede

2. Prečo je to dôležité práve teraz?

Jazykové modely v roku 2026 disponujú kontextovými oknami rádovo 200 000 až 1 000 000 tokenov. To znie ako neobmedzené množstvo priestoru, ale prax ukazuje opak.

Štyri konkrétne problémy, ktoré musí context engineering riešiť:

  1. Cena. Každý token v kontexte stojí peniaze. Milión tokenov pri každom volaní v produkčnom systéme s tisíckami používateľov sa rýchlo premení na astronomické náklady.
  2. Jav "lost in the middle". Výskum opakovane ukázal, že modely spracúvajú informáciu uprostred dlhého kontextu menej spoľahlivo ako informáciu na začiatku alebo na konci. Ak je kľúčový fakt pochovaný v päťtisícom tokene, model ho môže ignorovať.
  3. Latencia. Väčší kontext priamo predlžuje čas do prvého tokenu odpovede (TTFT). V interaktívnych aplikáciách je to viditeľné a frustrujúce.
  4. Rozptyl pozornosti. Irelevantné informácie znižujú presnosť. Model sa "zamotáva" v detailoch, ktoré nemajú pre danú úlohu žiadnu hodnotu.

Context engineering teda nie je len optimalizácia — je to predpoklad spoľahlivých a ekonomicky udržateľných AI systémov v škále.


3. Porovnanie hlavných prístupov

Prístup Čo rieši Nevýhody
Naivný kontextový stack Jednoduché na implementáciu Rýchlo preplní okno, vysoké náklady
Konverzačná komprimácia Ušetrí tokeny v histórii Strata detailov pri agresívnom skrátení
Selektívny RAG Len relevantné dokumenty v kontexte Závisí na kvalite retrieval systému
Hierarchická pamäť Krátkodobá + dlhodobá pamäť oddelene Komplexná implementácia a synchronizácia
Dynamický kontext Kontext sa mení podľa aktuálnej fázy úlohy Najzložitejší, ale najúčinnejší prístup

4. Praktické techniky

Konverzačná komprimácia Dlhé histórie konverzácie sa nahradia priebežnou sumarizáciou. Model v určitom intervale "sbalí" predchádzajúce správy do kratšieho výtahu, pričom zachová kľúčové fakty a rozhodnutia. Túto techniku aktívne využívajú produkčné agentické systémy ako Claude Code pri dlhodobých kódovacích reláciách.

Dynamické vstreknutie kontextu (Dynamic Context Injection) Namiesto pevného systémového promptu sa kontext zostavuje za behu: na základe otázky používateľa sa pomocou embeddingov vyberú len relevantné časti internej dokumentácie, firemných pravidiel alebo pamäte agenta. Výsledok je výrazne kratší, a zároveň relevantnejší kontext.

Chunk ranking a re-ranking V RAG pipeline nestačí načítať top-k dokumentov podľa kosínusovej podobnosti. Následný re-ranking pomocou cross-encoder modelu zaistí, že najrelevantnejšie časti sú skutočne na prvých miestach — a teda spoľahlivejšie spracované modelom podľa pravidla "dôležité na začiatok alebo koniec".

Minimalizácia výstupov nástrojov Výstupy nástrojov — JSON z API, tabuľky z databáz, logy — by mali byť pred vložením do kontextu orezané na to, čo model naozaj potrebuje. Niekoľko tokenov navyše násobene tisícami volaní za deň predstavuje zbytočné náklady bez prínosu pre kvalitu.

Pozičná prioritizácia Najdôležitejšie informácie patria na začiatok alebo koniec kontextu. Inštrukcie o formáte odpovede, kľúčové obmedzenia alebo aktuálny stav úlohy sa umiestňujú strategicky — nie sa "hodia" doprostred dlhého kontextu.


5. Riziká, limity a čo nás čaká

"Nalejme tam všetko" je anti-vzor Veľké kontextové okná zvádzajú k myšlienke, že stačí vložiť všetky dostupné informácie a model sa sám vyzná. Výsledok je pomalý, drahý a paradoxne menej presný systém ako ten, ktorý používa selektívny, starostlivo zostavený kontext.

Latentná zaujatosť cez systémový prompt Systémový prompt formuje celé správanie modelu od začiatku relácie. Nedomyslený systémový prompt môže spôsobiť systematicky chybné odpovede v špecifických situáciách — bez zrejmej príčiny, ťažko laditeľné.

Pamäťová konzistencia a čerstvosť Ak rôzne časti kontextu obsahujú protichodné informácie — napríklad starý cached dokument verzus čerstvý výstup nástroja — model sa môže rozhodovať nepredvídateľne. Context engineering musí riešiť aj verzinovanie a explicitné označovanie čerstvosti zdrojov.

Bezpečnosť: prompt injection cez kontext Externé dáta vstupujúce do kontextu — webové stránky, e-maily, PDF dokumenty — môžu obsahovať škodlivé inštrukcie zamaskované ako bežný obsah. Context engineering bez sanitizácie vstupov otvára útočný vektor, pri ktorom externý obsah de facto preberá riadenie agenta.

Smerovanie odvetvia Vznikajú špecializované nástroje na automatizáciu context engineeringu: od frameworkov ako LangGraph a DSPy, cez pamäťové vrstvy, až po dedikované context optimization API. Tí, ktorí dnes pochopia princípy, budú o krok vpred pri adopcii týchto nástrojov.


Zhrnutie: Context engineering je nová kľúčová kompetencia pre každého, kto buduje produkčné AI aplikácie — kto zvládne presne riadiť, čo model "vidí" pri každom volaní, získa merateľnú výhodu vo výkone, nákladoch aj bezpečnosti systému.