ChatGPT 5.4
ChatGPT 5.4 (interný názov gpt-5.4) je najnovšia iterácia vlajkovej lode OpenAI v rodine GPT-5 modelov, vydaná začiatkom marca 2026. Nadväzuje na GPT-5.3-Codex a predstavuje zásadný posun od špecializovaného kódovacieho modelu späť k univerzálnemu AI systému — tentokrát s bezprecedentnou úrovňou autonómie, multimodálneho porozumenia a dlhodobého plánovania.
Štyri mesiace po vydaní je GPT-5.4 etablovaný ako referenčný bod v odvetví. Tento článok reflektuje nielen pôvodné funkcie pri vydaní, ale aj to, čo sa ukázalo v praxi a aké aktualizácie OpenAI vydal od marca do júla 2026.
1. Unified Reasoning Engine
GPT-5.4 kombinuje rýchly a hlboký reasoning do jedného systému s plynulým prepínaním medzi režimami. Na rozdiel od GPT-5, kde externý router rozhodoval o prepnutí modelu, v 5.4 ide o jeden model s dynamickou hĺbkou uvažovania — rozdiel, ktorý je v praxi citeľný.
- Adaptive Compute: Model sám rozhoduje, koľko „myslenia" úloha vyžaduje — od okamžitej odpovede po niekoľkominútovú hlbokú analýzu. Používateľ vidí indikátor intenzity výpočtu v reálnom čase.
- Transparentné uvažovanie: Postup myšlienok je viditeľný v reálnom čase. Používateľ môže kedykoľvek zasiahnuť, presmerovať alebo zastaviť reasoning — čo je zásadný rozdiel oproti modelom, kde reasoning prebieha ako čierna skrinka.
- Meta-reasoning: Model hodnotí kvalitu vlastného uvažovania a automaticky prepracúva slabé časti. V benchmarkoch sa táto schopnosť prejavila najmä pri matematických dôkazoch a viacúrovňovom plánovaní.
- Chain-of-Thought komprimácia: Pre opakované typy úloh model internalizoval frekventované myšlienkové vzory, čo skracuje latenciu o 30–40 % oproti GPT-5.2 pri zachovaní kvality výsledku.
V praxi sa Unified Reasoning Engine ukázal ako najväčší kvalitatívny skok pre analytické a výskumné úlohy — nie pre konverzáciu, kde je rozdiel menej znateľný.
2. Natívne spracovanie videa a 3D
GPT-5.2 priniesol analýzu video streamu. GPT-5.4 pridáva generovanie a editáciu videa priamo v konverzácii — bez prepínania na externé nástroje.
- Video-to-Video transformácie: Úprava existujúceho videa podľa slovného popisu (zmena štýlu, pridanie objektov, úprava osvetlenia, zmena pozadia). Výsledky pri jednoduchých úlohách sú produkčne použiteľné; pri komplexných scénach s viacerými pohybujúcimi sa objektmi stále vznikajú artefakty.
- 3D porozumenie a generovanie: Model rozumie priestorovým vzťahom z 2D vstupov a dokáže generovať základné 3D scény vo formátoch kompatibilných s bežnými 3D editormi (glTF, OBJ).
- Dlhé video analýzy: Analyzuje videá v dĺžke až 3 hodiny s presným časovým odkazovaním. Použiteľné pre prepis zápisníc zo schôdzí, analýzu vzdelávacích videí alebo dokumentárnych materiálov.
- Multimodálny vstup v reálnom čase: Kombinácia živého videa, hlasu a textu v jednej konverzácii — základný kameň pre aplikácie v telemedicíne, vzdelávaní a technickej podpore.
3. Pokročilé agentické schopnosti
GPT-5.4 posúva agentické AI na novú úroveň s multi-session persistenciou a autonómnym plánovaním. Toto je oblasť, kde model prekonáva konkurenciu najmarkantnejšie.
- Persistent Agents: Agenti bežia na pozadí a plnia dlhodobé úlohy — monitorovanie webov, generovanie pravidelných reportov, automatizované workflow. Agent nezávisle rozhoduje, kedy je úloha splnená a kedy je potrebný ľudský vstup.
- Tool Discovery: Model automaticky objavuje a učí sa používať nové nástroje a API bez manuálnej konfigurácie. Stačí poskytnúť dokumentáciu alebo príklad volania.
- Multi-Agent Orchestration: Koordinácia viacerých špecializovaných agentov pre komplexné úlohy — jeden agent zhromažďuje dáta, druhý analyzuje, tretí generuje výstup. OpenAI zverejnil špecifikáciu
Agents Protocol v1.1, ktorá umožňuje interoperabilitu s agentmi tretích strán. - Real-World Actions: Integrácia s externými službami pre reálne akcie — nákupy, rezervácie, správa smart home zariadení, odosielanie e-mailov v mene používateľa. Každá akcia podlieha konfigurovateľnej úrovni autorizácie.
- Checkpoint systém: Pre kritické agentické úlohy model automaticky vyžaduje ľudské potvrdenie pred nezvratnými akciami (platby, mazanie, odosielanie). Táto funkcia nie je voliteľná — je súčasťou bezpečnostného rámca.
4. Vylepšená pamäť a personalizácia
- Hierarchická pamäť: Trojúrovňový systém — krátkodobá (konverzácia), strednodobá (týždne), dlhodobá (mesiace) pamäť s automatickou prioritizáciou relevantných informácií.
- Proaktívne pripomienky: Model sám pripomenie relevantné informácie z minulých konverzácií, keď je to užitočné — bez toho, aby používateľ musel explicitne žiadať.
- Personalizovaný komunikačný štýl: Adaptácia tónu, hĺbky a formátu odpovedí podľa individuálnych preferencií. Po niekoľkých konverzáciách model rozozná, či preferujete technickú presnosť, zjednodušené vysvetlenia alebo konkrétne príklady.
- Zdieľaná pamäť v tímoch: V Team a Enterprise plánoch môže tím zdieľať kontextuálnu pamäť — model pozná interné procesy, terminológiu a projekty organizácie naprieč všetkými členmi.
5. Rozšírená kontextová kapacita
GPT-5.4 prináša výrazné rozšírenie kontextového okna oproti predchodcom:
| Model | Kontextové okno | Efektívna utilizácia |
|---|---|---|
| GPT-5.2 | 256K tokenov | ~70 % |
| GPT-5.3-Codex | 512K tokenov | ~75 % |
| GPT-5.4 | 1M tokenov | ~85 % |
| Claude Opus 4.6 | 500K tokenov | ~80 % |
| Gemini 3 Pro | 2M tokenov | ~65 % |
Milión tokenov zodpovedá zhruba 750 000 slovám — celá väčšia kódová základňa, kompletná zbierka vedeckých prác alebo dlhodobá projektová dokumentácia sa zmestí do jedného kontextu. Efektívna utilizácia (schopnosť skutočne pracovať s informáciami na začiatku aj konci kontextu) je v prípade GPT-5.4 vyššia ako pri Gemini napriek menšiemu absolútnemu oknu.
Technické parametre a benchmarky
| Benchmark | GPT-5.4 | GPT-5.3-Codex | GPT-5.2 | Claude Opus 4.6 | Gemini 3 Pro |
|---|---|---|---|---|---|
| MMLU-Pro | 94,2 % | 89,1 % | 87,3 % | 91,8 % | 90,4 % |
| SWE-Bench Pro | 62,4 % | 56,8 % | 55,6 % | 60,1 % | 58,7 % |
| Terminal-Bench 2.0 | 81,6 % | 77,3 % | 62,2 % | 79,4 % | 74,1 % |
| GPQA Diamond | 78,9 % | 71,2 % | 68,5 % | 76,3 % | 74,8 % |
| Video Understanding | 89,3 % | — | 72,1 % | 68,7 % | 88,1 % |
| Multi-Agent Tasks | 84,7 % | 69,3 % | 61,8 % | 78,2 % | 76,5 % |
| Long-Context Recall | 91,2 % | 83,4 % | 78,9 % | 88,6 % | 84,3 % |
Benchmarky k dátumu vydania (marec 2026). Výsledky tretích strán sa môžu mierne líšiť.
Dostupnosť a cenník
ChatGPT plány
| Plán | GPT-5.4 prístup | Persistent Agents | Video generovanie | Cena |
|---|---|---|---|---|
| Free | ✅ (limitovaný) | ❌ | ❌ | $0 |
| Plus | ✅ | ✅ (3 agenti) | ✅ (10 min/deň) | $20/mesiac |
| Pro | ✅ (prioritný) | ✅ (neobmedzené) | ✅ (neobmedzené) | $200/mesiac |
| Team | ✅ | ✅ (team-wide) | ✅ | $25/osoba/mesiac |
| Enterprise | ✅ (dedikovaný) | ✅ (custom) | ✅ (custom) | Individuálne |
API prístup
| Model | Input (1M tokenov) | Output (1M tokenov) | Cached input | Poznámka |
|---|---|---|---|---|
| gpt-5.4 | $3,00 | $15,00 | $0,75 | Plný model s reasoning |
| gpt-5.4-mini | $0,40 | $1,60 | $0,10 | Rýchly, cenovo efektívny |
| gpt-5.4-nano | $0,10 | $0,40 | $0,025 | Ultra-rýchly pre jednoduché úlohy |
Prompt caching (cached input cena) znižuje náklady na opakované dlhé systémové promptúry o 75 %. Pre produkčné aplikácie s fixným systémovým promptom je caching zásadný.
Bezpečnosť a alignment
Kľúčové bezpečnostné vylepšenia
- Deliberative Alignment: Pri každej odpovedi model konzultuje internalizované bezpečnostné pravidlá a vie vysvetliť svoje rozhodnutia. Ide o prechod od reaktívnych filtrov k proaktívnemu hodnoteniu.
- Vylepšené Safe Completions: Namiesto odmietnutia citlivých otázok model poskytuje bezpečné, vzdelávacie odpovede s kontextom — čo znižuje frustráciu legitímnych používateľov a zároveň chráni pred zneužitím.
- Red-teaming výsledky: OpenAI spolupracoval s 15+ externými organizáciami na testovaní bezpečnosti pred vydaním, vrátane nezávislých bezpečnostných laboratórií a akademických inštitúcií.
- Watermarking: Všetok generovaný obsah (text, obraz, video) obsahuje digitálny vodoznak identifikujúci AI pôvod. Vodoznak je odolný voči bežným úpravám (kompresia, orezávanie, zmena formátu).
- Audit log pre agentické akcie: Každá akcia vykonaná agentom je zaznamenávaná s časovou pečiatkou, zdôvodnením a odkazom na pôvodný príkaz. V Enterprise plánoch je log dostupný pre compliance audit.
Známe obmedzenia
- Halucinácie sú výrazne znížené, ale nie eliminované — najmä pri obscúrnych faktických otázkach a nedávnych udalostiach mimo trénovacie dáta.
- Video generovanie produkuje artefakty pri komplexných scénach s viacerými pohybujúcimi sa objektmi a rýchlymi prechodmi.
- Persistent agents vyžadujú pravidelný human-in-the-loop checkpoint pre kritické úlohy — plná autonómia pri vysokorizikových akciách nie je odporúčaná ani konfigurovateľná.
- Kontextové okno 1M tokenov zvyšuje latenciu prvého tokenu pri plnom využití — pre real-time aplikácie je preto vhodnejší gpt-5.4-mini.
Praktické využitie a prípadové štúdie
Štyri mesiace po vydaní sa objavili vzory skutočného nasadenia, ktoré stoja za zmienku:
Zákaznícka podpora (Tier 1–2): Persistent agenti s prístupom do CRM systémov zvládnu väčšinu Tier 1 dopytov bez ľudského zásahu. Medián riešenia klesol o 60 % v pilotných nasadeniach. Kritický faktor úspechu je kvalita systémového promptu a jasná definícia eskalačných pravidiel.
Výskum a due diligence: Pro používatelia využívajú dlhý kontext na analýzu stoviek strán dokumentov (výročné správy, právne zmluvy, vedecké štúdie) v jednom behu. Výstup je štruktúrovaný súhrn s odkazmi na konkrétne pasáže — overiteľný a auditovateľný.
Vzdelávanie: Personalizované tutorstvo s dlhodobou pamäťou — model pozná pokrok študenta naprieč týždňami, adaptuje obtiažnosť a identifikuje opakujúce sa slabé miesta. Efektívne najmä pre matematiku, programovanie a jazyky.
Tvorivá produkcia: Krátke reklamné videá, editácia záberov z dronov, generovanie produktových vizualizácií. Kvalita je dostačujúca pre social media obsah; pre broadcast produkciu stále nestačí.
Ekosystém a integrácie
OpenAI výrazne investoval do ekosystému okolo GPT-5.4:
- GPT Store 2.0: Nová verzia obchodu s dôrazom na agentické aplikácie. Kategória „Agents" prekonala v počte publikácií kategóriu „Chatbots" v priebehu prvého mesiaca po vydaní.
- Operator API: Rozhranie pre firmy na vytváranie vlastných ChatGPT prostredí s firemnou identitou, vlastnými bezpečnostnými pravidlami a izolovanou pamäťou.
- Microsoft 365 Copilot: GPT-5.4 pohání Copilot v celej produktívnej súprave Microsoft — Word, Excel, Teams, Outlook. Tesnú integráciu oceňujú hlavne firemní používatelia, ktorí neprechádzajú na ChatGPT samotnú.
- Plugin ekosystém → MCP: OpenAI prešiel na Model Context Protocol (MCP) ako štandard pre nástroje tretích strán, čo zvýšilo kompatibilitu s nástrojmi budovanými pre iné modely (Anthropic, Google).
Porovnanie s konkurenciou
| Vlastnosť | GPT-5.4 | Claude Opus 4.6 | Gemini 3 Pro | Grok 3 |
|---|---|---|---|---|
| Reasoning | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐ | ⭐⭐⭐⭐ |
| Kódovanie | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐ | ⭐⭐⭐ |
| Multimodalita | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐ | ⭐⭐⭐⭐⭐ | ⭐⭐⭐ |
| Agenti | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐ | ⭐⭐⭐⭐ | ⭐⭐⭐ |
| Kontextové okno | ⭐⭐⭐⭐ | ⭐⭐⭐⭐ | ⭐⭐⭐⭐⭐ | ⭐⭐⭐ |
| Bezpečnosť a alignment | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐ | ⭐⭐⭐ |
| Open-source | ❌ | ❌ | ❌ | Čiastočne |
| Cena (API) | Stredná | Stredná–vysoká | Nízka–stredná | Nízka |
Kľúčové rozlíšenie: GPT-5.4 vedie v šírke schopností a agentickej infraštruktúre; Claude Opus 4.6 je preferovanou voľbou pre dlhú, nuansovanú textovú prácu a bezpečnostne citlivé nasadenia; Gemini 3 Pro vyniká v multimodalite a integráciách s Google Workspace.
Aktualizácie od vydania (marec – júl 2026)
OpenAI vydal od marca niekoľko incrementálnych aktualizácií:
- Apríl 2026 — gpt-5.4-0415: Zlepšená faktická presnosť pri otázkach o udalostiach do januára 2026. Znížená miera odmietnutí pri legitímnych kreatívnych a výskumných úlohách.
- Máj 2026 — Video Gen 1.1: Výrazné zlepšenie konzistencie postáv naprieč scénami a redukcia artefaktov pri pohybe. Maximálna dĺžka generovaného videa predĺžená z 60 na 180 sekúnd.
- Jún 2026 — Agents Protocol v1.1: Štandardizácia komunikácie medzi agentmi rôznych poskytovateľov. Podpora asynchrónnych agentských volaní s garantovaným doručením výsledkov.
- Júl 2026 — Scheduled Agents (beta): Agenti môžu byť spustení podľa časového plánu bez aktívnej konverzácie — krok k plne autonómnym pracovným tokom.
Pre koho je GPT-5.4 určený
- Vývojári: Plnohodnotný AI pair-programmer s persistent session, multi-repo kontextom a Tool Discovery. Najväčšia hodnota pri komplexných refaktoringoch a debug sedeniach naprieč veľkými kódovými základňami.
- Firmy: Autonómni agenti pre zákaznícku podporu, analýzu dát a automatizáciu procesov. Návratnosť investície je najrýchlejšia tam, kde dnes sedí tím ľudí a spracúva opakujúce sa dotazy.
- Kreatívci: Generovanie a editácia videa, 3D obsahu a interaktívnych aplikácií. Použiteľné pre prototypovanie a social media produkciu — nie pre broadcast.
- Študenti a výskumníci: Hlboká analýza vedeckých prác, pomoc s výskumom a písaním. Milión tokenov kontextu mení charakter literárnych rešerší.
- Bežní používatelia: Inteligentný osobný asistent s dlhodobou pamäťou, proaktívnymi schopnosťami a personalizáciou. Najväčší skok oproti GPT-5.2 pocíti ten, kto model používa každý deň opakovane.
Záver
GPT-5.4 je doteraz najkomplexnejší model v portfóliu OpenAI a po štyroch mesiacoch v produkčnom nasadení sa ukazuje, že jeho najsilnejšia stránka nie je žiadna jednotlivá funkcia — je to integrácia. Reasoning, pamäť, agenti a multimodalita fungujú ako súdržný systém, nie ako zbierka oddeleného toolingu.
Konkurencia drží krok: Claude Opus 4.6 prevyšuje v dlhej textovej práci a safety, Gemini 3 Pro v multimodalite a Google ekosystéme. GPT-5.4 vyniká tam, kde potrebujete jedno riešenie naprieč mnohými typmi úloh — čo je presne to, čo väčšina firiem a pokročilých individuálnych používateľov hľadá.
Najdôležitejšia lekcia z prvých mesiacov nasadenia: kvalita výsledkov závisí od kvality promptovania a architektúry agentských workflow viac ako kedykoľvek predtým. Samotný model je silný — ale jeho plný potenciál sa prejaví len s premyslenou implementáciou.
Tip: Ak prechádzate z GPT-5.2 alebo 5.3-Codex, najväčší rozdiel pocítite v agentických schopnostiach a video funkcionalite. Pre čisto kódovacie úlohy zostáva GPT-5.3-Codex v API stále konkurencieschopnou a cenovo výhodnejšou voľbou.