OpenAI vydal GPT 5.5. Jde o velkou věc, protože je to první zcela přetrénovaný základní model od GPT 4.5. Každý model mezi GPT 5 a GPT 5.4 byl iterací tréninku na stejném základu. Podle OpenAI je GPT 5.5 vytvořen od nuly s novou architekturou, novým tréninkovým korpusem a novými cíly orientovanými na agenty — ačkoli někteří nezávislí recenzenti poznamenávají, že se spíše jedná o významné vylepšení po tréninku než o kompletní přestavbu.
Co je tedy GPT 5.5? Jedná se o model OpenAI, navržený primárně pro úlohy, kde AI potřebuje plánovat, provádět, samo se korigovat a pokračovat bez neustálého lidského vstupu. Prezident OpenAI Greg Brockman říká, že dokáže "podívat se na nejasný problém a zjistit, co je třeba udělat dál." To znamená, že GPT 5.5 zvládá volně definované úlohy tak, jak by je zvládl senior inženýr.
GPT 5.5 byl spuštěn 23. dubna pro placené uživatele, včetně uživatelů služeb ChatGPT Plus, Pro, Business a Enterprise, stejně jako uživatelů Codex. Přístup přes API bude brzy k dispozici, jakmile OpenAI finalizuje svá opatření v oblasti kybernetické bezpečnosti. Jednou z vynikajících vlastností GPT 5.5 je, že je vybaven oknem kontextu s 1 milionem tokenů v API, zatímco uživatelé Codex dostávají 400K.
Ale co konkrétně znamená "agentický" v praxi?
GPT 5.5 se neomezuje jen na odpověď na vaši otázku. Provádí sekvenci akcí, používá nástroje, kontroluje svou práci a pokračuje, dokud není úloha dokončena. Dáte mu víceúrovňový problém a on naplánuje trasu, provede ji a ověří výsledek bez nutnosti, aby ho člověk znovu vyzval v každém kroku.
GPT 5.5 má několik čísel
- Dosahuje 82,7 % na Terminal-Bench 2.0, který testuje pracovní postupy příkazového řádku.
- Dosahuje 58,6 % na SWE-Bench Pro, který vyhodnocuje řešení reálných problémů na GitHubu.
- Dosahuje skóre 60 na Artificial Intelligence Index, což ho umisťuje na vrchol žebříčku.
Existuje praktický příklad, jak lze GPT 5.5 používat. Vlastní finanční tým OpenAI použil Codex běžící GPT 5.5 k analýze 24 771 daňových formulářů K-1 v celkovém rozsahu 71 637 stran. To urychlilo proces o dva týdny ve srovnání s předchozím rokem.
Jak se tedy GPT 5.5 srovnává s modely jako Claude Opus 4.7 a Gemini 3.1 Pro?
Záleží na úloze. GPT 5.5 vede v úlohách plánování a provádění, zatímco Claude Opus 4.7 má výhodu v úlohách "opravit chybu v reálné kódové základně". Gemini 3.1 Pro Preview dosahuje 92,6 % v vícejazyčných úlohách a konkuruje nižší cenou.
Jednou z věcí, která je důležitější než skóre v benchmarku, je efektivnost. GPT 5.5 je navržen tak, aby dosáhl výstupů s menším počtem tokenů a menším počtem pokusů. Podle Artificial Analysis používá o 40 % méně tokenů k dokončení stejných úloh Codex ve srovnání s GPT 5.4.
Ceny GPT 5.5 jsou $5/$30 za milion vstupních/výstupních tokenů, což je dvojnásobek ceny GPT 5.4. Zisky z efektivnosti tokenů to částečně kompenzují v reálných úlohách. Pro týmy, které provádějí více než přibližně 4 miliony výstupních tokenů měsíčně, je předplatné ChatGPT Pro plus Codex CLI pravděpodobně levnější než fakturace API na základě využití.
Co to tedy znamená pro softwarové týmy a vývojáře?
Skutečná změna s GPT 5.5 není vedení v benchmarku, ale změna pracovního postupu, kterou umožňuje — model je vytvořen tak, aby fungoval jako "šéf kanceláře" v kódovacích potrubích, něco, co lze pověřit vágní úlohou, rozložit ji na dílčí úlohy, provést je s nástroji a ověřit výstup před vrácením.
Pro inženýrské týmy to znamená, že se bottleneck posouvá. Nemusíte psát konkrétní výzvu, abyste dostali dobrý výstup. Musíte vědět, jak zkontrolovat a směrovat výstup z modelu, který už pracuje autonomně. Toto je jiná dovednost než promptní inženýrství.
Zde jsou některé praktické tipy pro používání GPT 5.5:
- Používejte GPT 5.5 pro end-to-end úlohy implementace funkcí v Codex, dlouhodobou práci, kde předchozí modely vyžadovaly lidskou korekcí uprostřed úlohy.
- Používejte jej pro ladění ve velkém měřítku - OpenAI cituje týmy, které zkrátily dobu ladění "ze dní na hodiny" na komplexních kódových základnách.
- Prozkoumejte automatizaci znalostní práce mimo kód, zpracování dokumentů, generování tabulek a shrnutí výzkumu.
- Směrování podle obtížnosti — Nepoužívejte GPT 5.5 na všechno. Používejte GPT 5.4 mini nebo podobné pro jednoduší úlohy a rezervujte GPT 5.5 pro složité víceúrovňové práce, kde je nárůst inteligence opravdu ospravedlnit cenu.
- GPT 5.5 má stále některé mezery. Celkově jde o mocný nástroj, který může softwarovým týmům a vývojářům pomoci pracovat efektivněji.
Benchmarky
Upřímnost je opravdu důležitá, když mluvíme o benchmarks.
GPT 5.5 není tak dobrý jako Claude Opus 4.7 na SWE-Bench Pro. Toto je test, který je velmi podobný opravování reálného problému na GitHubu v kódové základně, která používá mnoho jazyků. GPT 5.5 dosáhl 58,6 % zatímco Claude Opus 4.7 dosáhl 64,3 %. GPT 5.5 také nedosáhl dobrých výsledků v porozumění jazykům. Dosáhl 83,2 % na MMMLU zatímco Opus 4.7 dosáhl 91,5 %. Gemini 3.1 Pro dosáhl 92,6 %. (Pozn.: tato čísla pochází z vlastních hlášených benchmarků OpenAI a nebyla nezávisle ověřena v době vydání.) Toto je velký rozdíl pro týmy, které pracují s kódovými základnami nebo uživatele z celého světa. Měli by na to myslet před přechodem na GPT 5.5.
Snad nejdůležitější slabostí, kterou je třeba zdůraznit, je míra halucinací GPT 5.5. Nezávislé testování společnosti Artificial Analysis zaznamenalo míru halucinací 86 % v jejich evaluaci AA-Omniscience, ve srovnání s Claude Opus 4.7 na 36 % a Gemini 3.1 Pro Preview na 50 %. Model zná více než cokoliv jiného, co bylo testováno — a sebevědomě dá špatnou odpověď téměř dvakrát a půlkrát více než jeho nejbližší konkurent. Pro produkční případy použití, kde záleží na přesnosti, toto není marginální poznámka.
Cena API také roste. Nejde o číslo v titulku. Týmy, které používají GPT 5.5 hodně, by měly jej testovat se svou práci a vypočítat si, kolik je to bude stát. Další společnosti jako Anthropic a Google také pracují na modelech AI, což znamená, že se ceny mohou změnit v příštích několika měsících. OpenAI v minulosti snížil ceny po vydání modelů.
Je tedy GPT 5.5 model AI na kódování právě teď?
Pro úlohy kódování, které jsou složité a vyžadují spoustu myšlení, je GPT 5.5 pravděpodobně nejlepší. Pro opravování chyb v existujících kódových základnách je Claude Opus 4.7 stále lepší. Pro týmy, které se zajímají o náklady, je Gemini 3.1 Pro Preview také dobrou volbou. Trh pro modely AI je nyní velmi konkurenční. Žádný jednotlivý model není nejlepší v každé kategorii.
Jedna věc je jasná: GPT 5.5 je krok vpřed v technologii AI. Byl vytvořen od nuly. Zvládá složité úlohy kódování na vlastní pěst. Zda je to warto dodatečného nákladu, závisí na tom, jak to používáte. Měli byste jej pečlivě otestovat, než se rozhodnete přejít.
Nejlepší model AI není vždy ten, který dosahuje nejlepšího výkonu v benchmarks. Je to ten, který je nejlépe vhodný pro to, co potřebujete dělat.
TL;DR
GPT 5.5 je model AI OpenAI a byl vytvořen tak, aby zvládal úlohy kódování na vlastní pěst. Dosahuje dobrých výsledků v benchmarks a používá méně tokenů a je dobrý v řešení komplikovaných problémů. Stojí dvakrát tolik jako starý model, ale je efektivnější. Pro opravování chyb je Claude Opus 4.7 stále lepší. Pro všechno ostatní je GPT 5.5 nejlepší model AI na kódování právě teď.
Chcete vytvořit vysoce výkonný vzdálený technický tým?
Podívejte se na MyNextDeveloper, platformu, kde můžete najít top 3 % softwarových inženýrů, kteří jsou hluboko zapáleni pro inovaci. Naše řešení software talentu na vyžádání, dedikovaná a důkladná poskytují komplexní řešení pro všechny vaše softwarové požadavky.
Navštivte naše webové stránky, abyste se dozvěděli, jak vám můžeme pomoci při sestavování vašeho dokonalého týmu.




