Ve zkratce
  • Claude Opus 5.5 (Anthropic, 22. 9.): 4 USD vstup / 20 USD výstup za milion tokenů, o 20 % méně než Opus 5. Čtení z cache kleslo z 0,50 na 0,20 USD. Anthropic hlásí výkon na úrovni Fable 5.1 na většině práce a o 40 % nižší náklady na typickou úlohu.
  • GPT-6 Sol (OpenAI, 22. 9.): 2 / 10 USD, přesně polovina ceny GPT-5.6 Sol. GPT-6 Luna: 0,10 / 0,50 USD, tedy sedmkrát levnější než Gemini 3.8 Flash.
  • Mezi vlajkovými modely za 10 / 50 USD a levnou třídou vznikla střední třída, která před týdnem v této podobě neexistovala. Právě tam patří většina úloh, kde jde o úsudek.
  • Háčky: Opus 5.5 se nedá spustit bez „uvažování“, čísla o výkonu jsou od výrobců a každá změna modelu znamená test na vlastních datech.

Před třemi týdny jsme psali, že dva nejsilnější modely na trhu se shodly na ceně 10 a 50 dolarů za milion tokenů. V úterý 22. září se titíž dva výrobci tentýž den pustili do středu trhu. Anthropic vydal Claude Opus 5.5, OpenAI vydalo GPT-6 Sol a GPT-6 Luna. Společný jmenovatel není nový rekord v benchmarku, ale ceník: téměř vlajkový výkon za pětinu až dvě pětiny vlajkové ceny. Pro firmu, která si v létě přepočítávala AI automatizaci a vyšlo jí, že se nevyplatí, je to důvod přepočítat to znovu.

Co vyšlo, bez marketingu

Claude Opus 5.5

Nástupce Opus 5. Stojí 4 dolary za milion vstupních a 20 dolarů za milion výstupních tokenů, Opus 5 stál 5 a 25. Větší změna je v cache: čtení už jednou poslaného kontextu kleslo z 0,50 na 0,20 dolaru za milion tokenů, zápis do cache z 6,25 na 5 dolarů. Anthropic k tomu tvrdí, že model dokončí stejnou úlohu s menším počtem tokenů, takže typická agentická práce vyjde zhruba o 40 % levněji než na Opus 5. Výkon má být na většině práce na úrovni Fable 5.1, která stojí 10 a 50 dolarů, a na třech testech agentické práce v terminálu a v kódu ji podle výrobce překonává. Dostupný je přes API i na Amazon Web Services, Google Cloud a Microsoft Azure.

Dvě změny, které v titulcích nebudou. Za prvé, Opus 5.5 se už nedá spustit bez režimu uvažování. Model před odpovědí vždy přemýšlí, což je u složité úlohy výhoda a u třídění e-mailů zbytečné výstupní tokeny navíc, tedy ty za 20 dolarů. Za druhé, většinu úloh z oblasti kybernetické bezpečnosti model automaticky přesměruje na starší Opus 4.8 a na práci s biologickými daty je potřeba ověření. Běžné firmy se to netýká, ale kdo staví agenta, který má například kontrolovat bezpečnost vlastního webu, má s tím počítat.

GPT-6 Sol a GPT-6 Luna

Dva menší sourozenci GPT-6 Astra, která vyšla 3. září. Sol je model na běžnou náročnější práci, tedy psaní a kontrolu kódu, analýzu dat a vícekrokové úlohy, a stojí 2 dolary za milion vstupních a 10 dolarů za milion výstupních tokenů. GPT-5.6 Sol stál 4 a 20, zlevnění je přesně poloviční. Luna je objemový model na úlohy s jasným zadáním, tedy shrnutí, vytahování údajů z dokumentů a rychlé odpovědi, za 0,10 a 0,50 dolaru. GPT-5.6 Luna stála 0,20 a 1,20. OpenAI tvrdí, že Sol dělá zhruba polovinu chyb oproti předchůdci a blíží se spolehlivosti Astry. V API se modely jmenují gpt-6-sol a gpt-6-luna, do placených plánů ChatGPT a do Codexu přicházejí postupně.

S modely přišla i lepší cache: opakovaně posílaný začátek promptu, typicky instrukce a firemní dokumentace, má slevu až 90 % a drží se aspoň 30 minut od posledního použití. Vývojář si nově může určit, která část promptu se má uložit, a cache předehřát ještě před prvním dotazem uživatele. Pro asistenta nad firemní bází je to důležitější zpráva než samotná cena modelu, k tomu se vrátíme níže.

Nový ceník: tři třídy místo dvou

  • Vlajková třída — Claude Fable 5.1 a GPT-6 Astra: 10 / 50 USD za milion tokenů (vstup / výstup)
  • Střední třída — Claude Opus 5.5: 4 / 20 USD. GPT-6 Sol: 2 / 10 USD
  • Levná třída — Gemini 3.8 Flash: 0,75 / 3,75 USD do 31. 12. 2026, od ledna 1,50 / 7,50 USD. GPT-6 Luna: 0,10 / 0,50 USD

Ještě začátkem září byla volba jednoduchá: buď drahý model za 10 a 50 dolarů, nebo levný za méně než dolar, a mezi nimi Opus 5 za 5 a 25. Dnes je střed obsazený dvěma modely, které výrobci sami staví vedle svých vlajkových lodí. A na spodku Luna podlezla Gemini Flash sedminásobně, přičemž Flash od ledna zdraží na dvojnásobek. Všechny ceny jsou v dolarech bez DPH a čísla o výkonu jsou zatím od výrobců, nezávislá měření přijdou za týdny.

Co to znamená v číslech: dva modelové příklady

Třídění pošty

Firma, která nechá AI přečíst a roztřídit 5 000 e-mailů měsíčně s krátkým návrhem odpovědi, pošle modelu zhruba 7,5 milionu tokenů a dostane zpět 1,5 milionu. Na Luně to stojí 1,50 dolaru měsíčně, na Sol 30 dolarů, na Opus 5.5 60 dolarů a na Fable 5.1 nebo Astře 150 dolarů. U tohoto typu úlohy je cena modelu nepodstatná proti ceně integrace a jediná otázka je, který z levných modelů dělá na vašich e-mailech nejméně chyb.

Asistent nad firemní dokumentací

Asistent na webu nebo pro zaměstnance, který má v kontextu firemní bázi s 50 000 tokeny (zhruba sto stran textu) a měsíčně odbaví 3 000 rozhovorů po čtyřech otázkách, načte tu bázi z cache dvanácttisíckrát, tedy 600 milionů tokenů. Na Opus 5 to bylo 300 dolarů měsíčně, na Opus 5.5 je to 120 dolarů, na Sol stejně 120 a na Luně 6 dolarů. Nové otázky a odpovědi jsou při tom objemu drobné. Tohle je místo, kde se dnešní zlevnění projeví nejvíc: ne v ceně za nový token, ale v tom, kolik stojí model, který si pamatuje.

Které úlohy se tím přepočítají

Úlohy odložené kvůli ceně drahého modelu

Revize smluv, kontrola složitějších dokladů, agent, který sám projde interní systém a doplní záznamy. Dosud platilo, že na tyhle úlohy je potřeba vlajkový model, a jeho cena návratnost často zabila. Pokud Opus 5.5 a Sol dělají to, co tvrdí výrobci, jde o stejnou práci za 60 až 80 % méně než na vlajkovém modelu. Otestujte je na vlastních vzorcích, ne na benchmarku.

Objemové rutiny, které už běží na levném modelu

Extrakce z dokladů, klasifikace, shrnutí, překlady. Luna je sedmkrát levnější než Gemini Flash a Flash od ledna zdraží. Zní to jako jasná výměna, ale není: u levné třídy je účet za model tak malý, že rozhoduje výhradně chybovost. Model, který ušetří pět dolarů měsíčně a jednou za den špatně přečte částku na faktuře, je dražší než ten předchozí.

Asistenti a agenti, kteří stojí na cache

Chatbot nad znalostní bází, agent, který při každém kroku znovu čte instrukce a dosavadní výsledky. Tady je zlevnění největší a týká se obou výrobců naráz. Podmínkou je, aby integrace s cache pracovala vědomě, tedy aby se neměnný kontext posílal vždy stejně a na začátku. Pokud si tohle někdo při stavbě nepohlídal, dnešní slevy se na jeho účtu neprojeví.

Kde je háček

  • Opus 5.5 vždy uvažuje. U jednoduchých úloh utrácí výstupní tokeny za přemýšlení, které nikdo nepotřebuje. Na třídění pošty je nesprávná volba ne kvůli ceně za token, ale kvůli tomu, co s tokeny dělá.
  • „Polovina chyb“ a „úroveň Fable“ jsou tvrzení výrobců. Měří se na jejich testech. Jediné měření, na kterém záleží, je sto vašich dokumentů s ručně ověřeným výsledkem.
  • Změna modelu není zadarmo ani u téhož dodavatele. Jiný model odpovídá jinak, jinak drží formát a jinak reaguje na okrajové případy. Regresní test na vlastních vzorcích je půl dne práce a přeskočit ho se nevyplácí.
  • Ceny jsou v dolarech a mění se oběma směry. Gemini Flash od ledna zdraží, Sonnet 5 v srpnu skončil se zaváděcí cenou. Návratnost, která funguje jen při dnešním ceníku, není návratnost.

Kdy vás to nezajímá

  • Používáte AI přes chat — Opus 5.5 i GPT-6 Sol přijdou do placených plánů v rámci předplatného. Nic neřešíte.
  • Máte pár dotazů denně — u stovek požadavků měsíčně je rozdíl mezi třídami v jednotkách korun až stokorun. Vybírejte podle kvality.
  • Běžíte na levném modelu a stačí — přechod na střední třídu kvůli benchmarkům účet zvýší a u jednoduchých úloh výsledek nezmění.

Odložili jste v létě automatizaci, protože vyšla draho? Napište nám dvě věty o tom, co měla dělat, a do 24 hodin řekneme, do které třídy dnes patří a co by provoz stál při nových cenách. Zdarma a bez telefonátů.

Co s tím udělat tento měsíc

  • Vytáhněte ze šuplíku propočty, které nevyšly. U střední třídy za 2 až 4 dolary na vstupu může vyjít to, co při 10 dolarech nevyšlo.
  • Pokud máte proces na Opus 5, otestujte Opus 5.5 na vlastních vzorcích. Stejné API, nižší cena, ale vždy zapnuté uvažování. Sledujte počet výstupních tokenů, nejen cenu za milion.
  • Podívejte se, jak vaše integrace pracuje s cache. Pokud neměnný kontext neposílá vždy stejně a na začátku, dnešní slevy vás minou. Bývá to hodina práce s nejvyšším výnosem.

Časté otázky

Je Claude Opus 5.5 opravdu stejně dobrý jako Fable 5.1?
Podle Anthropicu na většině práce ano a na třech testech agentické práce v terminálu a v kódu je i lepší. Je to však měření výrobce na jeho vlastních testech. Fable 5.1 zůstává modelem na nejtěžší uvažování a Anthropic ji dál prodává za 10 a 50 dolarů. Pro firmu je jediná spolehlivá odpověď test na vlastních dokumentech: sto vzorků, ručně ověřený výsledek, srovnání chybovosti a spotřeby tokenů.
Máme proces na Opus 5. Máme přejít na Opus 5.5?
Pravděpodobně ano, ale ne bez testu. Cena je o pětinu nižší a čtení z cache o 60 % levnější, takže účet klesne téměř jistě. Opus 5.5 se však nedá spustit bez režimu uvažování, což u jednoduchých úloh zvýší počet výstupních tokenů. Spusťte oba modely na stejných vzorcích a porovnejte nejen kvalitu, ale i spotřebu tokenů na jednu úlohu.
Dá se GPT-6 Luna za 0,10 dolaru použít na něco vážného?
Na úlohy s jasným zadáním a strojovou kontrolou ano: vytahování údajů z dokladů, třídění, shrnutí, překlady. Ne na úsudek nad složitým dokumentem. Je sedmkrát levnější než Gemini 3.8 Flash, ale při těchto cenách je účet za model tak malý, že rozhoduje jen chybovost na vašich datech. Otestujte ji na sto vlastních vzorcích dřív, než něco přepnete.
Proč je cena za cache důležitější než cena za vstup?
Asistent nad firemní bází i agent, který pracuje v krocích, posílají modelu při každém dotazu znovu tentýž kontext: instrukce, dokumentaci, dosavadní průběh. Ten se čte z cache a tvoří většinu účtu. Opus 5.5 ho čte za 0,20 dolaru za milion tokenů, tedy za dvacetinu ceny nového vstupu, a OpenAI dává na cache slevu až 90 % a drží ji aspoň 30 minut. Podmínkou je integrace, která neměnný kontext posílá vždy stejně a na začátku.
Co znamená, že Opus 5.5 přesměruje bezpečnostní úlohy na starší model?
Anthropic většinu úloh z kybernetické bezpečnosti nepouští do Opus 5.5 a automaticky je odbaví starší Opus 4.8. Běžných firemních automatizací se to netýká. Počítat s tím má firma, která staví agenta na kontrolu bezpečnosti vlastních systémů: dostane odpověď od jiného modelu, než si objednala, a měla by to v testech vidět.

Závěr

Dvacátý druhý září nepřinesl nový nejlepší model, přinesl levnější dobrý model od obou hlavních výrobců naráz. Vznikla střední třída, ve které se dá koupit úsudek za pětinu až dvě pětiny vlajkové ceny, a levná třída klesla tak nízko, že o výběru rozhoduje jen chybovost. Největší úspora přitom není v ceně za token, ale v cache, a tu je potřeba mít v integraci postavenou. Stavíme AI řešení pro firmy převážně na Claude, ale tak, aby se model dal vyměnit. Napište nám, který proces jste kvůli ceně odložili, a přepočítáme ho při dnešním ceníku.

Autor Ondrej Remeselník

Zakladatel a vývojář DataStorm. Ve vývoji softwaru od roku 1999 — weby, aplikace a systémy pro firmy jako IAD Investments, DPD či SME. Píše z praxe, ne z doslechu.