Přeskočit na obsah
Čísla 3 min čtení

Anthropic slibuje u Opusu 5.5 o 40 % nižší náklady, sazby za tokeny klesly o pětinu

Anthropic vydal Claude Opus 5.5 a slibuje u něj o 40 % nižší náklady než u Opusu 5. V ceníku ale žádná položka o 40 % neklesla: tokeny zlevnily o pětinu, čtení z cache o tři pětiny. Kolik z toho na konkrétním účtu vyjde, rozhoduje podíl cache.

Anthropic vydal 22. září model Claude Opus 5.5 a hned do úvodní věty oznámení dal číslo 40 %: o tolik má být provoz levnější než u Opusu 5. V ceníku ale žádná položka o 40 % neklesla. Vstupní i výstupní tokeny zlevnily o pětinu, čtení z cache o tři pětiny.

Stolní elektronická kalkulačka
Stolní kalkulačka Aurora DT210. Foto: Coyau, Wikimedia Commons (CC BY-SA 3.0)

Pětina dolů u všeho kromě čtení z cache

Sazby vede ceník Claude Platform a shodně je uvádí i OpenRouter, tedy někdo mimo Anthropic. Platí od vydání, tedy od 22. září 2026.

za milion tokenůOpus 5.5Opus 5rozdíl
vstup4 $5 $−20 %
výstup20 $25 $−20 %
zápis do cache na 5 minut5 $6,25 $−20 %
zápis do cache na hodinu8 $10 $−20 %
čtení z cache0,20 $0,50 $−60 %

Čtení z cache je účtování za tu část dotazu, kterou model jednou zpracoval a má ji odloženou stranou. U agentů a u práce nad kódem je to většina všech tokenů, protože se s každým dalším krokem posílá znovu celá dosavadní konverzace. Cena se odvozuje od sazby za vstup násobkem a ten se u novějších modelů mění: u většiny nabídky je to desetina vstupní sazby, u Opusu 5.5 dvacetina a u Fable 5.1 čtyřicetina. Čtení z cache tedy zlevnilo dvakrát – jednou spolu se vstupem, podruhé změnou toho násobku.

Kdy z ceníku vyjde těch 40 %

Všechny položky kromě čtení z cache klesly přesně o pětinu, takže se celková úspora dá spočítat. Kdo cache nepoužívá vůbec, zaplatí o 20 % míň. Každé procento účtu, které dřív padlo na čtení z cache, přidá k tomu dalších 0,4 procentního bodu. Na 40 % se plátce dostane v okamžiku, kdy čtení z cache dělalo ve starých sazbách přesně polovinu faktury; při třech čtvrtinách vyjde 50 %. Je to náš dopočet ze dvou ceníků, Anthropic ho takhle nepředkládá.

Firma sama vysvětluje těch 40 % v oznámení dvakrát a pokaždé jinak. Poprvé to svádí na ceník – nižší sazby za tokeny a za čtení z cache, o kterém tamtéž píše, že tvoří většinu nákladů agentní práce a práce nad kódem. Podruhé, pod tabulkou výsledků, stojí, že model stojí míň za token a spotřebuje méně tokenů na úkol, což dohromady dává pokles o 40 %. Druhá půlka téhle věty není cena, ale chování modelu, a to se z ceníku ověřit nedá. Jakou skladbu dotazů má oznámení na mysli, když mluví o obvyklé zátěži, neuvádí.

Co za ty peníze zákazník dostane

Model se v rozhraní jmenuje claude-opus-5-5 a podle poznámek k vydání má ve výchozím nastavení okno milion tokenů a strop 128 tisíc tokenů na výstup. Uvažování je natrvalo zapnuté: požadavek, který ho vypíná, vrátí chybu 400 a hloubka se řídí jen parametrem effort. Dostupný je na rozhraní Anthropicu, na Amazon Bedrock, v Google Cloudu a v Microsoft Foundry.

Vedle běžného provozu má tenhle model i rychlý režim se zrychlením až 2,5krát. Ten stojí 8 $ za milion vstupních a 40 $ za milion výstupních tokenů, tedy dvojnásobek základní sazby. Sonnet 5.5 a Haiku 5.5 mají podle oznámení přijít v nadcházejících týdnech; ceny u nich firma zatím neuvedla.

Čísla z testů měřil většinou sám výrobce

Tabulka v oznámení dává Opusu 5.5 na testu Terminal-Bench 4.0 66,4 % proti 52,3 % u Opusu 5 a 57,9 % u GPT-6 Astra. Měřil to Anthropic sám, směrodatná chyba je u nového modelu ±2,6 bodu a každý sloupec běžel na jiném nastavení – nový model na stupni xhigh, model OpenAI na high, protože se u obou bere nejlepší dosažené skóre. Čísla za modely OpenAI navíc firma přebírá od OpenAI, sama je neměřila.

Poznámka pod tabulkou přiznává ještě jednu věc: když při testu zasáhly ochrany nového modelu, dokončil bezpečnostní úlohy Opus 4.8 a úlohy z biologie a z vývoje modelů Opus 5. Část řádku tedy nenaměřil model, který je v jeho záhlaví. Anthropic k tomu dodává, že to skóre Opusu 5.5 spíš snižuje, a o výsledcích obecně píše, že rozestupy mezi modely na téhle úrovni už o rozdílu v praxi mnoho neříkají.

Jestli u konkrétního zákazníka platí dvacet procent, nebo čtyřicet, se pozná bez jediného testu: stačí se v posledním vyúčtování podívat, jaký podíl částky padl na čtení z cache. Pod polovinou je sleva menší než slibovaná, nad ní větší.

Zdroje

Diskuse

Zatím tu nikdo nediskutuje. Můžete být první.

Napsat příspěvek

Diskutovat můžete i bez účtu. S registrací se ale příspěvek zveřejní hned a nemusíte pokaždé vyplňovat jméno. Účet už máte? Přihlaste se.

Nezveřejňujeme ho, slouží jen redakci.

Podporuje zápis Texy: **tučně**, *kurzíva*, odrážky, odkazy.

Dál k tématu

  1. Čísla

    Claude API účtuje zhuštění konverzace mimo hlavní pole odpovědi

    Messages API Anthropicu umí od 14. září zhustit konverzaci na požádání: aplikace pošle historii, server vrátí podepsané shrnutí místo odpovědi. Volání se účtuje jako…

  2. Čísla

    GitHub nabídne žádost o vyšší rozpočet vývojáři, kterému dojdou kredity Copilotu

    Vývojáři, kterému v GitHub Copilotu dojdou AI kredity, se od 16. září ukáže nabídka požádat správce o vyšší rozpočet; žádost míří na účet, který ten rozpočet platí.…

  3. Čísla

    Refaktor s 1 393 agenty stál Nous Research asi 25 tisíc dolarů

    Hermes Agent v hlavním běhu vyslal 1 393 subagentů a po následných opravách vyšla modelová útrata asi na 25 000 dolarů. Nous Research uvádí pokles netestovacího Pythonu…

  4. Čísla

    Správa kontextu zvedla vyhledávacímu agentu Iris-mini výsledek testu o 21,2 bodu

    Laboratoř AllSpark Research zveřejnila váhy vyhledávacích agentů Iris-mini a Iris-pro a k nim i program, kterým je měřila. Z jejích vlastních tabulek plyne, že týž model…