Přeskočit na obsah
Čísla 4 min čtení

Anthropic účtuje za Haiku 5.5 desetinu sazeb Haiku 4.5, jen u promptů do 100 000 tokenů

Anthropic vydal 7. října Claude Haiku 5.5 za 0,10 dolaru za milion vstupních tokenů, tedy za desetinu sazby Haiku 4.5. U promptů delších než 100 000 tokenů se ale sazby pětinásobí a nový tokenizér počítá týž text zhruba o 30 % delší. Průměrnou úsporu 75 % firma opírá o to, že 90 % požadavků na Haiku 4.5 bylo kratších.

Anthropic vydal 7. října model Claude Haiku 5.5, nejmenší a nejrychlejší z řady 5.5. V poznámkách k vydání platformy ho popisuje jako model pro práci ve velkém objemu, kde rozhoduje rychlost odezvy. Dokumentace k tomu jmenuje třídění, směrování požadavků, vytahování údajů z textu a dílčí úlohy pro větší modely. Kontext má milion tokenů místo 200 000 u Haiku 4.5 a odpověď může mít až 128 000 tokenů místo 64 000.

Automat s dvojí cenou u každé položky
Haiku 5.5 má v ceníku dvě sady cen podle délky promptu. Foto: SPARKY358, Wikimedia Commons (CC BY 4.0)

Hlavní zprávou je cena. Za milion vstupních tokenů chce Anthropic 0,10 dolaru a za milion výstupních 0,50 dolaru, tedy desetinu toho, co stojí Haiku 4.5 (1 a 5 dolarů). Ta sazba ale platí jen do určité délky promptu. Ceník má pro Haiku 5.5 dva řádky a ve druhém, pro prompty delší než 100 000 tokenů, stojí pětinásobek: 0,50 dolaru za vstup a 2,50 dolaru za výstup. Pětkrát dražší je nad prahem i čtení z mezipaměti (0,05 místo 0,01 dolaru) a zápis do ní.

Haiku 5.5 je jediný nový model Anthropicu s prahem

U ostatních modelů od Claude 4.6 dál Anthropic délku promptu v ceně neřeší. Ceník to říká výslovně: požadavek o 900 000 tokenech se u nich účtuje stejnou sazbou za token jako požadavek o 9 000 tokenech. Haiku 5.5 je v téže větě uvedený jako výjimka. Stejně ho popisuje stránka o kontextovém okně: milion tokenů je u něj výchozí, jen prompty nad 100 000 tokenů stojí víc.

Že nejde jen o zápis v dokumentaci, ukazuje zprostředkovatel, který model přeprodává od několika poskytovatelů. Rozhraní OpenRouteru vede u Haiku 5.5 základní sazby 0,10 a 0,50 dolaru a k nim druhou sadu cen s podmínkou min_prompt_tokens: 100000. Hodnoty v ní sedí s druhým řádkem ceníku Anthropicu, a to u Anthropicu, Amazon Bedrocku, Google Cloudu i Azuru. Část nabídek na Bedrocku, Google Cloudu a Azuru stojí 0,11 a 0,55 dolaru, což odpovídá desetiprocentní přirážce, kterou ceník Anthropicu uvádí u regionálních koncových bodů.

Práh dělá v ceně skok. Prompt o 99 000 tokenech zaplatí za vstup necelý cent, prompt o 101 000 tokenech přes pět centů. Podobný práh má OpenAI u GPT-6 Astra, leží ale na 272 000 tokenech a sazby se za ním zvednou dvakrát u vstupu a půldruhého krát u výstupu, ne pětkrát.

Stejný text vydá zhruba o třetinu víc tokenů

Srovnání desetiny proti celé sazbě má háček v tom, co se počítá. Haiku 5.5 používá novější tokenizér, tedy jiný způsob dělení textu na tokeny, stejný jako modely od Claude 4.7. Týž vstupní text z něj podle dokumentace vyjde zhruba o 30 % delší než u Haiku 4.5; přesný rozdíl závisí na obsahu.

Náš přepočet: za každý dolar, který text stál na Haiku 4.5, zaplatíte na Haiku 5.5 pod prahem zhruba 13 centů. Nad prahem to bude kolem 65 centů, takže úspora činí asi třetinu, ne polovinu. A práh 100 000 nových tokenů odpovídá přibližně 77 000 tokenům, jak je počítal Haiku 4.5.

Průměr 75 % firma opírá o počet požadavků

Anthropic v oznámení píše, že Haiku 5.5 vyjde v průměru zhruba o 75 % levněji než Haiku 4.5. Poznámka pod čarou to rozepisuje: pod prahem je cena o 90 % nižší, nad ním o 50 % a na Haiku 4.5 spadalo do první skupiny 90 % požadavků. Výpočet podle firmy zahrnuje i nový tokenizér, o kterém tam stojí, že model potřebuje na úlohu „slightly more tokens“, tedy o něco víc tokenů. Dokumentace o tomtéž mluví jako o zhruba 30 %.

Těch 90 % je podíl požadavků, ne tokenů. Požadavek nad prahem nese nejméně 100 000 tokenů, takže na účtu váží víc než krátký dotaz na zatřídění textu. Jak firma oba podíly zvážila, z oznámení nevyčtete. Kdo modelu posílá hlavně dlouhé dokumenty, se k průměru 75 % nemusí dostat.

U agentů délku promptu zvedá ještě jedna změna. U Haiku 4.5 rozhraní předchozí bloky uvažování (thinking) z historie konverzace samo odstraňovalo. U Haiku 5.5 je podle stránky o kontextovém okně rozhraní ve výchozím stavu ponechává, takže se počítají do kontextu jako každý jiný vstup. Dlouhá konverzace s nástroji se tak k 100 000 tokenům dostane dřív.

Co se změnilo v rozhraní

Pro přechod platí podobné výhrady jako u Sonnetu 5.5. Požadavek s ručním rozpočtem na uvažování (budget_tokens) vrátí chybu 400. Stejně skončí nastavení temperature, top_p nebo top_k mimo výchozí hodnotu i předvyplněný začátek odpovědi. Uvažování je zapnuté ve výchozím stavu, takže odpověď může začínat blokem thinking a kód, který bere první blok jako text odpovědi, se splete. Haiku 5.5 navíc nemá úroveň služeb Priority Tier a jeho bezpečnostní klasifikátory můžou požadavek odmítnout bez náhradního zpracování na straně serveru. Všechno to vypisuje průvodce přechodem.

Na složitější programování model podle samotného Anthropicu není. Firma v oznámení píše, že na úlohy typu Terminal-Bench 4.0 zůstávají lepší volbou Sonnet 5.5 a Opus 5.5. Haiku se podle ní hodí na úžeji vymezenou práci, jako je zhušťování a shrnování konverzace nebo dílčí úlohy. Ve vlastním měření na tomtéž testu naměřila Haiku 5.5 39,2 %, Sonnetu 5.5 70,6 % a Haiku 4.5 nulu. Jsou to čísla výrobce.

Týž den Anthropic snížil cenu čtení z mezipaměti u Sonnetu 5.5 z 0,20 na 0,10 dolaru za milion tokenů. Ohlásil také měsíční kredity na API pro předplatitele: 100 dolarů pro tarif Max 5x, 200 dolarů pro Max 20x a až 500 dolarů pro tarif Team, sdílených mezi jeho uživateli.

Zdroje

Diskuse

Zatím tu nikdo nediskutuje. Můžete být první.

Napsat příspěvek

Diskutovat můžete i bez účtu. S registrací se ale příspěvek zveřejní hned a nemusíte pokaždé vyplňovat jméno. Účet už máte? Přihlaste se.

Nezveřejňujeme ho, slouží jen redakci.

Podporuje zápis Texy: **tučně**, *kurzíva*, odrážky, odkazy.

Dál k tématu

  1. Čísla

    Metoda Googlu zlepšila agenty v testu i na úlohách, které při úpravách neviděli

    Tým Google Cloud AI Research zveřejnil metodu RRSI, která upravuje nástroje a pokyny kolem jazykového modelu. Na neznámých úlohách získala v testech až 4,7 bodu; samotné…

  2. Čísla

    Institut FRI našel podceněné odhady pokroku AI v testech

    Srovnání předpovědí s dosaženými výsledky ukázalo, že odborníci čekali matematické milníky později. Průběžná zpráva ale snáz odhalí příliš nízký odhad než příliš vysoký.

  3. Čísla

    Měřič útraty v bráně Claude apps účtoval hodinovou mezipaměť levnější sazbou

    Claude Code 2.1.286 opravuje měřič, podle kterého brána Claude apps hlídá útratové limity vývojářů. Zápis do hodinové mezipaměti počítal sazbou pětiminutové, tedy o 37,5…

  4. Licence a podmínky

    Anthropic zase účtuje odmítnuté požadavky ve třech z pěti kategorií

    Od 24. září 2026 se za požadavek, který bezpečnostní klasifikátor Claudu odmítne ještě před prvním slovem odpovědi, zase platí. Nedopadá to na všechna odmítnutí, jen na…