Přeskočit na obsah
Čísla 3 min čtení

Režim Ultrafast ubírá v Codexu z předplatného osmkrát rychleji než z koupených kreditů

OpenAI zapnula 8. října nejrychlejší stupeň obsluhy Ultrafast v Codexu a v ChatGPT Work. Ceník u něj vede dvě různé přirážky za totéž zrychlení: z limitu zahrnutého v předplatném ubere osminásobek běžné spotřeby, z koupených kreditů šestinásobek. V rozhraní API je sazba za token šestinásobná bez výjimky.

Výzkumník drží v ruce křemíkovou destičku s čipy
Rychlost Ultrafastu stojí na čipech Cerebrasu, které se vyrábějí z celé křemíkové destičky místo z jejího výřezu. Foto: U.S. Department of Energy, Wikimedia Commons (Public domain)

Ultrafast je nejrychlejší stupeň obsluhy, jaký OpenAI nabízí. V rozhraní API jede od srpna, do Codexu a do ChatGPT Work ho firma pustila 8. října. Umí ho dva modely, GPT-6.1 Sol a GPT-6 Astra.

Oznámení v seznamu změn uvádí, komu se režim zapne, a na cenu odkazuje do ceníku. Tam stojí, že se za zrychlení platí dvěma různými přirážkami podle toho, z čeho se spotřeba odečítá.

Osminásobek z limitu, šestinásobek z kreditů

Dokumentace rychlostních režimů vede u každého stupně dvojici čísel vztaženou ke standardní spotřebě téhož modelu:

RežimLimit zahrnutý v předplatnémKoupené kredity a Enterprise pay-as-you-go
Fast2,5×2×
GPT-6 Astra Ultrafast8×6×
GPT-6.1 Sol Ultrafast8×6×

Přirážka za rychlost je tedy u zahrnutého limitu o třetinu vyšší než u kreditů; osm děleno šesti je vlastní dopočet z obou násobků v tabulce. U režimu Fast je rozdíl mírnější, 2,5 proti dvěma.

Na tarifu Pro za 500 dolarů se nejdřív spotřebuje zahrnuté využití a teprve po něm kredity. Tentýž úkon proto ubírá z rozpočtu jinak podle toho, jestli uživatel zahrnutý limit už vyčerpal, nebo ne.

Kolik to je v kreditech

Ceník Codexu uvádí kreditové sazby jen pro standardní rychlost, v kreditech za milion tokenů. GPT-6.1 Sol stojí 50 kreditů za vstup, 2,5 za cachovaný vstup a 250 za výstup. GPT-6 Astra 250, 25 a 1 250. Násobek pro Ultrafast si musí čtenář dopočítat sám, protože v tabulce není: po vynásobení šesti vyjde u Solu 300, 15 a 1 500 kreditů, u Astry 1 500, 150 a 7 500. Obojí je náš výpočet ze dvou čísel v ceníku.

Kolik je kredit v dolarech, ceník neříká. Stojí v něm, že nákupní cena kreditů i slevy závisí na tarifu nebo na smlouvě. Zápis do cache se u kreditového účtování neúčtuje zvlášť, na rozdíl od API.

V API je to šestinásobek bez výjimky

Tam, kde se platí za tokeny v dolarech, je poměr jednotný. Ceník API vede u GPT-6.1 Sol ve standardním režimu dva dolary za milion vstupních tokenů a deset za milion výstupních; v Ultrafastu dvanáct a šedesát. U GPT-6 Astra se deset mění na šedesát a padesát na tři sta. Stejný šestinásobek platí i pro cachovaný vstup a zápis do cache.

Nad prahem 272 tisíc vstupních tokenů se sazby zdvojnásobují, takže Ultrafast s dlouhým kontextem u Solu vyjde na 24 dolarů za vstup a 90 za výstup. O tom, že se u Astry do dražší sazby počítá celý požadavek včetně prvních 272 tisíc tokenů, jsme psali v září.

Jedna věta v dokumentaci ty dva světy spojuje: kdo Codex přihlásí klíčem k API, platí tokenové sazby a kreditové násobky na něj neplatí.

Komu se režim zapne

Ultrafast je v Codexu a v ChatGPT Work dostupný na tarifu Pro za 500 dolarů a na vybraných plánech Enterprise a Edu. U Enterprise je vypnutý a zapíná ho vlastník pracovního prostoru buď pro celý prostor, nebo pro vybrané lidi. Podmínkou je kreditová nebo dolarová smlouva podle skutečného využití; starší plány Enterprise, které stojí na limitech tempa, podporu nemají.

Ostatní samoobslužné tarify k Ultrafastu přístup nemají, a to ani tehdy, když si jejich uživatel kredity dokoupí. Dokumentace u toho píše „at launch“, tedy k datu spuštění.

Rozdíl je i v tom, kde model počítá. GPT-6.1 Sol v Ultrafastu zvládne rezidenci ve Spojených státech i v Evropě, konkrétně v Evropském hospodářském prostoru a ve Švýcarsku. GPT-6 Astra jen ve Spojených státech. U mírnějšího režimu Fast je na tom Astra stejně a popsali jsme to v září.

Co se za to kupuje

Dokumentace uvádí jedinou rychlostní hodnotu: GPT-6 Astra generuje v Ultrafastu tokeny až osmkrát rychleji než ve standardním režimu Codexu. U GPT-6.1 Sol žádné číslo není, přestože se na něj násobky vztahují stejně.

Když OpenAI režim představila 13. srpna, slibovala u tehdejšího GPT-5.6 Sol až čtrnáctinásobek a 750 výstupních tokenů za sekundu. Ten model je v Ultrafastu dodnes jen v předběžném přístupu. Výpočty pro něj dodává Cerebras, který staví akcelerátory z celé křemíkové destičky.

Cerebras k tomu zveřejnil vlastní měření na testu Humanity's Last Exam: GPT-5.6 Sol v Ultrafastu prošel všech 2 500 otázek za 11 hodin a 11 minut, Claude Fable 5 za 78 hodin a 27 minut. Měřil to sám dodavatel, první model v Codexu 10. července a druhý v Claude Code mezi 13. a 15. červencem, oba na úrovni uvažování xhigh. Nikdo jiný to zatím nezopakoval, takže je to tvrzení výrobce, ne ověřený výsledek.

Druhá mez je v tempu. V API má Ultrafast vlastní limity oddělené od standardního i rychlého režimu a u Astry jsou výrazně nižší: v nejvyšším tarifu Grow 5 milionů tokenů za minutu proti 40 milionům u Solu. Pro agenty, kteří volají nástroje jeden za druhým, firma doporučuje trvalé spojení přes WebSockets. Bez něj podle dokumentace zdržení sítě část získané rychlosti sebere.

Zdroje

Diskuse

Zatím tu nikdo nediskutuje. Můžete být první.

Napsat příspěvek

Diskutovat můžete i bez účtu. S registrací se ale příspěvek zveřejní hned a nemusíte pokaždé vyplňovat jméno. Účet už máte? Přihlaste se.

Nezveřejňujeme ho, slouží jen redakci.

Podporuje zápis Texy: **tučně**, *kurzíva*, odrážky, odkazy.

Dál k tématu

  1. Čísla

    Anthropic účtuje za Haiku 5.5 desetinu sazeb Haiku 4.5, jen u promptů do 100 000 tokenů

    Anthropic vydal 7. října Claude Haiku 5.5 za 0,10 dolaru za milion vstupních tokenů, tedy za desetinu sazby Haiku 4.5. U promptů delších než 100 000 tokenů se ale sazby…

  2. Čísla

    Metoda Googlu zlepšila agenty v testu i na úlohách, které při úpravách neviděli

    Tým Google Cloud AI Research zveřejnil metodu RRSI, která upravuje nástroje a pokyny kolem jazykového modelu. Na neznámých úlohách získala v testech až 4,7 bodu; samotné…

  3. Čísla

    Institut FRI našel podceněné odhady pokroku AI v testech

    Srovnání předpovědí s dosaženými výsledky ukázalo, že odborníci čekali matematické milníky později. Průběžná zpráva ale snáz odhalí příliš nízký odhad než příliš vysoký.

  4. Čísla

    Měřič útraty v bráně Claude apps účtoval hodinovou mezipaměť levnější sazbou

    Claude Code 2.1.286 opravuje měřič, podle kterého brána Claude apps hlídá útratové limity vývojářů. Zápis do hodinové mezipaměti počítal sazbou pětiminutové, tedy o 37,5…