Prompt delší než 272 tisíc tokenů zdraží u GPT-6 Astra celý požadavek
OpenAI vydala 3. září GPT-6 Astra s oknem 1 050 000 tokenů a sazbou 10 dolarů za milion vstupních tokenů. Prompt nad 272 tisíc tokenů ale přepne účtování na dvojnásobek u vstupu a na jedenapůlnásobek u výstupu, a to pro celý požadavek včetně tokenů pod prahem.
OpenAI zapsala k 3. září do seznamu změn svého API vydání modelu GPT-6 Astra. Jeho stránka uvádí okno 1 050 000 tokenů, z toho nejvýš 922 000 na vstupu a 128 000 na výstupu, znalosti do 30. dubna 2026 a čtyři sazby: 10 dolarů za milion vstupních tokenů, 1 dolar za milion tokenů načtených z cache, 12,50 za jejich uložení a 50 dolarů za milion tokenů výstupu.

Pod tou tabulkou stojí jedna věta, která s účtem udělá víc než celá tabulka nad ní. Prompt delší než 272 tisíc vstupních tokenů se podle ní účtuje dvojnásobnou sazbou za vstup i za cache a jedenapůlnásobnou za výstup, a to for the full request, tedy za celý požadavek.
Jeden token navíc přidá 2,72 dolaru
Sazba se nedělí na pásma, jak se to dělá u daní. Požadavek s 272 000 tokeny na vstupu stojí 2,72 dolaru. Požadavek s 272 001 tokeny stojí 5,44 dolaru, protože do dražší sazby spadne i těch prvních 272 tisíc. Mezi oběma voláními je rozdíl jednoho tokenu a 2,72 dolaru; obojí je náš dopočet ze sazeb na stránce modelu.
Obě pásma vypisuje ceník OpenAI vedle sebe jako krátký a dlouhý kontext: u GPT-6 Astra 10 a 20 dolarů za milion vstupních tokenů, 1 a 2 za čtení z cache, 12,50 a 25 za zápis do ní, 50 a 75 za výstup. Táž čísla vrací nezávisle na OpenAI i veřejné rozhraní OpenRouteru, které u modelu vede pole overrides s hranicí min_prompt_tokens: 272000 a s týmiž čtyřmi sazbami.
Nad prahem leží sedm desetin možného vstupu
Levnější polovina ceníku pokrývá 272 000 z 922 000 tokenů, které se do vstupu vejdou, tedy 29,5 % rozsahu. Zbylých 650 000 tokenů je v dražším pásmu. Kdo okno vytíží, zaplatí za plný vstup 18,44 dolaru a za plný výstup 128 000 tokenů dalších 9,60, dohromady 28,04 dolaru za jediné volání. V režimu Fast, který stránka modelu vede za dvojnásobek platné sazby, je to 56,08 dolaru.
Dávkové zpracování jde opačným směrem a stojí polovinu, takže dávkový požadavek nad prahem vyjde na 10 dolarů za milion vstupních tokenů, tedy přesně na standardní sazbu pod ním. Potvrzuje to i OpenRouter, který dávkovou variantu modelu vede zvlášť.
Starší řady měly týž práh, ale počítaly ho na relaci
Číslo 272 tisíc není nové. Táž hranice stojí na stránkách modelů GPT-5.4 i GPT-5.5 a obě mají stejně velké okno. Liší se ale slovo na konci: u obou starších řad se dražší sazba počítá for the full session, tedy za celou relaci, kdežto GPT-5.6 Sol a po něm GPT-6 Astra už mluví o jednom požadavku.
Druhý rozdíl je v limitech tempa. GPT-5.4 a GPT-5.5 mají pro dlouhý kontext vlastní tabulku s nižšími stropy: v prvním tarifním pásmu 200 požadavků za minutu proti 500 u běžných promptů a 400 000 tokenů za minutu proti 500 000. GPT-5.6 Sol ani GPT-6 Astra takovou tabulku nemají – překročení prahu u nich mění cenu, ne povolené tempo.
Sazby se přitom hýbou i po vydání. U Luny a Terry je OpenAI po spuštění snížila a u GPT-5.6 Sol je současná cena podle ceníku propagační, zaručená nejméně do 21. listopadu 2026.
Uložení do cache se nad prahem vrátí až podruhé
Zápis do cache stojí 1,25násobek běžné vstupní sazby, což nad prahem dělá 25 dolarů za milion tokenů. Načtení uloženého promptu pak přijde na 2 dolary. Kdo tedy dlouhý prompt uloží a jednou přečte, zaplatí 27 dolarů za milion tokenů místo 20 bez cache. Při druhém čtení je to 29 proti 40. Cache se u dlouhého kontextu vyplatí od chvíle, kdy se týž prompt použije podruhé.
GPT-6 Astra má vedle ceny i jiná omezení, která seznam změn vypisuje jako body k migraci: neumí stupeň uvažování none, nebere vlastní hodnoty temperature a top_p ani logprobs a volání nástrojů vyžaduje rozhraní Responses. Práh 272 tisíc tokenů mezi nimi ale nestojí, přestože s účtem hne víc než kterékoli z nich.
Zdroje
- GPT-6 Astra – stránka modelu se sazbami, velikostí okna a limity tempa
- Changelog OpenAI API – zápis o vydání ze 3. září 2026
- Ceník OpenAI – tabulka krátkého a dlouhého kontextu
- Seznam modelů OpenRouteru – strojově čitelné sazby včetně hranice 272 000 tokenů