GPT-6.1 Sol nepodporuje úroveň uvažování none ani parametr temperature
OpenAI vydala 29. září GPT-6.1 Sol za stejné sazby jako GPT-6 Sol, levnější je jen čtení z cache. Kdo ale v rozhraní API jen přepíše jméno modelu, může narazit: nový model nemá nejnižší úroveň uvažování none a s ní přichází o parametr temperature i o volání funkcí přes Chat Completions.
OpenAI vydala 29. září GPT-6.1 Sol, novou verzi modelu, který sama řadí pod svůj nejvýkonnější GPT-6 Astra. Podle oznámení se mu v řadě testů blíží za pětinu jeho sazeb. Ta čísla naměřila OpenAI a zatím je nikdo nezopakoval. Pro vývojáře, kteří v rozhraní API volají GPT-6 Sol vydaný 22. září, je podstatnější něco jiného. Nový model nebere nejnižší úroveň uvažování none, takže výměna jména modelu v kódu nemusí stačit.

Sazby zůstaly, zlevnilo jen čtení z cache
Podle stránky modelu stojí GPT-6.1 Sol 2 dolary za milion vstupních tokenů a 10 dolarů za milion výstupních. Přesně tolik OpenAI účtuje i za GPT-6 Sol. Změnila se jediná položka: přečtení milionu tokenů uložených v cache vyjde na 0,10 dolaru místo 0,20. Zápis do cache stojí dál 2,50 dolaru za milion. Dražší sazba pro prompty nad 272 tisíc tokenů platí u obou modelů stejně, tedy dvojnásobek za vstup i cache a jedenapůlnásobek za výstup, a to za celý požadavek.
Kolik to ušetří, záleží na tom, jak velkou část promptu agent opakuje. Náš příklad: požadavek se 100 tisíci tokeny z cache, 5 tisíci novými tokeny vstupu a 2 tisíci tokeny výstupu stojí u GPT-6 Sol 5 centů, u GPT-6.1 Sol 4 centy. Bez cache vyjdou oba modely nastejno.
Tytéž částky vede tabulka cen projektu LiteLLM, podle které knihovna LiteLLM počítá útratu, i katalog OpenRouteru. Ten model zařadil 29. září odpoledne podle UTC.
Bez úrovně none padá i temperature
GPT-6 Sol přijímal šest úrovní uvažování od none po max. GPT-6.1 Sol jich má pět, začíná na low a výchozí je medium; none ani minimal nepodporuje. Stejně je na tom GPT-6 Astra a u něj příručka k uvažování výslovně píše, že požadavek s none skončí chybou HTTP 400. U nového Solu uvádí jen to, že úroveň nepodporuje.
Na none přitom visí další parametry. Průvodce přechodem na rodinu GPT-6 velí odstranit temperature, top_p a top_logprobs, kdykoli úroveň uvažování není none. V Chat Completions k nim přidává ještě logprobs. U GPT-6.1 Sol to tedy platí vždycky. Aplikace, která teplotou řídí, jak moc se odpovědi rozcházejí, nebo čte pravděpodobnosti tokenů kvůli třídění textu, na novém modelu tyhle páky nemá. Místo none dokumentace doporučuje low.
Volání funkcí přes Chat Completions skončilo
Druhá změna se týká starší cesty do API. GPT-6 Sol uměl volat funkce i přes v1/chat/completions, ovšem jen s nastavením reasoning_effort: "none". S touhle úrovní zmizela i ta možnost. GPT-6.1 Sol v Chat Completions obslouží jen požadavky bez nástrojů a na volání funkcí OpenAI odkazuje na rozhraní Responses. Kdo má agenta postaveného nad Chat Completions a chce na novém modelu dál používat nástroje, musí přepsat i klienta, ne jen jméno modelu.
Starší Sol přitom OpenAI dál doporučuje jako náhradu. Když 1. října ohlásila, že GPT-5.1 a GPT-5.3-Codex zmizí z API 1. dubna 2027, navrhla za oba gpt-6-sol, ne novější verzi. Důvod v oznámení nepadne.
Tabulka LiteLLM změnu u přímého rozhraní OpenAI zachytila: záznam gpt-6.1-sol má supports_none_reasoning_effort nastavené na false. U záznamů téhož modelu pro Azure (azure/gpt-6.1-sol a azure_ai/gpt-6.1-sol) ale stojí true. Jestli Azure úroveň none u tohoto modelu opravdu nabízí, nebo jde o záznam převzatý od GPT-6 Sol, se z tabulky poznat nedá.
Kontext zůstal, hranice znalostí se posunula o deset dní
Okno má nový model stejné jako předchůdce: 1 050 000 tokenů, z toho nejvýš 922 000 na vstupu a 128 000 na výstupu. Hranice znalostí se posunula z 20. na 30. dubna 2026. Limity tempa uvádějí stránky obou modelů stejné, od 500 požadavků a 500 tisíc tokenů za minutu v první úrovni po 15 000 požadavků a 40 milionů tokenů v páté. Stránka GPT-6.1 Sol navíc v samostatném oddílu vypisuje, že model nepodporuje doladění ani předpovězený výstup (predicted outputs).
V ChatGPT je GPT-6.1 Sol podle oznámení v tarifech Plus, Pro, Business, Enterprise a Edu, jenže jen v režimu Work a v Codexu. V běžném chatu zatím není. Variantu Ultrafast, která má v Codexu generovat až osmkrát rychleji než standardní rychlost, OpenAI slíbila „v příštích dnech“. Příručka k režimu Ultrafast v API ho ke 4. říjnu mezi modely neuvádí.
Čísla z testů jsou zatím jen čísla OpenAI
Oznámení opírá srovnání o pět sad testů. V DeepSWE v1.1 má GPT-6.1 Sol dosáhnout výsledku GPT-6 Astra zhruba za pětinu nákladů a nejlepší výsledek GPT-6 Sol překonat o 6,4 procentního bodu. V OSWorld 2.0 zaostává za Astrou o 2,1 bodu zhruba za sedminu ceny úlohy. V Terminal-Bench Science 0.1 vyšla průměrná úloha při nejvyšší úrovni uvažování na 5,47 dolaru proti 23,80 u Astry a 23,21 u Claude Opus 5.5. Nejvyšší skóre, 68,1 %, si ale drží Astra.
Všechno měřila OpenAI ve vlastním prostředí a výsledky konkurence převzala z veřejných zpráv. U testu AutomationBench 1.0.6 sama připisuje, že náklady Claude Fable 5.1 jsou v grafu podhodnocené, protože v nich chybějí záložní pokusy, ke kterým došlo zhruba u 40 % úloh. Podobnou sadu změn, po kterých starší požadavek skončí chybou, vypsal o den dřív Anthropic u Sonnetu 5.5. Rozdíl je v tom, že OpenAI ji u GPT-6.1 Sol nevypsala v oznámení, ale jen v dokumentaci.
Zdroje
- Introducing GPT-6.1 Sol, oznámení OpenAI z 29. září 2026
- GPT-6.1 Sol a GPT-6 Sol, stránky modelů v dokumentaci API
- Using the GPT-6 family, průvodce přechodem
- Reasoning models, příručka k úrovním uvažování
- Deprecations, seznam vyřazovaných modelů
- model_prices_and_context_window.json, tabulka cen projektu LiteLLM
- GPT-6.1 Sol v katalogu OpenRouteru