Přeskočit na obsah
Infrastruktura 4 min čtení

OpenAI chystá vratky za chybně účtované kontejnery v Agents API

OpenAI zapsala 18. září na svou stavovou stránku, že kontejnery, které hostuje pro rozhraní Agents API, účtuje víc, než má. Od prvního hlášení do uzavření incidentu uplynulo devět hodin a dvaadvacet minut; kdy chybné účtování začalo, stránka neuvádí. Dotčeným zákazníkům firma slíbila spočítat vratky.

Stavová stránka OpenAI přijala 18. září 2026 ve 22:29 UTC hlášení nazvané „Overbilling for OpenAI-hosted containers in the Agent API“, tedy nadměrné účtování kontejnerů, které firma hostuje pro své agentní rozhraní. První zápis mluví o „higher-than-expected charges“ a hned v úvodu dodává, že se chystají vratky. Incident se zavřel druhý den v 7:52 UTC.

Serverové uzly v šasi s propojovacími kabely
Serverové uzly HP ProLiant SL250s v šasi s6500. Foto: Patrick Finnegan, Wikimedia Commons (CC BY 2.0)

Kdy účtování začalo být špatné, stránka neuvádí

Devět hodin a dvaadvacet minut je doba mezi prvním zápisem a uzavřením, ne doba, po kterou se účtovalo špatně. Pole s počátkem incidentu zůstalo ve strojových datech stránky prázdné, takže se z něj nedá vyčíst ani to, odkdy chyba běžela, ani kolik sezení zasáhla. Zákazník to pozná z vyúčtování nebo z vratky – a tu OpenAI ve druhém zápise teprve slíbila spočítat, až projde zasaženou spotřebu.

Zápisů má incident pět. Ve 23:22 UTC firma napsala, že na opravě pracuje a zároveň prochází spotřebu, aby zjistila, koho se to týká. V 1:08 UTC hlásila, že opravu stále zavádí, v 5:00 UTC že je nasazená a že „nová sezení na tuhle chybu nenarazí“. Mezi prvním hlášením a nasazenou opravou je tedy šest a půl hodiny, uzavření přišlo o dalších necelé tři hodiny později.

U dotčených součástí stojí na stránce věta „No components marked as affected“, tedy že incident nezasáhl žádnou z vedených služeb. Do statistiky dostupnosti se proto nepromítne; stejný stupeň dopadu dostalo téhož dne zdržení odpovědí podpory, kdežto chyby v pracovním režimu ChatGPT z předchozího dne jsou vedené jako závažné. Jak takové zápisy vypadají v celku, ukázalo měření 96 hlášení: příčinu z nich popisovalo jediné.

Kontejner je virtuální stroj, který provozuje poskytovatel

Dokumentace popisuje kontejner jako plně izolovaný virtuální stroj, ve kterém model spouští kód. OpenAI ho používá dvěma způsoby: pod nástroji Code Interpreter a Hosted Shell a od letošního září i jako sandbox hostovaný OpenAI pro rozhraní Agents API, tedy linuxové pracoviště s Pythonem, Node.js a nástroji příkazové řádky. Paměť se volí ve čtyřech stupních – 1, 4, 16 nebo 64 GB – a zvolený stupeň platí po celý život kontejneru.

Životnost se u těch dvou použití liší. Kontejner pod Code Interpreterem vyprší, když se dvacet minut nepoužije, a zpátky do činného stavu ho podle dokumentace převést nelze. Sandbox pro Agents API naproti tomu dostává udržovací signály i v pauzách mezi kroky a smazat se může až tehdy, když činnost i ty signály ustanou na hodinu. Tuhle lhůtu nastavit nejde, dokumentace to říká výslovně.

Ceník má u kontejnerů dvě různé účtovací jednotky

Tabulka vestavěných nástrojů v ceníku OpenAI vede u řádku Containers cenu „1 GB $0.03, 4 GB $0.12, 16 GB $0.48, 64 GB $1.92 per 20-minute session per container“, tedy za dvacetiminutové sezení a jeden kontejner. Poznámka pod tou samou tabulkou ale říká, že „eligible container sessions“ se účtují po minutách s pětiminutovým minimem na sezení. Které sezení je „eligible“, dokument nevysvětluje – jinak v něm to slovo stojí jen u přirážky za zpracování v regionu. Ceník jsme stáhli dvakrát, prohlížečem i curlem, a obě jednotky v něm stojí vedle sebe pokaždé.

Podle tabulkové jednotky vychází hodina na tři dvacetiminutová sezení, tedy 0,09 dolaru u stupně 1 GB, 0,36 u 4 GB, 1,44 u 16 GB a 5,76 u 64 GB, a to na jeden kontejner. Hodinová cena v ceníku není, je to náš dopočet ze sazeb výš. Tokeny modelu se účtují zvlášť.

Dvacetiminutová jednotka sedí na dobu, po které vyprší kontejner Code Interpreteru. Sandbox Agents API drží hodinu a platí se za něj podle téhož řádku – dokumentace k němu jen odkazuje na „standardní sazby za kontejner“. Jestli se do účtovaného sezení počítají i pauzy, ve kterých kontejner nic nepočítá a jen dostává udržovací signály, neuvádí ani jeden z obou dokumentů. Místo toho radí sezení po dokončení práce smazat, aby se uklidil i sandbox.

Před náklady varoval v oznámení bety zaměstnanec OpenAI

Agents API pustila OpenAI do veřejné bety 10. září 2026. V oznámení na svém vývojářském fóru k tomu napsala, že rozhraní nemá žádné poplatky navíc a že „you simply pay for the tokens and tools your agents use“ – platí se jen za tokeny a nástroje, které agent použije.

Devět minut po tom oznámení se ve stejném vlákně zeptal jeden z vývojářů, kde je ceník hostovaných sandboxů. Odpověď od zaměstnance OpenAI nejdřív odkázala na řádek Containers a pak přidala varování: kdo s hostovanými sandboxy začíná, má být při zakládání nových kontejnerů opatrný a spočítat si náklady dopředu. „I learned this the hard way,“ stojí na konci. Chyba v účtování týchž kontejnerů přišla o osm dní později.

Dvě jména pro jednu věc drží u toho rozhraní i sama firma: stavová stránka píše o „Agent API“, dokumentace o „Agents API“.

Na jednotce záleží u agenta víc než na sazbě

E2B, jeden z poskytovatelů sandboxů, na které dokumentace Agents API sama odkazuje, účtuje běžící sandbox po sekundách. Jedno virtuální jádro stojí 0,000014 dolaru za sekundu, dvě jádra jako výchozí nastavení dvojnásobek; paměť a úložiště má ve vlastních sazbách, takže se celková cena obou služeb přímo srovnat nedá.

Srovnat se dá jednotka. U agenta, který si kontejnery zakládá a zahazuje podle toho, co po něm zadání zrovna chce, na ní záleží víc než na sazbě samotné: v dvacetiminutové jednotce se za půlminutový úkol zaplatí celé sezení, tedy čtyřicetinásobek doby, po kterou se opravdu počítalo. Po sekundách se zaplatí ta půlminuta.

Dokud ceník neřekne, které sezení je „eligible“, nemá zákazník jak dopředu poznat, kterou z obou jednotek u svého provozu dostane. Pro rozhraní ohlášené dva týdny se slovy o žádných poplatcích navíc je to nepříjemná kombinace – a jednu chybu v účtování těch kontejnerů už OpenAI přiznala. Kolik zákazníků se jí týká a o jaké částky šlo, firma nezveřejnila.

Zdroje

Diskuse

Zatím tu nikdo nediskutuje. Můžete být první.

Napsat příspěvek

Diskutovat můžete i bez účtu. S registrací se ale příspěvek zveřejní hned a nemusíte pokaždé vyplňovat jméno. Účet už máte? Přihlaste se.

Nezveřejňujeme ho, slouží jen redakci.

Podporuje zápis Texy: **tučně**, *kurzíva*, odrážky, odkazy.

Dál k tématu

  1. Infrastruktura

    Podle OpenAI LIFO pool v úložišti Habitat dál zatěžoval pomalé procesy

    OpenAI popsala 11. září zpětnou vazbu v úložišti Habitat: po náporu vracely pomalé procesy spojení jako poslední a LIFO pool jim proto posílal další práci. Veřejné…

  2. Infrastruktura

    Nvidia cílí v Austrálii na 2 GW pro AI, rozpis po areálech ale chybí

    Nvidia spojila osm australských provozovatelů datových center pod společný cíl až 2 GW pro umělou inteligenci do roku 2027. Jednotlivá čísla v oznámení však míchají…

  3. Infrastruktura

    Dify 1.17.1 vyžaduje u Weaviate postup přes dvanáct menších verzí

    Vlastní instalace Dify s přibalenou databází Weaviate nesmí při přechodu na verzi 1.17.1 skočit rovnou z 1.27.0 na 1.39.2. Návod předepisuje zálohu a třináct spuštění…

  4. Infrastruktura

    vLLM 0.29 zapíná Model Runner V2, který dokumentace dál označuje za neúplný

    vLLM 0.29.0 změnilo 9. září výchozí cestu, která připravuje vstupy a spouští model na akcelerátoru. Model Runner V2 má zjednodušit asynchronní provoz a šetřit paměť, k…