Anthropic slibuje stálý přístup externím hodnotitelům, OpenAI se přidává
Dario Amodei vyzval ke zpomalení vývoje nejvýkonnějších modelů. Jeho Anthropic se zatím zavázal k jednomu kroku, který může udělat bez států a konkurence: dá externím hodnotitelům kancelář, firemní počítač a přístup podobný interním týmům. Sam Altman oznámil stejný záměr za OpenAI. Ani jedna firma ale neuvedla, kdo ji bude kontrolovat, kdy začne ani podle jaké hranice by vývoj skutečně zpomalila.
Šéf Anthropicu Dario Amodei zveřejnil 12. září plán, jak zpomalit vývoj nejvýkonnějších modelů umělé inteligence. Nenavrhl, aby jeho firma přestala trénovat. Z jeho tří kroků je jen jeden závazkem, který může Anthropic splnit sám: pustit externí hodnotitele dovnitř firmy a dát jim přístup podobný vlastním bezpečnostním týmům.

Hodnotitel nemá dostat jen výsledky připravené firmou. Amodeiho text slibuje kancelář, vstupní průkaz, firemní počítač a systémová oprávnění srovnatelná s těmi, která mají zaměstnanci provádějící interní testy. Kontrolor by tak mohl pracovat průběžně, ne pouze nad jedním modelem těsně před vydáním.
Kontrolor smí zveřejnit vlastní závěr
Anthropic si vyhrazuje omezení vyžadovaná zákonem, smlouvami a ochranou soukromí zákazníků či obchodních partnerů. Zprávu ale nemá před vydáním redigovat podle svého. Hodnotitel ji smí zveřejnit bez firemní redakční kontroly; firma může začernit bezpečnostně citlivé, právní, obchodní nebo cizí důvěrné údaje. Pokud by takový zásah změnil závěr, kontrolor smí veřejně říct, že k tomu došlo.
Tohle je podstatně širší nabídka než jednorázové předání modelu k testu. Současně v ní chybějí údaje, podle kterých půjde slib hlídat. Anthropic nejmenoval hodnotitele, neuvedl způsob jeho výběru ani den, kdy dostane průkaz a počítač. Není jasné ani to, ke kterým modelům a záznamům se podobný přístup bude vztahovat.
Sam Altman podle TechCrunch odpověděl, že OpenAI udělá totéž a podrobnosti oznámí později. Její závazek je proto zatím kratší než ten anthropický: potvrzuje směr, nikoli pravidla přístupu.
Společná brzda potřebuje vládu
Druhý krok má být dohoda laboratoří v demokratických zemích. Firmy by určily kontrolní body podle schopností modelů a u každého předem řekly, jaká ochrana musí být připravená, než vývoj postoupí dál. Když by se některý účastník k hranici přiblížil, zpomalili by všichni.
Amodei však žádnou číselnou hranici neurčil. Neuvedl test, skóre ani maximální výpočetní výkon, po jehož dosažení by Anthropic vývoj pozastavil. Omezení výpočetního výkonu nebo zákazy používat AI při vývoji další AI sám označuje za snadno obejitelné. Návrh navíc podle něj potřebuje podporu vlády nebo úzkou výjimku z antimonopolních pravidel, aby společný postup konkurentů nebyl nezákonnou dohodou.
Externí kontrola a společné zpomalení jsou tedy dvě různé věci. První může ukázat, co model dokáže a co firma při vlastních testech přehlédla. Druhá potřebuje měřitelnou hranici, shodu konkurentů a právní oporu. Zveřejněný plán zatím podrobně popisuje jen první.
Třetí krok míří na Čínu
Poslední patro má být globální. Amodei chce, aby demokratické země udržely náskok omezením vývozu čipů do Číny, bránily krádežím vah a ztížily takzvanou destilaci, při níž se menší model učí z výstupů většího. Teprve potom by podle něj šlo jednat o celosvětové koordinaci.
Tady je plán nejméně určitý. Neříká, kdo by globální dohodu ověřoval, jak by se měřil pokrok skrytého modelu ani co by následovalo po porušení. Neobsahuje termín a nejmenuje státy, které by k ní byly ochotné přistoupit.
Přístup pomůže, ale rychlost neurčuje
Pro průběžného externího hodnotitele existuje praktický důvod. Anthropic letos při zpětném auditu našel případy, kdy jeho modely během bezpečnostních testů zasáhly skutečné systémy; nejstarší incident zůstal bez odhalení nejméně tři měsíce. Člověk s přístupem k interním záznamům by mohl nezávisle prověřit, zda firma podobné mezery skutečně zavřela.
Amodei zároveň píše, že roje agentů mohou během šesti až dvanácti měsíců převzít velkou část činností na internetu. Je to jeho odhad, ne výsledek nezávislého měření. The Guardian jej zasazuje do sporu o to, zda laboratoře mají dobrovolně brzdit, nebo potřebují závazná pravidla.
TechCrunch cituje i námitku, že pravidla navržená největšími laboratořemi mohou zvýhodnit právě firmy, které už mají kapitál, čipy a přístup k vládám. Nabídka nezávislého přístupu má proti tomu jednu ověřitelnou vlastnost: pozná se, zda člověk zvenčí opravdu pracuje uvnitř a zda smí vydat zprávu. Dokud ale Anthropic neoznámí jeho jméno a termín nástupu, zůstává i tahle část slibem.
Výzva ke zpomalení tak zatím nemá rychlostní limit. Má návrh kontroly, kterou lze zavést hned, a dvě dohody, pro něž chybějí účastníci, metrika i datum.
Zdroje
- Dario Amodei: We Must Pace the Frontier, září 2026 – původní návrh tří kroků a závazek Anthropicu k externím hodnotitelům
- TechCrunch: Anthropic CEO outlines plan to pace the frontier, 12. 9. 2026 – datum, reakce Sama Altmana a kritická námitka k navrhovaným pravidlům
- The Guardian: „We must slow the pace“, 12. 9. 2026 – nezávislé zpravodajské ověření a kontext debaty