Přeskočit na obsah
Modely 3 min čtení

V testu Tavusu považovalo 26 z 54 lidí avatara Griffin-Lite za člověka

Tavus pustil Griffin-Lite jen k vybraným testerům. Ve firemní studii ho 26 z 54 účastníků po minutovém hovoru považovalo za člověka; samostatné měření Nvidia hodnotí jeho projev i zpoždění.

Modrá webkamera Logitech na horní hraně monitoru
Webkamera na monitoru, ilustrační snímek k videohovorům. Foto: Peter Placzek, Wikimedia Commons (CC BY-SA 4.0)

Minutový videohovor stačil ve studii Tavusu k tomu, aby 26 z 54 účastníků označilo svého protějška za skutečného člověka. Na druhé straně přitom běžel Griffin-Lite, systém vytvářející tvář, hlas a odpovědi během rozhovoru. Firma ho představila 1. října 2026. Výzkumnou zkoušku zpřístupnila vybraným testerům, zákazníci ho zatím používat nemohou.

Tavus svůj výsledek popisuje jako překonání videové obdoby Turingova testu, tedy zkoušky, zda člověk odliší stroj od lidského partnera. Zveřejněný postup ale dokládá konkrétní minutovou studii. Účastníci předem dostali informaci, že budou mluvit s jiným účastníkem; nešlo o lidi, kteří od začátku věděli, že mají odhalovat umělou inteligenci.

Účastníci mluvili o tom, na co se letos těší

Dobrovolníky Tavus získal přes nezávislou výzkumnou platformu. V hovoru měli probrat, na co se letos těší. Potom zapsali partnerovu odpověď a hodnotili přirozenost, důvěryhodnost i průběh rozhovoru. Až na konci dotazníku dostali otázku, zda je napadlo, že protějšek nemusí být skutečný člověk. Nakonec se všichni dozvěděli, že hovořili s modelem.

U Griffin-Lite uvádí firma 26 takových záměn z 54 rozhovorů, zaokrouhleně 48 %. Předchozí sestava Tavusu, složená z modelů Phoenix-4.5, Sparrow-2 a Raven-1, podle stejného protokolu přesvědčila jednoho ze 41 lidí, tedy 2,4 %. Jde o dvě různě velké skupiny. Výsledky zveřejnil Tavus. Nvidia hodnotila jinou sadu úloh, nikoli tyto minutové hovory; zpráva The Decoder přebírá výsledky od Tavusu.

Ani účastníci, kterým avatar připadal lidský, nehodnotili rozhovor bez výhrad. Plynulost hovoru dostala ve firemní studii průměr 4,9 bodu ze sedmi, pocit, že protějšek opravdu naslouchá, 5,5 bodu. Tato čísla popisují zkušenost lidí po krátkém setkání. Neříkají, jak by model obstál po hodině nebo při jiné úloze.

Nvidia známkuje projev a porozumění odděleně

Druhý doklad pochází z žebříčku VideoFDB výzkumníků Nvidia. Ten používá 237 úseků skutečných videohovorů a sleduje třeba zacházení s pauzou, přerušování či reakci na výraz tváře. Hodnocení výstupů provádí jazykový model podle předem stanovených pravidel na stupnici od nuly do pěti. Lidská předloha je záznam skutečného rozhovoru, se kterým se výsledky porovnávají.

V části o vytváření řeči a obrazu má Tavus Griffin Lite celkové skóre 3,83; lidská předloha 3,92. Sestava Gemini 2.5 s avatarem Anam dosáhla 2,80. V samostatné části o porozumění zvuku a obrazu dostal Griffin 3,73 proti lidským 4,20. Žebříček tedy potvrzuje obě skóre, která Tavus uvádí v oznámení.

Blízká souhrnná známka za projev nezakrývá rozdíl v časování. U generování tabulka uvádí medián zpoždění 1 892 milisekund pro Griffin a 900 milisekund pro lidskou předlohu. Také dílčí hodnocení vhodnosti neverbálních projevů zůstává nižší: 2,83 proti 3,18. Přívětivý hlas a pohyblivá tvář se v tomto měření sčítají s dalšími vlastnostmi; souhrnné číslo samo nevypovídá o každé z nich.

Griffin má poslouchat i během vlastní odpovědi

Podle technického popisu Tavusu systém průběžně přijímá zvuk i obraz a rozhoduje, kdy promluvit, mlčet nebo reagovat gestem. Rozhodování pokračuje také ve chvíli, kdy avatar mluví. Záměrem je například odlišit pauzu na rozmyšlenou od konce věty a přestat mluvit, když mu člověk skočí do řeči.

Tavus popisuje dvě propojené části: jednu pro porozumění rozhovoru a řízení reakcí, druhou pro vytváření hlasu a videa. Avatar tak může přikývnout, aniž by čekal na dokončenou slovní odpověď. Výrobce na stránce ukazuje rozhovory i pomoc s Rubikovou kostkou; tyto vybrané ukázky jsou předvedení jeho možností, nikoli další nezávislý test.

Termín širšího vydání Tavus neurčil. Nejdřív chce dořešit bezpečnost a způsob, jak dát člověku vědět, že mluví s AI. O přístup k výzkumné verzi se lze přihlásit přes formulář v oznámení. Stávající nabídka Tavusu dál běží na jiných modelech, takže účet u služby sám o sobě přístup ke Griffin-Lite nezajišťuje.

Zdroje

Diskuse

Zatím tu nikdo nediskutuje. Můžete být první.

Napsat příspěvek

Diskutovat můžete i bez účtu. S registrací se ale příspěvek zveřejní hned a nemusíte pokaždé vyplňovat jméno. Účet už máte? Přihlaste se.

Nezveřejňujeme ho, slouží jen redakci.

Podporuje zápis Texy: **tučně**, *kurzíva*, odrážky, odkazy.

Dál k tématu

  1. Modely

    Google pustil Gemini 4 Argon zatím jen k vybraným obráncům sítí

    Gemini 4 Argon má limit milionu výstupních tokenů, zatím ho ale dostávají jen vybraní účastníci programu Fairwind. Google zveřejnil úvodní ceny i jejich budoucí…

  2. Modely

    Anthropic vyjmenoval u Sonnetu 5.5 pět změn, které rozbijí kód psaný pro Sonnet 5

    Claude Sonnet 5.5 vyšel 28. září a stojí stejně jako jeho předchůdce, dva dolary za milion vstupních tokenů a deset za výstupní. Kontext zůstal na milionu tokenů, jenže…

  3. Modely

    NVIDIA měřila nový diarizační model u šesti z osmi sad proti jiným referenčním štítkům

    NVIDIA vydala 23. září model Nemotron 3 Diarization, který v nahrávce rozliší až osm mluvčích a zvládne to i za běhu. Proti předchozí verzi klesla chybovost v průměru o…

  4. Modely

    Gemini 3.8 Live dostal avatar pro firemní agenty

    Google přidal k modelu Gemini 3.8 Live obrazový výstup, který mluvenou odpověď převádí do pohybu přednastavené nebo vlastní postavy. Live Avatar od 24. září běží v…