Přeskočit na obsah

Čísla

Přehled článků v rubrice čísla. Nejnovější nahoře.

  1. Čísla

    Správa kontextu zvedla vyhledávacímu agentu Iris-mini výsledek testu o 21,2 bodu

    Laboratoř AllSpark Research zveřejnila váhy vyhledávacích agentů Iris-mini a Iris-pro a k nim i program, kterým je měřila. Z jejích vlastních tabulek plyne, že týž model dostane na testu…

  2. Čísla

    Zbytečný převod na 32 bitů bral v knihovně TRL přes pětinu času na grafické kartě

    Vnitřní smyčka výchozí ztrátové funkce v knihovně TRL převáděla obě vstupní matice ze šestnácti bitů na dvaatřicet, ačkoli obě v paměti ležely v šestnácti. Násobení se tím přesunulo z…

  3. Čísla

    Globální KV cache DeepSeeku V4.1 Flash zabere při milionu tokenů 890 MiB

    DeepSeek zveřejnil váhy multimodálního modelu V4.1 Flash s kontextem dlouhým 1 048 576 tokenů. Globální KV cache ukládá 890 bajtů na token, takže při zaplnění celého okna zabere přesně 890…

  4. Čísla

    Modely Flare a Sunburst z GPT Image 2.5 mají stejné sazby za token

    OpenAI rozdělila GPT Image 2.5 do dvou modelů pro API. Flare má rychleji obsloužit běžné generování, Sunburst má přesněji upravovat obraz; sazby za textové i obrazové tokeny mají shodné.

  5. Čísla

    Pydantic AI 2.40 po zapnutí každou hodinu stahuje 1 678 cenových položek

    Pydantic AI 2.40 přidala volitelné stahování cen modelů hned po startu a potom každou hodinu. Při našem testu se seznam rozšířil z 1 646 na 1 678 položek; výpadek stahování ponechal v…

  6. Čísla

    Známku ověřeného měření nemá ani jeden z 2 542 výsledků v žebříčcích Hugging Face

    Hugging Face ukládá od prosince 2025 výsledky testů přímo do repozitáře modelu a skládá z nich žebříčky benchmarků. Ze 2 542 položek, které v nich 4. září 2026 stály, nemá známku ověřeného…

  7. Čísla

    Experti uložení po čtyřech bitech tvoří 94 % vah DeepSeeku V4 Flash Vision

    DeepSeek nahrál 31. srpna 2026 na Hugging Face váhy experimentálního modelu DeepSeek-V4-Flash-Vision-Exp. Osmačtyřicet souborů má dohromady 167,8 GB a 93,8 % z toho zabírají směrovaní…

  8. Čísla

    Zrychlení jádra Qwen-Image se v celém požadavku neprojevilo

    SGLang sloučil závěrečnou normalizaci a modulaci obrazového modelu Qwen-Image do jediného jádra. Samotná operace zrychlila podle délky vstupu 3,1krát až 5,6krát, deset měření celého…

  9. Čísla

    Sada Monsoon ukázala větší rozdíly mezi regiony Indie než mezi osmi modely přepisu řeči

    Hugging Face a Voice Arena přidaly do žebříčku Open ASR Leaderboard sady Monsoon pro indickou angličtinu a hindštinu. Každý klip v nich nese dvanáct údajů o mluvčím, a to stačilo, aby se…

  10. Čísla

    Váhy modelu Hy4 preview se ani ve verzi FP8 nevejdou na osm karet po 80 GB

    Tencent nahrál na Hugging Face váhy vlajkového modelu Hy4 preview a dal je pod licenci Apache 2.0. Součet 131 souborů v repozitáři dá 1 560 GB, kvantizovaná verze FP8 zabere 813,8 GB. Návod…

  11. Čísla

    OpenAI uvádí u čipu Jalapeño až 1,9krát více práce na watt

    První vlastní čip OpenAI pro běh modelů má podle výsledků výrobce zvládnout 1,5 až 1,9krát více práce na watt než srovnávané systémy Nvidia. Při stejné práci by to znamenalo o 33 až 47…

  12. Čísla

    Tabulka n-gramů drží ve vahách Qwen3.8-Flash-Next 51 miliard parametrů

    Qwen zveřejnil váhy Qwen3.8-Flash-Next, na kterých chce postavit příští generaci svých modelů. Soubory nesou 179 999 981 459 parametrů a zaberou 360 GB. Přes 51 miliard z toho ale nic…

  13. U sebe doma

    SGLang odstranil přepínač pro kvantizaci, který v devíti vydáních jen hlásil chybu

    Přepínač --torchao-config končil v SGLangu chybou ImportError, ať mu uživatel předal kteroukoli z povolených hodnot. Rozbil ho skok verze knihovny torchao, který se svezl s úpravou…

  14. Čísla

    LiteLLM počítal úsporu z mezipaměti bez ceny jejího zápisu

    LiteLLM až do verze 1.98.0 přičítal úsporu za tokeny načtené z mezipaměti, ale neodečetl příplatek za její vytvoření. U zápisu 20 000 tokenů pro Claude Sonnet 4.5 tak mohl přehled ukazovat…

  15. Čísla

    Pew našel stopy AI v desetině anglického webu, u novějších stránek ve více než třetině

    Pew Research Center prověřil 490 000 anglických webových stránek a v červencovém vzorku našel významné stopy strojového autorství u 10 % z nich. Mezi stránkami s datem vydání po spuštění…

  16. Čísla

    Gartner čeká 42,3 miliardy dolarů u infrastruktury, IDC čeká 497 miliard u hardwaru.

    Gartner odhadl, že celosvětové výdaje za pronajatou infrastrukturu pro modely letos dosáhnou 42,3 miliardy dolarů, tedy o 96,4 % víc než loni. IDC čeká u „výdajů na AI infrastrukturu“ za…

  17. Nástroje

    Vydání LiteLLM 1.96.1 vyčerpalo místo na PyPI a zbyly z něj na indexu čtyři soubory z 36

    Nahrávání vydání 1.96.1 se 11. srpna zastavilo po čtyřech souborech z 36, protože projektu došlo místo na PyPI. Názvy souborů jsou na indexu neměnné, takže ta verze zůstane torzem bez…

  18. U sebe doma

    Návod k modelu Ling-3.0-tiny radí zapnout zrychlení, které ten model nemá

    Karta modelu Ling-3.0-tiny radí spustit ho příkazem, který zapíná spekulativní dekódování NEXTN. V konfiguraci téhož modelu ale stojí, že pomocnou vrstvu pro ně nemá, a dokumentace SGLangu…

  19. Čísla

    Knihovna Transformers vypsala od února 33 nekompatibilních změn v jedenácti vydáních

    Verze 5.15.0 knihovny Transformers vyšla 10. srpna 2026 a pod nadpisem Breaking changes má čtyři položky. Od lednového vydání pětky jich projekt vypsal 33, rozdělených do jedenácti vydání;…

  20. Čísla

    Bez jasného pokynu modely při doučování matematiky příliš napovídají, ukázal test Ai2

    Institut Ai2 zveřejnil TutorMoments, měřítko postavené na 462 přepisech skutečného doučování matematiky. Sedmi jazykovým modelům dal roli doučovatele: bez bližšího pokynu většinou…