Čísla
Přehled článků v rubrice čísla. Nejnovější nahoře.
-
Správa kontextu zvedla vyhledávacímu agentu Iris-mini výsledek testu o 21,2 bodu
Laboratoř AllSpark Research zveřejnila váhy vyhledávacích agentů Iris-mini a Iris-pro a k nim i program, kterým je měřila. Z jejích vlastních tabulek plyne, že týž model dostane na testu…
-
Zbytečný převod na 32 bitů bral v knihovně TRL přes pětinu času na grafické kartě
Vnitřní smyčka výchozí ztrátové funkce v knihovně TRL převáděla obě vstupní matice ze šestnácti bitů na dvaatřicet, ačkoli obě v paměti ležely v šestnácti. Násobení se tím přesunulo z…
-
Globální KV cache DeepSeeku V4.1 Flash zabere při milionu tokenů 890 MiB
DeepSeek zveřejnil váhy multimodálního modelu V4.1 Flash s kontextem dlouhým 1 048 576 tokenů. Globální KV cache ukládá 890 bajtů na token, takže při zaplnění celého okna zabere přesně 890…
-
Modely Flare a Sunburst z GPT Image 2.5 mají stejné sazby za token
OpenAI rozdělila GPT Image 2.5 do dvou modelů pro API. Flare má rychleji obsloužit běžné generování, Sunburst má přesněji upravovat obraz; sazby za textové i obrazové tokeny mají shodné.
-
Pydantic AI 2.40 po zapnutí každou hodinu stahuje 1 678 cenových položek
Pydantic AI 2.40 přidala volitelné stahování cen modelů hned po startu a potom každou hodinu. Při našem testu se seznam rozšířil z 1 646 na 1 678 položek; výpadek stahování ponechal v…
-
Známku ověřeného měření nemá ani jeden z 2 542 výsledků v žebříčcích Hugging Face
Hugging Face ukládá od prosince 2025 výsledky testů přímo do repozitáře modelu a skládá z nich žebříčky benchmarků. Ze 2 542 položek, které v nich 4. září 2026 stály, nemá známku ověřeného…
-
Experti uložení po čtyřech bitech tvoří 94 % vah DeepSeeku V4 Flash Vision
DeepSeek nahrál 31. srpna 2026 na Hugging Face váhy experimentálního modelu DeepSeek-V4-Flash-Vision-Exp. Osmačtyřicet souborů má dohromady 167,8 GB a 93,8 % z toho zabírají směrovaní…
-
Zrychlení jádra Qwen-Image se v celém požadavku neprojevilo
SGLang sloučil závěrečnou normalizaci a modulaci obrazového modelu Qwen-Image do jediného jádra. Samotná operace zrychlila podle délky vstupu 3,1krát až 5,6krát, deset měření celého…
-
Sada Monsoon ukázala větší rozdíly mezi regiony Indie než mezi osmi modely přepisu řeči
Hugging Face a Voice Arena přidaly do žebříčku Open ASR Leaderboard sady Monsoon pro indickou angličtinu a hindštinu. Každý klip v nich nese dvanáct údajů o mluvčím, a to stačilo, aby se…
-
Váhy modelu Hy4 preview se ani ve verzi FP8 nevejdou na osm karet po 80 GB
Tencent nahrál na Hugging Face váhy vlajkového modelu Hy4 preview a dal je pod licenci Apache 2.0. Součet 131 souborů v repozitáři dá 1 560 GB, kvantizovaná verze FP8 zabere 813,8 GB. Návod…
-
OpenAI uvádí u čipu Jalapeño až 1,9krát více práce na watt
První vlastní čip OpenAI pro běh modelů má podle výsledků výrobce zvládnout 1,5 až 1,9krát více práce na watt než srovnávané systémy Nvidia. Při stejné práci by to znamenalo o 33 až 47…
-
Tabulka n-gramů drží ve vahách Qwen3.8-Flash-Next 51 miliard parametrů
Qwen zveřejnil váhy Qwen3.8-Flash-Next, na kterých chce postavit příští generaci svých modelů. Soubory nesou 179 999 981 459 parametrů a zaberou 360 GB. Přes 51 miliard z toho ale nic…
-
SGLang odstranil přepínač pro kvantizaci, který v devíti vydáních jen hlásil chybu
Přepínač --torchao-config končil v SGLangu chybou ImportError, ať mu uživatel předal kteroukoli z povolených hodnot. Rozbil ho skok verze knihovny torchao, který se svezl s úpravou…
-
LiteLLM počítal úsporu z mezipaměti bez ceny jejího zápisu
LiteLLM až do verze 1.98.0 přičítal úsporu za tokeny načtené z mezipaměti, ale neodečetl příplatek za její vytvoření. U zápisu 20 000 tokenů pro Claude Sonnet 4.5 tak mohl přehled ukazovat…
-
Pew našel stopy AI v desetině anglického webu, u novějších stránek ve více než třetině
Pew Research Center prověřil 490 000 anglických webových stránek a v červencovém vzorku našel významné stopy strojového autorství u 10 % z nich. Mezi stránkami s datem vydání po spuštění…
-
Gartner čeká 42,3 miliardy dolarů u infrastruktury, IDC čeká 497 miliard u hardwaru.
Gartner odhadl, že celosvětové výdaje za pronajatou infrastrukturu pro modely letos dosáhnou 42,3 miliardy dolarů, tedy o 96,4 % víc než loni. IDC čeká u „výdajů na AI infrastrukturu“ za…
-
Vydání LiteLLM 1.96.1 vyčerpalo místo na PyPI a zbyly z něj na indexu čtyři soubory z 36
Nahrávání vydání 1.96.1 se 11. srpna zastavilo po čtyřech souborech z 36, protože projektu došlo místo na PyPI. Názvy souborů jsou na indexu neměnné, takže ta verze zůstane torzem bez…
-
Návod k modelu Ling-3.0-tiny radí zapnout zrychlení, které ten model nemá
Karta modelu Ling-3.0-tiny radí spustit ho příkazem, který zapíná spekulativní dekódování NEXTN. V konfiguraci téhož modelu ale stojí, že pomocnou vrstvu pro ně nemá, a dokumentace SGLangu…
-
Knihovna Transformers vypsala od února 33 nekompatibilních změn v jedenácti vydáních
Verze 5.15.0 knihovny Transformers vyšla 10. srpna 2026 a pod nadpisem Breaking changes má čtyři položky. Od lednového vydání pětky jich projekt vypsal 33, rozdělených do jedenácti vydání;…
-
Bez jasného pokynu modely při doučování matematiky příliš napovídají, ukázal test Ai2
Institut Ai2 zveřejnil TutorMoments, měřítko postavené na 462 přepisech skutečného doučování matematiky. Sedmi jazykovým modelům dal roli doučovatele: bez bližšího pokynu většinou…