Modely
Přehled článků v rubrice modely. Nejnovější nahoře.
-
Model GPT-6 Astra zvládl sedm pokusů ze sta v testu s robotickými rameny
Zkouška StationeryBench dala dvěma modelům stejná dvouramenná ramena a pět úloh z psacího stolu. GPT-6 Astra od OpenAI splnil zadání v sedmi pokusech ze sta, MolmoAct2 od Ai2 ani v jednom.…
-
Streamovací VibeVoice-ASR od Microsoftu přepisuje řeč i s mluvčím už během nahrávky
Microsoft vydal 2. září VibeVoice-ASR-Streaming ve dvou velikostech pod licencí MIT. Model vydává přepis po blocích 2,9 s a u každé věty říká, kdo ji řekl, bez zvláštního kroku pro…
-
Z trojice modelů Nex-N2.5 chybí na Hugging Face váhy jen prostřednímu Pro
Nex AGI vydala 8. září rodinu agentních modelů Nex-N2.5 ve třech velikostech a slibuje otevřené váhy. Nejmenší mini má 70 GB v BF16 a největší Max 1,65 TB ve FP8, repozitář Pro nese zatím…
-
Dvě tabulky slovníku zabírají v modelu MiniCPM5-2B pětinu parametrů
Skupina OpenBMB vydala 6. září model MiniCPM5-2B pro běh na koncových zařízeních. Z jeho 2 516 756 480 parametrů připadá 534 773 760 na dvojici tabulek, které převádějí tokeny na vektory a…
-
Zrychlená verze videomodelu MiniMax H3 dokládá slíbenou kvalitu šesti srovnáními
Váhy VDN-H3 přidávají k videomodelu MiniMax H3 druhou, levnější větev pozornosti a podle autorů z něj udělají 74,5násobně rychlejší stroj. Rychlost mají rozepsanou po jednotlivých krocích…
-
Institut IFM vydal u rodiny K2 Horizon 309 značek se stavy z průběhu trénování
Institute of Foundation Models při univerzitě MBZUAI zveřejnil 3. září 2026 šest modelů K2 Horizon pod licencí Apache 2.0. Vedle finálních vah nechal v repozitářích i stavy z průběhu…
-
Hlídač bezpečnosti k modelům Ling 3.0 stojí na jediné vrstvě pozornosti
Ant Group vydal 1. září 2026 dvě sady vah pod jménem SingProbe. Nejsou to samostatné modely: napojí se na běžící Ling 3.0, odečtou mu skryté stavy ze tří vrstev a ke každému vygenerovanému…
-
Destilovaný videomodel FastH3 nese strojově čitelný doklad o svém vzniku
FastVideo zveřejnil čtyřkrokovou destilaci videomodelu MiniMax H3 a přiložil k ní soubor provenance.json: revizi základních vah, číslo kroku trénování, otisky sha256 i větu o tom, čím se…
-
Smíšená kvantizace zmenšila váhy Qwen3.8-27B na 8,4 gigabajtu
DASLab při IST Austria zveřejnila tři kvantizace modelu Qwen3.8-27B. Každému velkému tenzoru přidělují přesnost zvlášť, takže nejmenší jazykové váhy zabírají 8,4 GB místo 53,8 GB u…
-
Na vlastním testu Pipecatu vyskočil doladěný Nemotron 3 Nano z 28,6 na 72,3 procenta
Tým Pipecat vydal PhoneLLM Alpha 1, plné doladění modelu NVIDIA Nemotron 3 Nano 30B-A3B na telefonní hovory. Na vlastním žebříčku PhoneBench mu skóre stouplo z 28,6 na 72,3 %, tedy z…
-
GLM-5.3-Flash si drží KV cache jen v jedenácti ze 45 vrstev
Váhy modelu GLM-5.3-Flash jsou na Hugging Face pod licencí MIT: 321,3 miliardy parametrů v 62 souborech, dohromady 328,3 GB. Slovo „Flash“ se týká ceny provozu, ne rozměrů. Levný je proto,…
-
Nanbeige 4.2 pouští svých dvaadvacet vrstev dvakrát za sebou
Model Nanbeige4.2-3B předčí v agentních testech podstatně větší modely a přitom má jen tři miliardy parametrů mimo vloženiny. Konfigurace prozrazuje proč: dvaadvacet vrstev vah se na každém…
-
Váhy modelu SenseNova U1.5-8B-MoT mají 17,5 miliardy parametrů
SenseTime vydala 19. srpna otevřený multimodální model SenseNova U1.5-8B-MoT. Rozhraní Hugging Face u něj napočítá 17 532 854 464 parametrů a osm souborů s vahami zabere pětatřicet…
-
Draft model DFlash 2 pro Qwen3.8 se rozběhne jen na nevydaném kódu SGLangu a vLLM
Inco AI zveřejnila 18. srpna DFlash 2 – malý model, který za Qwen3.8-27B předpovídá celé bloky tokenů dopředu. Ve vlastním měření tím propustnost SGLangu roste 2,7 až 3,4krát, jenže…
-
Kopie hudebního modelu MiniMax Music3 uvádějí na Hugging Face čtyři různé licence
MiniMax nahrál 7. srpna 2026 na Hugging Face váhy hudebního modelu Music3 a přiložil k nim vlastní licenci s prahem dvaceti milionů dolarů ročních tržeb. Do hlavičky karty ji ale nezapsal,…
-
Malé modely se jménem Qwen3.8 nevydal Qwen, ale Empero, a stojí na Qwen3.5
Na Hugging Face přibyly 15. srpna 2026 tři modely pojmenované Qwen3.8-9B, Qwen3.8-4B a Qwen3.8-2B. Qwen žádnou takovou velikost nevydal: jsou to destilace, které do o generaci starších…
-
RWKV-7 G1i dostal formát pro Transformers, samotné váhy jsou venku od 5. srpna
Projekt RWKV zveřejnil čtyři velikosti řady G1i ve formátu, který načte knihovna Transformers – od 1,5 do 13,3 miliardy parametrů, všechny pod licencí Apache 2.0. Původní soubory vah nesou…
-
DeepSeek vydal V4-Pro, který si draft model pro zrychlení nese přímo ve vahách
DeepSeek vydal 13. srpna 2026 ostrou verzi modelu DeepSeek-V4-Pro-0813 pod licencí MIT. Hlavní novinkou je modul DSpark, který navrhuje tokeny dopředu a jehož váhy neleží v samostatném…
-
EXAONE 4.5 přišla v GGUF o posuvnou pozornost kvůli pořadí metadat
Oficiální GGUF modelu EXAONE 4.5 obsahuje 65 bloků včetně jedné hlavy pro předpověď více tokenů, ale llama.cpp kontrolovalo počet vrstev dřív, než tuto hlavu odečetlo. Posuvná pozornost…
-
Mach-1 sbalil váhy Qwen3.6-35B na 7,5 GB, běžný nástroj je ale nepřečte
Syzygy Research vydala Mach-1 Additive 35B, ternární balení modelu Qwen3.6-35B-A3B, které srazí 71,9 GB vah na 7,53 GB. Vlastní měření vydavatele mu přisuzuje 95 % výkonu původního modelu.…