Přeskočit na obsah

Modely

Přehled článků v rubrice modely. Nejnovější nahoře.

  1. Modely

    Model GPT-6 Astra zvládl sedm pokusů ze sta v testu s robotickými rameny

    Zkouška StationeryBench dala dvěma modelům stejná dvouramenná ramena a pět úloh z psacího stolu. GPT-6 Astra od OpenAI splnil zadání v sedmi pokusech ze sta, MolmoAct2 od Ai2 ani v jednom.…

  2. Modely

    Streamovací VibeVoice-ASR od Microsoftu přepisuje řeč i s mluvčím už během nahrávky

    Microsoft vydal 2. září VibeVoice-ASR-Streaming ve dvou velikostech pod licencí MIT. Model vydává přepis po blocích 2,9 s a u každé věty říká, kdo ji řekl, bez zvláštního kroku pro…

  3. Modely

    Z trojice modelů Nex-N2.5 chybí na Hugging Face váhy jen prostřednímu Pro

    Nex AGI vydala 8. září rodinu agentních modelů Nex-N2.5 ve třech velikostech a slibuje otevřené váhy. Nejmenší mini má 70 GB v BF16 a největší Max 1,65 TB ve FP8, repozitář Pro nese zatím…

  4. Modely

    Dvě tabulky slovníku zabírají v modelu MiniCPM5-2B pětinu parametrů

    Skupina OpenBMB vydala 6. září model MiniCPM5-2B pro běh na koncových zařízeních. Z jeho 2 516 756 480 parametrů připadá 534 773 760 na dvojici tabulek, které převádějí tokeny na vektory a…

  5. Modely

    Zrychlená verze videomodelu MiniMax H3 dokládá slíbenou kvalitu šesti srovnáními

    Váhy VDN-H3 přidávají k videomodelu MiniMax H3 druhou, levnější větev pozornosti a podle autorů z něj udělají 74,5násobně rychlejší stroj. Rychlost mají rozepsanou po jednotlivých krocích…

  6. Modely

    Institut IFM vydal u rodiny K2 Horizon 309 značek se stavy z průběhu trénování

    Institute of Foundation Models při univerzitě MBZUAI zveřejnil 3. září 2026 šest modelů K2 Horizon pod licencí Apache 2.0. Vedle finálních vah nechal v repozitářích i stavy z průběhu…

  7. Modely

    Hlídač bezpečnosti k modelům Ling 3.0 stojí na jediné vrstvě pozornosti

    Ant Group vydal 1. září 2026 dvě sady vah pod jménem SingProbe. Nejsou to samostatné modely: napojí se na běžící Ling 3.0, odečtou mu skryté stavy ze tří vrstev a ke každému vygenerovanému…

  8. Modely

    Destilovaný videomodel FastH3 nese strojově čitelný doklad o svém vzniku

    FastVideo zveřejnil čtyřkrokovou destilaci videomodelu MiniMax H3 a přiložil k ní soubor provenance.json: revizi základních vah, číslo kroku trénování, otisky sha256 i větu o tom, čím se…

  9. Modely

    Smíšená kvantizace zmenšila váhy Qwen3.8-27B na 8,4 gigabajtu

    DASLab při IST Austria zveřejnila tři kvantizace modelu Qwen3.8-27B. Každému velkému tenzoru přidělují přesnost zvlášť, takže nejmenší jazykové váhy zabírají 8,4 GB místo 53,8 GB u…

  10. Modely

    Na vlastním testu Pipecatu vyskočil doladěný Nemotron 3 Nano z 28,6 na 72,3 procenta

    Tým Pipecat vydal PhoneLLM Alpha 1, plné doladění modelu NVIDIA Nemotron 3 Nano 30B-A3B na telefonní hovory. Na vlastním žebříčku PhoneBench mu skóre stouplo z 28,6 na 72,3 %, tedy z…

  11. Modely

    GLM-5.3-Flash si drží KV cache jen v jedenácti ze 45 vrstev

    Váhy modelu GLM-5.3-Flash jsou na Hugging Face pod licencí MIT: 321,3 miliardy parametrů v 62 souborech, dohromady 328,3 GB. Slovo „Flash“ se týká ceny provozu, ne rozměrů. Levný je proto,…

  12. Modely

    Nanbeige 4.2 pouští svých dvaadvacet vrstev dvakrát za sebou

    Model Nanbeige4.2-3B předčí v agentních testech podstatně větší modely a přitom má jen tři miliardy parametrů mimo vloženiny. Konfigurace prozrazuje proč: dvaadvacet vrstev vah se na každém…

  13. Modely

    Váhy modelu SenseNova U1.5-8B-MoT mají 17,5 miliardy parametrů

    SenseTime vydala 19. srpna otevřený multimodální model SenseNova U1.5-8B-MoT. Rozhraní Hugging Face u něj napočítá 17 532 854 464 parametrů a osm souborů s vahami zabere pětatřicet…

  14. Modely

    Draft model DFlash 2 pro Qwen3.8 se rozběhne jen na nevydaném kódu SGLangu a vLLM

    Inco AI zveřejnila 18. srpna DFlash 2 – malý model, který za Qwen3.8-27B předpovídá celé bloky tokenů dopředu. Ve vlastním měření tím propustnost SGLangu roste 2,7 až 3,4krát, jenže…

  15. Modely

    Kopie hudebního modelu MiniMax Music3 uvádějí na Hugging Face čtyři různé licence

    MiniMax nahrál 7. srpna 2026 na Hugging Face váhy hudebního modelu Music3 a přiložil k nim vlastní licenci s prahem dvaceti milionů dolarů ročních tržeb. Do hlavičky karty ji ale nezapsal,…

  16. Modely

    Malé modely se jménem Qwen3.8 nevydal Qwen, ale Empero, a stojí na Qwen3.5

    Na Hugging Face přibyly 15. srpna 2026 tři modely pojmenované Qwen3.8-9B, Qwen3.8-4B a Qwen3.8-2B. Qwen žádnou takovou velikost nevydal: jsou to destilace, které do o generaci starších…

  17. Modely

    RWKV-7 G1i dostal formát pro Transformers, samotné váhy jsou venku od 5. srpna

    Projekt RWKV zveřejnil čtyři velikosti řady G1i ve formátu, který načte knihovna Transformers – od 1,5 do 13,3 miliardy parametrů, všechny pod licencí Apache 2.0. Původní soubory vah nesou…

  18. Modely

    DeepSeek vydal V4-Pro, který si draft model pro zrychlení nese přímo ve vahách

    DeepSeek vydal 13. srpna 2026 ostrou verzi modelu DeepSeek-V4-Pro-0813 pod licencí MIT. Hlavní novinkou je modul DSpark, který navrhuje tokeny dopředu a jehož váhy neleží v samostatném…

  19. Modely

    EXAONE 4.5 přišla v GGUF o posuvnou pozornost kvůli pořadí metadat

    Oficiální GGUF modelu EXAONE 4.5 obsahuje 65 bloků včetně jedné hlavy pro předpověď více tokenů, ale llama.cpp kontrolovalo počet vrstev dřív, než tuto hlavu odečetlo. Posuvná pozornost…

  20. Modely

    Mach-1 sbalil váhy Qwen3.6-35B na 7,5 GB, běžný nástroj je ale nepřečte

    Syzygy Research vydala Mach-1 Additive 35B, ternární balení modelu Qwen3.6-35B-A3B, které srazí 71,9 GB vah na 7,53 GB. Vlastní měření vydavatele mu přisuzuje 95 % výkonu původního modelu.…