Modely
Přehled článků v rubrice modely. Nejnovější nahoře.
-
Pokee-Isaac slibuje kontext deseti milionů tokenů na jedné kartě, váhy ale nezveřejnil
Pokee AI ohlásila 8. srpna 2026 model Pokee-Isaac 28B, který má zvládnout kontext deseti milionů tokenů a vejít se na jedinou grafickou kartu. Váhy ale nezveřejnila; model se prodává jako…
-
Nová řada modelů zkouší vštípit hodnoty už při předtrénování
Skupina model-raising zveřejnila 9. srpna rodinu malých jazykových modelů ke studii Synthetic Persona Pretraining. Ta zkouší vepsat modelu hodnoty už do předtrénování, místo aby se…
-
Ve vlastním testu Nvidie dokončil VoiceChat 11B třetinu nástrojových úloh
Nvidia vydala 3. srpna hlasový model VoiceChat 11B pro průběžný rozhovor a volání nástrojů. V jejím měření na FDB-v3 vybral správný nástroj v 82,5 % případů, správné argumenty však předal v…
-
Ling-3.0-flash popisuje podmínky měření podrobně, výsledky testů má jen v obrázcích
Skupina inclusionAI zveřejnila 2. srpna 2026 na Hugging Face model Ling-3.0-flash: 124 miliardy vah, z toho 5,1 miliardy aktivních při každém tokenu, licence MIT. U testů karta uvádí…
-
Ternární model Maple-Preview má v hlavním repozitáři 40 GB vah místo slíbených 5,31
DeepGrove zveřejnil 4. srpna 2026 pod licencí MIT ternární model Maple-Preview: 20,21 miliardy vah, z toho 1,49 miliardy aktivních při každém tokenu. Karta modelu slibuje kontrolní bod o 5…
-
AMD popisuje Instella-MoE jako plně otevřený model, licence vah dovoluje jen výzkum
AMD dala na Hugging Face model Instella-MoE-16B-A3B a s ním kontrolní body ze všech šesti fází tréninku. Kód k němu je pod licencí MIT, váhy pod licencí RESEARCH-ONLY RAIL, která povoluje…
-
LG dala K-EXAONE 2.0 s 1,5 TB vah pod Apache 2.0 místo vlastní licence
Korejská LG AI Research zveřejnila K-EXAONE 2.0, model se 750 miliardami parametrů, z nichž se na token používá 37 miliard. Váhy zabírají 1 497,7 GB a model vznikl rozšířením předchozí…
-
NVIDIA radí sdílet KV hlavu mezi víc dotazů, ale neříká, na kterých GPU měřila
Nový technický rozbor rozděluje obsluhu dlouhého kontextu na dvě odlišné úlohy: načtení zadání omezuje výpočetní výkon, generování dalšího tokenu propustnost paměti. NVIDIA z toho odvozuje…
-
Váhy Solar Open 2 mají 500 GB, licence chce jméno začínající na Solar
Korejský Upstage vydal 22. července otevřené váhy modelu Solar Open 2 – 250 miliard parametrů, z toho 15 miliard aktivních na token, kontext milion tokenů. Ke stažení je 500,62 GB. Licence…
-
DeepSeek vydal V4-Flash pod MIT se 167 GB vah a skripty místo šablony chatu
DeepSeek zveřejnil 31. července ostrou verzi modelu V4-Flash. Licence je čistá MIT bez prahů tržeb a bez podmínek navíc, kontext má milion tokenů a váhy 166,9 GB. Devět čísel v tabulce…
-
Anthropic vydal Opus 5 za polovinu ceny Fable, test mu naměřil 50 % halucinací
Anthropic 24. července vydal model Claude Opus 5 za 5 dolarů za milion vstupních a 25 dolarů za milion výstupních tokenů, tedy za polovinu ceny Fable 5. V nezávislém souhrnném testu vede o…