Přeskočit na obsah

Všechny články

Kompletní výpis, od nejnovějšího.

  1. Infrastruktura

    NCCL 2.31 přidal přenos, který NVIDIA podporuje jen na Blackwellu a od CUDA 13.3

    Knihovna, přes kterou si karty NVIDIA při trénování modelů předávají mezivýsledky, vydala 11. srpna verzi 2.31. Hlavní novinku, Compute Fabric Transport, podporuje NVIDIA jen na kartách…

  2. Bezpečnost

    OpenClaw pustí uložený klíč jen na vyjmenované servery, zatím v předběžném vydání

    Agentní nástroj OpenClaw vydal 15. srpna předběžnou verzi, ve které podřízený proces místo klíče k cizímu rozhraní dostane jen zástupnou hodnotu. Skutečný klíč za ni dosadí až proxy uvnitř…

  3. Licence a podmínky

    Přehled Hugging Face nenašel u čínských modelů nekomerční licenci, Kimi K3 má dva prahy

    Hugging Face vydal 14. srpna letní přehled otevřených modelů. Stojí v něm, že ze 178 čínských vydání nad 20 miliard parametrů nenese ani jedno nekomerční omezení. Licence největšího z nich,…

  4. Bezpečnost

    Databáze GitHubu zná jen jedno ze čtyř bezpečnostních hlášení brány ContextForge

    Brána ContextForge stojí mezi jazykovým modelem a nástroji, které volá. Její vývojáři zveřejnili 15. června 2026 na repozitáři čtyři bezpečnostní hlášení; do databáze GitHubu, ze které čtou…

  5. U sebe doma

    Ollama vypnula výchozí postih za opakování u modelů, které si ho samy nenastaví

    Verze 0.32.10 z 12. srpna mění jednu výchozí hodnotu serveru: model, který si postih za opakování sám neurčí, dostane napříště 1,0 místo 1,1, tedy vypnuto. Ollama to zdůvodňuje tím, že…

  6. Infrastruktura

    Načítání vah z disku spolklo ve SGLangu čtyři pětiny startu Qwen3-235B

    Vývojáři obslužné vrstvy SGLang si rozebrali po krocích, co server dělá, než přijme první požadavek. Ze 390 sekund startu modelu Qwen3-235B na čtyřech kartách připadlo 306 až 327 sekund na…

  7. Nástroje

    Vydání LiteLLM 1.96.1 vyčerpalo místo na PyPI a zbyly z něj na indexu čtyři soubory z 36

    Nahrávání vydání 1.96.1 se 11. srpna zastavilo po čtyřech souborech z 36, protože projektu došlo místo na PyPI. Názvy souborů jsou na indexu neměnné, takže ta verze zůstane torzem bez…

  8. Modely

    DeepSeek vydal V4-Pro, který si draft model pro zrychlení nese přímo ve vahách

    DeepSeek vydal 13. srpna 2026 ostrou verzi modelu DeepSeek-V4-Pro-0813 pod licencí MIT. Hlavní novinkou je modul DSpark, který navrhuje tokeny dopředu a jehož váhy neleží v samostatném…

  9. Modely

    RWKV-7 G1i dostal formát pro Transformers, samotné váhy jsou venku od 5. srpna

    Projekt RWKV zveřejnil čtyři velikosti řady G1i ve formátu, který načte knihovna Transformers – od 1,5 do 13,3 miliardy parametrů, všechny pod licencí Apache 2.0. Původní soubory vah nesou…

  10. Nástroje

    Sandbox Codexu pro Windows selhává na části strojů hned při spuštění příkazu

    Agentní nástroj Codex spouští na Windows každý příkaz v sandboxu postaveném na omezeném přístupovém tokenu. U části uživatelů se příkaz nespustí vůbec a místo výstupu přijde hláška…

  11. Licence a podmínky

    Licence videomodelu MiniMax H3 vylučuje EU, Británii, Jižní Koreu i USA

    Čínská MiniMax zveřejnila váhy modelu H3, který skládá krátké video se synchronizovaným zvukem. Licence z 2. srpna 2026 ale vymezuje území, kde se smí používat, a Evropskou unii z něj spolu…

  12. U sebe doma

    llama.cpp ve Windows zapíná rychlé jádro na Intel Xe2 a Xe3 od verze 8860

    Vydání b10215 z 31. července zrušilo plošné vypnutí rychlé Walshovy-Hadamardovy transformace na grafikách Intel ve Windows. Na architekturách Xe2 a Xe3 ji povolí až s ovladačem 32.0.101…

  13. U sebe doma

    Llama.cpp umí dvoubitový Q2_0 i na kartách NVIDIA a ternární model 8B má 2,15 GiB.

    Do hlavní větve llama.cpp přibyla 30. července 2026 podpora formátu Q2_0 pro karty NVIDIA, o den později i pro rozhraní SYCL. Formát ukládá váhu do dvou bitů a s jedním měřítkem na každých…

  14. U sebe doma

    Návod k modelu Ling-3.0-tiny radí zapnout zrychlení, které ten model nemá

    Karta modelu Ling-3.0-tiny radí spustit ho příkazem, který zapíná spekulativní dekódování NEXTN. V konfiguraci téhož modelu ale stojí, že pomocnou vrstvu pro ně nemá, a dokumentace SGLangu…

  15. U sebe doma

    ONNX Runtime 1.29.0 sbírá data i na Linuxu, macOS, Androidu a iOS

    Vydání z 12. srpna přidalo do knihovny sběr telemetrie pro Linux, macOS, Android a iOS; dosud běžel jen na Windows. V oficiálních balíčcích je zapnutý ve výchozím stavu a vypne ho proměnná…

  16. Čísla

    Výsledek fontu proti sběru dat se mezi čtyřmi filtry liší víc než třicetkrát

    Projekt ShieldFont zaměňuje slova ve zdroji stránky, aby robotům sbírajícím trénovací data podstrčil jiný text než čtenáři. Jeho vlastní měření v repozitáři zkoušelo čtyři filtry kvality a…

  17. Licence a podmínky

    Qwen vydal nové váhy pod vlastní licencí se třemi prahy, ne pod Apache 2.0

    Qwen zveřejnil 8. srpna 2026 váhy svého dosud největšího modelu Qwen3.8-2.4T-A95B. Předchozí generace vycházely pod Apache 2.0, tahle má vlastní licenci se třemi prahy: 100 miliony…

  18. Modely

    Ling-3.0-flash popisuje podmínky měření podrobně, výsledky testů má jen v obrázcích

    Skupina inclusionAI zveřejnila 2. srpna 2026 na Hugging Face model Ling-3.0-flash: 124 miliardy vah, z toho 5,1 miliardy aktivních při každém tokenu, licence MIT. U testů karta uvádí…

  19. Bezpečnost

    Open WebUI vydalo sedmnáct záznamů CVE až osm dní po opravné verzi

    Rozhraní Open WebUI, které si lidé staví před vlastní modely, vydalo 27. července 2026 verzi 0.11.0 s bezpečnostními opravami a v poznámkách rovnou napsalo, že je zatím nevyjmenuje všechny.…

  20. Nástroje

    Aider má poslední vydání z února a novější modely zná jen jeho nevydaná hlavní větev

    Terminálový nástroj aider má na PyPI od 12. února tutéž verzi 0.86.2. Nastavení pro modely, které vyšly potom, v repozitáři je, jenže leží na hlavní větvi, ze které se nic nevydalo.…