Přeskočit na obsah

Všechny články

Kompletní výpis, od nejnovějšího.

  1. Licence a podmínky

    Licence modelu Thomson-1.0-Small nedovoluje jeho šíření ani úpravy

    Thomson Reuters zveřejnil váhy modelu Thomson-1.0-Small a na kartě mu říká open-weight. Přiložená licence PolyForm Strict 1.0.0 ale dává právo jen k nekomerčnímu užití, a to bez šíření a…

  2. Licence a podmínky

    Licence Breeze TTS 2 zakazuje komerčně používat i výstupy z vlastního serveru

    BreezeBlue zveřejnila váhy řečového modelu Breeze TTS 2 a kód pro jeho spuštění. Kód je pod Apache 2.0, vlastní licence vah ale vyžaduje písemné svolení ke komerčnímu použití modelu,…

  3. Čísla

    Váhy modelu Hy4 preview se ani ve verzi FP8 nevejdou na osm karet po 80 GB

    Tencent nahrál na Hugging Face váhy vlajkového modelu Hy4 preview a dal je pod licenci Apache 2.0. Součet 131 souborů v repozitáři dá 1 560 GB, kvantizovaná verze FP8 zabere 813,8 GB. Návod…

  4. Infrastruktura

    Anthropic otevřel Model Hardware Standard jen vybraným laboratořím

    Model Hardware Standard má sjednotit ovládání mikroskopů, pipetovacích robotů a robotických ramen přes společné příkazy a bezpečnostní limity. Anthropic 27. srpna otevřel výzkumný náhled…

  5. Nástroje

    Modul mcp.server.fastmcp se do SDK vrátil jen proto, aby spadl s odkazem na návod

    Přejmenování třídy FastMCP na MCPServer nechalo ve druhé verzi knihovny mcp starý import padat na holé hlášce, ze které se nedalo poznat, že je nainstalovaná jiná hlavní verze. Vydání 2.1.1…

  6. U sebe doma

    llama.cpp podporuje od sestavení b10665 DSpark pro Nemotron 3.5

    Sestavení llama.cpp b10665 z 28. srpna umí vedle hlavního Nemotronu 3.5 načíst samostatný draft model DSpark od Nvidie. Ten přidá 1,35 GB dat k 21,58 GB cílového repozitáře. Autor změny…

  7. Bezpečnost

    Tři servery MCP dostaly týž den záznam CVE za to, že si neověřovaly volajícího

    Dropbox, Timescale a ByteDance mají od 27. srpna 2026 každý svůj záznam CVE k serveru protokolu MCP a příčiny se překrývají. Obě oficiální sady MCP umí odmítnout požadavek, jehož hlavička…

  8. Infrastruktura

    Ray 2.58 zohledňuje KV cache při směrování dotazů mezi replikami

    Ray 2.58 dokončil směrování požadavků podle toho, kolik jejich prefixu už leží v KV cache jednotlivých replik. Router převádí text na tokeny jednou, sleduje bloky v paměti GPU i RAM a při…

  9. Bezpečnost

    Záznamy CVE k platformě Cohere North neříkají, která verze je opravená

    Databáze NVD zveřejnila 26. srpna čtyři záznamy o podnikové agentní platformě Cohere North ve verzi 1.1.5. Jméno produktu je v nich jen ve větě popisu; v polích pro výrobce, produkt a verzi…

  10. Nástroje

    Ollama 0.33.1 začala v MLX skutečně vynucovat JSON Schema

    Ollama uměla přijmout JSON Schema i u modelů v MLX, její runner se jím však neřídil. Verze 0.33.1 to mění: XGrammar před každým krokem zakáže tokeny, které by porušily zadanou strukturu.…

  11. Modely

    GLM-5.3-Flash si drží KV cache jen v jedenácti ze 45 vrstev

    Váhy modelu GLM-5.3-Flash jsou na Hugging Face pod licencí MIT: 321,3 miliardy parametrů v 62 souborech, dohromady 328,3 GB. Slovo „Flash“ se týká ceny provozu, ne rozměrů. Levný je proto,…

  12. Bezpečnost

    Spring AI 2.0.1 zavírá chybu v PDF i cestu k podstrčení modelu přes cache

    Spring AI opravilo dvě zranitelnosti ve zpracování dokumentů a lokálních modelů. Speciálně připravené PDF může zastavit vlákno pro načítání dat, místní uživatel na sdíleném stroji zase mohl…

  13. Licence a podmínky

    Nová licence Qwenu chce zvláštní smlouvu i po malém poskytovateli inference

    Qwen dal 24. srpna 2026 váhám modelu Qwen3.8-Flash-Next licenci Qwen Community License 1.0. Od licence svého největšího modelu, která vyšla o šestnáct dní dřív, se liší jedinou větou: chybí…

  14. Čísla

    OpenAI uvádí u čipu Jalapeño až 1,9krát více práce na watt

    První vlastní čip OpenAI pro běh modelů má podle výsledků výrobce zvládnout 1,5 až 1,9krát více práce na watt než srovnávané systémy Nvidia. Při stejné práci by to znamenalo o 33 až 47…

  15. Modely

    Nanbeige 4.2 pouští svých dvaadvacet vrstev dvakrát za sebou

    Model Nanbeige4.2-3B předčí v agentních testech podstatně větší modely a přitom má jen tři miliardy parametrů mimo vloženiny. Konfigurace prozrazuje proč: dvaadvacet vrstev vah se na každém…

  16. Nástroje

    Paseo ovládá z telefonu nativní CLI devětatřiceti agentních nástrojů

    Paseo pouští nativní příkazovou řádku cizích agentních nástrojů na stroji uživatele a ovládat se dá z telefonu, prohlížeče i desktopu. Model si nevybírá: rozhoduje o něm ta příkazová řádka,…

  17. U sebe doma

    vLLM 0.28.0 přesunul podporu bitsandbytes z hlavního stromu do zásuvného modulu

    Obsluha jazykových modelů vLLM vydala 26. srpna 2026 verzi 0.28.0 s 584 commity od 270 přispěvatelů. Podpora kvantizace bitsandbytes odešla z hlavního stromu do samostatného zásuvného…

  18. Čísla

    Tabulka n-gramů drží ve vahách Qwen3.8-Flash-Next 51 miliard parametrů

    Qwen zveřejnil váhy Qwen3.8-Flash-Next, na kterých chce postavit příští generaci svých modelů. Soubory nesou 179 999 981 459 parametrů a zaberou 360 GB. Přes 51 miliard z toho ale nic…

  19. Infrastruktura

    Cisco přidá do AI infrastruktury rackové servery Supermicro

    Sestava spojí výpočetní systémy, síťové přepínače a kapalinové chlazení. Do prodeje má jít v říjnu, takže zatím stojí hlavně na slibu tří dodavatelů.

  20. Bezpečnost

    V bezobslužném režimu zastaví Continue CLI ničivý příkaz jen podle neúplného seznamu

    Continue CLI umí běžet bez dohledu a v tom režimu spouští příkazy shellu bez ptaní. Jedinou tvrdou zábranou zůstává výčet nebezpečných cest: zná kořen, domovský adresář a čtyři systémové…