Všechny články
Kompletní výpis, od nejnovějšího.
-
Licence modelu Thomson-1.0-Small nedovoluje jeho šíření ani úpravy
Thomson Reuters zveřejnil váhy modelu Thomson-1.0-Small a na kartě mu říká open-weight. Přiložená licence PolyForm Strict 1.0.0 ale dává právo jen k nekomerčnímu užití, a to bez šíření a…
-
Licence Breeze TTS 2 zakazuje komerčně používat i výstupy z vlastního serveru
BreezeBlue zveřejnila váhy řečového modelu Breeze TTS 2 a kód pro jeho spuštění. Kód je pod Apache 2.0, vlastní licence vah ale vyžaduje písemné svolení ke komerčnímu použití modelu,…
-
Váhy modelu Hy4 preview se ani ve verzi FP8 nevejdou na osm karet po 80 GB
Tencent nahrál na Hugging Face váhy vlajkového modelu Hy4 preview a dal je pod licenci Apache 2.0. Součet 131 souborů v repozitáři dá 1 560 GB, kvantizovaná verze FP8 zabere 813,8 GB. Návod…
-
Anthropic otevřel Model Hardware Standard jen vybraným laboratořím
Model Hardware Standard má sjednotit ovládání mikroskopů, pipetovacích robotů a robotických ramen přes společné příkazy a bezpečnostní limity. Anthropic 27. srpna otevřel výzkumný náhled…
-
Modul mcp.server.fastmcp se do SDK vrátil jen proto, aby spadl s odkazem na návod
Přejmenování třídy FastMCP na MCPServer nechalo ve druhé verzi knihovny mcp starý import padat na holé hlášce, ze které se nedalo poznat, že je nainstalovaná jiná hlavní verze. Vydání 2.1.1…
-
llama.cpp podporuje od sestavení b10665 DSpark pro Nemotron 3.5
Sestavení llama.cpp b10665 z 28. srpna umí vedle hlavního Nemotronu 3.5 načíst samostatný draft model DSpark od Nvidie. Ten přidá 1,35 GB dat k 21,58 GB cílového repozitáře. Autor změny…
-
Tři servery MCP dostaly týž den záznam CVE za to, že si neověřovaly volajícího
Dropbox, Timescale a ByteDance mají od 27. srpna 2026 každý svůj záznam CVE k serveru protokolu MCP a příčiny se překrývají. Obě oficiální sady MCP umí odmítnout požadavek, jehož hlavička…
-
Ray 2.58 zohledňuje KV cache při směrování dotazů mezi replikami
Ray 2.58 dokončil směrování požadavků podle toho, kolik jejich prefixu už leží v KV cache jednotlivých replik. Router převádí text na tokeny jednou, sleduje bloky v paměti GPU i RAM a při…
-
Záznamy CVE k platformě Cohere North neříkají, která verze je opravená
Databáze NVD zveřejnila 26. srpna čtyři záznamy o podnikové agentní platformě Cohere North ve verzi 1.1.5. Jméno produktu je v nich jen ve větě popisu; v polích pro výrobce, produkt a verzi…
-
Ollama 0.33.1 začala v MLX skutečně vynucovat JSON Schema
Ollama uměla přijmout JSON Schema i u modelů v MLX, její runner se jím však neřídil. Verze 0.33.1 to mění: XGrammar před každým krokem zakáže tokeny, které by porušily zadanou strukturu.…
-
GLM-5.3-Flash si drží KV cache jen v jedenácti ze 45 vrstev
Váhy modelu GLM-5.3-Flash jsou na Hugging Face pod licencí MIT: 321,3 miliardy parametrů v 62 souborech, dohromady 328,3 GB. Slovo „Flash“ se týká ceny provozu, ne rozměrů. Levný je proto,…
-
Spring AI 2.0.1 zavírá chybu v PDF i cestu k podstrčení modelu přes cache
Spring AI opravilo dvě zranitelnosti ve zpracování dokumentů a lokálních modelů. Speciálně připravené PDF může zastavit vlákno pro načítání dat, místní uživatel na sdíleném stroji zase mohl…
-
Nová licence Qwenu chce zvláštní smlouvu i po malém poskytovateli inference
Qwen dal 24. srpna 2026 váhám modelu Qwen3.8-Flash-Next licenci Qwen Community License 1.0. Od licence svého největšího modelu, která vyšla o šestnáct dní dřív, se liší jedinou větou: chybí…
-
OpenAI uvádí u čipu Jalapeño až 1,9krát více práce na watt
První vlastní čip OpenAI pro běh modelů má podle výsledků výrobce zvládnout 1,5 až 1,9krát více práce na watt než srovnávané systémy Nvidia. Při stejné práci by to znamenalo o 33 až 47…
-
Nanbeige 4.2 pouští svých dvaadvacet vrstev dvakrát za sebou
Model Nanbeige4.2-3B předčí v agentních testech podstatně větší modely a přitom má jen tři miliardy parametrů mimo vloženiny. Konfigurace prozrazuje proč: dvaadvacet vrstev vah se na každém…
-
Paseo ovládá z telefonu nativní CLI devětatřiceti agentních nástrojů
Paseo pouští nativní příkazovou řádku cizích agentních nástrojů na stroji uživatele a ovládat se dá z telefonu, prohlížeče i desktopu. Model si nevybírá: rozhoduje o něm ta příkazová řádka,…
-
vLLM 0.28.0 přesunul podporu bitsandbytes z hlavního stromu do zásuvného modulu
Obsluha jazykových modelů vLLM vydala 26. srpna 2026 verzi 0.28.0 s 584 commity od 270 přispěvatelů. Podpora kvantizace bitsandbytes odešla z hlavního stromu do samostatného zásuvného…
-
Tabulka n-gramů drží ve vahách Qwen3.8-Flash-Next 51 miliard parametrů
Qwen zveřejnil váhy Qwen3.8-Flash-Next, na kterých chce postavit příští generaci svých modelů. Soubory nesou 179 999 981 459 parametrů a zaberou 360 GB. Přes 51 miliard z toho ale nic…
-
Cisco přidá do AI infrastruktury rackové servery Supermicro
Sestava spojí výpočetní systémy, síťové přepínače a kapalinové chlazení. Do prodeje má jít v říjnu, takže zatím stojí hlavně na slibu tří dodavatelů.
-
V bezobslužném režimu zastaví Continue CLI ničivý příkaz jen podle neúplného seznamu
Continue CLI umí běžet bez dohledu a v tom režimu spouští příkazy shellu bez ptaní. Jedinou tvrdou zábranou zůstává výčet nebezpečných cest: zná kořen, domovský adresář a čtyři systémové…