Všechny články
Kompletní výpis, od nejnovějšího.
-
Claude sdílí paměť mezi chatem a cloudovým Coworkem
Anthropic propojil paměť v chatu s cloudovými úlohami Coworku. Co si Claude uloží při rozhovoru, může použít při samostatné práci a poznatek z Coworku se vrátí do dalších chatů. Uživatel…
-
Paseo ovládá z telefonu nativní CLI devětatřiceti agentních nástrojů
Paseo pouští nativní příkazovou řádku cizích agentních nástrojů na stroji uživatele a ovládat se dá z telefonu, prohlížeče i desktopu. Model si nevybírá: rozhoduje o něm ta příkazová řádka,…
-
vLLM 0.28.0 přesunul podporu bitsandbytes z hlavního stromu do zásuvného modulu
Obsluha jazykových modelů vLLM vydala 26. srpna 2026 verzi 0.28.0 s 584 commity od 270 přispěvatelů. Podpora kvantizace bitsandbytes odešla z hlavního stromu do samostatného zásuvného…
-
OpenAI uvádí u čipu Jalapeño až 1,9krát více práce na watt
První vlastní čip OpenAI pro běh modelů má podle výsledků výrobce zvládnout 1,5 až 1,9krát více práce na watt než srovnávané systémy Nvidia. Při stejné práci by to znamenalo o 33 až 47…
-
Spring AI 2.0.1 zavírá chybu v PDF i cestu k podstrčení modelu přes cache
Spring AI opravilo dvě zranitelnosti ve zpracování dokumentů a lokálních modelů. Speciálně připravené PDF může zastavit vlákno pro načítání dat, místní uživatel na sdíleném stroji zase mohl…
-
Tři servery MCP dostaly týž den záznam CVE za to, že si neověřovaly volajícího
Dropbox, Timescale a ByteDance mají od 27. srpna 2026 každý svůj záznam CVE k serveru protokolu MCP a příčiny se překrývají. Obě oficiální sady MCP umí odmítnout požadavek, jehož hlavička…
-
Váhy modelu Hy4 preview se ani ve verzi FP8 nevejdou na osm karet po 80 GB
Tencent nahrál na Hugging Face váhy vlajkového modelu Hy4 preview a dal je pod licenci Apache 2.0. Součet 131 souborů v repozitáři dá 1 560 GB, kvantizovaná verze FP8 zabere 813,8 GB. Návod…
-
Modul mcp.server.fastmcp se do SDK vrátil jen proto, aby spadl s odkazem na návod
Přejmenování třídy FastMCP na MCPServer nechalo ve druhé verzi knihovny mcp starý import padat na holé hlášce, ze které se nedalo poznat, že je nainstalovaná jiná hlavní verze. Vydání 2.1.1…
-
Ollama 0.33.1 začala v MLX skutečně vynucovat JSON Schema
Ollama uměla přijmout JSON Schema i u modelů v MLX, její runner se jím však neřídil. Verze 0.33.1 to mění: XGrammar před každým krokem zakáže tokeny, které by porušily zadanou strukturu.…
-
Ray 2.58 zohledňuje KV cache při směrování dotazů mezi replikami
Ray 2.58 dokončil směrování požadavků podle toho, kolik jejich prefixu už leží v KV cache jednotlivých replik. Router převádí text na tokeny jednou, sleduje bloky v paměti GPU i RAM a při…
-
llama.cpp podporuje od sestavení b10665 DSpark pro Nemotron 3.5
Sestavení llama.cpp b10665 z 28. srpna umí vedle hlavního Nemotronu 3.5 načíst samostatný draft model DSpark od Nvidie. Ten přidá 1,35 GB dat k 21,58 GB cílového repozitáře. Autor změny…
-
Sada Monsoon ukázala větší rozdíly mezi regiony Indie než mezi osmi modely přepisu řeči
Hugging Face a Voice Arena přidaly do žebříčku Open ASR Leaderboard sady Monsoon pro indickou angličtinu a hindštinu. Každý klip v nich nese dvanáct údajů o mluvčím, a to stačilo, aby se…
-
Na vlastním testu Pipecatu vyskočil doladěný Nemotron 3 Nano z 28,6 na 72,3 procenta
Tým Pipecat vydal PhoneLLM Alpha 1, plné doladění modelu NVIDIA Nemotron 3 Nano 30B-A3B na telefonní hovory. Na vlastním žebříčku PhoneBench mu skóre stouplo z 28,6 na 72,3 %, tedy z…
-
Licence modelu Thomson-1.0-Small nedovoluje jeho šíření ani úpravy
Thomson Reuters zveřejnil váhy modelu Thomson-1.0-Small a na kartě mu říká open-weight. Přiložená licence PolyForm Strict 1.0.0 ale dává právo jen k nekomerčnímu užití, a to bez šíření a…
-
Anthropic otevřel Model Hardware Standard jen vybraným laboratořím
Model Hardware Standard má sjednotit ovládání mikroskopů, pipetovacích robotů a robotických ramen přes společné příkazy a bezpečnostní limity. Anthropic 27. srpna otevřel výzkumný náhled…
-
Licence Breeze TTS 2 zakazuje komerčně používat i výstupy z vlastního serveru
BreezeBlue zveřejnila váhy řečového modelu Breeze TTS 2 a kód pro jeho spuštění. Kód je pod Apache 2.0, vlastní licence vah ale vyžaduje písemné svolení ke komerčnímu použití modelu,…
-
llama-quantize si na velký tenzor bere nejvýš osm gigabajtů operační paměti
Kvantizační nástroj z llama.cpp si na každý tenzor alokoval dva pomocné bloky po čtyřech bajtech na parametr, takže u opravdu velké vkládací tabulky šly nároky do stovek gigabajtů. Od 27.…
-
Vazba NIXL pro Rust běžela ve dvou obrazech Dynama na náhradních funkcích
NVIDIA vydala 29. srpna opravu Dynama 1.4.2. Ve dvou jeho kontejnerových obrazech ležela knihovna NIXL v adresáři, kam dynamický zavaděč nedohlédne; přitom je to ona, kdo při rozděleném…
-
Popis CVE k Hermes Agentu nesedí na odkazované opravné commity
Dvě bezpečnostní hlášení zveřejněná 28. srpna popisují chyby v katalogu MCP a ochraně citlivých souborů Hermes Agentu. První sedí na opravný commit přesně: větev main vystřídal neměnný…
-
Codex 0.151.0 dovoluje rozšířením přepsat výsledek nástroje MCP
Rozšíření Codexu mohou od verze 0.151.0 prohlédnout odpověď serveru MCP a před modelem ji nahradit. Dostanou i konečné argumenty a kontext volání; změna platí pro úspěšné i chybové výsledky…