Přeskočit na obsah

Všechny články

Kompletní výpis, od nejnovějšího.

  1. Nástroje

    Claude sdílí paměť mezi chatem a cloudovým Coworkem

    Anthropic propojil paměť v chatu s cloudovými úlohami Coworku. Co si Claude uloží při rozhovoru, může použít při samostatné práci a poznatek z Coworku se vrátí do dalších chatů. Uživatel…

  2. Nástroje

    Paseo ovládá z telefonu nativní CLI devětatřiceti agentních nástrojů

    Paseo pouští nativní příkazovou řádku cizích agentních nástrojů na stroji uživatele a ovládat se dá z telefonu, prohlížeče i desktopu. Model si nevybírá: rozhoduje o něm ta příkazová řádka,…

  3. U sebe doma

    vLLM 0.28.0 přesunul podporu bitsandbytes z hlavního stromu do zásuvného modulu

    Obsluha jazykových modelů vLLM vydala 26. srpna 2026 verzi 0.28.0 s 584 commity od 270 přispěvatelů. Podpora kvantizace bitsandbytes odešla z hlavního stromu do samostatného zásuvného…

  4. Čísla

    OpenAI uvádí u čipu Jalapeño až 1,9krát více práce na watt

    První vlastní čip OpenAI pro běh modelů má podle výsledků výrobce zvládnout 1,5 až 1,9krát více práce na watt než srovnávané systémy Nvidia. Při stejné práci by to znamenalo o 33 až 47…

  5. Bezpečnost

    Spring AI 2.0.1 zavírá chybu v PDF i cestu k podstrčení modelu přes cache

    Spring AI opravilo dvě zranitelnosti ve zpracování dokumentů a lokálních modelů. Speciálně připravené PDF může zastavit vlákno pro načítání dat, místní uživatel na sdíleném stroji zase mohl…

  6. Bezpečnost

    Tři servery MCP dostaly týž den záznam CVE za to, že si neověřovaly volajícího

    Dropbox, Timescale a ByteDance mají od 27. srpna 2026 každý svůj záznam CVE k serveru protokolu MCP a příčiny se překrývají. Obě oficiální sady MCP umí odmítnout požadavek, jehož hlavička…

  7. Čísla

    Váhy modelu Hy4 preview se ani ve verzi FP8 nevejdou na osm karet po 80 GB

    Tencent nahrál na Hugging Face váhy vlajkového modelu Hy4 preview a dal je pod licenci Apache 2.0. Součet 131 souborů v repozitáři dá 1 560 GB, kvantizovaná verze FP8 zabere 813,8 GB. Návod…

  8. Nástroje

    Modul mcp.server.fastmcp se do SDK vrátil jen proto, aby spadl s odkazem na návod

    Přejmenování třídy FastMCP na MCPServer nechalo ve druhé verzi knihovny mcp starý import padat na holé hlášce, ze které se nedalo poznat, že je nainstalovaná jiná hlavní verze. Vydání 2.1.1…

  9. Nástroje

    Ollama 0.33.1 začala v MLX skutečně vynucovat JSON Schema

    Ollama uměla přijmout JSON Schema i u modelů v MLX, její runner se jím však neřídil. Verze 0.33.1 to mění: XGrammar před každým krokem zakáže tokeny, které by porušily zadanou strukturu.…

  10. Infrastruktura

    Ray 2.58 zohledňuje KV cache při směrování dotazů mezi replikami

    Ray 2.58 dokončil směrování požadavků podle toho, kolik jejich prefixu už leží v KV cache jednotlivých replik. Router převádí text na tokeny jednou, sleduje bloky v paměti GPU i RAM a při…

  11. U sebe doma

    llama.cpp podporuje od sestavení b10665 DSpark pro Nemotron 3.5

    Sestavení llama.cpp b10665 z 28. srpna umí vedle hlavního Nemotronu 3.5 načíst samostatný draft model DSpark od Nvidie. Ten přidá 1,35 GB dat k 21,58 GB cílového repozitáře. Autor změny…

  12. Čísla

    Sada Monsoon ukázala větší rozdíly mezi regiony Indie než mezi osmi modely přepisu řeči

    Hugging Face a Voice Arena přidaly do žebříčku Open ASR Leaderboard sady Monsoon pro indickou angličtinu a hindštinu. Každý klip v nich nese dvanáct údajů o mluvčím, a to stačilo, aby se…

  13. Modely

    Na vlastním testu Pipecatu vyskočil doladěný Nemotron 3 Nano z 28,6 na 72,3 procenta

    Tým Pipecat vydal PhoneLLM Alpha 1, plné doladění modelu NVIDIA Nemotron 3 Nano 30B-A3B na telefonní hovory. Na vlastním žebříčku PhoneBench mu skóre stouplo z 28,6 na 72,3 %, tedy z…

  14. Licence a podmínky

    Licence modelu Thomson-1.0-Small nedovoluje jeho šíření ani úpravy

    Thomson Reuters zveřejnil váhy modelu Thomson-1.0-Small a na kartě mu říká open-weight. Přiložená licence PolyForm Strict 1.0.0 ale dává právo jen k nekomerčnímu užití, a to bez šíření a…

  15. Infrastruktura

    Anthropic otevřel Model Hardware Standard jen vybraným laboratořím

    Model Hardware Standard má sjednotit ovládání mikroskopů, pipetovacích robotů a robotických ramen přes společné příkazy a bezpečnostní limity. Anthropic 27. srpna otevřel výzkumný náhled…

  16. Licence a podmínky

    Licence Breeze TTS 2 zakazuje komerčně používat i výstupy z vlastního serveru

    BreezeBlue zveřejnila váhy řečového modelu Breeze TTS 2 a kód pro jeho spuštění. Kód je pod Apache 2.0, vlastní licence vah ale vyžaduje písemné svolení ke komerčnímu použití modelu,…

  17. U sebe doma

    llama-quantize si na velký tenzor bere nejvýš osm gigabajtů operační paměti

    Kvantizační nástroj z llama.cpp si na každý tenzor alokoval dva pomocné bloky po čtyřech bajtech na parametr, takže u opravdu velké vkládací tabulky šly nároky do stovek gigabajtů. Od 27.…

  18. Infrastruktura

    Vazba NIXL pro Rust běžela ve dvou obrazech Dynama na náhradních funkcích

    NVIDIA vydala 29. srpna opravu Dynama 1.4.2. Ve dvou jeho kontejnerových obrazech ležela knihovna NIXL v adresáři, kam dynamický zavaděč nedohlédne; přitom je to ona, kdo při rozděleném…

  19. Bezpečnost

    Popis CVE k Hermes Agentu nesedí na odkazované opravné commity

    Dvě bezpečnostní hlášení zveřejněná 28. srpna popisují chyby v katalogu MCP a ochraně citlivých souborů Hermes Agentu. První sedí na opravný commit přesně: větev main vystřídal neměnný…

  20. Nástroje

    Codex 0.151.0 dovoluje rozšířením přepsat výsledek nástroje MCP

    Rozšíření Codexu mohou od verze 0.151.0 prohlédnout odpověď serveru MCP a před modelem ji nahradit. Dostanou i konečné argumenty a kontext volání; změna platí pro úspěšné i chybové výsledky…