Všechny články
Kompletní výpis, od nejnovějšího.
-
Pydantic AI 2.37 už váže volání nástroje k oznámené zprávě
Pydantic AI při odpovědi tvořené jen voláním nástroje posílala odkaz na zprávu, kterou proud AG-UI nikdy nezahájil. Verze 2.37.0 přidává prázdný pár začátku a konce zprávy; assistant-ui 0.0…
-
Knihovna ash_ai spouštěla text promptu jako zdrojový kód Elixiru
Šest záznamů CVE zveřejněných 31. srpna míří na jedinou knihovnu: rozšíření ash_ai, které do elixirového frameworku Ash přidává práci s jazykovými modely. Nejzávažnější z nich má známku 8,9…
-
NVIDIA přesouvá řadič paměti z akcelerátoru do základního čipu NVHBM
NVIDIA oznámila NVHBM, která přesouvá řadič paměti z akcelerátoru do základního čipu v HBM. Proti HBM4E slibuje až o 30 % vyšší propustnost a o 15 % nižší spotřebu, u uvolněné plochy ale…
-
Nová cesta v llama.cpp zrychluje dávkové zpracování IQ vah na procesoru
Sestavení b10726 přidalo procesorový panel, který u IQ kvantizací dekóduje osm řádků vah najednou. Autor změny naměřil při dávce 512 na AMD EPYC 9654 podle modelu a formátu 1,9násobnou až 8…
-
Experti uložení po čtyřech bitech tvoří 94 % vah DeepSeeku V4 Flash Vision
DeepSeek nahrál 31. srpna 2026 na Hugging Face váhy experimentálního modelu DeepSeek-V4-Flash-Vision-Exp. Osmačtyřicet souborů má dohromady 167,8 GB a 93,8 % z toho zabírají směrovaní…
-
Zrychlení jádra Qwen-Image se v celém požadavku neprojevilo
SGLang sloučil závěrečnou normalizaci a modulaci obrazového modelu Qwen-Image do jediného jádra. Samotná operace zrychlila podle délky vstupu 3,1krát až 5,6krát, deset měření celého…
-
Destilovaný videomodel FastH3 nese strojově čitelný doklad o svém vzniku
FastVideo zveřejnil čtyřkrokovou destilaci videomodelu MiniMax H3 a přiložil k ní soubor provenance.json: revizi základních vah, číslo kroku trénování, otisky sha256 i větu o tom, čím se…
-
Smíšená kvantizace zmenšila váhy Qwen3.8-27B na 8,4 gigabajtu
DASLab při IST Austria zveřejnila tři kvantizace modelu Qwen3.8-27B. Každému velkému tenzoru přidělují přesnost zvlášť, takže nejmenší jazykové váhy zabírají 8,4 GB místo 53,8 GB u…
-
Superwhisper přidal do licence S1-mini povinnost uvádět model původním jménem
Superwhisper zveřejnil 12. srpna 2026 model S1-mini pro čištění přepisů řeči a přiložil k němu čistý text licence Apache 2.0. Pátý den po vydání do souboru přibyla podmínka navíc: model se…
-
Browser-use web-ui ukládá klíče k modelům do nešifrovaných souborů
Záznam CVE-2026-82640 zveřejněný 30. srpna popisuje, jak browser-use web-ui ukládá klíče k modelům do souborů JSON v čitelné podobě. Týká se vydání 2.0.0 až 3.0.0 a stejný zápis zůstává i v…
-
Triton 3.8.0 překládá jádra pro Rubin, který je zatím jen v náhledu dokumentace PTX
Vydání z 28. srpna přidalo do překladače Triton cíl „cuda:107“ pro architekturu, kterou NVIDIA popisuje zatím jen ve vývojářském náhledu dokumentace PTX. Z Tritonu i z toho náhledu se dá…
-
Dohled v PILOTu umí přesměrovat běžícího agenta
Preprint týmu AllSpark z 27. srpna popisuje agenta, jehož práci za běhu sleduje a směruje druhý agent. PILOT v Terminal-Bench 2.0 překonal nejlepší srovnávaný nástroj o 4,4 až 5,0…
-
Vazba NIXL pro Rust běžela ve dvou obrazech Dynama na náhradních funkcích
NVIDIA vydala 29. srpna opravu Dynama 1.4.2. Ve dvou jeho kontejnerových obrazech ležela knihovna NIXL v adresáři, kam dynamický zavaděč nedohlédne; přitom je to ona, kdo při rozděleném…
-
Integrace Sentry SDK mohla do verze 2.66.1 vypnout schvalování nástrojů
Nové hlášení ze 30. srpna upozornilo, že integrace OpenAI Agents v Sentry SDK sestavovala každý nástroj znovu a nepřenášela jeho schvalování ani vstupní a výstupní kontroly. Oprava je od 10…
-
llama-quantize si na velký tenzor bere nejvýš osm gigabajtů operační paměti
Kvantizační nástroj z llama.cpp si na každý tenzor alokoval dva pomocné bloky po čtyřech bajtech na parametr, takže u opravdu velké vkládací tabulky šly nároky do stovek gigabajtů. Od 27.…
-
Astron Agent má opravu kopírování cizích pracovních postupů zatím jen v hlavní větvi
Zranitelnost CVE-2026-82475 dovolovala přihlášenému uživateli přepsat pracovní postup jiného účtu nebo si zkopírovat jeho definici. Oprava je od 25. srpna v hlavní větvi, poslední vydání 1…
-
Sada Monsoon ukázala větší rozdíly mezi regiony Indie než mezi osmi modely přepisu řeči
Hugging Face a Voice Arena přidaly do žebříčku Open ASR Leaderboard sady Monsoon pro indickou angličtinu a hindštinu. Každý klip v nich nese dvanáct údajů o mluvčím, a to stačilo, aby se…
-
Codex 0.151.0 dovoluje rozšířením přepsat výsledek nástroje MCP
Rozšíření Codexu mohou od verze 0.151.0 prohlédnout odpověď serveru MCP a před modelem ji nahradit. Dostanou i konečné argumenty a kontext volání; změna platí pro úspěšné i chybové výsledky…
-
Na vlastním testu Pipecatu vyskočil doladěný Nemotron 3 Nano z 28,6 na 72,3 procenta
Tým Pipecat vydal PhoneLLM Alpha 1, plné doladění modelu NVIDIA Nemotron 3 Nano 30B-A3B na telefonní hovory. Na vlastním žebříčku PhoneBench mu skóre stouplo z 28,6 na 72,3 %, tedy z…
-
Popis CVE k Hermes Agentu nesedí na odkazované opravné commity
Dvě bezpečnostní hlášení zveřejněná 28. srpna popisují chyby v katalogu MCP a ochraně citlivých souborů Hermes Agentu. První sedí na opravný commit přesně: větev main vystřídal neměnný…