Všechny články
Kompletní výpis, od nejnovějšího.
-
Destilovaný videomodel FastH3 nese strojově čitelný doklad o svém vzniku
FastVideo zveřejnil čtyřkrokovou destilaci videomodelu MiniMax H3 a přiložil k ní soubor provenance.json: revizi základních vah, číslo kroku trénování, otisky sha256 i větu o tom, čím se…
-
Astron Agent má opravu kopírování cizích pracovních postupů zatím jen v hlavní větvi
Zranitelnost CVE-2026-82475 dovolovala přihlášenému uživateli přepsat pracovní postup jiného účtu nebo si zkopírovat jeho definici. Oprava je od 25. srpna v hlavní větvi, poslední vydání 1…
-
Triton 3.8.0 překládá jádra pro Rubin, který je zatím jen v náhledu dokumentace PTX
Vydání z 28. srpna přidalo do překladače Triton cíl „cuda:107“ pro architekturu, kterou NVIDIA popisuje zatím jen ve vývojářském náhledu dokumentace PTX. Z Tritonu i z toho náhledu se dá…
-
Dohled v PILOTu umí přesměrovat běžícího agenta
Preprint týmu AllSpark z 27. srpna popisuje agenta, jehož práci za běhu sleduje a směruje druhý agent. PILOT v Terminal-Bench 2.0 překonal nejlepší srovnávaný nástroj o 4,4 až 5,0…
-
Superwhisper přidal do licence S1-mini povinnost uvádět model původním jménem
Superwhisper zveřejnil 12. srpna 2026 model S1-mini pro čištění přepisů řeči a přiložil k němu čistý text licence Apache 2.0. Pátý den po vydání do souboru přibyla podmínka navíc: model se…
-
Integrace Sentry SDK mohla do verze 2.66.1 vypnout schvalování nástrojů
Nové hlášení ze 30. srpna upozornilo, že integrace OpenAI Agents v Sentry SDK sestavovala každý nástroj znovu a nepřenášela jeho schvalování ani vstupní a výstupní kontroly. Oprava je od 10…
-
Z.AI vyměnila u GLM-5.3 licenci MIT za vlastní podmínky s prahem deseti miliard dolarů
Z.AI zveřejnila 27. srpna 2026 váhy modelu GLM-5.3 a nedala jim MIT jako čtyřem předchozím verzím řady. Vlastní licence přidává jednu podmínku: kdo provozuje inferenci jako službu a má…
-
Experti uložení po čtyřech bitech tvoří 94 % vah DeepSeeku V4 Flash Vision
DeepSeek nahrál 31. srpna 2026 na Hugging Face váhy experimentálního modelu DeepSeek-V4-Flash-Vision-Exp. Osmačtyřicet souborů má dohromady 167,8 GB a 93,8 % z toho zabírají směrovaní…
-
Browser-use web-ui ukládá klíče k modelům do nešifrovaných souborů
Záznam CVE-2026-82640 zveřejněný 30. srpna popisuje, jak browser-use web-ui ukládá klíče k modelům do souborů JSON v čitelné podobě. Týká se vydání 2.0.0 až 3.0.0 a stejný zápis zůstává i v…
-
Nová cesta v llama.cpp zrychluje dávkové zpracování IQ vah na procesoru
Sestavení b10726 přidalo procesorový panel, který u IQ kvantizací dekóduje osm řádků vah najednou. Autor změny naměřil při dávce 512 na AMD EPYC 9654 podle modelu a formátu 1,9násobnou až 8…
-
Smíšená kvantizace zmenšila váhy Qwen3.8-27B na 8,4 gigabajtu
DASLab při IST Austria zveřejnila tři kvantizace modelu Qwen3.8-27B. Každému velkému tenzoru přidělují přesnost zvlášť, takže nejmenší jazykové váhy zabírají 8,4 GB místo 53,8 GB u…
-
Knihovna ash_ai spouštěla text promptu jako zdrojový kód Elixiru
Šest záznamů CVE zveřejněných 31. srpna míří na jedinou knihovnu: rozšíření ash_ai, které do elixirového frameworku Ash přidává práci s jazykovými modely. Nejzávažnější z nich má známku 8,9…
-
Zrychlení jádra Qwen-Image se v celém požadavku neprojevilo
SGLang sloučil závěrečnou normalizaci a modulaci obrazového modelu Qwen-Image do jediného jádra. Samotná operace zrychlila podle délky vstupu 3,1krát až 5,6krát, deset měření celého…
-
Codex spouštěl program z nastavení cizího repozitáře mimo vlastní sandbox
OpenAI zveřejnila 1. září 2026 čtyři záznamy CVE ke svému agentnímu nástroji Codex. Tři z nich stojí na témže předpokladu: repozitář si s sebou nese vlastní soubor .git/config a Codex podle…
-
Google vyměnil u vah TimesFM 3.0 licenci Apache 2.0 za nekomerční podmínky
Google dal 24. srpna 2026 na Hugging Face váhy předpovědního modelu TimesFM 3.0 a karta modelu u nich uváděla licenci Apache 2.0. O necelé tři dny později k nim přibyly vlastní nekomerční…
-
Hlídač bezpečnosti k modelům Ling 3.0 stojí na jediné vrstvě pozornosti
Ant Group vydal 1. září 2026 dvě sady vah pod jménem SingProbe. Nejsou to samostatné modely: napojí se na běžící Ling 3.0, odečtou mu skryté stavy ze tří vrstev a ke každému vygenerovanému…
-
NVIDIA přesouvá řadič paměti z akcelerátoru do základního čipu NVHBM
NVIDIA oznámila NVHBM, která přesouvá řadič paměti z akcelerátoru do základního čipu v HBM. Proti HBM4E slibuje až o 30 % vyšší propustnost a o 15 % nižší spotřebu, u uvolněné plochy ale…
-
Pydantic AI 2.37 už váže volání nástroje k oznámené zprávě
Pydantic AI při odpovědi tvořené jen voláním nástroje posílala odkaz na zprávu, kterou proud AG-UI nikdy nezahájil. Verze 2.37.0 přidává prázdný pár začátku a konce zprávy; assistant-ui 0.0…
-
Codex zapne experimentální správu kontextu jen třem z šestnácti tarifů ChatGPT
Codex 0.153.0 vyšel 3. září 2026 a přidal vypnutou položku features.context_management.experimental_mode. Zapíná rozpočet tokenů, poznámky k historii a nástroj new_context. Naskočí ale jen…
-
MLflow ve verzích 2.1.0 až 3.14.x ignoroval zákaz pickle u modelů statsmodels
Bezpečnostní volba v MLflow měla zastavit načítání modelů uložených pomocí pickle, integrace statsmodels ji ale nekontrolovala. Upravený modelový artefakt proto mohl při načtení spustit kód…