Přeskočit na obsah

Všechny články

Kompletní výpis, od nejnovějšího.

  1. Modely

    Destilovaný videomodel FastH3 nese strojově čitelný doklad o svém vzniku

    FastVideo zveřejnil čtyřkrokovou destilaci videomodelu MiniMax H3 a přiložil k ní soubor provenance.json: revizi základních vah, číslo kroku trénování, otisky sha256 i větu o tom, čím se…

  2. Bezpečnost

    Astron Agent má opravu kopírování cizích pracovních postupů zatím jen v hlavní větvi

    Zranitelnost CVE-2026-82475 dovolovala přihlášenému uživateli přepsat pracovní postup jiného účtu nebo si zkopírovat jeho definici. Oprava je od 25. srpna v hlavní větvi, poslední vydání 1…

  3. Infrastruktura

    Triton 3.8.0 překládá jádra pro Rubin, který je zatím jen v náhledu dokumentace PTX

    Vydání z 28. srpna přidalo do překladače Triton cíl „cuda:107“ pro architekturu, kterou NVIDIA popisuje zatím jen ve vývojářském náhledu dokumentace PTX. Z Tritonu i z toho náhledu se dá…

  4. Nástroje

    Dohled v PILOTu umí přesměrovat běžícího agenta

    Preprint týmu AllSpark z 27. srpna popisuje agenta, jehož práci za běhu sleduje a směruje druhý agent. PILOT v Terminal-Bench 2.0 překonal nejlepší srovnávaný nástroj o 4,4 až 5,0…

  5. Licence a podmínky

    Superwhisper přidal do licence S1-mini povinnost uvádět model původním jménem

    Superwhisper zveřejnil 12. srpna 2026 model S1-mini pro čištění přepisů řeči a přiložil k němu čistý text licence Apache 2.0. Pátý den po vydání do souboru přibyla podmínka navíc: model se…

  6. Bezpečnost

    Integrace Sentry SDK mohla do verze 2.66.1 vypnout schvalování nástrojů

    Nové hlášení ze 30. srpna upozornilo, že integrace OpenAI Agents v Sentry SDK sestavovala každý nástroj znovu a nepřenášela jeho schvalování ani vstupní a výstupní kontroly. Oprava je od 10…

  7. Licence a podmínky

    Z.AI vyměnila u GLM-5.3 licenci MIT za vlastní podmínky s prahem deseti miliard dolarů

    Z.AI zveřejnila 27. srpna 2026 váhy modelu GLM-5.3 a nedala jim MIT jako čtyřem předchozím verzím řady. Vlastní licence přidává jednu podmínku: kdo provozuje inferenci jako službu a má…

  8. Čísla

    Experti uložení po čtyřech bitech tvoří 94 % vah DeepSeeku V4 Flash Vision

    DeepSeek nahrál 31. srpna 2026 na Hugging Face váhy experimentálního modelu DeepSeek-V4-Flash-Vision-Exp. Osmačtyřicet souborů má dohromady 167,8 GB a 93,8 % z toho zabírají směrovaní…

  9. Bezpečnost

    Browser-use web-ui ukládá klíče k modelům do nešifrovaných souborů

    Záznam CVE-2026-82640 zveřejněný 30. srpna popisuje, jak browser-use web-ui ukládá klíče k modelům do souborů JSON v čitelné podobě. Týká se vydání 2.0.0 až 3.0.0 a stejný zápis zůstává i v…

  10. U sebe doma

    Nová cesta v llama.cpp zrychluje dávkové zpracování IQ vah na procesoru

    Sestavení b10726 přidalo procesorový panel, který u IQ kvantizací dekóduje osm řádků vah najednou. Autor změny naměřil při dávce 512 na AMD EPYC 9654 podle modelu a formátu 1,9násobnou až 8…

  11. Modely

    Smíšená kvantizace zmenšila váhy Qwen3.8-27B na 8,4 gigabajtu

    DASLab při IST Austria zveřejnila tři kvantizace modelu Qwen3.8-27B. Každému velkému tenzoru přidělují přesnost zvlášť, takže nejmenší jazykové váhy zabírají 8,4 GB místo 53,8 GB u…

  12. Bezpečnost

    Knihovna ash_ai spouštěla text promptu jako zdrojový kód Elixiru

    Šest záznamů CVE zveřejněných 31. srpna míří na jedinou knihovnu: rozšíření ash_ai, které do elixirového frameworku Ash přidává práci s jazykovými modely. Nejzávažnější z nich má známku 8,9…

  13. Čísla

    Zrychlení jádra Qwen-Image se v celém požadavku neprojevilo

    SGLang sloučil závěrečnou normalizaci a modulaci obrazového modelu Qwen-Image do jediného jádra. Samotná operace zrychlila podle délky vstupu 3,1krát až 5,6krát, deset měření celého…

  14. Bezpečnost

    Codex spouštěl program z nastavení cizího repozitáře mimo vlastní sandbox

    OpenAI zveřejnila 1. září 2026 čtyři záznamy CVE ke svému agentnímu nástroji Codex. Tři z nich stojí na témže předpokladu: repozitář si s sebou nese vlastní soubor .git/config a Codex podle…

  15. Licence a podmínky

    Google vyměnil u vah TimesFM 3.0 licenci Apache 2.0 za nekomerční podmínky

    Google dal 24. srpna 2026 na Hugging Face váhy předpovědního modelu TimesFM 3.0 a karta modelu u nich uváděla licenci Apache 2.0. O necelé tři dny později k nim přibyly vlastní nekomerční…

  16. Modely

    Hlídač bezpečnosti k modelům Ling 3.0 stojí na jediné vrstvě pozornosti

    Ant Group vydal 1. září 2026 dvě sady vah pod jménem SingProbe. Nejsou to samostatné modely: napojí se na běžící Ling 3.0, odečtou mu skryté stavy ze tří vrstev a ke každému vygenerovanému…

  17. Infrastruktura

    NVIDIA přesouvá řadič paměti z akcelerátoru do základního čipu NVHBM

    NVIDIA oznámila NVHBM, která přesouvá řadič paměti z akcelerátoru do základního čipu v HBM. Proti HBM4E slibuje až o 30 % vyšší propustnost a o 15 % nižší spotřebu, u uvolněné plochy ale…

  18. Nástroje

    Pydantic AI 2.37 už váže volání nástroje k oznámené zprávě

    Pydantic AI při odpovědi tvořené jen voláním nástroje posílala odkaz na zprávu, kterou proud AG-UI nikdy nezahájil. Verze 2.37.0 přidává prázdný pár začátku a konce zprávy; assistant-ui 0.0…

  19. Nástroje

    Codex zapne experimentální správu kontextu jen třem z šestnácti tarifů ChatGPT

    Codex 0.153.0 vyšel 3. září 2026 a přidal vypnutou položku features.context_management.experimental_mode. Zapíná rozpočet tokenů, poznámky k historii a nástroj new_context. Naskočí ale jen…

  20. Bezpečnost

    MLflow ve verzích 2.1.0 až 3.14.x ignoroval zákaz pickle u modelů statsmodels

    Bezpečnostní volba v MLflow měla zastavit načítání modelů uložených pomocí pickle, integrace statsmodels ji ale nekontrolovala. Upravený modelový artefakt proto mohl při načtení spustit kód…