Přeskočit na obsah

Všechny články

Kompletní výpis, od nejnovějšího.

  1. Bezpečnost

    Přihlášený uživatel OpenShift AI může načíst společné klíče NVIDIA

    Red Hat zveřejnil 7. září zranitelnost CVE-2026-86332 se skóre 6,5. Přihlášený uživatel dashboardu OpenShift AI může bez správcovského oprávnění načíst společný klíč NVIDIA NGC i…

  2. Nástroje

    Filtr proměnných prostředí v lokálním sandboxu Agents SDK se musí zapnout ručně

    Knihovna openai-agents vydala 8. září verzi 0.22.1 s možností omezit, které proměnné prostředí hostitele uvidí příkaz spuštěný agentem. Zapíná se ručně; bez toho příkaz dál dostává kopii…

  3. Čísla

    Pydantic AI 2.40 po zapnutí každou hodinu stahuje 1 678 cenových položek

    Pydantic AI 2.40 přidala volitelné stahování cen modelů hned po startu a potom každou hodinu. Při našem testu se seznam rozšířil z 1 646 na 1 678 položek; výpadek stahování ponechal v…

  4. U sebe doma

    llama.cpp sloučil pro DeepSeek V4 zhruba 137 uzlů do jednoho spuštění

    Backend Vulkan v llama.cpp dostal tři sloučené operace pro hyperpropojení DeepSeeku V4. Při dekódování na Strix Halo naměřil autor změny 16,77 místo 11,16 tokenu za sekundu, ale každé…

  5. Licence a podmínky

    Z licence Breeze TTS 2 zmizel bod, který žádal souhlas od každého dalšího příjemce

    Firma RESONIA vydala 1. září druhé znění licence k řečovému modelu Breeze TTS 2. Jediná věcná změna je vypuštění bodu, který po každém, kdo model šíří dál, chtěl souhlas od každého příjemce…

  6. Bezpečnost

    Poslední požadavek v dávce dostal ve vLLM odpověď toho prvního

    Hlášení CVE-2026-73558 z 8. září popisuje přetečení 32bitového indexu ve výpočetním jádře serveru vLLM. Sejde-li se v jedné dávce dost tokenů, sáhne výpočet pro poslední požadavek na data…

  7. Nástroje

    Python SDK pro MCP už nenásleduje přesměrování na jiný server

    MCP Python SDK 2.2.0 už nenásleduje přesměrování na jiný server, protože by na něj mohl znovu poslat přihlašovací údaje i tělo požadavku. Vydání ze 7. září také zpřísnilo kontrolu OAuth a…

  8. Nástroje

    Pydantic AI 2.41 umí vytvářet obrázky přímo, bez běhu agenta

    Pydantic AI 2.41 přidala samostatné rozhraní ImageGenerator pro tvorbu a úpravy obrázků. Aplikace už nemusí kvůli obrazovému modelu spouštět agenta; společné volání ale zakrývá rozdíly v…

  9. Čísla

    Modely Flare a Sunburst z GPT Image 2.5 mají stejné sazby za token

    OpenAI rozdělila GPT Image 2.5 do dvou modelů pro API. Flare má rychleji obsloužit běžné generování, Sunburst má přesněji upravovat obraz; sazby za textové i obrazové tokeny mají shodné.

  10. Nástroje

    Pydantic AI 2.42 připojí modely GitHub Copilotu přes vlastní adaptér

    Pydantic AI 2.42 dostala vlastní provider pro modely nabízené v předplatném GitHub Copilot. Běžný adaptér pro rozhraní OpenAI nad nimi selhával na chybějících polích a u modelů Claude a…

  11. Modely

    Z trojice modelů Nex-N2.5 chybí na Hugging Face váhy jen prostřednímu Pro

    Nex AGI vydala 8. září rodinu agentních modelů Nex-N2.5 ve třech velikostech a slibuje otevřené váhy. Nejmenší mini má 70 GB v BF16 a největší Max 1,65 TB ve FP8, repozitář Pro nese zatím…

  12. U sebe doma

    Ollama vrací Codexu shrnutí konverzace jako prostý JSON v poli encrypted_content

    Testovací verze Ollamy 0.34.0 přidává do rozhraní kompatibilního s OpenAI koncový bod /v1/responses/compact a rozumí spouštěči kompakce, který Codex posílá na konci vstupu. Shrnutí dělá…

  13. Modely

    Streamovací VibeVoice-ASR od Microsoftu přepisuje řeč i s mluvčím už během nahrávky

    Microsoft vydal 2. září VibeVoice-ASR-Streaming ve dvou velikostech pod licencí MIT. Model vydává přepis po blocích 2,9 s a u každé věty říká, kdo ji řekl, bez zvláštního kroku pro…

  14. Čísla

    Zbytečný převod na 32 bitů bral v knihovně TRL přes pětinu času na grafické kartě

    Vnitřní smyčka výchozí ztrátové funkce v knihovně TRL převáděla obě vstupní matice ze šestnácti bitů na dvaatřicet, ačkoli obě v paměti ležely v šestnácti. Násobení se tím přesunulo z…

  15. Infrastruktura

    vLLM 0.29 zapíná Model Runner V2, který dokumentace dál označuje za neúplný

    vLLM 0.29.0 změnilo 9. září výchozí cestu, která připravuje vstupy a spouští model na akcelerátoru. Model Runner V2 má zjednodušit asynchronní provoz a šetřit paměť, k V1 se však program…

  16. Bezpečnost

    Knihovna Transformers 5.17 přestala ukládat cizí kód před souhlasem

    Knihovna Transformers uměla převzít z modelového repozitáře vlastní způsob generování. Soubor s cizím kódem však stáhla a uložila do mezipaměti dřív, než se uživatele zeptala, zda mu…

  17. Licence a podmínky

    Lightricks zakázal v licenci LTX-2.5 odstraňovat skryté označení z výstupu modelu

    Komunitní licence videomodelů LTX-2.x nese datum 11. srpna 2026 a oddíl o běhových omezeních v ní narostl z 69 slov na 739. Zakazuje odstranit z modelu i z jeho výstupů vodoznak, údaje o…

  18. Čísla

    Globální KV cache DeepSeeku V4.1 Flash zabere při milionu tokenů 890 MiB

    DeepSeek zveřejnil váhy multimodálního modelu V4.1 Flash s kontextem dlouhým 1 048 576 tokenů. Globální KV cache ukládá 890 bajtů na token, takže při zaplnění celého okna zabere přesně 890…

  19. Nástroje

    Gemini CLI 0.59 ignoruje servery MCP z nedůvěryhodné složky

    Gemini CLI 0.59 srovnala chování svého experimentálního serveru A2A s pravidly pro důvěryhodné složky. Když prostředí označí pracovní adresář za nedůvěryhodný, server už z něj nepřevezme…

  20. Nástroje

    Cursor spustil Projects, kde koordinační agent kód nepíše a řídí ostatní agenty

    Cursor spustil 10. září funkci Projects. Uživatel v ní mluví s jediným koordinačním agentem, který sám do kódu nesáhne: sestaví plán a rozdá práci dalším agentům na cloudovém počítači…