Přeskočit na obsah

Všechny články

Kompletní výpis, od nejnovějšího.

  1. Bezpečnost

    Poslední požadavek v dávce dostal ve vLLM odpověď toho prvního

    Hlášení CVE-2026-73558 z 8. září popisuje přetečení 32bitového indexu ve výpočetním jádře serveru vLLM. Sejde-li se v jedné dávce dost tokenů, sáhne výpočet pro poslední požadavek na data…

  2. Infrastruktura

    Prompt delší než 272 tisíc tokenů zdraží u GPT-6 Astra celý požadavek

    OpenAI vydala 3. září GPT-6 Astra s oknem 1 050 000 tokenů a sazbou 10 dolarů za milion vstupních tokenů. Prompt nad 272 tisíc tokenů ale přepne účtování na dvojnásobek u vstupu a na…

  3. Čísla

    Modely Flare a Sunburst z GPT Image 2.5 mají stejné sazby za token

    OpenAI rozdělila GPT Image 2.5 do dvou modelů pro API. Flare má rychleji obsloužit běžné generování, Sunburst má přesněji upravovat obraz; sazby za textové i obrazové tokeny mají shodné.

  4. Nástroje

    Filtr proměnných prostředí v lokálním sandboxu Agents SDK se musí zapnout ručně

    Knihovna openai-agents vydala 8. září verzi 0.22.1 s možností omezit, které proměnné prostředí hostitele uvidí příkaz spuštěný agentem. Zapíná se ručně; bez toho příkaz dál dostává kopii…

  5. Licence a podmínky

    Z licence Breeze TTS 2 zmizel bod, který žádal souhlas od každého dalšího příjemce

    Firma RESONIA vydala 1. září druhé znění licence k řečovému modelu Breeze TTS 2. Jediná věcná změna je vypuštění bodu, který po každém, kdo model šíří dál, chtěl souhlas od každého příjemce…

  6. Čísla

    Globální KV cache DeepSeeku V4.1 Flash zabere při milionu tokenů 890 MiB

    DeepSeek zveřejnil váhy multimodálního modelu V4.1 Flash s kontextem dlouhým 1 048 576 tokenů. Globální KV cache ukládá 890 bajtů na token, takže při zaplnění celého okna zabere přesně 890…

  7. Modely

    Dvě tabulky slovníku zabírají v modelu MiniCPM5-2B pětinu parametrů

    Skupina OpenBMB vydala 6. září model MiniCPM5-2B pro běh na koncových zařízeních. Z jeho 2 516 756 480 parametrů připadá 534 773 760 na dvojici tabulek, které převádějí tokeny na vektory a…

  8. U sebe doma

    llama.cpp počítal u sedmi architektur normalizaci jinak než jejich referenční kód

    Vektory dotazů a klíčů v hybridní vrstvě Gated DeltaNet dělil llama.cpp odmocninou ořezanou zdola, kdežto knihovna, ke které se jejich referenční kód hlásí, k té odmocnině malé číslo…

  9. Bezpečnost

    Knihovna Transformers 5.17 přestala ukládat cizí kód před souhlasem

    Knihovna Transformers uměla převzít z modelového repozitáře vlastní způsob generování. Soubor s cizím kódem však stáhla a uložila do mezipaměti dřív, než se uživatele zeptala, zda mu…

  10. Modely

    Zrychlená verze videomodelu MiniMax H3 dokládá slíbenou kvalitu šesti srovnáními

    Váhy VDN-H3 přidávají k videomodelu MiniMax H3 druhou, levnější větev pozornosti a podle autorů z něj udělají 74,5násobně rychlejší stroj. Rychlost mají rozepsanou po jednotlivých krocích…

  11. Nástroje

    Pydantic AI 2.41 umí vytvářet obrázky přímo, bez běhu agenta

    Pydantic AI 2.41 přidala samostatné rozhraní ImageGenerator pro tvorbu a úpravy obrázků. Aplikace už nemusí kvůli obrazovému modelu spouštět agenta; společné volání ale zakrývá rozdíly v…

  12. Infrastruktura

    Dify 1.17.1 vyžaduje u Weaviate postup přes dvanáct menších verzí

    Vlastní instalace Dify s přibalenou databází Weaviate nesmí při přechodu na verzi 1.17.1 skočit rovnou z 1.27.0 na 1.39.2. Návod předepisuje zálohu a třináct spuštění novějšího obrazu;…

  13. Nástroje

    Pydantic AI 2.42 připojí modely GitHub Copilotu přes vlastní adaptér

    Pydantic AI 2.42 dostala vlastní provider pro modely nabízené v předplatném GitHub Copilot. Běžný adaptér pro rozhraní OpenAI nad nimi selhával na chybějících polích a u modelů Claude a…

  14. Infrastruktura

    vLLM 0.29 zapíná Model Runner V2, který dokumentace dál označuje za neúplný

    vLLM 0.29.0 změnilo 9. září výchozí cestu, která připravuje vstupy a spouští model na akcelerátoru. Model Runner V2 má zjednodušit asynchronní provoz a šetřit paměť, k V1 se však program…

  15. U sebe doma

    llama.cpp sloučil pro DeepSeek V4 zhruba 137 uzlů do jednoho spuštění

    Backend Vulkan v llama.cpp dostal tři sloučené operace pro hyperpropojení DeepSeeku V4. Při dekódování na Strix Halo naměřil autor změny 16,77 místo 11,16 tokenu za sekundu, ale každé…

  16. Bezpečnost

    Hlídač agentů v API OpenAI umí konverzaci zastavit, hotové kroky ale nevrátí zpět

    Spolu s modelem GPT-6 Astra ohlásilo OpenAI 3. září 2026 systém, který na pozadí čte uvažování agenta a při podezření na nezamýšlený přenos dat nebo destruktivní zásah konverzaci zastaví.…

  17. Nástroje

    Python SDK pro MCP už nenásleduje přesměrování na jiný server

    MCP Python SDK 2.2.0 už nenásleduje přesměrování na jiný server, protože by na něj mohl znovu poslat přihlašovací údaje i tělo požadavku. Vydání ze 7. září také zpřísnilo kontrolu OAuth a…

  18. Licence a podmínky

    Sada 4,5 miliardy záznamů o videích z TikToku vznikla sběrem proti jeho podmínkám

    Na Hugging Face leží od 2. září 289 GB popisků, počtů přehrání a značek zvuků ke 4,5 miliardy příspěvků z TikToku. Autor v kartě sady píše, že data sebral přes rozhraní mobilní aplikace a…

  19. Čísla

    Pydantic AI 2.40 po zapnutí každou hodinu stahuje 1 678 cenových položek

    Pydantic AI 2.40 přidala volitelné stahování cen modelů hned po startu a potom každou hodinu. Při našem testu se seznam rozšířil z 1 646 na 1 678 položek; výpadek stahování ponechal v…

  20. Bezpečnost

    Přihlášený uživatel OpenShift AI může načíst společné klíče NVIDIA

    Red Hat zveřejnil 7. září zranitelnost CVE-2026-86332 se skóre 6,5. Přihlášený uživatel dashboardu OpenShift AI může bez správcovského oprávnění načíst společný klíč NVIDIA NGC i…