Všechny články
Kompletní výpis, od nejnovějšího.
-
Ollama vrací Codexu shrnutí konverzace jako prostý JSON v poli encrypted_content
Testovací verze Ollamy 0.34.0 přidává do rozhraní kompatibilního s OpenAI koncový bod /v1/responses/compact a rozumí spouštěči kompakce, který Codex posílá na konci vstupu. Shrnutí dělá…
-
Knihovna Transformers 5.17 přestala ukládat cizí kód před souhlasem
Knihovna Transformers uměla převzít z modelového repozitáře vlastní způsob generování. Soubor s cizím kódem však stáhla a uložila do mezipaměti dřív, než se uživatele zeptala, zda mu…
-
Z trojice modelů Nex-N2.5 chybí na Hugging Face váhy jen prostřednímu Pro
Nex AGI vydala 8. září rodinu agentních modelů Nex-N2.5 ve třech velikostech a slibuje otevřené váhy. Nejmenší mini má 70 GB v BF16 a největší Max 1,65 TB ve FP8, repozitář Pro nese zatím…
-
vLLM 0.29 zapíná Model Runner V2, který dokumentace dál označuje za neúplný
vLLM 0.29.0 změnilo 9. září výchozí cestu, která připravuje vstupy a spouští model na akcelerátoru. Model Runner V2 má zjednodušit asynchronní provoz a šetřit paměť, k V1 se však program…
-
Modely Flare a Sunburst z GPT Image 2.5 mají stejné sazby za token
OpenAI rozdělila GPT Image 2.5 do dvou modelů pro API. Flare má rychleji obsloužit běžné generování, Sunburst má přesněji upravovat obraz; sazby za textové i obrazové tokeny mají shodné.
-
Poslední požadavek v dávce dostal ve vLLM odpověď toho prvního
Hlášení CVE-2026-73558 z 8. září popisuje přetečení 32bitového indexu ve výpočetním jádře serveru vLLM. Sejde-li se v jedné dávce dost tokenů, sáhne výpočet pro poslední požadavek na data…
-
Pydantic AI 2.42 připojí modely GitHub Copilotu přes vlastní adaptér
Pydantic AI 2.42 dostala vlastní provider pro modely nabízené v předplatném GitHub Copilot. Běžný adaptér pro rozhraní OpenAI nad nimi selhával na chybějících polích a u modelů Claude a…
-
Z licence Breeze TTS 2 zmizel bod, který žádal souhlas od každého dalšího příjemce
Firma RESONIA vydala 1. září druhé znění licence k řečovému modelu Breeze TTS 2. Jediná věcná změna je vypuštění bodu, který po každém, kdo model šíří dál, chtěl souhlas od každého příjemce…
-
Pydantic AI 2.41 umí vytvářet obrázky přímo, bez běhu agenta
Pydantic AI 2.41 přidala samostatné rozhraní ImageGenerator pro tvorbu a úpravy obrázků. Aplikace už nemusí kvůli obrazovému modelu spouštět agenta; společné volání ale zakrývá rozdíly v…
-
Filtr proměnných prostředí v lokálním sandboxu Agents SDK se musí zapnout ručně
Knihovna openai-agents vydala 8. září verzi 0.22.1 s možností omezit, které proměnné prostředí hostitele uvidí příkaz spuštěný agentem. Zapíná se ručně; bez toho příkaz dál dostává kopii…
-
Python SDK pro MCP už nenásleduje přesměrování na jiný server
MCP Python SDK 2.2.0 už nenásleduje přesměrování na jiný server, protože by na něj mohl znovu poslat přihlašovací údaje i tělo požadavku. Vydání ze 7. září také zpřísnilo kontrolu OAuth a…
-
Prompt delší než 272 tisíc tokenů zdraží u GPT-6 Astra celý požadavek
OpenAI vydala 3. září GPT-6 Astra s oknem 1 050 000 tokenů a sazbou 10 dolarů za milion vstupních tokenů. Prompt nad 272 tisíc tokenů ale přepne účtování na dvojnásobek u vstupu a na…
-
llama.cpp sloučil pro DeepSeek V4 zhruba 137 uzlů do jednoho spuštění
Backend Vulkan v llama.cpp dostal tři sloučené operace pro hyperpropojení DeepSeeku V4. Při dekódování na Strix Halo naměřil autor změny 16,77 místo 11,16 tokenu za sekundu, ale každé…
-
Dvě tabulky slovníku zabírají v modelu MiniCPM5-2B pětinu parametrů
Skupina OpenBMB vydala 6. září model MiniCPM5-2B pro běh na koncových zařízeních. Z jeho 2 516 756 480 parametrů připadá 534 773 760 na dvojici tabulek, které převádějí tokeny na vektory a…
-
Pydantic AI 2.40 po zapnutí každou hodinu stahuje 1 678 cenových položek
Pydantic AI 2.40 přidala volitelné stahování cen modelů hned po startu a potom každou hodinu. Při našem testu se seznam rozšířil z 1 646 na 1 678 položek; výpadek stahování ponechal v…
-
llama.cpp počítal u sedmi architektur normalizaci jinak než jejich referenční kód
Vektory dotazů a klíčů v hybridní vrstvě Gated DeltaNet dělil llama.cpp odmocninou ořezanou zdola, kdežto knihovna, ke které se jejich referenční kód hlásí, k té odmocnině malé číslo…
-
Přihlášený uživatel OpenShift AI může načíst společné klíče NVIDIA
Red Hat zveřejnil 7. září zranitelnost CVE-2026-86332 se skóre 6,5. Přihlášený uživatel dashboardu OpenShift AI může bez správcovského oprávnění načíst společný klíč NVIDIA NGC i…
-
Hlídač agentů v API OpenAI umí konverzaci zastavit, hotové kroky ale nevrátí zpět
Spolu s modelem GPT-6 Astra ohlásilo OpenAI 3. září 2026 systém, který na pozadí čte uvažování agenta a při podezření na nezamýšlený přenos dat nebo destruktivní zásah konverzaci zastaví.…
-
Dynamicky sestavený Bifrost mohl bez přihlášení spustit modul z webu
Správní rozhraní AI brány Bifrost před verzí 2.0.0 přijímalo od nepřihlášeného volajícího internetovou adresu vlastního zásuvného modulu. V dynamickém sestavení mohl stažený modul běžet…
-
Zrychlená verze videomodelu MiniMax H3 dokládá slíbenou kvalitu šesti srovnáními
Váhy VDN-H3 přidávají k videomodelu MiniMax H3 druhou, levnější větev pozornosti a podle autorů z něj udělají 74,5násobně rychlejší stroj. Rychlost mají rozepsanou po jednotlivých krocích…