Všechny články
Kompletní výpis, od nejnovějšího.
-
SGLang omezuje vzdálená média na 64 MiB
Inference server SGLang 0.5.18 nově omezuje jeden vzdálený obrázek, video nebo zvuk na 64 MiB. Pro servery přístupné nedůvěryhodným klientům přidal také volitelný seznam přesných názvů…
-
Knihovna Transformers čte podle indexu i soubory mimo složku modelu a opravu nemá
Když Transformers načítá model rozdělený do víc souborů, vezme jejich jména z indexu ležícího vedle vah a připojí je ke složce modelu bez jediné kontroly. Jméno, které ze složky vede pryč,…
-
Ollama 0.32.15 přestala číst metadata GGUF při každém dotazu
Server Ollamy otevíral soubor GGUF a četl z něj metadata při každém dotazu na chat i generování; autor změny odhaduje tu režii na 300 ms za volání. Verze 0.32.15 z 19. srpna 2026 si…
-
MCP chce nástroje odkrývat postupně, celý katalog už model číst nemá
Nový plán protokolu MCP počítá s tím, že model nebude před každým úkolem číst úplné definice všech dostupných nástrojů. Má je vyhledávat a načítat postupně, podobně jako to už nabízejí…
-
LiteLLM počítal úsporu z mezipaměti bez ceny jejího zápisu
LiteLLM až do verze 1.98.0 přičítal úsporu za tokeny načtené z mezipaměti, ale neodečetl příplatek za její vytvoření. U zápisu 20 000 tokenů pro Claude Sonnet 4.5 tak mohl přehled ukazovat…
-
Stripe se dohodl na koupi zprostředkovatele OpenRouter, cenu neuvádí ani jedno oznámení
Stripe se 19. srpna 2026 dohodl na koupi OpenRouteru, tedy brány, přes kterou vývojáři posílají dotazy modelům desítek výrobců. Cenu neuvádí ani jedno ze dvou oznámení; Bloomberg tři dny…
-
Spring AI 2.0.1 nastavila strop na 100 000 relací serveru MCP
Spring AI 2.0.0 dovolovala vzdálenému klientovi bez přihlášení opakovanými inicializacemi postupně vyčerpat paměť serveru. Oprava z 21. srpna omezuje počet relací, ale jejich automatické…
-
Servery MCP rodiny faf mají opravu, tři jejich kopie na npm ji nemají
Databáze GitHubu vydala 19. srpna 2026 tři bezpečnostní hlášení k balíčkům faf-mcp, claude-faf-mcp a grok-faf-mcp: jejich nástroje si nechaly podstrčit cestu k libovolnému souboru na disku.…
-
Kubeflow splnil nejvyšší nároky CNCF, bezstarostný provoz AI to neslibuje
Kubeflow postoupil po bezpečnostním auditu a kontrole správy projektu do nejvyšší fáze CNCF. Označení graduated snižuje riziko opuštěného projektu, negarantuje však bezpečí konkrétní…
-
llama.cpp přidal k nočním sestavením verze 0.1.x, postup je zatím rozdělaný
llama.cpp má od 17. srpna vedle nočních značek s písmenem b i značky v0.1.0 až v0.1.2. Nová značka vznikne jen tehdy, když se soubory jeho vnitřní kopie knihovny ggml shodují s vydanou…
-
Pew našel stopy AI v desetině anglického webu, u novějších stránek ve více než třetině
Pew Research Center prověřil 490 000 anglických webových stránek a v červencovém vzorku našel významné stopy strojového autorství u 10 % z nich. Mezi stránkami s datem vydání po spuštění…
-
Laravel Tackle vynucuje omezení AI agenta přímo v PHP
Balíček Laravel Tackle spouští programovacího agenta uvnitř aplikace. Cesty, příkazy a odhadovanou útratu omezuje přímo v PHP; čerstvá verze 1.27.3 navíc opravila chování bezobslužného běhu…
-
Ornith 1.5 se hlásí k licenci MIT, ale její text v jeho repozitářích chybí
Rodina Ornith 1.5 vyšla 18. srpna 2026 a v hlavičce každé karty stojí licence MIT. Odkaz, který má k jejímu znění vést, míří na LICENSE v témž repozitáři – a ten tam u žádného ze šesti…
-
Webhooky MLflow vydaly obsah z vnitřní sítě i nepřihlášenému útočníkovi
Výchozí server MLflow nechává rozhraní pro webhooky bez přihlášení a jeho pojistku proti SSRF šlo obejít obyčejným přesměrováním. Útočník tak mohl serveru poručit, ať sáhne na adresu ve…
-
Agent Canvas od OpenHands přepnul výchozí model na Kimi K3 a označil ho za bezplatný
Vydání 1.14.0 rozhraní Agent Canvas změnilo výchozí jazykový model z GLM-5.2 na Kimi K3 a zařadilo ho mezi čtyři trasy, které nesou odznak „Free“. Co ta bezplatnost obnáší, se z poznámek k…
-
Malé modely se jménem Qwen3.8 nevydal Qwen, ale Empero, a stojí na Qwen3.5
Na Hugging Face přibyly 15. srpna 2026 tři modely pojmenované Qwen3.8-9B, Qwen3.8-4B a Qwen3.8-2B. Qwen žádnou takovou velikost nevydal: jsou to destilace, které do o generaci starších…
-
llama.cpp vypnul mapování modelu do paměti na části integrovaných grafik
llama.cpp od 11. srpna 2026 nemapuje soubor s váhami do paměti všude, kde to jde. Nový výchozí režim mapování vypne, jakmile některé ze zapojených zařízení ohlásí, že ho nepodporuje. Ve…
-
U téhož modelu nabízí poskytovatelé OpenRouteru různé přesnosti a cena to neprozradí
Zprostředkovatel OpenRouter nabízí u téhož modelu i víc než třicet poskytovatelů. Měření jeho veřejného rozhraní ukazuje, že se mezi nimi liší přesnost vah i velikost kontextu, a že cena za…
-
Desktopová aplikace Unslothu vyšla pod AGPL, knihovna zůstává pod Apache 2.0
Unsloth zveřejnil 11. srpna 2026 desktopovou aplikaci, která na vlastním počítači pouští i trénuje modely. Repozitář, ze kterého vznikla, má ale licence dvě: knihovna běží pod Apache 2.0,…
-
Gartner čeká 42,3 miliardy dolarů u infrastruktury, IDC čeká 497 miliard u hardwaru.
Gartner odhadl, že celosvětové výdaje za pronajatou infrastrukturu pro modely letos dosáhnou 42,3 miliardy dolarů, tedy o 96,4 % víc než loni. IDC čeká u „výdajů na AI infrastrukturu“ za…