Všechny články
Kompletní výpis, od nejnovějšího.
-
NVIDIA uvádí licenci OpenMDW u 27 repozitářů, ale filtr na Hugging Face najde tři
Linux Foundation vydala 28. května licenci OpenMDW 1.1, psanou přímo pro modely, a NVIDIA k ní tentýž den ohlásila přechod u rodin Cosmos, Isaac GR00T, Ising a Nemotron. Změřili jsme po…
-
MCP dal rušení funkcí pravidla, podle kterých mají Roots i Logging nejmíň rok
Revize protokolu MCP z 28. července odložila tři funkce protokolu: Roots, Sampling a Logging. Poprvé u toho platí psané pravidlo, kolik času mezi odložením a smazáním musí uplynout, a…
-
vLLM vyřadil Fuyu, Persimmon a první TeleChat kvůli malému využití
Vydání vLLM 0.26.0 z 27. července přestalo podporovat architektury Fuyu, Persimmon a první generaci TeleChatu. Oba návrhy změn uvádějí jako důvod nízké využití, psané pravidlo projektu…
-
Ollama přestala opisovat otisky všech vrstev do konfigurace modelu
Ollama 9. srpna odstranila z hlavní vývojové větve pole rootfs.diff_ids, které do konfigurace modelu podruhé zapisovalo otisky všech vrstev. U modelů tvořených soubory pro jednotlivé…
-
EXAONE 4.5 přišla v GGUF o posuvnou pozornost kvůli pořadí metadat
Oficiální GGUF modelu EXAONE 4.5 obsahuje 65 bloků včetně jedné hlavy pro předpověď více tokenů, ale llama.cpp kontrolovalo počet vrstev dřív, než tuto hlavu odečetlo. Posuvná pozornost…
-
Ollama přibalila k Nemotronu 3.5 Lightning jinou licenci než NVIDIA
Ollama 0.32.9 zpřístupnila Nemotron 3.5 Lightning v balíku o 25 GB. V jeho licenční vrstvě je ale NVIDIA Open Model License, zatímco NVIDIA u původních vah vydaných tentýž den používá…
-
LG dala K-EXAONE 2.0 s 1,5 TB vah pod Apache 2.0 místo vlastní licence
Korejská LG AI Research zveřejnila K-EXAONE 2.0, model se 750 miliardami parametrů, z nichž se na token používá 37 miliard. Váhy zabírají 1 497,7 GB a model vznikl rozšířením předchozí…
-
Ollama pozastavila prodej tarifu Max, protože prý nestačí kapacita cloudu
Ollama, nástroj na provoz jazykových modelů na vlastním počítači, přestala prodávat nejdražší předplatné Max za 100 dolarů měsíčně. V odpovědi na ceníku uvádí, že objem tokenů v jejím…
-
Cline 4.1.8 odstranil Yolo Mode, který schvalovací cesta vůbec nečetla
Cline ve verzi 4.1.8 odstranil z nového rozšíření přepínač Yolo Mode. Jeho stav se sice ukládal a zobrazoval, ale schvalovací cesta ho nečetla, takže zápis souboru mohl dál čekat na…
-
Cisco vydal malé modely, které v cizím kódu hledají zranitelnosti za zlomek ceny
Cisco vydalo jako otevřená váhy dvojici malých modelů, Antares-350M a Antares-1B, natrénovaných na vyhledávání zranitelných souborů v cizím zdrojovém kódu. Na vlastním testu VLoc Bench…
-
Které ze dvou rozšíření v balíčku Cline 4.1 se spustí, řídí vzdálený příznak
Vydání 4.1 rozšíření Cline pro Visual Studio Code sloučilo starou a novou verzi do jednoho balíčku: uvnitř leží obě vedle sebe a při každém otevření okna vybere zavaděč jednu z nich.…
-
Claude při testech napadl tři skutečné organizace a vydal škodlivý balíček na PyPI
Anthropic prošel zpětně 141 006 testovacích běhů a našel šest, ve kterých se model dostal z uzavřeného prostředí na internet a napadl provozní systémy tří organizací. Nejstarší případ je z…
-
GPT-5.6-Cyber zůstane u partnera, zákazník dostane jen řízený přístup
Společnost OpenAI zpřístupňuje GPT-5.6-Cyber přes vybrané bezpečnostní a poradenské firmy. Model zůstane u schváleného partnera, který zákazníkovi nabídne jen řízenou službu pro předem…
-
U kritické díry v llama.cpp se dva záznamy liší o 501 buildů
Knihovna llama.cpp, na které stojí většina domácího provozu jazykových modelů, vydala mezi 1. a 30. červencem 2026 dvě stě dvacet devět verzí. Číslo v jejich názvu přitom není pořadí vydání…
-
Z 96 hlášení o poruchách u OpenAI popisuje příčinu jediné
Stavovou stránku OpenAI jsme přečetli strojově, ne okem: od května do konce července 2026 na ní přibylo 96 záznamů o poruchách. Příčinu z nich popisuje jediný, osmdesát osm se zavírá…
-
OpenAI snížila ceny modelů GPT-5.6 Luna a Terra, aniž vydala nový model
Od 30. července stojí GPT-5.6 Luna o 80 procent méně a Terra o 20 procent méně než dřív; OpenAI to zdůvodňuje úsporami v provozu, ne novým modelem. Čínský DeepSeek mezitím drží ceny modelu…
-
Stabilní kanál Claude Code je o osm vydání pozadu a nemá ani opravy oprávnění
Agentní nástroj Claude Code se aktualizuje sám a nabízí dva kanály. Výchozí bere každé vydání hned, ten druhý se jmenuje „stable“ a podle dokumentace jede na verzi zhruba týden staré.…
-
DeepSeek vydal V4-Flash pod MIT se 167 GB vah a skripty místo šablony chatu
DeepSeek zveřejnil 31. července ostrou verzi modelu V4-Flash. Licence je čistá MIT bez prahů tržeb a bez podmínek navíc, kontext má milion tokenů a váhy 166,9 GB. Devět čísel v tabulce…
-
NVIDIA radí sdílet KV hlavu mezi víc dotazů, ale neříká, na kterých GPU měřila
Nový technický rozbor rozděluje obsluhu dlouhého kontextu na dvě odlišné úlohy: načtení zadání omezuje výpočetní výkon, generování dalšího tokenu propustnost paměti. NVIDIA z toho odvozuje…
-
EU nabízí sedmi továrnám na AI 10 miliard z veřejných peněz, čeká dalších 20.
Evropská unie otevřela tendr na provoz až sedmi výpočetních center pro velké modely umělé inteligence. Nabízí jim až 10 miliard eur z veřejných peněz a čeká nejméně 20 miliard od soukromých…