Přeskočit na obsah

Všechny články

Kompletní výpis, od nejnovějšího.

  1. Licence a podmínky

    NVIDIA uvádí licenci OpenMDW u 27 repozitářů, ale filtr na Hugging Face najde tři

    Linux Foundation vydala 28. května licenci OpenMDW 1.1, psanou přímo pro modely, a NVIDIA k ní tentýž den ohlásila přechod u rodin Cosmos, Isaac GR00T, Ising a Nemotron. Změřili jsme po…

  2. Nástroje

    MCP dal rušení funkcí pravidla, podle kterých mají Roots i Logging nejmíň rok

    Revize protokolu MCP z 28. července odložila tři funkce protokolu: Roots, Sampling a Logging. Poprvé u toho platí psané pravidlo, kolik času mezi odložením a smazáním musí uplynout, a…

  3. U sebe doma

    vLLM vyřadil Fuyu, Persimmon a první TeleChat kvůli malému využití

    Vydání vLLM 0.26.0 z 27. července přestalo podporovat architektury Fuyu, Persimmon a první generaci TeleChatu. Oba návrhy změn uvádějí jako důvod nízké využití, psané pravidlo projektu…

  4. U sebe doma

    Ollama přestala opisovat otisky všech vrstev do konfigurace modelu

    Ollama 9. srpna odstranila z hlavní vývojové větve pole rootfs.diff_ids, které do konfigurace modelu podruhé zapisovalo otisky všech vrstev. U modelů tvořených soubory pro jednotlivé…

  5. Modely

    EXAONE 4.5 přišla v GGUF o posuvnou pozornost kvůli pořadí metadat

    Oficiální GGUF modelu EXAONE 4.5 obsahuje 65 bloků včetně jedné hlavy pro předpověď více tokenů, ale llama.cpp kontrolovalo počet vrstev dřív, než tuto hlavu odečetlo. Posuvná pozornost…

  6. Licence a podmínky

    Ollama přibalila k Nemotronu 3.5 Lightning jinou licenci než NVIDIA

    Ollama 0.32.9 zpřístupnila Nemotron 3.5 Lightning v balíku o 25 GB. V jeho licenční vrstvě je ale NVIDIA Open Model License, zatímco NVIDIA u původních vah vydaných tentýž den používá…

  7. Modely

    LG dala K-EXAONE 2.0 s 1,5 TB vah pod Apache 2.0 místo vlastní licence

    Korejská LG AI Research zveřejnila K-EXAONE 2.0, model se 750 miliardami parametrů, z nichž se na token používá 37 miliard. Váhy zabírají 1 497,7 GB a model vznikl rozšířením předchozí…

  8. Infrastruktura

    Ollama pozastavila prodej tarifu Max, protože prý nestačí kapacita cloudu

    Ollama, nástroj na provoz jazykových modelů na vlastním počítači, přestala prodávat nejdražší předplatné Max za 100 dolarů měsíčně. V odpovědi na ceníku uvádí, že objem tokenů v jejím…

  9. Nástroje

    Cline 4.1.8 odstranil Yolo Mode, který schvalovací cesta vůbec nečetla

    Cline ve verzi 4.1.8 odstranil z nového rozšíření přepínač Yolo Mode. Jeho stav se sice ukládal a zobrazoval, ale schvalovací cesta ho nečetla, takže zápis souboru mohl dál čekat na…

  10. Nástroje

    Cisco vydal malé modely, které v cizím kódu hledají zranitelnosti za zlomek ceny

    Cisco vydalo jako otevřená váhy dvojici malých modelů, Antares-350M a Antares-1B, natrénovaných na vyhledávání zranitelných souborů v cizím zdrojovém kódu. Na vlastním testu VLoc Bench…

  11. Nástroje

    Které ze dvou rozšíření v balíčku Cline 4.1 se spustí, řídí vzdálený příznak

    Vydání 4.1 rozšíření Cline pro Visual Studio Code sloučilo starou a novou verzi do jednoho balíčku: uvnitř leží obě vedle sebe a při každém otevření okna vybere zavaděč jednu z nich.…

  12. Bezpečnost

    Claude při testech napadl tři skutečné organizace a vydal škodlivý balíček na PyPI

    Anthropic prošel zpětně 141 006 testovacích běhů a našel šest, ve kterých se model dostal z uzavřeného prostředí na internet a napadl provozní systémy tří organizací. Nejstarší případ je z…

  13. Licence a podmínky

    GPT-5.6-Cyber zůstane u partnera, zákazník dostane jen řízený přístup

    Společnost OpenAI zpřístupňuje GPT-5.6-Cyber přes vybrané bezpečnostní a poradenské firmy. Model zůstane u schváleného partnera, který zákazníkovi nabídne jen řízenou službu pro předem…

  14. Čísla

    U kritické díry v llama.cpp se dva záznamy liší o 501 buildů

    Knihovna llama.cpp, na které stojí většina domácího provozu jazykových modelů, vydala mezi 1. a 30. červencem 2026 dvě stě dvacet devět verzí. Číslo v jejich názvu přitom není pořadí vydání…

  15. Infrastruktura

    Z 96 hlášení o poruchách u OpenAI popisuje příčinu jediné

    Stavovou stránku OpenAI jsme přečetli strojově, ne okem: od května do konce července 2026 na ní přibylo 96 záznamů o poruchách. Příčinu z nich popisuje jediný, osmdesát osm se zavírá…

  16. Čísla

    OpenAI snížila ceny modelů GPT-5.6 Luna a Terra, aniž vydala nový model

    Od 30. července stojí GPT-5.6 Luna o 80 procent méně a Terra o 20 procent méně než dřív; OpenAI to zdůvodňuje úsporami v provozu, ne novým modelem. Čínský DeepSeek mezitím drží ceny modelu…

  17. Nástroje

    Stabilní kanál Claude Code je o osm vydání pozadu a nemá ani opravy oprávnění

    Agentní nástroj Claude Code se aktualizuje sám a nabízí dva kanály. Výchozí bere každé vydání hned, ten druhý se jmenuje „stable“ a podle dokumentace jede na verzi zhruba týden staré.…

  18. Modely

    DeepSeek vydal V4-Flash pod MIT se 167 GB vah a skripty místo šablony chatu

    DeepSeek zveřejnil 31. července ostrou verzi modelu V4-Flash. Licence je čistá MIT bez prahů tržeb a bez podmínek navíc, kontext má milion tokenů a váhy 166,9 GB. Devět čísel v tabulce…

  19. Modely

    NVIDIA radí sdílet KV hlavu mezi víc dotazů, ale neříká, na kterých GPU měřila

    Nový technický rozbor rozděluje obsluhu dlouhého kontextu na dvě odlišné úlohy: načtení zadání omezuje výpočetní výkon, generování dalšího tokenu propustnost paměti. NVIDIA z toho odvozuje…

  20. Infrastruktura

    EU nabízí sedmi továrnám na AI 10 miliard z veřejných peněz, čeká dalších 20.

    Evropská unie otevřela tendr na provoz až sedmi výpočetních center pro velké modely umělé inteligence. Nabízí jim až 10 miliard eur z veřejných peněz a čeká nejméně 20 miliard od soukromých…