Přeskočit na obsah

Všechny články

Kompletní výpis, od nejnovějšího.

  1. Bezpečnost

    Útoku, který agentovi podvrhne fakta místo pokynů, neodolal Claude Code ani Codex

    Šest autorů popsalo třídu útoků, která agentovi nepodstrčí skrytý příkaz, ale zfalšuje údaje, kterým bez ptaní věří – jméno odesílatele, identifikátor tlačítka, záznam o už proběhlém…

  2. Infrastruktura

    Ollama pozastavila prodej tarifu Max, protože prý nestačí kapacita cloudu

    Ollama, nástroj na provoz jazykových modelů na vlastním počítači, přestala prodávat nejdražší předplatné Max za 100 dolarů měsíčně. V odpovědi na ceníku uvádí, že objem tokenů v jejím…

  3. Nástroje

    Z formátu Agent Plugins 1.0 jsou přenosné jen dvě součásti pluginu

    Specifikace Agent Plugins 1.0.0 popisuje jeden adresář, ze kterého si kterýkoli podporující nástroj načte skilly a servery MCP. Přenosné jsou právě tyhle dvě součásti; oprávnění, ověřování…

  4. Modely

    DeepSeek vydal V4-Flash pod MIT se 167 GB vah a skripty místo šablony chatu

    DeepSeek zveřejnil 31. července ostrou verzi modelu V4-Flash. Licence je čistá MIT bez prahů tržeb a bez podmínek navíc, kontext má milion tokenů a váhy 166,9 GB. Devět čísel v tabulce…

  5. Čísla

    Test agentů nechal na Hugging Face 205 stejnojmenných modelů, 107 vzniklo za tři dny.

    Sada úloh Toolathlon nechává agenta nahrát model na Hugging Face pod pevným jménem MyAwesomeModel-TestRepo. Úklid je ale zapsaný v přípravě před testem, ne za ním, takže repozitáře…

  6. Nástroje

    Které ze dvou rozšíření v balíčku Cline 4.1 se spustí, řídí vzdálený příznak

    Vydání 4.1 rozšíření Cline pro Visual Studio Code sloučilo starou a novou verzi do jednoho balíčku: uvnitř leží obě vedle sebe a při každém otevření okna vybere zavaděč jednu z nich.…

  7. Modely

    Váhy Solar Open 2 mají 500 GB, licence chce jméno začínající na Solar

    Korejský Upstage vydal 22. července otevřené váhy modelu Solar Open 2 – 250 miliard parametrů, z toho 15 miliard aktivních na token, kontext milion tokenů. Ke stažení je 500,62 GB. Licence…

  8. Modely

    LG dala K-EXAONE 2.0 s 1,5 TB vah pod Apache 2.0 místo vlastní licence

    Korejská LG AI Research zveřejnila K-EXAONE 2.0, model se 750 miliardami parametrů, z nichž se na token používá 37 miliard. Váhy zabírají 1 497,7 GB a model vznikl rozšířením předchozí…

  9. Čísla

    LongCat-Flash-Lite-Sparse má pod MIT 138 GB vah a plné okno přidá dalších 16 GB

    Meituan dal 31. července na Hugging Face váhy modelu LongCat-Flash-Lite-Sparse. Má 69 miliard parametrů, licenci MIT bez jakýchkoli prahů a kontextové okno 983 040 tokenů, tedy o něco méně,…

  10. Modely

    NVIDIA radí sdílet KV hlavu mezi víc dotazů, ale neříká, na kterých GPU měřila

    Nový technický rozbor rozděluje obsluhu dlouhého kontextu na dvě odlišné úlohy: načtení zadání omezuje výpočetní výkon, generování dalšího tokenu propustnost paměti. NVIDIA z toho odvozuje…

  11. U sebe doma

    llama.cpp ohlásil změnu portu serveru z 8080 na 9931, termín neuvedl

    Kdo si pouští model doma přes llama-server, najde ve výpisu novou hlášku: výchozí port se má změnit z 8080 na 9931. Kdy k tomu dojde, projekt neuvádí, a v kódu zatím zůstává osmička. Nové…

  12. Modely

    AMD popisuje Instella-MoE jako plně otevřený model, licence vah dovoluje jen výzkum

    AMD dala na Hugging Face model Instella-MoE-16B-A3B a s ním kontrolní body ze všech šesti fází tréninku. Kód k němu je pod licencí MIT, váhy pod licencí RESEARCH-ONLY RAIL, která povoluje…

  13. U sebe doma

    Nanbeige 4.2 se vejde do telefonu na 2,58 GB, kontext v něm spadl na 4 096 tokenů

    Na Hugging Face přibyl převod čínského modelu Nanbeige 4.2 do formátu běhového prostředí LiteRT-LM: jediný soubor o velikosti 2,58 GB, čtyřbitové váhy a kontext 4 096 tokenů místo 262 144,…

  14. U sebe doma

    Laguna S 2.1 uvádí milion tokenů kontextu, vlastní GGUF od výrobce má 256 tisíc

    Firma poolside vydala 21. července otevřené váhy modelu Laguna S 2.1 se 118 miliardami parametrů a kontextovým oknem 1 048 576 tokenů. Balíčky GGUF, které k němu sama nabízí, jsou ale…

  15. Infrastruktura

    Nová datová centra v Texasu se nepřipojí k síti, dokud neprojdou auditem

    Guvernér Greg Abbott nařídil 3. srpna texaské komisi pro veřejné služby a provozovateli sítě ERCOT prověřit všechna datová centra ve frontě na připojení. Projekt, který auditem neprojde, se…

  16. U sebe doma

    Ollama v 0.32.6 odstranila generování obrázků a odkazuje na starší verzi

    Vydání Ollamy 0.32.6 ze 4. srpna 2026 smazalo ze zdrojového kódu celou část, která uměla generovat obrázky. Poznámky k vydání radí zůstat na verzi 0.32.5. Katalog modelů na ollama.com…

  17. Infrastruktura

    AMD uvedla rack Helios se 72 kartami MI455X, jehož náskok je zatím odhad

    AMD uvedla 23. července rack Helios se 72 akcelerátory Instinct MI455X a 18 procesory EPYC „Venice“. Katalogový list karty uvádí 432 GB paměti HBM4 a propustnost 23,3 TB/s. Dvě čísla z…

  18. Čísla

    Po záměně průměru za nejslabší výsledek se první pětka HELM Lite vymění celá

    Pořadí modelů v žebříčku závisí na tom, jak se dílčí výsledky slijí do jednoho čísla. Práce ze sborníku workshopu GEM přepočítala dva veřejné žebříčky HELM podle nejslabšího výsledku místo…

  19. Čísla

    OpenAI snížila ceny modelů GPT-5.6 Luna a Terra, aniž vydala nový model

    Od 30. července stojí GPT-5.6 Luna o 80 procent méně a Terra o 20 procent méně než dřív; OpenAI to zdůvodňuje úsporami v provozu, ne novým modelem. Čínský DeepSeek mezitím drží ceny modelu…

  20. Modely

    Ling-3.0-flash popisuje podmínky měření podrobně, výsledky testů má jen v obrázcích

    Skupina inclusionAI zveřejnila 2. srpna 2026 na Hugging Face model Ling-3.0-flash: 124 miliardy vah, z toho 5,1 miliardy aktivních při každém tokenu, licence MIT. U testů karta uvádí…