Všechny články
Kompletní výpis, od nejnovějšího.
-
Útoku, který agentovi podvrhne fakta místo pokynů, neodolal Claude Code ani Codex
Šest autorů popsalo třídu útoků, která agentovi nepodstrčí skrytý příkaz, ale zfalšuje údaje, kterým bez ptaní věří – jméno odesílatele, identifikátor tlačítka, záznam o už proběhlém…
-
Ollama pozastavila prodej tarifu Max, protože prý nestačí kapacita cloudu
Ollama, nástroj na provoz jazykových modelů na vlastním počítači, přestala prodávat nejdražší předplatné Max za 100 dolarů měsíčně. V odpovědi na ceníku uvádí, že objem tokenů v jejím…
-
Z formátu Agent Plugins 1.0 jsou přenosné jen dvě součásti pluginu
Specifikace Agent Plugins 1.0.0 popisuje jeden adresář, ze kterého si kterýkoli podporující nástroj načte skilly a servery MCP. Přenosné jsou právě tyhle dvě součásti; oprávnění, ověřování…
-
DeepSeek vydal V4-Flash pod MIT se 167 GB vah a skripty místo šablony chatu
DeepSeek zveřejnil 31. července ostrou verzi modelu V4-Flash. Licence je čistá MIT bez prahů tržeb a bez podmínek navíc, kontext má milion tokenů a váhy 166,9 GB. Devět čísel v tabulce…
-
Test agentů nechal na Hugging Face 205 stejnojmenných modelů, 107 vzniklo za tři dny.
Sada úloh Toolathlon nechává agenta nahrát model na Hugging Face pod pevným jménem MyAwesomeModel-TestRepo. Úklid je ale zapsaný v přípravě před testem, ne za ním, takže repozitáře…
-
Které ze dvou rozšíření v balíčku Cline 4.1 se spustí, řídí vzdálený příznak
Vydání 4.1 rozšíření Cline pro Visual Studio Code sloučilo starou a novou verzi do jednoho balíčku: uvnitř leží obě vedle sebe a při každém otevření okna vybere zavaděč jednu z nich.…
-
Váhy Solar Open 2 mají 500 GB, licence chce jméno začínající na Solar
Korejský Upstage vydal 22. července otevřené váhy modelu Solar Open 2 – 250 miliard parametrů, z toho 15 miliard aktivních na token, kontext milion tokenů. Ke stažení je 500,62 GB. Licence…
-
LG dala K-EXAONE 2.0 s 1,5 TB vah pod Apache 2.0 místo vlastní licence
Korejská LG AI Research zveřejnila K-EXAONE 2.0, model se 750 miliardami parametrů, z nichž se na token používá 37 miliard. Váhy zabírají 1 497,7 GB a model vznikl rozšířením předchozí…
-
LongCat-Flash-Lite-Sparse má pod MIT 138 GB vah a plné okno přidá dalších 16 GB
Meituan dal 31. července na Hugging Face váhy modelu LongCat-Flash-Lite-Sparse. Má 69 miliard parametrů, licenci MIT bez jakýchkoli prahů a kontextové okno 983 040 tokenů, tedy o něco méně,…
-
NVIDIA radí sdílet KV hlavu mezi víc dotazů, ale neříká, na kterých GPU měřila
Nový technický rozbor rozděluje obsluhu dlouhého kontextu na dvě odlišné úlohy: načtení zadání omezuje výpočetní výkon, generování dalšího tokenu propustnost paměti. NVIDIA z toho odvozuje…
-
llama.cpp ohlásil změnu portu serveru z 8080 na 9931, termín neuvedl
Kdo si pouští model doma přes llama-server, najde ve výpisu novou hlášku: výchozí port se má změnit z 8080 na 9931. Kdy k tomu dojde, projekt neuvádí, a v kódu zatím zůstává osmička. Nové…
-
AMD popisuje Instella-MoE jako plně otevřený model, licence vah dovoluje jen výzkum
AMD dala na Hugging Face model Instella-MoE-16B-A3B a s ním kontrolní body ze všech šesti fází tréninku. Kód k němu je pod licencí MIT, váhy pod licencí RESEARCH-ONLY RAIL, která povoluje…
-
Nanbeige 4.2 se vejde do telefonu na 2,58 GB, kontext v něm spadl na 4 096 tokenů
Na Hugging Face přibyl převod čínského modelu Nanbeige 4.2 do formátu běhového prostředí LiteRT-LM: jediný soubor o velikosti 2,58 GB, čtyřbitové váhy a kontext 4 096 tokenů místo 262 144,…
-
Laguna S 2.1 uvádí milion tokenů kontextu, vlastní GGUF od výrobce má 256 tisíc
Firma poolside vydala 21. července otevřené váhy modelu Laguna S 2.1 se 118 miliardami parametrů a kontextovým oknem 1 048 576 tokenů. Balíčky GGUF, které k němu sama nabízí, jsou ale…
-
Nová datová centra v Texasu se nepřipojí k síti, dokud neprojdou auditem
Guvernér Greg Abbott nařídil 3. srpna texaské komisi pro veřejné služby a provozovateli sítě ERCOT prověřit všechna datová centra ve frontě na připojení. Projekt, který auditem neprojde, se…
-
Ollama v 0.32.6 odstranila generování obrázků a odkazuje na starší verzi
Vydání Ollamy 0.32.6 ze 4. srpna 2026 smazalo ze zdrojového kódu celou část, která uměla generovat obrázky. Poznámky k vydání radí zůstat na verzi 0.32.5. Katalog modelů na ollama.com…
-
AMD uvedla rack Helios se 72 kartami MI455X, jehož náskok je zatím odhad
AMD uvedla 23. července rack Helios se 72 akcelerátory Instinct MI455X a 18 procesory EPYC „Venice“. Katalogový list karty uvádí 432 GB paměti HBM4 a propustnost 23,3 TB/s. Dvě čísla z…
-
Po záměně průměru za nejslabší výsledek se první pětka HELM Lite vymění celá
Pořadí modelů v žebříčku závisí na tom, jak se dílčí výsledky slijí do jednoho čísla. Práce ze sborníku workshopu GEM přepočítala dva veřejné žebříčky HELM podle nejslabšího výsledku místo…
-
OpenAI snížila ceny modelů GPT-5.6 Luna a Terra, aniž vydala nový model
Od 30. července stojí GPT-5.6 Luna o 80 procent méně a Terra o 20 procent méně než dřív; OpenAI to zdůvodňuje úsporami v provozu, ne novým modelem. Čínský DeepSeek mezitím drží ceny modelu…
-
Ling-3.0-flash popisuje podmínky měření podrobně, výsledky testů má jen v obrázcích
Skupina inclusionAI zveřejnila 2. srpna 2026 na Hugging Face model Ling-3.0-flash: 124 miliardy vah, z toho 5,1 miliardy aktivních při každém tokenu, licence MIT. U testů karta uvádí…