Všechny články
Kompletní výpis, od nejnovějšího.
-
Nanbeige 4.2 se vejde do telefonu na 2,58 GB, kontext v něm spadl na 4 096 tokenů
Na Hugging Face přibyl převod čínského modelu Nanbeige 4.2 do formátu běhového prostředí LiteRT-LM: jediný soubor o velikosti 2,58 GB, čtyřbitové váhy a kontext 4 096 tokenů místo 262 144,…
-
Nové úložiště ani rejstříky se v Milvusu 3.0 ve výchozím nastavení nezapnou
Vektorová databáze Milvus dostala 29. července 2026 značku 3.0.0. Umí nově postavit rejstřík nad daty, která zůstanou ležet v objektovém úložišti, a má přepsaný řídký index. V konfiguraci…
-
Oprava AgentCore CLI neodstraní podstrčený kód z generovaného agenta.
Nástroj @aws/agentcore, kterým se v Amazon Bedrock AgentCore zakládají a nasazují agenti, vypisoval popis spolupracujícího agenta do trojitě uvozeného řetězce v generovaném souboru main.py…
-
Čínská pravidla pro citové chatboty platí od 15. července, proti návrhu přibyly pokuty
Pět čínských úřadů vydalo pravidla pro služby, které s uživatelem vedou trvalý citový rozhovor. Platí od 15. července 2026 a proti loňskému návrhu se v nich zákaz trénovat model na…
-
AMD uvedla rack Helios se 72 kartami MI455X, jehož náskok je zatím odhad
AMD uvedla 23. července rack Helios se 72 akcelerátory Instinct MI455X a 18 procesory EPYC „Venice“. Katalogový list karty uvádí 432 GB paměti HBM4 a propustnost 23,3 TB/s. Dvě čísla z…
-
U 95 % souborů v trénovací sadě korpusu The Stack v3 se licence nenašla
Hugging Face vydal The Stack v3, další díl sbírky zdrojového kódu pro trénování modelů: jeho trénovací sada má 15,9 TB textu ze 173 milionů repozitářů na GitHubu. Ze statistik, které…
-
PJM chce omezovat nová datová centra, která si nepřivedou vlastní kapacitu
Správní rada PJM Interconnection, provozovatele přenosové soustavy pro 67 milionů lidí na východě USA, rozhodla 27. července, že nové velké odběry nad 50 MW vezme zvlášť: kdo si k síti…
-
Po záměně průměru za nejslabší výsledek se první pětka HELM Lite vymění celá
Pořadí modelů v žebříčku závisí na tom, jak se dílčí výsledky slijí do jednoho čísla. Práce ze sborníku workshopu GEM přepočítala dva veřejné žebříčky HELM podle nejslabšího výsledku místo…
-
vLLM 0.26.0 bere tři až sedm bitů na váhu, jenže dva bity model v měření položily
Nástroje pro běh jazykových modelů zmenšují váhy skoro vždy na osm nebo čtyři bity. Vydání vLLM 0.26.0 z 27. července 2026 přidalo dvě schémata, která ke kratším šířkám přiberou i…
-
TensorRT-LLM odstranil svůj backend nad TensorRT, zatím mimo stabilní vydání
Návrhy změn sloučené v červenci 2026 odebraly z knihovny TensorRT-LLM celý původní běhový backend postavený nad TensorRT. Zmizely příkazy trtllm-build, trtllm-prune a trtllm-refit i…
-
Laguna S 2.1 uvádí milion tokenů kontextu, vlastní GGUF od výrobce má 256 tisíc
Firma poolside vydala 21. července otevřené váhy modelu Laguna S 2.1 se 118 miliardami parametrů a kontextovým oknem 1 048 576 tokenů. Balíčky GGUF, které k němu sama nabízí, jsou ale…
-
NVIDIA radí sdílet KV hlavu mezi víc dotazů, ale neříká, na kterých GPU měřila
Nový technický rozbor rozděluje obsluhu dlouhého kontextu na dvě odlišné úlohy: načtení zadání omezuje výpočetní výkon, generování dalšího tokenu propustnost paměti. NVIDIA z toho odvozuje…
-
llama.cpp ve Windows zapíná rychlé jádro na Intel Xe2 a Xe3 od verze 8860
Vydání b10215 z 31. července zrušilo plošné vypnutí rychlé Walshovy-Hadamardovy transformace na grafikách Intel ve Windows. Na architekturách Xe2 a Xe3 ji povolí až s ovladačem 32.0.101…
-
Llama.cpp umí dvoubitový Q2_0 i na kartách NVIDIA a ternární model 8B má 2,15 GiB.
Do hlavní větve llama.cpp přibyla 30. července 2026 podpora formátu Q2_0 pro karty NVIDIA, o den později i pro rozhraní SYCL. Formát ukládá váhu do dvou bitů a s jedním měřítkem na každých…
-
Výsledek fontu proti sběru dat se mezi čtyřmi filtry liší víc než třicetkrát
Projekt ShieldFont zaměňuje slova ve zdroji stránky, aby robotům sbírajícím trénovací data podstrčil jiný text než čtenáři. Jeho vlastní měření v repozitáři zkoušelo čtyři filtry kvality a…
-
Komise smí pokutovat poskytovatele obecných modelů od 2. srpna, rok po povinnostech
Poskytovatelé obecných modelů mají povinnosti z evropského nařízení o umělé inteligenci už od 2. srpna 2025. Pokutu za jejich porušení ale Evropská komise smí uložit teprve od 2. srpna 2026…
-
Opravy pěti CVE v Ruby SDK protokolu MCP vyšly o tři týdny dřív než hlášení
Databáze bezpečnostních hlášení GitHubu přidala 30. července 2026 k oficiální rubyové knihovně protokolu MCP pět záznamů najednou, dva s vysokou závažností. Všechny opravuje verze 0.23.0,…
-
Které ze dvou rozšíření v balíčku Cline 4.1 se spustí, řídí vzdálený příznak
Vydání 4.1 rozšíření Cline pro Visual Studio Code sloučilo starou a novou verzi do jednoho balíčku: uvnitř leží obě vedle sebe a při každém otevření okna vybere zavaděč jednu z nich.…
-
Konec 27 verzí modelů v Microsoft Foundry se posunul dál, medián posunu je 182 dní.
Microsoft změnil 31. července tabulku, ve které katalog Foundry vede data ukončení modelů. U 27 kombinací modelu a verze se datum posunulo dál, u žádné blíž; medián posunu je 182 dní. Do…
-
Ollama pozastavila prodej tarifu Max, protože prý nestačí kapacita cloudu
Ollama, nástroj na provoz jazykových modelů na vlastním počítači, přestala prodávat nejdražší předplatné Max za 100 dolarů měsíčně. V odpovědi na ceníku uvádí, že objem tokenů v jejím…