Přeskočit na obsah

Všechny články

Kompletní výpis, od nejnovějšího.

  1. U sebe doma

    Nanbeige 4.2 se vejde do telefonu na 2,58 GB, kontext v něm spadl na 4 096 tokenů

    Na Hugging Face přibyl převod čínského modelu Nanbeige 4.2 do formátu běhového prostředí LiteRT-LM: jediný soubor o velikosti 2,58 GB, čtyřbitové váhy a kontext 4 096 tokenů místo 262 144,…

  2. Infrastruktura

    Nové úložiště ani rejstříky se v Milvusu 3.0 ve výchozím nastavení nezapnou

    Vektorová databáze Milvus dostala 29. července 2026 značku 3.0.0. Umí nově postavit rejstřík nad daty, která zůstanou ležet v objektovém úložišti, a má přepsaný řídký index. V konfiguraci…

  3. Bezpečnost

    Oprava AgentCore CLI neodstraní podstrčený kód z generovaného agenta.

    Nástroj @aws/agentcore, kterým se v Amazon Bedrock AgentCore zakládají a nasazují agenti, vypisoval popis spolupracujícího agenta do trojitě uvozeného řetězce v generovaném souboru main.py…

  4. Licence a podmínky

    Čínská pravidla pro citové chatboty platí od 15. července, proti návrhu přibyly pokuty

    Pět čínských úřadů vydalo pravidla pro služby, které s uživatelem vedou trvalý citový rozhovor. Platí od 15. července 2026 a proti loňskému návrhu se v nich zákaz trénovat model na…

  5. Infrastruktura

    AMD uvedla rack Helios se 72 kartami MI455X, jehož náskok je zatím odhad

    AMD uvedla 23. července rack Helios se 72 akcelerátory Instinct MI455X a 18 procesory EPYC „Venice“. Katalogový list karty uvádí 432 GB paměti HBM4 a propustnost 23,3 TB/s. Dvě čísla z…

  6. Licence a podmínky

    U 95 % souborů v trénovací sadě korpusu The Stack v3 se licence nenašla

    Hugging Face vydal The Stack v3, další díl sbírky zdrojového kódu pro trénování modelů: jeho trénovací sada má 15,9 TB textu ze 173 milionů repozitářů na GitHubu. Ze statistik, které…

  7. Infrastruktura

    PJM chce omezovat nová datová centra, která si nepřivedou vlastní kapacitu

    Správní rada PJM Interconnection, provozovatele přenosové soustavy pro 67 milionů lidí na východě USA, rozhodla 27. července, že nové velké odběry nad 50 MW vezme zvlášť: kdo si k síti…

  8. Čísla

    Po záměně průměru za nejslabší výsledek se první pětka HELM Lite vymění celá

    Pořadí modelů v žebříčku závisí na tom, jak se dílčí výsledky slijí do jednoho čísla. Práce ze sborníku workshopu GEM přepočítala dva veřejné žebříčky HELM podle nejslabšího výsledku místo…

  9. Čísla

    vLLM 0.26.0 bere tři až sedm bitů na váhu, jenže dva bity model v měření položily

    Nástroje pro běh jazykových modelů zmenšují váhy skoro vždy na osm nebo čtyři bity. Vydání vLLM 0.26.0 z 27. července 2026 přidalo dvě schémata, která ke kratším šířkám přiberou i…

  10. Nástroje

    TensorRT-LLM odstranil svůj backend nad TensorRT, zatím mimo stabilní vydání

    Návrhy změn sloučené v červenci 2026 odebraly z knihovny TensorRT-LLM celý původní běhový backend postavený nad TensorRT. Zmizely příkazy trtllm-build, trtllm-prune a trtllm-refit i…

  11. U sebe doma

    Laguna S 2.1 uvádí milion tokenů kontextu, vlastní GGUF od výrobce má 256 tisíc

    Firma poolside vydala 21. července otevřené váhy modelu Laguna S 2.1 se 118 miliardami parametrů a kontextovým oknem 1 048 576 tokenů. Balíčky GGUF, které k němu sama nabízí, jsou ale…

  12. Modely

    NVIDIA radí sdílet KV hlavu mezi víc dotazů, ale neříká, na kterých GPU měřila

    Nový technický rozbor rozděluje obsluhu dlouhého kontextu na dvě odlišné úlohy: načtení zadání omezuje výpočetní výkon, generování dalšího tokenu propustnost paměti. NVIDIA z toho odvozuje…

  13. U sebe doma

    llama.cpp ve Windows zapíná rychlé jádro na Intel Xe2 a Xe3 od verze 8860

    Vydání b10215 z 31. července zrušilo plošné vypnutí rychlé Walshovy-Hadamardovy transformace na grafikách Intel ve Windows. Na architekturách Xe2 a Xe3 ji povolí až s ovladačem 32.0.101…

  14. U sebe doma

    Llama.cpp umí dvoubitový Q2_0 i na kartách NVIDIA a ternární model 8B má 2,15 GiB.

    Do hlavní větve llama.cpp přibyla 30. července 2026 podpora formátu Q2_0 pro karty NVIDIA, o den později i pro rozhraní SYCL. Formát ukládá váhu do dvou bitů a s jedním měřítkem na každých…

  15. Čísla

    Výsledek fontu proti sběru dat se mezi čtyřmi filtry liší víc než třicetkrát

    Projekt ShieldFont zaměňuje slova ve zdroji stránky, aby robotům sbírajícím trénovací data podstrčil jiný text než čtenáři. Jeho vlastní měření v repozitáři zkoušelo čtyři filtry kvality a…

  16. Licence a podmínky

    Komise smí pokutovat poskytovatele obecných modelů od 2. srpna, rok po povinnostech

    Poskytovatelé obecných modelů mají povinnosti z evropského nařízení o umělé inteligenci už od 2. srpna 2025. Pokutu za jejich porušení ale Evropská komise smí uložit teprve od 2. srpna 2026…

  17. Bezpečnost

    Opravy pěti CVE v Ruby SDK protokolu MCP vyšly o tři týdny dřív než hlášení

    Databáze bezpečnostních hlášení GitHubu přidala 30. července 2026 k oficiální rubyové knihovně protokolu MCP pět záznamů najednou, dva s vysokou závažností. Všechny opravuje verze 0.23.0,…

  18. Nástroje

    Které ze dvou rozšíření v balíčku Cline 4.1 se spustí, řídí vzdálený příznak

    Vydání 4.1 rozšíření Cline pro Visual Studio Code sloučilo starou a novou verzi do jednoho balíčku: uvnitř leží obě vedle sebe a při každém otevření okna vybere zavaděč jednu z nich.…

  19. Licence a podmínky

    Konec 27 verzí modelů v Microsoft Foundry se posunul dál, medián posunu je 182 dní.

    Microsoft změnil 31. července tabulku, ve které katalog Foundry vede data ukončení modelů. U 27 kombinací modelu a verze se datum posunulo dál, u žádné blíž; medián posunu je 182 dní. Do…

  20. Infrastruktura

    Ollama pozastavila prodej tarifu Max, protože prý nestačí kapacita cloudu

    Ollama, nástroj na provoz jazykových modelů na vlastním počítači, přestala prodávat nejdražší předplatné Max za 100 dolarů měsíčně. V odpovědi na ceníku uvádí, že objem tokenů v jejím…