Všechny články
Kompletní výpis, od nejnovějšího.
-
Experimentální backend v PyTorchi 2.14 umí postavit skupinu procesů po výpadku znovu
PyTorch vydal 2. září verzi 2.14 a v ní backend nccl2, port komunikační vrstvy z projektu torchcomms. Proti dosavadnímu backendu umí přestavět skupinu procesů: zboří komunikátor a postaví…
-
Hugging Face zveřejnil 207 WebGPU kernelů pro prohlížeč, loader k nim vyšel jako náhled
Organizace webgpu-kernels na Hubu nese 207 výpočetních programů pro grafický čip pod licencí Apache 2.0 a balíček @huggingface/kernels je z prohlížeče stáhne a spustí. Proti ONNX Runtime…
-
Známku ověřeného měření nemá ani jeden z 2 542 výsledků v žebříčcích Hugging Face
Hugging Face ukládá od prosince 2025 výsledky testů přímo do repozitáře modelu a skládá z nich žebříčky benchmarků. Ze 2 542 položek, které v nich 4. září 2026 stály, nemá známku ověřeného…
-
Záznam CVE popsal chybu FaceFusionu až dva měsíce po její opravě
FaceFusion do verze 3.6.1 skládal cestu k souboru úlohy přímo z názvu, který přijalo rozhraní Gradio bez přihlášení. Cizí klient tak mohl zapsat JSON mimo pracovní adresář. Verze 3.7.0…
-
Tři skenery skillů pro AI agenty dostaly čísla CVE za přeskočený spustitelný kód
AgentVerus Scanner, skill-scan z Tencent AI-Infra-Guard a claude-skill-antivirus dostaly 2. září tři čísla CVE. Všechny tři mají posoudit, jestli je cizí skill pro agenta bezpečný, a…
-
Institut IFM vydal u rodiny K2 Horizon 309 značek se stavy z průběhu trénování
Institute of Foundation Models při univerzitě MBZUAI zveřejnil 3. září 2026 šest modelů K2 Horizon pod licencí Apache 2.0. Vedle finálních vah nechal v repozitářích i stavy z průběhu…
-
Ollama 0.33.3 čte doporučené hodnoty vzorkování přímo ze souboru modelu
Ollama do teď používala vlastní výchozí teplotu a top_p vždycky, když je nepřepsal Modelfile nebo požadavek. Verze 0.33.3 z 2. září 2026 se nejdřív podívá, co si o sobě napsal sám vydavatel…
-
llama.cpp nechá některé velké vkládací tabulky na disku místo v operační paměti
Projekt llama.cpp vydal 4. září 2026 verzi 0.4.0 s volbou --lazy-mode: vybraná vkládací tabulka zůstane v souboru na disku a program z ní čte řádky až ve chvíli, kdy je potřebuje. Sama od…
-
CowAgent má dvě nová CVE kvůli výstupu příkazů a sdílenému prohlížeči
Dva záznamy CVE zveřejněné 2. září popisují odmítnutí služby v agentním nástroji CowAgent. Nástroj Bash hromadí celý výstup příkazu před jeho zkrácením, zatímco prohlížeč nechá dlouhou…
-
Projekt llama.cpp přestal převádět pět vah Qwen3-TTS 0,6B na 16 bitů
Sestavení b10760 mění převod pomocného souboru pro model Qwen3-TTS 0,6B. Pět vah zůstane ve 32 bitech, protože mezivýsledek o hodnotě kolem 145 tisíc překračoval limit F16 a výpočet končil…
-
Zrychlená verze videomodelu MiniMax H3 dokládá slíbenou kvalitu šesti srovnáními
Váhy VDN-H3 přidávají k videomodelu MiniMax H3 druhou, levnější větev pozornosti a podle autorů z něj udělají 74,5násobně rychlejší stroj. Rychlost mají rozepsanou po jednotlivých krocích…
-
Sada 4,5 miliardy záznamů o videích z TikToku vznikla sběrem proti jeho podmínkám
Na Hugging Face leží od 2. září 289 GB popisků, počtů přehrání a značek zvuků ke 4,5 miliardy příspěvků z TikToku. Autor v kartě sady píše, že data sebral přes rozhraní mobilní aplikace a…
-
SGLang 0.5.19 odmítne požadavek s víc než 32 zastavovacími řetězci
Inferenční server SGLang přijme od verze 0.5.19 v jednom požadavku nejvýš 32 zastavovacích řetězců a 32 regulárních výrazů, každý výraz do 256 bajtů. Přes tu mez vrátí HTTP 400. OpenAI…
-
Souběžné načtení dvou vektorů promptu obešlo ve vLLM pojistku proti loňské díře
Záznam CVE-2026-73557 popisuje, že pojistka, kterou vLLM přidal v prosinci 2025 proti chybě CVE-2025-62164, stála na přepínači společném pro celý proces. Když server načítal dva vektory…
-
Ollama ohlásila modely v ChatGPT Desktopu jako novinku, příkaz na ně má od května
Testovací verze Ollamy 0.34.0-rc1 z 5. září má v poznámkách jako první bod používání modelů Ollamy v ChatGPT Desktopu. Příkaz na to je v projektu od května, nové je ovládání z aplikace na…
-
Hlídač agentů v API OpenAI umí konverzaci zastavit, hotové kroky ale nevrátí zpět
Spolu s modelem GPT-6 Astra ohlásilo OpenAI 3. září 2026 systém, který na pozadí čte uvažování agenta a při podezření na nezamýšlený přenos dat nebo destruktivní zásah konverzaci zastaví.…
-
llama.cpp počítal u sedmi architektur normalizaci jinak než jejich referenční kód
Vektory dotazů a klíčů v hybridní vrstvě Gated DeltaNet dělil llama.cpp odmocninou ořezanou zdola, kdežto knihovna, ke které se jejich referenční kód hlásí, k té odmocnině malé číslo…
-
Prompt delší než 272 tisíc tokenů zdraží u GPT-6 Astra celý požadavek
OpenAI vydala 3. září GPT-6 Astra s oknem 1 050 000 tokenů a sazbou 10 dolarů za milion vstupních tokenů. Prompt nad 272 tisíc tokenů ale přepne účtování na dvojnásobek u vstupu a na…
-
Dvě tabulky slovníku zabírají v modelu MiniCPM5-2B pětinu parametrů
Skupina OpenBMB vydala 6. září model MiniCPM5-2B pro běh na koncových zařízeních. Z jeho 2 516 756 480 parametrů připadá 534 773 760 na dvojici tabulek, které převádějí tokeny na vektory a…
-
Dynamicky sestavený Bifrost mohl bez přihlášení spustit modul z webu
Správní rozhraní AI brány Bifrost před verzí 2.0.0 přijímalo od nepřihlášeného volajícího internetovou adresu vlastního zásuvného modulu. V dynamickém sestavení mohl stažený modul běžet…