Infrastruktura
Přehled článků v rubrice infrastruktura. Nejnovější nahoře.
-
Nvidia cílí v Austrálii na 2 GW pro AI, rozpis po areálech ale chybí
Nvidia spojila osm australských provozovatelů datových center pod společný cíl až 2 GW pro umělou inteligenci do roku 2027. Jednotlivá čísla v oznámení však míchají existující provoz,…
-
Dify 1.17.1 vyžaduje u Weaviate postup přes dvanáct menších verzí
Vlastní instalace Dify s přibalenou databází Weaviate nesmí při přechodu na verzi 1.17.1 skočit rovnou z 1.27.0 na 1.39.2. Návod předepisuje zálohu a třináct spuštění novějšího obrazu;…
-
vLLM 0.29 zapíná Model Runner V2, který dokumentace dál označuje za neúplný
vLLM 0.29.0 změnilo 9. září výchozí cestu, která připravuje vstupy a spouští model na akcelerátoru. Model Runner V2 má zjednodušit asynchronní provoz a šetřit paměť, k V1 se však program…
-
Prompt delší než 272 tisíc tokenů zdraží u GPT-6 Astra celý požadavek
OpenAI vydala 3. září GPT-6 Astra s oknem 1 050 000 tokenů a sazbou 10 dolarů za milion vstupních tokenů. Prompt nad 272 tisíc tokenů ale přepne účtování na dvojnásobek u vstupu a na…
-
SGLang 0.5.19 odmítne požadavek s víc než 32 zastavovacími řetězci
Inferenční server SGLang přijme od verze 0.5.19 v jednom požadavku nejvýš 32 zastavovacích řetězců a 32 regulárních výrazů, každý výraz do 256 bajtů. Přes tu mez vrátí HTTP 400. OpenAI…
-
Experimentální backend v PyTorchi 2.14 umí postavit skupinu procesů po výpadku znovu
PyTorch vydal 2. září verzi 2.14 a v ní backend nccl2, port komunikační vrstvy z projektu torchcomms. Proti dosavadnímu backendu umí přestavět skupinu procesů: zboří komunikátor a postaví…
-
NVIDIA přesouvá řadič paměti z akcelerátoru do základního čipu NVHBM
NVIDIA oznámila NVHBM, která přesouvá řadič paměti z akcelerátoru do základního čipu v HBM. Proti HBM4E slibuje až o 30 % vyšší propustnost a o 15 % nižší spotřebu, u uvolněné plochy ale…
-
Triton 3.8.0 překládá jádra pro Rubin, který je zatím jen v náhledu dokumentace PTX
Vydání z 28. srpna přidalo do překladače Triton cíl „cuda:107“ pro architekturu, kterou NVIDIA popisuje zatím jen ve vývojářském náhledu dokumentace PTX. Z Tritonu i z toho náhledu se dá…
-
Vazba NIXL pro Rust běžela ve dvou obrazech Dynama na náhradních funkcích
NVIDIA vydala 29. srpna opravu Dynama 1.4.2. Ve dvou jeho kontejnerových obrazech ležela knihovna NIXL v adresáři, kam dynamický zavaděč nedohlédne; přitom je to ona, kdo při rozděleném…
-
Anthropic otevřel Model Hardware Standard jen vybraným laboratořím
Model Hardware Standard má sjednotit ovládání mikroskopů, pipetovacích robotů a robotických ramen přes společné příkazy a bezpečnostní limity. Anthropic 27. srpna otevřel výzkumný náhled…
-
Ray 2.58 zohledňuje KV cache při směrování dotazů mezi replikami
Ray 2.58 dokončil směrování požadavků podle toho, kolik jejich prefixu už leží v KV cache jednotlivých replik. Router převádí text na tokeny jednou, sleduje bloky v paměti GPU i RAM a při…
-
Cisco přidá do AI infrastruktury rackové servery Supermicro
Sestava spojí výpočetní systémy, síťové přepínače a kapalinové chlazení. Do prodeje má jít v říjnu, takže zatím stojí hlavně na slibu tří dodavatelů.
-
Alibaba prodává nové akcie za 10,2 miliardy dolarů na AI
Alibaba ocenila 710 milionů nových akcií na 112,70 hongkongského dolaru za kus. Celý čistý výnos chce vložit do svého řetězce pro umělou inteligenci, zejména do výpočetní infrastruktury.…
-
Kubeflow splnil nejvyšší nároky CNCF, bezstarostný provoz AI to neslibuje
Kubeflow postoupil po bezpečnostním auditu a kontrole správy projektu do nejvyšší fáze CNCF. Označení graduated snižuje riziko opuštěného projektu, negarantuje však bezpečí konkrétní…
-
Stripe se dohodl na koupi zprostředkovatele OpenRouter, cenu neuvádí ani jedno oznámení
Stripe se 19. srpna 2026 dohodl na koupi OpenRouteru, tedy brány, přes kterou vývojáři posílají dotazy modelům desítek výrobců. Cenu neuvádí ani jedno ze dvou oznámení; Bloomberg tři dny…
-
U téhož modelu nabízí poskytovatelé OpenRouteru různé přesnosti a cena to neprozradí
Zprostředkovatel OpenRouter nabízí u téhož modelu i víc než třicet poskytovatelů. Měření jeho veřejného rozhraní ukazuje, že se mezi nimi liší přesnost vah i velikost kontextu, a že cena za…
-
NCCL 2.31 přidal přenos, který NVIDIA podporuje jen na Blackwellu a od CUDA 13.3
Knihovna, přes kterou si karty NVIDIA při trénování modelů předávají mezivýsledky, vydala 11. srpna verzi 2.31. Hlavní novinku, Compute Fabric Transport, podporuje NVIDIA jen na kartách…
-
IBM má za 240 milionů dolarů dodat Together AI cluster, kapacitu neuvádí
Vyhrazený inferenční cluster s Nvidia HGX B300 má být na IBM Cloud dostupný v prvním čtvrtletí 2027. Oznámení uvádí hodnotu kontraktu a vlastní provoz Together AI, nikoli počet systémů,…
-
Envision uvedl do provozu areál v Ulanqabu, dva gigawatty i milion čipů jsou zatím cíl
Envision oznámil 6. srpna uvedení areálu Galaxy Campus v Ulanqabu do provozu a přidal dvě velká čísla: přes dva gigawatty a milion akcelerátorů. Obě popisují cílový stav, ne dnešek, a každé…
-
Hlavní větev Transformers přestala vydávat starý soubor z cache za aktuální
Knihovna Transformers mohla na souborovém systému jen pro čtení předat aplikaci starší soubor z cache, i když na Hugging Face Hubu našla novější revizi. Oprava sloučená 9. srpna 2026 chybu…