Přeskočit na obsah
Infrastruktura 4 min čtení

AMD uvedla rack Helios se 72 kartami MI455X. Náskok nad konkurencí je zatím odhad

AMD uvedla 23. července rack Helios se 72 akcelerátory Instinct MI455X a 18 procesory EPYC „Venice“. Katalogový list karty uvádí 432 GB paměti HBM4 a propustnost 23,3 TB/s. Dvě čísla z tiskové zprávy, o 30 % lepší poměr tokenů k ceně proti racku Vera Rubin a čtyřiatřicetinásobná průchodnost proti předchozí kartě, mají pod čarou různě podrobné vysvětlivky.

Křemíková vrstva čipu pod mikroskopem
Křemíková vrstva čipu pro vstupy a výstupy procesoru AMD EPYC Rome pod mikroskopem. Akcelerátor MI455X skládá do jednoho pouzdra osm výpočetních čipů a dva čipy pro vstupy a výstupy. Foto: Fritzchens Fritz, Wikimedia Commons (CC0)

Firma AMD uvedla 23. července na vlastní konferenci Advancing AI v San Francisku novou řadu akcelerátorů Instinct MI400 a s ní i celý rack, kterému říká Helios. Rack je skříň, do které se v datovém centru zasouvají servery jeden nad druhý. Ten od AMD pojme osmnáct serverů a v každém leží čtyři karty MI455X a jeden šestadevadesátijádrový procesor EPYC „Venice“. Dohromady je to 72 akcelerátorů a 18 procesorů na jednu skříň.

Odběratelé jsou domluvení dopředu. Anthropic se s AMD dohodl na nasazení až dvou gigawattů karet řady MI450, první gigawatt se má nasazovat v první polovině roku 2027 a AMD zároveň slíbila vložit do Anthropicu až pět miliard dolarů. Gigawatty tu neznamenají výkon karet, ale příkon celé instalace. OpenAI podle tiskové zprávy z konference počítá s prvními racky ve čtvrtém čtvrtletí letošního roku, Oracle Cloud Infrastructure má podle katalogového listu nasadit 50 000 karet MI455X od roku 2026.

Co stojí v katalogovém listu

Karta MI455X má podle katalogového listu 432 GB paměti HBM4 a špičkovou propustnost 23,3 TB/s, což je podle AMD až 2,9krát víc než u předchozí MI355X. Skládá se z osmi výpočetních čipů a dvou čipů pro vstupy a výstupy vyrobených u TSMC dvounanometrovým a třínanometrovým postupem, má 256 výpočetních jednotek a taktuje se do 2,4 GHz. Ve čtyřbitovém formátu MXFP4 uvádí AMD špičkových 40 265 TFLOPS, v osmibitovém 20 133.

Jeden řádek té tabulky vyčnívá dolů. U dvojité přesnosti FP64 stojí pět TFLOPS, tedy zhruba osmitisícina toho, co táž tabulka uvádí u čtyřbitového formátu. Není to opomenutí: na vědecké výpočty prodává AMD samostatný akcelerátor MI430X, u kterého tisková zpráva slibuje až 288 TFLOPS ve FP64. Řada se tím rozdělila na dvě větve, jednu pro jazykové modely a druhou pro simulace.

Čtyřnásobek, nebo čtyřiatřicetinásobek

Tisková zpráva tvrdí, že MI455X dodá „34x higher token throughput“ proti MI355X. Vysvětlivka pod ní, označená MI400-020, upřesňuje, oč jde: o měření a výpočty laboratoře AMD Performance Labs z července 2026, o průchodnost tokenů ve třech bodech odezvy a o model DeepSeek V4 Flash obsluhovaný ve čtyřbitové přesnosti.

Katalogový list téže firmy přitom u téhož páru karet uvádí nárůst až čtyřnásobný, a to u maticových operací ve čtyřech a osmi bitech. Obě čísla jsou od AMD a každé měří něco jiného: čtyřnásobek je špičková aritmetika čipu, čtyřiatřicetinásobek jsou vydané tokeny jednoho konkrétního modelu. Čím se rozdíl mezi nimi zaplní, vysvětlivka neříká. Neuvádí verzi ROCm, program, kterým se model obsluhuje, ani délku vstupu a výstupu, takže si to měření nikdo zvenčí nezopakuje. Zvláštnost jedné firmy to není: chybějící údaj o použitém hardwaru měla nedávno i doporučení NVIDIA k dlouhému kontextu.

Třicet procent proti racku Vera Rubin

U celé skříně slibuje AMD až o 30 % víc tokenů na dolar než vedoucí konkurenční řešení. Vysvětlivka MI400-025 k tomu dodává tři věci. Je to odhad, v originále „estimates“, opět z laboratoře AMD a z července 2026. Počítal se na úloze s modelem Kimi K2 Thinking při 32K vstupních a 8K výstupních tokenech. A protivníkem byl rack NVIDIA Vera Rubin NVL72. Vysvětlivka sama označuje průchodnost za odhadovanou a hodinovou cenu karet za projekci podle tržních podmínek, takže naměřená není ani jedna strana toho podílu.

Nezávislé srovnání zatím existuje jen na papíře. Server The Register napsal tentýž den, že Helios je proti Vera Rubin větší a rychlejší skoro v každém údaji, o polovinu víc paměti HBM4 i propustnosti ven ze skříně a o 15 až 25 % vyšší výkon při trénování, ale že je to zatím jen papír. Uvádí i údaj v neprospěch AMD: kompresní technika má podle něj dát Vera Rubin čtvrtinový náskok při odvozování ve čtyřech bitech.

Nejpodrobnější vysvětlivka je u karty MI350P

Vedle karet pro Helios uvedla AMD i kartu MI350P, kterou míří do už postavených serverů, a slibuje u ní až 4,2krát víc tokenů za sekundu na dolar než konkurence. Vysvětlivka MI350P-007 je z celé tiskové zprávy zdaleka nejpodrobnější: model Llama 3.3 70B Instruct v osmibitové přesnosti, 1 024 tokenů na vstupu i na výstupu, devět úrovní souběžnosti od jedné do 512, medián ze tří běhů, ROCm 7.14.0 a k tomu verze ovladače, BIOSu i jádra Linuxu.

Právě díky té podrobnosti se v ní dá dočíst i to, co jinde chybí. Výsledek je „peak per-concurrency ratio“, tedy nejlepší z těch devíti bodů, ne jejich průměr. Cena serveru s kartami AMD, 327 238,40 dolaru, je vlastní odhad AMD, kdežto srovnávaná cena 265 928,24 dolaru je ceníková částka z webu výrobce serverů k 16. červenci 2026. A úvodní věta vysvětlivky jmenuje jako protivníka kartu NVIDIA H200 NVL, zatímco popsaná a oceněná sestava je server s osmi kartami RTX PRO 6000 Blackwell Server Edition.

Co to rozhodne

Helios je podle AMD ve výrobě, u zákazníků ale naběhne až koncem letošního roku. Do té doby jsou všechna srovnání výrobcova a rozhodne až první měření někoho jiného, ať už výsledek v sadě MLPerf, nebo čísla od odběratele, který si skříň postaví. Podle nás je na tom nejzajímavější to, že číslo, které se bude citovat nejčastěji, tedy čtyřiatřicetinásobek, stojí na nejkratší ze všech tří vysvětlivek.

Zdroje: tisková zpráva AMD z konference Advancing AI 2026 včetně vysvětlivek MI400-020, MI400-025 a MI350P-007, katalogový list AMD Instinct MI455X (LE-93204-00, 07/26), společná tisková zpráva AMD a Anthropicu z 22. července 2026 a rozbor serveru The Register z 23. července 2026. Přepočty poměrů mezi řádky katalogového listu jsou naše.

Diskuse

Zatím tu nikdo nediskutuje. Můžete být první.

Napsat příspěvek

Diskutovat můžete i bez účtu. S registrací se ale příspěvek zveřejní hned a nemusíte pokaždé vyplňovat jméno. Účet už máte? Přihlaste se.

Nezveřejňujeme ho, slouží jen redakci.

Podporuje zápis Texy: **tučně**, *kurzíva*, odrážky, odkazy.

Dál k tématu

  1. Infrastruktura

    Milvus 3.0 přinesl nové úložiště i nové rejstříky. Ve výchozím nastavení se nezapnou

    Vektorová databáze Milvus dostala 29. července 2026 značku 3.0.0. Umí nově postavit rejstřík nad daty, která zůstanou ležet v objektovém úložišti, a má přepsaný řídký…

  2. Infrastruktura

    PJM chce omezovat nová datová centra, která si nepřivedou vlastní kapacitu

    Správní rada PJM Interconnection, provozovatele přenosové soustavy pro 67 milionů lidí na východě USA, rozhodla 27. července, že nové velké odběry nad 50 MW vezme zvlášť…

  3. Infrastruktura

    Ollama pozastavila prodej tarifu Max za 100 dolarů. Kapacita cloudu prý nestačí

    Ollama, nástroj na provoz jazykových modelů na vlastním počítači, přestala prodávat nejdražší předplatné Max za 100 dolarů měsíčně. V odpovědi na ceníku uvádí, že objem…

  4. Infrastruktura

    Za tři měsíce 96 hlášení o poruchách u OpenAI. Příčinu popisuje jediné z nich

    Stavovou stránku OpenAI jsme přečetli strojově, ne okem: od května do konce července 2026 na ní přibylo 96 záznamů o poruchách. Příčinu z nich popisuje jediný, osmdesát…