Az AMD bemutatta Helios AI-rackjét és új adatközponti chipjeit

Az AMD bemutatta Helios nevű, rackméretű AI-rendszerét, valamint a 6. generációs EPYC processzorokat és az Instinct MI400 GPU-sorozatot. A vállalat szerint a platformot vezető AI-cégek gigawattos léptékben telepítik majd.
- Az AMD bemutatta a 72 MI455X GPU-t és 18 EPYC processzort használó Helios AI-racket.
- A vállalat szerint a Helios akár 30 százalékkal több tokent ad dolláronként a vezető versenytársi megoldásnál.
- Az Anthropic legfeljebb 2 gigawattnyi MI455X GPU telepítését tervezi.
- Az OpenAI 2026 negyedik negyedévétől kezdené a Helios telepítését.
- Az AMD 2027-re MI500, 2028-ra MI600 GPU-kat jelentett be.
72 GPU és 18 processzor egy Helios-rackben
Az AMD július 23-án, a San Franciscó-i Advancing AI 2026 rendezvényen ismertette új AI-infrastruktúra- és fizikai AI-portfólióját. Ennek központi eleme az AMD Helios, amely a vállalat első rack-scale, vagyis teljes rackre kiterjedő AI-megoldása.
A Helios egy rendszerben 72 AMD Instinct MI455X GPU-t és 18, 6. generációs AMD EPYC, „Venice” kódnevű processzort kapcsol össze. A rendszert AMD Pensando hálózati megoldások és az AMD ROCm nyílt szoftverplatformja egészíti ki. Az AMD állítása szerint a Helios a vezető versenytárs megoldásához képest akár 30 százalékkal több következtetési tokent biztosít dolláronként.
A vállalat közlése szerint a Helios már gyártásban van, és vezető AI-cégek, valamint felhőszolgáltatók választották. A felsorolt partnerek között szerepel az OpenAI, az Anthropic, a Meta, a Microsoft, az Oracle, a HUMAIN, a Tensorwave, a Vultr és a Cirrascale. A rendszereket többek között a Bull, a HPE, a Lenovo és a Supermicro szállíthatja, a gyártásban pedig a Sanmina és a Wiwynn is részt vesz.
Partnerségek az Anthropiccal, az OpenAI-jal és a Metával
Az Anthropic és az AMD korábbi stratégiai együttműködését részletesebben is bemutatta. A két vállalat legfeljebb 2 gigawattnyi AMD Instinct MI455X GPU telepítését tervezi Helios-rendszerekben, többéves mérnöki együttműködés keretében. A Claude segítségével AMD GPU-s munkaterheléseket optimalizálnak, és gyorsítják a ROCm fejlesztését. Az AMD a Claude-ot mérnöki és termékfejlesztési csapataiban is széles körben használja majd.
Az OpenAI és az AMD a teljes AI-verem, vagyis a szilíciumtól a szoftverig terjedő infrastruktúra optimalizálásán dolgozik. Az OpenAI Triton keretrendszerét a ROCm szoftverrel együtt használják GPT-alapú munkaterhelésekhez. Az OpenAI a Helios telepítését 2026 negyedik negyedévében kezdené, majd 2027-ben gyorsítaná fel.
A Meta az AMD-vel gigawattos telepítésekhez közösen tervez, és saját munkaterheléseihez optimalizálja az AMD teljes AI-számítási stackjét. A vállalat laboratóriumaiban már validálják a 6. generációs EPYC platformokat, valamint megkezdték a Helios-rackek tesztelését. A Cerebras eközben alacsony késleltetésű AI-számítását kombinálná a Helios nagy áteresztőképességű infrastruktúrájával.
Új EPYC és Instinct chipek, hosszabb távú ütemterv
Az AMD szerint a 6. generációs EPYC processzorok a vállalat legszélesebb szerverprocesszor-portfólióját adják az ügynökalapú AI-hoz, felhős, vállalati, általános célú és nagy teljesítményű számítási feladatokra. Az Instinct MI400 sorozat részeként az MI455X GPU a vállalat állítása szerint 34-szer nagyobb token-átbocsátást nyújt az MI355X-hez képest. A nagy pontosságú számításokra szánt MI430X legfeljebb 288 TFLOPS hardveralapú FP64-teljesítményt kínál, az MI350P pedig akár 4,2-szer több tokent biztosít másodpercenként és dolláronként a versenytársi megoldásoknál.
Az AMD bemutatta a ROCm.ai fejlesztői platformot is. Ez olyan kódolási ügynököket támogat, mint a Claude, a Codex és a Cursor, amelyek natív módon érthetik meg az AMD platformjait és a ROCm környezetet. A közlemény szerint a MI455X már olyan nyílt forráskódú keretrendszerekkel is használható, mint a PyTorch, a Hugging Face, a vLLM és az SGLang.
A vállalat 2027-re ígéri az Instinct MI500, 2028-ra az MI600 sorozatot. A Zen 7 architektúrára épülő következő generációs EPYC processzorok 2028-ban, a Zen 8-alapú „Ravenna” processzorok pedig 2030-ban érkezhetnek. Az AMD szerint a bejelentések azt jelzik, hogy az AI-infrastruktúra fejlesztését az adatközpontoktól a vállalati és helyi rendszerekig teljes hardveres és szoftveres portfólióval kívánja támogatni.
