AMD představuje nový rack pro trénování a inferenci AI. Jde o Helios, který ve svých útrobách schovává 72 GPU Instinct MI455X a 31 TB paměti HBM4.
Společnost AMD se snaží dohnat Nvidii a ohrozit její dominanci na poli AI serverů. Pomoci by jí v tom měl nový Helios AI Rack, což je zařízení obsahující 72 nejnovějších GPU AMD Instinct MI455X. Novinka tak dosahuje výkonu 2,9 ExaFLOPS v FP4 a 1,4 ExaFLOPS v FP8.
Samotné jedno GPU MI455X zvládá 40 PFLOPS v FP4 a 20 PFLOPS v FP8, což je dvojnásobek toho, co zvládne předchozí generace MI350. Pokud to srovnáme s Nvidií Rubin, tak její GPU je o něco výkonnější v FP4 s výkonem 50 PFLOPS, ale je slabší v FP8 se 17,5 PFLOPS. Výhodou AMD je paměť, neboť tu máme 432 GB paměti HBM4 na GPU (paměti jsou od Samsungu) s propustností 19,6 TB/s. Pro zajímavost, MI350 mělo jen 8 TB/s. Nvidia Rubin se musí spokojit jen s 288 GB paměti od SK hynixu, ta ale běží rychleji s 22 TB/s. Jak vidíme, každé řešení má své výhody i nevýhody.

Zajímavostí jsou nové čipy EPYC Venice, což jsou první procesory nové architektury Zen 6. Vyráběny jsou nejpokročilejším procesem u TSMC, tedy 2nm metodou. Tato výrobní technologie přechází z FinFET na GAA a měla by při stejné spotřebě navýšit výkon o 10-15 %, při stejném výkonu o 25-30 % snížit spotřebu a přinést o 15 % vyšší hustotu tranzistorů. Procesory mohou mít až 256 jader a podporu pro 512 vláken.
V neposlední řadě je tu čip AMD Pensando, a to ve verzi Vulcano 800 AI NIC, který přináší až 800Gbps konektivitu. Jeden takový rack má spotřebu zhruba 225-245 kW. Nevýhodou AMD bude patrně něco, co bychom proti Nvidii nečekali, cena. Spekuluje se totiž, že jeden takový rack vyjde na 5-5,5 mil. USD, zatímco rack s Nvidia Rubin by měl stát jen 3,5-4 mil. USD. To je zhruba o 40 % vyšší částka. Mezi prvními zákazníky jsou společnosti jako Microsoft (pro Azure), OpenAI a Oracle.
























