AMD heeft tijdens haar Advancing AI 2026-conferentie in San Francisco een compleet platform gepresenteerd dat zich richt op grote AI-implementaties. Het bedrijf verschuift de focus van enkel processors en accelerators naar een geïntegreerde infrastructuur: met de nieuwe EPYC “Venice” processors met Zen 6-architectuur, GPU’s Instinct MI455X, Pensando-netwerken, ROCm-software en Helios, hun eerste rack-scale AI-infrastructuurontwerp.
De kernpunten van AMD Advancing AI 2026 in 30 seconden
- De EPYC “Venice” zal Zen 6 implementeren, tot 256 cores en fabricage op 2 nanometer bij TSMC.
- Instinct MI455X bevat 432 GB HBM4-geheugen en levert tot 40 petaflops FP4-prestaties.
- Helios combineert 72 GPU’s MI455X en 18 EPYC Venice-CPU’s in één computing-domein.
- AMD belooft tot 30% meer tokens per dollar dan NVIDIA Vera Rubin NVL72, op basis van eigen schattingen.
- OpenAI, Anthropic, Meta en Microsoft werken al aan implementaties of validaties van het platform.
De presentatie markeert een belangrijke strategische verschuiving voor AMD. Jarenlang richtte het bedrijf zich vooral op het leveren van CPU’s en accelerators voor systemen van derden. Helios breidt dit uit: het definieert hoe alle componenten van een AI-rack moeten worden verbonden, gevoed, gekoeld en beheerd.
Het doel is om grote datacentra een compleet alternatief te bieden voor NVIDIA-platforms, gebaseerd op open standaarden zoals UALink, Ultra Ethernet en Open Rack Wide, in plaats van afhankelijk te zijn van proprietary interconnecties.
EPYC Venice brengt Zen 6 tot 256 cores
De zesde generatie EPYC-processors, bekend als Venice, wordt een kernonderdeel van de nieuwe infrastructuur. AMD is al begonnen met productietoelevering via TSMC en positioneert deze als de eerste high-performance computing-processors die deze fase bereiken met het geavanceerde 2-nanometerproces van de Taiwanese fabrikant.
Deze familie gebruikt de Zen 6-architectuur en biedt configuraties tot 256 cores en 512 threads per socket, tegenover maximaal 192 cores in de huidige EPYC Turin-modellen met Zen 5 en Zen 5c. AMD kondigt ook tot 1,6 TB/s geheugentoegang en PCIe Gen 6.0-connectiviteit aan voor accelerators, opslag en netwerken.
Venice is vooral gericht op zogeheten AI-achtige systemen. Hoewel GPU’s de zware rekentaken uitvoeren, blijven CPU’s agents coördineren, data voorbereiden, databases beheren, tools draaien en accelerators aansturen.
AMD beweert dat de zesde generatie EPYC meer agents per watt, dollar en rack kan draaien. Deze vergelijkingen moeten voorlopig worden beschouwd als uitspraken van de fabrikant, totdat er commerciële systemen en onafhankelijke tests beschikbaar zijn.
Venice zal geen enkel processor zijn, maar een familie die diverse infrastructuurprofielen bedient. Varianten met hogere kloksnelheid per core, hoge dichtheid en aangepaste configuraties voor cloud, bedrijfsomgevingen en high-performance computing komen eraan.
Instinct MI455X verbetert geheugen en bandbreedte
Een andere grote aankondiging uit San Francisco is AMD Instinct MI455X, de GPU gebaseerd op de CDNA 5-architectuur, die centraal zal staan in Helios.
Elke GPU krijgt tot 432 GB HBM4-geheugen en levert tot 23,3 TB/s bandbreedte, afhankelijk van de configuratie die AMD toont. De maximale prestaties worden geschat op 40 petaflops FP4, een precisie die vooral wordt gebruikt voor grootschalige AI-modellering.
| Kenmerk | AMD Instinct MI455X |
|---|---|
| Architectuur | CDNA 5 |
| Geheugen | Tot 432 GB HBM4 |
| Bandbreedte | Tot 23,3 TB/s |
| FP4-prestaties | Tot 40 petaflops |
| Hoofdaanbod | Training en inferentie AI |
AMD stelt dat MI455X tot 34 keer meer tokens kan verwerken dan MI355X in bepaalde tests met DeepSeek-V4-Flash, en de kosten per miljoen tokens tot 18 keer kan verminderen. Deze cijfers komen uit interne tests van AMD, gebaseerd op geprojecteerde precisies, interactiviteitsniveaus en cloudkosten.
De uitgebreide geheugencapaciteit is cruciaal. Grotere modellen, langere contextvensters en systemen met meerdere gebruikers vereisen steeds meer parameters en data dichtbij de GPU. Hogere HBM-capaciteit vermindert gegevensbeweging tussen knooppunten en houdt meer werk binnen hetzelfde systeem.
Helios maakt een heel rack AI-systeem
Helios vormt de backbone van AMD’s nieuwe generatie. Een rack bevat 72 Instinct MI455X accelerators, verdeeld over 18 compute bakken, samen met 18 EPYC Venice CPUs, Pensando-netwerken, vloeistofkoeling en ROCm-software.
Deze configuratie biedt 31 TB HBM4-geheugen, 2,9 exaflops FP4 en 1,4 exaflops FP8, plus intern bandwidth van 260 TB/s en 43 TB/s voor rack-naar-rack communicatie.
| AMD Helios | Gerapporteerde specificaties |
|---|---|
| GPU’s per rack | 72 Instinct MI455X |
| CPU’s per rack | 18 EPYC Venice |
| Geheugen HBM4 | 31 TB |
| FP4-prestaties | 2,9 exaflops |
| FP8-prestaties | 1,4 exaflops |
| Interne bandbreedte | 260 TB/s |
| Rack-tot-rack communicatie | 43 TB/s |
Helios concurreert rechtstreeks met NVIDIA Vera Rubin NVL72. AMD beweert dat Helios tot 15% meer AI-rekenkracht biedt, met 50% meer HBM-geheugen en 50% meer externe schaalbare bandwidth.
Daarnaast belooft het platform tot 30% meer tokens per dollar in bepaalde inferentielasten. Deze uitspraken zijn gebaseerd op AMD’s eigen modellering en moeten nog worden bevestigd door onafhankelijke benchmarks.
Open standaarden versus NVIDIA’s controle
De strategie van AMD gaat verder dan cijfers. Helios gebruikt UALink over Ethernet voor communicatie tussen accelerators, in combinatie met standaarden van het Ultra Ethernet Consortium en het Open Rack Wide-ontwerp van Meta via het Open Compute Project.
NVIDIA profiteert van een meer gesloten ecosysteem met eigen technologieën zoals NVLink en NVSwitch. Hoewel dit optimaal geïntegreerd is, beperkt het ook de keuze van de klant tot één leverancier en haar technologieën.
AMD streeft naar een open platform dat de integratie van componenten van verschillende fabrikanten mogelijk maakt en flexibiliteit biedt om de infrastructuur aan te passen.
ROCm vormt de andere kern van AMD’s aanpak. Het ondersteunt onder andere PyTorch, TensorFlow en JAX, en tools voor gedistribueerde inferentie. Maar compatibiliteit met deze omgevingen garandeert niet dat CUDA-werkloads probleemloos kunnen worden overgezet zonder aanpassingen.
Softwareondersteuning blijft een van NVIDIA’s sterke punten, en AMD moet nog aantonen dat ROCm even stabiel en compleet is voor diverse projecten.
Samenwerking met grote spelers
AMD benadrukte dat Helios niet slechts een technisch prototype is. Anthropic plant deploys tot 2 gigawatt aan GPU-capaciteit met MI455X en werkt samen met AMD om ROCm verder te verbeteren met Claude.
OpenAI ontwikkelt met AMD GPT-klasse workload-optimisaties en verwacht Helios in het vierde kwartaal van 2026 operationeel te krijgen, met meer uitrol in 2027. Meta test momenteel EPYC-processors en Helios in haar labs. Microsoft bereidt systemen voor met Venice en Pensando-netwerktechnologieën. Ook andere grote spelers zoals Oracle, Vultr, HPE, Lenovo en Supermicro tonen interesse en ondersteunen het ontwerp.
Dit alles onderstreept dat de AI-strijd niet enkel over chips gaat: het gaat ook om fabricagecapaciteit, geheugentechnologie, netwerkbandbreedte en een ecosysteem dat volledige machine-effectiviteit mogelijk maakt.
Advancing AI 2026 laat zien dat AMD niet langer alleen een alternatieve CPU- en GPU-leverancier is, maar een volledige architectuuraanbieder voor de toekomstige AI-fabrieken. Hoewel Helios nog moet bewijzen in productie dat het de concurrentie kan verslaan, maakt het de competitie met NVIDIA veel breder dan slechts één versneller.
Veelgestelde vragen
Wat is AMD Helios?
Het eerste rack-scale AI-infrastructuurontwerp van AMD. Het combineert EPYC Venice-CPU’s, 72 MI455X GPU’s, Pensando-netwerken, koeling en ROCm-software.
Hoeveel cores hebben de EPYC Venice?
De familie op basis van Zen 6 biedt tot 256 cores en 512 threads per socket.
Hoeveel geheugen heeft de Instinct MI455X?
Elke accelerator kan tot 432 GB HBM4 bevatten, terwijl een volledig Helios-rack 31 TB bereikt.
Wordt AMD Helios sneller dan NVIDIA Vera Rubin?
AMD claimt dat het meer rekenkracht, geheugen en tokens per dollar biedt in bepaalde configuraties. Deze cijfers komen van de fabrikant en moeten nog worden bevestigd wanneer systemen in productie zijn.
vía: amd
