AMD assemble un rack IA complet pour défier Nvidia

iEXExchanger
AMD assemble un rack IA complet pour défier Nvidia

AMD a dévoilé Helios, son premier rack IA complet avec 72 puces Instinct MI455X. Anthropic a déjà réservé 2 gigawatts de capacité, et Microsoft y adosse Azure.

AMD a assemblé ses puces en un rack de serveur complet baptisé Helios — la première vraie tentative de l'entreprise pour proposer une alternative globale aux systèmes d'entraînement IA de Nvidia, et pas juste une puce plus rapide. Un seul rack regroupe 72 accélérateurs Instinct MI455X, 18 nouveaux processeurs EPYC « Venice » et un réseau haut débit reliant le tout via un circuit de refroidissement liquide.

Le chiffre qu'AMD met en avant : environ 50% de mémoire en plus par rack que le système concurrent Vera Rubin de Nvidia. Pour des modèles à plusieurs milliers de milliards de paramètres, ce n'est pas un simple argument marketing — plus de mémoire signifie moins besoin de fragmenter le modèle entre plusieurs puces, donc des entraînements plus rapides et moins coûteux.

Plus que le matériel, ce qui compte, c'est qui s'est déjà engagé. Anthropic a accepté de déployer jusqu'à 2 gigawatts de GPU MI450, pariant que l'entraînement futur de Claude ne reposera plus uniquement sur du matériel Nvidia. Microsoft construit son infrastructure Azure autour de Helios, et OpenAI, Meta et Oracle ont confirmé leurs propres plans de déploiement.

Les livraisons débutent d'ici la fin de l'année, le processeur de nouvelle génération Venice-X suivra en 2027. C'est le plus gros pari d'infrastructure de l'histoire d'AMD — la PDG Lisa Su évalue le marché des accélérateurs IA à 1 400 milliards de dollars d'ici 2030 et veut en arracher une part réelle à Nvidia, qui contrôle encore environ 90% de ce marché.

Le hic, c'est que le matériel n'a jamais vraiment été le talon d'Achille d'AMD. L'écosystème logiciel CUDA de Nvidia a mis dix ans à se construire, et les développeurs ont été lents à adopter la pile logicielle ROCm d'AMD. La volonté d'Anthropic et de Microsoft de faire tourner Helios à l'échelle industrielle sera le vrai test pour savoir si cet écart est enfin comblé.

Questions et réponses

Questions fréquemment posées sur le sujet de l'article

Qu'est-ce qu'AMD Helios ?

C'est le premier rack de serveur IA entièrement intégré d'AMD : 72 accélérateurs Instinct MI455X, 18 CPU EPYC Venice et un refroidissement liquide réunis dans un seul système pour entraîner de grands modèles.

En quoi Helios diffère-t-il du système Vera Rubin de Nvidia ?

Selon AMD, un rack Helios embarque environ 50% de mémoire en plus que Vera Rubin, ce qui permet de loger de grands modèles avec moins de fragmentation entre puces et accélère l'entraînement.

Qui a déjà commandé des systèmes basés sur Helios ?

Anthropic a accepté de déployer jusqu'à 2 gigawatts de capacité GPU MI450, Microsoft construit une partie d'Azure sur Helios, et OpenAI, Meta et Oracle ont confirmé leurs propres plans de déploiement.

Quand les livraisons de Helios débuteront-elles ?

Les livraisons débuteront d'ici la fin de 2026, le processeur de nouvelle génération Venice-X pour cette plateforme étant prévu pour 2027.

AMD peut-elle vraiment défier la domination de Nvidia ?

Le matériel d'AMD est compétitif, mais le vrai obstacle reste l'écosystème logiciel CUDA de Nvidia, bâti en dix ans. Le succès de Helios dépendra de la capacité d'Anthropic, Microsoft et d'autres à faire tourner de vraies charges de travail sur la pile ROCm d'AMD.