cnbc.com détecté sur le web

AMD lance Helios face à Nvidia, Microsoft nouveau client

TL;DR

  • Microsoft rejoint Meta, OpenAI, Oracle et Tata Consultancy Services parmi les premiers clients confirmés de Helios, premier système rack-scale IA d'AMD.
  • Chaque rack embarque 72 GPU Instinct MI455X, des CPU EPYC Venice et des DPU Pensando, dans un châssis Open Rack Wide double largeur.
  • Futurum estime Helios entre 5 et 5,5 M$ l'unité, contre 3,5 à 4 M$ pour le Vera Rubin de Nvidia, qui détient plus de 95% du marché GPU datacenter.

Le fait que Microsoft rejoigne Meta, OpenAI et Oracle sur la liste des premiers clients de Helios, comme le rapporte CNBC, change la lecture qu'on peut faire du positionnement d'AMD. Le rack-scale est la brique sur laquelle Nvidia a bâti sa domination, et jusqu'ici AMD y répondait surtout avec des GPU vendus à l'unité. Helios est la première tentative sérieuse d'y répondre au même niveau d'intégration.

Techniquement, chaque rack embarque 72 GPU Instinct MI455X, des CPU EPYC Venice et des DPU Pensando, dans un châssis Open Rack Wide double largeur soumis par Meta à l'Open Compute Project. Côté prix, le Futurum Group estime chaque Helios entre 5 et 5,5 M$ l'unité, contre 3,5 à 4 M$ pour le Vera Rubin de deuxième génération de Nvidia. Microsoft s'est engagé à déployer Helios « at scale » sur Azure, et Tata Consultancy Services rejoint la liste côté intégration entreprise, selon Tom's Hardware.

Pourquoi ça compte au-delà d'une annonce produit: selon les chiffres cités par Futurum, Nvidia détient toujours plus de 95% du marché des GPU pour datacenter. En mai, Lisa Su avait affirmé sur CNBC que Helios présentait des « significant benefits » face aux systèmes de Nvidia, notamment sur l'inférence, la bande passante mémoire et les capacités mémoire. Un carnet de commandes hyperscaler concret est ce qui manquait pour transformer cette revendication en volume.

La réserve honnête, c'est que le prix estimé reste sensiblement au-dessus de celui de Vera Rubin, et qu'AMD doit convaincre les acheteurs que les gains d'inférence revendiqués compensent l'écart. Les premières livraisons en volume sont attendues au troisième trimestre 2026 avec une montée en cadence au quatrième et jusqu'au début 2027, ce qui laisse à Nvidia plusieurs trimestres pour continuer d'expédier. Ce que l'article ne quantifie pas, c'est la part réelle du capex IA de Microsoft qui basculera vers AMD, ni la maturité effective du stack logiciel côté clients. Reste que pour la première fois depuis longtemps, la question n'est plus de savoir si AMD peut faire du GPU IA, mais si Helios peut faire tourner un rack de production d'hyperscaler à l'échelle promise.