Nvidia évalue des Rubin Ultra à mémoire HBM réduite
TL;DR
- Depuis le T3 2026, Nvidia évalue plusieurs configurations HBM pour Rubin Ultra au-delà de son design initial en 12-Hi HBM4e.
- Selon TrendForce, les alternatives testées incluent 8-Hi HBM4e, 12-Hi HBM4 et 8-Hi HBM4, aucune décision finale n'étant tranchée.
- Les livraisons de bits HBM ne progresseraient que de 50 à 60% en 2027, un rythme jugé insuffisant face à la demande.
Le récit habituel autour de la roadmap IA de Nvidia parle de FLOPs, de nœuds TSMC et de fabric NVLink. Cette semaine, c'est la mémoire qui décide, et pas dans le bon sens. The Information rapporte que Nvidia envisage sérieusement des variantes de son futur Rubin Ultra embarquant moins de HBM que prévu, une idée reprise et étayée par une note de TrendForce datée du 4 août 2026.
La note de TrendForce est précise sur le périmètre de l'évaluation. Depuis le début du troisième trimestre 2026, Nvidia teste, en plus du design initial en HBM4e 12-Hi, trois alternatives à specs plus basses : HBM4e 8-Hi, HBM4 12-Hi et HBM4 8-Hi. Aucune décision finale n'est encore prise, la firme évalue plusieurs pistes en parallèle. Côté I/O, le scénario HBM4e viserait 14 à 16 Gbps, contre 11 à 12 Gbps pour un scénario HBM4 optimisé, à comparer à 8 à 11,7 Gbps aujourd'hui.
La raison de fond n'est pas un problème de design mais un problème d'approvisionnement. TrendForce anticipe une DRAM sous tension jusqu'en 2027, avec des livraisons de bits HBM qui ne progresseraient que de 50 à 60% en glissement annuel l'an prochain, un rythme jugé insuffisant pour absorber la demande IA. La contrainte se paie en compromis d'architecture : le nombre d'étages de stack HBM détermine, selon TrendForce, l'arbitrage entre capacité mémoire par GPU et nombre de GPU livrables.
Ce que la couverture ne dit pas encore, c'est quelle configuration sera in fine retenue pour la SKU grand public, ni comment les clients déjà engagés sur la version 12-Hi HBM4e verront leurs contrats ajustés. Les répartitions d'allocations entre Micron, SK hynix et Samsung sur HBM4 et HBM4e en 2027 restent également floues à ce stade. À prendre comme un signal fort, pas comme un plan produit arrêté.
À court terme, le pouvoir de négociation glisse mécaniquement du côté des fournisseurs mémoire, et les acheteurs IA qui bâtissaient leurs plans 2027 sur une hypothèse de 288 Go par GPU vont devoir recalibrer sur une base potentiellement inférieure.
Article original publié par theinformation.com
Lire l'article original →Titre original : The Information : Nvidia envisage un Rubin Ultra à mémoire réduite face à la pénurie de HBM