OpenAI conçoit Jalapeño en 20 mois avec ses LLM et Broadcom
TL;DR
- Le premier silicium de Jalapeño arrive 20 mois après le concept, avec neuf mois entre RTL et tape-out et moins de cent ingénieurs.
- Un modèle interne a fait passer un kernel d'attention DeepSeek de 0,31 % à 88,94 % du plafond théorique en environ 40 heures.
- Broadcom prend le back-end physique à partir du gate-level, ce qui laisse OpenAI dépendant du partenaire pour porter la puce jusqu'au silicium.
OpenAI a livré son premier accélérateur maison, baptisé Jalapeño, en moins de 20 mois entre le concept d'architecture et le premier silicium, dont neuf mois seulement entre le RTL et le tape-out, rapporte IEEE Spectrum. L'équipe qui a conçu la puce comptait en moyenne moins de cent personnes sur toute la durée du projet.
Sur le papier, Jalapeño délivre jusqu'à 13,4 pétaflops en calcul 4 bits, embarque 232 gigaoctets de HBM4 attaqués à 15,4 téraoctets par seconde, et réduit la latence bout-en-bout jusqu'à 3,6 fois face au GB300 de Nvidia. Ces chiffres sont ceux d'OpenAI, pas d'un tiers indépendant.
Ce qui rend le projet inhabituel, c'est l'emploi des propres modèles de la maison à l'intérieur du flot de conception. L'équipe a couplé Accelerated Hardware Synthesis (XLS), un outil open source de Google, à des LLM internes, dont des « précurseurs de GPT-6 Astra ». « L'IA était bien meilleure sur les choses qui ressemblent à du logiciel », explique Chris Leary, membre du staff technique chez OpenAI, avant d'ajouter que « XLS ressemble d'une certaine façon à du logiciel, il a bénéficié de cet avantage ». Résultat cité : une réduction de 10 % de la surface des unités de multiplication matricielle.
Le saut le plus visible est venu côté logiciel. Quand les premiers silicium sont revenus en mai, un modèle interne a fait grimper la performance sur le kernel d'attention multi-head latent de DeepSeek de 0,31 % à 88,94 % du plafond théorique, en une quarantaine d'heures.
Richard Ho, VP hardware d'OpenAI, désamorce le récit du chip designer autonome. « Les modèles donnent des super-pouvoirs à nos ingénieurs », dit-il, avant de préciser que « nos ingénieurs pilotent toujours le travail. Ils sont l'arbitre final ». Il concède aussi : « Nous ne disons pas que n'importe qui peut construire un accélérateur à l'état de l'art avec juste le Codex d'OpenAI. »
Reste le non-dit industriel : Broadcom prend en charge toute l'implémentation physique à partir du niveau porte, et c'est le partenaire qui porte la puce jusqu'au silicium. Ho projette néanmoins la suite : « Astra et les modèles suivants seront très bons en conception de puce. » L'annonce s'inscrit dans un tempo d'infra soutenu chez OpenAI, qui a présenté à ses prêteurs des projections de 856 Md$ de dépenses compute d'ici 2030.
Article original publié par spectrum.ieee.org
Lire l'article original →Titre original : IEEE Spectrum: OpenAI a co-designé son ASIC Jalapeño en 20 mois avec ses propres LLMs, -10 % de surface