Nvidia met en production son accélérateur d'inférence Groq 3 LPX, Nebius premier client et SpaceX bascule sur Vera CPU
Résumé
Annoncé à Hot Chips 2026, le Groq 3 LPX de Nvidia entre en production pleine : jusqu'à 256 LPU par rack et 3 400 tokens/s sur Gemma 4 31B en contexte 100k selon Artificial Analysis, quatre fois Cerebras. Nebius Token Factory est le premier client, tandis que SpaceX bâtit sa prochaine architecture IA autour de Vera Rubin et déploie les CPU Vera pour l'orchestration.
Article original publié par siliconangle.com
Lire l'article original →Titre original : Nvidia met en production son accélérateur d'inférence Groq 3 LPX, Nebius premier client et SpaceX bascule sur Vera CPU