siliconangle.com détecté sur le web

Nvidia met en production son accélérateur d'inférence Groq 3 LPX, Nebius premier client et SpaceX bascule sur Vera CPU

Résumé

Annoncé à Hot Chips 2026, le Groq 3 LPX de Nvidia entre en production pleine : jusqu'à 256 LPU par rack et 3 400 tokens/s sur Gemma 4 31B en contexte 100k selon Artificial Analysis, quatre fois Cerebras. Nebius Token Factory est le premier client, tandis que SpaceX bâtit sa prochaine architecture IA autour de Vera Rubin et déploie les CPU Vera pour l'orchestration.