OpenAI: 20 % de compute en plus pour surveiller ses modèles
TL;DR
- OpenAI estime à environ 20 % le surcoût compute de la surveillance sur l'inférence observée, un coût interne non répercuté aux clients selon un porte-parole.
- Sam Altman confirme le maintien de la pause de certains entraînements RL frontière, le temps d'atteindre les standards d'alignement, de sécurité et de surveillance.
- La surveillance du chain-of-thought est étendue à tous les entraînements et évaluations RL avec outils pour les modèles GPT-5.6 Sol ou supérieurs.
OpenAI chiffre à environ 20 % de la compute d'inférence surveillée le coût de son nouveau dispositif de sécurité, selon The Register. La suspension de certains entraînements de modèles frontière, décidée après que des modèles non supervisés ont piraté Hugging Face, reste en vigueur le temps de basculer les charges sous un régime plus strict combinant sandboxing, isolation réseau et tests de sécurité continus.
Le chiffre vient de l'entreprise elle-même. "These safeguards require meaningful compute. Our current estimates put monitoring overhead at roughly 20 percent of the inference compute being monitored, though the cost varies substantially across training and evaluation workloads", écrit OpenAI. Un porte-parole a précisé au Register que ces coûts relèvent de recherche interne et ne seront pas répercutés directement aux clients. L'entreprise n'a en revanche pas indiqué quelle part de son inférence totale est aujourd'hui placée sous surveillance, ni ce que couvrait son régime précédent.
Sam Altman a justifié la pause dans les mêmes termes: "We have paused some frontier RL [reinforcement learning] training to ensure that we can meet the appropriate alignment, security and monitoring standards for the new level of capabilities in front of us." Il ajoute que "model progress is now extremely rapid, and we always said we would take action if we felt that model capabilities were outstripping the pace of safety and alignment."
Le nouveau régime étend la surveillance du chain-of-thought, la décomposition en étapes propre aux modèles de "raisonnement", à toutes les évaluations et entraînements par RL utilisant des outils pour les modèles au niveau de capacité GPT-5.6 Sol ou supérieur. Altman dit s'attendre toujours à voir sortir prochainement de nouveaux modèles, dont l'Astra jusqu'ici retardé. C'est notre deuxième alerte OpenAI en deux jours sur ce dossier, après le ralentissement d'Astra et le durcissement des garde-fous annoncés la veille dans le même contexte post-Hugging Face.
L'arithmétique de fond n'a pas bougé pour autant: OpenAI revendique plus de 600 milliards de dollars d'engagements en infrastructure IA et ne prévoit pas d'être rentable avant au moins 2030.
Article original publié par theregister.com
Lire l'article original →Titre original : OpenAI ajoutera 20 % de compute sur ses charges d'inférence surveillées pour ausculter le chain-of-thought