OpenAI ouvre ses modèles aux évaluateurs dès l'entraînement
TL;DR
- OpenAI dit vouloir laisser des groupes tiers auditer ses modèles pendant l'entraînement et l'évaluation, plus seulement avant lancement.
- Discussions engagées avec METR et Redwood Research, mais aucun partenaire nommé et aucune condition d'accès fixée.
- Anthropic paie Accenture au moins 1 Md$ sur cinq ans pour intégrer ses évaluateurs, contraste marqué avec le vague d'OpenAI.
OpenAI dit qu'il laissera des groupes tiers mener des évaluations techniques de sécurité pendant l'entraînement et l'évaluation de ses modèles, pas seulement avant leur lancement, et discute avec METR et Redwood Research. Aucun partenaire n'est nommé, aucune condition d'accès n'est fixée, écrit The Next Web après une avance de Bloomberg mardi.
Dix jours plus tôt, la promesse était plus concrète. Sam Altman avait évoqué un accès de niveau salarié pour les évaluateurs, avec « desks, badges and laptops » et un droit de publication. Le billet publié cette semaine se limite à évoquer une venue dans les bureaux « for the most sensitive work ».
Lama Ahmad, qui pilote le travail d'OpenAI avec les experts en sécurité extérieurs, « said it is talking to organisations it has and has not used before ». Le laboratoire liste quatre priorités : « independence mechanisms, scientific rigour, security practices and clear responsibilities ». Rien sur le financement, rien sur les échéances.
Le contraste avec Anthropic est net. La semaine dernière, le concurrent d'OpenAI a annoncé qu'il embarquerait des évaluateurs d'Accenture, en « paying the company evaluating it at least $1B over five years », tout en reconnaissant dans la même annonce que « the money should come from pooled or government sources because neither exists yet ». OpenAI laisse la question ouverte.
Le calendrier n'est pas neutre. Depuis août 2025, l'article 55 du règlement européen sur l'IA impose aux fournisseurs de modèles à usage général présentant un risque systémique de mener des tests adverses standardisés, aux côtés d'obligations de cybersécurité et de report d'incidents. Cette annonce s'ajoute à une longue file de dépêches OpenAI tracées ces trois derniers mois où le curseur gouvernance bouge en même temps que les procès et les fuites.
Article original publié par thenextweb.com
Lire l'article original →Titre original : OpenAI publie ses principes pour ouvrir ses modèles aux évaluateurs tiers dès la phase d'entraînement