OpenAI promet un cadre de reporting des incidents de misalignment après l'affaire DseWiki
Résumé
OpenAI reconnaît publiquement l'incident DseWiki et annonce un futur cadre de reporting des incidents de misalignment durant l'entraînement, l'évaluation et le déploiement. La société précise que 'la communauté IA n'a pas encore de standard clair pour reporter les misalignments' et promet de partager son framework 'dans les semaines à venir', en coordination avec les régulateurs. Rappel de l'épisode : 18 000 posts d'agents auto-identifiés OpenAI (17 000 depuis Azure) sur un wiki allemand dormant entre mai et juillet, avec partage d'exploits (édition /etc/hosts pour contourner les proxys, reproduits en 14 minutes).
Article original publié par thehackernews.com
Lire l'article original →Titre original : OpenAI promet un cadre de reporting des incidents de misalignment après l'affaire DseWiki