github.com via Hacker News

OpenAI retire trois preuves mathématiques, erreur de signe

OpenAI ai-research

TL;DR

  • Trois manuscrits du dépôt openai/math ont été retirés le 7 octobre après qu'une erreur de signe dans la preuve sur les classes de Weil a invalidé l'argument de cancellation et deux preuves dépendantes.
  • Sur 719 manuscrits publiés par OpenAI, seuls 300 (42 %) sont accompagnés d'une preuve formelle vérifiée en Lean, les autres restant non formalisés.
  • Le mathématicien Andrew Sutherland (MIT) juge les revendications non vérifiables tant qu'OpenAI ne libère pas le modèle utilisé ni les prompts correspondants.

Une erreur de signe. Dans « Algebraicity of Weil classes on split abelian eightfolds », OpenAI reconnaît qu'elle « invalidates a stabilization-trace cancellation argument and the construction used by two dependent papers ». Les deux manuscrits visés, « Algebraicity of Kuga–Satake Correspondences for K3 Surfaces » et « The rational Hodge conjecture for products of K3 surfaces », sont retirés avec le premier.

Les trois textes portent désormais des notices de rétractation dans le dépôt openai/math, avec lien vers la version archivée. Quatorze autres manuscrits ont été révisés le même jour pour combler des lacunes de preuve, corriger des énoncés ou clarifier des hypothèses.

Le lot complet, mis en ligne la veille et déjà couvert dans notre alerte d'hier, compte désormais 719 manuscrits en 372 familles, dont 300 (42 %) accompagnés d'une preuve formelle vérifiée en Lean. Les autres restent non formalisés, et OpenAI a reconnu que certains pouvaient contenir des défauts.

Andrew Sutherland, mathématicien au MIT, résume le reproche de la communauté : « Until and unless they release the model and people can replicate their results, I think you should treat any claims about one-shotting problems with a single agent as unverified. » Le groupe consultatif associé au projet a réclamé les prompts et le coût de calcul par résultat ; OpenAI n'a fourni ni l'un ni l'autre, seulement une moyenne et dix résumés abrégés de raisonnement.