OpenAI a annoncé la publication d’une vaste collection de travaux de recherche en mathématiques produits par un modèle interne non commercialisé, alors que l’entreprise cherche à « améliorer » la manière dont elle partage ses résultats avec la communauté mathématique au sens large.
Dans un dépôt GitHub publié mardi, l’entreprise a indiqué que la collection comprenait 722 manuscrits regroupés en 372 familles de résultats apparentés, couvrant des domaines allant des corrélations ordinaires à deux points de fonctions multiplicatives au système de Vlasov-Maxwell. OpenAI a précisé que les résultats se trouvaient à différents stades de vérification et que certains travaux dépourvus de preuves formelles pourraient contenir des erreurs.
Le modèle a traité environ 4 000 problèmes, chaque résultat mobilisant en moyenne l’équivalent d’environ trois heures de temps de réflexion de ChatGPT Pro, a ajouté l’entreprise. La plupart des travaux ont suivi la même procédure, bien que certains résultats aient été traités séparément, notamment une région sans zéros pour la fonction zêta de Riemann et une preuve de la conjecture de Hodge pour les variétés abéliennes CM.
« Nous voulons donner directement aux scientifiques les moyens de disposer de capacités de pointe et nous travaillons à publier de manière responsable le modèle qui a produit ces résultats », a déclaré l’entreprise dans une déclaration. « C’est pourquoi il est important de continuer à évaluer nos modèles internes de pointe en mathématiques et dans d’autres disciplines scientifiques, afin d’accélérer le développement des outils permettant de faire progresser ces domaines. »
OpenAI a indiqué avoir préparé cette publication avec la contribution du groupe consultatif indépendant sur les mathématiques et l’intelligence artificielle de l’Institute for Advanced Study. Le dépôt comprend également des formalisations Lean de nombreuses preuves, ainsi que 10 résumés abrégés du raisonnement du modèle.
Cette publication fait suite à l’annonce de l’entreprise le mois dernier selon laquelle environ 10 000 agents d’IA avaient travaillé sur le problème de l’existence et de la régularité de Navier-Stokes.
Cette annonce a déclenché un différend avec Tristan Buckmaster, professeur à NYU, qui a affirmé qu’OpenAI avait agi trop rapidement après qu’il eut utilisé Codex avec le mathématicien d’Anthropic Levent Alpöge alors qu’ils travaillaient sur le problème. OpenAI a déclaré qu’elle ne pouvait pas exclure que des données désidentifiées issues de leur utilisation de ses produits aient contribué à l’amélioration des modèles. L’entreprise a également indiqué qu’elle ne solliciterait pas le prix Clay du millénaire, doté de 1 million de dollars.
