Le prochain ChatGPT pourrait avoir des compétences exceptionnelles en mathématiques. Du moins, c’est ce que laisse entendre OpenAI, qui vient de publier, d’un coup, un ensemble de 722 manuscrits. L’entreprise indique que, comme ses précédentes méthodes d’évaluation en mathématiques ont atteint un plateau, celle-ci évalue désormais ses nouveaux modèles en utilisant des problèmes ouverts. Et les 722 manuscrits publiés sur GitHub, regroupés en 372 familles, sont les résultats de ces travaux, sur un modèle d’IA qui n’est pas encore sorti.
“La grande majorité des résultats ont été obtenus selon la même procédure, à l’aide d’un modèle interne OpenAI non publié. En moyenne, chaque résultat a nécessité trois heures de calcul avec ChatGPT Pro et ce modèle”, explique également l’entreprise. Pour l’heure, ces découvertes n’ont pas encore été validées par la communauté scientifique. Mais, en tout cas, elles pourraient donner un aperçu des performances du prochain modèle de pointe d’OpenAI.
We’re releasing a broad range of new mathematical results produced by an internal frontier model.
We’ve been consulting with the independent Advisory Group on Mathematics and Artificial Intelligence at the Institute for Advanced Study, and we have drawn on their advice and…
— OpenAI (@OpenAI) October 6, 2026
OpenAI veut éviter de nouvelles polémiques en étant plus transparent
Tout en continuant à publier les résultats de ses modèles d’intelligence artificielle, OpenAI joue la carte de la prudence, afin d’éviter de nouvelles polémiques. En effet, en septembre, un groupe de mathématiciens avait dénoncé l’utilisation des problèmes mathématiques comme benchmark par les laboratoires d’IA, estimant que cela est “préjudiciable à la science des mathématiques.”
Aujourd’hui, l’entreprise s’appuie sur un groupe consultatif indépendant, appelé “Advisory Group on Mathematics and Artificial Intelligence”. Et pour les nouvelles publications, le créateur de ChatGPT indique qu’il a travaillé avec ce groupe consultatif pour “élaborer de bonnes pratiques”.
Les publications sur GitHub prennent en charge un protocole de révisions et de citations. OpenAI propose aussi des formalisations de certaines des preuves avancées par l’IA dans Lean, un outil qui facilite la vérification. “Afin de promouvoir la transparence et l’ouverture scientifiques, nous publions également dans le référentiel des informations supplémentaires sur la manière dont nous avons obtenu ces résultats. Il s’agit notamment de 10 résumés du raisonnement du modèle, d’estimations de la puissance de calcul utilisée en termes d’utilisation du forfait « Pro » sur ChatGPT, ainsi que de statistiques sur le nombre de problèmes traités”, indique aussi l’entreprise.