OpenAI a révélé des solutions à plusieurs problèmes mathématiques anciens, produits par un modèle en développement non publié dans un lot de 722 manuscrits, couvrant 372 familles de résultats regroupant des travaux connexes. Cela prolonge une série de percées qui ont impressionné mais aussi intrigué certains membres de la communauté mathématique, tout en soulevant des questions concernant l’éthique de la recherche et les pratiques académiques. Selon AGMAI, le nouveau groupe consultatif indépendant composé de mathématiciens éminents formé pour travailler sur la communication responsable des résultats, inclut des solutions à “centaines” de questions ouvertes.
Les résultats étaient attendus depuis des semaines, bien que jusqu’à présent OpenAI n’ait pas fourni de détails sur les problèmes résolus par le modèle ou sur le moment exact où ceux-ci seraient publiés. En septembre, l’entreprise a déclaré que son modèle avait « résolu plus de 100 problèmes ouverts depuis longtemps dans la plupart des domaines des mathématiques ». Les articles publiés et autres détails incluent également des résumés de la logique du modèle, des estimations du calcul utilisé et des statistiques concernant le nombre de problèmes tentés. OpenAI affirme que « le résultat moyen » a nécessité l’équivalent de trois heures de pensée avec ChatGPT Pro.
AGMAI, ou le groupe consultatif sur les mathématiques et l’intelligence artificielle publié Ses premières recommandations ont été publiées à la fin du mois de septembre, invitant les laboratoires d’IA à rendre les résultats mathématiques disponibles rapidement et via des canaux académiques établis, si possible, tout en divulguant des détails tels que le nom du modèle utilisé, les prompts et les coûts de calcul. Le groupe a également exhorté les entreprises d’IA à « ne pas traiter la diffusion des résultats mathématiques comme un moyen de marketing pour promouvoir leurs modèles », une pratique qui, selon eux, cause des dommages importants à la communauté mathématique.
Voici comment OpenAI a décrit son processus pour cette version :
Pour cette version, nous publions les résultats dans un dépôt GitHub, avec des protocoles pour les révisions et les citations des articles. Nous continuons à explorer d’autres alternatives proposées par la communauté pour cette version, qui respectent les directives du comité. Pour les versions futures, nous nous engageons à améliorer davantage la qualité des articles grâce aux citations, à l’exposé mathématique et à la présentation des résultats, afin d’en faciliter la compréhension.
L’impact complet des résultats risque de prendre du temps à se faire sentir, car les mathématiciens doivent les évaluer et les assimiler. Ils s’ajoutent à un ensemble de résultats mathématiques en croissance rapide provenant d’OpenAI et de laboratoires concurrents comme Anthropic, que le domaine est encore en train de traiter, y compris des résultats concernant le problème du Prix Millennium, l’un des questions ouvertes les plus célèbres dans ce domaine. La vitesse à laquelle les laboratoires d’IA ont pénétré dans cette discipline cette année — en particulier leur manière de gérer les annonces — a provoqué un débat intense sur les pratiques de recherche, l’éthique et la manière dont les entreprises attribuent aux mathématiciens humains dont le travail est utilisé par leurs systèmes pour produire des résultats.
Suivez les sujets et les auteurs de cette histoire pour voir davantage de contenu similaire sur votre flux de page d’accueil personnalisée, et pour recevoir des mises à jour par e-mail.