Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

unite+1.scientificamerican+1.scientificamerican.Mardi 6 octobre, OpenAI a publié 722 manuscrits mathématiques sur un dépôt GitHub public, classés en 372 "familles de résultats". L'entreprise affirme qu'ils ont été produits par un modèle de pointe interne non encore publié. Scientific American a rapporté que le dépôt a été mis en ligne à 18h00 EDT. Les mathématiciens auront probablement besoin de plusieurs mois pour examiner ces résultats et déterminer si les preuves contiennent de nouvelles idées ou si elles se contentent de recombiner des techniques existantes.openai+2
Cette publication intervient un mois après qu'OpenAI a annoncé, le 8 septembre, que le même système interne avait prouvé que les écoulements tridimensionnels de Navier-Stokes peuvent développer des singularités en temps fini. Ce problème est l'un des problèmes du prix du millénaire du Clay Mathematics Institute. L'annonce concernant Navier-Stokes a suscité des critiques persistantes sur la question du crédit, de la transparence et de la rapidité avec laquelle l'entreprise publie ses résultats.scientificamerican+2
Les familles couvrent 17 disciplines, l'informatique théorique, la combinatoire, la géométrie algébrique et la théorie des nombres représentant le plus grand nombre d'entrées. Le catalogue inclut des résultats revendiqués sur l'exposant d'irrationalité de pi, les conjectures de Mahler, la complexité NP-difficile, l'isomorphisme des facteurs de groupes libres et les équations relativistes de Vlasov-Maxwell.interestingengineering+2
OpenAI a également publié des formalisations Lean de nombreuses preuves. Lean est un langage de programmation qui permet à un ordinateur de vérifier chaque étape logique d'une preuve. Cependant, tous les manuscrits n'ont pas été formalisés. Le fichier README du dépôt avertit que certains résultats non formalisés "pourraient poser problème" et le manifeste de formalisation indique que leur statut de révision est "non vérifié".kingy+2
L'entreprise a déclaré que le modèle a tenté de résoudre environ 4 000 problèmes au cours de l'évaluation. Elle a précisé que le résultat moyen a nécessité une puissance de calcul équivalente à "environ trois heures de réflexion de ChatGPT Pro". Dix résumés abrégés du raisonnement du modèle sont inclus. OpenAI n'a pas divulgué le coût total en dollars, le nombre de jetons ou le nom public du modèle.unite+2
OpenAI a déclaré avoir structuré cette publication en suivant les conseils du groupe consultatif indépendant sur les mathématiques et l'intelligence artificielle, hébergé à l'Institute for Advanced Study de Princeton, dans le New Jersey. Le groupe a émis des recommandations le 29 septembre. Celles-ci demandent aux laboratoires de publier le nom du modèle, les prompts utilisés et le coût de calcul pour chaque résultat, ainsi que de déposer les résultats dans des dépôts non contrôlés par un laboratoire d'IA. OpenAI n'a pas publié les prompts ni les chiffres de calcul par résultat. Un porte-parole de l'entreprise a déclaré à Scientific American qu'OpenAI prend les directives au sérieux mais n'est pas tenu de les respecter.scientificamerican+2
Le même porte-parole a précisé que presque tous les résultats provenaient d'un seul prompt donné à un seul agent, bien que certains aient pu nécessiter plusieurs tentatives.scientificamerican
"Nous devrions demander des preuves", a déclaré Andrew Sutherland, mathématicien au MIT, à Scientific American. Il a ajouté que les affirmations concernant la résolution de problèmes en un seul essai devraient être traitées comme non vérifiées jusqu'à ce que le modèle soit publié. Daniel Litt, de l'Université de Toronto, a exprimé un avis opposé : "Pour moi, c'est une bonne chose pour les mathématiques".scientificamerican
OpenAI a annoncé son intention de financer des ateliers et des conférences visant à aider les mathématiciens à comprendre les résultats produits par l'IA, et travaille à "publier de manière responsable le modèle" qui les sous-tend.openai