Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

unite+1.scientificamerican+1.scientificamerican.Am Dienstag, den 6. Oktober, veröffentlichte OpenAI 722 mathematische Manuskripte in einem öffentlichen GitHub-Repository, sortiert in 372 sogenannte Ergebnisfamilien. Das Unternehmen gibt an, dass ein unveröffentlichtes internes Grenzmodell diese erstellt hat. Scientific American berichtete, dass das Repository um 18 Uhr EDT live ging. Mathematiker werden voraussichtlich Monate benötigen, um die Ergebnisse zu durcharbeiten und zu beurteilen, ob die Beweise neue Ideen enthalten oder hauptsächlich bestehende Techniken rekombinieren.openai+2
Die Veröffentlichung erfolgt einen Monat nachdem OpenAI am 8. September bekannt gab, dass dasselbe interne System bewiesen habe, dass dreidimensionale Navier-Stokes-Strömungen in endlicher Zeit Singularitäten entwickeln können. Dieses Problem ist eines der Millennium-Probleme des Clay Mathematics Institute. Die Navier-Stokes-Ankündigung hat anhaltende Kritik hinsichtlich der Anerkennung, Transparenz und der Geschwindigkeit, mit der das Unternehmen Ergebnisse veröffentlicht, auf sich gezogen.scientificamerican+2
Die Familien verteilen sich auf 17 Disziplinen, wobei theoretische Informatik, Kombinatorik, algebraische Geometrie und Zahlentheorie die meisten Einträge ausmachen. Der Katalog enthält behauptete Ergebnisse zum Irrationalitätsexponenten von Pi, den Mahler-Vermutungen, NP-Härte, der Isomorphie von freien Gruppenfaktoren und den relativistischen Vlasov-Maxwell-Gleichungen.interestingengineering+2
OpenAI veröffentlichte auch Lean-Formalisierungen vieler Beweise. Lean ist eine Programmiersprache, mit der ein Computer jeden logischen Schritt eines Beweises überprüfen kann. Nicht jedes Manuskript wurde jedoch formalisiert. Die README-Datei des Repositorys warnt, dass einige der nicht formalisierten Ergebnisse "Probleme haben könnten", und das Formalisierungsmanifest listet den Überprüfungsstatus als "ungeprüft".kingy+2
Das Unternehmen teilte mit, dass das Modell im Laufe der Evaluierung etwa 4.000 Probleme bearbeitet hat. Es hieß, das durchschnittliche Ergebnis habe eine Rechenleistung verbraucht, die "etwa drei Stunden Denkarbeit von ChatGPT Pro" entspricht. Zehn gekürzte Zusammenfassungen der Überlegungen des Modells sind enthalten. OpenAI legte keine Gesamtkosten, Token-Anzahlen oder einen öffentlichen Modellnamen offen.unite+2
OpenAI erklärte, die Veröffentlichung basiere auf Ratschlägen der unabhängigen Advisory Group on Mathematics and Artificial Intelligence, die am Institute for Advanced Study in Princeton, New Jersey, angesiedelt ist. Die Gruppe gab am 29. September Empfehlungen ab. Diese fordern Labore dazu auf, den Modellnamen, die verwendeten Prompts und die Rechenkosten für jedes Ergebnis zu veröffentlichen sowie Ergebnisse in Repositories zu hinterlegen, die nicht von einem KI-Labor kontrolliert werden. OpenAI veröffentlichte weder Prompts noch Rechenleistungsdaten pro Ergebnis. Ein Unternehmenssprecher sagte gegenüber Scientific American, dass OpenAI die Richtlinien ernst nehme, aber nicht an sie gebunden sei.scientificamerican+2
Der gleiche Sprecher sagte, dass fast jedes Ergebnis aus einem einzigen Prompt stammte, der an einen einzigen Agenten gegeben wurde, obwohl einige mehrere Versuche erfordert haben könnten.scientificamerican
"Wir sollten nach Belegen fragen", sagte Andrew Sutherland, Mathematiker am MIT, gegenüber Scientific American. Er sagte, Behauptungen über das Lösen von Problemen im ersten Anlauf sollten als unbestätigt betrachtet werden, bis das Modell veröffentlicht wird. Daniel Litt von der University of Toronto vertrat die gegenteilige Ansicht: "Für mich ist es eine gute Sache für die Mathematik".scientificamerican
OpenAI teilte mit, dass es Workshops und Konferenzen finanzieren wolle, um Mathematikern zu helfen, die KI-generierten Ergebnisse zu verstehen, und dass es daran arbeite, das Modell hinter den Ergebnissen "verantwortungsvoll zu veröffentlichen".openai