OpenAI hat unerwartet ein Archiv von 722 wissenschaftlichen Arbeiten auf GitHub veröffentlicht, die Lösungen für 372 komplexe mathematische Probleme enthalten. Dieses Archiv umfasst fundamentale Mathematik, theoretische Informatik und mathematische Physik und demonstriert ein beispielloses Maß an Autonomie moderner neuronaler Netze. Laut Angaben der Entwickler wurden all diese umfangreichen Arbeiten von einem neuen, noch nicht veröffentlichten fortschrittlichen KI-Modell als Reaktion auf nur einen einzigen Prompt mit Hinweisen generiert.

Technische Generierungsdetails und automatisierte Verifizierung

Der technischen Dokumentation zufolge testete das Modell rund 4000 Aufgaben, wobei die Erstellung einer erfolgreichen Lösung im Durchschnitt etwa drei Rechenstunden auf ChatGPT Pro-Niveau erforderte. Damit die wissenschaftliche Gemeinschaft die Korrektheit solcher komplexen Berechnungen objektiv bewerten kann, fügten die Entwickler formalisierte Beweise in der spezialisierten Programmiersprache Lean bei. Die Verwendung von Lean ermöglicht es Algorithmen und mathematischen Programmen Dritter, die Logik und Korrektheit jedes einzelnen Beweisschritts automatisch zu überprüfen, ohne manuelles Durchsuchen.

Widersprüchliche Daten

Trotz technischer Innovationen und formaler Beweise in Lean begegnete die akademische und wissenschaftliche Gemeinschaft den Behauptungen von OpenAI mit erheblichem Skeptizismus. Der Hauptknackpunkt war, dass das Unternehmen externen Forschern nach wie vor keinen direkten Zugriff auf das Modell selbst gewährt hat, um die Ergebnisse unabhängig zu reproduzieren. Mathematiker weisen darauf hin, dass ohne offene Tests die Behauptungen über das Lösen hunderter komplexer Probleme mit nur einem einzigen Prompt nicht verifizierbar bleiben. Darüber hinaus kritisieren Experten das Fehlen detaillierter Daten zur genauen Rechenzeit für jeden Einzelfall und die vollständige Verschleierung des genauen Textes der Quell-Prompts.

Konsequenzen für die Wissenschaft und Perspektiven

Die Situation um die Veröffentlichung des OpenAI-Archivs hat langjährige Diskussionen über die Transparenz kommerzieller Entwicklungen im Bereich der künstlichen Intelligenz verschärft. Einerseits eröffnet die Demonstration der Fähigkeiten zur automatisierten Problemlösung grandiose Perspektiven für die Grundlagenwissenschaft und die Beschleunigung des technologischen Fortschritts. Andererseits befürchten Wissenschaftler zu Recht die Abgeschlossenheit großer Tech-Player, die verlangen, dass ihren Errungenschaften blind geglaubt wird. Experten sind sich einig, dass ein echter Durchbruch in der Mathematik durch KI ein offenes Ökosystem erfordert, in dem unabhängige Forscher jede Phase der Datenerstellung prüfen und gegenchecken können.