KI-Beweise von OpenAI: Nur 162 von 722 Arbeiten formal abgesichert
Veröffentlicht am: 08.10.2026 um 19:35 Uhr | Redaktion boerse-global.de
Die Vereinigung Association for Human Mathematics (AHM) hat scharfe Kritik an OpenAI geübt und Wissenschaftler aufgerufen, die Zusammenarbeit mit dem KI-Unternehmen einzustellen. Anlass ist die Veröffentlichung von Hunderten KI-generierten Lösungsvorschlägen für mathematische Probleme, die OpenAI am Vortag ohne vorherige Absprache publik gemacht hatte.
In einer Stellungnahme, die am 7. Oktober 2026 als Gastbeitrag auf dem Blog des Mathematikers Terence Tao erschien, bezeichnete die Vereinigung den Schritt als Demonstration von Macht statt Wissenschaft und sprach von einer völligen Missachtung wissenschaftlicher Forschungsnormen.
Kritik an Veröffentlichungspraxis und Missachtung von Gremien
Die im September 2026 gegründete AHM, die über 800 Mitglieder zählt – andere Angaben sprechen von 752 Mitgliedern – und der unter anderem Fields-Medaillen-Preisträger Peter Scholze angehört, formulierte deutliche Vorwürfe. Mathematiker hätten diese Arbeiten nicht angefragt.
Dennoch lägen die Kosten und der Aufwand für die Überprüfung der Ergebnisse nun bei Universitäten und Forschenden, während OpenAI lediglich die Rechenleistung für die Erzeugung aufgewendet habe. Die Vereinigung stellte allerdings weder die formale Richtigkeit der Beweise in Abrede noch verband sie ihren Boykottaufruf mit Sanktionen oder Fristen.
Zudem warf die AHM dem Unternehmen vor, zentrale Leitlinien der beratenden Fachgruppe Advisory Group on Mathematics and Artificial Intelligence (AGMAI) am Institute for Advanced Study ignoriert zu haben.
Das Gremium hatte gefordert, fortgeschrittene Probleme nicht von internen KI-Modellen bearbeiten zu lassen. Die AHM-Kritik fällt in eine Phase, in der sich OpenAI parallel mit Klagen wegen Plagiats, Urheberrechtsverletzungen und Markenverwässerung auseinandersetzen muss.
Wer sich mit dem Einsatz von KI-Systemen befasst, muss heute komplexe rechtliche Rahmenbedingungen wie den EU AI Act beachten. Dieser kostenlose Umsetzungsleitfaden bietet Unternehmen einen kompakten Überblick über alle Anforderungen, Pflichten und Fristen. EU AI Act in 5 Schritten verstehen: Fristen, Pflichten und Risikoklassen kompakt erklärt
Hundertfache Manuskripte und geringe Prüfquote
OpenAI hatte am 6. Oktober 2026 mehr als 300 KI-generierte Lösungen zu mathematischen Problemen auf der Plattform GitHub unter der Apache-2.0-Lizenz bereitgestellt. Der Datensatz umfasst 722 Manuskripte zu über 370 Resultatfamilien; abweichende Zählungen nennen 719 Manuskripte nach dem Rückzug von drei Papieren sowie 372 Ergebnisgruppen.
Die Arbeiten stammen von einem unveröffentlichten internen Modell. Nach Unternehmensangaben bearbeitete das System rund 4000 Aufgaben, wobei knapp ein Zehntel eine ausreichende Signifikanz für den Katalog erreichte.
Pro Ergebnis fielen im Schnitt rund drei Stunden ChatGPT-Pro-Denkzeit an. Nahezu das gesamte Material soll laut einem Unternehmenssprecher auf einem einzigen Prompt an einen Agenten beruhen; genaue Prompts wurden jedoch nicht veröffentlicht.
Die formale Absicherung der Ergebnisse gilt in der Fachwelt als lückenhaft. Zwar gab OpenAI an, die Mehrzahl der Beweise sei in der formalen Beweissprache Lean verifiziert worden, Auswertungen des Repositoriums zeigen jedoch, dass lediglich 162 der 722 Veröffentlichungen – rund 22 Prozent – über ein formalisiertes Hauptergebnis verfügen.
Rund 78 Prozent der Arbeiten besitzen keinen computergestützten Hauptbeweis. OpenAI räumte selbst ein, dass unformalisierte Ergebnisse Fehler aufweisen könnten, und kündigte an, Verifikationen nachzuholen.
Die rechtssichere Dokumentation von KI-Systemen wird für Organisationen und Fachverantwortliche zunehmend zur Pflicht. Welche Systeme als Hochrisiko gelten und was jetzt konkret zu tun ist, erfahren Sie in diesem kostenlosen Report. Kostenlosen Umsetzungsleitfaden zum EU AI Act jetzt herunterladen
Die vorgestellten Arbeiten berühren anspruchsvolle Themenfelder wie Zahlentheorie, Gruppentheorie, Differenzialgeometrie und theoretische Informatik. Beansprucht werden unter anderem Fortschritte im Umfeld der Riemann-Vermutung, der Hodge-Vermutung sowie Beweisvorschläge für Teilaspekte weiterer ungelöster Probleme. Bislang hat keines der Dokumente ein klassisches Begutachtungsverfahren durchlaufen.
Geteilte Reaktionen in der Wissenschaft
In der mathematischen Gemeinschaft sorgt das Vorgehen für gespaltene Reaktionen. Forschende wie Peter Scholze sprachen mit Blick auf das schiere Volumen und die thematische Bandbreite von einer Bombe, mahnten jedoch Geduld bei der Detailbewertung an.
Andere Fachvertreter bezeichneten das Vorgehen als PR-Aktion oder wiesen auf methodische Schwächen und unzureichende Zitationen in einzelnen Manuskripten hin. Die AGMAI stellte klar, dass ihre beratende Funktion keine Billigung der Veröffentlichung bedeute, und forderte weitergehende Transparenz zu Modellen, Rechenkosten und Rechenschritten.
