KI-generierte Beweise werden oft mit einem Prozess namens Formalisierung überprüft. OpenAI scheint einen subtilen Fehler begangen zu haben, als es seine Navier-Stokes-Problem-Beweise veröffentlichte, ein Team von Mathematikern behauptet. Der Fehler bedeutet nicht, dass die Beweise falsch sind oder dass OpenAI das Problem nicht korrekt gelöst hat, aber er wirft die Frage auf, ob von KI-Modellen generierte mathematische Ergebnisse immer vertraut werden können.
"Was bei all diesen von großen Sprachmodellen generierten Beweisen getan werden muss, ist, dass sie von Menschen gelesen werden müssen, und das schafft einen enormen zusätzlichen Aufwand für Mathematiker", sagt Anders Hansen an der University of Cambridge. Am 8. September verkündete OpenAI, es habe eine Lösung für das Navier-Stokes-Problem gefunden, eines der berühmtesten offenen Probleme der Mathematik. Es veröffentlichte den Beweis in zwei Versionen – einmal in "natürlicher Sprache“ und einmal in der Computercode Lean.
Das Problem, sagen Hansen und sein Team, ist, dass die beiden Beweise nicht übereinstimmen. "Dieser Formalisierungsprozess soll das Peer-Review ersetzen", sagt Teammitglied Fabian Circelli, ebenfalls an der University of Cambridge. "Peer-Review würde bedeuten, dass menschliche Augen die Beweise betrachten. Aber was wir in diesem Papier gezeigt haben, ist, dass diese Art der KI-auto-Formalisierung dieselbe Zweck nicht erfüllen kann."
Der spezifische Anspruch des Teams stützt sich auf Teile der Beweise, die Lemma 8.6 genannt werden. In der natürlichen Sprachversion erfordert eine Gleichung, dass ein Wert unter m + 4 liegt, während in der Lean-Version der entsprechende Wert unter m + 5 liegt, was mathematisch schwächer ist. OpenAI sagte dem New Scientist, es sei sich des Widerspruchs bewusst und dass dies nicht bedeutet, dass einer der Beweise ungültig ist.
Quelle: Hacker News · Zusammengefasst von HeadlinesBriefing