KI-Beweise in der Mathematik: Warnungen, Proteste und Prüfungen
Die Leiden Declaration warnt vor Genauigkeitsverlust, Fields-Medaillenträger kritisieren KI-Unternehmen, und ein Human Audit prüft OpenAIs Navier-Stokes-Lösung.
Mit KI erstellt◆ Fakten auf einen Blick
- Die Leiden Declaration on Artificial Intelligence and Mathematics wurde im Juni 2026 veröffentlicht, entstand aus einem Workshop im September 2025 am Lorentz Center und wird von der International Mathematical Union unterstützt.
- Die Deklaration warnt, dass die Abhängigkeit von KI-generierten Beweisen Genauigkeit, Zuverlässigkeit und unabhängige Überprüfbarkeit mathematischer Forschung bedroht.
- 25 Fields-Medaillenträger haben einen offenen Brief unterzeichnet, der den Vorstoß von KI-Unternehmen kritisiert, berühmte mathematische Probleme als Demonstration von Modellfähigkeiten zu lösen.
- OpenAI hat am 8. September 2026 eine KI-generierte Lösung für das Navier-Stokes-Problem der Millennium-Preis-Probleme bekannt gegeben.
- Ein Human Audit der von OpenAI veröffentlichten KI-Beweise fand keinen bestätigten substanziellen mathematischen Fehler in den Hauptresultaten, wies aber auf Vorbehalte in Kapitel 8 und nur teilweise geprüfte Abhängigkeiten hin.
- DeepSeek-Prover erreichte auf dem Lean-4-miniF2F-Test eine Whole-Proof-Generierungsgenauigkeit von 46,3 % mit 64 Samples und übertraf GPT-4 (23,0 %).
Die Leiden Declaration (Juni 2026) warnt, dass KI-generierte Beweise Genauigkeit, Zuverlässigkeit und unabhängige Überprüfbarkeit mathematischer Forschung bedrohen; die wachsende Beteiligung von KI-Unternehmen könne Forschungsagenden verzerren und Forscher ohne Zugang benachteiligen. 25 Fields-Medaillenträger kritisieren, dass KI-Unternehmen berühmte Probleme nur als Demonstrationsobjekte lösen, ohne das konzeptuelle Verständnis zu fördern, das für die Entwicklung neuer Ideen und die Weitergabe von Wissen entscheidend ist – der Prozess zählt, nicht nur das Ergebnis. OpenAI meldete am 8. September 2026 eine KI-Lösung des Navier-Stokes-Problems; die Debatte dreht sich um Kreditverteilung und die Frage, ob Mathematik nur aus Ergebnissen besteht. Ein Human Audit fand keinen bestätigten substanziellen Fehler, aber Vorbehalte: Kapitel 8 benötigt Überarbeitung, und nur teilweise geprüfte Abhängigkeiten schränken die Verlässlichkeit ein. DeepSeek-Prover (46,3 % Whole-Proof-Genauigkeit, 5 FIMO-Beweise) und AlphaProof/AlphaGeometry 2 (Silbermedaillen-Niveau, aber manuelle Formalisierung und lange Rechenzeit) zeigen Fortschritte bei formalen Beweisen.



