Der Drop

OpenAI hat gerade 722 Mathe-Manuskripte auf GitHub gedroppt und behauptet, sie seien alle von einem einzigen geheimen KI-Modell aufgrund eines einzigen Prompts erstellt worden. Das Ganze hat absolute 'Vertrau mir, Bro'-Vibes, weil das Modell selbst unter Verschluss bleibt. Sie sagen, sie hätten dem Bot etwa 4.000 Aufgaben gestellt und die besten herausgepickt, was zu 372 'Familien' von Ergebnissen führte.

Die Skepsis

Real talk: Die Mathe-Community nimmt das nicht einfach so hin. Der MIT-Mathematiker Andrew Sutherland hat es 100 gehalten und gegenüber Scientific American erklärt, dass diese Ergebnisse im Grunde unbestätigt sind, solange das Modell nicht für öffentliche Tests freigegeben wird.

Nur 162 dieser Paper wurden von Lean überprüft, einer Software, die logische Schritte mechanisch verifiziert. Das bedeutet, dass etwa 78 % der Sammlung nicht offiziell geprüft wurden, und OpenAI hat sogar zugegeben, dass einiges von dem nicht formalisierten Zeug totaler Cap sein könnte.

Der Vibe-Check

Einige Akademiker bezeichnen das als 'sehr großen Tag', aber andere sind lowkey gestresst. Das Institute for Advanced Study wies darauf hin, dass wir in eine Ära eintreten, in der KI mathematische Argumente ausgeben kann, die Menschen nicht einmal verstehen oder verifizieren können – was für die Zukunft verantwortungsvoller Wissenschaft highkey beängstigend ist.

Außerdem sind die 'Issues' im Repository deaktiviert und keine PRs erlaubt, was ein massives L für die Zusammenarbeit ist. Während Anthropic kürzlich einen riesigen Beweis mit 13 Millionen Zeilen für alle sichtbar veröffentlicht hat, hält OpenAI an ihrer Geheimzutat fest.

Warum das wichtig ist

Wenn diese Technologie legitim ist, ist es ein massives W für die Fähigkeit von KI, mit komplexer Logik umzugehen. Aber so wie es jetzt ist, ist es meistens nur Hype. Bis OpenAI das Modell und die tatsächlichen Prompts veröffentlicht, ist das nur ein Haufen Dokumente, die noch nicht ganz bereit für die Primetime sind.