
GPT-6 Astra von OpenAI belegte den ersten Platz im ErdosBench – dem Test offener mathematischer Aufgaben. Dabei erklärte der Chief Scientist des Unternehmens, Jakub Paczoski, dass Mathematik kein Entwicklungspriorität war.
Nach der dargestellten Beschreibung investiert OpenAI Ressourcen in rekursives Selbstverbesserung und Forschung zur Ausrichtung von KI. Das Unternehmen beschreibt Astra auch als die leistungsstärkste OpenAI-Modell für fortgeschrittenes Denken, Computerarbeit, Textverarbeitung und Designbewertung.
Das ist wichtig, weil das Ergebnis die Diskrepanz zwischen den angegebenen Prioritäten der Entwicklung und der endgültigen Leistungsfähigkeit des Modells in einem einzelnen Bereich zeigt. Allerdings liegen die verfügbaren Materialien im Metadaten-Format vor und liefern keine Details zu Tests, dem Vergleich mit anderen Modellen oder den Gründen des Ergebnisses.
redaktioneller Kommentar
Warum es wichtig ist
Wahrscheinliche Folge ist ein verstärktes Interesse an Modellen mit ungleichmäßigen Fähigkeiten, die in einzelnen Bereichen die Erwartungen übertreffen. Als nächstes beobachtbares Signal wird das Auftreten von Testdetails oder einer unabhängigen Überprüfung des Ergebnisses sein. Wesentliche Unsicherheit besteht darin, dass im Paket der vollständige Text der Quellen und der Erhebungsmethode von ErdosBench fehlt.