
GPT-6 Astra d'OpenAI a pris la première place sur ErdosBench, un test de problèmes mathématiques ouverts. Pourtant, le directeur scientifique de l'entreprise, Jakub Paczowski, a déclaré que les mathématiques n'étaient pas une priorité de développement.
Selon la description présentée, OpenAI oriente ses ressources vers l'auto-amélioration récursive et la recherche sur l'alignement de l'IA. L'entreprise décrit également Astra comme son modèle le plus puissant pour le raisonnement avancé, l'interaction avec les ordinateurs, la rédaction de textes et la conception.
Ceci est important car le résultat met en évidence un écart entre les priorités de développement annoncées et la performance finale du modèle dans un domaine spécifique. Cependant, les documents disponibles sont présentés sous forme de métadonnées et ne fournissent pas de détails sur les tests, la comparaison avec d'autres modèles ou les raisons de ce résultat.
commentaire éditorial
Pourquoi c’est important
Une conséquence probable est un intérêt accru pour les modèles aux capacités inégales, qui surpassent les attentes dans des domaines spécifiques. Le prochain signal observable sera l'apparition de détails sur les tests ou une vérification indépendante du résultat. Une incertitude substantielle subsiste car le dossier ne contient pas le texte intégral des sources ni la méthodologie d'ErdosBench.