OpenAI a développé la puce Jalapeño pour une inférence rapide à grande échelle, rapporte TechCrunch AI. Selon le résumé de la publication, la puce a été testée sur le benchmark InferenceX de Semianalysis.

Selon ce test, Jalapeño a affiché plus de jetons par utilisateur et une performance par kilowatt supérieure à celle des solutions disponibles à l'époque, considérées comme les plus avancées.

La portée pratique de ce résultat dépend des conditions de test: le document disponible ne contient ni chiffres précis, ni description de la configuration comparée, ni confirmation de la part d'OpenAI. Par conséquent, la publication évoque pour l'instant un résultat revendiqué par une seule source, et non une supériorité pleinement vérifiée.