
OpenAI a présenté Jalapeño, sa première puce dédiée à l'inférence, c'est-à-dire à l'exécution de modèles d'IA déjà entraînés. La présentation a eu lieu lors de la conférence Hot Chips.
Selon les tests de SemiAnalysis rapportés par The Decoder, Jalapeño a démontré un débit et une efficacité énergétique supérieurs à ceux des puces Nvidia Blackwell et Rubin. OpenAI décrit également la puce comme étant plus rapide et plus économe en énergie pour les modèles actuels.
Pour OpenAI, cela signifie un contrôle potentiel sur une partie importante de l'infrastructure informatique. Cependant, les informations disponibles reposent sur des résumés de documents et non sur un ensemble complet de résultats publiés: la méthodologie, les configurations de test et les valeurs absolues des performances ne sont pas spécifiées.
commentaire éditorial
Pourquoi c’est important
Conséquence probable : un renforcement du contrôle d'OpenAI sur sa base de calcul et une réduction de la dépendance potentielle aux accélérateurs externes. Le premier signal vérifiable sera la publication de méthodologies détaillées et de mesures indépendantes. La principale incertitude concerne la mesure dans laquelle l'avantage revendiqué dépend de scénarios et de conditions de test spécifiques.