OpenAI hat den Chip Jalapeño für schnelle Inferenz in großem Maßstab entwickelt, berichtet TechCrunch AI. Der Zusammenfassung des Mediums zufolge wurde der Chip im InferenceX-Benchmark von Semianalysis getestet.

Laut diesem Test zeigte Jalapeño mehr Tokens pro Benutzer und eine höhere Leistung pro Kilowatt als die damals verfügbaren, als fortschrittlich geltenden Lösungen.

Die praktische Bedeutung des Ergebnisses hängt von den Testbedingungen ab: Das verfügbare Material enthält keine numerischen Werte, keine Beschreibung der Vergleichskonfiguration und keine Bestätigung durch OpenAI. Daher spricht die Veröffentlichung derzeit lediglich von einem behaupteten Ergebnis einer einzigen Quelle und nicht von einer umfassend verifizierten Überlegenheit.