25 August hat OpenAI Jalapeño vollständig vorgestellt — seinen ersten Beschleuniger für KI-Aufgaben. Laut IEEE Spectrum AI, basierend auf den von OpenAI gemachten Leistungsangaben, liefert der Chip bis zu 13,4-Petaflop an Berechnungen im Format 4-Bit und arbeitet mit 232 Speicher, wobei Daten mit einer Geschwindigkeit von bis zu 15,4 pro Sekunde übertragen werden.

In denselben Tests reduzierte Jalapeño die Durchsatzlatenz auf 3,6-fach im Vergleich zu Nvidia GB300, das OpenAI derzeit verwendet, bei geringerem Energieverbrauch. Die Quelle präzisiert, dass die Durchsatzlatenz den Zeitraum von der Anfrage bis zur Ausgabe des letzten Tokens misst.

Der praktische Sinn der Behauptung besteht darin, dass OpenAI die Rechenhardware enger mit eigenen KI-Lasten verknüpfen kann. Im verfügbaren Material gibt es jedoch keine unabhängige Bestätigung der Ergebnisse, keine Details zur Testkonfiguration oder zu Plänen für eine Massenverbreitung des Chips.