MarkTechPost hat einen Benchmark für Inferenz-APIs für Sprach- und Echtzeit-Agenten veröffentlicht. Im Mittelpunkt der Analyse steht die Time to First Token (TTFT), die von Teams häufig bei der Auswahl von APIs verwendet wird.

Der Beitrag betrachtet vier Schichten des Sprachstacks: Large Language Models, Spracherkennung, Sprachsynthese und Sprach-zu-Sprach-Verarbeitung. In der Beschreibung wird angegeben, dass die Kennzahlen mit den Primärquellen 30 August 2026 Jahre abgeglichen wurden, und die Herkunft jeder Zahl separat gekennzeichnet wurde.

Der Quellpaket enthält keine numerischen Ergebnisse, keine Liste der Teilnehmer oder eine Rangliste; Damit bestätigt es die methodische Abdeckung des Benchmarks, erlaubt es jedoch nicht, den schnellsten API zu benennen.