MarkTechPost опубликовал бенчмарк API вывода для голосовых и работающих в реальном времени агентов. В центре анализа — время до первого токена (TTFT), которое команды часто используют при выборе API.

Материал рассматривает четыре слоя голосового стека: большие языковые модели, распознавание речи, синтез речи и преобразование речи в речь. В описании сказано, что показатели сверялись с первичными источниками 30 августа 2026 года, а происхождение каждого числа отдельно обозначалось.

Пакет источника не содержит самих числовых результатов, списка участников или итогового рейтинга. Поэтому он подтверждает методологический охват бенчмарка, но не позволяет назвать наиболее быстрый API.