AWS Machine Learning Blog сообщает, что TorchServe больше не поддерживается, поэтому командам приходится самостоятельно отвечать за весь стек GPU-инференса. В публикации AWS описан Ray Serve Deep Learning Container как поддерживаемый и предварительно протестированный контейнер с уже собранными фреймворком, драйверами GPU и слоем обслуживания моделей.

Материал также показывает развёртывание мультимодальной модели, работающей с изображениями и языком, в Amazon EKS с использованием этого контейнера на одном узле с GPU. Источник не раскрывает детали конфигурации, результаты тестов или условия миграции.

Практический смысл для команд — возможность опираться на готовую комбинацию компонентов вместо самостоятельной сборки всего окружения. Это вывод из описания AWS, а не подтверждённый источником результат внедрения.