Le blog AWS Machine Learning a décrit la configuration d'une passerelle LiteLLM gérée par le client sur Amazon ECS avec AWS Fargate. La passerelle se connecte au modèle OpenAI dans Amazon Bedrock, et Codex achemine les requêtes via l'API Responses.

La configuration décrite prévoit des identités distinctes, des budgets, des limites de requêtes et de la télémétrie. Le document compare également cette approche à un accès direct via IAM Identity Center et à un déploiement géré par Portkey.

L'importance pratique du schéma réside dans le contrôle centralisé de l'utilisation de Codex et du modèle connecté. Cependant, la source est présentée sous forme de métadonnées et de description sommaire par AWS; il n'existe donc ni confirmation indépendante, ni données de performance, ni calculs de coûts.