NVIDIA a présenté l'architecture Vera Rubin, conçue pour les tâches de post-entraînement des modèles d'intelligence artificielle. Selon le fabricant, la caractéristique clé de cette solution est d'atteindre le coût le plus bas par token grâce à l'application de méthodes de co-design extrême.

Cet indicateur devient la norme métrique centrale dans l'ère émergente de l'IA agentique, où l'efficacité des coûts influence directement l'évolutivité des systèmes intelligents. L'optimisation des dépenses liées au post-entraînement permet de déployer des modèles plus complexes avec le même budget.

Les informations présentées reposent exclusivement sur la méta-description du blog officiel de NVIDIA. À ce jour, il n'existe aucune confirmation indépendante des spécifications techniques ni de données détaillées sur les performances de cette nouvelle architecture provenant d'observateurs tiers.