NVIDIA a présenté Groq 3 LPX comme un accélérateur d'inférence pour des scénarios d'IA interactifs sur la plateforme NVIDIA Vera Rubin. Les documents de l'entreprise mentionnent également le système NVIDIA Vera Rubin NVL72.

Selon la description de NVIDIA, la plateforme est conçue pour un haut débit et une interactivité lors du traitement d'une large gamme de charges de travail IA, allant des petits aux grands modèles, y compris les modèles open source et propriétaires.

La portée pratique de cette annonce reste pour l'instant limitée: la source ne contient qu'un résumé éditorial, sans résultats de tests, comparaisons, paramètres de livraison ou confirmation indépendante.