No material «How XPUs Meet a World-Class AI Factory», a NVIDIA descreveu uma abordagem para a infraestrutura de fábricas de IA que operam continuamente. O foco central está no resultado da produção: velocidade de geração de tokens, número de tokens por watt, custo por token, utilização e tempo de atividade.

Segundo a exposição da NVIDIA, para essa economia, a infraestrutura deve ser projetada e construída como uma fábrica completa, e não como um conjunto de aceleradores individuais.

Isso é importante porque a comparação de chips individuais não mostra a eficiência total do sistema. No entanto, o material disponível é apresentado como metadados e um breve resumo da publicação; portanto, detalhes da arquitetura, lista de participantes e resultados práticos permanecem desconhecidos.