A NVIDIA anunciou a tecnologia ModelExpress, criada para resolver o problema do alto custo de transferência de dados na infraestrutura de inteligência artificial. À medida que os checkpoints de modelos crescem para centenas de gigabytes ou até mesmo um terabyte, os custos por byte de dado movido aumentam rapidamente.

A situação é agravada pelo fato de que a movimentação dos pesos desses modelos dentro de um cluster de computação é uma operação extremamente comum. Os métodos tradicionais de transferência tornam-se um gargalo quando os volumes de dados atingem tais escalas, exigindo novas abordagens para a distribuição de artefatos.

O ModelExpress é posicionado como uma ferramenta capaz de distribuir esses arquivos pesados na velocidade da luz, minimizando as latências inevitáveis ao trabalhar com protocolos de rede tradicionais em condições de volumes extremos de informação.