L'entreprise NVIDIA a annoncé la technologie ModelExpress, conçue pour résoudre le problème du coût élevé du transfert de données dans l'infrastructure d'intelligence artificielle. À mesure que les points de contrôle des modèles atteignent des tailles de centaines de gigaoctets, voire un téraoctet, les dépenses associées à chaque octet de données transféré augmentent rapidement.

La situation est exacerbée par le fait que le déplacement des poids de ces modèles au sein d'un cluster de calcul est une opération extrêmement courante. Les méthodes de transfert traditionnelles deviennent un goulot d'étranglement lorsque les volumes de données atteignent de telles échelles, nécessitant de nouvelles approches pour la distribution des artefacts.

ModelExpress se positionne comme un outil capable de distribuer ces fichiers lourds à la vitesse de la lumière, en minimisant les latences inévitables lors de l'utilisation de protocoles réseau traditionnels dans des conditions de volumes d'information extrêmes.