Das Unternehmen NVIDIA hat die Technologie ModelExpress angekündigt, die entwickelt wurde, um das Problem der hohen Kosten für die Datenübertragung in der Infrastruktur für künstliche Intelligenz zu lösen. Da die Kontrollpunkte von Modellen auf Hunderte von Gigabyte oder sogar einen Terabyte anwachsen, steigen die Kosten für jedes übertragene Byte Daten rapide an.

Die Situation wird dadurch verschärft, dass die Verschiebung dieser Modellgewichte innerhalb eines Rechenclusters eine äußerst häufige Operation ist. Traditionelle Übertragungsmethoden werden zum Engpass, sobald die Datenvolumina solche Ausmaße erreichen, was neue Ansätze für die Verteilung von Artefakten erfordert.

ModelExpress positioniert sich als ein Werkzeug, das in der Lage ist, diese schweren Dateien mit Lichtgeschwindigkeit zu verteilen und dabei die Latenzen zu minimieren, die bei der Arbeit mit traditionellen Netzwerkprotokollen unter Bedingungen extremer Informationsmengen unvermeidlich sind.