NVIDIA hat TensorRT Model Connect (TRTMC) in der öffentlichen Vorabversion veröffentlicht. Nach MarkTechPost handelt es sich bei dem Projekt mit der Apache-Lizenz-2.0 darum, eine unterstützte Checkpoint von Hugging Face oder einen lokalen Checkpoint in eine durchgehende TensorRT-Inferenz zu überführen und dies mit zwei Befehlen zu erreichen, ohne einen Zwischenaus-Export nach ONNX zu benötigen.

Der Build erzeugt einen Artefakt versioned.bundle, der über native Task Interfaces in C++ läuft. In dem beschriebenen Ausführungsweg ist PyTorch nicht beteiligt.

Zum Kontext: Das NVIDIA-Snapshot für GB300 vom 29 Juli 2026 umfasst 105 Release-Profile und 76 Modellfamilien. Die Quelle führt keine Leistungsdaten, keine Kompatibilitätsangaben aller Modelle oder Zeitrahmen für den Ausstieg aus der Vorabversion auf.