NVIDIA выпустила TensorRT Model Connect (TRTMC) в публичной предварительной версии. По данным MarkTechPost, проект с лицензией Apache-2.0 преобразует поддерживаемую контрольную точку из Hugging Face или локальный checkpoint в сквозной инференс TensorRT с помощью двух команд, без промежуточного экспорта в ONNX.

Сборка создаёт артефакт versioned.bundle, который запускается через нативные интерфейсы задач C++. В описанном сценарии PyTorch не входит в путь выполнения инференса.

Для контекста: снимок NVIDIA для GB300 от 29 июля 2026 года охватывает 105 профилей релизов и 76 семейств моделей. Источник не приводит данных о производительности TRTMC, совместимости всех моделей или сроках выхода из предварительной версии.