
NVIDIA выпустила TensorRT Model Connect (TRTMC) в публичной предварительной версии. По данным MarkTechPost, проект с лицензией Apache-2.0 преобразует поддерживаемую контрольную точку из Hugging Face или локальный checkpoint в сквозной инференс TensorRT с помощью двух команд, без промежуточного экспорта в ONNX.
Сборка создаёт артефакт versioned.bundle, который запускается через нативные интерфейсы задач C++. В описанном сценарии PyTorch не входит в путь выполнения инференса.
Для контекста: снимок NVIDIA для GB300 от 29 июля 2026 года охватывает 105 профилей релизов и 76 семейств моделей. Источник не приводит данных о производительности TRTMC, совместимости всех моделей или сроках выхода из предварительной версии.
комментарий редакции
Что это значит
Вероятное последствие — упрощение перехода от контрольной точки к развёртыванию TensorRT для поддерживаемых моделей. Следующим наблюдаемым сигналом станут перечень совместимых архитектур и опубликованные измерения производительности. Существенная неопределённость сохраняется из-за предварительного статуса, одного источника и отсутствия первичной технической документации в представленном пакете.