NVIDIA lanzó TensorRT Model Connect (TRTMC) en versión preliminar pública. Según datos de MarkTechPost, este proyecto con licencia Apache-2.0 convierte un punto de control compatible de Hugging Face o un checkpoint local en una inferencia completa de TensorRT mediante dos comandos, sin necesidad de una exportación intermedia a ONNX.

La compilación genera un artefacto llamado versioned.bundle, que se ejecuta a través de interfaces nativas de tareas en C++. En el escenario descrito, PyTorch no forma parte de la ruta de ejecución de la inferencia.

Como contexto: una instantánea de NVIDIA para GB300 del 29 de julio de 2026 abarca 105 perfiles de lanzamiento y 76 familias de modelos. La fuente no proporciona datos sobre el rendimiento de TRTMC, la compatibilidad con todos los modelos ni las fechas para salir de la versión preliminar.