NVIDIA presentó NeMo Switchyard, un enfoque para distribuir las cargas de trabajo de IA entre varios modelos. Esto se señala en la publicación NVIDIA Developer Blog del 11 de agosto de 2026.

Según el resumen de la fuente, los diferentes modelos se diferencian por fortalezas y debilidades, así como por costo. Estas características pueden cambiar dependiendo de la tarea o de cada etapa de una sola tarea.

Como ejemplo, NVIDIA ofrece una secuencia en la que primero se realiza clasificación, luego razonamiento, y para las acciones subsiguientes habituales basta un modelo más pequeño. La fuente se presenta en formato de metadatos, por lo que los detalles de implementación y los resultados de uso siguen siendo desconocidos.