A NVIDIA apresentou o NeMo Switchyard — uma abordagem para distribuir cargas de trabalho de IA entre vários modelos. Isso é afirmado em uma publicação do NVIDIA Developer Blog de 11 de agosto de 2026.

De acordo com o sinopse da fonte, diferentes modelos diferem em pontos fortes e fracos, bem como em custo. Essas características podem variar dependendo da tarefa ou de uma etapa específica dentro de uma única tarefa.

Como exemplo, a NVIDIA cita uma sequência onde primeiro é necessária classificação, seguida de raciocínio, e para ações subsequentes rotinas um modelo menor é suficiente. A fonte é apresentada no formato de metadados, portanto, detalhes de implementação e resultados de uso permanecem em aberto.