NVIDIA hat NeMo Switchyard vorgestellt – einen Ansatz zur Verteilung von KI-Arbeitslasten zwischen mehreren Modellen. Erwartet laut NVIDIA Developer Blog vom 11. August 2026.

Laut Synopsis des Sources unterscheiden sich verschiedene Modelle in Stärken und Schwächen sowie Kosten. Diese Eigenschaften können sich je nach Aufgabe oder einzelnen Phase einer Aufgabe ändern.

Als Beispiel nennt NVIDIA eine Sequenz, in der zunächst eine Klassifikation erforderlich ist, danach eine Begründung, und für gewöhnliche nachfolgende Aktionen genügt ein kleineres Modell. Da der Source im Format von Metadaten vorliegt, bleiben Details zur Implementierung und Ergebnisse der Nutzung offen.