NVIDIA представила NeMo Switchyard — подход к распределению рабочих нагрузок ИИ между несколькими моделями. Об этом говорится в публикации NVIDIA Developer Blog от 11 августа 2026 года.

Согласно синопсису источника, разные модели отличаются сильными и слабыми сторонами, а также стоимостью. Эти характеристики могут меняться в зависимости от задачи или отдельного этапа одной задачи.

В качестве примера NVIDIA приводит последовательность, где сначала требуется классификация, затем рассуждение, а для обычных последующих действий достаточно меньшей модели. Источник представлен в формате метаданных, поэтому подробности реализации и результаты использования остаются открытыми.