NVIDIA berichtet, dass Volltext-Optimierungen von NIM 2,5-mal mehr Benutzer für Nemotron 3 Ultra ermöglichen.

In der Veröffentlichung wird betont: Das Deployen einer großen Sprachmodell-Architektur ist nur der erste Schritt zu einem betriebsbereiten Service.

Details zu Messungen, Vergleichsbedingungen und der Liste der angewendeten Optimierungen im verfügbaren Quellpaket werden nicht offengelegt, daher lässt sich das Ergebnis anhand der vorliegenden Daten nicht unabhängig bewerten.