Nous Research a ajouté dans Hermes Desktop une configuration de modèle local en un seul clic. Selon le matériel MarkTechPost, l'application analyse l'équipement de l'utilisateur, fait correspondre le catalogue de modèles avec son processeur graphique, choisit la configuration la plus adaptée et la télécharge, puis configure llama.cpp.

Dans la description, une limite stricte de 4 bits et une fenêtre de contexte minimale de 64 milliers de tokens sont également indiquées. Cela signifie que l'automatisation s'applique non seulement au téléchargement du modèle, mais aussi à la présélection des variantes selon les contraintes matérielles.

La portée pratique du changement est de réduire les actions manuelles lors du démarrage d'un modèle local. Cependant, le paquet disponible ne contient qu'un synopsis des métadonnées d'une seule publication indépendante, il est donc inconnu quels modèles et quelles cartes graphiques sont pris en charge et comment l'application se comporte sur différentes configurations.