MarkTechPost a publié un guide pratique sur la création d'un modèle linguistique compact axé sur le raisonnement. Dans le processus décrit, il est utilisé le chargement en streaming du corpus SupraLabs avec Hugging Face.

Le guide comprend une filtration des données selon leur qualité et leur préparation pour le supervised fine-tuning — un fine-tuning supervisé sur des exemples étiquetés. La source présente cela comme un processus de travail complet, mais ne communique pas de publication d'un modèle entraîné spécifique.

L'intérêt pratique du matériel réside dans la séquence de préparation du corpus avant le fine-tuning. Étant donné que les informations disponibles ne présentent que sous forme de synopsis MarkTechPost, les résultats de l'entraînement, les caractéristiques du modèle et les comparaisons avec d'autres systèmes restent inconnus.