Der AWS Machine Learning Blog hat den ersten Teil einer Serie veröffentlicht, die sich mit der Vorbereitung von Daten für supervised fine-tuning befasst.

In dem Material werden Datenqualitätsprüfungen, das Dialog-Format JSONL, Denk- und Aufruf-Schemata sowie die Nutzung von Tools behandelt; außerdem wird die Aufteilung der Daten in Trainings- und Evaluierungsstichproben diskutiert.