
GPT-4o hat die Marketing-Aufgabenbewertungen in einem Experiment mit 1 053 Studierenden der Bocconi University um fast einen Punkt auf der Fünf-Punkte-Skala erhöht. The Decoder berichtet darüber.
Dabei wird in der Beschreibung des Experiments nicht angegeben, ob die Forscher tatsächlich überprüft haben, was die Studierenden gelernt haben. Daher entspricht eine höhere Note in diesem Fall nicht einem belegten Anstieg des Wissens.
Der Decoder verweist außerdem auf weitere Studien, wonach das Erledigen von Aufgaben mit KI ohne eigenständiges Denken langfristig schädlich ist. Im vorliegenden Paket finden sich keine Details zu diesen Studien, daher erfordert diese Behauptung eine separate Prüfung.
redaktioneller Kommentar
Warum es wichtig ist
Wahrscheinliche Folge ist eine Zunahme von Debatten darüber, was Bildungsbewertungen tatsächlich messen, wenn KI verwendet wird. Als nächstes beobachtbarer Hinweis werden Studien sein, in denen Endnoten mit unabhängigen Wissensprüfungen verglichen werden. Eine wesentliche Unsicherheit bleibt bestehen: Im vorliegenden Material gibt es keine Methodik des Experiments, keine Daten zum langfristigen Lernen und keine Details zu den erwähnten Studien.