
Das Pew Research Center analysierte fast eine halbe Million englischsprachiger Webseiten auf Anzeichen von durch künstliche Intelligenz erstelltem Text. Laut einer von The Decoder veröffentlichten Zusammenfassung der Studie weisen mehr als ein Drittel der Seiten, die nach dem Start von ChatGPT veröffentlicht wurden, solche Merkmale auf.
Kommerzielle Websites in der Top-Level-Domain.com enthalten diesen Daten zufolge zehnmal häufiger KI-Texte als Websites in den Domänen.edu oder.gov. Dies deutet auf Unterschiede zwischen den Typen von Webplattformen hin, erklärt jedoch nicht die Gründe für diese Kluft.
Die praktische Bedeutung dieses Befunds liegt in der wachsenden Rolle automatisierter Texte im öffentlichen Web-Umfeld. Dabei basiert das verfügbare Paket auf Metadaten und einer Zusammenfassung von The Decoder und nicht auf dem vollständigen Studientext oder einer unabhängigen Überprüfung der Ergebnisse.
redaktioneller Kommentar
Warum es wichtig ist
Sofern sich die Schlussfolgerungen bestätigen, werden Redaktionen und Forscher häufiger die Herkunft von Webtexten überprüfen und zwischen automatisierter und manueller Erstellung unterscheiden müssen. Das nächste beobachtbare Signal wird das Erscheinen vergleichbarer Studien mit offener Methodik und unabhängiger Überprüfung sein. Eine erhebliche Unsicherheit besteht darin, dass im verfügbaren Paket weder der vollständige Studientext noch eine Beschreibung der Erkennungsmethode enthalten sind.