Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

pewresearchpewresearchtechcrunchMehr als ein Drittel der englischsprachigen Webseiten, die seit der Veröffentlichung von ChatGPT im November 2022 erschienen sind, zeigen Anzeichen einer KI-Urheberschaft. Dies geht aus einer am Donnerstag veröffentlichten Studie des Pew Research Center hervor.pewresearch
Das Ergebnis liefert eines der bisher deutlichsten Anzeichen dafür, wie generative KI das Internet in weniger als vier Jahren verändert hat. Pew analysierte fast eine halbe Million Webseiten aus dem Common Crawl-Archiv, die den Zeitraum von Januar 2021 bis Juli 2026 abdecken, und untersuchte sie mit einem von Open Pangram entwickelten KI-Erkennungsmodell.pewresearch
In einer Stichprobe von 10.000 Webseiten aus dem Juli 2026 zeigten 10% "deutliche Anzeichen einer KI-Urheberschaft". Da das offene Internet jedoch eine Mischung aus alten und neuen Inhalten enthält, von denen viele vor der Ära der KI-Schreibwerkzeuge entstanden sind, filterte Pew alle Seiten heraus, die vor dem Start von ChatGPT veröffentlicht wurden. Unter den verbleibenden Seiten wiesen 35% Anzeichen einer KI-Urheberschaft auf.techcrunch+1
Der Trend ist nicht gleichmäßig verteilt. Seiten mit .com-Domains weisen etwa zehnmal häufiger KI-Inhalte auf als .edu- oder .gov-Domains, die beide bei etwa 1% liegen. Seiten mit .org-Domains liegen mit 4,6% dazwischen.pewresearch+1
Pew identifizierte spezifische sprachliche Merkmale, die in Webinhalten nach ChatGPT stark zugenommen haben. Im Vergleich zu Anfang 2023 treten Gedankenstriche heute etwa doppelt so häufig auf, das Oxford-Komma nahm um 63% zu, und KI-bevorzugtes Vokabular wie "delve", "interplay", "tapestry" und "testament" hat sich in der Verwendung mehr als verdoppelt. Die Nutzung von Strukturen mit "negativer Parallelität" ("es ist nicht nur X, es ist Y") hat sich fast verdreifacht.pewresearch
Die Studie erscheint kurz nachdem Cloudflare berichtete, dass der Bot-Verkehr den menschlichen Web-Traffic überholt hat, ein Meilenstein, der früher erreicht wurde als vom Unternehmen geschätzt.techcrunch
Pew räumte ein, dass KI-Erkennungstools einzelne Seiten falsch klassifizieren können. "Modelle wie dieses suchen nach statistischen Unterschieden in der Art und Weise, wie menschliche Autoren und KI-Modelle Sprache verwenden", merkte der Bericht an und fügte hinzu, dass die Muster in großem Maßstab zuverlässiger werden.pewresearch
Die Untersuchung wurde von Samuel Bestvater, einem leitenden Datenwissenschaftler bei Pew, durchgeführt und trägt zu einer wachsenden Zahl von Beweisen bei, die darauf hindeuten, dass das Internet zunehmend ein Ort ist, an dem, wie TechCrunch es ausdrückte, "ein Großteil von Bots gelesen wird, die von anderen Bots geschrieben wurden".techcrunch