Grundlage: acht Beiträge und Untersuchungen zum Thema. Der folgende Artikel umfasst rund 960 Wörter.
Wie künstliche Intelligenz das offene Internet verändert – und warum menschliche Stimmen dadurch wertvoller werden
Das Internet war einmal ein Garten aus Millionen menschlicher Stimmen. Manche klangen klug, andere unbeholfen. Einige erzählten von großen Entdeckungen, andere erklärten, wie man einen tropfenden Wasserhahn repariert. Zwischen wissenschaftlichen Aufsätzen, Nachrichten, Tagebüchern und Katzenbildern wuchs ein digitales Gedächtnis der Menschheit.
Heute ziehen neue Gärtner durch diesen Garten. Sie säen schneller, als Menschen lesen können. Ihre Texte sind sauber formuliert, übersichtlich gegliedert und lassen sich beinahe beliebig um einen weiteren Absatz verlängern. Doch je dichter dieser neue Bewuchs wird, desto drängender stellt sich eine entscheidende Frage: Was davon beruht noch auf menschlicher Erfahrung?
Die Zahl hinter dem Unbehagen
Am 20. August 2026 sorgte eine Untersuchung des Pew Research Center für Aufmerksamkeit. Analysiert wurden rund 490.000 englischsprachige Webseiten aus dem Common-Crawl-Archiv. In einer Stichprobe vom Juli 2026 zeigten ungefähr zehn Prozent aller untersuchten Seiten deutliche Spuren davon, dass KI Inhalte verfasst oder umfassend überarbeitet hatte.
Noch auffälliger war das Ergebnis bei jüngeren Inhalten: Betrachteten die Forschenden nur Webseiten, deren erkennbares Veröffentlichungsdatum nach dem Start von ChatGPT am 30. November 2022 lag, stieg der Anteil auf etwa 35 Prozent. Mehr als jede dritte dieser neueren Seiten trug demnach sprachliche Fingerabdrücke generativer KI. Quelle: Association for Computational Linguistics
Das bedeutet nicht, dass ein Drittel des gesamten Internets vollständig von Maschinen geschrieben wurde. Die Untersuchung erfasste sowohl vollständig KI-generierte als auch stark mithilfe von KI überarbeitete Texte. Außerdem können Detektoren menschliche Texte irrtümlich als künstlich einstufen.
Die Zahlen sind daher keine endgültigen Urteile über einzelne Artikel. Sie gleichen eher einem Wetterbericht: kein Beweis für jeden einzelnen Regentropfen, aber ein deutlicher Hinweis darauf, dass sich das Klima verändert.
Die schwierige Vermessung des künstlichen Wortes
Wie viel KI tatsächlich im Internet steckt, hängt stark davon ab, was untersucht wird und wie „KI-generiert“ definiert ist. Das Analyseunternehmen Graphite untersuchte eine andere Auswahl von Onlineartikeln und kam zu einem noch höheren Ergebnis.
Der Untersuchung zufolge war Anfang 2025 ungefähr die Hälfte der neu veröffentlichten Beiträge überwiegend KI-generiert. Graphite setzte dafür drei verschiedene Erkennungssysteme ein und beobachtete, dass sich der Anteil nach einem rasanten Anstieg bei etwa 50 Prozent stabilisierte. Quelle: Graphite
Die Abweichung von der Pew-Untersuchung ist nicht zwangsläufig ein Widerspruch. Pew untersuchte Webseiten unterschiedlicher Art, während Graphite sich auf Artikel konzentrierte. Beide Studien vermessen denselben Strom, nur an unterschiedlichen Stellen: KI-Texte sind vom Rand in die Mitte des Netzes gerückt.
Wenn Maschinen ihre eigenen Spuren lesen
So entsteht ein seltsamer Kreislauf. Sprachmodelle werden mit Texten aus dem Internet trainiert. Anschließend erzeugen sie neue Texte, die wiederum online veröffentlicht, von Suchmaschinen erfasst und von anderen KI-Systemen als Quellen verwendet werden.
Graphite untersuchte diesen möglichen Echoraum auch bei KI-Suchergebnissen. Im Juni 2026 wurden rund 42,7 Prozent der von ChatGPT herangezogenen Quellen als wahrscheinlich KI-generiert eingestuft. Damit verweist das System zunehmend auf Material, das möglicherweise von anderen Maschinen geschrieben wurde. Quelle: Graphite
Das Internet beginnt, mit seiner eigenen synthetischen Stimme zu sprechen. Ein Quellentext wird zu einer Zusammenfassung verdichtet, die Zusammenfassung zu einem Artikel und der Artikel zur Grundlage für die nächste Antwort.
Mit jedem Durchlauf können Nuancen verloren gehen und Fehler weitergetragen werden. Am Ende bleibt womöglich ein glatter, überzeugend klingender Satz, dessen Ursprung niemand mehr kennt.
Auch der Journalismus bleibt nicht unberührt
Eine 2026 veröffentlichte wissenschaftliche Untersuchung analysierte 186.000 Artikel aus rund 1.500 US-amerikanischen Zeitungen. Etwa neun Prozent der Beiträge wurden als teilweise oder vollständig KI-generiert eingestuft. Besonders häufig fanden sich entsprechende Hinweise in kleineren Lokalzeitungen sowie in Ressorts wie Wetter und Technologie.
Problematisch war nicht allein der Einsatz von KI, sondern auch die fehlende Transparenz darüber. Bei der manuellen Prüfung von 100 Artikeln, die als KI-beeinflusst eingestuft worden waren, fanden die Forschenden nur in fünf Fällen einen Hinweis auf den Einsatz von KI.
Zudem enthielten die als KI-generiert eingestuften Texte deutlich häufiger erfundene oder faktisch unbelegte Behauptungen als menschlich verfasste Artikel. Auch hier betonten die Autoren, dass Detektoren nicht unfehlbar seien und die Ergebnisse nicht als Anschuldigungen gegen einzelne Redaktionen verstanden werden dürften. Quelle: Association for Computational Linguistics
Damit trifft die Entwicklung den Journalismus an seiner empfindlichsten Stelle: beim Vertrauen. Ein Text kann stilistisch makellos sein und dennoch auf unsicherem Grund stehen.
Ein überzeugender Stil ist noch kein Beleg für Wahrheit.
Die neue Ökonomie des Netzes
Während Maschinen immer mehr Inhalte erzeugen, wird zugleich ein wachsender Teil dessen, was im Netz erscheint, von Maschinen gelesen. Cloudflare berichtete im Juli 2026, dass erstmals mehr als die Hälfte des beobachteten Internetverkehrs nicht von Menschen verursacht worden sei. Von den erfassten Crawler-Anfragen entfielen im Juni 2026 rund 52 Prozent auf das Sammeln von Daten für das Training von KI-Systemen. Quelle: blog.cloudflare.com
Für Verlage und unabhängige Autoren entsteht daraus ein wirtschaftliches Problem. Ihre Texte werden durchsucht, zusammengefasst und in direkte KI-Antworten verwandelt. Leser erhalten die gesuchte Information, ohne dafür unbedingt die ursprüngliche Webseite besuchen zu müssen.
Der Brunnen liefert weiterhin Wasser, doch immer weniger Menschen gehen bis zur Quelle.
Nicht die KI ist das eigentliche Problem
Generative KI kann beim Recherchieren, Strukturieren, Übersetzen und Überarbeiten helfen. Sie kann komplizierte Gedanken ordnen und Menschen unterstützen, denen das Schreiben sonst schwerfiele.
Entscheidend ist deshalb nicht allein, ob KI eingesetzt wurde, sondern welchen eigenen Beitrag ein Autor leistet: eigene Beobachtungen, überprüfte Fakten, Zweifel, Verantwortung und eine erkennbare Perspektive.
Auch Google unterscheidet zwischen Inhalten, die sinnvoll mit KI unterstützt wurden, und massenhaft erzeugten Seiten ohne Mehrwert. KI-gestützte oder KI-generierte Texte sind nicht grundsätzlich unerwünscht. Problematisch werden sie dort, wo Menge an die Stelle von Originalität tritt und Inhalte hauptsächlich produziert werden, um Suchmaschinen zu beeinflussen. Quelle: developers.google.com
Die Rückkehr des Menschlichen
Vielleicht führt die Flut synthetischer Texte zu einer überraschenden Gegenbewegung. Wenn perfekte Formulierungen überall verfügbar sind, verliert sprachliche Perfektion an Wert.
Wertvoll werden stattdessen Herkunft und Erfahrung: der Name eines verantwortlichen Autors, ein Gespräch vor Ort, eine Erfahrung aus erster Hand oder ein Gedanke, in dem nicht bloß bekannte Formulierungen neu zusammengesetzt werden.
Das Internet der Zukunft muss nicht menschenleer sein. Aber es braucht Orientierung: transparente Kennzeichnungen, nachvollziehbare Quellen und Redaktionen, die KI als Werkzeug einsetzen, ohne ihr die Verantwortung zu überlassen.
Denn Maschinen können Worte in nahezu unbegrenzter Menge erzeugen. Bedeutung entsteht jedoch erst dort, wo jemand für diese Worte einsteht.
Und vielleicht wird genau das zur wichtigsten Währung des neuen Netzes: nicht der perfekte Satz, sondern die glaubwürdige menschliche Stimme dahinter.
Weiterführende Informationen
Quellenhinweis: Einzelne Fakten, Einschätzungen und Prognosen dieses Beitrags stützen sich auf Veröffentlichungen der nachfolgend genannten Unternehmen und Institutionen. Die Links dienen zugleich der weiterführenden Information.
Search Engine Journal – 1 In 10 Webpages Shows Signs Of AI Authorship, Pew Reports
Der Beitrag vergleicht Pews Schätzung von 35 Prozent mit Graphites Wert von 49,9 Prozent und erklärt die unterschiedlichen Datengrundlagen und Definitionen.
https://www.searchenginejournal.com/1-in-10-webpages-shows-signs-of-ai-authorship-pew-reports/586883/
Graphite – AI Search Collapse: AI Responses Collapse When AI Retrieves Its Own Generations
Die Untersuchung stuft im Juni 2026 rund 42,7 Prozent der von ChatGPT herangezogenen Quellen als wahrscheinlich KI-generiert ein und demonstriert mögliche Rückkopplungseffekte.
https://graphite.io/five-percent/research/ai-search-collapse
Association for Computational Linguistics – AI use in American newspapers is widespread, uneven, and rarely disclosed
Die Studie ermittelt anhand von 186.000 US-Zeitungsartikeln rund neun Prozent KI-Beteiligung, seltene Kennzeichnung und ein 8,2-fach höheres Auftreten halluzinierter Behauptungen.
https://aclanthology.org/2026.acl-long.663/



