Die unangenehme Wahrheit über AI's Doom Loop und die Zukunft des Webs
Die unbequeme Wahrheit über AI's "Untergangsschleife" und was das für die Zukunft des Web bedeutet
Das Internet hat schon immer auf einem unausgesprochenen Deal basiert: Ersteller produzieren Inhalte, Plattformen indexieren sie, Nutzer konsumieren sie – und alle profitieren. Suchmaschinen schicken Traffic zu Verlagen. Links werden geklickt. Das System war zwar nicht perfekt, hat aber Millionen von unabhängigen Creators, Nachrichtenportalen und Unternehmen am Laufen gehalten.
Aber was passiert, wenn der Vermittler plötzlich beschließt, dass er niemanden mehr irgendwohin schicken muss?
Das ist die unbequeme Frage, die im Zentrum der kürzlich öffentlich gewordenen Gerichtsunterlagen aus dem Prozess der New York Times gegen OpenAI und Microsoft steht – und die Antworten sind vernichtend.
Sie wussten es. Und genau das ist das Problem.
Der eigentliche Schocker ist nicht, dass AI-Training möglicherweise Urheberrechte verletzt oder dass Large Language Models ein kompliziertes Verhältnis zu Ausgangsmaterial haben. Der Schocker ist, dass diese Unternehmen genau wussten, was sie taten.
Interne Microsoft-Dokumente beschreiben die AI-Inhaltsstrategie ganz offen als Schaffung einer "Untergangsschleife", die "die Performance unserer Modelle und des gesamten Web gleichzeitig beschädigen" würde. Sie räumten ein, dass ihre Produkte "die wirtschaftlichen Grundlagen ihrer essentiellen Zulieferer" bedrohen – also die Content-Lieferkette, die diese Systeme überhaupt möglich macht.
Anders gesagt: Sie sahen die Klippe, lenkten direkt darauf zu und fuhren weiter.
Brent Hecht, Microsofts Director of Applied Science, war in internen Kommunikationen sogar noch direkter und nannte die Praktiken beim Daten-Harvesting "den größten Diebstahl von Arbeit in der Menschheitsgeschichte". Er merkte an, dass Microsofts rechtliche Verteidigung "den Gedanken der Fair Use zum Gespött macht".
Natürlich hat Microsoft versucht, sich von Hechts Äußerungen zu distanzieren. Ein Sprecher charakterisierte sie als "die individuelle Perspektive eines einzelnen Mitarbeiters". Aber wenn die eigenen internen Dokumente im Grunde dasselbe aussagen, wird diese Unterscheidung eher schwierig aufrechtzuerhalten.
Das Lieferketten-Problem, über das niemand reden will
Hier liegt der fundamentale Widerspruch im Kern moderner AI-Entwicklung: Large Language Models brauchen riesige Mengen menschengemachter Inhalte, um zu funktionieren. Aber diese Modelle sind darauf ausgelegt, die Notwendigkeit für Menschen zu eliminieren, auf diese Inhalte direkt zuzugreifen.
Microsofts eigene Dokumente haben dieses Paradox eingeräumt. LLMs sind in ihren Worten "ein Produkt, das seine eigene Lieferkette zerstört", weil sie genau die Trainingsdaten ersetzen, die sie selbst nützlich machen.
Denk einen Moment darüber nach. Jedes Mal, wenn ChatGPT oder Copilot eine Frage beantwortet, anstatt auf eine Quelle zu verweisen, ist das ein potenzieller Leser, der nie weiterklickt. Das ist Werbeeinnahmen, die nie entstehen. Das ist ein Creator, der sich vielleicht dagegen entscheidet, dass Content-Erstellung die Mühe nicht wert ist.
Und wenn die Quelle versiegt – wenn weniger Creator weniger sehenswerte Inhalte produzieren – was passiert dann mit den Modellen, die auf diesem Content trainiert wurden?
Die Zahlen sind brutal
OpenAIs eigene Analysten schätzen, dass Suchverweis-Traffic zu Verlagen um bis zu 60% gesunken sein könnte, wegen AI-Zusammenfassungen und Chatbots, die Nutzer auf ihren Plattformen halten. Google Zero – das Phänomen, bei dem Websites null Traffic von Google-Suchen erhalten – ist von einer theoretischen Sorge zur gelebten Realität für viele Publisher geworden.
Satya Nadella selbst gab in einer Aussage zu, dass Chatbots "im Grunde Suche ersetzt und die Notwendigkeit beseitigt haben, direkt zur Quelle für Informationen zu gehen". Das ist kein Fehler im System; das ist das Feature, das diese Produkte für Nutzer wertvoll macht.
OpenAIs Nick Turley soll sogar noch direkter gewesen sein: Sobald man eine Antwort von ChatGPT bekommt, gibt es "keinen guten Grund", auf einen Link zur Quelle zu klicken.
Was das für Developer und Startups bedeutet
Hier wird es relevant für dich – den Developer oder Startup-Gründer, der die nächste Generation von Web-Produkten baut.
Die AI-Unternehmen argumentieren im Grunde, dass die alten Regeln nicht mehr gelten – dass das Gemeingut menschlichen Wissens geerntet werden sollte, um proprietäre Systeme zu bauen, die dann die Notwendigkeit ersetzen, auf dieses Wissen zuzugreifen. Und sie tun es mit vollem Bewusstsein des Schadens, den sie anrichten.
Das hat Implikationen jenseits des juristischen Theaters des NYT-Prozesses:
Abhängigkeit von AI-APIs ist riskant. Wenn die Unternehmen hinter diesen Modellen fragwürdige Praktiken betreiben, könnte die Basis deines Produkts auf wackligerem Grund stehen, als du denkst.
Content-Partnerschaften sind wichtig. Publisher sind zunehmend unwillig, ihre Inhalte ohne Gegenleistung scrapen zu lassen. Die rechtliche und geschäftliche Landschaft verschiebt sich in Richtung Lizenzierung.
Die Referral-Traffic-Ökonomie verändert sich. Wenn du ein Content-Business aufbaust, kannst du nicht mehr davon ausgehen, dass Suchtraffic oder Social Shares dich tragen werden. AI-Zusammenfassungen beantworten Nutzerfragen, bevor sie jemals deine Seite erreichen.
Das offene Web hat Wert. Die Prinzipien, die das Internet nützlich gemacht haben – Verlinkung, Zitierung, Traffic, der zu Quellen fließt – schaffen das Ökosystem, das AI überhaupt erst möglich macht. Dieses Ökosystem als unerschöpfliche Ressource zu behandeln, die man abbaut, ist am Ende selbstzerstörerisch.
Die Ironie ist beinahe perfekt
Der vielleicht ironischste Aspekt von allem ist, dass Microsoft, Google und OpenAI jetzt dabei sind, Content-Lizenzdeals mit den Verlagen abzuschließen, die sie beschädigt haben. Nadella selbst sagte, "alles, was hinter einer Paywall ist, sollte lizenziert werden" – eine Haltung, die überzeugender wäre, wenn Microsofts Produkte nicht jahrelang Paywall-Content als Fair-Use für Trainingsdaten behandelt hätten.
OpenAI-Vertreter gaben in Einreichungen zu, dass sie "sich nicht bewusst" waren "irgendeiner systematischen Anstrengung", Paywall-Content aus ihren Trainingsdaten zu erkennen oder zu entfernen. Die AI, die angeblich auf öffentlich zugänglichen Informationen trainiert wurde, scheint also erhebliche Schwierigkeiten gehabt zu haben, zwischen dem zu unterscheiden, was frei ist, und dem, was hinter einer Paywall steht.
Blick nach vorn
Die Untergangsschleife ist längst keine Theorie mehr. Sie passiert in Echtzeit – bei echten Creators, bei echten Verlagen, die versuchen, Journalismus und Content-Erstellung in einer zunehmend feindlichen Umgebung zu finanzieren.
Für die Tech-Industrie zu behaupten, dass AI "Information demokratisiert", während sie gleichzeitig das Geschäftsmodell zerstört, das Informationserstellung möglich macht – das ist keine Innovation. Das ist Rohstoffgewinnung, verkleidet in Silicon-Valley-Sprache.
Die Frage für Developer und Unternehmen, die auf AI aufbauen, ist nicht nur "wie können wir diese Tools nutzen?" Sie lautet: "Wie können wir Systeme bauen, die ihre eigene Grundlage nicht konsumieren?"
Am Ende des Tages ist das Web immer noch die Quelle. Die APIs und Chatbots sind nur eine Schicht darauf. Und wenn wir kollektiv entscheiden, dass diese Schicht wertvoller ist als das Fundament, auf dem sie ruht, kommt der ganze Stapel zum Einsturz.
Die Untergangsschleife ist real. Ob die Industrie die Weisheit hat, rechtzeitig auszusteigen, bevor es zu spät ist, bleibt abzuwarten.
Was denkst du? Schafft die AI-Industrie ein untragbares Ökosystem, oder sind diese Bedenken übertrieben? Teile deine Perspektive in den Kommentaren.