50.000 Abrufe pro Leser: KI-Bots saugen Verlagsinhalte ab
Cloudflare zeigt: Manche KI-Roboter rufen eine Seite bis zu 50.000-mal ab, gerechnet auf einen einzigen Seitenaufruf eines Lesers. 59 Prozent der Deutschen nutzen bereits KI-Werkzeuge, 81 Prozent wollen gekennzeichnete Trainingsdaten.

These: Das Verhältnis von Abruf zu Seitenaufruf ist kein Austausch mehr, sondern eine Enteignung der Inhaltsökonomie. Ohne Lizenz wird die Qualität von Information zu einem Kostenfaktor, den niemand tragen will.
Cloudflare veröffentlichte am 1. Juli 2026 den Überblick „Attribution Business Insights“. Die Zahlen darin lassen sich schwer ignorieren. Das Unternehmen stellte die Seitenabrufe von Robotern den tatsächlichen Zugriffen von Lesern gegenüber und kam auf Werte von 118:1 bis fast 50.000:1. Im extremsten Fall kommen also auf jeden Menschen, der eine Seite wirklich aufruft, fast 50.000 Abrufe durch Automaten. Cloudflare teilt den Verkehr in Training, Suchmaschine und Agenten auf. Nur der Suchmaschinenverkehr bringt dem Verlag etwas.
Der Markt reagiert, weil die Freiwilligkeit vorbei ist. Cloudflare führte Regeln für „gemischte“ Roboter ein, die mehrere Funktionen zugleich erfüllen. Ab dem 15. September lassen sie standardmäßig den Suchmaschinenverkehr durch, blockieren aber Training und Agentenbetrieb auf Seiten mit Werbung. Das wurde das Ende der kostenlosen Mitfahrt genannt. Parallel werden Lizenzverträge geschlossen: Netflix einigte sich mit Penske Media, dem Verlag von „Variety“ und „Rolling Stone“. Große Akteure zahlen lieber für Inhalte, als auf eine Regulierung zu warten.
Auf der Nutzerseite sind die Erwartungen klar, und die ARD/ZDF-Medienstudie 2026 beziffert sie. KI-Werkzeuge nutzen gelegentlich 59 Prozent der Deutschen ab 14 Jahren, 37 Prozent tun dies wöchentlich, verglichen mit 22 Prozent ein Jahr zuvor. Bei den Jüngsten, im Alter von 14 bis 29 Jahren, greifen 92 Prozent darauf zurück, bei den Ältesten, über 70 Jahre, 15 Prozent. Zugleich stehen 54 Prozent den Ergebnissen der Modelle skeptisch gegenüber und prüfen sie auf Fehler. 81 Prozent halten eine transparente Kennzeichnung von Trainingsdaten und Quellen für wichtig. Die Nutzer wollen keine kostenlose Magie, sie wollen wissen, woher die Antwort stammt.
In dieser Gegenüberstellung steckt ein ernster Interessenkonflikt. Dieselben Nutzer, die Kennzeichnungen wollen, verwenden Werkzeuge, die Inhalte ohne Lizenz und ohne Vergütung abgerufen haben. Verlage, die den Journalismus aus Werbung finanzieren sollten, verlieren Einnahmen. Zugleich liefern sie das Material, auf dem Modelle gebaut werden, die die Rolle des Vermittlers beim Zugang zu Information übernehmen. Eine Symmetrie gibt es hier nicht: Der Informationsbroker trägt nicht die Kosten der Erzeugung, zieht aber trotzdem Nutzen daraus.
Die Lösung liegt nicht im Schließen des Zugangs, sondern in der Bewertung. Drei Elemente sind nötig: ein öffentliches Register der Roboter und ihrer Funktionen, ein standardisierter Lizenzmechanismus, der auch kleinen Verlagen offensteht, und eine transparente Quellenangabe in den Antworten der Modelle. Ohne das erste wissen wir nicht, wer abruft; ohne das zweite bekommen nur die größten Redaktionen Verträge; ohne das dritte kann der Leser Synthese nicht von Fakt unterscheiden. Cloudflare hat gezeigt, dass die Daten existieren. Jetzt muss man aus ihnen die Grundlage für einen Vertrag machen, nicht für eine Beschwerde.
Quellen
3- 01Cloudflare exposes AI crawlers hitting sites 50,000 times per visitorEN
- 02Declared good bots, mixed-use crawlers, gray scrapers: how AI accesses publisher contentEN
- 03ARD/ZDF-Medienstudie 2026: So nutzen die Deutschen KIDE
Alle Zahlen und Zitate in diesem Text stammen aus den unten genannten Quellen.
Die Materialien wurden vom Redaktionsteam mit Unterstützung von KI erstellt.
Kommentare
0- Noch keine Kommentare — seien Sie der Erste.