50 tys. pobrań na jednego czytelnika. Boty AI wysysają treści wydawców
Cloudflare pokazał, że niektóre roboty AI pobierają stronę nawet 50 tys. razy na jedno wejście czytelnika. Do tego 59 proc. Niemców używa już narzędzi AI, ale 81 proc. chce oznaczania danych treningowych.

Relacja „pobranie na odsłonę” przestała być wymianą. Stała się wywłaszczeniem ekonomii treści. Bez licencji jakość informacji stanie się kosztem, którego nikt nie będzie chciał ponosić.
Cloudflare udostępnił 1 lipca 2026 r. przegląd „Attribution Business Insights”. Zestawienie liczby pobrań strony przez roboty z liczbą realnych wejść czytelników dało wskaźniki od 118:1 aż do blisko 50 000:1. W najbardziej skrajnych przypadkach na każdego człowieka, który faktycznie wszedł na stronę, przypada prawie 50 tysięcy pobrań przez automaty. Cloudflare dzieli ruch na treningowy, wyszukiwarkowy i agentowy. Tylko ten drugi przynosi wydawcy jakąkolwiek korzyść.
Rynek zaczyna reagować, bo dobrowolność się skończyła. Cloudflare wprowadził reguły dla „mieszanych” robotów, które pełnią kilka funkcji jednocześnie. Od 15 września domyślnie przepuszczają one ruch wyszukiwarkowy, ale blokują trening i działanie agenta na stronach z reklamami. Nazwano to końcem darmowego przejazdu. Równolegle zawierane są umowy licencyjne. Netflix porozumiał się z Penske Media, wydawcą „Variety” i „Rolling Stone”. Duzi gracze wolą płacić za treści, niż czekać na regulację.
Po stronie użytkowników oczekiwania są jasne, a badanie ARD/ZDF Medienstudie 2026 je kwantyfikuje. Z narzędzi AI korzysta okazjonalnie 59 proc. Niemców od 14. roku życia, a 37 proc. robi to co tydzień, w porównaniu z 22 proc. rok wcześniej. Wśród najmłodszych, w wieku 14–29 lat, sięga po nie 92 proc., a wśród najstarszych, po 70. roku życia, 15 proc. Przy tym 54 proc. podchodzi do wyników modeli sceptycznie i sprawdza je pod kątem błędów, a 81 proc. uznaje przejrzyste oznaczanie danych treningowych i źródeł za istotne. Odbiorcy nie chcą darmowej magii. Chcą wiedzieć, skąd pochodzi odpowiedź.
W tym zestawieniu kryje się poważny konflikt interesów. Ci sami użytkownicy, którzy chcą oznaczeń, korzystają z narzędzi, które treści pobrały bez licencji i bez wynagrodzenia. Wydawcy, którzy mieli finansować dziennikarstwo z reklam, tracą przychody, a jednocześnie dostarczają materiał, na którym buduje się modele przejmujące rolę pośrednika w dostępie do informacji. Nie ma tu symetrii. Broker informacji nie ponosi kosztu jej wytworzenia, a mimo to czerpie z niego korzyść.
Rozwiązanie nie polega na zamykaniu dostępu, tylko na wycenie. Potrzebne są trzy elementy: publiczny rejestr robotów i ich funkcji, standardowy mechanizm licencyjny dostępny także dla małych wydawców oraz przejrzyste wskazywanie źródeł w odpowiedziach modeli. Bez pierwszego nie wiemy, kto pobiera. Bez drugiego tylko największe redakcje zdobędą umowy. Bez trzeciego czytelnik nie odróżni syntezy od faktu. Cloudflare pokazał, że dane istnieją. Teraz trzeba z nich zrobić podstawę do umowy, a nie do skargi.
Źródła
3- 01Cloudflare exposes AI crawlers hitting sites 50,000 times per visitorEN
- 02Declared good bots, mixed-use crawlers, gray scrapers: how AI accesses publisher contentEN
- 03ARD/ZDF-Medienstudie 2026: So nutzen die Deutschen KIDE
Wszystkie liczby i cytaty w tym tekście pochodzą z poniższych źródeł. Nie dopisujemy danych, których w źródłach nie ma.
Materiały zostały przygotowane przez zespół redakcyjny wspierane przez AI.
Komentarze
0- Brak komentarzy — bądź pierwszy.