Przejdź do treści
Czas na świecieEU--:--UK--:--USA--:--CN--:--PLDEFRIT中文EN

portal o AI i technologiiwydarzenia · analizy · wywiady · tło techniczne

Szukaj
NA ŻYWO
›

50 tys. pobrań na jednego czytelnika. Boty AI wysysają treści wydawców

Cloudflare pokazał, że niektóre roboty AI pobierają stronę nawet 50 tys. razy na jedno wejście czytelnika. Do tego 59 proc. Niemców używa już narzędzi AI, ale 81 proc. chce oznaczania danych treningowych.

OpinieOpiniaKrzysztof BanaśOpublikowano: 26 września 20265 min czytaniaŹródła 3
50 tys. pobrań na jednego czytelnika. Boty AI wysysają treści wydawców

Relacja „pobranie na odsłonę” przestała być wymianą. Stała się wywłaszczeniem ekonomii treści. Bez licencji jakość informacji stanie się kosztem, którego nikt nie będzie chciał ponosić.

Cloudflare udostępnił 1 lipca 2026 r. przegląd „Attribution Business Insights”. Zestawienie liczby pobrań strony przez roboty z liczbą realnych wejść czytelników dało wskaźniki od 118:1 aż do blisko 50 000:1. W najbardziej skrajnych przypadkach na każdego człowieka, który faktycznie wszedł na stronę, przypada prawie 50 tysięcy pobrań przez automaty. Cloudflare dzieli ruch na treningowy, wyszukiwarkowy i agentowy. Tylko ten drugi przynosi wydawcy jakąkolwiek korzyść.

Rynek zaczyna reagować, bo dobrowolność się skończyła. Cloudflare wprowadził reguły dla „mieszanych” robotów, które pełnią kilka funkcji jednocześnie. Od 15 września domyślnie przepuszczają one ruch wyszukiwarkowy, ale blokują trening i działanie agenta na stronach z reklamami. Nazwano to końcem darmowego przejazdu. Równolegle zawierane są umowy licencyjne. Netflix porozumiał się z Penske Media, wydawcą „Variety” i „Rolling Stone”. Duzi gracze wolą płacić za treści, niż czekać na regulację.

Po stronie użytkowników oczekiwania są jasne, a badanie ARD/ZDF Medienstudie 2026 je kwantyfikuje. Z narzędzi AI korzysta okazjonalnie 59 proc. Niemców od 14. roku życia, a 37 proc. robi to co tydzień, w porównaniu z 22 proc. rok wcześniej. Wśród najmłodszych, w wieku 14–29 lat, sięga po nie 92 proc., a wśród najstarszych, po 70. roku życia, 15 proc. Przy tym 54 proc. podchodzi do wyników modeli sceptycznie i sprawdza je pod kątem błędów, a 81 proc. uznaje przejrzyste oznaczanie danych treningowych i źródeł za istotne. Odbiorcy nie chcą darmowej magii. Chcą wiedzieć, skąd pochodzi odpowiedź.

W tym zestawieniu kryje się poważny konflikt interesów. Ci sami użytkownicy, którzy chcą oznaczeń, korzystają z narzędzi, które treści pobrały bez licencji i bez wynagrodzenia. Wydawcy, którzy mieli finansować dziennikarstwo z reklam, tracą przychody, a jednocześnie dostarczają materiał, na którym buduje się modele przejmujące rolę pośrednika w dostępie do informacji. Nie ma tu symetrii. Broker informacji nie ponosi kosztu jej wytworzenia, a mimo to czerpie z niego korzyść.

Rozwiązanie nie polega na zamykaniu dostępu, tylko na wycenie. Potrzebne są trzy elementy: publiczny rejestr robotów i ich funkcji, standardowy mechanizm licencyjny dostępny także dla małych wydawców oraz przejrzyste wskazywanie źródeł w odpowiedziach modeli. Bez pierwszego nie wiemy, kto pobiera. Bez drugiego tylko największe redakcje zdobędą umowy. Bez trzeciego czytelnik nie odróżni syntezy od faktu. Cloudflare pokazał, że dane istnieją. Teraz trzeba z nich zrobić podstawę do umowy, a nie do skargi.

Komentarze 0

Źródła

3
  1. 01Cloudflare exposes AI crawlers hitting sites 50,000 times per visitorEN
  2. 02Declared good bots, mixed-use crawlers, gray scrapers: how AI accesses publisher contentEN
  3. 03ARD/ZDF-Medienstudie 2026: So nutzen die Deutschen KIDE

Wszystkie liczby i cytaty w tym tekście pochodzą z poniższych źródeł. Nie dopisujemy danych, których w źródłach nie ma.

Materiały zostały przygotowane przez zespół redakcyjny wspierane przez AI.

Krzysztof Banaś

Krzysztof Banaś

Opinie i komentarze

Krzysztof Banaś odpowiada za opinie i komentarze w portalu FLASH24, gdzie czyta wypowiedzi polityków i ekspertów oraz śledzi, jak te same dane są przedstawiane w różnych mediach. Przy każdej publikacji sprawdza, czy liczby zgadzają się z dokumentami źródłowymi, a jeśli nie — sięga po raporty i zestawia je z wcześniejszymi wypowiedziami. Czeka na kalendarz posiedzeń sejmowych komisji i porównuje projekty ustaw z ich późniejszymi wersjami, zanim coś opublikuje. Po godzinach słucha podcastów i publicystyki, a spory w komentarzach czyta jak materiał do kolejnych tekstów. Nie publikuje opinii, których nie da się oprzeć na konkretnym źródle.

Redakcja →

Komentarze

0
  1. Brak komentarzy — bądź pierwszy.

Dodaj komentarz

Komentarze są widoczne publicznie. Nie publikujemy wulgaryzmów, spamu i treści reklamowych.