50mila scaricamenti per un lettore. I bot AI prosciugano i contenuti degli editori
Cloudflare ha mostrato che alcuni robot AI scaricano una pagina fino a 50mila volte per ogni singolo accesso di un lettore. E il 59 per cento dei tedeschi usa già strumenti di AI, ma l'81 per cento vuole che i dati di addestramento siano etichettati.

Tesi: il rapporto tra scaricamenti e visite non è più uno scambio. È diventato un'espropriazione dell'economia dei contenuti. Senza licenze la qualità dell'informazione diventerà un costo che nessuno vorrà più sostenere.
Il 1 luglio 2026 Cloudflare ha pubblicato il rapporto "Attribution Business Insights". Il quadro che ne emerge è difficile da ignorare. Mettendo a confronto il numero di scaricamenti di una pagina da parte dei robot con il numero di accessi reali dei lettori, i rapporti vanno da 118:1 fino a quasi 50 000:1. Nei casi più estremi, per ogni persona che entra davvero sul sito ci sono quasi 50mila scaricamenti da parte degli automatismi. Cloudflare divide il traffico in tre categorie: addestramento, ricerca e agente. Solo la seconda porta all'editore un beneficio concreto.
Il mercato comincia a reagire, perché la volontarietà è finita. Cloudflare ha introdotto regole per i robot "misti", quelli che svolgono più funzioni insieme: dal 15 settembre lasciano passare per impostazione predefinita il traffico di ricerca, ma bloccano addestramento e azione dell'agente sui siti con pubblicità. È la fine del viaggio gratis. Nello stesso periodo si firmano accordi di licenza: Netflix ha trovato un'intesa con Penske Media, editore di "Variety" e "Rolling Stone". I grandi operatori preferiscono pagare i contenuti piuttosto che aspettare una regolamentazione.
Dal lato degli utenti le aspettative sono chiare, e lo studio ARD/ZDF Medienstudie 2026 le quantifica. Il 59 per cento dei tedeschi dai 14 anni in su usa strumenti di AI almeno occasionalmente, e il 37 per cento lo fa ogni settimana, contro il 22 per cento di un anno prima. Tra i più giovani, nella fascia 14-29 anni, li usa il 92 per cento, mentre tra gli over 70 il 15 per cento. Il 54 per cento guarda con scetticismo ai risultati dei modelli e li controlla alla ricerca di errori. L'81 per cento considera importante un'etichettatura trasparente dei dati di addestramento e delle fonti. Il pubblico non vuole magia gratuita: vuole sapere da dove viene la risposta.
In questo quadro c'è un conflitto di interessi serio. Gli stessi utenti che chiedono le etichette usano strumenti che hanno prelevato contenuti senza licenza e senza compenso. Gli editori, che dovevano finanziare il giornalismo con la pubblicità, perdono ricavi e allo stesso tempo forniscono il materiale su cui si costruiscono modelli che assumono il ruolo di intermediario nell'accesso all'informazione. Qui non c'è simmetria: il broker dell'informazione non sostiene il costo di produrla, eppure ne ricava un vantaggio.
La soluzione non è chiudere l'accesso, ma attribuire un prezzo. Servono tre elementi: un registro pubblico dei robot e delle loro funzioni, un meccanismo di licenza standard accessibile anche ai piccoli editori e l'indicazione trasparente delle fonti nelle risposte dei modelli. Senza il primo non sappiamo chi scarica; senza il secondo solo le redazioni più grandi otterranno accordi; senza il terzo il lettore non distingue la sintesi dal fatto. Cloudflare ha dimostrato che i dati esistono. Ora quei dati devono diventare la base di un contratto, non di una lamentela.
Fonti
3- 01Cloudflare exposes AI crawlers hitting sites 50,000 times per visitorEN
- 02Declared good bots, mixed-use crawlers, gray scrapers: how AI accesses publisher contentEN
- 03ARD/ZDF-Medienstudie 2026: So nutzen die Deutschen KIDE
Tutti i numeri e le citazioni di questo testo provengono dalle fonti elencate sotto.
I contenuti sono stati preparati dalla redazione con il supporto dell'IA.
Commenti
0- Nessun commento — sii il primo.