La fuga sulla moderazione di Facebook, l'Online Safety Act britannico e il Rules Hub di Reddit raccontano la stessa battaglia
Le linee guida interne di Facebook permettono un post che invita a spezzare il collo di una donna, ma vietano "Someone shoot Trump". Lo ha riferito Ars Technica nel maggio 2017, dopo che The Guardian ha pubblicato più di 100 manuali di formazione interni.

La fuga è arrivata in un momento scomodo. È uscita durante la campagna elettorale britannica, mentre i conservatori spingevano per multe ai siti che non rimuovono rapidamente i contenuti illegali. Lo scrive Ars Technica nel resoconto del 22 maggio 2017.
La difesa di Facebook, allora e in gran parte ancora oggi, è la scala e la categoria giuridica. I documenti trapelati mostrano l'azienda tracciare una linea sui contenuti che potrebbero causare un danno reale e credibile, chiedendo dettagli specifici prima di trattare una minaccia come credibile. Con quelle regole, i post misogini violenti e gli inviti a picchiare i bambini grassi restavano online. Minacciare un presidente no, anche perché negli Stati Uniti è un reato. L'azienda ha sempre sostenuto di essere una piattaforma, non un editore, e in Europa può appoggiarsi alla direttiva sul commercio elettronico, il cui articolo 15 dice che i servizi di hosting non hanno l'obbligo di sorvegliare ciò che trasmettono o memorizzano. Quella posizione diventa più difficile da tenere ogni volta che Facebook interviene sui contenuti, che è esattamente ciò che è un manuale di moderazione. La responsabile globale delle politiche di Facebook, Monika Bickert, ha detto a The Guardian che una "comunità globale diversificata" rende impossibile tracciare linee coerenti. Il confine tra satira e contenuto inappropriato, ha aggiunto, a volte è molto grigio.
Sei anni dopo, il Regno Unito ha smesso di chiedere con le buone.
L'Online Safety Bill ha ricevuto il royal assent il 26 ottobre 2023, diventando l'Online Safety Act, ha riferito The Verge. Copre l'accesso dei minori alla pornografia, i troll anonimi, gli annunci truffaldini, i deepfake intimi non consensuali, il materiale pedopornografico e i contenuti terroristici. Ofcom lo applica in tre fasi.
"I nostri nuovi poteri non servono a rimuovere contenuti", ha detto l'amministratrice delegata di Ofcom, Melanie Dawes, in una dichiarazione. "Il nostro compito è affrontare le cause profonde del danno".
Le sanzioni arrivano a 18.000.000 di sterline, circa 22.000.000 di dollari, o al 10 per cento del fatturato annuo globale, se superiore, con la possibilità del carcere per i dirigenti. WhatsApp e Signal hanno contestato una clausola che consente a Ofcom di chiedere alle aziende di identificare i contenuti di abuso sessuale sui minori, comunicati in pubblico o in privato, sostenendo che mina la crittografia end-to-end; alcuni fornitori hanno suggerito che preferirebbero lasciare il Regno Unito. La Wikimedia Foundation ha avvertito che rigidi obblighi di protezione dei minori mal si conciliano con un servizio che raccoglie pochi dati sugli utenti, comprese le età.
L'automazione avanza e le regole si fanno più sfumate
La novità più recente è che le piattaforme affidano il giudizio ai modelli linguistici. Reddit sta lanciando una suite di moderazione chiamata Rules Hub, che usa gli LLM per valutare se un post o un commento corrisponde all'intento di una regola, ha riferito The Verge il 6 agosto 2026. Rules Hub è stato testato con moderatori di oltre 700 comunità, si sta estendendo a tutte le comunità di nuova creazione e sarà ampiamente disponibile più avanti nel 2026.
Reddit dice che Rules Hub potrà col tempo sostituire molti dei flussi di applicazione su cui le comunità contano tramite Automoderator, che dipende dalla corrispondenza esatta di parole chiave e schemi. L'amministratore delegato Steve Huffman ha definito Automod difficile da imparare, difficile da mantenere e fortemente dipendente da una corrispondenza fragile di parole chiave e da configurazioni ereditate. L'azienda chiede inoltre alle nuove app di terze parti di usare la sua piattaforma per sviluppatori invece dell'API, e dice di stare valutando cambiamenti al vecchio Reddit, senza tempi definiti.
Metteteci accanto Valve. PC Gamer ha riferito il 2 giugno 2026 che, secondo un resoconto di Bloomberg basato su un ex dipendente anonimo, Gabe Newell ha aggredito verbalmente il consulente legale generale Karl Quackenbush, che sosteneva una moderazione più interventista mentre Valve valutava di accogliere contenuti apertamente pornografici: "Per che cazzo ti pago se questa è la tua opinione?". Steam ha comunque aperto i cancelli, per poi rimuovere i contenuti per adulti sotto la pressione dei processori di pagamento.
Così la stessa discussione torna sempre, con costumi diversi. Facebook ha scritto regole strette e l'ha chiamata neutralità. Il Regno Unito ha legiferato e ha lasciato a un regolatore il compito di scrivere i dettagli. Reddit sta sostituendo regole fragili con modelli che giudicano l'intento. Valve ha lasciato decidere il mercato, e ogni tanto un processore di pagamento. Nessuno di loro ha risolto la domanda posta dalla fuga del 2017: chi traccia la linea, e chi risponde quando si sposta.
Fonti
4- 01Facebook content moderation guidelines leakedEN
- 02Reddit is introducing a new moderator: AIEN
- 03Gabe Newell reportedly snapped 'What the f*** do I pay you for if that's your opinion?' at Valve lawyer pushing for more content moderation on SteamEN
- 04The UK's controversial Online Safety Bill finally becomes lawEN
Tutti i numeri e le citazioni di questo testo provengono dalle fonti elencate sotto.
I contenuti sono stati preparati dalla redazione con il supporto dell'IA.
Commenti
0- Nessun commento — sii il primo.