Facebook-Moderationsleak, britischer Online Safety Act und Reddits Rules Hub zeigen denselben Streit
Facebooks eigene Moderationsrichtlinien erlauben einen Beitrag, der Nutzern rät, einer Frau das Genick zu brechen, verbieten aber "Someone shoot Trump". Das berichtete Ars Technica im Mai 2017, nachdem The Guardian mehr als 100 interne Schulungshandbücher veröffentlicht hatte.

Das Leck kam zu einem ungünstigen Zeitpunkt: mitten im britischen Wahlkampf. Die Konservativen forderten damals Geldstrafen für Seiten, die illegale Inhalte nicht schnell genug entfernen. So steht es in dem Bericht von Ars Technica vom 22. Mai 2017.
Facebook verteidigt sich damals wie heute mit zwei Argumenten: der schieren Menge und der rechtlichen Kategorie. Die geleakten Dokumente zeigen, dass das Unternehmen die Grenze bei Inhalten zieht, die glaubhaft echten Schaden anrichten könnten. Bevor eine Drohung als glaubhaft gilt, verlangt es bestimmte Angaben. Nach diesen Regeln blieben gewalttätige frauenfeindliche Beiträge und Aufrufe, dicke Kinder zu verprügeln, stehen. Die Drohung gegen einen Präsidenten nicht, teils weil sie in den USA eine Straftat ist. Das Unternehmen betont seit Langem, es sei eine Plattform, kein Herausgeber. In Europa kann es sich auf die E-Commerce-Richtlinie stützen. Deren Artikel 15 besagt, dass Hosting-Dienste nicht überwachen müssen, was sie übertragen oder speichern. Diese Position wird schwerer zu halten, sobald Facebook in Inhalte eingreift. Genau das ist ein Moderationsregelwerk. Facebooks globale Leiterin für Politikmanagement, Monika Bickert, sagte dem Guardian, eine "diverse globale Gemeinschaft" mache eine einheitliche Grenzziehung unmöglich. Der Abstand zwischen Satire und unangemessenem Inhalt sei manchmal sehr grau.
Sechs Jahre später hörte das Vereinigte Königreich auf, freundlich zu fragen.
Der Online Safety Bill erhielt am 26. Oktober 2023 die königliche Zustimmung und wurde damit zum Online Safety Act, wie The Verge berichtete. Er umfasst den Zugang Minderjähriger zu Pornografie, anonyme Trolle, Betrugsanzeigen, nicht einvernehmliche intime Deepfakes, Material sexuellen Kindesmissbrauchs und Terrorismusinhalte. Ofcom setzt ihn in drei Phasen durch.
"Unsere neuen Befugnisse sollen keine Inhalte entfernen", sagte Ofcom-Chefin Melanie Dawes in einer Erklärung. "Unsere Aufgabe ist es, die Ursachen von Schaden anzugehen."
Die Strafen reichen bis 18 Millionen Pfund, rund 22 Millionen Dollar, oder 10 Prozent des globalen Jahresumsatzes, je nachdem, welcher Betrag höher ist. Chefs können ins Gefängnis kommen. WhatsApp und Signal wandten sich gegen eine Klausel, die Ofcom erlaubt, Unternehmen aufzufordern, Inhalte sexuellen Kindesmissbrauchs zu identifizieren, ob öffentlich oder privat kommuniziert. Sie erklärten, die Klausel untergrabe die Ende-zu-Ende-Verschlüsselung. Einige Anbieter ließen durchblicken, sie würden lieber das Vereinigte Königreich verlassen. Die Wikimedia Foundation warnte, strenge Pflichten zum Kinderschutz passten schlecht zu einem Dienst, der nur minimale Nutzerdaten sammelt, darunter das Alter.
Automatisierung zieht ein, und die Regeln werden unschärfer
Die neueste Wendung ist, dass Plattformen die Beurteilung an Sprachmodelle abgeben. Reddit führt eine Moderationssuite namens Rules Hub ein. Sie nutzt LLMs, um zu bewerten, ob ein Beitrag oder Kommentar zur Absicht einer Regel passt, wie The Verge am 6. August 2026 berichtete. Rules Hub wurde mit Moderatoren aus über 700 Communities getestet, wird auf alle neu erstellten Communities ausgeweitet und soll später im Jahr 2026 breit verfügbar sein.
Reddit sagt, Rules Hub könne irgendwann viele Durchsetzungsabläufe ersetzen, auf die sich Communities mit Automoderator verlassen. Automoderator beruht auf exaktem Schlüsselwort- und Musterabgleich. CEO Steve Huffman nannte Automod schwer zu lernen, schwer zu pflegen und stark abhängig von brüchigem Schlüsselwortabgleich und übernommenen Konfigurationen. Das Unternehmen verlangt außerdem, dass neue Drittanbieter-Apps seine Entwicklerplattform statt der API nutzen. Änderungen am alten Reddit prüft es, ohne festen Zeitplan.
Dem steht Valve gegenüber. PC Gamer berichtete am 2. Juni 2026, laut einem Bloomberg-Bericht, der sich auf einen anonymen ehemaligen Mitarbeiter beruft, habe Gabe Newell den Justiziar Karl Quackenbush angefahren. Quackenbush argumentierte für mehr eigene Moderation, als Valve erwog, offen pornografische Inhalte zuzulassen: "Wofür zum Teufel bezahle ich dich, wenn das deine Meinung ist?" Steam öffnete die Schleusen trotzdem und entfernte Erwachseneninhalte später unter Druck von Zahlungsabwicklern.
Derselbe Streit kehrt also in wechselnden Kostümen wieder. Facebook schrieb enge Regeln und nannte es Neutralität. Das Vereinigte Königreich erließ ein Gesetz und ließ eine Aufsichtsbehörde die Details schreiben. Reddit ersetzt brüchige Regeln durch Modelle, die Absicht beurteilen. Valve ließ den Markt entscheiden, gelegentlich auch einen Zahlungsabwickler. Keiner von ihnen hat die Frage beantwortet, die das Leck von 2017 aufwarf: Wer zieht die Grenze, und wer haftet, wenn sie sich verschiebt.
Quellen
4- 01Facebook content moderation guidelines leakedEN
- 02Reddit is introducing a new moderator: AIEN
- 03Gabe Newell reportedly snapped 'What the f*** do I pay you for if that's your opinion?' at Valve lawyer pushing for more content moderation on SteamEN
- 04The UK's controversial Online Safety Bill finally becomes lawEN
Alle Zahlen und Zitate in diesem Text stammen aus den unten genannten Quellen.
Die Materialien wurden vom Redaktionsteam mit Unterstützung von KI erstellt.
Kommentare
0- Noch keine Kommentare — seien Sie der Erste.