Filigrane invisible dans le texte : comment les entreprises répondent aux obligations de l'AI Act
Depuis le 2 août, les créateurs de systèmes génératifs doivent signaler les contenus IA de façon lisible par machine. Anthropic étend ce marquage à d'autres modèles Claude, mais l'outil a ses limites.

Marquer les contenus générés par l'IA ressemble à une question d'honnêteté envers le lecteur. Dans les faits, c'est un problème technique que le secteur gère de façons très diverses. heise online raconte comment Anthropic étend le marquage du texte à d'autres modèles Claude, sur fond d'exigences du règlement européen sur l'intelligence artificielle.
Selon heise, à partir du 30 septembre 2026, un filigrane invisible sera aussi apposé sur les résultats des modèles Claude Fable 5, Claude Sonnet 5 et Claude Opus 4.8. Claude Fable 5.1, Claude Mythos 5.1, Claude Opus 5.5 et Claude Opus 5 le sont déjà, ce dernier ayant été marqué lors d'une mise à jour après le lancement. Les modèles plus anciens doivent être complétés d'ici le 2 décembre. L'information vient d'un e-mail qu'Anthropic a envoyé à ses clients le 24 septembre. Détail important : la marque est appliquée au niveau du modèle et l'utilisateur ne peut pas la désactiver.
Comment cela fonctionne
La méthode ne repose ni sur des signes cachés ni sur des métadonnées faciles à supprimer. Anthropic utilise sa propre variante de la technique SynthID-Text développée par Google DeepMind : le mécanisme influence le choix de l'un de plusieurs tokens suivants également probables. Sur un texte long, il se forme un motif statistique détectable avec la bonne clé, à condition que l'extrait analysé soit assez long. L'entreprise affirme que cela ne dégrade pas la qualité du texte.
Les limites sont plus sérieuses que ne le suggère la simplicité de l'idée, et Anthropic les reconnaît elle-même. Une détection indique seulement que Claude a probablement participé à la création du texte. Le modèle peut réécrire un passage d'un autre auteur, ajouter ses propres phrases ou traduire un texte étranger : la marque disparaît. Ce n'est donc pas un outil de preuve, mais un signal de probabilité.
D'où vient l'obligation
La raison est réglementaire. L'AI Act européen impose des obligations de transparence aux créateurs de systèmes génératifs : depuis le 2 août, ils doivent veiller à ce que les contenus générés par l'IA, textes compris, soient marqués de manière lisible par machine et identifiables comme générés. Anthropic applique sa solution à l'échelle mondiale, sur toutes les plateformes Claude, même si l'initiative est venue d'Europe.
Un contexte institutionnel s'ajoute. La Commission européenne gère un Bureau de l'IA, plus de 125 employés répartis en six unités, chargé de la mise en œuvre de l'AI Act, dont les règles pour les modèles à usage général. Il peut notamment mener des évaluations de ces modèles, demander des informations et imposer des sanctions. L'obligation de marquage n'est donc qu'une exigence parmi d'autres que les fournisseurs de modèles doivent intégrer dans leur processus de production.
Est-ce que cela marche vraiment
La critique vient de deux côtés. D'un côté, des praticiens font remarquer que les filigranes dans le texte cèdent à une simple édition et s'effacent facilement par une traduction ou un résumé. De l'autre, la question inverse se pose : que se passe-t-il si la marque est détectée dans un texte qu'une personne a écrit elle-même, en utilisant le modèle seulement pour corriger ? Le sens de « marqué comme IA » se brouille alors et l'accusation injustifiée devient facile. Le plus sûr est de lire ce mécanisme comme un outil de surveillance statistique des contenus à l'échelle d'internet, et non comme un moyen de trancher sur la paternité d'un paragraphe.
Sources
2- 01heise: Wasserzeichen für KI-Texte – Anthropic weitet Anwendung ausDE
- 02European AI Office – European CommissionEN
Tous les chiffres et citations de ce texte proviennent des sources citées ci-dessous.
Les contenus ont été préparés par l'équipe de rédaction, assistée par l'IA.
Commentaires
0- Aucun commentaire — soyez le premier.