La société américaine d’intelligence artificielle Anthropic va apposer un filigrane invisible sur les textes générés avec Claude. Ce marquage reste présent lorsqu’un texte est copié puis collé ailleurs, sans être perceptible par les lecteurs.

Comment fonctionne ce filigrane invisible ?

Cette nouvelle fonctionnalité est déployée dans le monde entier pour les nouveaux modèles de Claude. Le filigrane ne concerne pas seulement le chatbot : les textes générés via l’API, Claude Code et les applications professionnelles seront également marqués.

Anthropic n’a pas précisé la technologie exacte utilisée. Dans le domaine des filigranes appliqués à l’IA, les chercheurs recourent souvent à un système dans lequel le modèle privilégie discrètement certains mots au moment de la rédaction.

Pour un lecteur humain, le texte conserve une apparence parfaitement normale. Un système de détection spécifique peut ensuite analyser si certains schémas lexicaux apparaissent plus fréquemment que ne le voudrait le hasard. Il devient ainsi possible d’estimer si un texte a probablement été généré ou modifié par Claude.

Le dispositif comporte toutefois des limites. Dans les textes courts, le nombre de mots peut être insuffisant pour identifier le schéma de manière fiable. Une réécriture importante ou une paraphrase peut aussi supprimer partiellement le filigrane.

Pour les images, Anthropic utilise une autre méthode. Les fichiers PNG, JPG ou SVG reçoivent des métadonnées de provenance numérique conformes à la norme C2PA. Elles permettent d’indiquer que Claude a participé à la création ou à la modification d’un fichier.

Un filigrane ne prouve pas qu’un texte est entièrement généré par l’IA

Anthropic travaille également sur des outils de détection permettant aux utilisateurs et à des tiers de vérifier la présence du filigrane. Une détection positive ne signifie toutefois pas automatiquement qu’un texte entier a été rédigé par l’IA. Claude peut aussi avoir été utilisé pour corriger, traduire ou résumer un texte existant.

Le filigrane indique surtout que Claude a probablement été impliqué dans le contenu. Cette évolution s’inscrit aussi dans le cadre de l’AI Act européen. Ces nouvelles règles de transparence imposent de plus en plus aux fournisseurs de rendre identifiable le contenu généré par l’IA.

Les anciens textes ne seront pas marqués rétroactivement. Seuls les nouveaux contenus produits par Claude après la mise en place du système recevront ce filigrane.

Anthropic franchit ainsi une étape importante vers une meilleure identification des contenus générés par l’IA. Reste à voir, dans la pratique, si le système résistera aux modifications importantes et aux méthodes sophistiquées visant à le contourner.

Albanese Australie

Une IA d’OpenAI s’introduit seule sur un site du gouvernement australien

Albanese Australie
Donald Trump
Xi Jinping
Plus Technologiques news

Le plus lu

near protocol

Le NEAR s’envole de 28 % : voici pourquoi

Le NEAR gagne près de 30 % après le lancement de nouvelles fonctions de confidentialité. Les volumes d’échanges, l’activité du réseau et les revenus progressent également fortement.

Avalanche
Charles Hoskinson