Newsbit
Voir l'application
Voir

La société américaine d’intelligence artificielle Anthropic va apposer un filigrane invisible sur les textes générés avec Claude. Ce marquage reste présent lorsqu’un texte est copié puis collé ailleurs, sans être perceptible par les lecteurs.

Comment fonctionne ce filigrane invisible ?

Cette nouvelle fonctionnalité est déployée dans le monde entier pour les nouveaux modèles de Claude. Le filigrane ne concerne pas seulement le chatbot : les textes générés via l’API, Claude Code et les applications professionnelles seront également marqués.

Anthropic n’a pas précisé la technologie exacte utilisée. Dans le domaine des filigranes appliqués à l’IA, les chercheurs recourent souvent à un système dans lequel le modèle privilégie discrètement certains mots au moment de la rédaction.

Pour un lecteur humain, le texte conserve une apparence parfaitement normale. Un système de détection spécifique peut ensuite analyser si certains schémas lexicaux apparaissent plus fréquemment que ne le voudrait le hasard. Il devient ainsi possible d’estimer si un texte a probablement été généré ou modifié par Claude.

Le dispositif comporte toutefois des limites. Dans les textes courts, le nombre de mots peut être insuffisant pour identifier le schéma de manière fiable. Une réécriture importante ou une paraphrase peut aussi supprimer partiellement le filigrane.

Pour les images, Anthropic utilise une autre méthode. Les fichiers PNG, JPG ou SVG reçoivent des métadonnées de provenance numérique conformes à la norme C2PA. Elles permettent d’indiquer que Claude a participé à la création ou à la modification d’un fichier.

Un filigrane ne prouve pas qu’un texte est entièrement généré par l’IA

Anthropic travaille également sur des outils de détection permettant aux utilisateurs et à des tiers de vérifier la présence du filigrane. Une détection positive ne signifie toutefois pas automatiquement qu’un texte entier a été rédigé par l’IA. Claude peut aussi avoir été utilisé pour corriger, traduire ou résumer un texte existant.

Le filigrane indique surtout que Claude a probablement été impliqué dans le contenu. Cette évolution s’inscrit aussi dans le cadre de l’AI Act européen. Ces nouvelles règles de transparence imposent de plus en plus aux fournisseurs de rendre identifiable le contenu généré par l’IA.

Les anciens textes ne seront pas marqués rétroactivement. Seuls les nouveaux contenus produits par Claude après la mise en place du système recevront ce filigrane.

Anthropic franchit ainsi une étape importante vers une meilleure identification des contenus générés par l’IA. Reste à voir, dans la pratique, si le système résistera aux modifications importantes et aux méthodes sophistiquées visant à le contourner.

Time, IA

Rabobank : l’IA n’est plus une promesse, mais une source de revenus

Time, IA
Robot IA

Les robots arrivent, encore une fois

Pourquoi l’IA nous fait-elle si peur ? Dans cette chronique, on comprend pourquoi cette inquiétude est légitime, sans pour autant résumer toute l’histoire.

Nvidia
Plus Technologiques news

Le plus lu

Opérations SWIFT
Brad Garlinghouse, Swell
Cardano