Anthropic a récemment détaillé le fonctionnement de ses futurs filigranes numériques, destinés à marquer le contenu généré par son modèle d’intelligence artificielle, Claude. Ces précisions visent à éclaircir la manière dont ces marques invisibles seront intégrées et leur résilience face aux modifications.
Le système de filigranage d’Anthropic repose sur l’intégration de motifs statistiques subtils dans le texte produit par Claude, imperceptibles à l’œil humain. L’objectif est de permettre l’identification du contenu issu de l’IA, contribuant ainsi à la transparence et à la lutte contre la désinformation. Ces filigranes sont conçus pour résister à des modifications mineures, mais une édition substantielle du texte pourrait potentiellement les masquer.
Concernant le code informatique, Anthropic admet que l’efficacité de cette méthode est moindre. La nature structurée et syntaxique du code rend difficile l’insertion de filigranes sans altérer sa fonctionnalité ou le rendre trop évident. Cette limitation souligne les défis techniques inhérents à l’application uniforme de telles mesures de traçabilité à travers différents types de contenus générés par l’IA. L’initiative d’Anthropic marque une étape vers une meilleure attribution, mais elle soulève des questions sur l’efficacité réelle de ces mesures face à l’évolution des techniques de manipulation de contenu.
Source : TechCrunch AI