Anthropic va bientôt proposer une API de détection de filigrane permettant aux tiers de vérifier si un texte a été généré par son modèle d’IA, Claude.
Cette technologie s’appuie sur la méthode SynthID de Google, modifiant la part d’aléatoire lors de la sélection des mots. Anthropic assure que cette approche n’altère pas la qualité du texte produit par Claude. L’objectif est d’offrir une traçabilité des contenus générés par intelligence artificielle.
L’API permettra aux développeurs et aux plateformes d’intégrer cette capacité de détection directement dans leurs services. Cependant, Anthropic précise que l’efficacité de cette méthode présente des limites, notamment avec les textes très factuels, le code informatique ou en cas de réécriture intensive du contenu original.
Cette initiative s’inscrit dans un effort plus large de l’industrie pour renforcer la transparence et la responsabilité des contenus générés par IA. Elle soulève la question de l’évolution future des outils de détection face à la sophistication croissante des modèles de langage.
Source : The Decoder