HyperAIHyperAI

Command Palette

Search for a command to run...

Anthropic détaille le filigrane IA de Claude

Anthropic a confirmé son intention de marquer les textes générés par son modèle d'intelligence artificielle Claude à l'aide d'un système de filigrane numérique. Cette annonce, présentée lors d'une conférence développeurs à San Francisco et détaillée dans un billet publié vendredi, vise principalement à se conformer à la future réglementation européenne sur l'IA. La société précise que cette mesure sera déployée à l'échelle mondiale dès son lancement, faute d'une méthode fiable pour la restreindre géographiquement à l'Europe. Le filigrane s'incorpore directement dans le choix des mots. S'appuyant sur une méthode publiée en 2024 par Google DeepMind, l'algorithme de Claude intègre subtilement des modèles statistiques lors de la sélection de termes équivalents, comme le choix entre joyeux ou enjoué. Ces marques restent invisibles à l'œil nu et ne nécessitent aucun caractère caché. Anthropic prévoit de mettre à disposition une interface de programmation permettant aux développeurs et aux utilisateurs tierces de vérifier la présence de ce filigrane. Malgré cette avancée, Anthropic souligne les limites de sa technologie. Le filigrane identifie spécifiquement les sorties de Claude et ne permet pas de détecter les textes générés par d'autres modèles d'IA. Sa fiabilité diminue également sur les textes factuels ou le code informatique, où la précision terminologique restreint les variations de vocabulaire. L'entreprise précise par ailleurs que ce marquage ne remet pas en cause la propriété intellectuelle des utilisateurs : Claude ne fait qu'analyser ou générer du contenu, dont les droits restent attribués à l'usager. Une modification légère du texte peut ne pas effacer la marque, tandis qu'une réécriture totale la supprime, ce qui remet alors en cause la qualification du contenu comme véritablement généré par l'IA. La révélation a provoqué un certain malaise parmi certains clients, bien qu'Anthropic assure ne pas constater de hausse des résiliations d'abonnement suite à l'annonce. Cette initiative s'inscrit dans une dynamique sectorielle élargie, OpenAI ayant annoncé de son côté des projets similaires. En répondant aux exigences réglementaires européennes, les principaux acteurs du secteur préparent une nouvelle norme de transparence pour les contenus générés par les intelligences artificielles. L'efficacité à long terme de ces filigranes face à la manipulation des textes et leur acceptation par le grand public resteront à évaluer dans les mois à venir.

Liens associés