Adoption
Anthropic Intègre la Technologie de Filigrane SynthID-Text de Google dans ses Modèles Claude
Anthropic s'apprête à mettre en œuvre la technologie de filigrane SynthID-Text de Google DeepMind dans tous ses modèles d'IA Claude à partir du 2 août 2026. Cette intégration permettra d'incorporer une empreinte statistique cachée dans le texte généré par l'IA, rendant possible sa détection par quiconque disposant de la clé cryptographique appropriée.
Cette initiative s'inscrit dans le cadre de l'Article 50(2) du Code de Pratique de la Loi sur l'IA de l'UE, qui exige que les sorties d'IA soient identifiables. Il est à noter que ce filigrane sera appliqué à l'échelle mondiale, et pas seulement en Europe.
Fonctionnement de SynthID-Text
SynthID-Text opère au niveau de la sélection des tokens dans le modèle de langage, influençant subtilement le choix des mots sans compromettre la qualité de la sortie. Par exemple, si « nuageux » et « couvert » sont des mots potentiels, le filigrane peut légèrement favoriser « couvert », un changement qui reste statistiquement indétectable pour les lecteurs humains mais identifiable grâce à l'algorithme de détection.
Anthropic affirme que ce filigrane ne dégradera pas la qualité ni la lisibilité du texte. Les propres tests de Google avec SynthID-Text sur son modèle Gemini auraient confirmé cela, sans perte de qualité observée sur 20 millions de réponses. Le filigrane reste intact même après de légères modifications ou paraphrases, ne se dégradant que lors de réécritures importantes.
Implications Plus Larges
Cette annonce intervient dans un contexte de pression réglementaire plus large, avec de grandes entreprises technologiques comme Google, Meta, Microsoft et OpenAI s'engageant à des mesures similaires concernant la provenance des contenus. Anthropic prévoit de retrofitter les modèles Claude existants avec le filigrane d'ici le 2 décembre 2026 et intégrera également des métadonnées C2PA pour les fichiers image pris en charge.
Cependant, de nouvelles recherches indiquent que le processus de filigranage pourrait affecter involontairement d'autres aspects du comportement du modèle, tels que les outils qu'il utilise lors de la génération de texte et son respect des protocoles de sécurité. Anthropic se prépare à lancer une API de détection pour permettre aux tiers de vérifier si un texte a été généré par Claude.
FAQ
Qu'est-ce que SynthID-Text et comment cela fonctionne-t-il ?
SynthID-Text est une technologie de marquage développée par Google DeepMind qui intègre une empreinte statistique cachée dans le texte généré par l'IA. Elle fonctionne au niveau de la sélection des tokens du modèle de langage, influençant subtilement le choix des mots pour créer un marquage qui est statistiquement indétectable pour les lecteurs humains mais identifiable grâce à un algorithme de détection.
Quand Anthropic mettra-t-il en œuvre SynthID-Text dans ses modèles Claude ?
Anthropic prévoit de mettre en œuvre la technologie de marquage SynthID-Text de Google DeepMind dans tous ses modèles d'IA Claude à partir du 2 août 2026.
Le marquage affectera-t-il la qualité du texte généré par les modèles Claude ?
Anthropic affirme que le marquage ne dégradera pas la qualité ou la lisibilité du texte. Les tests de Google avec SynthID-Text sur son modèle Gemini n'ont montré aucune perte de qualité sur 20 millions de réponses.
Quelles sont les implications plus larges de cette technologie de marquage ?
L'intégration de SynthID-Text s'aligne avec des mesures réglementaires telles que l'Article 50(2) du Code de Pratique de la Loi sur l'IA de l'UE, qui exige que les sorties de l'IA soient identifiables. De grandes entreprises technologiques s'engagent également à des mesures similaires de provenance du contenu, reflétant une poussée plus large pour la transparence dans le contenu généré par l'IA.
Y aura-t-il un moyen de vérifier si un texte a été généré par Claude ?
Oui, Anthropic se prépare à lancer une API de détection pour les tiers, leur permettant de vérifier si un texte a été généré par Claude, garantissant ainsi la responsabilité et la traçabilité dans le contenu généré par l'IA.