Anthropic détaille l'approche de tatouage de Claude face à la conformité avec l'AI Act européen et aux réactions des utilisateurs
Anthropic
Anthropic a publié un article de blog expliquant comment fonctionnera son tatouage pour Claude, afin de répondre aux préoccupations des utilisateurs et de se conformer à l'AI Act européen. L'entreprise utilisera SynthID-Text et publiera une API de détection, tout en reconnaissant qu'une édition intensive peut supprimer les tatouages.
Anthropic a publié un article de blog vendredi détaillant le filigrane des textes générés par son chatbot Claude. Cette décision, annoncée plus tôt cette semaine pour se conformer au Code de transparence de la loi européenne sur l'IA, a suscité des débats parmi les utilisateurs, certains sur Reddit évoquant une conspiration et d'autres sur X annulant leurs abonnements. L'article explique que Claude crée des schémas indétectables dans les choix de mots à faible enjeu, comme entre « overcast » et « grey », qui peuvent être détectés à l'aide d'une clé. Anthropic utilisera l'approche SynthID-Text de Google DeepMind et prévoit de publier une API de détection de filigrane. Il distingue également le filigrane des méthodes de détection d'IA comme celles de Pangram, qui recherchent des « indices » stylistiques. L'entreprise a admis qu'une réécriture complète éliminant chaque mot filigrané supprimerait le filigrane, mais qu'une légère édition ne le ferait probablement pas. Pour les textes relus ou édités, la présence du filigrane dépend de la longueur et de l'ampleur des modifications. Le code sera moins filigrané car le modèle doit produire un code fonctionnel, bien que les commentaires puissent contenir des filigranes. Enfin, Anthropic a noté que d'autres grands développeurs de modèles ont signé le même Code de pratique et mettront en œuvre leurs propres filigranes.
Source: TechCrunch AI —
original
