RégulationSécurité de l'IA 🇷🇺 11.08.2026 13:02

Anthropic, OpenAI et Google vont marquer les textes générés avec des filigranes IA invisibles

AnthropicAnthropic OpenAIOpenAI Google/DeepMindGoogle/DeepMind MicrosoftMicrosoft MistralMistral MetaMeta
Anthropic, OpenAI et Google mettent en œuvre des filigranes IA invisibles pour les textes générés, afin de se conformer à l'article 50 de la loi européenne sur l'intelligence artificielle (AI Act), qui est entrée en vigueur. Cette réglementation impose aux fournisseurs de marquer les contenus synthétiques, avec des amendes en cas de non-conformité. Cependant, les outils de vérification ne sont pas encore tous disponibles publiquement.
Anthropic a mis à jour sa documentation pour indiquer que Claude intégrera des filigranes invisibles dans les textes générés au niveau du modèle, qui survivent au copier-coller et aux modifications, et ajoutera également des métadonnées C2PA aux fichiers et images générés. Cela s'appliquera à tous les modèles Claude lancés à partir du 2 août 2026, avec une période de transition pour les modèles actuels, apparemment pour s'aligner sur la loi européenne sur l'IA, et sera déployé mondialement, pas seulement dans l'UE. L'article 50 de la loi sur l'IA, en vigueur à partir du 2 août 2026, impose aux fournisseurs d'IA générative de marquer les sorties comme contenu synthétique lisible par machine et exige des déployeurs de divulguer les deepfakes et les textes générés sur des sujets d'intérêt public. La Commission européenne a émis un code de pratique en deux sections (fournisseurs et déployeurs) avec signature volontaire mais conformité obligatoire, avec des amendes allant jusqu'à 15 millions d'euros ou 3% du chiffre d'affaires mondial. Environ 190 organisations ont signé, dont Google, Microsoft, OpenAI, Anthropic, Mistral et Meta (interdit en Russie comme extrémiste) dans la section des fournisseurs, tandis que des déployeurs comme Getty Images, Lufthansa, Bulgari, Lenovo, Iberdrola et des sites d'information grecs ont signé, mais pas les grandes plateformes technologiques. Les personnes ne peuvent pas détecter visuellement ces filigranes ; par exemple, SynthID de Google cache des filigranes dans le modèle de choix de mots, pas dans des caractères invisibles spéciaux. Le texte note également que le texte généré par l'IA peut être exempté d'étiquetage s'il subit une édition humaine avec responsabilité, et que les détecteurs actuels comme GPTZero ne sont pas fiables, car un test a identifié à tort une sortie Gemini comme écrite par un humain. OpenAI a lancé un vérificateur public avec API pour les images et l'audio, mais pas encore pour le texte, tandis que Google fournit la détection SynthID uniquement à certains médias et chercheurs. L'article mentionne que X étiquette automatiquement le contenu IA, et LinkedIn a un bouton pour le contenu ressemblant à de la 'slop' IA.
Source: Habr — хаб ИИ — original
Nos articles précédents sur ce sujet ↓
Infos fraîches