AI 안전규제 🇺🇸 15.08.2026 22:01

Anthropic, EU AI 법 준수 및 사용자 반발 속에서 Claude의 워터마킹 방식 설명

AnthropicAnthropic
Anthropic은 Claude에 대한 워터마킹이 어떻게 작동하는지 설명하는 블로그 게시물을 게시하여 사용자 우려를 해소하고 EU AI 법을 준수하고자 합니다. 회사는 SynthID-Text를 사용하고 탐지 API를 출시할 예정이며, 과도한 편집은 워터마크를 제거할 수 있음을 인정했습니다.
Anthropic는 금요일 블로그 게시물을 통해 자사 챗봇 Claude가 생성한 텍스트에 워터마크를 적용하는 방법을 자세히 설명했습니다. 이번 조치는 EU AI 법의 투명성 강령을 준수하기 위해 이번 주 초에 발표된 것으로, 일부 사용자들은 Reddit에서 이를 음모론이라고 부르고, X에서는 구독을 취소하는 등 논란을 불러일으켰습니다. 게시물에 따르면 Claude는 'overcast'와 'grey' 같은 중요도가 낮은 단어 선택에서 감지할 수 없는 패턴을 만들어 내며, 이는 키를 사용하여 감지할 수 있습니다. Anthropic은 Google DeepMind의 SynthID-Text 접근 방식을 사용할 예정이며, 워터마크 감지 API를 공개할 계획입니다. 또한 이 회사는 워터마킹을 Pangram과 같은 AI 감지 방법과 구분했는데, 후자는 문체상의 '특징'을 찾는 방법입니다. 회사는 모든 워터마크 단어를 제거하는 완전한 재작성은 워터마크를 제거할 수 있지만, 가벼운 편집은 아마 그렇지 않을 것이라고 인정했습니다. 교정되거나 편집된 텍스트의 경우, 워터마크의 존재 여부는 편집의 길이와 범위에 따라 달라집니다. 코드는 모델이 기능적인 코드를 생성해야 하기 때문에 워터마크가 적게 포함되지만, 주석에는 워터마크가 포함될 수 있습니다. 마지막으로 Anthropic은 다른 주요 모델 개발사들도 동일한 행동 강령에 서명했으며 자체 워터마크를 구현할 것이라고 언급했습니다.
출처: TechCrunch AI — 원문
관련 게시물 ↓
새로운 뉴스