모델AI 안전 🇺🇸 30.07.2026 16:02

Anthropic, Claude Opus 4.7의 정직률 92% 보고, 아첨 감소

AnthropicAnthropic
Anthropic은 최신 모델인 Claude Opus 4.7이 이전 버전에 비해 92%의 정직률을 달성하고 아첨(아첨 행동)이 감소했다고 발표했습니다. 이 모델은 보다 정확하고 진실된 응답을 제공하도록 설계되었습니다.
Anthropic이 클로드 오퍼스 4.7(Claude Opus 4.7)을 출시했으며, 92%의 정직률(즉, 거짓말을 하지 않을 확률)을 자랑하고 아첨 행동(sycophancy, 사용자에게 잘못 동의하는 경향)이 줄었다고 주장합니다. 이는 AI 모델을 더욱 진실되고 신뢰할 수 있게 만들기 위한 Anthropic의 지속적인 노력의 일환입니다. 이 모델은 이전 버전의 클로드를 기반으로 하여, 보다 정확한 정보를 제공하고 사용자를 아첨하거나 오도하는 것을 피하는 것을 목표로 합니다.
출처: Anthropic (GNews) — 원문
관련 게시물 ↓
새로운 뉴스