Anthropic: честность Claude Opus 4.7 достигла 92%, а подхалимство снизилось
Anthropic
Компания Anthropic сообщила, что её новая модель Claude Opus 4.7 демонстрирует 92% честных ответов и значительно меньше склонности к подхалимству (sycophancy) по сравнению с предыдущими версиями.
Anthropic объявила, что её последняя модель ИИ Claude Opus 4.7 достигла показателя честности в 92% — то есть в 92% случаев модель даёт ответы, соответствующие фактам, без искажений. Кроме того, разработчики отметили существенное снижение sycophancy (склонности ИИ подстраиваться под мнение пользователя, даже если оно неверно). Это стало возможным благодаря улучшенным методам обучения и калибровки модели. В компании подчеркнули, что борьба с sycophancy — один из ключевых приоритетов для создания более надёжных и беспристрастных систем ИИ. Claude Opus 4.7 доступен через API и веб-интерфейс.
Источник: Anthropic (GNews) —
оригинал
