ModelosSeguridad de IA 🇺🇸 30.07.2026 16:02

Anthropic reporta un 92% de honestidad en Claude Opus 4.7 y menor sicofancia

AnthropicAnthropic
Anthropic anunció que su modelo más reciente, Claude Opus 4.7, alcanza una tasa de honestidad del 92% y muestra menos sicofancia en comparación con versiones anteriores. El modelo está diseñado para proporcionar respuestas más precisas y veraces.
Anthropic ha lanzado Claude Opus 4.7, afirmando que tiene una tasa de honestidad del 92% y muestra un menor servilismo, es decir, que es menos propenso a estar de acuerdo incorrectamente con los usuarios. Esta mejora forma parte del esfuerzo continuo de Anthropic para hacer que los modelos de inteligencia artificial sean más veraces y fiables. El modelo se basa en versiones anteriores de Claude, con el objetivo de proporcionar información más precisa y evitar halagar o engañar a los usuarios.
Fuente: Anthropic (GNews) — original
Nuestros artículos anteriores sobre este tema ↓
Noticias frescas