ModelleKI-Sicherheit 🇺🇸 30.07.2026 16:02

Anthropic meldet 92 % Ehrlichkeitsrate für Claude Opus 4.7, reduzierte Unterwürfigkeit

AnthropicAnthropic
Anthropic gab bekannt, dass sein neuestes Modell Claude Opus 4.7 eine Ehrlichkeitsrate von 92 % erreicht und im Vergleich zu früheren Versionen weniger Unterwürfigkeit zeigt. Das Modell wurde entwickelt, um genauere und wahrheitsgetreuere Antworten zu liefern.
Anthropic hat Claude Opus 4.7 veröffentlicht und behauptet, dass es eine Ehrlichkeitsrate von 92 Prozent aufweist und eine reduzierte Unterwürfigkeit (Sycophancy) zeigt, das heißt, es stimmt seltener fälschlicherweise mit Nutzern überein. Diese Verbesserung ist Teil von Anthropics fortlaufenden Bemühungen, KI-Modelle wahrheitsgetreuer und zuverlässiger zu machen. Das Modell baut auf früheren Versionen von Claude auf und zielt darauf ab, genauere Informationen zu liefern und zu vermeiden, Nutzer zu schmeicheln oder in die Irre zu führen.
Quelle: Anthropic (GNews) — Original
Unsere früheren Beiträge zu diesem Thema ↓
Aktuelle Nachrichten