AnthropicのOpus 5:トークン効率に焦点、機能の飛躍はなし
Anthropic
OpenAI
Anthropicは、モデルの新バージョンであるOpus 5をリリースしました。主な重点はコスト効率にあり、このモデルはより強力なFableとほぼ同等の性能を、約半額の価格で提供します。ベンチマークでは、Opus 5は段階的な改善を示していますが、トレーニングの特性によりサイバーセキュリティタスクでは遅れをとっています。
Anthropicは、プログラミングと開発に人気のモデルの最新アップデートであるOpus 5を発表しました。このリリースは、エージェンティックコーディングにおけるOpus 4.5のような画期的なものではありません。Anthropicのグラフによると、Opus 5はコーディングタスクでFableモデルと同等の結果を達成し、ほぼすべてのテストでOpus 4.8やOpenAI GPT-5.6-Solを上回っていますが、性能向上は革新的というより段階的なものです。主な利点はコストです。Opus 5はFableに近い性能を約半額で提供します。一方、Anthropicは意図的にOpus 5を高度なサイバーセキュリティタスクで訓練しなかったため、この分野ではFableやMythosに大きく劣ります。Opus 5は脆弱性の発見にはそこそこ優れていますが、悪用においてはMythos 5に大幅に及びません。また、Fableとは異なり、Opus 5にはインシデント分析のための30日間のデータ保持のような厳格なセーフガードはありません。
出典: Ars Technica —
原文
