Qwen3.8-27Bがオープンソース化:コンシューマー向けGPUで「Opusレベルの」エージェントが動作し、複数のベンチマークでClaudeを上回る
Alibaba/Qwen
Anthropic
AlibabaのQwen3.8-27Bが正式にオープンソース化され、270億パラメータ、ネイティブなマルチモーダルサポート、最大100万トークンのコンテキストを特徴としています。これは、いくつかのソフトウェアエンジニアリングおよびエージェントベンチマークでClaude Opus 4.6 Maxを上回り、ハイエンドのコンシューマー向けGPUでのローカル実行を可能にします。このモデルには、調整可能な推論努力と長いコンテキストタスク向けの最適化が含まれています。
アリババは、270億パラメータのオープンソースモデルQwen3.8-27Bをリリースしました。公式ベンチマークでは、ソフトウェアエンジニアリングとエージェントタスクにおいて、Claude Opus 4.6 Maxを上回り、SWE-bench Proで8.3ポイント、QwenSWEBenchで15.2ポイントのリードを示しています。エージェント評価では、CoWorkBenchで70.7点に対しOpusは68.2点、マルチモーダルなコンピュータ・電話操作テストでは、OSWorld-Verifiedで84.3点、AndroidWorldで81.9点を達成し、Opusの72.7点と62.0点を上回りました。このモデルは、ネイティブなマルチモーダル理解をサポートし、ネイティブなコンテキストは262Kトークンで、100万まで拡張可能です。また、推論の努力レベル(xhigh、medium、low)の調整や、エージェントタスク用のpreserve_thinkingも含まれています。そのアーキテクチャは、Gated DeltaNet線形アテンションの48層とフルアテンションの16層を使用しており、長いコンテキストを可能にしています。Transformers、vLLM、SGLang、TokenSpeedと互換性があり、量子化版はHugging Faceで利用可能で、RTX 3090/4090などのコンシューマーGPUやApple Macでの展開が可能です。コミュニティテストでは、コーディングとマルチモーダルな能力が実証されており、NVIDIA GH200での高並行性の安定性や、長いビデオの処理が含まれます。
出典: QbitAI 量子位 —
原文
