Grok 4.6 リリース:エージェント型 AI の強化、ベンチマーク改善、Cursor と Grok Build で利用可能に
xAI
xAI は、AI モデルのアップグレード版である Grok 4.6 をリリースしました。これは、長時間実行されるエージェントや複雑な対話・視覚タスクに焦点を当てています。このモデルは、いくつかのベンチマークで競争力のあるパフォーマンスを示し、時には GPT-5.6 Sol や Fable 5 に匹敵またはそれを上回ります。Grok 4.6 は Cursor と Grok Build で利用可能で、API アクセスやパートナープラットフォームも提供されています。
xAIはGrok 4.6を発表しました。これはGrok 4.5を基盤に、長時間のエージェントタスク向けの機能が強化され、研究、コーディング、アイデアを洗練されたアプリケーションに変換するなど、複雑なマルチステッププロセスの処理能力が向上しています。このモデルは、厳選されたモデル生成データを使用した追加トレーニングの延長フェーズ、改善されたオプティマイザー、更新された方法論を用いてトレーニングされ、その後に教師ありファインチューニング(SFT)と強化学習(RL)のフェーズが続きました。自己チェックと検証の能力を示し、製品アイデアを特にビジュアルおよびインタラクティブなプロジェクトで動作するプロトタイプに変換することに優れています。安全性メカニズムはアップグレードおよび調整され、モデルはxAI史上最も広範なテストを受けました。ベンチマーク結果では、Grok 4.6 HighがAAインテリジェンスインデックス61、GDPVal-AA v2 1753、CursorBench v3.2 69.9%、DeepSWE v1.1 65.9%、FrontierCode v1.1(拡張版)61.3%、APEX-Agents 57.5%、Terminal-Bench v3.0 26%、APEX-SWE 56.4%、AA-Briefcase 1577、Harvey LAB(Vals)15.8%を達成しました。Grok 4.6はCursorとGrok Buildで利用可能になり、APIおよびOpenRouter、Vercel、Cloudflareなどのパートナープラットフォームでも提供されています。価格は入力トークン100万個あたり2ドル、出力トークン100万個あたり6ドルからで、高速版は2倍の料金です。初週はGrok BuildとCursorでの利用枠が2倍になります。
出典: Habr — хаб ИИ —
原文
