SpaceXAI、Grok 4.6をリリース:500Kコンテキスト、新しいxhigh推論、GPT-5.6 Sol Maxに匹敵
OpenAI
Anthropic
SpaceXAIは、Grok 4.5のポストトレーニングアップグレードであるGrok 4.6をリリースしました。500Kトークンのコンテキストウィンドウと、新しいxhigh推論努力レベルを特徴としています。このモデルは、Artificial Analysis Intelligence Indexでわずかな改善を示していますが、主要なコーディングベンチマークでは遅れを取っています。API、Cursor、Grok Buildで利用可能で、価格帯は200Kプロンプトトークンを超えると2倍になります。
SpaceXAIは、Grok 4.5のポストトレーニングアップグレードとしてGrok 4.6を発表しました。ベースモデルは変更せず、追加のトレーニング、再生成された教師ありファインチューニングの軌跡、およびエージェント環境での強化学習を通じて改善しています。このモデルは、Artificial Analysis Intelligence Indexで56から61にスコアを上げ、GPT-5.6 Sol Maxと並びましたが、DeepSWE(65.9%対73%)やTerminal-Bench(26%、Grok 4.5の15.7%の2倍)などのコーディングベンチマークでは遅れを取っています。コンテキスト長は50万トークンで、テキストと画像の入力、テキストのみの出力に対応し、xhigh推論努力レベルが追加されました。これは、xAI APIでgrok-4.6として利用可能であり、Grok Build、Cursor、OpenRouter、Vercel、Cloudflareでも提供されていますが、オープンウェイトやセルフホスティングは提供されていません。価格は、プロンプトトークンが20万未満の場合、入力100万トークンあたり2ドル、キャッシュ入力100万トークンあたり0.50ドル、出力100万トークンあたり6ドルから始まり、それを超えると倍になります。この記事は、GDPval-AAとAA-Briefcaseでの太字の勝利は信頼区間内の統計的同点であり、比較にはClaude Opus 5が含まれていないことを指摘しています。
出典: MarkTechPost —
原文
