モデル 🇷🇺 13.08.2026 16:04

Grok 4.6 リリース:ベンチマークと長時間タスクの価格

SpaceXAI は、500K コンテキストトークン、4 つの推論モードを備え、長期的なエージェント作業に焦点を当てた Grok 4.6 をリリースしました。初期のテストでは、上位の競合他社と同等の性能を示し、CursorBench で平均コスト 1 タスクあたり 2.81 ドルでトップに立っています。ただし、200K トークンを超えるコンテキストでは価格が 2 倍になります。
8月12日、SpaceXAIはGrok 4.6をリリースした。このモデルは、50万トークンのコンテキスト、4つの推論モード、そして拡張エージェントワークへの明確な焦点を備えている。初期のベンチマークでは、このモデルは最強の競合他社と同等の性能を示し、CursorBenchでは平均タスクコスト2.81ドルで首位に立っている。この数字は魅力的に見えるが、長いコンテキストは隠れた追加コストとして機能する。20万トークンを超えると、レートは2倍になる。この記事では、モデルが本当に改善した点、長時間実行のコスト、そして今すぐ試すべきユーザーについて考察する。
出典: Habr — хаб ИИ — 原文
関連記事 ↓
新着ニュース