Grok 4.6のリリースペースはどれほど速いのか
Grok 4.5のリリースからわずか1か月後の予告であり、xAIは2026年夏に3つのフロンティアモデルを連続投入する計画と見られます。現時点ではベンチマークスコアや価格は未公表です。
2026年7月8日:xAIがGrok 4.5を正式リリース。Cursorと共同で実際の開発者セッションデータを用いて訓練。50万トークンコンテキスト、入力$2/出力$6(100万トークンあたり)。
2026年7月16日〜26日:Moonshot AIのKimi K3がホスト型から完全オープンウェイト(2.8T、100万トークン)へ移行。
2026年7月28日:マスク氏がGrok 4.6/4.7のロードマップを公開。同日、OpenAI・Anthropic等の従業員1200名超が「Pacing the Frontier」公開書簡を発表。
2026年8月7日前後(目標):Grok 4.6、1.5Tパラメータ、SFT/RL強化が主眼。
2026年8月末〜9月初旬(推定):Grok 4.7、2.1Tパラメータ、4.6を上回る能力だが推論速度はやや遅いとの説明。
マスク氏のスケジュールは「Musk time」として知られるように、数日から2週間程度の遅延が珍しくありません。正式発表まではxAI公式チャネルを参照してください。
Grok 4.6のスペックと競合モデル比較表
| モデル | 日付 | パラメータ | 重点 | 状態 |
|---|---|---|---|---|
| Grok 4.5 | 2026年7月8日 | 非公開 | コーディング・エージェント | リリース済 |
| Grok 4.6 | 〜8月7日 | 1.5T | SFT/RL強化 | 予告のみ |
| Grok 4.7 | 〜8月末〜9月初 | 2.1T | 4.6超、トークン効率向上 | 予告のみ |
| モデル | ベンダー | パラメータ | コンテキスト | 価格(入力/出力、100万トークン) |
|---|---|---|---|---|
| Grok 4.5 | xAI | 非公開 | 500K | $2 / $6 |
| Grok 4.6(予告) | xAI | 1.5T | 非公開 | 非公開 |
| Kimi K3 | Moonshot AI | 2.8T(MoE) | 1M | $0.30/$3入力、$15出力 |
| Claude Fable 5.1(噂) | Anthropic | 非公開 | 非公開 | Fable 5と同額の噂 |
Grok 4.6の予定日は、Kimi K3の完全オープンウェイト公開から約10日後に位置します。K3はFrontend Code Arenaで1679点を記録し、初のオープンウェイト首位モデルとなりました。
なぜxAIはスケールだけでなく後学習を強調するのか
教師あり微調整(SFT)は高品質な出力例でモデルの振る舞いを整形します。強化学習(RL)は報酬信号を通じて多段階のエージェントタスクで正しい行動系列を学習させます。
Grok 4.5はCursorの実開発者セッションで後学習した結果、SWE-Bench Proタスクあたりの出力トークンがOpus 4.8の約6.7万に対し約1.9万と、4.2倍の効率差を示しました。Terminal-Bench 2.1では83.3%、SWE-Bench Proでは64.7%を記録しています。
補足:マスク氏自身もKimi K3のベンチマーク投稿に「印象的」とコメントしています。Artificial Analysisのインテリジェンス指数ではK3は世界3位です。
Grok 4.6リリース前の6ステップ評価Runbook
情報源の固定:7月28日のX投稿を「非公式予告」として分類し、xAI公式ブログとGrok Buildの告知を監視します。
ベースラインの構築:現行のGrok 4.5、Kimi K3 API、Claude Fable 5でSWE-Bench・Terminal-Bench・自社エージェントタスクのトークン消費とレイテンシを記録します。
A/Bルーティングの事前設定:APIゲートウェイまたはLiteLLMにGrok 4.6のモデルIDプレースホルダを追加し、24時間以内のグレーリリースを可能にします。
トークン効率の再測定:リーダーボード順位より実際の請求コストを優先し、同一タスクで4.6のコストを比較します。
デュアルSKU戦略の準備:4.6を「高速」、4.7を「高品質・低速」に分け、レイテンシ敏感型と品質敏感型のワークロードをルーティングで分離します。
ベンダーリスクの更新:2026年7月、xAIはCSAM生成を巡る初のユーザー訴訟を提起。Common Sense MediaはGrokを児童保護面で最悪クラスと評価しています。
注意すべき論点と2026年8月のリリース集中
唯一の情報源はX投稿:xAIの公式ブログ・モデルカード・製品ページは未同期です。
ベンチマークと価格は空白:Grok 4.5リリース時の詳細なモデルカードと異なり、4.6には独立評価がありません。
業界の「減速」呼びかけとの時期のズレ:「Pacing the Frontier」公開日とGrok 4.6/4.7予告日が同日で、xAIは署名者に含まれていません。
注意:マスク氏のスケジュールが実現すれば、Grok 4.6・4.7は噂のClaude Fable 5.1と同月に登場し、2026年8月はフロンティアモデルリリース密度が最高の月の一つになる可能性があります。
モデル選定の有効期間は数週間単位に短縮されています。ローカルMacでエージェント編成やiOS CI/CDを長時間稼働させる場合、スリープやメモリ制約がボトルネックになります。iOS CI/CDとAIエージェント自動化の本番環境では、MESHLAUNCHのMac Miniクラウドレンタルがより安定した選択肢です。専用Apple Silicon、24時間稼働、日次・週次・月次の柔軟な契約で、推論はAPIに任せ、ビルドと編成はクラウドMacに集約できます。
マスク氏はX上で「8月7日前後」と述べましたが、xAI公式の確認はありません。日程は前後する可能性があります。詳細は料金ページをご覧ください。
4.6は1.5TパラメータでSFT/RL後学習が重点です。4.7は2.1Tで能力は4.6を上回るが推論速度はやや遅く、トークン効率はさらに高いとされています。
現時点では判断できません。4.6には公開ベンチマークがなく、K3は第三者検証済みのスコアがあります。設定はヘルプセンターをご参照ください。
未公表です。Grok 4.5の入力$2/出力$6(100万トークンあたり)が参考値ですが、正式発表まで確定しません。
Grok 4.5の展開経路から、Grok Build、xAI API、xAIコンソールが先行し、Cursor等の第三者プラットフォームが続くと予想されますが、4.6については未確認です。