Grok 4.6 リリース日はいつ?
マスク氏が8月7日を予告

1.5兆パラメータ · SFT/RL後学習 · Kimi K3 / Fable 5.1 比較

Grok 4.6 リリース日はいつ?マスク氏が8月7日を予告
2026年7月28日、イーロン・マスク氏はX上でVercel CEOのGuillermo Rauch氏への返信の中で、xAIが8月7日前後に1.5兆パラメータのGrok 4.6をリリースすると述べました。数週間後には2.1兆パラメータのGrok 4.7も続く見込みです。本記事では、Grok 4.5から4.7までのタイムライン、SFT/RL強化の技術的意味、Kimi K3やClaude Fable 5.1との比較、および第三者検証のない情報の区別を整理します。
01

Grok 4.6のリリースペースはどれほど速いのか

Grok 4.5のリリースからわずか1か月後の予告であり、xAIは2026年夏に3つのフロンティアモデルを連続投入する計画と見られます。現時点ではベンチマークスコアや価格は未公表です。

01

2026年7月8日:xAIがGrok 4.5を正式リリース。Cursorと共同で実際の開発者セッションデータを用いて訓練。50万トークンコンテキスト、入力$2/出力$6(100万トークンあたり)。

02

2026年7月16日〜26日:Moonshot AIのKimi K3がホスト型から完全オープンウェイト(2.8T、100万トークン)へ移行。

03

2026年7月28日:マスク氏がGrok 4.6/4.7のロードマップを公開。同日、OpenAI・Anthropic等の従業員1200名超が「Pacing the Frontier」公開書簡を発表。

04

2026年8月7日前後(目標):Grok 4.6、1.5Tパラメータ、SFT/RL強化が主眼。

05

2026年8月末〜9月初旬(推定):Grok 4.7、2.1Tパラメータ、4.6を上回る能力だが推論速度はやや遅いとの説明。

マスク氏のスケジュールは「Musk time」として知られるように、数日から2週間程度の遅延が珍しくありません。正式発表まではxAI公式チャネルを参照してください。

02

Grok 4.6のスペックと競合モデル比較表

モデル日付パラメータ重点状態
Grok 4.52026年7月8日非公開コーディング・エージェントリリース済
Grok 4.6〜8月7日1.5TSFT/RL強化予告のみ
Grok 4.7〜8月末〜9月初2.1T4.6超、トークン効率向上予告のみ
モデルベンダーパラメータコンテキスト価格(入力/出力、100万トークン)
Grok 4.5xAI非公開500K$2 / $6
Grok 4.6(予告)xAI1.5T非公開非公開
Kimi K3Moonshot AI2.8T(MoE)1M$0.30/$3入力、$15出力
Claude Fable 5.1(噂)Anthropic非公開非公開Fable 5と同額の噂

Grok 4.6の予定日は、Kimi K3の完全オープンウェイト公開から約10日後に位置します。K3はFrontend Code Arenaで1679点を記録し、初のオープンウェイト首位モデルとなりました。

03

なぜxAIはスケールだけでなく後学習を強調するのか

教師あり微調整(SFT)は高品質な出力例でモデルの振る舞いを整形します。強化学習(RL)は報酬信号を通じて多段階のエージェントタスクで正しい行動系列を学習させます。

Grok 4.5はCursorの実開発者セッションで後学習した結果、SWE-Bench Proタスクあたりの出力トークンがOpus 4.8の約6.7万に対し約1.9万と、4.2倍の効率差を示しました。Terminal-Bench 2.1では83.3%、SWE-Bench Proでは64.7%を記録しています。

補足:マスク氏自身もKimi K3のベンチマーク投稿に「印象的」とコメントしています。Artificial Analysisのインテリジェンス指数ではK3は世界3位です。

04

Grok 4.6リリース前の6ステップ評価Runbook

01

情報源の固定:7月28日のX投稿を「非公式予告」として分類し、xAI公式ブログとGrok Buildの告知を監視します。

02

ベースラインの構築:現行のGrok 4.5、Kimi K3 API、Claude Fable 5でSWE-Bench・Terminal-Bench・自社エージェントタスクのトークン消費とレイテンシを記録します。

03

A/Bルーティングの事前設定:APIゲートウェイまたはLiteLLMにGrok 4.6のモデルIDプレースホルダを追加し、24時間以内のグレーリリースを可能にします。

04

トークン効率の再測定:リーダーボード順位より実際の請求コストを優先し、同一タスクで4.6のコストを比較します。

05

デュアルSKU戦略の準備:4.6を「高速」、4.7を「高品質・低速」に分け、レイテンシ敏感型と品質敏感型のワークロードをルーティングで分離します。

06

ベンダーリスクの更新:2026年7月、xAIはCSAM生成を巡る初のユーザー訴訟を提起。Common Sense MediaはGrokを児童保護面で最悪クラスと評価しています。

05

注意すべき論点と2026年8月のリリース集中

A

唯一の情報源はX投稿:xAIの公式ブログ・モデルカード・製品ページは未同期です。

B

ベンチマークと価格は空白:Grok 4.5リリース時の詳細なモデルカードと異なり、4.6には独立評価がありません。

C

業界の「減速」呼びかけとの時期のズレ:「Pacing the Frontier」公開日とGrok 4.6/4.7予告日が同日で、xAIは署名者に含まれていません。

注意:マスク氏のスケジュールが実現すれば、Grok 4.6・4.7は噂のClaude Fable 5.1と同月に登場し、2026年8月はフロンティアモデルリリース密度が最高の月の一つになる可能性があります。

モデル選定の有効期間は数週間単位に短縮されています。ローカルMacでエージェント編成やiOS CI/CDを長時間稼働させる場合、スリープやメモリ制約がボトルネックになります。iOS CI/CDとAIエージェント自動化の本番環境では、MESHLAUNCHのMac Miniクラウドレンタルがより安定した選択肢です。専用Apple Silicon、24時間稼働、日次・週次・月次の柔軟な契約で、推論はAPIに任せ、ビルドと編成はクラウドMacに集約できます。

よくある質問

マスク氏はX上で「8月7日前後」と述べましたが、xAI公式の確認はありません。日程は前後する可能性があります。詳細は料金ページをご覧ください。

4.6は1.5TパラメータでSFT/RL後学習が重点です。4.7は2.1Tで能力は4.6を上回るが推論速度はやや遅く、トークン効率はさらに高いとされています。

現時点では判断できません。4.6には公開ベンチマークがなく、K3は第三者検証済みのスコアがあります。設定はヘルプセンターをご参照ください。

未公表です。Grok 4.5の入力$2/出力$6(100万トークンあたり)が参考値ですが、正式発表まで確定しません。

Grok 4.5の展開経路から、Grok Build、xAI API、xAIコンソールが先行し、Cursor等の第三者プラットフォームが続くと予想されますが、4.6については未確認です。