Grok 4.6什麼時候發布?
馬斯克預告8月7日上線

1.5萬億參數 · SFT/RL 後訓練升級 · 與 Kimi K3 / Fable 5.1 競品橫評

Grok 4.6什麼時候發布?馬斯克預告8月7日上線,參數升至1.5萬億
馬斯克 7 月 28 日在 X 上回覆 Vercel CEO Guillermo Rauch 時透露,xAI 將於 8 月 7 日前後發布參數規模達 1.5 萬億的 Grok 4.6,隨後幾週內還會推出 2.1 萬億參數的 Grok 4.7。本文面向正在評估模型選型視窗的技術團隊,梳理 Grok 4.5→4.6→4.7 時間線、SFT/RL 升級含義、與 Kimi K3 及 Claude Fable 5.1 的橫向對比,並標註所有未經第三方驗證的資訊來源。
01

Grok 4.6 發布節奏有多快:從 4.5 到 4.7 僅兩個月

這距離上一代 Grok 4.5 發布僅一個月,意味著 xAI 在今年夏天要連續推出三款前沿模型。目前官方尚未公布 Grok 4.6 的具體基準分數和定價。

01

2026 年 7 月 8 日:xAI 正式發布 Grok 4.5,與 Cursor 合作、使用真實開發者會話資料訓練,支援 50 萬 token 上下文,定價為每百萬 token 輸入 $2 / 輸出 $6。

02

2026 年 7 月 16 日:競品 Moonshot AI(月之暗面)的 Kimi K3 以託管服務形式上線,隨後在 7 月 26 日提前一天放出完整開源權重,2.8 萬億參數、100 萬 token 上下文。

03

2026 年 7 月 28 日:馬斯克在回覆 Rauch 的貼文中首次公開 Grok 4.6 和 4.7 的路線圖與大致時間表。

04

約 2026 年 8 月 7 日(目標):Grok 4.6 計劃發布,1.5 萬億參數,重點在 SFT(監督微調)和 RL(強化學習)層面的升級。

05

2026 年 8 月末至 9 月初(預估):Grok 4.7 計劃跟進,2.1 萬億參數,馬斯克稱其「除了推理速度稍慢外,其他方面全面優於 4.6,且 token 效率更高」。

業內常稱之為「Musk time」,實際發布日期比預告晚幾天到兩週並不罕見,發布前建議以 xAI 官方帳號或官網公告為準。

02

Grok 4.6 核心數據一覽:與 Kimi K3、Claude Fable 5.1 怎麼比

模型發布/目標時間參數規模定位重點狀態
Grok 4.52026 年 7 月 8 日未公開程式設計與智慧體任務已發布
Grok 4.6約 2026 年 8 月 7 日1.5 萬億SFT/RL 大幅升級官方預告,未發布
Grok 4.7約 2026 年 8 月末–9 月初2.1 萬億全面優於 4.6,token 效率更高官方預告,未發布
模型廠商參數規模上下文視窗定價(輸入/輸出,每百萬 token)
Grok 4.5xAI未公開50 萬 token$2 / $6
Grok 4.6(預告)xAI1.5 萬億未公開未公開
Kimi K3月之暗面2.8 萬億(MoE)100 萬 token$0.30(快取命中)/$3 輸入,$15 輸出
Claude Fable 5.1(傳聞)Anthropic未公開未公開傳聞維持 Fable 5 定價

Grok 4.6 的發布時間表恰好卡在 Kimi K3 全面開源引發產業震動之後的第 10 天左右——xAI 加快 Grok 4.6/4.7 發布節奏,與 OpenAI、Anthropic 及中國廠商的競爭烈度上升直接相關。

03

Grok 4.6 升級重點不是「更大」,而是「更會學」

監督微調(SFT)是用人工標註或精選的高品質樣本去糾正模型的輸出習慣;強化學習(RL)則是用獎勵訊號讓模型在真實任務鏈路中學會「怎麼做才對」,尤其是多步驟的智慧體任務。

Grok 4.5 當時憑藉與 Cursor 合作獲取的真實開發者會話資料,在保持較小輸出 token 消耗的情況下拿到了 Terminal-Bench 2.1 83.3%、SWE-Bench Pro 64.7% 的成績,處理同類任務所用的輸出 token 數量遠低於 Claude Opus 4.8(約 1.9 萬 token 對 6.7 萬 token)。

提示:Kimi K3 在 Frontend Code Arena 程式設計榜單上以 1679 分登頂,成為首個超越所有閉源模型的開源模型。馬斯克本人也在 Kimi K3 相關評測下留言稱「令人印象深刻」。

04

Grok 4.6 發布前:六步模型評估 Runbook

01

鎖定資訊來源:將馬斯克 7 月 28 日 X 貼文標記為「非正式預告」,同時訂閱 xAI 官方部落格與 Grok Build 公告頻道。

02

建立基準對照組:以目前生產環境使用的 Grok 4.5、Kimi K3 API 或 Claude Fable 5 為基線,記錄 SWE-Bench、Terminal-Bench 及自有 Agent 任務的 token 消耗與延遲。

03

預留 A/B 切換視窗:在 API 閘道或 LiteLLM 路由層預置 Grok 4.6 模型 ID 佔位,確保正式發布後可在 24 小時內完成灰度切換。

04

評估 token 效率而非單純跑分:Grok 4.5 的核心優勢是輸出 token 效率,4.6 發布後優先複測同類任務的實際帳單成本。

05

關注 Grok 4.7 雙 SKU 策略:若 4.6 定位為「更快」、4.7 定位為「更強但更慢」,提前在路由策略中區分延遲敏感型與品質敏感型工作負載。

06

複核安全合規:xAI 7 月對一名使用者提起 CSAM 相關訴訟,Common Sense Media 1 月報告將 Grok 評為未成年人保護最差 AI 產品之一——企業接入前須更新供應商風險評估清單。

05

爭議點、產業分裂與 2026 年 8 月發布密度

A

時間表未經第三方驗證:目前唯一資訊來源是馬斯克在 X 上的一條回覆貼,xAI 官方部落格和產品頁尚未同步公告。

B

基準分數與定價全部空白:與 Grok 4.5 發布時詳細的模型卡、基準表不同,Grok 4.6 目前沒有任何獨立測評佐證其能力。

C

產業「減速」呼籲的錯位:7 月 28 日——馬斯克發布 Grok 4.6/4.7 路線圖的同一天,OpenAI、Anthropic 等公司 1200 餘名員工聯署了「Pacing the Frontier」公開信。xAI 並未出現在簽署名單中。

注意:如果馬斯克的時間表成立,Grok 4.6、Grok 4.7 將與傳聞中的 Claude Fable 5.1 在同一個月內相繼登場,2026 年 8 月很可能成為大模型發布密度最高的月份之一。

對開發者和企業使用者而言,選型視窗期極短。若你的團隊需要在本地 Mac 上長期執行 Agent 編排、CI/CD 流水線或 Cursor 聯動的開發環境,消費級硬體的記憶體瓶頸與系統更新彈窗會打斷長程任務。對於更穩定、更適合 iOS CI/CD 與 AI Agent 自動化的生產環境,MESHLAUNCH 的 Mac Mini 雲端租賃通常是更優解:獨佔 Apple Silicon、7×24 在線、按天/週/月彈性下單。

常見問題

馬斯克表示「大約 8 月 7 日」,但這是非正式表態,並非 xAI 官方確認的發布日期。詳情可見 價格頁了解雲端開發環境方案。

Grok 4.6 為 1.5 萬億參數,重點是 SFT 與 RL 後訓練升級;Grok 4.7 為 2.1 萬億參數,預計在 4.6 發布後「幾週」跟進,馬斯克稱其能力全面優於 4.6,但推理速度略慢,token 效率更高。

目前無法判斷。Grok 4.6 沒有任何公開基準分數,Kimi K3 已有實測數據。建議先查看 幫助中心了解雲端 Mac 開發環境配置。

官方未公布。可參考 Grok 4.5 的定價(輸入 $2/輸出 $6,每百萬 token)作為大致區間,但新一代模型定價可能調整。

按 Grok 4.5 的分發路徑推測,大概率會先上線 Grok Build、xAI 官方 API 和控制台,隨後逐步接入更多第三方平台。