Grok 4.6什么时候发布?
马斯克预告8月7日上线

1.5万亿参数 · SFT/RL 后训练升级 · 与 Kimi K3 / Fable 5.1 竞品横评

Grok 4.6什么时候发布?马斯克预告8月7日上线,参数升至1.5万亿
马斯克 7 月 28 日在 X 上回复 Vercel CEO Guillermo Rauch 时透露,xAI 将于 8 月 7 日前后发布参数规模达 1.5 万亿的 Grok 4.6,随后几周内还会推出 2.1 万亿参数的 Grok 4.7。本文面向正在评估模型选型窗口的技术团队,梳理 Grok 4.5→4.6→4.7 时间线、SFT/RL 升级含义、与 Kimi K3 及 Claude Fable 5.1 的横向对比,并标注所有未经第三方验证的信息来源。
01

Grok 4.6 发布节奏有多快:从 4.5 到 4.7 仅两个月

这距离上一代 Grok 4.5 发布仅一个月,意味着 xAI 在今年夏天要连续推出三款前沿模型。目前官方尚未公布 Grok 4.6 的具体基准分数和定价,以下信息基于马斯克本人的公开表态及行业报道整理。

01

2026 年 7 月 8 日:xAI 正式发布 Grok 4.5,定位为"专为编程与智能体任务打造"的旗舰模型,与 Cursor 合作、使用真实开发者会话数据训练,支持 50 万 token 上下文,定价为每百万 token 输入 $2 / 输出 $6。

02

2026 年 7 月 16 日:竞品 Moonshot AI(月之暗面)的 Kimi K3 以托管服务形式上线,随后在 7 月 26 日提前一天放出完整开源权重,2.8 万亿参数、100 万 token 上下文。

03

2026 年 7 月 28 日:马斯克在回复 Rauch 的帖子中首次公开 Grok 4.6 和 4.7 的路线图与大致时间表——这也是本文信息的主要来源。

04

约 2026 年 8 月 7 日(目标):Grok 4.6 计划发布,1.5 万亿参数,重点在 SFT(监督微调)和 RL(强化学习)层面的升级,而非单纯堆参数。

05

2026 年 8 月末至 9 月初(预估):Grok 4.7 计划跟进,2.1 万亿参数,马斯克称其"除了推理速度稍慢外,其他方面全面优于 4.6,且 token 效率更高"。

需要提醒的是,马斯克给出的时间表历来存在弹性——业内常称之为"Musk time",实际发布日期比预告晚几天到两周并不罕见,发布前建议以 xAI 官方账号或官网公告为准。

02

Grok 4.6 核心数据一览:与 Kimi K3、Claude Fable 5.1 怎么比

模型发布/目标时间参数规模定位重点状态
Grok 4.3 Beta2026 年 4 月 17 日未公开上一代基线已发布
Grok 4.52026 年 7 月 8 日未公开(非 MoE 单一 SKU)编程与智能体任务,与 Cursor 联合训练已发布
Grok 4.6约 2026 年 8 月 7 日1.5 万亿SFT/RL 大幅升级官方预告,未发布
Grok 4.7约 2026 年 8 月末–9 月初2.1 万亿全面优于 4.6,token 效率更高官方预告,未发布

注:参数规模、定价、基准分数均为厂商/马斯克自述,Grok 4.6 与 4.7 目前均未有第三方独立评测数据。

模型厂商参数规模上下文窗口定价(输入/输出,每百万 token)
Grok 4.5xAI未公开50 万 token$2 / $6
Grok 4.6(预告)xAI1.5 万亿未公开未公开
Kimi K3月之暗面2.8 万亿(MoE,激活约 16/896 专家)100 万 token$0.30(缓存命中)/$3(缓存未命中)输入,$15 输出
Claude Fable 5.1(传闻)Anthropic未公开未公开传闻维持 Fable 5 定价($10 输入/$50 输出)
GPT-5.6 SolOpenAI未公开未公开未公开

Grok 4.6 的发布时间表恰好卡在 Kimi K3 全面开源引发行业震动之后的第 10 天左右——业内普遍解读,xAI 加快 Grok 4.6/4.7 发布节奏,与 OpenAI、Anthropic 及中国厂商的竞争烈度上升直接相关。

03

Grok 4.6 升级重点不是"更大",而是"更会学"

监督微调(SFT)是用人工标注或精选的高质量样本去纠正模型的输出习惯;强化学习(RL)则是用奖励信号让模型在真实任务链路中学会"怎么做才对",尤其是多步骤的智能体任务。马斯克特意强调 Grok 4.6 的升级重点在"SFT & RL"而非参数规模本身。

这与 Grok 4.5 的打法是延续的——Grok 4.5 当时凭借与 Cursor 合作获取的真实开发者会话数据,在保持较小输出 token 消耗的情况下拿到了 Terminal-Bench 2.1 83.3%、SWE-Bench Pro 64.7% 的成绩,处理同类任务所用的输出 token 数量远低于 Claude Opus 4.8(约 1.9 万 token 对 6.7 万 token)。

Grok 4.6 的 1.5 万亿参数相比 Grok 4.5 是明显的规模跃升,但马斯克随后补充说 Grok 4.7 会更大(2.1 万亿)却"推理稍慢",暗示 xAI 内部很清楚参数规模和推理速度之间存在权衡,未来会用两款不同定位的模型分别满足"更强"和"更快"的需求。

提示:Kimi K3 在 Frontend Code Arena 编程榜单上以 1679 分登顶,成为首个超越所有闭源模型的开源模型,Artificial Analysis 智能指数综合排名全球第三。马斯克本人也在 Kimi K3 相关评测下留言称"令人印象深刻"。

04

Grok 4.6 发布前:六步模型评估 Runbook

01

锁定信息源:将马斯克 7 月 28 日 X 帖子标记为"非正式预告",同时订阅 xAI 官方博客与 Grok Build 公告渠道,正式发布前不以传闻数据做架构决策。

02

建立基准对照组:以当前生产环境使用的 Grok 4.5、Kimi K3 API 或 Claude Fable 5 为基线,记录 SWE-Bench、Terminal-Bench 及自有 Agent 任务的 token 消耗与延迟。

03

预留 A/B 切换窗口:在 API 网关或 LiteLLM 路由层预置 Grok 4.6 模型 ID 占位,确保正式发布后可在 24 小时内完成灰度切换,无需改动业务代码。

04

评估 token 效率而非单纯跑分:Grok 4.5 的核心优势是输出 token 效率(SWE-Bench Pro 任务约 1.9 万 token vs Opus 4.8 的 6.7 万),4.6 发布后优先复测同类任务的实际账单成本。

05

关注 Grok 4.7 双 SKU 策略:若 4.6 定位为"更快"、4.7 定位为"更强但更慢",提前在路由策略中区分延迟敏感型与质量敏感型工作负载。

06

复核安全合规:xAI 7 月对一名用户提起 CSAM 相关诉讼,Common Sense Media 1 月报告将 Grok 评为未成年人保护最差 AI 产品之一——企业接入前须更新供应商风险评估清单。

05

争议点、行业分裂与 2026 年 8 月发布密度

A

时间表未经第三方验证:目前唯一信息源是马斯克在 X 上的一条回复贴,xAI 官方博客和产品页尚未同步公告,实际日期存在提前或推迟的可能。

B

基准分数与定价全部空白:与 Grok 4.5 发布时详细的模型卡、基准表不同,Grok 4.6 目前没有任何独立测评或官方模型卡佐证其能力。

C

行业"减速"呼吁的错位:7 月 28 日——马斯克发布 Grok 4.6/4.7 路线图的同一天,OpenAI、Anthropic 等公司 1200 余名员工联署了"Pacing the Frontier"公开信,呼吁美国政府建立主动放缓前沿 AI 发展的治理工具。xAI 并未出现在签署名单中。

注意:如果马斯克的时间表成立,Grok 4.6、Grok 4.7 将与传闻中的 Claude Fable 5.1 在同一个月内相继登场,叠加 7 月已经开源的 Kimi K3 带来的冲击,2026 年 8 月很可能成为大模型发布密度最高的月份之一。

对开发者和企业用户而言,选型窗口期极短——上一代旗舰可能刚上线一个月就要面对新一代竞品。若你的团队需要在本地 Mac 上长期运行 Agent 编排、CI/CD 流水线或 Cursor 联动的开发环境,消费级硬件的内存瓶颈与系统更新弹窗会打断长程任务;而纯 API 调用又难以覆盖需要 Apple Silicon 原生工具链的 iOS 构建场景。对于更稳定、更适合 iOS CI/CD 与 AI Agent 自动化的生产环境,MESHLAUNCH 的 Mac Mini 云端租赁通常是更优解:独占 Apple Silicon、7×24 在线、按天/周/月弹性下单,把推理交给 API、把编排与构建留在稳定的云端 Mac 节点上。

常见问题

马斯克表示"大约 8 月 7 日",但这是非正式表态,并非 xAI 官方确认的发布日期,实际时间可能提前或延后。详情可见 价格页了解云端开发环境方案。

Grok 4.6 为 1.5 万亿参数,重点是 SFT 与 RL 后训练升级;Grok 4.7 为 2.1 万亿参数,预计在 4.6 发布后"几周"跟进,马斯克称其能力全面优于 4.6,但推理速度略慢,token 效率更高。

目前无法判断。Grok 4.6 没有任何公开基准分数,Kimi K3 已有实测数据且在部分编程榜单上表现突出,Claude Fable 5.1 本身尚未被 Anthropic 官方确认发布,三者暂无法直接对比。建议先查看 帮助中心了解云端 Mac 开发环境配置。

官方未公布。可参考 Grok 4.5 的定价(输入 $2/输出 $6,每百万 token)作为大致区间,但新一代模型定价可能调整,务必以正式发布信息为准。

按 Grok 4.5 的分发路径推测,大概率会先上线 Grok Build、xAI 官方 API 和控制台,随后逐步接入更多第三方平台(如 Grok 4.5 在 Cursor 的首日接入),但具体入口以正式发布公告为准。