首页 / 博客 / Grok 4.6 发布
ENGINEERING_BLOG · 2026.07.30

Grok 4.6什么时候发布?马斯克预告8月7日上线,参数升至1.5万亿

GROK 4.6 · 目标窗口
8/7±

1.5 万亿参数 · SFT/RL 后训练升级 · Grok 4.7 2.1T 数周内跟进

如果你在等 Grok 4.6 发布日期、纠结要不要从 Grok 4.5 或 Kimi K3 切 API,或想搞清楚「1.5 万亿参数」到底意味着什么——这篇把马斯克 7 月 28 日公开表态与行业报道里的关键信息一次讲透。马斯克在回复 Vercel CEO Guillermo Rauch 时透露,xAI 将于 8 月 7 日前后发布参数规模达 1.5 万亿的 Grok 4.6,随后几周内还会推出 2.1 万亿参数的 Grok 4.7。 核心判断:目前唯一一手信息源是马斯克的一条 X 回复,xAI 尚未公布模型卡与基准分数;时间表存在「Musk time」弹性,发布前务必以官方渠道核实。

SECTION 01 等 Grok 4.6 前最容易踩的五个坑

  • 别把推文当官宣:7 月 28 日信息来自马斯克回复 @rauchg,xAI 官方博客与产品页尚未同步,实际日期可能提前或推迟数天至两周。
  • 参数≠能力:马斯克强调 Grok 4.6 升级重点在 SFT 与 RL,而非单纯堆规模;Grok 4.5 已凭与 Cursor 联合训练在 Agent 基准上打出高 token 效率。
  • 基准分数空白:与 Grok 4.5 发布时详尽的模型卡不同,4.6/4.7 目前没有任何第三方独立评测,无法与 Kimi K3 或传闻中的 Claude Fable 5.1 做硬对比。
  • 竞品节奏极快:Kimi K3 在 7 月 26 日全面开源 2.8T 权重,Frontend Code Arena 1679 分登顶;xAI 加快 4.6/4.7 节奏与行业竞争烈度直接相关。
  • 安全合规阴影:7 月 xAI 首次起诉用户涉嫌利用 Grok 生成 CSAM;Common Sense Media 年初将 Grok 评为未成年人保护最差 AI 之一——技术迭代与安全投入需一并评估。

SECTION 02 Grok 4.5 到 4.7:时间线与核心数据

Grok 系列发布节奏(2026 年夏)
日期 事件
2026-07-08 xAI 发布 Grok 4.5:编程与智能体旗舰,与 Cursor 联合训练,50 万 token 上下文,定价输入 $2/输出 $6(每百万 token)
2026-07-16–26 月之暗面 Kimi K3 托管上线后全面开源 2.8T 权重、100 万 token 上下文
2026-07-28 马斯克在 X 回复 Rauch 首次公开 Grok 4.6/4.7 路线图;同日 OpenAI、Anthropic 等 1200+ 员工联署「Pacing the Frontier」公开信
约 2026-08-07 Grok 4.6 目标发布:1.5 万亿参数,SFT/RL 大幅升级(官方预告,未发布)
约 2026-08 末–9 月初 Grok 4.7 预估:2.1 万亿参数,马斯克称全面优于 4.6 但推理稍慢、token 效率更高
Grok 系列型号对照
模型 参数规模 定位重点 状态
Grok 4.3 Beta 未公开 上一代基线 已发布
Grok 4.5 未公开(非 MoE 单一 SKU) 编程与智能体,与 Cursor 联合训练 已发布
Grok 4.6 1.5 万亿 SFT/RL 大幅升级 官方预告
Grok 4.7 2.1 万亿 全面优于 4.6,token 效率更高 官方预告

参数规模、定价与基准分数均为厂商或马斯克自述;Grok 4.6 与 4.7 目前均未有第三方独立评测,表中「官方预告」信息务必以正式发布为准。

SECTION 03 SFT 与 RL 升级:为什么重点不是「更大」

监督微调(SFT)用高质量样本纠正模型输出习惯;强化学习(RL)用奖励信号让模型在多步骤智能体任务里学会正确行动序列。马斯克特意强调 Grok 4.6 的升级在「SFT & RL」而非参数本身,这与 Grok 4.5 打法延续——Grok 4.5 凭与 Cursor 合作的真实开发者会话数据,在 Terminal-Bench 2.1 拿到 83.3%、SWE-Bench Pro 64.7%,且处理同类任务输出 token 远低于 Claude Opus 4.8(约 1.9 万对 6.7 万)。

Grok 4.6 的 1.5 万亿参数相对 4.5 是明显规模跃升,但马斯克随后补充 Grok 4.7 更大(2.1 万亿)却「推理稍慢」,暗示 xAI 用两款不同定位模型分别满足「更强」与「更快」,而非一个 SKU 通吃所有场景——与 Anthropic Sonnet/Opus、OpenAI mini/full 分层策略一致。

SECTION 04 横向对比:Grok vs Kimi K3 与同期竞品

前沿模型规格与定价对照(预告/已发布混合)
模型 参数 上下文 定价(输入/输出,$/M token)
Grok 4.5 未公开 50 万 $2 / $6
Grok 4.6(预告) 1.5 万亿 未公开 未公开
Kimi K3 2.8 万亿 MoE 100 万 $0.30–$3 / $15
Claude Fable 5.1(传闻) 未公开 未公开 传闻维持 Fable 5($10/$50)
GPT-5.6 Sol 未公开 未公开 未公开

Grok 4.6 目标发布日约在 Kimi K3 全面开源后第 10 天。K3 在 Frontend Code Arena 以 1679 分登顶,成为首个超越所有闭源模型的开源权重模型;马斯克曾在 K3 相关评测下留言称「令人印象深刻」。更多 K3 背景见K3 开源权重解析;Fable 5 系列争议见Opus 5 与蒸馏门梳理

SECTION 05 争议与背景:Musk time、安全诉讼与行业分裂

  • 时间表未经第三方验证:唯一信息源是马斯克 X 回复,实际日期存在弹性,业内常称「Musk time」。
  • 基准与定价全部空白:「1.5 万亿」与「SFT/RL 大幅升级」目前均为单方面说法。
  • xAI 内容安全争议:7 月 xAI 起诉用户涉嫌绕过安全限制生成 CSAM,为该公司首次就 AI 深度伪造内容起诉用户;1 月 Common Sense Media 报告将 Grok 评为未成年人保护最差 AI 之一。
  • 与「减速」呼吁错位:7 月 28 日马斯克公布 4.6/4.7 路线图同一天,OpenAI、Anthropic 等 1200+ 员工联署「Pacing the Frontier」,呼吁建立放缓前沿 AI 的治理工具;xAI 未出现在签署名单。详见GPT-6 前哨战与监管赛跑

若马斯克时间表成立,Grok 4.6、4.7 将与传闻中的 Claude Fable 5.1(多方爆料指向 8 月)及已开源的 Kimi K3 叠加,2026 年 8 月很可能成为大模型发布密度最高的月份之一——选型窗口极短,token 效率与真实任务成本比单纯跑分更实际。

SECTION 06 Grok 4.6 发布前六步核对清单

  1. 订阅 xAI 官方渠道:关注 x.ai 博客、Grok Build 公告与马斯克 @elonmusk,勿只盯二手解读。
  2. 锁定 Grok 4.5 基准作基线:记录当前 SWE-Bench、Terminal-Bench 分数与 token 消耗,便于 4.6 发布后 A/B。
  3. 在 Cursor / OpenRouter 设 Fallback:Grok 4.5 已在 Cursor 上线;为 4.6 切换窗口预留 Kimi K3 或 GPT-5.6 Sol 备用路由。
  4. 核对 API 定价页:参考 4.5 的 $2/$6 每百万 token,但新一代定价可能调整,以发布日原文为准。
  5. 评估安全与合规:若面向企业或未成年人场景,复查 xAI 内容政策、日志留存与近期诉讼进展。
  6. 分离推理与编译栈:大模型 API 负责 Agent 编排,原生 macOS 构建留在物理 Apple Silicon 节点,避免虚拟机 EULA 与 20–40% 性能损耗。

SECTION 07 可引用数据与权威来源

  • Grok 4.5:50 万 token 上下文;Terminal-Bench 2.1 83.3%;SWE-Bench Pro 64.7%;定价 $2/$6 每百万 token
  • Grok 4.6(预告):1.5 万亿参数;SFT/RL 后训练升级;目标日期约 8 月 7 日
  • Grok 4.7(预告):2.1 万亿参数;数周内跟进;推理稍慢、token 效率更高
  • 竞品参照:Kimi K3 2.8T、100 万上下文、Frontend Code Arena 1679 分;Grok 4.5 对 Opus 4.8 SWE 任务约 4.2× 输出 token 效率优势

以下链接请在发版或上游更新后再次打开核对:

xAI:Introducing Grok 4.5

Moonshot AI:Kimi K3(Hugging Face)

The Verge:Pacing the Frontier 公开信报道

Grok 4.6 若兑现 SFT/RL 升级,会进一步挤压「纯 API 选型」的窗口期,但不能替代 Xcode 编译、Metal 调试与 iOS 签名链。虚拟机 macOS 有 EULA 风险且性能损耗显著。务实组合是:Grok/Kimi 等前沿 API 负责百万上下文推理与 Agent 编排,VPSNIX M4/M4 Pro 云端物理节点负责原生 Apple Silicon 构建——100% 苹果原装、完整 Root、零 Hypervisor 损耗、按天/月弹性下单。详见定价页

SECTION 08 常见问题 FAQ

Grok 4.6 具体是哪天发布?

马斯克表示「大约 8 月 7 日」,但这是非正式表态,并非 xAI 官方确认的发布日期,实际时间可能提前或延后。

Grok 4.6 和 Grok 4.7 有什么区别?

Grok 4.6 为 1.5 万亿参数,重点是 SFT 与 RL 后训练升级;Grok 4.7 为 2.1 万亿参数,预计在 4.6 发布后数周跟进,马斯克称其能力全面优于 4.6,但推理速度略慢,token 效率更高。

Grok 4.6 会比 Kimi K3 或 Claude Fable 5.1 更强吗?

目前无法判断。Grok 4.6 没有任何公开基准分数,Kimi K3 已有实测数据且在部分编程榜单表现突出,Claude Fable 5.1 尚未被 Anthropic 官方确认发布,三者暂无法直接对比。

Grok 4.6 大概会怎么定价?

官方未公布。可参考 Grok 4.5 的定价(输入 $2/输出 $6,每百万 token)作为大致区间,但新一代模型定价可能调整,务必以正式发布信息为准。

普通用户届时能在哪里用上 Grok 4.6?

按 Grok 4.5 的分发路径推测,大概率会先上线 Grok Build、xAI 官方 API 和控制台,随后逐步接入更多第三方平台,但具体入口以正式发布公告为准。