如果你在等 Grok 4.6 发布日期、纠结要不要从 Grok 4.5 或 Kimi K3 切 API,或想搞清楚「1.5 万亿参数」到底意味着什么——这篇把马斯克 7 月 28 日公开表态与行业报道里的关键信息一次讲透。马斯克在回复 Vercel CEO Guillermo Rauch 时透露,xAI 将于 8 月 7 日前后发布参数规模达 1.5 万亿的 Grok 4.6,随后几周内还会推出 2.1 万亿参数的 Grok 4.7。 核心判断:目前唯一一手信息源是马斯克的一条 X 回复,xAI 尚未公布模型卡与基准分数;时间表存在「Musk time」弹性,发布前务必以官方渠道核实。
SECTION 01 等 Grok 4.6 前最容易踩的五个坑
- 别把推文当官宣:7 月 28 日信息来自马斯克回复 @rauchg,xAI 官方博客与产品页尚未同步,实际日期可能提前或推迟数天至两周。
- 参数≠能力:马斯克强调 Grok 4.6 升级重点在 SFT 与 RL,而非单纯堆规模;Grok 4.5 已凭与 Cursor 联合训练在 Agent 基准上打出高 token 效率。
- 基准分数空白:与 Grok 4.5 发布时详尽的模型卡不同,4.6/4.7 目前没有任何第三方独立评测,无法与 Kimi K3 或传闻中的 Claude Fable 5.1 做硬对比。
- 竞品节奏极快:Kimi K3 在 7 月 26 日全面开源 2.8T 权重,Frontend Code Arena 1679 分登顶;xAI 加快 4.6/4.7 节奏与行业竞争烈度直接相关。
- 安全合规阴影:7 月 xAI 首次起诉用户涉嫌利用 Grok 生成 CSAM;Common Sense Media 年初将 Grok 评为未成年人保护最差 AI 之一——技术迭代与安全投入需一并评估。
SECTION 02 Grok 4.5 到 4.7:时间线与核心数据
| 日期 | 事件 |
|---|---|
| 2026-07-08 | xAI 发布 Grok 4.5:编程与智能体旗舰,与 Cursor 联合训练,50 万 token 上下文,定价输入 $2/输出 $6(每百万 token) |
| 2026-07-16–26 | 月之暗面 Kimi K3 托管上线后全面开源 2.8T 权重、100 万 token 上下文 |
| 2026-07-28 | 马斯克在 X 回复 Rauch 首次公开 Grok 4.6/4.7 路线图;同日 OpenAI、Anthropic 等 1200+ 员工联署「Pacing the Frontier」公开信 |
| 约 2026-08-07 | Grok 4.6 目标发布:1.5 万亿参数,SFT/RL 大幅升级(官方预告,未发布) |
| 约 2026-08 末–9 月初 | Grok 4.7 预估:2.1 万亿参数,马斯克称全面优于 4.6 但推理稍慢、token 效率更高 |
| 模型 | 参数规模 | 定位重点 | 状态 |
|---|---|---|---|
| Grok 4.3 Beta | 未公开 | 上一代基线 | 已发布 |
| Grok 4.5 | 未公开(非 MoE 单一 SKU) | 编程与智能体,与 Cursor 联合训练 | 已发布 |
| Grok 4.6 | 1.5 万亿 | SFT/RL 大幅升级 | 官方预告 |
| Grok 4.7 | 2.1 万亿 | 全面优于 4.6,token 效率更高 | 官方预告 |
参数规模、定价与基准分数均为厂商或马斯克自述;Grok 4.6 与 4.7 目前均未有第三方独立评测,表中「官方预告」信息务必以正式发布为准。
SECTION 03 SFT 与 RL 升级:为什么重点不是「更大」
监督微调(SFT)用高质量样本纠正模型输出习惯;强化学习(RL)用奖励信号让模型在多步骤智能体任务里学会正确行动序列。马斯克特意强调 Grok 4.6 的升级在「SFT & RL」而非参数本身,这与 Grok 4.5 打法延续——Grok 4.5 凭与 Cursor 合作的真实开发者会话数据,在 Terminal-Bench 2.1 拿到 83.3%、SWE-Bench Pro 64.7%,且处理同类任务输出 token 远低于 Claude Opus 4.8(约 1.9 万对 6.7 万)。
Grok 4.6 的 1.5 万亿参数相对 4.5 是明显规模跃升,但马斯克随后补充 Grok 4.7 更大(2.1 万亿)却「推理稍慢」,暗示 xAI 用两款不同定位模型分别满足「更强」与「更快」,而非一个 SKU 通吃所有场景——与 Anthropic Sonnet/Opus、OpenAI mini/full 分层策略一致。
SECTION 04 横向对比:Grok vs Kimi K3 与同期竞品
| 模型 | 参数 | 上下文 | 定价(输入/输出,$/M token) |
|---|---|---|---|
| Grok 4.5 | 未公开 | 50 万 | $2 / $6 |
| Grok 4.6(预告) | 1.5 万亿 | 未公开 | 未公开 |
| Kimi K3 | 2.8 万亿 MoE | 100 万 | $0.30–$3 / $15 |
| Claude Fable 5.1(传闻) | 未公开 | 未公开 | 传闻维持 Fable 5($10/$50) |
| GPT-5.6 Sol | 未公开 | 未公开 | 未公开 |
Grok 4.6 目标发布日约在 Kimi K3 全面开源后第 10 天。K3 在 Frontend Code Arena 以 1679 分登顶,成为首个超越所有闭源模型的开源权重模型;马斯克曾在 K3 相关评测下留言称「令人印象深刻」。更多 K3 背景见K3 开源权重解析;Fable 5 系列争议见Opus 5 与蒸馏门梳理。
SECTION 05 争议与背景:Musk time、安全诉讼与行业分裂
- 时间表未经第三方验证:唯一信息源是马斯克 X 回复,实际日期存在弹性,业内常称「Musk time」。
- 基准与定价全部空白:「1.5 万亿」与「SFT/RL 大幅升级」目前均为单方面说法。
- xAI 内容安全争议:7 月 xAI 起诉用户涉嫌绕过安全限制生成 CSAM,为该公司首次就 AI 深度伪造内容起诉用户;1 月 Common Sense Media 报告将 Grok 评为未成年人保护最差 AI 之一。
- 与「减速」呼吁错位:7 月 28 日马斯克公布 4.6/4.7 路线图同一天,OpenAI、Anthropic 等 1200+ 员工联署「Pacing the Frontier」,呼吁建立放缓前沿 AI 的治理工具;xAI 未出现在签署名单。详见GPT-6 前哨战与监管赛跑。
若马斯克时间表成立,Grok 4.6、4.7 将与传闻中的 Claude Fable 5.1(多方爆料指向 8 月)及已开源的 Kimi K3 叠加,2026 年 8 月很可能成为大模型发布密度最高的月份之一——选型窗口极短,token 效率与真实任务成本比单纯跑分更实际。
SECTION 06 Grok 4.6 发布前六步核对清单
- 订阅 xAI 官方渠道:关注 x.ai 博客、Grok Build 公告与马斯克 @elonmusk,勿只盯二手解读。
- 锁定 Grok 4.5 基准作基线:记录当前 SWE-Bench、Terminal-Bench 分数与 token 消耗,便于 4.6 发布后 A/B。
- 在 Cursor / OpenRouter 设 Fallback:Grok 4.5 已在 Cursor 上线;为 4.6 切换窗口预留 Kimi K3 或 GPT-5.6 Sol 备用路由。
- 核对 API 定价页:参考 4.5 的 $2/$6 每百万 token,但新一代定价可能调整,以发布日原文为准。
- 评估安全与合规:若面向企业或未成年人场景,复查 xAI 内容政策、日志留存与近期诉讼进展。
- 分离推理与编译栈:大模型 API 负责 Agent 编排,原生 macOS 构建留在物理 Apple Silicon 节点,避免虚拟机 EULA 与 20–40% 性能损耗。
SECTION 07 可引用数据与权威来源
- Grok 4.5:50 万 token 上下文;Terminal-Bench 2.1 83.3%;SWE-Bench Pro 64.7%;定价 $2/$6 每百万 token
- Grok 4.6(预告):1.5 万亿参数;SFT/RL 后训练升级;目标日期约 8 月 7 日
- Grok 4.7(预告):2.1 万亿参数;数周内跟进;推理稍慢、token 效率更高
- 竞品参照:Kimi K3 2.8T、100 万上下文、Frontend Code Arena 1679 分;Grok 4.5 对 Opus 4.8 SWE 任务约 4.2× 输出 token 效率优势
以下链接请在发版或上游更新后再次打开核对:
Moonshot AI:Kimi K3(Hugging Face)
The Verge:Pacing the Frontier 公开信报道
Grok 4.6 若兑现 SFT/RL 升级,会进一步挤压「纯 API 选型」的窗口期,但不能替代 Xcode 编译、Metal 调试与 iOS 签名链。虚拟机 macOS 有 EULA 风险且性能损耗显著。务实组合是:Grok/Kimi 等前沿 API 负责百万上下文推理与 Agent 编排,VPSNIX M4/M4 Pro 云端物理节点负责原生 Apple Silicon 构建——100% 苹果原装、完整 Root、零 Hypervisor 损耗、按天/月弹性下单。详见定价页。
SECTION 08 常见问题 FAQ
Grok 4.6 具体是哪天发布?
马斯克表示「大约 8 月 7 日」,但这是非正式表态,并非 xAI 官方确认的发布日期,实际时间可能提前或延后。
Grok 4.6 和 Grok 4.7 有什么区别?
Grok 4.6 为 1.5 万亿参数,重点是 SFT 与 RL 后训练升级;Grok 4.7 为 2.1 万亿参数,预计在 4.6 发布后数周跟进,马斯克称其能力全面优于 4.6,但推理速度略慢,token 效率更高。
Grok 4.6 会比 Kimi K3 或 Claude Fable 5.1 更强吗?
目前无法判断。Grok 4.6 没有任何公开基准分数,Kimi K3 已有实测数据且在部分编程榜单表现突出,Claude Fable 5.1 尚未被 Anthropic 官方确认发布,三者暂无法直接对比。
Grok 4.6 大概会怎么定价?
官方未公布。可参考 Grok 4.5 的定价(输入 $2/输出 $6,每百万 token)作为大致区间,但新一代模型定价可能调整,务必以正式发布信息为准。
普通用户届时能在哪里用上 Grok 4.6?
按 Grok 4.5 的分发路径推测,大概率会先上线 Grok Build、xAI 官方 API 和控制台,随后逐步接入更多第三方平台,但具体入口以正式发布公告为准。