若你正在關注 Grok 4.6 發布日期、猶豫是否該從 Grok 4.5 或 Kimi K3 切換 API,或想釐清「1.5 兆參數」究竟代表什麼——本文將馬斯克 7 月 28 日公開表態與產業報導中的關鍵資訊一次整理清楚。馬斯克在回覆 Vercel CEO Guillermo Rauch 時透露,xAI 將於 8 月 7 日前後發布參數規模達 1.5 兆的 Grok 4.6,並在隨後數週內推出 2.1 兆參數的 Grok 4.7。 核心判斷:目前唯一的一手資訊來源是馬斯克的一則 X 回覆,xAI 尚未公布模型卡與基準分數;時程表存在「Musk time」的彈性空間,發布前務必以官方管道核實。
SECTION 01 等待 Grok 4.6 時最常踩的五個坑
- 別把推文當正式公告:7 月 28 日的資訊來自馬斯克回覆 @rauchg,xAI 官方部落格與產品頁尚未同步,實際日期可能提前或延後數天至兩週。
- 參數不等於能力:馬斯克強調 Grok 4.6 的升級重點在 SFT 與 RL,而非單純堆疊規模;Grok 4.5 已憑與 Cursor 聯合訓練,在 Agent 基準上展現高 token 效率。
- 基準分數仍是空白:與 Grok 4.5 發布時詳盡的模型卡不同,4.6/4.7 目前沒有任何第三方獨立評測,無法與 Kimi K3 或傳聞中的 Claude Fable 5.1 做硬性對照。
- 競品節奏極快:Kimi K3 在 7 月 26 日全面開源 2.8T 權重,Frontend Code Arena 以 1679 分登頂;xAI 加快 4.6/4.7 節奏,與產業競爭烈度直接相關。
- 安全合規陰影:7 月 xAI 首次提告使用者,涉嫌利用 Grok 生成 CSAM;Common Sense Media 年初將 Grok 評為未成年人保護最差的 AI 之一——技術迭代與安全投入需一併評估。
SECTION 02 Grok 4.5 至 4.7:時程與關鍵數據
| 日期 | 事件 |
|---|---|
| 2026-07-08 | xAI 發布 Grok 4.5:程式設計與智慧代理旗艦,與 Cursor 聯合訓練,50 萬 token 上下文,定價輸入 $2 / 輸出 $6(每百萬 token) |
| 2026-07-16–26 | 月之暗面 Kimi K3 託管上線後全面開源 2.8T 權重、100 萬 token 上下文 |
| 2026-07-28 | 馬斯克在 X 回覆 Rauch,首次公開 Grok 4.6/4.7 路線圖;同日 OpenAI、Anthropic 等 1200+ 員工聯署「Pacing the Frontier」公開信 |
| 約 2026-08-07 | Grok 4.6 目標發布:1.5 兆參數,SFT/RL 大幅升級(官方預告,尚未發布) |
| 約 2026-08 末–9 月初 | Grok 4.7 預估:2.1 兆參數,馬斯克稱全面優於 4.6 但推理稍慢、token 效率更高 |
| 模型 | 參數規模 | 定位重點 | 狀態 |
|---|---|---|---|
| Grok 4.3 Beta | 未公開 | 上一代基線 | 已發布 |
| Grok 4.5 | 未公開(非 MoE 單一 SKU) | 程式設計與智慧代理,與 Cursor 聯合訓練 | 已發布 |
| Grok 4.6 | 1.5 兆 | SFT/RL 大幅升級 | 官方預告 |
| Grok 4.7 | 2.1 兆 | 全面優於 4.6,token 效率更高 | 官方預告 |
參數規模、定價與基準分數均為廠商或馬斯克自述;Grok 4.6 與 4.7 目前均無第三方獨立評測,表中「官方預告」資訊務必以正式發布為準。
SECTION 03 SFT 與 RL 升級:為何焦點不在「更大」
監督微調(SFT)以高品質樣本校正模型輸出習慣;強化學習(RL)以獎勵訊號讓模型在多步驟智慧代理任務中學會正確行動序列。馬斯克特別強調 Grok 4.6 的升級在「SFT & RL」而非參數本身,這與 Grok 4.5 的策略延續——Grok 4.5 憑與 Cursor 合作的真實開發者會話資料,在 Terminal-Bench 2.1 拿下 83.3%、SWE-Bench Pro 64.7%,且處理同類任務的輸出 token 遠低於 Claude Opus 4.8(約 1.9 萬對 6.7 萬)。
Grok 4.6 的 1.5 兆參數相對 4.5 是明顯的規模躍升,但馬斯克隨後補充 Grok 4.7 更大(2.1 兆)卻「推理稍慢」,暗示 xAI 以兩款不同定位的模型分別滿足「更強」與「更快」,而非一個 SKU 通吃所有場景——與 Anthropic Sonnet/Opus、OpenAI mini/full 的分層策略一致。
SECTION 04 橫向對照:Grok vs Kimi K3 與同期競品
| 模型 | 參數 | 上下文 | 定價(輸入/輸出,$/M token) |
|---|---|---|---|
| Grok 4.5 | 未公開 | 50 萬 | $2 / $6 |
| Grok 4.6(預告) | 1.5 兆 | 未公開 | 未公開 |
| Kimi K3 | 2.8 兆 MoE | 100 萬 | $0.30–$3 / $15 |
| Claude Fable 5.1(傳聞) | 未公開 | 未公開 | 傳聞維持 Fable 5($10/$50) |
| GPT-5.6 Sol | 未公開 | 未公開 | 未公開 |
Grok 4.6 目標發布日約在 Kimi K3 全面開源後第 10 天。K3 在 Frontend Code Arena 以 1679 分登頂,成為首個超越所有閉源模型的開源權重模型;馬斯克曾在 K3 相關評測下留言稱「令人印象深刻」。更多 K3 背景見K3 開源權重解析;Fable 5 系列爭議見Opus 5 與蒸餾門梳理。
SECTION 05 爭議與背景:Musk time、安全訴訟與產業分裂
- 時程表未經第三方驗證:唯一資訊來源是馬斯克的 X 回覆,實際日期存在彈性,業界常稱「Musk time」。
- 基準與定價全部空白:「1.5 兆」與「SFT/RL 大幅升級」目前均為單方面說法。
- xAI 內容安全爭議:7 月 xAI 提告使用者涉嫌繞過安全限制生成 CSAM,為該公司首次就 AI 深度偽造內容提告使用者;1 月 Common Sense Media 報告將 Grok 評為未成年人保護最差的 AI 之一。
- 與「減速」呼籲錯位:7 月 28 日馬斯克公布 4.6/4.7 路線圖同一天,OpenAI、Anthropic 等 1200+ 員工聯署「Pacing the Frontier」,呼籲建立放緩前沿 AI 的治理工具;xAI 未出現在簽署名單。詳見GPT-6 前哨戰與監管賽跑。
若馬斯克時程表成立,Grok 4.6、4.7 將與傳聞中的 Claude Fable 5.1(多方爆料指向 8 月)及已開源的 Kimi K3 疊加,2026 年 8 月很可能成為大模型發布密度最高的月份之一——選型窗口極短,token 效率與真實任務成本比單純跑分更實際。
SECTION 06 Grok 4.6 發布前六步核對清單
- 訂閱 xAI 官方管道:追蹤 x.ai 部落格、Grok Build 公告與馬斯克 @elonmusk,別只盯二手解讀。
- 鎖定 Grok 4.5 基準作基線:記錄目前 SWE-Bench、Terminal-Bench 分數與 token 消耗,便於 4.6 發布後 A/B 對照。
- 在 Cursor / OpenRouter 設 Fallback:Grok 4.5 已在 Cursor 上線;為 4.6 切換窗口預留 Kimi K3 或 GPT-5.6 Sol 備用路由。
- 核對 API 定價頁:參考 4.5 的 $2/$6 每百萬 token,但新一代定價可能調整,以發布日原文為準。
- 評估安全與合規:若面向企業或未成年人場景,複查 xAI 內容政策、日誌留存與近期訴訟進展。
- 分離推理與編譯棧:大模型 API 負責 Agent 編排,原生 macOS 建置留在實體 Apple Silicon 節點,避免虛擬機 EULA 與 20–40% 效能損耗。
SECTION 07 可引用數據與權威來源
- Grok 4.5:50 萬 token 上下文;Terminal-Bench 2.1 83.3%;SWE-Bench Pro 64.7%;定價 $2/$6 每百萬 token
- Grok 4.6(預告):1.5 兆參數;SFT/RL 後訓練升級;目標日期約 8 月 7 日
- Grok 4.7(預告):2.1 兆參數;數週內跟進;推理稍慢、token 效率更高
- 競品參照:Kimi K3 2.8T、100 萬上下文、Frontend Code Arena 1679 分;Grok 4.5 對 Opus 4.8 SWE 任務約 4.2× 輸出 token 效率優勢
以下連結請在發版或上游更新後再次開啟核對:
Moonshot AI:Kimi K3(Hugging Face)
The Verge:Pacing the Frontier 公開信報導
Grok 4.6 若兌現 SFT/RL 升級,會進一步擠壓「純 API 選型」的窗口期,但不能替代 Xcode 編譯、Metal 除錯與 iOS 簽章鏈。虛擬機 macOS 有 EULA 風險且效能損耗顯著。務實組合是:Grok/Kimi 等前沿 API 負責百萬上下文推理與 Agent 編排,VPSNIX M4/M4 Pro 雲端實體節點負責原生 Apple Silicon 建置——100% 蘋果原裝、完整 Root、零 Hypervisor 損耗、按天/月彈性下單。詳見定價頁。
SECTION 08 常見問題 FAQ
Grok 4.6 具體是哪天發布?
馬斯克表示「大約 8 月 7 日」,但這是非正式表態,並非 xAI 官方確認的發布日期,實際時間可能提前或延後。
Grok 4.6 和 Grok 4.7 有什麼區別?
Grok 4.6 為 1.5 兆參數,重點是 SFT 與 RL 後訓練升級;Grok 4.7 為 2.1 兆參數,預計在 4.6 發布後數週跟進,馬斯克稱其能力全面優於 4.6,但推理速度略慢,token 效率更高。
Grok 4.6 會比 Kimi K3 或 Claude Fable 5.1 更強嗎?
目前無法判斷。Grok 4.6 沒有任何公開基準分數,Kimi K3 已有實測數據且在部分程式設計榜單表現突出,Claude Fable 5.1 尚未被 Anthropic 官方確認發布,三者暫無法直接對照。
Grok 4.6 大概會怎麼定價?
官方未公布。可參考 Grok 4.5 的定價(輸入 $2 / 輸出 $6,每百萬 token)作為大致區間,但新一代模型定價可能調整,務必以正式發布資訊為準。
一般使用者屆時能在哪裡用上 Grok 4.6?
按 Grok 4.5 的分發路徑推測,大概率會先上線 Grok Build、xAI 官方 API 和控制台,隨後逐步接入更多第三方平台,但具體入口以正式發布公告為準。