Grok 4.6の発売日を待ち、Grok 4.5を維持するかKimi K3へ切り替えるか検討している方、あるいは「1.5兆パラメータ」が実際に何を意味するのか整理したい方へ——本記事はイーロン・マスク氏の7月28日の公開発言と業界報道を一つの actionable な絵にまとめます。マスク氏はVercel CEO Guillermo Rauch氏へのX上の返信で、xAIが8月7日頃に1.5兆パラメータのGrok 4.6を投入し、数週間以内に2.1兆パラメータのGrok 4.7が続く計画だと述べました。結論から言えば、現時点の一次情報源はマスク氏のX返信1件のみで、モデルカードやベンチマークは未公開です。過去のマスク氏のスケジュールは数日から数週間ずれることが多いため、コミット前にxAI公式チャネルで必ず確認してください。
SECTION 01 Grok 4.6に賭ける前に外すべき5つの罠
- ツイートはプレスリリースではない:7月28日の情報はマスク氏が@rauchgへ返信したものです。xAIのブログと製品ページはスペック・日程を未確認のままです。
- パラメータ数≠能力:マスク氏は生の規模よりSFTとRLのアップグレードを強調しました。Grok 4.5はすでにCursor共同トレーニングと高いトークン効率でAgentベンチマークで競争力を示しています。
- ベンチマークスコアはまだゼロ:Grok 4.5の詳細なモデルカードとは異なり、4.6/4.7には第三者評価が一切なく、Kimi K3や噂のClaude Fable 5.1との硬い比較はできません。
- 競合のペースは苛烈:Kimi K3は7月26日に2.8Tのフルオープンウェイトを公開し、Frontend Code Arenaで1,679点を記録しました。xAIの圧縮された4.6/4.7スケジュールはこの圧力を反映しています。
- 安全面の影:7月にxAIはGrok経由のCSAM生成疑惑でユーザーを提訴しました。Common Sense Mediaは1月、Grokを児童安全で最悪クラスのAIの一つと評価しています。能力とコンプライアンスを並行して評価してください。
SECTION 02 タイムラインとコアスペック:Grok 4.5から4.7まで
| 日付 | 出来事 |
|---|---|
| 2026-07-08 | xAIがGrok 4.5を投入:コーディング/Agent flagship、Cursor共同トレーニング、500Kコンテキスト、入力$2/出力$6(100万トークンあたり) |
| 2026-07-16–26 | Moonshot AIのKimi K3がホスト提供後フルオープンウェイト:2.8Tパラメータ、1Mコンテキスト |
| 2026-07-28 | マスク氏がRauch氏への返信でGrok 4.6/4.7ロードマップを投稿。同日1,200名超の従業員が「Pacing the Frontier」公開書簡を発表 |
| 〜2026-08-07 | Grok 4.6目標:1.5Tパラメータ、SFT/RL大幅アップグレード(発表済み、未投入) |
| 〜2026年8月末–9月初 | Grok 4.7見込み:2.1Tパラメータ。マスク氏は4.6より優れるが提供速度はやや遅く、トークン効率は高いと述べています |
| モデル | パラメータ | 重点 | 状態 |
|---|---|---|---|
| Grok 4.3 Beta | 非公開 | 前世代ベースライン | 投入済み |
| Grok 4.5 | 非公開(単一SKU、MoEではない) | コーディング/Agent、Cursor共同トレーニング | 投入済み |
| Grok 4.6 | 1.5T | SFT/RLアップグレード | 発表済み |
| Grok 4.7 | 2.1T | 4.6を超える総合アップグレード | 発表済み |
パラメータ数、価格、ベンチマーク数値はベンダーまたはマスク氏の発言に基づきます。Grok 4.6と4.7には独立評価がまだなく、「発表済み」行は公式投入まで方向性の参考として扱ってください。
SECTION 03 アップグレードの本質はポストトレーニング、単なる規模ではない
教師あり微調整(SFT)はキュレーションされた例で出力を整形します。強化学習(RL)は報酬信号で多段階Agentタスクを学習させます。マスク氏の「SFT & RLを大幅改善」という表現はGrok 4.5の戦略を継続します。実際のCursor開発者セッションにより、Terminal-Bench 2.1で83.3%、SWE-Bench Proで64.7%を達成し、SWEタスクあたりの出力トークンはOpus 4.8の67,020に対し約15,954——4.2倍の効率差です。
Grok 4.6の1.5Tジャンプは実際の規模拡大ですが、マスク氏のGrok 4.7の言及——2.1Tで「提供はやや遅いがあらゆる面で優れる」——は品質対レイテンシの2 SKU戦略を示唆し、AnthropicのSonnet/Opus分離やOpenAIのmini/full階層と同型です。
SECTION 04 正面比較:Grok vs Kimi K3と同世代モデル
| モデル | パラメータ | コンテキスト | 価格($/M 入/出) |
|---|---|---|---|
| Grok 4.5 | 非公開 | 500K | $2 / $6 |
| Grok 4.6(発表済み) | 1.5T | 非公開 | 非公開 |
| Kimi K3 | 2.8T MoE | 1M | $0.30–$3 / $15 |
| Claude Fable 5.1(噂) | 非公開 | 非公開 | 噂はFable 5($10/$50) |
| GPT-5.6 Sol | 非公開 | 非公開 | 非公開 |
Grok 4.6の目標はKimi K3オープンウェイト公開から約10日後です。K3はFrontend Code Arenaで1,679点を記録し、そのリーダーボードで全クローズドモデルを上回った初のオープンウェイトモデルです。マスク氏はK3ベンチマークスレッドに「impressive」とコメントしました。K3の詳細はK3オープンウェイト解説、Fable系列の文脈はOpus 5と蒸留論争をご覧ください。
SECTION 05 論点:Musk time、訴訟、業界の分裂
- タイムライン未検証:唯一の情報源はX返信1件。「Musk time」のずれはxAI、Tesla、SpaceXで共通です。
- ベンチマークと価格は空白:「1.5T」「SFT/RLアップグレード」はベンダー主張で第三者証明がありません。
- コンテンツ安全訴訟:2026年7月、xAIはGrok経由のCSAM疑惑でユーザーを提訴——同社初の此类訴。Common Sense Mediaはすでに児童安全の欠陥を指摘しています。
- ペースの衝突:マスク氏が4.6/4.7を発表した同日、OpenAI、Anthropic、Google DeepMind、Metaの1,200名超が「Pacing the Frontier」を公開。xAIは署名者に含まれません。GPT-6前哨戦と規制競争を参照してください。
マスク氏のスケジュールが守られれば、Grok 4.6と4.7は噂のClaude Fable 5.1(8月リーク)とKimi K3のオープンウェイト衝撃と重なり、2026年8月はフロンティアモデル投入が最も密集する月の一つになる可能性があります。 flagship の賞味期限は数週間に短縮され、リーダーボード順位よりトークン効率と実タスクコストが重要です。
SECTION 06 Grok 4.6投入前の6ステップチェックリスト
- 公式チャネルを購読する:x.aiブログ、Grok Build告知、@elonmusk——二次情報だけに頼らないでください。
- Grok 4.5ベースラインを記録する:SWE-Bench、Terminal-Benchスコアとトークン使用量を記録し、投入後のA/Bに備えます。
- Cursor/OpenRouterのフォールバックを設定する:Grok 4.5は本日Cursorで利用可能。切替ウィンドウ用にKimi K3やGPT-5.6 Solルートを確保します。
- 価格ページを監視する:4.5は$2/$6(100万トークンあたり)で投入。4.6の価格は変わる可能性があるため、投入日の原文を読みます。
- 安全とコンプライアンスを確認する:エンタープライズや若年向け製品では、xAIポリシー、ログ、最近の訴訟を監査します。
- 推論とビルドスタックを分離する:LLM APIでAgentオーケストレーション、ネイティブmacOSビルドは物理Apple Silicon上——VM EULAリスクと20–40%のオーバーヘッドを避けます。
SECTION 07 引用可能な数値と一次情報源
- Grok 4.5:500Kコンテキスト;Terminal-Bench 2.1 83.3%;SWE-Bench Pro 64.7%;$2/$6(100万トークンあたり)
- Grok 4.6(発表済み):1.5Tパラメータ;SFT/RLポストトレーニング重点;目標〜8月7日
- Grok 4.7(発表済み):2.1Tパラメータ;4.6の数週間後;提供はやや遅く、トークン効率は向上
- 同世代参照:Kimi K3 2.8T、1Mコンテキスト、Frontend Code Arena 1,679;Grok 4.5はSWEタスクでOpus 4.8比約4.2倍の出力トークン効率
上流更新後は以下のリンクを再確認してください。
Moonshot AI: Kimi K3(Hugging Face)
The Verge: Pacing the Frontier coverage
Grok 4.6のSFT/RLアップグレードはAPI選定ウィンドウをさらに圧縮しますが、Xcodeビルド、Metalデバッグ、iOS署名チェーンは代替できません。VM macOSはEULAリスクと測定可能な性能損失を伴います。実務的なスタックは、フロンティアAPI(Grok/Kimi)で百万トークンAgentオーケストレーション、VPSNIX M4/M4 Proクラウド物理ノードでネイティブApple Siliconビルド——正規Appleハードウェア、フルRoot、ゼロHypervisorオーバーヘッド、日次/月次の柔軟課金。料金をご覧ください。
SECTION 08 よくある質問 FAQ
Grok 4.6は具体的にいつ発売されますか?
マスク氏はX上で「2026年8月7日頃」と述べました。xAIは公式に日程を確認していません。ずれる可能性がある目標として扱ってください。
Grok 4.6とGrok 4.7の違いは何ですか?
Grok 4.6は1.5TパラメータでSFT/RL改善が重点です。Grok 4.7は数週間後に予想される2.1Tで、マスク氏は提供速度を除き4.6を上回ると述べ、一部レイテンシとトークン効率のトレードオフがあります。
Grok 4.6はKimi K3やClaude Fable 5.1に勝てますか?
まだ判断できません。Grok 4.6には公開ベンチマークがありません。Kimi K3にはFrontend Code Arena首位など検証済みスコアがあり、Claude Fable 5.1はAnthropicにより未確認です。
Grok 4.6の価格はどのくらいですか?
不明です。Grok 4.5は入力$2/出力$6(100万トークンあたり)で投入されました。参考値として妥当ですが、4.6の価格は未公開です。
Grok 4.6はどこで使えますか?
Grok 4.5の展開に基づくと、Grok Build、xAI API、コンソールが先行し、その後サードパーティプラットフォームへ広がる見込みですが、4.6については未確認です。