Если вы трекаете дату релиза Grok 4.6, думаете остаться на Grok 4.5 или переключиться на Kimi K3, или пытаетесь понять, что значит «1.5 trillion parameters» в реальных workload'ах — этот разбор собирает публичные заявления Musk от 28 июля и индустриальный контекст в одну инженерную картину. В ответе Vercel CEO Guillermo Rauch на X Musk сказал, что xAI планирует выкатить Grok 4.6 около 7 августа с 1.5T параметрами, а через несколько недель — Grok 4.7 на 2.1T. Bottom line: единственный primary source сегодня — один reply в X. Нет model card, нет third-party benchmarks; Musk time historically сдвигает дедлайны на дни-недели. Перед commit'ом — verify через официальные каналы xAI.
SECTION 01 Пять ловушек, если вы уже betting на Grok 4.6
- Твит ≠ press release: 28 июля инфа пришла из reply Musk'а @rauchg. Блог xAI и product pages не подтвердили ни specs, ни dates.
- Params ≠ capability: Musk акцентировал SFT/RL upgrades, а не raw scale. Grok 4.5 уже конкурирует на agent benchmarks через Cursor co-training и insane token efficiency.
- Benchmark void: В отличие от детального model card Grok 4.5, у 4.6/4.7 ноль independent evals — hard compare с Kimi K3 или rumored Claude Fable 5.1 невозможен.
- Competitive cadence brutal: Kimi K3 26 июля выкатил full 2.8T open weights и набрал 1 679 pts на Frontend Code Arena — первый open-weight, обогнавший все closed models. Compressed schedule 4.6/4.7 у xAI — прямой ответ на этот pressure.
- Safety shadows: В июле xAI засудил user за alleged CSAM generation через Grok; Common Sense Media в январе поставил Grok среди worst по child safety. Factor compliance alongside raw capability.
SECTION 02 Timeline и core specs: Grok 4.5 → 4.7
| Дата | Событие |
|---|---|
| 2026-07-08 | xAI шипит Grok 4.5: coding/agent flagship, Cursor co-trained, 500K context, $2/$6 per million input/output tokens |
| 2026-07-16–26 | Kimi K3 от Moonshot AI: hosted → full open-weight, 2.8T params, 1M context |
| 2026-07-28 | Musk постит roadmap 4.6/4.7 в reply Rauch; в тот же день 1 200+ сотрудников публикуют письмо «Pacing the Frontier» |
| ~2026-08-07 | Grok 4.6 target: 1.5T params, major SFT/RL upgrade (announced, not shipped) |
| ~конец авг.–нач. сен. 2026 | Grok 4.7 estimate: 2.1T params; Musk: лучше 4.6 кроме чуть slower serving, выше token efficiency |
| Модель | Params | Фокус | Статус |
|---|---|---|---|
| Grok 4.3 Beta | Undisclosed | Prior baseline | Shipped |
| Grok 4.5 | Undisclosed (single SKU, not MoE) | Coding/agents, Cursor co-trained | Shipped |
| Grok 4.6 | 1.5T | SFT/RL upgrade | Announced |
| Grok 4.7 | 2.1T | Broad upgrade over 4.6 | Announced |
Parameter counts, pricing и benchmark figures — vendor/Musk statements. У Grok 4.6 и 4.7 пока нет independent evaluations — строки «announced» трактуйте как directional до official launch.
SECTION 03 Почему upgrade — post-training, а не просто scale
Supervised fine-tuning (SFT) шейпит outputs на curated examples; reinforcement learning (RL) учит multi-step agent tasks через reward signals. Framing Musk'а «significantly improved SFT & RL» продолжает playbook Grok 4.5: real Cursor dev sessions дали Terminal-Bench 2.1 на 83.3% и SWE-Bench Pro на 64.7%, при ~15 954 output tokens per SWE task vs 67 020 у Opus 4.8 — 4.2× efficiency gap.
Jump до 1.5T у Grok 4.6 — real scale, но framing Grok 4.7 (2.1T, «better in every way except slightly slower to serve») сигналит два SKU под quality vs latency — mirror Anthropic Sonnet/Opus split и OpenAI mini/full tiers.
SECTION 04 Head-to-head: Grok vs Kimi K3 и peers
| Модель | Params | Context | Pricing ($/M in/out) |
|---|---|---|---|
| Grok 4.5 | Undisclosed | 500K | $2 / $6 |
| Grok 4.6 (announced) | 1.5T | Undisclosed | Undisclosed |
| Kimi K3 | 2.8T MoE | 1M | $0.30–$3 / $15 |
| Claude Fable 5.1 (rumored) | Undisclosed | Undisclosed | Rumored Fable 5 ($10/$50) |
| GPT-5.6 Sol | Undisclosed | Undisclosed | Undisclosed |
Target Grok 4.6 — примерно через 10 дней после open-weight drop Kimi K3. K3 topped Frontend Code Arena на 1 679 pts — первый open-weight, обогнавший все closed models на этой доске. Musk прокомментировал «impressive» в K3 benchmark threads. Больше про K3: разбор open weights K3; контекст Fable: Opus 5 и distillation controversy.
SECTION 05 Controversies: Musk time, lawsuits, industry split
- Timeline unverified: Single X reply — единственный source; «Musk time» slippage common across xAI, Tesla, SpaceX.
- Benchmarks и pricing blank: «1.5T» и «SFT/RL upgrade» — vendor claims без third-party proof.
- Content safety litigation: Июль 2026 xAI sued user over alleged CSAM via Grok — first такого рода lawsuit, implicit acknowledgment bypass risk. Common Sense Media уже flagged child-safety gaps.
- Pacing collision: В день анонса 4.6/4.7 от Musk 1 200+ employees OpenAI, Anthropic, Google DeepMind, Meta опубликовали «Pacing the Frontier»; xAI absent из signatories. См. GPT-6 standoff и regulatory race.
Если schedule Musk'а держится, Grok 4.6 и 4.7 столкнутся с rumored Claude Fable 5.1 (August leaks) и open-weight shock Kimi K3 — август 2026 может стать densest frontier-model month ever. Shelf life любого flagship сжимается до weeks; token efficiency и real task cost бьют leaderboard rank alone.
SECTION 06 Six-step checklist до ship'а Grok 4.6
- Subscribe на official channels: x.ai blog, Grok Build announcements, @elonmusk — не только second-hand summaries.
- Baseline Grok 4.5 metrics: Зафиксируйте SWE-Bench, Terminal-Bench scores и token usage для post-launch A/B.
- Cursor/OpenRouter fallbacks: Grok 4.5 уже в Cursor; reserve Kimi K3 или GPT-5.6 Sol routes на switch window.
- Watch pricing page: 4.5 launched at $2/$6 per million tokens; 4.6 pricing может измениться — читайте launch-day text.
- Review safety и compliance: Для enterprise или youth-facing products — audit xAI policies, logging, recent litigation.
- Split inference от compile stack: LLM APIs для agent orchestration; native macOS builds на physical Apple Silicon — avoid VM EULA risk и 20–40% overhead.
SECTION 07 Citable figures и primary sources
- Grok 4.5: 500K context; Terminal-Bench 2.1 83.3%; SWE-Bench Pro 64.7%; $2/$6 per million tokens
- Grok 4.6 (announced): 1.5T params; SFT/RL post-training focus; target ~Aug 7
- Grok 4.7 (announced): 2.1T params; weeks after 4.6; slower serving, better token efficiency
- Peer reference: Kimi K3 2.8T, 1M context, Frontend Code Arena 1 679; Grok 4.5 ~4.2× output token efficiency vs Opus 4.8 на SWE tasks
Re-open после любого upstream update:
Moonshot AI: Kimi K3 (Hugging Face)
The Verge: Pacing the Frontier coverage
SFT/RL upgrade Grok 4.6 ещё сильнее сожмёт API selection windows, но он не заменит Xcode builds, Metal debugging или iOS signing chains. VM macOS = EULA risk + measurable performance loss. Pragmatic stack: frontier APIs (Grok/Kimi) для million-token agent orchestration; VPSNIX M4/M4 Pro cloud physical nodes для native Apple Silicon builds — genuine Apple hardware, full root, zero hypervisor overhead, flexible daily/monthly billing. См. pricing.
SECTION 08 FAQ
Когда exactly выйдет Grok 4.6?
Musk сказал «around August 7, 2026» на X. xAI официально date не подтвердил. Treat as target, который может shift.
Чем Grok 4.6 отличается от Grok 4.7?
Grok 4.6 — 1.5T params с фокусом на SFT/RL improvements. Grok 4.7, expected weeks later, — 2.1T; Musk говорит, outperform 4.6 кроме serving speed — trade latency за better token efficiency.
Grok 4.6 обгонит Kimi K3 или Claude Fable 5.1?
Too early. У Grok 4.6 нет published benchmarks; у Kimi K3 verified scores включая Frontend Code Arena leadership; Claude Fable 5.1 Anthropic официально не confirmed.
Сколько будет стоить Grok 4.6?
Unknown. Grok 4.5 launched at $2 per million input и $6 per million output tokens — reasonable reference, но 4.6 pricing undisclosed.
Где можно будет юзать Grok 4.6?
По rollout Grok 4.5: expect Grok Build, xAI API, console first, потом third-party platforms — для 4.6 пока not confirmed.