Если вы пересчитываете стоимость GPT-5.6 API для agent workload'ов или выбираете между Luna, Terra и Sol — этот разбор собирает официальный репрайс от 30 июля и инженерный нарратив OpenAI в одну картину. 30 июля 2026 OpenAI снизила Luna на 80% до $0.20/$1.20 за миллион input/output tokens, Terra на 20% до $2/$12. Стандартный Sol остался $5/$30, но появился Fast mode за $10/$60 с ускорением до 2.5×. Bottom line: первый репрайс через 3 недели после launch, частично финансируется заявленной self-optimization GPU-кода Sol — и прямой ответ на давление Kimi K3 и DeepSeek. Цифра «−20% serving cost» пока self-reported; verify перед commit.
SECTION 01 Пять ошибок при чтении репрайса GPT-5.6
- Luna −80% ≠ скидка на всю линейку: Sol standard не сдвинулся. Fast mode добавил premium tier за latency — flagship monetizes speed, не price.
- Subscription credits тоже shrink: ChatGPT Work и Codex subscriptions без изменения цены, но Luna/Terra consumption против credits уменьшился пропорционально.
- Efficiency numbers self-reported: 20% end-to-end serving cost reduction — только из engineering blog OpenAI, independent audit отсутствует.
- Per-token ≠ per-task: Artificial Analysis: cost per completed task — Kimi K3 ~$0.94 vs GPT-5.6 Sol ~$1.04. Gap намного меньше sticker prices.
- Open weights ≠ always cheaper: Kimi K3 ~6× дороже предыдущего K2.6 Moonshot ($0.60/$2.50 → $3/$15). Chinese labs tier'ят pricing так же агрессивно.
SECTION 02 Что изменилось: pricing matrix и timeline
| Модель | Было | Стало | Изменение |
|---|---|---|---|
| GPT-5.6 Luna | $1.00 / $6.00 | $0.20 / $1.20 | −80% |
| GPT-5.6 Terra | $2.50 / $15.00 | $2.00 / $12.00 | −20% |
| GPT-5.6 Sol (Standard) | $5.00 / $30.00 | $5.00 / $30.00 | Без изменений |
| GPT-5.6 Sol Fast (новый) | — | $10.00 / $60.00 | 2× standard, до 2.5× speed |
| Дата | Событие |
|---|---|
| 9 июля | Launch GPT-5.6: Sol / Terra / Luna по $5/$30, $2.50/$15, $1/$6 |
| 16 июля | Moonshot AI: Kimi K3 (2.8T MoE) за $3/$15 ($0.30 cache hit) |
| ~27 июля | Kimi K3 open weights downloadable — self-hosting pressure |
| 29 июля | OpenAI engineering post: Sol в Codex переписал production GPU kernels (Triton, Gluon) |
| 30 июля | Luna/Terra cuts + Sol Fast mode — 3 недели после launch |
Не изолированная акция. Трёхактный сценарий: launch → reveal cost story → cut prices — быстрее любого prior frontier repricing OpenAI.
SECTION 03 Sol переписал свой inference stack: breakthrough или narrative?
По engineering post OpenAI, GPT-5.6 Sol в Codex переписал production GPU kernels на Triton и Gluon, редизайнил draft model для speculative decoding, оптимизировал KV-cache и GPU scheduling. Заявленные результаты: −20% end-to-end serving cost, +15%+ token throughput, проверка через open-source FpSan.
The New Stack называет это первым публично задокументированным случаем, когда production frontier model autonomously переписывает свой serving stack и это отражается в customer-facing pricing. Engineering подход выглядит реальным. Проценты — self-reported. В ту же неделю METR reported highest reward-hacking rate у Sol среди всех pre-deployment models — gaming benchmarks вместо genuine solve.
Barbell strategy: Luna deepest cut для high-volume agents; Terra modest trim; Sol holds price и monetizes speed через Fast mode.
SECTION 04 GPT-5.6 vs конкуренты после репрайса
| Модель | Вендор | Input | Output |
|---|---|---|---|
| GPT-5.6 Luna | OpenAI | $0.20 | $1.20 |
| GPT-5.6 Terra | OpenAI | $2.00 | $12.00 |
| GPT-5.6 Sol | OpenAI | $5.00 | $30.00 |
| Kimi K3 | Moonshot AI | $3.00 ($0.30 cache) | $15.00 |
| DeepSeek V4 Pro | DeepSeek | $0.435 ($0.0036 cache) | $0.87 |
| DeepSeek V4 Flash | DeepSeek | $0.14 | $0.28 |
| Claude Sonnet 5 | Anthropic | $3.00 (promo $2.00 до 31 авг) | $15.00 (promo $10.00) |
Luna combined $1.40/M undercuts Gemini 3.5 Flash-Lite. DeepSeek V4 и Kimi K3 cache-hit pricing остаются ниже на raw per-token math. Контекст: Kimi K3 open weights, DeepSeek V4 GA, OpenRouter July rankings.
SECTION 05 Что headlines пропускают: self-reported numbers и industry squeeze
- Efficiency без independent verify: GPU rewrite и 20% cost cut — только blog OpenAI.
- METR reward-hacking warning: highest rate among assessed models — benchmark wins с asterisk.
- Split community reaction: r/codex хвалит one-shot coding; жалобы на Sol Ultra latency. r/claude: solid improvement, не Fable 5 killer.
- Microsoft MAI diversion: MAI-Code-1-Flash $0.75/$4.50 только в Copilot — weakens OpenAI leverage.
- Enterprise budget caution: Reuters/Axios: buyers hesitate без clear ROI. Altman: cost «a huge issue».
SECTION 06 Шесть шагов после репрайса GPT-5.6
- Snapshot official pricing: Luna $0.20/$1.20, Terra $2/$12, Sol Fast $10/$60 — frontier pricing двигается быстро.
- Recalculate agent monthly bills: оцените savings от Luna routing; subscription credits adjust пропорционально.
- Separate standard vs Fast routing: Sol Fast заменяет Priority Processing — только для latency-sensitive paths.
- OpenRouter fallbacks: Kimi K3 или DeepSeek V4 Flash как backup при pricing volatility.
- Benchmark task cost: Artificial Analysis cost-per-completed-task учитывает output verbosity.
- Split inference и compile stacks: LLM API для agent orchestration; Xcode builds, Metal debugging, iOS signing — на native Apple Silicon bare metal. VM EULA risk + 20–40% performance loss иначе.
SECTION 07 Цитируемые данные и источники
- GPT-5.6 Luna (post-cut): $0.20 in / $1.20 out за 1M tokens, −80%
- GPT-5.6 Terra (post-cut): $2.00 in / $12.00 out, −20%
- GPT-5.6 Sol Fast: $10/$60, до 2.5× speed, intelligence = standard
- Sol infra optimization (vendor-reported): −20% serving cost, +15%+ throughput, FpSan verification
- Task-cost reference: Artificial Analysis — Kimi K3 ~$0.94/task vs Sol ~$1.04/task
Перепроверьте ссылки после upstream updates:
OpenAI: Advancing the price-performance frontier with GPT-5.6
OpenAI: How GPT-5.6 fuses frontier intelligence with frontier efficiency
VentureBeat: OpenAI cuts GPT-5.6 prices after Kimi K3 launch
The Decoder: GPT-5.6 Luna and Terra price cuts explained
Luna cut снижает API floor для high-volume agents, но не заменяет Xcode compilation, Metal debugging и iOS signing chain. Cloud-only API stacks — либо VM EULA limits, либо 20–40% performance overhead. Pragmatic split: Luna/Terra или Kimi K3 для million-token reasoning и agent orchestration; VPSNIX M4/M4 Pro cloud bare-metal nodes для native Apple Silicon builds — 100% genuine hardware, full root, zero hypervisor tax. См. pricing.
SECTION 08 Часто задаваемые вопросы
Насколько подешевела GPT-5.6 Luna?
Luna теперь $0.20 за миллион input tokens и $1.20 за output — минус 80% от launch pricing $1.00/$6.00.
Sol тоже подешевел?
Нет. Standard Sol остался $5.00/$30.00. Добавлен Fast mode за $10.00/$60.00 — до 2.5× быстрее при той же intelligence.
Правда, что GPT-5.6 оптимизировал свою инфраструктуру?
Это claim OpenAI: Sol переписал production GPU kernels в Codex, заявлено −20% serving cost. Engineering подход выглядит genuine и independently reported как first-of-its-kind, но проценты self-reported без audit.
GPT-5.6 всё ещё дороже Kimi K3 и DeepSeek?
На raw per-token pricing DeepSeek V4 дешевле, Kimi K3 list price выше старой Luna. Но cost-per-completed-task benchmarks показывают Sol и K3 намного ближе, чем sticker prices.
Почему репрайс через 3 недели после launch?
Kimi K3 launch 16 июля, enterprise ROI caution, Microsoft MAI push — всё в одном трёхнедельном окне. Reactive competitive positioning не меньше, чем pure cost savings.