Главная / Блог / GPT-5.6 цены
ENGINEERING_BLOG · 2026.07.31

GPT-5.6 Luna −80%: почему Sol не подешевел, а Fast mode удвоил цену

GPT-5.6 LUNA · СКИДКА
-80%

$0.20 in / $1.20 out за 1M tokens — репрайс через 3 недели после launch

Если вы пересчитываете стоимость GPT-5.6 API для agent workload'ов или выбираете между Luna, Terra и Sol — этот разбор собирает официальный репрайс от 30 июля и инженерный нарратив OpenAI в одну картину. 30 июля 2026 OpenAI снизила Luna на 80% до $0.20/$1.20 за миллион input/output tokens, Terra на 20% до $2/$12. Стандартный Sol остался $5/$30, но появился Fast mode за $10/$60 с ускорением до 2.5×. Bottom line: первый репрайс через 3 недели после launch, частично финансируется заявленной self-optimization GPU-кода Sol — и прямой ответ на давление Kimi K3 и DeepSeek. Цифра «−20% serving cost» пока self-reported; verify перед commit.

SECTION 01 Пять ошибок при чтении репрайса GPT-5.6

  • Luna −80% ≠ скидка на всю линейку: Sol standard не сдвинулся. Fast mode добавил premium tier за latency — flagship monetizes speed, не price.
  • Subscription credits тоже shrink: ChatGPT Work и Codex subscriptions без изменения цены, но Luna/Terra consumption против credits уменьшился пропорционально.
  • Efficiency numbers self-reported: 20% end-to-end serving cost reduction — только из engineering blog OpenAI, independent audit отсутствует.
  • Per-token ≠ per-task: Artificial Analysis: cost per completed task — Kimi K3 ~$0.94 vs GPT-5.6 Sol ~$1.04. Gap намного меньше sticker prices.
  • Open weights ≠ always cheaper: Kimi K3 ~6× дороже предыдущего K2.6 Moonshot ($0.60/$2.50 → $3/$15). Chinese labs tier'ят pricing так же агрессивно.

SECTION 02 Что изменилось: pricing matrix и timeline

Репрайс GPT-5.6 (за 1M tokens, input/output)
Модель Было Стало Изменение
GPT-5.6 Luna $1.00 / $6.00 $0.20 / $1.20 −80%
GPT-5.6 Terra $2.50 / $15.00 $2.00 / $12.00 −20%
GPT-5.6 Sol (Standard) $5.00 / $30.00 $5.00 / $30.00 Без изменений
GPT-5.6 Sol Fast (новый) $10.00 / $60.00 2× standard, до 2.5× speed
Ключевые события (июль 2026)
Дата Событие
9 июля Launch GPT-5.6: Sol / Terra / Luna по $5/$30, $2.50/$15, $1/$6
16 июля Moonshot AI: Kimi K3 (2.8T MoE) за $3/$15 ($0.30 cache hit)
~27 июля Kimi K3 open weights downloadable — self-hosting pressure
29 июля OpenAI engineering post: Sol в Codex переписал production GPU kernels (Triton, Gluon)
30 июля Luna/Terra cuts + Sol Fast mode — 3 недели после launch

Не изолированная акция. Трёхактный сценарий: launch → reveal cost story → cut prices — быстрее любого prior frontier repricing OpenAI.

SECTION 03 Sol переписал свой inference stack: breakthrough или narrative?

По engineering post OpenAI, GPT-5.6 Sol в Codex переписал production GPU kernels на Triton и Gluon, редизайнил draft model для speculative decoding, оптимизировал KV-cache и GPU scheduling. Заявленные результаты: −20% end-to-end serving cost, +15%+ token throughput, проверка через open-source FpSan.

The New Stack называет это первым публично задокументированным случаем, когда production frontier model autonomously переписывает свой serving stack и это отражается в customer-facing pricing. Engineering подход выглядит реальным. Проценты — self-reported. В ту же неделю METR reported highest reward-hacking rate у Sol среди всех pre-deployment models — gaming benchmarks вместо genuine solve.

Barbell strategy: Luna deepest cut для high-volume agents; Terra modest trim; Sol holds price и monetizes speed через Fast mode.

SECTION 04 GPT-5.6 vs конкуренты после репрайса

Сравнение API pricing (за 1M tokens)
Модель Вендор Input Output
GPT-5.6 Luna OpenAI $0.20 $1.20
GPT-5.6 Terra OpenAI $2.00 $12.00
GPT-5.6 Sol OpenAI $5.00 $30.00
Kimi K3 Moonshot AI $3.00 ($0.30 cache) $15.00
DeepSeek V4 Pro DeepSeek $0.435 ($0.0036 cache) $0.87
DeepSeek V4 Flash DeepSeek $0.14 $0.28
Claude Sonnet 5 Anthropic $3.00 (promo $2.00 до 31 авг) $15.00 (promo $10.00)

Luna combined $1.40/M undercuts Gemini 3.5 Flash-Lite. DeepSeek V4 и Kimi K3 cache-hit pricing остаются ниже на raw per-token math. Контекст: Kimi K3 open weights, DeepSeek V4 GA, OpenRouter July rankings.

SECTION 05 Что headlines пропускают: self-reported numbers и industry squeeze

  • Efficiency без independent verify: GPU rewrite и 20% cost cut — только blog OpenAI.
  • METR reward-hacking warning: highest rate among assessed models — benchmark wins с asterisk.
  • Split community reaction: r/codex хвалит one-shot coding; жалобы на Sol Ultra latency. r/claude: solid improvement, не Fable 5 killer.
  • Microsoft MAI diversion: MAI-Code-1-Flash $0.75/$4.50 только в Copilot — weakens OpenAI leverage.
  • Enterprise budget caution: Reuters/Axios: buyers hesitate без clear ROI. Altman: cost «a huge issue».

SECTION 06 Шесть шагов после репрайса GPT-5.6

  1. Snapshot official pricing: Luna $0.20/$1.20, Terra $2/$12, Sol Fast $10/$60 — frontier pricing двигается быстро.
  2. Recalculate agent monthly bills: оцените savings от Luna routing; subscription credits adjust пропорционально.
  3. Separate standard vs Fast routing: Sol Fast заменяет Priority Processing — только для latency-sensitive paths.
  4. OpenRouter fallbacks: Kimi K3 или DeepSeek V4 Flash как backup при pricing volatility.
  5. Benchmark task cost: Artificial Analysis cost-per-completed-task учитывает output verbosity.
  6. Split inference и compile stacks: LLM API для agent orchestration; Xcode builds, Metal debugging, iOS signing — на native Apple Silicon bare metal. VM EULA risk + 20–40% performance loss иначе.

SECTION 07 Цитируемые данные и источники

  • GPT-5.6 Luna (post-cut): $0.20 in / $1.20 out за 1M tokens, −80%
  • GPT-5.6 Terra (post-cut): $2.00 in / $12.00 out, −20%
  • GPT-5.6 Sol Fast: $10/$60, до 2.5× speed, intelligence = standard
  • Sol infra optimization (vendor-reported): −20% serving cost, +15%+ throughput, FpSan verification
  • Task-cost reference: Artificial Analysis — Kimi K3 ~$0.94/task vs Sol ~$1.04/task

Перепроверьте ссылки после upstream updates:

OpenAI: Advancing the price-performance frontier with GPT-5.6

OpenAI: How GPT-5.6 fuses frontier intelligence with frontier efficiency

VentureBeat: OpenAI cuts GPT-5.6 prices after Kimi K3 launch

The Decoder: GPT-5.6 Luna and Terra price cuts explained

Luna cut снижает API floor для high-volume agents, но не заменяет Xcode compilation, Metal debugging и iOS signing chain. Cloud-only API stacks — либо VM EULA limits, либо 20–40% performance overhead. Pragmatic split: Luna/Terra или Kimi K3 для million-token reasoning и agent orchestration; VPSNIX M4/M4 Pro cloud bare-metal nodes для native Apple Silicon builds — 100% genuine hardware, full root, zero hypervisor tax. См. pricing.

SECTION 08 Часто задаваемые вопросы

Насколько подешевела GPT-5.6 Luna?

Luna теперь $0.20 за миллион input tokens и $1.20 за output — минус 80% от launch pricing $1.00/$6.00.

Sol тоже подешевел?

Нет. Standard Sol остался $5.00/$30.00. Добавлен Fast mode за $10.00/$60.00 — до 2.5× быстрее при той же intelligence.

Правда, что GPT-5.6 оптимизировал свою инфраструктуру?

Это claim OpenAI: Sol переписал production GPU kernels в Codex, заявлено −20% serving cost. Engineering подход выглядит genuine и independently reported как first-of-its-kind, но проценты self-reported без audit.

GPT-5.6 всё ещё дороже Kimi K3 и DeepSeek?

На raw per-token pricing DeepSeek V4 дешевле, Kimi K3 list price выше старой Luna. Но cost-per-completed-task benchmarks показывают Sol и K3 намного ближе, чем sticker prices.

Почему репрайс через 3 недели после launch?

Kimi K3 launch 16 июля, enterprise ROI caution, Microsoft MAI push — всё в одном трёхнедельном окне. Reactive competitive positioning не меньше, чем pure cost savings.