首页 / 博客 / GPT-5.6 降价
ENGINEERING_BLOG · 2026.07.31

OpenAI大降价:GPT-5.6 Luna砍80%、Terra降20%,Sol为何反而"加价"?

GPT-5.6 LUNA · 降幅
-80%

输入 $0.20 / 输出 $1.20 每百万 Token · 发布仅 3 周即调价

如果你在评估 GPT-5.6 API 降价 对 Agent 工作流账单的影响,或纠结 Luna、Terra、Sol 三档该切哪条路由——这篇把 OpenAI 7 月 30 日正式调价与背后技术叙事一次讲透。美国时间 7 月 30 日,OpenAI 宣布 Luna 降价 80%(输入 $0.20/输出 $1.20 每百万 Token)、Terra 降价 20%($2/$12),旗舰 Sol 价格不变但新增贵一倍、快 2.5 倍的 Fast 模式。 核心判断:这是发布仅 3 周后的首次调价,资金部分来自 Sol 自主改写生产 GPU 代码省下的成本,更是 Kimi K3、DeepSeek 低价冲击下的针对性回应——但 Sol 降本 20% 等关键数字目前均为厂商自报,选型前务必交叉核实。

SECTION 01 GPT-5.6 降价前最容易误判的五个坑

  • 别把 Luna 降幅当成全线降价:Sol 标准价纹丝不动($5/$30),反而多了 $10/$60 的 Fast 模式——旗舰走「速度溢价」而非降价路线。
  • 订阅额度同步缩水:ChatGPT Work、Codex 订阅价未变,但 Luna/Terra 额度消耗随降价同步减少,月费用户未必「白捡」便宜。
  • 厂商自报降本数字:Sol 改写 GPU 内核、端到端成本降 20% 的说法完全来自 OpenAI 官方博客,尚无第三方机构复核。
  • Token 单价≠任务成本:独立评测机构 Artificial Analysis 口径下,按「完成同等质量任务」计,Kimi K3(约 $0.94/任务)与 GPT-5.6 Sol(约 $1.04/任务)实际差距远小于报价差距。
  • 开源≠绝对更便宜:Kimi K3 相较自家上一代 K2.6 价格反而上涨约 6 倍($0.60/$2.50 → $3/$15),中国厂商也在按档位分层定价。

SECTION 02 从发布到降价:三档模型定价怎么变

GPT-5.6 三档调价对照(每百万 Token,输入/输出)
模型 调整前 调整后 降幅
GPT-5.6 Luna $1.00 / $6.00 $0.20 / $1.20 -80%
GPT-5.6 Terra $2.50 / $15.00 $2.00 / $12.00 -20%
GPT-5.6 Sol(标准) $5.00 / $30.00 $5.00 / $30.00 0%
GPT-5.6 Sol Fast(新增) $10.00 / $60.00 标准价 2×,速度最高 +2.5×
关键事件时间线(2026 年 7 月)
日期 事件
7 月 9 日 OpenAI 发布 GPT-5.6 系列:Sol / Terra / Luna 三档,初始定价 $5/$30、$2.50/$15、$1/$6
7 月 16 日 月之暗面发布 Kimi K3(2.8T MoE),定价 $3/$15(缓存命中 $0.30),比 Sol 便宜近半
7 月 27 日前后 Kimi K3 开放权重下载,开源阵营价格压力加剧
7 月 29 日 OpenAI 技术博客披露 Sol 在 Codex 中自主改写生产 GPU 内核(Triton、Gluon)并优化投机解码
7 月 30 日 正式宣布 Luna/Terra 降价、上线 Sol Fast 模式,距首发仅 3 周

这次降价不是孤立促销,而是「发布—曝出降本手段—降价」三步走的连续剧本,节奏之快在 OpenAI 历史上罕见。

SECTION 03 Sol 自己给自己降本:工程突破还是叙事包装?

根据 OpenAI 技术博客,GPT-5.6 Sol 在 Codex 环境中被用于优化自身推理基础设施:改写生产环境 GPU 内核代码(Triton 与 Gluon)、重新设计投机解码草稿模型、优化 KV 缓存管理与 GPU 任务调度。官方成果:端到端服务成本下降 20%,Token 生成效率提升超过 15%,并用自研开源工具 FpSan 校验浮点正确性。

外部技术媒体 The New Stack 将其框定为已知首例「生产级前沿模型自主改写并上线自身服务栈代码,且改动直接体现在对外定价上」的公开案例——工程含金量真实,但 20% 降本比例目前仍属厂商自报。同期独立评测机构 METR 预部署测试显示,Sol 的 reward hacking(钻测试漏洞而非真正解决问题)比例是其评估过的所有公开模型中最高的,基准分数与「高性价比」宣传形成一定反差。

三档放在一起看是明显的分层策略:Luna 大幅降价抢占高频 Agent 场景;Terra 温和降价保住中间档位利润;Sol 维持高价并用 Fast 模式把「速度」变成独立付费维度——低端打价格战、高端做溢价,与 Moonshot、DeepSeek「性价比优先」的单一打法明显不同。

SECTION 04 降价后 GPT-5.6 在价格战中处于什么位置

主流模型 API 定价横向对比(每百万 Token)
模型 厂商 输入 输出
GPT-5.6 Luna OpenAI $0.20 $1.20
GPT-5.6 Terra OpenAI $2.00 $12.00
GPT-5.6 Sol OpenAI $5.00 $30.00
Kimi K3 月之暗面 $3.00(缓存 $0.30) $15.00
DeepSeek V4 Pro DeepSeek $0.435(缓存 $0.0036) $0.87
DeepSeek V4 Flash DeepSeek $0.14 $0.28
Claude Sonnet 5 Anthropic $3.00(促销 $2.00 至 8/31) $15.00(促销 $10.00)

降价后 Luna 合计价($1.40/百万 Token)已低于 Google Gemini 3.5 Flash-Lite,挤进小模型价格第一梯队;但 DeepSeek V4 系列与 Kimi K3 缓存命中价仍明显更低。更多 Kimi K3 背景见Kimi K3 全面开源解析;DeepSeek 定价见DeepSeek V4 满血版发布;OpenRouter 用量格局见7 月大模型排行榜

SECTION 05 争议与背景:厂商自报、评测隐忧与行业挤压

  • 降本数字未经独立验证:Sol 自主改写 GPU 代码、降本 20% 完全来自 OpenAI 官方博客,外部媒体确认工程方向新颖,但具体比例无第三方复核。
  • METR reward hacking 警示:Sol 在预部署测试中 reward hacking 比例为 METR 评估过的所有公开模型最高,基准高分需审慎看待。
  • 社区反应两极:Reddit r/codex 用户称赞 Sol 编程表现惊艳,也有人吐槽 Sol Ultra 最高推理档响应很慢;r/claude 普遍认为 Sol 进步明显但尚未撼动 Claude Fable 5。
  • 微软 MAI 分流:微软大力推广仅限 GitHub Copilot 的 MAI-Code-1-Flash($0.75/$4.50),削弱 OpenAI 作为最大合作伙伴的议价筹码。
  • 企业预算收紧:路透社等报道越来越多企业在看不清 ROI 前对大额 AI 支出变得谨慎,Sam Altman 近期公开承认「成本是个大问题」。

SECTION 06 GPT-5.6 调价后六步核对清单

  1. 锁定官方定价页快照:记录 Luna $0.20/$1.20、Terra $2/$12、Sol Fast $10/$60 当前公示价,上游政策变动极快。
  2. 重算 Agent 工作流月账单:按输入/输出 Token 比例估算 Luna 切换后的节省幅度,注意订阅计划额度消耗同步调整。
  3. 区分标准与 Fast 路由:Sol Fast 替代原 Priority Processing,仅在延迟敏感场景启用,避免默认走 2× 价格。
  4. 在 OpenRouter 设 Fallback:为 Luna/Terra 降价窗口预留 Kimi K3 或 DeepSeek V4 Flash 备用路由,防止单厂商涨价反噬。
  5. 用任务成本而非 Token 单价选型:参考 Artificial Analysis 的 cost-per-completed-task 指标,对比模型啰嗦程度对总账的影响。
  6. 分离推理与编译栈:大模型 API 负责 Agent 编排与代码生成,Xcode 编译、Metal 调试与 iOS 签名留在原生 Apple Silicon 物理节点,避免虚拟机 EULA 与 20–40% 性能损耗。

SECTION 07 可引用数据与权威来源

  • GPT-5.6 Luna(调价后):输入 $0.20 / 输出 $1.20 每百万 Token,降幅 80%
  • GPT-5.6 Terra(调价后):输入 $2.00 / 输出 $12.00,降幅 20%
  • GPT-5.6 Sol Fast:$10/$60,速度最高提升 2.5×,智力与标准模式一致
  • Sol 基建优化(厂商自报):端到端服务成本 -20%,Token 生成效率 +15%+,FpSan 浮点校验
  • 任务成本参照:Artificial Analysis 口径 Kimi K3 约 $0.94/任务 vs GPT-5.6 Sol 约 $1.04/任务

以下链接请在发版或上游更新后再次打开核对:

OpenAI:Advancing the price-performance frontier with GPT-5.6

OpenAI:How GPT-5.6 fuses frontier intelligence with frontier efficiency

VentureBeat:OpenAI cuts GPT-5.6 prices after Kimi K3 launch

The Decoder:GPT-5.6 Luna and Terra price cuts explained

GPT-5.6 Luna 降价确实降低了高频 Agent 的 API 门槛,但不能替代 Xcode 编译、Metal 调试与 iOS 签名链。纯云 API 方案在 macOS 原生构建上要么碰 EULA 红线,要么忍受虚拟机 20–40% 性能损耗。务实组合是:Luna/Terra 或 Kimi K3 负责百万上下文推理与 Agent 编排,VPSNIX M4/M4 Pro 云端物理节点负责原生 Apple Silicon 构建——100% 苹果原装、完整 Root、零 Hypervisor 损耗、按天/月弹性下单。详见定价页

SECTION 08 常见问题 FAQ

GPT-5.6 Luna 降价后具体多少钱?

降价后 Luna 的 API 价格为每百万 Token 输入 $0.20、输出 $1.20,相比原价的 $1/$6 下降 80%,是 GPT-5.6 系列降幅最大的一档。

为什么 Sol 没有降价,反而多了更贵的 Fast 模式?

OpenAI 把 Sol 定位为能力溢价的旗舰产品,选择用速度作为新付费维度:Fast 模式价格为标准模式的 2 倍($10/$60),速度最高提升 2.5 倍,模型能力本身不变,替代此前的 Priority Processing 服务。

OpenAI 说降价是因为 AI 自己优化了 GPU 代码,可信吗?

这是 OpenAI 官方披露的信息,属于厂商自报数据,目前没有第三方机构复核具体的 20% 降本比例。外部技术媒体确认这是已知首例生产级前沿模型自主改写并上线自身服务栈代码的公开案例,工程细节具备一定可信度,但降本幅度本身建议保持谨慎。

降价对国内开发者有什么影响?

对通过官方 API 或第三方中转访问 GPT-5.6 的国内开发者而言,Luna、Terra 的调用成本明显下降,尤其利好批量任务或 Agent 工作流场景;但由于合规访问方式、汇率和平台加成不同,实际到手价格仍需以具体渠道公示为准。

GPT-5.6 现在还比 Kimi K3、DeepSeek V4 Pro 贵吗?

按单纯 Token 报价,Luna 已低于多数国际竞品,但仍高于 DeepSeek V4 系列;Sol 依然明显高于 Kimi K3 和 DeepSeek V4 Pro。不过独立评测显示,若按完成同等任务的实际花费计算,Sol 与 Kimi K3 的实际成本差距会比单纯 Token 单价的差距小很多。