首页 / 博客 / 涨价变阵
ENGINEERING_BLOG · 2026.08.17

DeepSeek涨价+阿里开源2.4万亿旗舰+GLM-5.3跃升:中国大模型8月为何集体「变阵」?

V4-PRO · 高峰缓存命中输入
1100%

8 月 17 日 0 点生效;headline 涨幅对应高峰时段缓存命中输入,不是整张账单

8 月 12 日到 17 日的五天里,正在算 DeepSeek / Qwen / GLM API 账单的开发者和采购方,同时撞上三件互相矛盾又互相呼应的事:DeepSeek 宣布 API 涨价最高超 1100%,阿里把从未开源过的 Qwen-Max 级旗舰 2.4 万亿参数权重放出来,智谱则用同一个基座、纯靠后训练把编程测试成绩拉高数倍。结论先给:国产大模型正在从「卷价格」转向「卷定价权」。下文按时间线、价表明细、三种打法、横向比价、争议点与六步核对清单拆开看。

SECTION 01 读「DeepSeek涨价1100%」前,先分清这四个坑

  • headline 口径不是整张账单:「涨 11 倍」「涨超 1100%」「涨 350%」都对,但分别对应高峰缓存命中输入、输出、缓存未命中输入。对重度调用者影响更大的其实是输出价(350%)和缓存未命中输入价。
  • 峰谷窗口按北京时间:高峰是 9–12 点、14–18 点,其余为空闲;空闲价是高峰价的一半。错峰调度本身就是这次调价的设计意图。
  • 「开源权重」不等于 Apache 2.0:Qwen3.8-Max 用自定义许可证,年营收超 5000 万美元的模型即服务 / AI 工作助手业务须单独谈授权。网传「禁止美欧英韩下载」是不实信息。
  • GLM-5.3 不是新基座:7430 亿参数与 GLM-5.2 相同,分数来自后训练强化学习扩规模;官方自测尚无独立第三方复测。前序单品见DeepSeek V4 满血版与峰谷计费Qwen3.8-Max 发布解读

SECTION 02 时间线:一张表看懂这两周的开源与涨价

2026 年 7–8 月中国大模型变阵 · 公开时间线
日期 事件
7月16日 月之暗面 Kimi K3(2.8 万亿参数)开源,此前已引发美方安全关注
7月30日 OpenAI 把最便宜档 GPT-5.6 Luna 降价 80%
8月2日–3日 阿里 Qwen3.8-Max 先预告、后上线云端 API
8月6日–7日 OpenAI 把 Luna 设为免费用户默认模型并开放无限文本对话
8月10日 Meta 发布开源模型 Muse Glimmer(300 亿参数,Apache 2.0),预告旗舰 Muse Spark 1.2 权重「即将开源」
8月12日 阿里在 ModelScope / Hugging Face 放出 Qwen3.8-2.4T-A95B 开源权重;同日 xAI 发布 Grok 4.6
8月13日 DeepSeek-V4-Pro 正式版上线,同步公告 8 月 17 日起 API 涨价;谷歌发布降价的 Gemini 3.7 Flash
8月14日 智谱发布 GLM-5.3,沿用 GLM-5.2 的 7430 亿参数基座
8月17日 0点(北京时间) DeepSeek 新定价正式生效

把镜头拉远:中国厂商在涨价和开源上做加法的同一时间,美国厂商正在免费和降价上做加法。这不是巧合,而是同一场定价博弈的两个侧面。OpenAI 侧降价细节见GPT-5.6 Luna / Terra / Sol 调价解读

SECTION 03 核心数据:DeepSeek价表、Qwen规格、GLM同基座对比

DeepSeek 新价于北京时间 8 月 17 日 0 点生效;高峰时段为北京时间 9–12 点、14–18 点。下表为每百万 tokens 人民币口径,交叉核对官方公告与多方报道。

DeepSeek 涨价明细(每百万 tokens,人民币)
计费项 涨价前 空闲时段(新) 高峰时段(新) 涨幅(高峰)
V4-Flash 缓存命中输入 ¥0.02 ¥0.05 ¥0.10 约 400%
V4-Flash 缓存未命中输入 ¥1.0 ¥1.5 ¥3.0 200%
V4-Flash 输出 ¥2.0 ¥4.5 ¥9.0 350%
V4-Pro 缓存命中输入 ¥0.025 ¥0.15 ¥0.30 约 1100%
V4-Pro 缓存未命中输入 ¥3.0 ¥4.5 ¥9.0 200%
V4-Pro 输出 ¥6.0 ¥13.5 ¥27.0 350%

缓存命中场景涨幅最大(最高约 12 倍 / 1100%+),但绝对金额仍很小;对重度调用者影响更大的是输出价格(350%)和缓存未命中输入价格。

Qwen3.8-2.4T-A95B(Qwen3.8-Max 开源权重)关键规格
项目 数据
参数规模 2.4 万亿总参数,950 亿激活参数(MoE,512 个专家,10 路由 + 1 共享)
上下文窗口 开源权重原生 26.2 万 tokens,可扩展至约 101 万;云端 Max 版默认 100 万 tokens
发布节奏 8 月 2 日预告 → 8 月 3 日 API 上线 → 8 月 12 日开源权重
API 定价(国际站) 输入 $2 / M tokens,输出 $6 / M tokens
许可证 非 Apache 2.0,自定义「Qwen3.8-Max License」
意义 阿里历史上首次把 Max 级(旗舰)模型开源,此前 Qwen3.5 / 3.6 / 3.7 Max 均为闭源 API
GLM-5.3 vs GLM-5.2:同基座,纯靠后训练(智谱官方自测)
基准测试 GLM-5.2 GLM-5.3 变化
Terminal-Bench 3.0 4.6% 28.3% +23.7
DeepSWE v1.1 46.2% 66.9% +20.7
Agents' Last Exam(CLI) 23.8% 28.5% +4.7
CyberGym 77.2% 84.5% +7.3
AutomationBench 26.2% 48.2% +22.0

以上为智谱官方自测,尚无独立第三方复测。GLM-5.3 在 Terminal-Bench 3.0 上仍落后 GPT-5.6 Sol(34.6%)和 Claude Fable 5(33.7%),属于「开源模型第一梯队」,并非全面登顶。

SECTION 04 三种打法:峰谷定价、自定义许可证、后训练配方

1. DeepSeek:从「贴地价」到「分时定价」,本质是算力紧张的显性化

这次涨价最容易被误读为「跟涨」,细看结构更像一次「算力账单透明化」。此前 DeepSeek 长期采用不分时段的统一低价,用低价换用户规模,再靠缓存命中率和错峰调度摊薄成本。调用量指数级增长、GPU 产能跟不上时,这套模式撑不住——公告里「鼓励更灵活的工作负载调度」,翻译过来就是「高峰算力已经不够用了,请你自己错峰」。

一个常被忽略的细节:涨价后官方 API 在高峰时段已经反超部分第三方转售平台(如 GMI Cloud、Novita 等目前报价仍低于官方高峰价)。「官方价格最便宜」这个曾经支撑 DeepSeek 护城河的假设,第一次被打破。

2. 阿里:开源权重圈住生态,自定义许可证圈住收入

Qwen3.8-Max 的开源不是简单的「慈善」。阿里同时做了两件事:把 2.4 万亿参数权重公开下载,同时配一份不同于以往 Apache 2.0 的自定义许可证——年营收超 5000 万美元的「模型即服务」或「AI 工作助手」业务,必须单独找阿里谈商业授权;月活超 1 亿或月收入超 2000 万美元的产品,必须在界面上显著展示模型名称。

逻辑是:用开源换开发者生态和口碑(尤其是海外开发者),但在真正能产生现金流的大客户身上继续保留议价权。这也是为什么它和 Meta 的 Muse Glimmer(完全 Apache 2.0,无附加条款)在「开源程度」上不是一个量级。网传许可证禁止美国、欧盟、英国、韩国用户下载,官方原文并无任何地域限制条款。

3. 智谱 GLM-5.3:不换基座,只换后训练配方

最值得关注的不是分数本身,而是怎么拿到这个分数——基座与 GLM-5.2 完全相同(7430 亿参数),没有重新预训练,仅靠扩大强化学习环境规模做后训练,就把 Terminal-Bench 3.0 从 4.6% 拉到 28.3%,接近 6 倍提升。当预训练 Scaling Law 边际收益放缓,「后训练强化学习规模化」正在成为新的性能杠杆,门槛显著低于重新训练一个千亿级基座,意味着更多中小厂商也有机会靠「精装修」追上头部模型。

deepseek-v4-pro-cny-per-1m.txt
V4-Pro  per 1M tokens  CNY  (Beijing peak 09-12 / 14-18)
off-peak  cache-hit 0.15   miss 4.5   out 13.5
peak      cache-hit 0.30   miss 9.0   out 27.0
headline  ~1100% = peak cache-hit input only

SECTION 05 横向对比:涨价之后 DeepSeek 还是最便宜的旗舰吗?

旗舰档输入 / 输出价格对照(每百万 tokens)
模型 输入价格 输出价格 开源程度
DeepSeek V4-Pro(高峰) ¥9.0(约 $1.26) ¥27.0(约 $3.78) 权重未开源
DeepSeek V4-Pro(空闲) ¥4.5(约 $0.63) ¥13.5(约 $1.89) 权重未开源
Qwen3.8-Max(国际站) $2 $6 开源(自定义许可证)
OpenAI GPT-5.6 Luna $0.20 $1.20 闭源
Claude Opus 5(据阿里披露倍数推算) 约 $5 约 $25 闭源

换算汇率按约 ¥7.15 / $1 估算,仅供参考,实际以官方公告为准。涨价后 DeepSeek V4-Pro 空闲时段价格仍明显低于 Claude Opus 5,但已经不再是「全场最低」——阿里国际站的 Qwen3.8-Max、OpenAI 的 Luna 都比 DeepSeek 的空闲价更便宜。「国产 = 最便宜」的等式正在瓦解,价格竞争进入分层阶段。

SECTION 06 争议点:哪些说法要对口径,哪些还没核实

  • 涨价幅度的口径混乱:不同媒体分别报道「涨 11 倍」「涨超 1100%」「涨 350%」,对应的是不同计费维度,阅读时需要看清具体是哪一项。
  • 阿里「震悟 M890 国产芯片」服务的说法:多家中文财经媒体报道称 Qwen3.8-Max 部分推理服务跑在阿里自研的震悟 M890 芯片和「盘古 AL128」超节点上,目前仅见于中文媒体转述,未见阿里官方独立技术文档或第三方基准测试确认,建议标注为未经独立验证
  • GLM-5.3「发现 Cursor 严重漏洞」的说法:来自 VentureBeat 报道及智谱方面透露,具体漏洞细节未公开披露,真实性和影响范围有待第三方安全机构确认,属于厂商单方面披露
  • 中国商务部可能酝酿反制出口管制:部分报道提及中国官方可能针对 AI / 半导体技术酝酿反制性出口管制措施,目前未见官方正式确认,属于媒体推测 / 传闻性质,仅供背景参考。

SECTION 07 影响与背景:这不是孤立事件,而是一场两线战争

过去一个月,中国头部模型厂商呈现出「一周三更」的密集发布节奏——DeepSeek、阿里、智谱之外,还有月之暗面 Kimi K3(7 月 16 日,2.8 万亿参数开源)、MiniMax H3 等轮番登场。国内财经媒体普遍将这一现象解读为「中国开源模型密集发布,倒逼全球 AI 行业重新定价」。Kimi K3 开源背景见Kimi K3 全面开源解读

与此同时,美国厂商走的是另一条路径:OpenAI 7 月 30 日大幅降价(Luna 降 80%),8 月 6–7 日把降价后的 Luna 设为免费用户默认模型并开放无限文本对话;谷歌 8 月 13 日发布价格减半的 Gemini 3.7 Flash。中国厂商在「开源旗舰 + 梯度涨价」,美国厂商在「消费端免费 + 降价防守」——两条路径同时发生,共同把 2026 年 8 月变成大模型行业定价逻辑重构的一个关键节点。

另一层背景是地缘政治:月之暗面 Kimi K3 的开源此前已引发美方安全审查关注,阿里选择在这个窗口把 2.4 万亿参数的旗舰模型开源,被部分分析解读为「在潜在监管收紧前,抢先巩固国产模型的国际影响力和技术对等叙事」。这一判断带有一定推测性质,但确实是理解这波开源潮时机选择时不可忽略的背景。

SECTION 08 六步核对清单:涨价和开源之后怎么评估自己的账单

  1. 先拆 headline,再看自己的计费项:把缓存命中输入、缓存未命中输入、输出分开记账,禁止用「1100%」直接乘整月账单。
  2. 对照北京时间高峰窗口:9–12 点、14–18 点走高峰价;批量评测、离线蒸馏、夜间 Agent 回放优先排到空闲时段。
  3. 用真实缓存命中率估算倍数:有分析测算重度用户(高缓存命中、多空闲)实际账单涨幅约为 1.8 倍;高峰 + 低命中才会接近 headline。
  4. 读 Qwen3.8-Max License 原文,不读转发帖:个人与内部使用基本不受影响;模型即服务 / AI 工作助手且过去 12 个月该业务累计收入超 5000 万美元须单独申请商业授权;月活超 1 亿或月收入超 2000 万美元须显著标注模型名称。无地域限制条款。
  5. 把 GLM-5.3 官方自测与第三方复测分开:Terminal-Bench 3.0 的 4.6% → 28.3% 是厂商自报;独立复测未发布前,不要把它写成「全面登顶」。
  6. 未核实信息单独记账:震悟 M890 / 盘古 AL128、Cursor 漏洞、商务部反制出口管制,均不得当作已确认事实写进采购结论。敏感评测与错峰实验若需要可控出口与 Root,优先放在独立物理节点,而不是和共享云会话绑在同一层。

SECTION 09 可引用数据与权威来源

  • V4-Pro 高峰缓存命中输入:¥0.025 → ¥0.30,约 1100%;输出 ¥6.0 → ¥27.0,350%
  • Qwen3.8-2.4T-A95B:2.4 万亿总参数 / 950 亿激活;原生 26.2 万 tokens,可扩至约 101 万;国际站 API $2 / $6
  • GLM-5.3 Terminal-Bench 3.0:4.6% → 28.3%(+23.7),同 7430 亿基座、无重新预训练;官方自测
  • 许可证门槛:年营收超 5000 万美元的 MaaS / AI 工作助手须单独授权;月活超 1 亿或月收入超 2000 万美元须显著展示模型名

以下为可核验入口(官方源与第三方报道分组)。价格、许可证条款、基准测试分数建议发布前再次打开官方页核对;芯片服务、安全漏洞发现、出口管制传闻已在正文标注为未经独立验证。

官方 / 仓库源:

DeepSeek API Docs — DeepSeek-V4-Pro GA Release(含定价更新说明)

Hugging Face — Qwen/Qwen3.8-2.4T-A95B

Z.ai — GLM-5.3: Frontier Coding with Emergent Cyber Capabilities

Z.ai Docs — GLM-5.3

第三方报道:

21 财经 — DeepSeek 调价今日正式生效,涨幅最高达 1100%

VentureBeat — GLM-5.3 and the reported Cursor vulnerability

共享云 API 一旦改成峰谷价,错峰调度、缓存命中率和出口隔离都会变成账单变量;把评测、蒸馏和 7×24 Agent 全堆在同一条共享会话上,既难控成本,也难控出口面。对于需要零损耗原生算力、稳定 iOS CI/CD 与 AI Agent 7×24 自动化的生产环境,VPSNIX 的云端物理节点通常是更优解——100% 苹果原装物理机、完整 Root 权限、无 Hypervisor 损耗、按天 / 周 / 月弹性下单,便于把错峰实验与生产流水线分在可控节点上。可结合Mac mini M4 租赁全解析定价页评估方案。

SECTION 10 常见问题 FAQ

DeepSeek 这次涨价之后,是不是意味着以后用起来更贵了?

要分场景看。如果你的调用大多落在空闲时段(非北京时间 9–12 点、14–18 点),且是缓存命中率较高的重度用户,实际涨幅会明显低于表面的「350%」「1100%」这类 headline 数字(有分析测算重度用户实际账单涨幅约为 1.8 倍左右);但如果集中在高峰时段调用、且缓存命中率低,涨幅会接近甚至达到 headline 数字。

阿里开源的 Qwen3.8-Max,个人开发者能免费商用吗?

个人开发者和内部使用基本不受影响。但如果你的业务是「模型即服务」或「AI 工作助手」类产品,且过去 12 个月内该业务累计收入超过 5000 万美元,需要单独向阿里申请商业授权;如果产品月活超 1 亿或月收入超 2000 万美元,需要在界面上显著标注模型名称。

GLM-5.3 和 GLM-5.2 是同一个模型吗?为什么突然变强这么多?

底层基座模型确实完全相同(7430 亿参数),智谱没有重新训练。分数大幅提升的原因是后训练阶段大幅扩大了强化学习环境的规模,这说明当前阶段「后训练规模化」本身就是一个独立、有效的性能杠杆,不一定需要重新预训练一个更大的基座。

网传阿里的 Qwen3.8-Max 许可证禁止美国、欧盟用户下载,是真的吗?

不是真的。这是网络上流传的不实信息,官方许可证原文中没有任何地域限制条款,主要限制是针对超过特定营收规模的商业化服务,与用户所在地区无关。

Meta 这次开源 Muse Glimmer,是不是意味着 Llama 时代的开源精神又回来了?

目前还只能算「部分回归」。Muse Glimmer 本身只是一个 300 亿参数的蒸馏小模型,Meta 真正的旗舰闭源模型 Muse Spark 1.2 尚未开源,扎克伯格只是「预告」未来会开放其权重。如果这一步真的落地,才称得上是美国厂商首次把旗舰级闭源模型转为开源,目前仍需持续关注后续进展。