DeepSeek、Qwen、GLMのAPI請求を見ているチームは、同じ週に矛盾して見える3手を同時に受けました。DeepSeekは一部の課金項目を最大1,100%引き上げました。アリババは未公開だった2.4兆パラメータのフラッグシップをオープンウェイトで出しました。智譜はGLM-5.3を投入し、同一基座のままコーディング指標を約6倍に伸ばしました。再学習はありません。結論は単純です。中国のラボは「最安値だけ」で争う段階から、「価格決定力」で争う段階へ移っています。本記事はタイムライン、料金表、3社の戦略、横断比較、未確認事項、六段階チェックリストの順で、公開情報だけを整理します。
SECTION 01 DeepSeek 1,100%値上げを引用する前に外す4つの落とし穴
- 見出しは1行の課金項目であり、請求書そのものではありません:「11倍」「1,100%超」「350%」はいずれも正しい数字です。それぞれピーク時キャッシュヒット入力、出力、キャッシュミス入力に対応します。実請求を動かすのは、ほぼゼロに近かったキャッシュヒット枠より、出力(350%)とキャッシュミス入力です。
- ピーク時間は北京時間です:午前9時〜12時、午後2時〜6時です。それ以外はオフピークで、ピーク時の半額です。公告の意図は、負荷を自分でずらすことです。
- オープンウェイトは Apache 2.0 ではありません:Qwen3.8-Maxは独自ライセンスです。Model-as-a-Service または AI Work Assistant 事業で、任意の12か月間に5,000万ドルを超える収益がある場合は、別途の商用契約が必要です。米国・EU・英国・韓国の利用者がウェイトをダウンロードできない、という主張は誤りです。
- GLM-5.3は新しい基座ではありません:パラメータ数はGLM-5.2と同じ743Bです。伸びは後学習の強化学習を拡大した結果です。点数はメーカー自己申告であり、第三者による再測定はまだ公開されていません。先行メモはDeepSeek V4 GAとピークバレー課金、Qwen3.8-Max公開メモを参照してください。
SECTION 02 タイムライン:何が公開され、いつ料金が変わったか
| 日付 | 出来事 |
|---|---|
| 2026年7月16日 | Moonshot AIがKimi K3(2.8Tパラメータ)をオープンウェイト公開。米国側の安全保障上の注視を招く |
| 2026年7月30日 | OpenAIがGPT-5.6 Lunaを80%値下げ |
| 2026年8月2日〜3日 | アリババがQwen3.8-Maxをプレビューし、続けてホスト型APIとして正式公開 |
| 2026年8月6日〜7日 | OpenAIがLunaを無料の既定モデルにし、テキストチャットを無制限化 |
| 2026年8月10日 | MetaがMuse Glimmer(30B、Apache 2.0)を公開し、フラッグシップMuse Spark 1.2のオープンウェイトを予告 |
| 2026年8月12日 | アリババがQwen3.8-2.4T-A95BをHugging Face / ModelScopeに掲載。同日xAIがGrok 4.6を投入 |
| 2026年8月13日 | DeepSeek-V4-ProがGAし、8月17日発効の値上げを発表。Googleは値下げしたGemini 3.7 Flashを投入 |
| 2026年8月14日 | 智譜がGLM-5.3を公開。基座はGLM-5.2と同じ743Bを再利用 |
| 2026年8月17日 0時(北京時間) | DeepSeekの新料金が発効 |
俯瞰すると、中国側が値上げとフラッグシップのウェイト公開を進める一方、米国側は消費者層で値下げと無料化を進めています。同じ競争の裏表です。OpenAI側の値下げはGPT-5.6 Luna / Terra / Solの値下げメモで整理しています。
SECTION 03 数字の対照:DeepSeek料金表、Qwen仕様、GLMは後学習のみ
DeepSeekの新料金は北京時間8月17日0時に発効します。ピーク時間は北京時間の午前9時〜12時と午後2時〜6時です。下表は100万トークンあたりの人民元建ての公式値で、公式公告と複数報道で照合しています。
| 課金項目 | 旧価格 | 新オフピーク | 新ピーク | ピーク時の上昇 |
|---|---|---|---|---|
| V4-Flash キャッシュヒット(入力) | ¥0.02 | ¥0.05 | ¥0.10 | 約400% |
| V4-Flash キャッシュミス(入力) | ¥1.0 | ¥1.5 | ¥3.0 | 200% |
| V4-Flash 出力 | ¥2.0 | ¥4.5 | ¥9.0 | 350% |
| V4-Pro キャッシュヒット(入力) | ¥0.025 | ¥0.15 | ¥0.30 | 約1,100% |
| V4-Pro キャッシュミス(入力) | ¥3.0 | ¥4.5 | ¥9.0 | 200% |
| V4-Pro 出力 | ¥6.0 | ¥13.5 | ¥27.0 | 350% |
1,100%はピーク時キャッシュヒット入力にだけ当てはまります。もともとほぼ無料に近かった枠です。実請求の大半を占める出力は350%です。オフピーク中心でキャッシュヒットが半分程度の重い負荷を独立試算すると、請求は約1.8倍に寄ります。
| 仕様 | 内容 |
|---|---|
| パラメータ | 総計2.4T、トークンあたり活性95B(MoE、512エキスパート、ルーティング10+共有1) |
| コンテキスト窓 | オープンチェックポイントはネイティブ262,144トークン、約1.01Mまで延長可能。ホスト型Maxの既定は1M |
| 公開順 | 8月2日プレビュー → 8月3日API公開 → 8月12日オープンウェイト |
| API料金(国際) | 入力$2/M、出力$6/M |
| ライセンス | Apache 2.0ではない。独自のQwen3.8-Max License |
| 位置づけ | アリババがMax級フラッグシップをオープンウェイトにした初例。Qwen3.5 / 3.6 / 3.7 MaxはAPIのみでした |
| ベンチマーク | GLM-5.2 | GLM-5.3 | 変化 |
|---|---|---|---|
| Terminal-Bench 3.0 | 4.6% | 28.3% | +23.7 pts |
| DeepSWE v1.1 | 46.2% | 66.9% | +20.7 pts |
| Agents' Last Exam (CLI) | 23.8% | 28.5% | +4.7 pts |
| CyberGym | 77.2% | 84.5% | +7.3 pts |
| AutomationBench | 26.2% | 48.2% | +22.0 pts |
これらは智譜の自測です。第三者による再測定は公開されていません。Terminal-Bench 3.0では、GLM-5.3はGPT-5.6 Sol(34.6%)とClaude Fable 5(33.7%)の後ろにいます。オープンウェイトとしては上位ですが、フロンティア全体の首位ではありません。
SECTION 04 3つの戦略:時間帯課金、独自ライセンス、後学習の拡大
DeepSeek:戦略転換ではなく、供給制約が料金表に出た
「中国最安モデルがついに粗利に屈した」と読むのは誤りやすいです。料金の形は逆を示しています。計算資源の不足が、価格表の上で可視化された、という読みの方が整合します。常時安価な一律料金は、GPU供給が需要に追いついているあいだは獲得施策として機能しました。利用が指数的に伸び、供給が追いつかなくなると、どこかを明示せざるを得ません。「より柔軟なワークロードスケジューリングを促す」は、企業向けの言い換えです。ピーク時の計算資源は不足しているので、負荷は利用側でずらしてください、という意味です。
海外報道で抜けやすい一点があります。ピーク時のDeepSeek公式APIは、一部の第三者再販(GMI Cloud、Novitaなど。V4 Proを新公式ピークより安く掲示している例があります)より高くなり得ます。「公式APIが常に最安」という前提は、今回初めて崩れます。
アリババ:ウェイト公開で認知を取り、ライセンスで収益天井を守る
アリババは同時に2つを行いました。2.4Tのチェックポイントを無料ダウンロード可能にしました。同時に、小型Qwenで使っていたApache 2.0ではなく独自ライセンスを付けました。Model-as-a-Service または AI Work Assistant 事業で、任意の12か月間に5,000万ドルを超える収益がある場合は、別途の商用ライセンス交渉が必要です。月間アクティブユーザー1億以上、または月次収益2,000万ドル以上の製品は、モデル名を目立つ位置に表示する必要があります。
ウェイトは開発者、とくに海外の開発者を取りに行きます。その上に競合する推論事業を建てられる少数社に対しては、交渉力を残します。MetaのMuse Glimmerが制限のないApache 2.0で出しているのとは、賭け方が違います。ライセンスが米国・EU・英国・韓国からのダウンロードを禁じている、という主張は誤りです。公開テキストに地域条項はありません。
GLM-5.3:新しい基座はない。手法そのものが本題です
基座はGLM-5.2と同じ743Bです。再学習はありません。Terminal-Bench 3.0で約6倍(4.6% → 28.3%)まで伸びた要因は、後学習で強化学習環境を拡大したことです。事前学習のスケーリング則が収穫逓減を示すなか、後学習の強化学習は独立したレバーになりつつあり、基盤モデルを作り直すよりコスト床が低いです。OpenAI級の計算資源を持たない中堅ラボでも、エージェントとコーディング指標では差を詰められます。
V4-Pro per 1M tokens CNY (Beijing peak 09-12 / 14-18)
off-peak cache-hit 0.15 miss 4.5 out 13.5
peak cache-hit 0.30 miss 9.0 out 27.0
headline ~1100% = peak cache-hit input only
SECTION 05 横断比較:DeepSeekはまだ最安のフロンティア級か
| モデル | 入力 | 出力 | オープンウェイト |
|---|---|---|---|
| DeepSeek V4-Pro(ピーク) | ¥9.0(約$1.26) | ¥27.0(約$3.78) | なし |
| DeepSeek V4-Pro(オフピーク) | ¥4.5(約$0.63) | ¥13.5(約$1.89) | なし |
| Qwen3.8-Max(国際API) | $2.00 | $6.00 | あり(独自ライセンス) |
| OpenAI GPT-5.6 Luna | $0.20 | $1.20 | なし |
| Claude Opus 5(アリババ比率からの示唆) | 約$5.00 | 約$25.00 | なし |
人民元から米ドルへの換算は約¥7.15/$1です。概算です。オフピークのV4-ProはClaude Opus 5より十分安いですが、絶対最安ではなくなりました。Qwen3.8-Maxの国際料金とOpenAIのLunaは、いずれもDeepSeekのオフピークを少なくとも一軸で下回ります。「中国モデル=最安モデル」は2025年から2026年初頭までおおむね成立していました。いまは前提として使えません。
SECTION 06 争点と未確認:確定事実と報道を分ける
- 1,100%という見出しは正確ですが、文脈なしでは誤解を誘います。対象はピーク時キャッシュヒット入力だけです。実請求の大半を占める出力は350%です。
- Qwen3.8-Maxがアリババ自社のZhenwu M890チップ(および「Pangu AL128」スーパーノード)で動いている、という複数の中国金融メディア報道は、アリババの技術文書や第三者ベンチマークでは独立確認されていません。メーカー周辺の未確認報道として扱ってください。
- GLM-5.3がCursorで「重大な脆弱性」を発見したという話は、VentureBeatと智譜自身の開示に依っています。技術詳細は公開されていません。メーカー発信であり、独立監査済みではありません。
- 中国商務部がAI / 半導体技術への報復的輸出規制を準備しているという報道は推測であり、未確認メディアに依っています。公式発表ではありません。
SECTION 07 なぜ重要か:並行する2つの価格戦
過去1か月、中国の主要ラボは国内金融メディアが「週3回のモデル更新」と呼ぶ速度で投入しています。DeepSeek、アリババ、智譜の上には、MoonshotのKimi K3(7月16日オープンウェイト、2.8T)とMiniMax H3があります。中国語圏の報道は、オープンウェイト公開が業界全体の再価格付けを強制している、とより強く書きます。英語圏の製品メモより主張が前に出ます。Kimi K3の背景はKimi K3全面オープンウェイト公開を参照してください。
米国ラボは消費者層で逆の手を打っています。OpenAIは7月30日に最安枠を80%下げ、1週間後にそのモデルを無料かつ無制限にしました。Googleは8月13日、3週間前の前作の半額でコーディング向けモデルを出しました。中国側はフラッグシップをオープンウェイトにし、計算資源が足りない上位枠では段階的な値上げを入れます。米国側は消費者端で無料と安価へ走ります。どちらも事実です。最適化しているファネルの位置が違います。
地政学の層も、慎重に名前を付ける必要があります。MoonshotのKimi K3はすでに米国側の安全保障上の注視を受けています。アリババがこの窓で2.4Tフラッグシップをオープンウェイトにしたことを、規制が締まる前に海外の認知と「技術的拮抗」の物語を固定する動き、と読む分析もあります。それは知情に基づく解釈であり、確定事実ではありません。英語圏のテック報道だけを追うと、個別の製品ニュースとして抜け落ちやすいです。
SECTION 08 六段階チェックリスト:値上げを自社請求に照合する
- 見出し倍率を請求全体に掛けない:キャッシュヒット入力、キャッシュミス入力、出力は別行です。月額全体に1,100%を適用しないでください。
- トラフィックを北京時間のピーク枠に照合する:午前9時〜12時と午後2時〜6時(北京時間)はピーク課金です。バッチ評価、オフライン蒸留、夜間のエージェント再生はオフピークへ移します。
- 実測のキャッシュヒット率で増分を試算する:キャッシュヒットが高く、大半がオフピークの重い利用者は、試算で約1.8倍に寄ります。ピークかつヒット率が低い場合に、見出し倍率へ近づきます。
- 発表スレッドではなくQwen3.8-Max License本文を読む:個人利用と社内利用はおおむね影響しません。MaaS / AI Work Assistantで任意の12か月間に5,000万ドル超の収益がある場合は、別途の商用ライセンスが必要です。月間アクティブ1億以上、または月次収益2,000万ドル以上は、モデル名の目立つ表示が必要です。地域禁止はありません。
- GLM-5.3の公式自測と第三者再測定を分けて記録する:Terminal-Bench 3.0の4.6% → 28.3%は自己申告です。独立再測定が出るまで「フロンティア首位」と書かないでください。
- 未確認の主張を別帳簿に置き、隔離ノードで検証する:Zhenwu M890 / Pangu AL128、Cursor脆弱性、輸出規制の噂は確定事実ではありません。出口制御とRootが必要な機密評価やオフピーク実験は、共有クラウドセッションではなく隔離した物理ノードへ置きます。
SECTION 09 引用できる数値と一次情報
- V4-Proピーク時キャッシュヒット入力:¥0.025 → ¥0.30、約1,100%。出力は¥6.0 → ¥27.0、350%
- Qwen3.8-2.4T-A95B:総計2.4T / 活性95B。ネイティブ262K、約1.01Mまで延長可能。国際APIは$2 / $6
- GLM-5.3 Terminal-Bench 3.0:4.6% → 28.3%(+23.7)。同一743B基座、再学習なし。メーカー自己申告
- ライセンス閾値:任意の12か月で5,000万ドルのMaaSまたはAI Work Assistantは別途ライセンス。月間アクティブ1億または月次収益2,000万ドルは目立つ名称表示
以下は検証可能な入口です。転載や見積もりの前に、最新の公式料金とライセンス条項を再度開いて確認してください。上で未確認とした項目(国内チップ主張、Cursor脆弱性報道、輸出規制の噂)は、独立確認されていません。
公式 / リポジトリの一次情報:
DeepSeek API Docs — DeepSeek-V4-Pro GA Release(料金更新)
Hugging Face — Qwen/Qwen3.8-2.4T-A95B
Z.ai — GLM-5.3: Frontier Coding with Emergent Cyber Capabilities
第三者報道:
21jingji — DeepSeekピーク/オフピーク料金が発効、ピーク時は最大1,100%値上げ
VentureBeat — GLM-5.3と報じられたCursor脆弱性
共有APIが時間帯課金へ移ると、キャッシュヒット率と出口の隔離は請求変数になります。評価、蒸留、常時稼働エージェントを1つの共有セッションに積むと、コストも出口ポリシーも制御しにくくなります。ゼロ損耗のネイティブ算力、安定したiOS CI/CD、AI Agentの7×24自動化が必要な本番では、VPSNIXのクラウド物理ノードが通常より適した選択肢です。Apple純正の物理機、完全なRoot、Hypervisor損耗なし、日・週・月の柔軟な注文で、オフピーク実験と本番パイプラインを分けられます。Mac mini M4クラウドレンタル全解説と料金ページで構成を検討してください。
SECTION 10 よくある質問 FAQ
値上げ後もDeepSeekはGPT-5.6やClaudeより安いですか?
オフピーク料金はClaude Opus 5より安いです。ただし全体の絶対最安ではなくなりました。OpenAIのGPT-5.6 Luna(100万トークンあたり$0.20 / $1.20)と、アリババのQwen3.8-Max国際料金($2 / $6)は、少なくとも一軸でDeepSeekの新オフピークを下回ります。フロンティア級としてはまだ相対的に安いですが、無条件の最安ではありません。
Qwen3.8-Maxのオープンウェイトを商用製品で無料利用できますか?
多くの用途では可能です。個人プロジェクトと社内利用はおおむね影響しません。例外は、Model-as-a-Service または AI Work Assistant 事業で、連続する任意の12か月間に5,000万ドルを超える収益がある場合です。この層はアリババとの別途商用ライセンスが必要です。
Qwen3.8-Maxは米国・EU・英国の利用者に禁止されていますか?
禁止されていません。ネット上で流れた主張は誤りです。公開ライセンスに地域制限はありません。制限は収益に基づき、所在地には結び付いていません。
GLM-5.3とGLM-5.2の実体的な違いは何ですか?
基座レベルでは違いはありません。どちらも同じ743Bの基盤モデルです。性能差(Terminal-Bench 3.0で約6倍)は、後学習で強化学習を拡大した結果であり、基座の再学習はありません。
Metaは小型のMuse Glimmerだけでなく、フラッグシップも本当にオープンソースにしますか?
まだです。Muse Glimmerは30Bの蒸留モデルであり、Metaの本命フラッグシップではありません。Mark Zuckerberg氏は、より大型で非公開のMuse Spark 1.2について、オープンウェイトを「まもなく」出すと述べています。実現すれば、米国のフラッグシップ級モデルとして初の公開になります。本稿執筆時点では未公開です。表明された意向であり、確定事実ではありません。