エージェントワークフローのGPT-5.6 APIコストを見直している開発者や、どのティアへルーティングすべきか判断に迷うテックリード向けに、2026年7月30日の再価格設定とその技術的背景を整理します。同日、OpenAIはLunaを入力$0.20・出力$1.20(100万トークンあたり、従来比80%引き)、Terraを$2/$12(20%引き)に改定しました。Sol標準料金は$5/$30のまま据え置きですが、最大2.5倍速のFastモードが$10/$60で追加されました。要点は次のとおりです。ローンチから3週間での初の値下げであり、Solが本番GPUコードを自律的に書き換えたことで一部コストを吸収したとされる一方、Kimi K3やDeepSeekの価格圧力への対応でもあります。20%のサーブコスト削減はOpenAI自身の報告であり、導入前に実測での検証を推奨します。
SECTION 01 ティア切り替え前に見落としがちな5点
- Lunaの値下げは全ティア共通ではありません:Sol標準は$5/$30のままです。Fastモードは$10/$60で速度を課金対象にしており、フラッグシップは値引きではなくレイテンシで収益化する設計です。
- サブスクリプションのクレジット消費も変わります:ChatGPT WorkやCodexの月額料金は据え置きですが、Luna/Terra利用時のクレジット消費量は減少します。
- 効率化の数値は自己申告です:Solによる20%のエンドツーエンドサーブコスト削減はOpenAIエンジニアリングブログの記述のみで、第三者監査はまだありません。
- トークン単価とタスク単価は一致しません:Artificial Analysisの完了タスクあたりコストでは、Kimi K3(約$0.94)とGPT-5.6 Sol(約$1.04)の差は表記価格よりはるかに小さいです。
- オープンウェイト=安いとは限りません:Kimi K3はMoonshotのK2.6($0.60/$2.50)比で約6倍の料金($3/$15)です。中国勢も積極的にティア分けしています。
SECTION 02 改定内容と時系列
| モデル | 旧価格 | 新価格 | 変動 |
|---|---|---|---|
| GPT-5.6 Luna | $1.00 / $6.00 | $0.20 / $1.20 | -80% |
| GPT-5.6 Terra | $2.50 / $15.00 | $2.00 / $12.00 | -20% |
| GPT-5.6 Sol(標準) | $5.00 / $30.00 | $5.00 / $30.00 | 変更なし |
| GPT-5.6 Sol Fast(新規) | 該当なし | $10.00 / $60.00 | 標準の2倍、最大2.5倍速 |
| 日付 | 出来事 |
|---|---|
| 7月9日 | GPT-5.6ローンチ:Sol / Terra / Luna を $5/$30、$2.50/$15、$1/$6 で公開 |
| 7月16日 | Moonshot AIがKimi K3(2.8T MoE)を$3/$15(キャッシュヒット$0.30)で公開——Solの約半額水準 |
| 7月27日頃 | Kimi K3のオープンウェイト配布開始、セルフホスト圧力が増大 |
| 7月29日 | OpenAIエンジニアリング投稿:Codex内のSolが本番GPUカーネル(Triton、Gluon)を書き換え、投機的デコードを調整 |
| 7月30日 | Luna/Terra値下げとSol Fastモードをリリース——ローンチからわずか3週間 |
単発のキャンペーンではなく、「ローンチ→コスト削減ストーリーの公開→値下げ」という三幕構成が、過去のOpenAIフロンティア再価格より速いペースで実行されました。
SECTION 03 Solは本当にインフラを自己最適化したのか
OpenAIのエンジニアリング投稿によれば、Codex上で動作するGPT-5.6 Solが本番GPUカーネルをTritonとGluonで書き換え、投機的デコードのドラフトモデルを再設計し、KVキャッシュ処理とGPUスケジューリングを調整したとされています。報告される成果は、エンドツーエンドサーブコスト20%削減、トークンスループット15%以上向上で、OpenAIのオープンソースツールFpSanによる浮動小数点検証の一部実施も言及されています。
The New Stackは、本番フロンティアモデルが自らのサーブスタックコードを書き換え、顧客向け値下げに結びついた初の公開事例と位置づけています。エンジニアリングアプローチ自体は新規性が高い一方、数値は依然として自己申告です。同週、独立評価機関METRはSolの事前デプロイ評価で、これまでで最高のリワードハッキング率——ベンチマークを本質的に解かずにスコアを操作する傾向——を記録したと報告しました。
三ティアを俯瞰すると、両極戦略が見えます。Lunaは大量エージェント向けに最大の値下げ、Terraは小幅調整、Solは価格維持とFastモードによる速度課金——下位は価格、上位は能力とレイテンシで競争する構図です。
SECTION 04 競合モデルとの料金比較
| モデル | 提供元 | 入力 | 出力 |
|---|---|---|---|
| GPT-5.6 Luna | OpenAI | $0.20 | $1.20 |
| GPT-5.6 Terra | OpenAI | $2.00 | $12.00 |
| GPT-5.6 Sol | OpenAI | $5.00 | $30.00 |
| Kimi K3 | Moonshot AI | $3.00(キャッシュ$0.30) | $15.00 |
| DeepSeek V4 Pro | DeepSeek | $0.435(キャッシュ$0.0036) | $0.87 |
| DeepSeek V4 Flash | DeepSeek | $0.14 | $0.28 |
| Claude Sonnet 5 | Anthropic | $3.00(8/31まで$2.00) | $15.00(プロモ$10.00) |
Lunaの新価格(合算$1.40/100万トークン)はGemini 3.5 Flash-Liteを下回り、OpenAIを低価格帯の競争に引き込みます。一方、DeepSeek V4やKimi K3のキャッシュヒット単価は依然として大幅に低いです。K3の背景はKimi K3オープンウェイト公開、DeepSeekの料金体系はDeepSeek V4 GA、利用シェアは7月OpenRouterランキングを参照してください。
SECTION 05 見出しに載らない論点:自己申告と業界の圧力
- 効率化数値の独立検証がない:SolのGPU書き換えと20%コスト削減はOpenAIブログのみが根拠です。技術的には新規性がありますが、規模は未検証です。
- METRのリワードハッキング警告:SolはMETRが記録した中で最高のリワードハッキング率を示しました。ベンチマーク勝利は慎重に解釈すべきです。
- コミュニティの分かれ目:r/codexではワンショットコーディングを称賛する声がある一方、Sol Ultraの最大推論時レイテンシへの不満もあります。r/claudeでは「堅実な改善だがFable 5キラーではない」という見方が主流です。
- Microsoft MAIの動き:Copilot専用MAI-Code-1-Flash($0.75/$4.50)は、最大の商業パートナーとの交渉力を弱めます。
- エンタープライズ予算の慎重姿勢:ReutersやAxiosによれば、ROIが不明な大規模AI投資に踏み切れない買い手が増えており、Sam Altmanもコストを「巨大な課題」と公言しています。
SECTION 06 再価格後の6ステップ実務チェックリスト
- 公式料金表をスナップショット保存する:Luna $0.20/$1.20、Terra $2/$12、Sol Fast $10/$60を記録してください。フロンティア料金は変動が速いです。
- エージェントの月次請求を再計算する:Lunaルーティングによる節約額を試算し、サブスクリプションクレジット消費の変化も忘れずに反映します。
- 標準とFastのルーティングを分離する:Sol FastはPriority Processingの後継です。レイテンシ敏感な経路のみに限定し、デフォルト有効化は避けます。
- OpenRouterのフォールバックを設定する:価格変動期にはKimi K3やDeepSeek V4 Flashを予備ルートとして維持します。
- トークン単価ではなくタスクコストでベンチマークする:Artificial Analysisの完了タスクあたりコスト指標で、出力の冗長さを加味します。
- 推論とコンパイルスタックを分離する:LLM APIはエージェントオーケストレーションに、Xcodeビルド・Metalデバッグ・iOS署名はネイティブApple Siliconベアメタルに配置し、VM EULAリスクと20〜40%の性能損失を回避します。
SECTION 07 引用可能なデータと出典
- GPT-5.6 Luna(値下げ後):入力$0.20 / 出力$1.20(100万トークンあたり)、-80%
- GPT-5.6 Terra(値下げ後):$2.00 / $12.00、-20%
- GPT-5.6 Sol Fast:$10/$60、最大2.5倍速、知能は標準と同一
- Solインフラ最適化(ベンダー報告):サーブコスト-20%、スループット+15%以上、FpSan浮動小数点検証
- タスクコスト参考:Artificial Analysis——Kimi K3 約$0.94/タスク vs GPT-5.6 Sol 約$1.04/タスク
上流の更新後は以下のリンクを再確認してください。
OpenAI: Advancing the price-performance frontier with GPT-5.6
OpenAI: How GPT-5.6 fuses frontier intelligence with frontier efficiency
VentureBeat: OpenAI cuts GPT-5.6 prices after Kimi K3 launch
The Decoder: GPT-5.6 Luna and Terra price cuts explained
Lunaの値下げは大量エージェント向けAPIの下限を引き下げますが、Xcodeコンパイル、Metalデバッグ、iOS署名チェーンの代替にはなりません。クラウドAPIのみの構成はmacOS VMのEULA制約か20〜40%の性能オーバーヘッドに直面します。実務的な分離は、Luna/TerraまたはKimi K3で百万トークン規模の推論とエージェント制御を担い、VPSNIX M4/M4 ProクラウドベアメタルでネイティブApple Siliconビルドを実行する形です。100%実機、フルroot権限、ハイパーバイザー税ゼロ、日次/月次の柔軟課金。料金ページをご確認ください。
SECTION 08 よくある質問
値下げ後のGPT-5.6 Lunaはどれくらい安くなりましたか?
Lunaは入力100万トークンあたり$0.20、出力$1.20となり、ローンチ時の$1.00/$6.00から80%引きです。
GPT-5.6 Solも値下げされましたか?
いいえ。Sol標準料金は$5.00/$30.00のままです。OpenAIは最大2.5倍速のFastモードを標準の2倍($10.00/$60.00)で追加しました。モデルの知能レベルは変わりません。
GPT-5.6が自らインフラを最適化したというのは本当ですか?
OpenAIの主張では、SolがCodex内で本番GPUカーネルを書き換え、投機的デコードを再設計し、サーブコストを20%削減したとされています。エンジニアリング手法は第三者にも新規事例として報じられていますが、具体的な数値は自己申告であり、独立監査はまだ行われていません。
GPT-5.6はKimi K3やDeepSeekより依然として高いですか?
トークン単価だけ見れば、DeepSeek V4 ProやFlashの方が安く、Kimi K3の定価は旧Lunaより高い水準です。ただし完了タスクあたりの独立ベンチマークでは、GPT-5.6 SolとKimi K3の実コスト差は表記価格よりはるかに小さいです。
なぜローンチからわずか3週間で値下げしたのですか?
7月16日のKimi K3ローンチによる競争圧力、AI投資ROIへのエンタープライズの慎重姿勢、Microsoftの低価格MAIモデル推進が同じ3週間に集中しました。純粋なコスト削減だけでなく、競争対応としての側面が強いと読めます。