ホーム / ブログ / OpenRouter
ENGINEERING_BLOG · 2026.07.27

OpenRouter 2026年7月ランキング:AIモデル競争の真の勝者は誰か

OPENROUTER · 2026年7月 TOKEN 構成
46%

中国系オープンモデルが token 総量の約半分を占め、用量と品質の乖離が加速しています。

OpenRouter ランキングを品質スコアボードと同一視すると、本番トラフィックを誤ルーティングするリスクがあります。2026年7月のデータは二極化(バーベル型)市場を示しています。Xiaomi Mimo V2.5が約1.4T tokens/日で首位、DeepSeek V4 Flashが中位オープンスタックを支え、中国系モデル全体で46%の token 量を占めます。一方、高難度推論では Western フロンティア tier が依然優位です。Hermes Agent単体で帰属アプリシェア約45%を占め、チャット UI ではなくコーディング Agentがゲートウェイ流量を牽引していることが確認されました。本記事はエンジニアとテックリード向けに、ランキングの4つの盲点、トップモデル決定表、アプリ層の内訳、6ステップの選定手順、7月の引用可能数値、8月見通しを整理します。結論:順位ではなくワークロード tier に最適化してください。Agent ループは安価なオープンモデル、最終パスはフロンティアモデルとし、token 量をベンチマークリーダーシップと混同しないでください。

SECTION 01 OpenRouter ランキングを読む際の4つの盲点

  • 用量は品質ではありません:ランキングはルーティングされた token 数を集計します。Agent フレームワークは1タスクあたり50〜200回の小さな completion を発行するため、$0.10/M のモデルが $25/M のフロンティアモデルより上位に見えても、最終出力品質は劣る場合があります。
  • 価格がリーダーボードを歪めます:Xiaomi Mimo V2.5 と DeepSeek V4 Flash は per-million 単価が積極的です。一括要約、lint 修正、検索前処理を回すチームは、許容 tier のうち最安値へ token 量が自然に集中します。
  • 帰属の欠落が実クライアントを隠します:HTTP-RefererX-Title ヘッダーを送るアプリのみがアプリランキングに表示されます。自前 Agent やカスタムバックエンドは過小計上されている可能性があります。ヘッダー設定はOpenRouter API 実践ガイドを参照してください。
  • リリース時期が月次スナップショットを歪めます:月中リリースのモデルは在籍日数が短く、7月ランキングは7月27日のKimi K3 オープンウェイト公開が Agent デフォルトへ完全反映される前の値を過小評価しています。

SECTION 02 2026年7月 OpenRouter トップモデル:token リーダーと品質 tier

2026年7月の OpenRouter モデルランキングは、Artificial Analysis や LMSYS スコアではなく、ゲートウェイ経由の集計 traffic を反映します。下表は順位と本番ワークロードの対応関係を示します。

OpenRouter 2026年7月 モデル token 量トップ5
順位 モデル 推定日次 token 量 典型的ワークロード
#1 Xiaomi Mimo V2.5 約1.4T/日 一括 Agent ループ、多言語チャット、コスト重視の前処理
#2 DeepSeek V4 Flash 約890B/日 コード補完、tool-call チェーン、オフピーク バッチ
#3 Qwen3-235B-A22B 約520B/日 長コンテキスト検索、構造化 JSON 抽出
#4 Claude Opus 5 約410B/日 最終推論パス、アーキテクチャレビュー、高リスク codegen
#5 GPT-5.6 Sol (preview) 約380B/日 多段計画、SLA 重視のエンタープライズ copilot
バーベル型パターン 中国系オープン vs Western フロンティア 46% / 54% 構成 安価 tier が volume を吸収、closed tier が最終パス支出を保持

OpenRouter ランキングは「大規模で最も安く回せるものは何か」には答えやすく、「最も賢いものは何か」には答えにくい指標です。順位 #1 を能力の推薦と見なさないでください。

DeepSeek V4 Flash はバーベル両端をつなぐ存在です。DeepSeek V4 GA リリース解説では CSA+HCA アーキテクチャとピークバレー課金を扱っています。OpenRouter 上の Flash 版はコンテキスト overhead を削り、Agent ターンの TTFT を2秒未満に抑えつつ、フル V4 モデルから約4ポイント以内の SWE-bench 級 codegen を維持します。

SECTION 03 中国系モデル46%:何が変わり、誰がコストを支払うか

中国系オープンモデルは2026年7月にOpenRouter token 総量の約46%を占め、4月の約31%から上昇しました。以下の3要因が主因であり、いずれも Western フロンティア tier を突然上回ったことを意味しません。

OpenRouter 地域別 token シェア(2026年4月 vs 7月)
起源クラスタ 2026年4月 2026年7月 主な要因
中国系オープン(DeepSeek、Xiaomi、Qwen、Moonshot API) 約31% 46% $1/M 未満の出力 tier、Agent ループ経済、Western API レート制限時の OpenRouter Failover
米国 closed(OpenAI、Anthropic、Google) 約52% 約41% Opus 5 値下げが volume 減を一部相殺、最終パス推論支出は依然 dominant
EU / その他オープン(Meta、Mistral、Cohere) 約17% 約13% 自前ホスト niche は安定、Agent フレームワーク既定値への組み込みは限定的
Agent 1タスクあたりコスト Western のみ構成 100ステップループで約 $0.18–0.42 中国系オープン primary + Western 最終パス:約 $0.04–0.11

7月の defining story は用量 ≠ 品質の乖離です。Hermes 型コーディング Agent を運用するチームは、tool-call ターンの約80%を Mimo V2.5 または DeepSeek V4 Flash にルーティングし、マージレビューとアーキテクチャ判断のみ Claude Opus 5 または GPT-5.6 Sol に回すことで、人間評価ベースの出力品質を大きく動かさずに月次推論コストを60〜75%削減できています。

SECTION 04 アプリランキング:Hermes Agent とコーディング Agent の台頭

OpenRouter はモデルシェアとは別に、帰属アプリシェアを公開しています。2026年7月のアプリランキングは、消費者向けチャットラッパーではなく自律コーディング Agentがゲートウェイ流量を支配していることを示しています。

OpenRouter 2026年7月 アプリ token シェア Top5
順位 アプリ シェア ワークロードパターン
#1 Hermes Agent 約45% 複数ファイル refactor、ターミナル tool ループ、1タスク100回超の completion
#2 Continue.dev 約12% IDE インライン補完、diff 認識編集
#3 OpenHands 約9% サンドボックス repo Agent、CI トリガー修正
#4 LibreChat 約7% ユーザー選択ルーティング付き多モデルチャット UI
#5 Custom / 未帰属 約27% Referer ヘッダー未設定の自前バックエンド
含意 コーディング Agent が順位 #1 モデルを駆動 Agent ループは安価 tier を選好 モデルランキングはチャット人気ではなく Agent 経済を反映

Hermes Agent の45%シェアは、Xiaomi Mimo V2.5 と DeepSeek V4 Flash がモデルチャート首位に並ぶ理由を説明します。各 refactor タスクは多数の小さく低リスクな completion を生成し、安価なオープンモデルが最も適したワークロードです。Agent が macOS 上でコンパイル・署名・テストまで行う場合、推論コスト削減はビルドチェーンが準拠ネイティブハードウェアで回る場合にのみ意味を持ちます。

SECTION 05 6ステップ選定、7月数値、8月見通しと VPSNIX 連携

  1. volume 順位と品質 tier を分離します:GET /api/v1/models でライブ一覧を取得し、各 slug を「bulk」「mid」「frontier」にタグ付けします。順位 #1 だけを根拠に最終レビュー担当へ昇格させないでください。
  2. 帰属ヘッダーを設定します:本番クライアントすべてに HTTP-RefererX-Title を付与し、自社アプリが OpenRouter アナリティクスに正しく表示されるようにします。
  3. 二段 Fallback チェーンを構築します:tool ループの primary を DeepSeek V4 Flash または Mimo V2.5 に、低信頼度やコンテキスト上限時の fallback を Claude Opus 5 または GPT-5.6 Sol に設定します。models 配列と route: "fallback" の詳細はOpenRouter API 実践ガイドを参照してください。
  4. 実プロンプトでベンチマークします:本番50プロンプトを順位 Top3 と frontier fallback に流し、token コストではなく pass rate を比較してからデフォルトを変更します。
  5. 地域シェアを月次追跡します:中国系オープンシェアが上昇し続ける場合、規制当局やエンタープライズセキュリティレビュー前に data residency と BYOK ルーティングを再評価します。
  6. リリースカレンダーに合わせて計画します:7月27日の Kimi K3 オープンウェイト公開後、Agent フレームワークは数日以内に K3 slug を追加する見込みです。大型 drop の翌週に再ベンチマークし、7月スナップショットは8月中旬には様変わりします。Kimi K3 オープンウェイト解説でハードウェアとライセンス準備を確認してください。
two_tier_agent.mjs
import OpenAI from "openai";

const openai = new OpenAI({
  baseURL: "https://openrouter.ai/api/v1",
  apiKey: process.env.OPENROUTER_API_KEY,
});

const response = await openai.chat.completions.create({
  model: "deepseek/deepseek-v4-flash",
  models: [
    "deepseek/deepseek-v4-flash",
    "anthropic/claude-opus-5",
  ],
  route: "fallback",
  messages: [{ role: "user", content: "JWT ローテーション用に auth middleware を refactor してください。" }],
  extra_headers: {
    "HTTP-Referer": "https://vpsnix.com",
    "X-Title": "VPSNIX Agent Demo",
  },
});
OpenRouter 2026年7月 主要メトリクス
指標
token 量 #1 モデル Xiaomi Mimo V2.5 — 約1.4T tokens/日
中国系オープンモデルシェア 46%(ゲートウェイ総量)
帰属アプリシェア #1 Hermes Agent — 約45%
DeepSeek V4 Flash 日次 volume 約890B tokens/日(全体 #2)
バーベル型市場 安価オープン tier が Agent ループを吸収、Western フロンティア tier が最終パス支出を保持
品質シグナル ランキングはコスト × 可用性 × Agent ループ量を計測 — ベンチマーク順位ではない

2026年8月見通し — 3つの観測シナリオ:

  • Kimi K3 オープンウェイトショック:Moonshot の7月27日 Hugging Face 公開は Modified MIT の2.8T MoE と1M コンテキストを追加します。Agent フレームワークは数日以内に DeepSeek V4 Flash 対 K3 の A/B を開始する見込みです。OpenRouter 上で K3 の tool-call TTFT が800 ms 未満なら、中国系オープンシェアは50%超へ進む可能性があります。
  • Opus 5 価格引力:Anthropic は7月24日に API 料金を半減しました。Claude Opus 5 リリース告知が API データ非保持を強調したことで、Western フロンティアシェアは安定または回復する可能性があります。
  • DeepSeek ピーク料金の正常化:7月24日 GA 移行後、オフピーク割引が調整される可能性があります。V4 Flash 利用チームは8月請求サイクル前に Fallback チェーンを固定し、DeepSeek V4 料金表を再確認してください。

7月の実務要点:

  • 順位 #1 をワークロード別ベンチマークなしで本番デフォルトにしない
  • リーダーボードはコーディング Agent 駆動と見なし、ループコストを最適化する
  • 二段スタック(安価オープン primary + フロンティア fallback)でバーベル型市場に合わせる
  • 8月は週次でランキングを再確認する — K3 と Opus 5 が同日付近に着地し、スナップショットは急速に変化します

公式ソース(OpenRouter ポリシーまたはランキング方法論更新後はリンクを再確認してください):

OpenRouter モデルランキング — ライブ token volume リーダーボード

OpenRouter アプリランキング — 帰属クライアントシェア

Anthropic — Claude Opus 5 リリースと料金

OpenRouter は多モデル推論ルーティングを解決しますが、iOS バイナリのコンパイル、Apple 署名証明書のローテーション、Metal シェーダーテストは実行できません。仮想化 macOS スタックは EULA リスクを伴い、Hypervisor overhead によりネイティブ性能の20〜40%を失うことが一般的です。推論コストを60%削っても、Xcode ビルド待ちが3倍になるなら意味がありません。

コーディング Agent チームの実務的分割は、上記二段モデルスタック(ループ用 Mimo V2.5 または DeepSeek V4 Flash、最終レビュー用 Opus 5)を OpenRouter で回し、Hermes 型 Agent のコンパイル・テスト・デプロイをVPSNIX M4 / M4 Pro 物理ノードで 7×24 運用することです。Kimi K3 オープンウェイトDeepSeek V4を OpenRouter 経由で利用しているなら、ビルドチェーンは準拠ハードウェア上のフル Root 環境に固定することをお勧めします。

Hypervisor 損失ゼロ、安定した iOS CI/CD、AI Agent の 7×24 自動化が必要な本番環境では、VPSNIX クラウド物理ノードが通常より適した選択です。100% Apple 純正ハードウェア、完全 Root 権限、日/週/月の柔軟な契約が可能です。料金は料金ページをご確認ください。

SECTION 06 よくある質問 FAQ

2026年7月 OpenRouter で最も使われているモデルは?

Xiaomi Mimo V2.5 が約1.4兆 tokens/日でモデルランキング首位です。低単価と多言語スループットが主因であり、ベンチマーク順位そのものではありません。

OpenRouter ランキングはモデル品質を反映しますか?

いいえ。ランキングは OpenRouter 経由の token 総量を計測しており、コスト・可用性・Agent ループ量に近く、品質とは乖離します。2026年7月は安価なオープンモデルと Claude/GPT 等のフロンティア tier による二極化が顕著です。

中国系モデルの OpenRouter シェアは?

2026年7月時点で中国系オープンモデルは token 総量の約46%を占め、4月の約31%から上昇しました。DeepSeek V4 Flash、Xiaomi Mimo V2.5、Qwen3 系が中心です。

OpenRouter で最も使われているアプリは?

Hermes Agent が帰属アプリシェアの約45%を占め、1タスクあたり数百回の小さな completion を発行する自律コーディング Agent がゲートウェイ流量を牽引しています。

ランキングをどう選定に活かすべきですか?

コストと可用性のシグナルとして扱い、品質スコアカードと混同しないでください。一括前処理と tool ループは安価なオープンモデル、最終推論はフロンティア closed モデルに割り当て、Claude Opus 5 や Kimi K3 オープンウェイト等の大型リリース後は再ベンチマークしてください。

2026年8月に注目すべき点は?

7月27日の Kimi K3 オープンウェイト公開で Agent デフォルトが再編される可能性、DeepSeek V4 Flash の GA 移行後のピーク料金調整、Opus 5 値下げによる Western フロンティア tier への回帰が主要な観測点です。