OpenRouter ランキングを品質スコアボードと同一視すると、本番トラフィックを誤ルーティングするリスクがあります。2026年7月のデータは二極化(バーベル型)市場を示しています。Xiaomi Mimo V2.5が約1.4T tokens/日で首位、DeepSeek V4 Flashが中位オープンスタックを支え、中国系モデル全体で46%の token 量を占めます。一方、高難度推論では Western フロンティア tier が依然優位です。Hermes Agent単体で帰属アプリシェア約45%を占め、チャット UI ではなくコーディング Agentがゲートウェイ流量を牽引していることが確認されました。本記事はエンジニアとテックリード向けに、ランキングの4つの盲点、トップモデル決定表、アプリ層の内訳、6ステップの選定手順、7月の引用可能数値、8月見通しを整理します。結論:順位ではなくワークロード tier に最適化してください。Agent ループは安価なオープンモデル、最終パスはフロンティアモデルとし、token 量をベンチマークリーダーシップと混同しないでください。
SECTION 01 OpenRouter ランキングを読む際の4つの盲点
- 用量は品質ではありません:ランキングはルーティングされた token 数を集計します。Agent フレームワークは1タスクあたり50〜200回の小さな completion を発行するため、$0.10/M のモデルが $25/M のフロンティアモデルより上位に見えても、最終出力品質は劣る場合があります。
- 価格がリーダーボードを歪めます:Xiaomi Mimo V2.5 と DeepSeek V4 Flash は per-million 単価が積極的です。一括要約、lint 修正、検索前処理を回すチームは、許容 tier のうち最安値へ token 量が自然に集中します。
- 帰属の欠落が実クライアントを隠します:
HTTP-RefererとX-Titleヘッダーを送るアプリのみがアプリランキングに表示されます。自前 Agent やカスタムバックエンドは過小計上されている可能性があります。ヘッダー設定はOpenRouter API 実践ガイドを参照してください。 - リリース時期が月次スナップショットを歪めます:月中リリースのモデルは在籍日数が短く、7月ランキングは7月27日のKimi K3 オープンウェイト公開が Agent デフォルトへ完全反映される前の値を過小評価しています。
SECTION 02 2026年7月 OpenRouter トップモデル:token リーダーと品質 tier
2026年7月の OpenRouter モデルランキングは、Artificial Analysis や LMSYS スコアではなく、ゲートウェイ経由の集計 traffic を反映します。下表は順位と本番ワークロードの対応関係を示します。
| 順位 | モデル | 推定日次 token 量 | 典型的ワークロード |
|---|---|---|---|
| #1 | Xiaomi Mimo V2.5 | 約1.4T/日 | 一括 Agent ループ、多言語チャット、コスト重視の前処理 |
| #2 | DeepSeek V4 Flash | 約890B/日 | コード補完、tool-call チェーン、オフピーク バッチ |
| #3 | Qwen3-235B-A22B | 約520B/日 | 長コンテキスト検索、構造化 JSON 抽出 |
| #4 | Claude Opus 5 | 約410B/日 | 最終推論パス、アーキテクチャレビュー、高リスク codegen |
| #5 | GPT-5.6 Sol (preview) | 約380B/日 | 多段計画、SLA 重視のエンタープライズ copilot |
| バーベル型パターン | 中国系オープン vs Western フロンティア | 46% / 54% 構成 | 安価 tier が volume を吸収、closed tier が最終パス支出を保持 |
OpenRouter ランキングは「大規模で最も安く回せるものは何か」には答えやすく、「最も賢いものは何か」には答えにくい指標です。順位 #1 を能力の推薦と見なさないでください。
DeepSeek V4 Flash はバーベル両端をつなぐ存在です。DeepSeek V4 GA リリース解説では CSA+HCA アーキテクチャとピークバレー課金を扱っています。OpenRouter 上の Flash 版はコンテキスト overhead を削り、Agent ターンの TTFT を2秒未満に抑えつつ、フル V4 モデルから約4ポイント以内の SWE-bench 級 codegen を維持します。
SECTION 03 中国系モデル46%:何が変わり、誰がコストを支払うか
中国系オープンモデルは2026年7月にOpenRouter token 総量の約46%を占め、4月の約31%から上昇しました。以下の3要因が主因であり、いずれも Western フロンティア tier を突然上回ったことを意味しません。
| 起源クラスタ | 2026年4月 | 2026年7月 | 主な要因 |
|---|---|---|---|
| 中国系オープン(DeepSeek、Xiaomi、Qwen、Moonshot API) | 約31% | 46% | $1/M 未満の出力 tier、Agent ループ経済、Western API レート制限時の OpenRouter Failover |
| 米国 closed(OpenAI、Anthropic、Google) | 約52% | 約41% | Opus 5 値下げが volume 減を一部相殺、最終パス推論支出は依然 dominant |
| EU / その他オープン(Meta、Mistral、Cohere) | 約17% | 約13% | 自前ホスト niche は安定、Agent フレームワーク既定値への組み込みは限定的 |
| Agent 1タスクあたりコスト | Western のみ構成 | 100ステップループで約 $0.18–0.42 | 中国系オープン primary + Western 最終パス:約 $0.04–0.11 |
7月の defining story は用量 ≠ 品質の乖離です。Hermes 型コーディング Agent を運用するチームは、tool-call ターンの約80%を Mimo V2.5 または DeepSeek V4 Flash にルーティングし、マージレビューとアーキテクチャ判断のみ Claude Opus 5 または GPT-5.6 Sol に回すことで、人間評価ベースの出力品質を大きく動かさずに月次推論コストを60〜75%削減できています。
SECTION 04 アプリランキング:Hermes Agent とコーディング Agent の台頭
OpenRouter はモデルシェアとは別に、帰属アプリシェアを公開しています。2026年7月のアプリランキングは、消費者向けチャットラッパーではなく自律コーディング Agentがゲートウェイ流量を支配していることを示しています。
| 順位 | アプリ | シェア | ワークロードパターン |
|---|---|---|---|
| #1 | Hermes Agent | 約45% | 複数ファイル refactor、ターミナル tool ループ、1タスク100回超の completion |
| #2 | Continue.dev | 約12% | IDE インライン補完、diff 認識編集 |
| #3 | OpenHands | 約9% | サンドボックス repo Agent、CI トリガー修正 |
| #4 | LibreChat | 約7% | ユーザー選択ルーティング付き多モデルチャット UI |
| #5 | Custom / 未帰属 | 約27% | Referer ヘッダー未設定の自前バックエンド |
| 含意 | コーディング Agent が順位 #1 モデルを駆動 | Agent ループは安価 tier を選好 | モデルランキングはチャット人気ではなく Agent 経済を反映 |
Hermes Agent の45%シェアは、Xiaomi Mimo V2.5 と DeepSeek V4 Flash がモデルチャート首位に並ぶ理由を説明します。各 refactor タスクは多数の小さく低リスクな completion を生成し、安価なオープンモデルが最も適したワークロードです。Agent が macOS 上でコンパイル・署名・テストまで行う場合、推論コスト削減はビルドチェーンが準拠ネイティブハードウェアで回る場合にのみ意味を持ちます。
SECTION 05 6ステップ選定、7月数値、8月見通しと VPSNIX 連携
- volume 順位と品質 tier を分離します:
GET /api/v1/modelsでライブ一覧を取得し、各 slug を「bulk」「mid」「frontier」にタグ付けします。順位 #1 だけを根拠に最終レビュー担当へ昇格させないでください。 - 帰属ヘッダーを設定します:本番クライアントすべてに
HTTP-RefererとX-Titleを付与し、自社アプリが OpenRouter アナリティクスに正しく表示されるようにします。 - 二段 Fallback チェーンを構築します:tool ループの primary を DeepSeek V4 Flash または Mimo V2.5 に、低信頼度やコンテキスト上限時の fallback を Claude Opus 5 または GPT-5.6 Sol に設定します。
models配列とroute: "fallback"の詳細はOpenRouter API 実践ガイドを参照してください。 - 実プロンプトでベンチマークします:本番50プロンプトを順位 Top3 と frontier fallback に流し、token コストではなく pass rate を比較してからデフォルトを変更します。
- 地域シェアを月次追跡します:中国系オープンシェアが上昇し続ける場合、規制当局やエンタープライズセキュリティレビュー前に data residency と BYOK ルーティングを再評価します。
- リリースカレンダーに合わせて計画します:7月27日の Kimi K3 オープンウェイト公開後、Agent フレームワークは数日以内に K3 slug を追加する見込みです。大型 drop の翌週に再ベンチマークし、7月スナップショットは8月中旬には様変わりします。Kimi K3 オープンウェイト解説でハードウェアとライセンス準備を確認してください。
import OpenAI from "openai";
const openai = new OpenAI({
baseURL: "https://openrouter.ai/api/v1",
apiKey: process.env.OPENROUTER_API_KEY,
});
const response = await openai.chat.completions.create({
model: "deepseek/deepseek-v4-flash",
models: [
"deepseek/deepseek-v4-flash",
"anthropic/claude-opus-5",
],
route: "fallback",
messages: [{ role: "user", content: "JWT ローテーション用に auth middleware を refactor してください。" }],
extra_headers: {
"HTTP-Referer": "https://vpsnix.com",
"X-Title": "VPSNIX Agent Demo",
},
});
| 指標 | 値 |
|---|---|
| token 量 #1 モデル | Xiaomi Mimo V2.5 — 約1.4T tokens/日 |
| 中国系オープンモデルシェア | 46%(ゲートウェイ総量) |
| 帰属アプリシェア #1 | Hermes Agent — 約45% |
| DeepSeek V4 Flash 日次 volume | 約890B tokens/日(全体 #2) |
| バーベル型市場 | 安価オープン tier が Agent ループを吸収、Western フロンティア tier が最終パス支出を保持 |
| 品質シグナル | ランキングはコスト × 可用性 × Agent ループ量を計測 — ベンチマーク順位ではない |
2026年8月見通し — 3つの観測シナリオ:
- Kimi K3 オープンウェイトショック:Moonshot の7月27日 Hugging Face 公開は Modified MIT の2.8T MoE と1M コンテキストを追加します。Agent フレームワークは数日以内に DeepSeek V4 Flash 対 K3 の A/B を開始する見込みです。OpenRouter 上で K3 の tool-call TTFT が800 ms 未満なら、中国系オープンシェアは50%超へ進む可能性があります。
- Opus 5 価格引力:Anthropic は7月24日に API 料金を半減しました。Claude Opus 5 リリース告知が API データ非保持を強調したことで、Western フロンティアシェアは安定または回復する可能性があります。
- DeepSeek ピーク料金の正常化:7月24日 GA 移行後、オフピーク割引が調整される可能性があります。V4 Flash 利用チームは8月請求サイクル前に Fallback チェーンを固定し、DeepSeek V4 料金表を再確認してください。
7月の実務要点:
- 順位 #1 をワークロード別ベンチマークなしで本番デフォルトにしない
- リーダーボードはコーディング Agent 駆動と見なし、ループコストを最適化する
- 二段スタック(安価オープン primary + フロンティア fallback)でバーベル型市場に合わせる
- 8月は週次でランキングを再確認する — K3 と Opus 5 が同日付近に着地し、スナップショットは急速に変化します
公式ソース(OpenRouter ポリシーまたはランキング方法論更新後はリンクを再確認してください):
OpenRouter モデルランキング — ライブ token volume リーダーボード
OpenRouter アプリランキング — 帰属クライアントシェア
Anthropic — Claude Opus 5 リリースと料金
OpenRouter は多モデル推論ルーティングを解決しますが、iOS バイナリのコンパイル、Apple 署名証明書のローテーション、Metal シェーダーテストは実行できません。仮想化 macOS スタックは EULA リスクを伴い、Hypervisor overhead によりネイティブ性能の20〜40%を失うことが一般的です。推論コストを60%削っても、Xcode ビルド待ちが3倍になるなら意味がありません。
コーディング Agent チームの実務的分割は、上記二段モデルスタック(ループ用 Mimo V2.5 または DeepSeek V4 Flash、最終レビュー用 Opus 5)を OpenRouter で回し、Hermes 型 Agent のコンパイル・テスト・デプロイをVPSNIX M4 / M4 Pro 物理ノードで 7×24 運用することです。Kimi K3 オープンウェイトやDeepSeek V4を OpenRouter 経由で利用しているなら、ビルドチェーンは準拠ハードウェア上のフル Root 環境に固定することをお勧めします。
Hypervisor 損失ゼロ、安定した iOS CI/CD、AI Agent の 7×24 自動化が必要な本番環境では、VPSNIX クラウド物理ノードが通常より適した選択です。100% Apple 純正ハードウェア、完全 Root 権限、日/週/月の柔軟な契約が可能です。料金は料金ページをご確認ください。
SECTION 06 よくある質問 FAQ
2026年7月 OpenRouter で最も使われているモデルは?
Xiaomi Mimo V2.5 が約1.4兆 tokens/日でモデルランキング首位です。低単価と多言語スループットが主因であり、ベンチマーク順位そのものではありません。
OpenRouter ランキングはモデル品質を反映しますか?
いいえ。ランキングは OpenRouter 経由の token 総量を計測しており、コスト・可用性・Agent ループ量に近く、品質とは乖離します。2026年7月は安価なオープンモデルと Claude/GPT 等のフロンティア tier による二極化が顕著です。
中国系モデルの OpenRouter シェアは?
2026年7月時点で中国系オープンモデルは token 総量の約46%を占め、4月の約31%から上昇しました。DeepSeek V4 Flash、Xiaomi Mimo V2.5、Qwen3 系が中心です。
OpenRouter で最も使われているアプリは?
Hermes Agent が帰属アプリシェアの約45%を占め、1タスクあたり数百回の小さな completion を発行する自律コーディング Agent がゲートウェイ流量を牽引しています。
ランキングをどう選定に活かすべきですか?
コストと可用性のシグナルとして扱い、品質スコアカードと混同しないでください。一括前処理と tool ループは安価なオープンモデル、最終推論はフロンティア closed モデルに割り当て、Claude Opus 5 や Kimi K3 オープンウェイト等の大型リリース後は再ベンチマークしてください。
2026年8月に注目すべき点は?
7月27日の Kimi K3 オープンウェイト公開で Agent デフォルトが再編される可能性、DeepSeek V4 Flash の GA 移行後のピーク料金調整、Opus 5 値下げによる Western フロンティア tier への回帰が主要な観測点です。