首頁 / 部落格 / OpenRouter 排行
ENGINEERING_BLOG · 2026.07.27

OpenRouter 2026 年 7 月大模型排行榜深度解析:誰在真正贏下這場 AI 流量戰爭?

OPENROUTER · 中國份額
46%

中國廠商 Token 份額一年內從不足 2% 躍升至約 46%。

若你正透過 OpenRouter 建構 Agent 或多模型路由,卻只看 SWE-bench 基準測試而忽略真實 Token 消耗排行榜,很可能選錯主力模型——2026 年 7 月 25 日數據顯示,小米 Mimo V2.5 以 1.4T tokens/天登頂,DeepSeek V4 Flash 以 943.9B 緊隨其後,中國廠商合計份額已達 46%,美國廠商約 30–36%。本文面向 AI 應用開發者、Agent 建構者與企業技術決策者,拆解用量榜 Top 12、廠商份額格局、App 層暗流、價格差 35 倍的選型邏輯,以及 8 月走勢預測。結論先行:OpenRouter 排行榜衡量的是「流量」而非「品質」——批量推理選中國高性價比模型,高價值分類任務仍應看 Claude Sonnet 4.6 / Opus 4.7 的支出占比;用量榜 + 分類榜雙軌對照,才是 2026 下半年正確的選型姿勢。

SECTION 01 只看基準測試不看用量榜,選型會踩哪些坑?

  • 用量≠品質:Claude Sonnet 4.6 與 Opus 4.7 在 OpenRouter 分類支出榜各占 13.5%,但 7 月 25 日用量榜 Claude Sonnet 5 僅 99.5B tokens/天,排在第 12 位——高單價模型天然在「流量榜」靠後。
  • 忽視價格槓桿:DeepSeek V4 Flash 輸入 $0.05–0.14/M,GPT-5.5 約 $5/M,35 倍價差驅動 Agent 框架批量切向中國模型,基準測試相近時帳單可能差一個數量級。
  • 忽略 App 層結構:Hermes Agent 占 App 呼叫約 45%,Kilo Code 約 13%,OpenClaw 約 9%——你的競品可能已透過 Cline→Roo Code→Kilo Code 分叉鏈鎖定預設模型,而你還在手動切換。
  • 開源權重窗口期:Kimi K3 開源權重以 157.6B tokens/天已進入 Top 12,量化版預計 2–4 週內上線 OpenRouter,靜態選型表會迅速過時。
  • 安全因子被低估:流量戰爭白熱化後,資料駐留、供應商穩定性與DeepSeek V4 API 合規將成為與價格並列的硬約束,純性價比選型存在隱性風險。

SECTION 02 2026 年 7 月 OpenRouter 模型用量榜與廠商份額

以下數據截取自 OpenRouter 2026 年 7 月 25 日排行榜快照(tokens/天)。發版後請再次開啟官方頁面核對最新數值。

OpenRouter 模型用量 Top 12(2026-07-25)
排名 模型 日 Token 消耗
1 小米 Mimo V2.5 1.4T / 天
2 DeepSeek V4 Flash 943.9B / 天
3 Hy3 590B / 天
4 Nemotron 3 Ultra 428.6B / 天
5 DeepSeek V4 Pro 413.7B / 天
6 GLM 5.2 316.7B / 天
7 MiniMax M3 262.5B / 天
8 Step 3.7 Flash 204.8B / 天
9 Kimi K3 157.6B / 天
10 Ling 3.0 Flash 128.3B / 天
11 Gemini 3 Flash 106.3B / 天
12 Claude Sonnet 5 99.5B / 天
結構特徵 Top 10 中 8 款為中國廠商模型 美國模型僅 Gemini 3 Flash、Claude Sonnet 5 入圍
OpenRouter 廠商 Token 份額與定價對比
維度 中國廠商 美國廠商
Token 份額(2026-07) 約 46%(一年前 <2%) 約 30–36%
#1 供應商 DeepSeek,穩定 16–18% Anthropic / OpenAI 分列其後
分類支出領先 Claude Sonnet 4.6、Opus 4.7 各 13.5%
代表輸入價 DeepSeek V4 Flash $0.05–0.14/M GPT-5.5 約 $5/M
選型啟示 批量 Agent / 編碼補全首選 高價值分類 / 複雜推理首選

OpenRouter 用量榜回答「誰在被大規模呼叫」,分類支出榜回答「誰在燒高價值 Token」——兩個榜單疊加,才能畫出真實的 AI 流量地圖。

SECTION 03 App 層排行榜:Agent 框架如何重塑模型預設路由

模型用量不只來自直接 API 呼叫——OpenRouter App 排行榜揭示了中間層如何批量導流 Token。2026 年 7 月 App 層格局:

  • Hermes Agent(~45%):當前 OpenRouter 上最大的單一 App 流量來源,預設路由傾向高性價比 Flash 模型,是 Mimo V2.5 與 DeepSeek V4 Flash 登頂的重要推手。
  • Kilo Code(~13%):源自 Cline→Roo Code 分叉鏈的編碼 Agent,開發者一旦配置預設模型,後續補全與重構請求自動走同一供應商。
  • OpenClaw(~9%):開源 Agent 執行環境,支援多模型 Fallback,但在正式環境傾向鎖定單一主力以控制延遲。
  • Roleplay 類 App 隱形市場:排行榜未完整展示的長上下文角色扮演應用,消耗大量 Ling、MiniMax 等模型的 cheap tier,是 Hy3、Ling 3.0 Flash 高用量的隱性來源。

對 Agent 建構者而言,App 層排名意味著:你的預設模型選擇會被框架級流量放大——Hermes 或 Kilo Code 切換預設路由,可能在 48 小時內改變整個 OpenRouter 用量榜格局。若你尚未接入 OpenRouter,可先閱讀OpenRouter 手把手接入教學完成 API Key 與 HTTP-Referer 配置,確保自家 App 呼叫被正確歸因。

SECTION 04 基於 OpenRouter 排行榜的六步模型選型實操

  1. 開啟官方排行榜雙視圖:造訪 OpenRouter Rankings,分別查看 Models(用量)與 Apps(應用層)Tab,記錄你目標場景相關模型的 7 日 Token 趨勢,而非單日快照。
  2. 按場景拆分路由策略:批量程式碼補全 / Agent 迴圈呼叫 → 用量榜 Top 5(Mimo V2.5、DeepSeek V4 Flash);複雜分類 / 合規稽核 → 分類支出榜頭部(Claude Sonnet 4.6、Opus 4.7)。
  3. 核算真實 Token 成本:GET /api/v1/models 拉取即時單價,按日呼叫量估算月帳單。DeepSeek V4 Flash 與 GPT-5.5 在同等 10M tokens/天場景下,價差可達 35 倍。
  4. 配置 Fallback 鏈:正式環境設定 models 陣列 + route: "fallback",主力限流時自動降級至 Step 3.7 Flash 或 GLM 5.2,避免 Hermes Agent 類高併發場景單點故障。
  5. 綁定 HTTP-Referer 與 X-Title:確保 OpenRouter 將你的 App 正確計入 Apps 排行榜,便於後續 A/B 對比不同模型的真實轉化與留存。
  6. 設定月度覆盤閾值:當某模型用量份額週環比變化 >15%,或 Kimi K3 量化版上線後,觸發重新評估;8 月重點關注中國份額是否突破 50% 及 DeepSeek 供應商穩定性。
  7. 安全與合規前置審查:高敏感資料場景評估是否允許流量經 OpenRouter 美國閘道路由至中國供應商;必要時啟用 BYOK 或直連DeepSeek V4 官方 API

SECTION 05 硬核數據、8 月走勢預測與可引用來源

  • 中國份額躍遷:中國廠商 Token 份額從 2025 年 7 月不足 2% 升至 2026 年 7 月約 46%,DeepSeek 作為 #1 供應商穩定在 16–18%。
  • 價格剪刀差:DeepSeek V4 Flash 輸入 $0.05–0.14/M vs GPT-5.5 ~$5/M,約 35 倍差距,是 Agent 批量推理大規模切模的核心驅動力。
  • 品質 vs 流量分離:Claude Sonnet 4.6 與 Opus 4.7 各占分類支出 13.5%,但用量榜 Claude Sonnet 5 僅 99.5B/天——高單價模型在流量戰爭中天然處於劣勢。
  • Kimi K3 變數:157.6B/天已進 Top 12;Modified MIT 2.8T 權重發布後,量化版預計 2–4 週內上線 OpenRouter,可能衝擊 Top 5。
  • 8 月預測:中國份額有望逼近 50%;安全審查、資料駐留與供應商 SLA 將與價格並列成為企業選型前三因子。

以下連結為本文數據依據,發版後請再次開啟核對最新排行榜數值:

OpenRouter 官方模型與廠商排行榜

OpenRouter App 層呼叫排行榜

Anthropic Claude Opus 5 官方發布說明

典型高效組合是:OpenRouter 負責多模型推理路由與 A/B 對比,VPSNIX M4/M4 Pro 實體節點負責 Hermes Agent、Kilo Code 與 Xcode 編譯鏈 7×24 部署——雲端 LLM 再強也無法在 Hypervisor 虛擬 macOS 上穩定跑 iOS 憑證鏈與 Metal 除錯;虛擬化方案伴隨 EULA 風險與 20–40% 效能損耗。對於需要零損耗原生算力、穩定 iOS CI/CD 與 AI Agent 自動化的正式環境,VPSNIX 的雲端實體節點通常是更優解:100% 蘋果原裝硬體、完整 Root 權限、無 Hypervisor 損耗、按天/週/月彈性下單。報價見定價頁;若已在 OpenRouter 上跑Kimi K3DeepSeek V4做 Agent 推理,更應將編譯與部署鏈鎖定在合規實體環境。

SECTION 06 常見問題 FAQ

OpenRouter 排行榜反映的是用量還是模型品質?

統計的是 Token 消耗量與 App 呼叫頻次,反映「誰被用得最多」。Claude Sonnet 4.6 與 Opus 4.7 在分類支出榜各占 13.5%,但用量榜前列多為 DeepSeek V4 Flash、Mimo V2.5 等高性價比模型。

為什麼 2026 年 7 月中國模型 Token 份額暴漲至 46%?

DeepSeek V4 Flash 輸入價約為 GPT-5.5 的 1/35,Mimo V2.5 以 1.4T tokens/天登頂。Agent 框架與編碼工具大規模採用中國模型做批量推理,疊加 Kimi K3 開源權重預期,推動份額從不足 2% 躍升。

Kimi K3 開源權重對 OpenRouter 排名有何影響?

7 月 25 日 Kimi K3 以 157.6B tokens/天進入 Top 12。Modified MIT 完整 2.8T 權重發布後,量化版預計 2–4 週內上線 OpenRouter,將進一步拉升月之暗面份額。

企業選型應該看用量榜還是分類支出榜?

批量 Agent、程式碼補全參考用量榜選 DeepSeek V4 Flash 或 Mimo V2.5;複雜推理、合規稽核參考分類支出榜選 Claude Sonnet 4.6 或 Opus 4.7。雙軌對照才能平衡成本與品質。

8 月中國模型份額會超過 50% 嗎?

按當前增速與 Kimi K3 量化版上線節奏,8 月中國廠商 Token 份額有望逼近或突破 50%。安全審查、資料駐留與供應商穩定性將與價格並列成為選型關鍵因子。