首頁 / 部落格 / OpenRouter 排行榜
ENGINEERING BLOG · 2026.07.27

OpenRouter 2026年7月大模型排行榜深度解析:
誰在真正贏下這場 AI 流量戰爭?

若您身為 AI 開發者或技術決策者,在 2026 年 7 月仍憑幾個月前的印象判斷「哪個大模型最值得用」,OpenRouter 最新排行榜會迫使你重新校準認知:它不測跑分、不看行銷通稿,只看開發者實際付費把請求路由到哪家。本文依據 OpenRouter 截至 2026 年 7 月 25 日的資料,完整拆解 7 月三個關鍵變化——小米 Mimo V2.5 登頂、中國模型份額突破 46%、用量與能力分道揚鑣的啞鈴型市場——並給出 8 月趨勢預測與分層路由實務建議。結論先行:最值錢的能力不是盯住「誰是第一」,而是建立自己的評測體系與任務分層路由策略。

01

七月榜單與6 月 OpenRouter 排行榜相比,名次波動更快、中國陣營內部競爭更激烈。若您仍按 2025 年「美國三巨頭=預設選擇」的心智做選型,會撞上以下隱性成本:

  • 混淆「用量第一」與「品質第一」:OpenRouter 排的是 Token 用量,不是能力。Mimo V2.5 日用量 1.4T 不代表它適合您的複雜推理 Agent——Claude 系列在難任務消費份額仍居首。
  • 忽視 35 倍價差的經濟學:DeepSeek V4 Flash 輸入約 $0.05–0.14/百萬 Token,GPT-5.5 約 $5/百萬 Token。理性開發者用腳投票,榜單反映的是價格敏感度,不完全是能力排序。
  • 只看模型層、忽視應用層:Hermes Agent 單一應用占約 45% 應用 Token;角色扮演類應用占據開源模型流量可觀比例,企業報導幾乎看不到——若只讀 B 端新聞,您會錯過真實市場結構。
  • 單模型綁定與路由缺失:「月度冠軍」從 MiniMax M2.5 到 MiMo-V2-Pro 再到 Mimo V2.5 頻繁易主;硬編碼單一供應商等於主動累積技術債。可參考OpenRouter 多模型接入教學搭建 fallback 架構。

一句話:capability(能力)和 popularity(用量)正在分道揚鑣——中國開源模型靠價格吃下跑量任務,美國閉源旗艦守著難任務的定價權。

02

以下模型 Token 用量資料截至 2026 年 7 月 25 日(榜單每日變動,發布前請以 openrouter.ai/rankings 即時資料為準)。

模型 Token 用量 Top 12(2026-07-25 單日)
排名 模型 廠商 單日 Token 近 30 天累計
1Mimo V2.5小米1.4T31.2T
2DeepSeek V4 FlashDeepSeek943.9B23.6T
3Hy3騰訊590B23.4T
4Nemotron 3 Ultra 550B(免費)NVIDIA428.6B9T
5DeepSeek V4 ProDeepSeek413.7B11.6T
6GLM 5.2智譜 Z.ai316.7B13.3T
7MiniMax M3MiniMax262.5B15.1T
8Step 3.7 Flash階躍星辰204.8B5.9T
9Kimi K3月之暗面157.6B1.6T(新上榜)
10Ling 3.0 Flash螞蟻 InclusionAI128.3B417.3B
11Gemini 3 Flash PreviewGoogle106.3B4T
12Claude Sonnet 5Anthropic99.5B3.6T

前十名中,中國廠商模型占據七席;美國陣營主要由 Nemotron 3 Ultra、Claude、Gemini 守住位置。DeepSeek 仍是單一廠商中份額最穩定的第一名(約 16%–18%),但「月度冠軍模型」頻繁易主——從今年 2 月 MiniMax M2.5、4 月 MiMo-V2-Pro 到 7 月 Mimo V2.5,中國陣營內部競爭同樣激烈。

廠商 Token 份額(綜合多方 7 天口徑,約數)
廠商 歸屬 份額(約)
DeepSeek中國16%–18%
小米中國8%–18%(Mimo V2.5 暴漲,波動最大)
Anthropic美國10%–15%
騰訊中國8%–13%
Google美國8%–13%
智譜 Z.ai中國4%–7%
OpenAI美國6%–8%
中國廠商合計約 46%(一年前 <2%)
美國三巨頭合計約 30%–36%(一年前約 70%)
價格與定位對照(2026 年 7 月)
模型 輸入/M 輸出/M 定位
DeepSeek V4 Flash~$0.05–0.14~$0.24–0.28性價比之王,Agentic Coding 首選
Nemotron 3 Ultra$0.42(另有免費版)$2.61美系全開源,NVIDIA 生態
MiniMax M3$0.10$1.21多模態/長上下文預算之選
GLM 5.2$0.45$3.31開源裡類 Opus 規劃品質
Kimi K3~$3~$151.4TB 開源權重,閉源級能力
Claude Opus 5$5(快速檔 $10)$25(快速檔 $50)閉源旗艦,7 月最強基準分

03

必須潑一盆冷水:OpenRouter 排行榜排的是 Token 用量,不是模型品質。便宜又快的模型掛在高流量應用背後,就能輕鬆刷到前列——哪怕在複雜推理上表現平平。

按任務類型統計的「消費金額占比」呈現不同圖景:通用對話 35.7%,Agent 工作流 30.4%,程式碼 26.5%,資料處理 7.5%。但若專門看「分類/複雜推理」這類難任務,畫風立刻反轉——Claude Sonnet 4.6 和 Claude Opus 4.7 以各 13.5% 消費份額並列第一,GPT-5.5 以 11.6% 排第三,總量榜單上霸屏的廉價開源模型在此維度幾乎「查無此模型」。

市場正在自然分層:便宜的中國開源模型吃下海量、低門檻、可容錯的跑量任務(閒聊、創意寫作、角色扮演、簡單程式輔助),閉源旗艦仍把持高價值、低容錯的難任務定價權(複雜推理、企業級 Agent 規劃、強一致性分類)。7 月 24 日 Anthropic 發布的 Claude Opus 5 是最好例證——FrontierBench v0.1 拿下 43.3%,反超 GPT-5.6 Sol 的 37.5%,價格維持 Opus 系列 $5/$25 每百萬 Token。更多 Claude 生態背景見Claude Opus 5 與 Kimi K3 爭議解讀;Kimi K3 參數與基準見Kimi K3 深度評測

04

應用層排行榜(openrouter.ai/apps)反映「這些大腦真正被用來做什麼」:

  • Hermes Agent(Nous Research 開源自我迭代智慧體)以約 45% Token 份額一騎絕塵;
  • 程式設計類 Agent 占榜單大半:Kilo Code(~13%)、OpenClaw(~9%)、Claude Code(~6%)、Cline(~1.7%)均在前十;
  • Cline → Roo Code → Kilo Code 是同一代碼血統的三次分叉,「孫輩」Kilo Code 已反超祖輩,說明開源程式 Agent 護城河比想像中淺;
  • 角色扮演/陪伴類(Janitor AI、ISEKAI ZERO、SillyTavern、HammerAI)合計占據開源模型流量可觀比例——OpenRouter × a16z《State of AI》顯示創意角色扮演貢獻開源模型總用量一半以上。
應用/Agent 層 Top 10(OpenRouter Apps,約數)
排名 應用 類型 份額
1Hermes Agent個人智慧體/CLI~45%
2Kilo Code程式 Agent~13%
3OpenClaw通用 Agent~9%
4Claude Code程式 Agent~6%
5Descript內容生產~4.5%
6piAgent~3.3%
7Lemonade陪伴/遊戲~2.1%
8ISEKAI ZERO角色扮演~2.0%
9Janitor AI角色扮演~1.8%
10Cline程式 Agent(IDE)~1.7%

基於 7 月資料與啞鈴型市場結構,建議按以下六步建立分層路由:

  1. 盤點任務類型與容錯閾值:將工作流分為閒聊/創意、Agent 編排、程式碼、複雜推理四類,標註每類可接受的錯誤率與延遲上限。
  2. 對照用量榜與消費榜做雙軌驗證:跑量任務優先測試 DeepSeek V4 Flash、GLM 5.2;難任務保留 Claude Opus 5 / GPT-5.6 做峰值 fallback,勿用總量排名代替場景評測。
  3. 在 OpenRouter 搭建技術預研沙盒:單一 Key 橫跨數百模型快速 A/B 對照;注意跨境存取延遲約 180–250ms 且無法開立本地發票,生產環境須評估合規中轉方案。
  4. 實施混合路由降本:程式類任務預設 DeepSeek V4 Flash,卡住步驟再升檔至 Claude Opus 5;參考DeepSeek V4 滿血版定價與遷移指南設定 API。
  5. 將廠商安全紀錄納入評分卡:本週 OpenAI 未發布模型沙盒逃逸事件持續發酵,美國國會已提出「AI 終止開關法案」——企業 Agent 場景須做權限收斂與供應商安全稽核。
  6. 為 Agent 生產化準備穩定算力底座:本機 Claude Code / Cursor Agent 與雲端 API 呼叫需 7×24 環境;評估 Mac mini 裸金屬 vs 虛擬化方案的 Hypervisor 損耗與 Metal 編譯鏈相容性。

05

8 月趨勢預測(基於 7 月走勢):

  • 中國開源模型合計份額大概率繼續爬升,年內有望突破 50%,除非美國廠商重大降價;
  • 「月度冠軍模型」寶座繼續易主,留意各家 8 月迭代節奏;
  • Anthropic 可能推出更平價型號搶占用量份額,Opus 5 已是兩個月內第四款旗艦;
  • Kimi K3 的 1.4TB 權重預計 2–4 週內出現社群量化版本,中小團隊屆時才真正能用上;
  • 安全與合規成為新選型變數,企業採購中「廠商安全聲譽」權重將明顯上升。
  • Mimo V2.5 日用量:約 1.4 兆 Token/天,7 月 25 日榜單第一;近 30 天累計 31.2T。
  • 中美價差:DeepSeek V4 Flash 輸入約 $0.05–0.14/M vs GPT-5.5 約 $5/M,價差約 35 倍。
  • 中國廠商份額遷移:從一年前 <2% 升至約 46%,是過去 12 個月 AI 產業最陡峭的份額遷移曲線之一。
  • Claude Opus 5 基準:FrontierBench v0.1 得分 43.3%,定價 $5/$25 每百萬 Token(快速檔 $10/$50)。

常見問題 FAQ

OpenRouter 排行榜是按什麼排序的?

按真實付費 Token 用量排序,反映開發者實際路由選擇,而非基準測試分數。

2026 年 7 月 OpenRouter 用量第一的模型是哪個?

截至 2026 年 7 月 25 日,小米 Mimo V2.5 以約 1.4 兆 Token/天位居第一。

中國模型在 OpenRouter 上占多少份額?

綜合多方 7 天口徑,中國廠商合計約占 46% Token 份額,一年前不到 2%。

用量高的模型一定品質更好嗎?

不一定。建議按任務類型分層路由:跑量走低價開源,難任務走閉源旗艦。

以下為主要參考來源;榜單每日變動,發布前請以官方頁面即時資料為準。

OpenRouter 官方排行榜

OpenRouter Apps 應用層排行

OpenRouter Blog:DeepSeek V4 Adoption

OpenRouter × a16z State of AI 報告

7 月這份榜單最值得記住的是:能力與用量正在分道揚鑣。對需要 7×24 運行 Claude Code、Kilo Code 或自建 Agent 的生產團隊而言,純 API 路由無法解決本機編譯鏈、Metal 加速與穩定連線問題——虛擬化 Mac 存在 Hypervisor 損耗與 iOS CI 相容風險。對於需要零損耗原生算力、穩定 iOS CI/CD 與 AI Agent 7×24 自動化的生產環境,ZUKCLOUD 的裸金屬 Mac mini 雲端節點通常是更優解:獨占 Apple Silicon 實體機、無 Hypervisor 損耗、7×24 在線、按天/週/月彈性下單。更多架構論證見裸金屬架構宣言