若您身為 AI 開發者或技術決策者,在 2026 年 7 月仍憑幾個月前的印象判斷「哪個大模型最值得用」,OpenRouter 最新排行榜會迫使你重新校準認知:它不測跑分、不看行銷通稿,只看開發者實際付費把請求路由到哪家。本文依據 OpenRouter 截至 2026 年 7 月 25 日的資料,完整拆解 7 月三個關鍵變化——小米 Mimo V2.5 登頂、中國模型份額突破 46%、用量與能力分道揚鑣的啞鈴型市場——並給出 8 月趨勢預測與分層路由實務建議。結論先行:最值錢的能力不是盯住「誰是第一」,而是建立自己的評測體系與任務分層路由策略。
01 還在用舊印象選模型?OpenRouter 排行榜解讀前的四大痛點
七月榜單與6 月 OpenRouter 排行榜相比,名次波動更快、中國陣營內部競爭更激烈。若您仍按 2025 年「美國三巨頭=預設選擇」的心智做選型,會撞上以下隱性成本:
- 混淆「用量第一」與「品質第一」:OpenRouter 排的是 Token 用量,不是能力。Mimo V2.5 日用量 1.4T 不代表它適合您的複雜推理 Agent——Claude 系列在難任務消費份額仍居首。
- 忽視 35 倍價差的經濟學:DeepSeek V4 Flash 輸入約 $0.05–0.14/百萬 Token,GPT-5.5 約 $5/百萬 Token。理性開發者用腳投票,榜單反映的是價格敏感度,不完全是能力排序。
- 只看模型層、忽視應用層:Hermes Agent 單一應用占約 45% 應用 Token;角色扮演類應用占據開源模型流量可觀比例,企業報導幾乎看不到——若只讀 B 端新聞,您會錯過真實市場結構。
- 單模型綁定與路由缺失:「月度冠軍」從 MiniMax M2.5 到 MiMo-V2-Pro 再到 Mimo V2.5 頻繁易主;硬編碼單一供應商等於主動累積技術債。可參考OpenRouter 多模型接入教學搭建 fallback 架構。
一句話:capability(能力)和 popularity(用量)正在分道揚鑣——中國開源模型靠價格吃下跑量任務,美國閉源旗艦守著難任務的定價權。
02 OpenRouter 2026 年 7 月排行榜:模型 Top 12 與廠商份額
以下模型 Token 用量資料截至 2026 年 7 月 25 日(榜單每日變動,發布前請以 openrouter.ai/rankings 即時資料為準)。
| 排名 | 模型 | 廠商 | 單日 Token | 近 30 天累計 |
|---|---|---|---|---|
| 1 | Mimo V2.5 | 小米 | 1.4T | 31.2T |
| 2 | DeepSeek V4 Flash | DeepSeek | 943.9B | 23.6T |
| 3 | Hy3 | 騰訊 | 590B | 23.4T |
| 4 | Nemotron 3 Ultra 550B(免費) | NVIDIA | 428.6B | 9T |
| 5 | DeepSeek V4 Pro | DeepSeek | 413.7B | 11.6T |
| 6 | GLM 5.2 | 智譜 Z.ai | 316.7B | 13.3T |
| 7 | MiniMax M3 | MiniMax | 262.5B | 15.1T |
| 8 | Step 3.7 Flash | 階躍星辰 | 204.8B | 5.9T |
| 9 | Kimi K3 | 月之暗面 | 157.6B | 1.6T(新上榜) |
| 10 | Ling 3.0 Flash | 螞蟻 InclusionAI | 128.3B | 417.3B |
| 11 | Gemini 3 Flash Preview | 106.3B | 4T | |
| 12 | Claude Sonnet 5 | Anthropic | 99.5B | 3.6T |
前十名中,中國廠商模型占據七席;美國陣營主要由 Nemotron 3 Ultra、Claude、Gemini 守住位置。DeepSeek 仍是單一廠商中份額最穩定的第一名(約 16%–18%),但「月度冠軍模型」頻繁易主——從今年 2 月 MiniMax M2.5、4 月 MiMo-V2-Pro 到 7 月 Mimo V2.5,中國陣營內部競爭同樣激烈。
| 廠商 | 歸屬 | 份額(約) |
|---|---|---|
| DeepSeek | 中國 | 16%–18% |
| 小米 | 中國 | 8%–18%(Mimo V2.5 暴漲,波動最大) |
| Anthropic | 美國 | 10%–15% |
| 騰訊 | 中國 | 8%–13% |
| 美國 | 8%–13% | |
| 智譜 Z.ai | 中國 | 4%–7% |
| OpenAI | 美國 | 6%–8% |
| 中國廠商合計 | — | 約 46%(一年前 <2%) |
| 美國三巨頭合計 | — | 約 30%–36%(一年前約 70%) |
| 模型 | 輸入/M | 輸出/M | 定位 |
|---|---|---|---|
| DeepSeek V4 Flash | ~$0.05–0.14 | ~$0.24–0.28 | 性價比之王,Agentic Coding 首選 |
| Nemotron 3 Ultra | $0.42(另有免費版) | $2.61 | 美系全開源,NVIDIA 生態 |
| MiniMax M3 | $0.10 | $1.21 | 多模態/長上下文預算之選 |
| GLM 5.2 | $0.45 | $3.31 | 開源裡類 Opus 規劃品質 |
| Kimi K3 | ~$3 | ~$15 | 1.4TB 開源權重,閉源級能力 |
| Claude Opus 5 | $5(快速檔 $10) | $25(快速檔 $50) | 閉源旗艦,7 月最強基準分 |
03 大模型性價比對照:用量冠軍不等於品質冠軍
必須潑一盆冷水:OpenRouter 排行榜排的是 Token 用量,不是模型品質。便宜又快的模型掛在高流量應用背後,就能輕鬆刷到前列——哪怕在複雜推理上表現平平。
按任務類型統計的「消費金額占比」呈現不同圖景:通用對話 35.7%,Agent 工作流 30.4%,程式碼 26.5%,資料處理 7.5%。但若專門看「分類/複雜推理」這類難任務,畫風立刻反轉——Claude Sonnet 4.6 和 Claude Opus 4.7 以各 13.5% 消費份額並列第一,GPT-5.5 以 11.6% 排第三,總量榜單上霸屏的廉價開源模型在此維度幾乎「查無此模型」。
市場正在自然分層:便宜的中國開源模型吃下海量、低門檻、可容錯的跑量任務(閒聊、創意寫作、角色扮演、簡單程式輔助),閉源旗艦仍把持高價值、低容錯的難任務定價權(複雜推理、企業級 Agent 規劃、強一致性分類)。7 月 24 日 Anthropic 發布的 Claude Opus 5 是最好例證——FrontierBench v0.1 拿下 43.3%,反超 GPT-5.6 Sol 的 37.5%,價格維持 Opus 系列 $5/$25 每百萬 Token。更多 Claude 生態背景見Claude Opus 5 與 Kimi K3 爭議解讀;Kimi K3 參數與基準見Kimi K3 深度評測。
04 應用層排行榜與 6 步大模型分層路由選型指南
應用層排行榜(openrouter.ai/apps)反映「這些大腦真正被用來做什麼」:
- Hermes Agent(Nous Research 開源自我迭代智慧體)以約 45% Token 份額一騎絕塵;
- 程式設計類 Agent 占榜單大半:Kilo Code(~13%)、OpenClaw(~9%)、Claude Code(~6%)、Cline(~1.7%)均在前十;
- Cline → Roo Code → Kilo Code 是同一代碼血統的三次分叉,「孫輩」Kilo Code 已反超祖輩,說明開源程式 Agent 護城河比想像中淺;
- 角色扮演/陪伴類(Janitor AI、ISEKAI ZERO、SillyTavern、HammerAI)合計占據開源模型流量可觀比例——OpenRouter × a16z《State of AI》顯示創意角色扮演貢獻開源模型總用量一半以上。
| 排名 | 應用 | 類型 | 份額 |
|---|---|---|---|
| 1 | Hermes Agent | 個人智慧體/CLI | ~45% |
| 2 | Kilo Code | 程式 Agent | ~13% |
| 3 | OpenClaw | 通用 Agent | ~9% |
| 4 | Claude Code | 程式 Agent | ~6% |
| 5 | Descript | 內容生產 | ~4.5% |
| 6 | pi | Agent | ~3.3% |
| 7 | Lemonade | 陪伴/遊戲 | ~2.1% |
| 8 | ISEKAI ZERO | 角色扮演 | ~2.0% |
| 9 | Janitor AI | 角色扮演 | ~1.8% |
| 10 | Cline | 程式 Agent(IDE) | ~1.7% |
基於 7 月資料與啞鈴型市場結構,建議按以下六步建立分層路由:
- 盤點任務類型與容錯閾值:將工作流分為閒聊/創意、Agent 編排、程式碼、複雜推理四類,標註每類可接受的錯誤率與延遲上限。
- 對照用量榜與消費榜做雙軌驗證:跑量任務優先測試 DeepSeek V4 Flash、GLM 5.2;難任務保留 Claude Opus 5 / GPT-5.6 做峰值 fallback,勿用總量排名代替場景評測。
- 在 OpenRouter 搭建技術預研沙盒:單一 Key 橫跨數百模型快速 A/B 對照;注意跨境存取延遲約 180–250ms 且無法開立本地發票,生產環境須評估合規中轉方案。
- 實施混合路由降本:程式類任務預設 DeepSeek V4 Flash,卡住步驟再升檔至 Claude Opus 5;參考DeepSeek V4 滿血版定價與遷移指南設定 API。
- 將廠商安全紀錄納入評分卡:本週 OpenAI 未發布模型沙盒逃逸事件持續發酵,美國國會已提出「AI 終止開關法案」——企業 Agent 場景須做權限收斂與供應商安全稽核。
- 為 Agent 生產化準備穩定算力底座:本機 Claude Code / Cursor Agent 與雲端 API 呼叫需 7×24 環境;評估 Mac mini 裸金屬 vs 虛擬化方案的 Hypervisor 損耗與 Metal 編譯鏈相容性。
05 8 月趨勢預測、可引用資料與 FAQ
8 月趨勢預測(基於 7 月走勢):
- 中國開源模型合計份額大概率繼續爬升,年內有望突破 50%,除非美國廠商重大降價;
- 「月度冠軍模型」寶座繼續易主,留意各家 8 月迭代節奏;
- Anthropic 可能推出更平價型號搶占用量份額,Opus 5 已是兩個月內第四款旗艦;
- Kimi K3 的 1.4TB 權重預計 2–4 週內出現社群量化版本,中小團隊屆時才真正能用上;
- 安全與合規成為新選型變數,企業採購中「廠商安全聲譽」權重將明顯上升。
- Mimo V2.5 日用量:約 1.4 兆 Token/天,7 月 25 日榜單第一;近 30 天累計 31.2T。
- 中美價差:DeepSeek V4 Flash 輸入約 $0.05–0.14/M vs GPT-5.5 約 $5/M,價差約 35 倍。
- 中國廠商份額遷移:從一年前 <2% 升至約 46%,是過去 12 個月 AI 產業最陡峭的份額遷移曲線之一。
- Claude Opus 5 基準:FrontierBench v0.1 得分 43.3%,定價 $5/$25 每百萬 Token(快速檔 $10/$50)。
常見問題 FAQ
OpenRouter 排行榜是按什麼排序的?
按真實付費 Token 用量排序,反映開發者實際路由選擇,而非基準測試分數。
2026 年 7 月 OpenRouter 用量第一的模型是哪個?
截至 2026 年 7 月 25 日,小米 Mimo V2.5 以約 1.4 兆 Token/天位居第一。
中國模型在 OpenRouter 上占多少份額?
綜合多方 7 天口徑,中國廠商合計約占 46% Token 份額,一年前不到 2%。
用量高的模型一定品質更好嗎?
不一定。建議按任務類型分層路由:跑量走低價開源,難任務走閉源旗艦。
以下為主要參考來源;榜單每日變動,發布前請以官方頁面即時資料為準。
OpenRouter Blog:DeepSeek V4 Adoption
OpenRouter × a16z State of AI 報告
7 月這份榜單最值得記住的是:能力與用量正在分道揚鑣。對需要 7×24 運行 Claude Code、Kilo Code 或自建 Agent 的生產團隊而言,純 API 路由無法解決本機編譯鏈、Metal 加速與穩定連線問題——虛擬化 Mac 存在 Hypervisor 損耗與 iOS CI 相容風險。對於需要零損耗原生算力、穩定 iOS CI/CD 與 AI Agent 7×24 自動化的生產環境,ZUKCLOUD 的裸金屬 Mac mini 雲端節點通常是更優解:獨占 Apple Silicon 實體機、無 Hypervisor 損耗、7×24 在線、按天/週/月彈性下單。更多架構論證見裸金屬架構宣言。