2026年7月時点でも数ヶ月前の印象で「どの LLM を選ぶべきか」を判断している AI 開発者や技術意思決定者の方にとって、OpenRouter 最新ランキングは認識の更新を迫ります。ベンチマークではなく、開発者が実際に課金してルーティングしたトークン量だけを見る指標です。本記事では 2026年7月25日時点のデータに基づき、小米 Mimo V2.5 の首位、中国系モデル46%シェア突破、利用量と能力が分岐するダンベル型市場という7月の3大変化を整理し、8月トレンドと階層ルーティングの実務指針を示します。結論として、最も価値があるのは「今週の1位」を追うことではなく、自社の評価体系とタスク別ルーティング戦略を構築することです。
01 古い印象のままモデルを選ぶ?OpenRouter 解読前の4つの痛点
7月のボードは6月の OpenRouter ランキングよりも変動が速く、中国陣営内の競争も激化しています。2025年の「米国ビッグ3=安全策」という前提のまま選定すると、次の隠れコストが発生します。
- 利用量1位と品質1位の混同:OpenRouter はトークン利用量で並べ替えており、能力ランキングではありません。Mimo V2.5 の日次1.4Tは、複雑な推論 Agent に最適という意味ではありません。難タスクの消費シェアでは Claude 系列が依然首位です。
- 約35倍の価格差の軽視:DeepSeek V4 Flash の入力は約 $0.05–0.14/百万トークン、GPT-5.5 は約 $5/百万トークン。ランキングは価格感度を強く反映しており、能力順そのものではありません。
- モデル層だけ見てアプリ層を無視:Hermes Agent 単体でアプリトークンの約45%を占有。ロールプレイ系アプリがオープンモデル流量の大半を占めますが、エンタープライズ向け報道ではほとんど触れられません。
- 単一ベンダー固定とルーティング欠如:月間チャンピオンは MiniMax M2.5、MiMo-V2-Pro、Mimo V2.5 と頻繁に交代しています。単一プロバイダーへのハードコードは技術的負債です。OpenRouter マルチモデル統合ガイドでフォールバック設計を参照してください。
一言で言えば、capability(能力)と popularity(利用量)は分岐しつつある——中国系オープンモデルが価格でボリュームを獲得し、米国クローズド旗艦が難タスクの価格決定力を維持しています。
02 OpenRouter 2026年7月ランキング:モデル Top 12 とベンダーシェア
以下のモデルトークン量は 2026年7月25日時点のデータです(ランキングは日々変動します。引用前に openrouter.ai/rankings で最新値を確認してください)。
| 順位 | モデル | ベンダー | 日次トークン | 直近30日累計 |
|---|---|---|---|---|
| 1 | Mimo V2.5 | 小米 | 1.4T | 31.2T |
| 2 | DeepSeek V4 Flash | DeepSeek | 943.9B | 23.6T |
| 3 | Hy3 | Tencent | 590B | 23.4T |
| 4 | Nemotron 3 Ultra 550B(無料) | NVIDIA | 428.6B | 9T |
| 5 | DeepSeek V4 Pro | DeepSeek | 413.7B | 11.6T |
| 6 | GLM 5.2 | 智譜 Z.ai | 316.7B | 13.3T |
| 7 | MiniMax M3 | MiniMax | 262.5B | 15.1T |
| 8 | Step 3.7 Flash | StepFun | 204.8B | 5.9T |
| 9 | Kimi K3 | Moonshot AI | 157.6B | 1.6T(新規入榜) |
| 10 | Ling 3.0 Flash | InclusionAI | 128.3B | 417.3B |
| 11 | Gemini 3 Flash Preview | 106.3B | 4T | |
| 12 | Claude Sonnet 5 | Anthropic | 99.5B | 3.6T |
上位10位のうち7席を中国系ベンダーのモデルが占め、米国陣営は主に Nemotron 3 Ultra、Claude、Gemini がポジションを維持しています。DeepSeek は単一ベンダーとして最も安定したシェア1位(約16%–18%)ですが、月間ボリュームチャンピオンは中国陣営内でも頻繁に交代しています。
| ベンダー | 地域 | シェア(概算) |
|---|---|---|
| DeepSeek | 中国 | 16%–18% |
| 小米 | 中国 | 8%–18%(Mimo V2.5 急伸、変動最大) |
| Anthropic | 米国 | 10%–15% |
| Tencent | 中国 | 8%–13% |
| 米国 | 8%–13% | |
| 智譜 Z.ai | 中国 | 4%–7% |
| OpenAI | 米国 | 6%–8% |
| 中国系ベンダー合計 | — | 約46%(1年前 <2%) |
| 米国ビッグ3合計 | — | 約30%–36%(1年前約70%) |
| モデル | 入力/M | 出力/M | ポジション |
|---|---|---|---|
| DeepSeek V4 Flash | ~$0.05–0.14 | ~$0.24–0.28 | コスパ最強、Agentic Coding 向け |
| Nemotron 3 Ultra | $0.42(無料版あり) | $2.61 | 米系フルオープン、NVIDIA エコシステム |
| MiniMax M3 | $0.10 | $1.21 | マルチモーダル/長コンテキスト予算向け |
| GLM 5.2 | $0.45 | $3.31 | オープン内 Opus 級プランニング |
| Kimi K3 | ~$3 | ~$15 | 1.4TB オープンウェイト、クローズド級能力 |
| Claude Opus 5 | $5(高速 $10) | $25(高速 $50) | クローズド旗艦、7月ベンチマーク首位 |
03 LLM コスパ比較:利用量チャンピオンは品質チャンピオンではない
まず前提を明確にします。OpenRouter ランキングはトークン利用量であり、モデル品質ではありません。安価で高速なモデルが高トラフィックアプリの背後にあれば、複雑推論で平凡でも上位に入れます。
タスク種別の消費金額比率は別の絵を描きます。一般チャット35.7%、Agent ワークフロー30.4%、コード26.5%、データ処理7.5%。「分類/複雑推論」に絞ると——Claude Sonnet 4.6 と Claude Opus 4.7 が各13.5%で消費シェア1位タイ、GPT-5.5 が11.6%で3位——総量ランキングを席巻する安価オープンモデルはほぼ姿を見せません。
市場は自然に二層化しています。安価な中国系オープンモデルが大量・低障壁・許容誤差の高いボリュームタスクを吸収(雑談、創作、ロールプレイ、簡易コーディング支援)し、クローズド旗艦が高価値・低許容の難タスクの価格決定力を維持しています。7月24日の Claude Opus 5 発表が好例です——FrontierBench v0.1 で43.3%、GPT-5.6 Sol の37.5%を上回り、Opus 系列の $5/$25 価格を維持。背景はClaude Opus 5 と Kimi K3 論争の解説、Kimi K3 の詳細はKimi K3 徹底レビューを参照してください。
04 アプリ層ランキングと6ステップ階層ルーティング選定ガイド
アプリ層ランキング(openrouter.ai/apps)は、モデルが実際に何に使われているかを示します。
- Hermes Agent(Nous Research の自己改善型エージェント)が約45%のトークンシェアで突出;
- コーディング Agent が上位10の大半:Kilo Code(~13%)、OpenClaw(~9%)、Claude Code(~6%)、Cline(~1.7%);
- Cline → Roo Code → Kilo Code は同一コード系譜の3回のフォークで、最も新しい Kilo Code が祖先を逆転——オープンソース開発ツールの先行優位は想像より浅い;
- ロールプレイ/コンパニオン系(Janitor AI、ISEKAI ZERO、SillyTavern、HammerAI)がオープンモデル流量の相当部分を占有——OpenRouter × a16z《State of AI》では創意ロールプレイがオープンモデル総利用の半分以上を占めると報告されています。
| 順位 | アプリ | 種別 | シェア |
|---|---|---|---|
| 1 | Hermes Agent | 個人エージェント/CLI | ~45% |
| 2 | Kilo Code | コーディング Agent | ~13% |
| 3 | OpenClaw | 汎用 Agent | ~9% |
| 4 | Claude Code | コーディング Agent | ~6% |
| 5 | Descript | コンテンツ制作 | ~4.5% |
| 6 | pi | Agent | ~3.3% |
| 7 | Lemonade | コンパニオン/ゲーム | ~2.1% |
| 8 | ISEKAI ZERO | ロールプレイ | ~2.0% |
| 9 | Janitor AI | ロールプレイ | ~1.8% |
| 10 | Cline | コーディング Agent(IDE) | ~1.7% |
7月データとダンベル型市場構造に基づき、次の6ステップで階層ルーティングを構築することを推奨します。
- タスク種別と許容誤差の棚卸し:雑談/創作、Agent オーケストレーション、コード、複雑推論の4類に分類し、各カテゴリの許容エラー率とレイテンシ上限を記録します。
- 利用量榜と消費榜の二軸検証:ボリュームタスクは DeepSeek V4 Flash、GLM 5.2 を優先テスト。難タスクは Claude Opus 5 / GPT-5.6 をピーク時フォールバックに確保し、総量順位でシナリオ評価を代替しないでください。
- OpenRouter で技術検証サンドボックスを構築:単一キーで数百モデルを横断 A/B 比較。アジアからのレイテンシは約180–250ms で、現地インボイス非対応の点に留意し、本番ではコンプライアンス対応の中継を検討します。
- ハイブリッドルーティングでコスト削減:コーディングタスクは DeepSeek V4 Flash をデフォルトにし、詰まったステップのみ Claude Opus 5 に昇格。DeepSeek V4 GA 価格と移行ガイドを参照してください。
- ベンダー安全実績をスコアカードに組み込む:今週の OpenAI サンドボックス脱出事件と米国議会の「AI Kill Switch Act」提案——企業 Agent では権限収束とベンダー安全監査が必須です。
- Agent 本番化に向けた安定コンピュート基盤を準備:ローカル Claude Code / Cursor Agent とクラウド API 呼び出しには7×24環境が必要です。Mac mini ベアメタルと仮想化の Hypervisor オーバーヘッド、Metal ツールチェーン互換性を評価してください。
05 8月トレンド予測、引用可能データ、FAQ
8月トレンド予測(7月の推移に基づく):
- 中国系オープンモデル合計シェアは上昇を続け、年内に50%突破の可能性。米国ベンダーの大幅値下げがなければ;
- 月間ボリュームチャンピオンは引き続き交代——各社の8月リリースペースに注目;
- Anthropic がより低価格のボリューム向けモデルを投入する可能性。Opus 5 は2ヶ月以内の4つ目の旗艦;
- Kimi K3 の1.4TB ウェイトは2–4週間以内にコミュニティ量子化版が登場する見込み;
- セキュリティとコンプライアンスが新たな選定変数に——企業調達でベンダー安全評価の比重が上がります。
- Mimo V2.5 日次利用量:約1.4兆トークン/日、7月25日ランキング1位。直近30日累計31.2T。
- 米中価格差:DeepSeek V4 Flash 入力約 $0.05–0.14/M vs GPT-5.5 約 $5/M、約35倍。
- 中国系ベンダーシェアの変遷:1年前 <2% から約46%へ——過去12ヶ月で最も急峻なシェア移行の一つ。
- Claude Opus 5 ベンチマーク:FrontierBench v0.1 スコア43.3%、価格 $5/$25 百万トークン(高速 $10/$50)。
よくある質問(FAQ)
OpenRouter のランキングは何で並べ替えられていますか?
実際に課金されたトークン利用量で並べ替えられており、ベンチマークスコアではありません。
2026年7月の OpenRouter 利用量1位のモデルは?
2026年7月25日時点で、小米 Mimo V2.5 が約1.4兆トークン/日で1位です。
中国系モデルの OpenRouter シェアは?
複数ソースの7日間集計で、中国系ベンダー合計約46%のトークンシェア。1年前は2%未満でした。
利用量が多いモデルほど品質が高いですか?
必ずしもそうではありません。タスク種別に応じた階層ルーティングを推奨します。
以下が主要な参照ソースです。ランキングは日々変動するため、引用前に公式ページで最新データを確認してください。
OpenRouter Blog: DeepSeek V4 Adoption
OpenRouter × a16z State of AI レポート
7月のランキングで覚えておくべきは、能力と利用量が分岐しつつあるということです。Claude Code、Kilo Code、カスタム Agent を7×24で稼働させる本番チームにとって、API ルーティングだけではローカルツールチェーン、Metal 加速、安定稼働は解決しません——仮想化 Mac には Hypervisor オーバーヘッドと iOS CI 互換リスクがあります。ゼロオーバーヘッドのネイティブ算力、安定した iOS CI/CD、AI Agent の7×24自動化が必要な本番環境では、ZUKCLOUD のベアメタル Mac mini クラウドノードが通常より適した選択です。専用 Apple Silicon 物理マシン、Hypervisor オーバーヘッドなし、7×24オンライン、日/週/月の柔軟課金。詳細はベアメタルアーキテクチャ宣言をご覧ください。