ホーム / ブログ / OpenRouter ランキング
ENGINEERING BLOG · 2026.07.01

OpenRouter 2026年6月ランキング解読:
中国系モデルが開発者トラフィックの61%を占める — 次に来るもの

2026年7月時点でも「米国ビッグ3=安全策」という前提でモデルを選んでいる開発者やアーキテクトの方には、OpenRouter 2026年6月の実トラフィックデータが選定基準の見直しを迫ります。中国系モデルが開発者トークン量の約61%を占め、米国系ラボの合計シェアは1年前の約70%から約30%へと半減しました。本記事ではランキング全体、利用量と品質の乖離、シナリオ別モデル選定、Q3 2026 リリース予測を整理します。結論として、最も価値の高いスキルは「最良のモデルを1つ選ぶこと」ではなく、アプリを書き換えずにモデルを差し替えられるアーキテクチャを構築することです。

01

6月は出来事が集中しました。Claude Fable 5 が輸出規制の下で姿を消し、OpenAI と Anthropic が IPO 意向を示し、中国系モデルが OpenRouter トラフィックの60%を超えました。2025年の前提のまま判断すると、次のような隠れコストが発生します。

  • 利用量首位と品質首位の混同: DeepSeek V4 Flash が日次619Bトークンで首位ですが、長期エージェント基盤の最適解とは限りません。Claude Opus 4.8 は Artificial Analysis Intelligence Index で61.4と依然首位です。
  • 能力より経済性の軽視: サンディエゴの開発者は「Claude で1時間のコーディングは約10ドル、DeepSeek なら50セント未満」と語っています。米国・欧州・インドの開発者が中国系モデルを選ぶのは、安く、速く、十分に良いからです。
  • 単一プロバイダー依存という技術的負債: Q3 2026 は GPT-6、Claude Opus 5、Gemini 4、DeepSeek V5 が90日以内に集中リリースされる可能性があります。1社にハードコードするのは意図的な負債です。
  • エージェント本番化の転換点の過小評価: 2026年はエージェントが実験から本番へ移行する年と広く認識されています。Anthropic の2026 State of AI Agents レポートでは Claude API 呼び出しの約44%が数学・コンピュータタスクです。オーケストレーション基盤は API と同等に重要であり、ベアメタルアーキテクチャ宣言でも論じた通りです。

02

OpenRouter は数百万件の実開発者リクエストに基づく、最も正直なスコアボードの一つです。以下は2026年6月時点のデータです。

企業別(週次トークン量)
順位 企業 出身 週次トークン シェア
1DeepSeek中国5.13T17.6%
2Anthropic米国4.34T14.8%
3Google米国3.66T12.5%
4OpenAI米国2.46T8.4%
5Xiaomi中国2.42T8.3%
6MiniMax中国2.37T8.1%
7Tencent中国2.36T8.1%
8Qwen (Alibaba)中国1.26T4.3%

上位ティアの中国系企業は特定可能なボリュームの約46%を占め、中国系トラフィック全体では開発者シェアが61%を超えています。

日次トークン量トップ10モデル
順位 モデル 企業 日次トークン
1DeepSeek V4 FlashDeepSeek619B
2Hy3 PreviewTencent451B
3MiniMax M3MiniMax447B
4MiMo-V2.5Xiaomi327B
5DeepSeek V4 ProDeepSeek300B
6Claude Opus 4.7Anthropic263B
7Claude Opus 4.8Anthropic~200B
8Claude Sonnet 4.6Anthropic178B
9Gemini 3 Flash PreviewGoogle156B
10Kimi K2.6Moonshot AI~150B

このランキングは、ベンダーのマーケティング音量ではなく、開発者が本番で実際に信頼しているモデルを反映しています。

03

Bloomberg が引用した OpenRouter と Exponential View のデータは、この逆転を明確に示しています。

  • 2025年6月: 米国ラボ(Google + OpenAI + Anthropic)が OpenRouter トークンシェアの約70%を占有
  • 2026年6月: 同数値が約30%に低下 — 40ポイントのシフトを中国系モデルが吸収

これは「国内偏好」ではなく、グローバルな経済性の問題です。ダラスの開発者は次のように語っています。「複雑タスク用に Claude + ChatGPT で月500ドル、日常コーディングと音声認識の90%は MiniMax + Kimi + MiMo で月200ドル」。

品質の天井:Claude Opus 4.8 が総合首位を維持。 Artificial Analysis Intelligence Index(2026年5月下旬):

品質指数とコーディングベンチマーク
モデル Intelligence Index SWE-bench Pro 備考
Claude Opus 4.861.4 (#1)69.2%長コンテキスト・エージェントで首位
GPT-5.559–6063.1%最高のエコシステム、最速ツール呼び出し
Gemini 3.1 Pro57最難推論で強み
Qwen 3.7 Max57中国系クローズドモデル首位
Claude Sonnet 4.680.8% (Verified)文章・指示追従で最高

あるエンジニアが20タスクをフロンティアモデル横断で実行した結果、Opus 4.8 が16勝、GPT-5.5 が5勝、Gemini 3.1 Pro が4勝でした。長コンテキスト作業では Opus は単に優れているだけでなく、別カテゴリにいました。

Claude Fable 5 は輸出規制の下で6月中旬にグローバル停止する前、品質スコア100/100を一時記録していました。最難ワークロードにおける米国品質の天井は依然として高いことを示しています。

ボリューム王者:中国系モデルは日常作業の価格性能比で勝利。 構造的理由は3つです。

  1. 価格: MiniMax M3 は入力 $0.60/M — Claude Opus 4.8 の $5.00/M 比で約8倍安い
  2. 十分な品質: コード補完、翻訳、要約、日常タスクの大半はフロンティア性能の80–90%に到達
  3. オープンウェイト: DeepSeek V4 と MiniMax M3 はウェイトを公開し、セルフホストとデータ residency の摩擦を排除

04

ユースケース別モデル選定(2026年6月)
ユースケース 推奨モデル 理由
複雑コーディング / 長期エージェントClaude Opus 4.8Intelligence Index #1、長コンテキストで比類なし
日常開発支援DeepSeek V4 Flash / MiMo-V2.5優れた価格性能、高速
最低コスト本番 APIMiniMax M3$0.60/M、オープンウェイト、セルフホスト可
超長コンテキスト(1M+)Kimi K2.61M コンテキスト、競争力ある価格
Google Workspace / マルチモーダルGemini 3.5 Flashネイティブ GWorkspace、フロンティア級の速度/価値
リアルタイム Web / X コンテキストGrok 4.3ライブ情報取得に最適
セルフホスト / オンプレGLM 5.2 / Kimi K2.6トップクラスのオープンウェイト選択肢
読みやすいテキスト付き画像生成ChatGPT Images 2.0AI 画像のテキスト描画で最高
総合日常チャットGPT-5.5GPT-5.3 比で幻覚52.5%減、強力なエコシステム

合理的な分割は、最難タスクの5%をフロンティアクローズドモデルに、残り95%のボリュームを中国系オープンウェイトモデルに割り当てることです。モデル非依存ルーティングを実装する6ステップは以下の通りです。

  1. 統一インターフェースの抽象化: OpenRouter または内部ゲートウェイでプロバイダーをラップし、アプリコードはベンダー SDK ではなくスキーマに依存させます。
  2. タスク複雑度によるルーティング: 単純補完は DeepSeek V4 Flash(~$0.50/時間クラス)、長期エージェントは Claude Opus 4.8、中間層は Sonnet 4.6 または GPT-5.5 へ。
  3. コスト・レイテンシ予算の設定: 各リクエストクラスに max_tokens、タイムアウト、百万トークン上限を付与し、予算超過時は Flash モデルへ自動ダウングレード。
  4. 独自ベンチマークスイートの構築: 月次で20–50件の本番タスクを実行 — 公開リーダーボードだけに判断を委ねない。6月リーク情報まとめでも論じた通り、噂は公式 SWE-bench データの代替になりません。
  5. オープンウェイトセルフホスト経路の確保: コンプライアンス敏感なワークロードには MiniMax M3、GLM 5.2、Kimi K2.6 を自社ハードウェアまたはベアメタルノードにデプロイ。
  6. Q3 リリースアラートの配線: GPT-6(8–9月)、Claude Opus 5(~9月)、Gemini 4、DeepSeek V5 が6週間以内に集中する可能性 — ルーティング層はアプリ書き換えなしで新モデル ID をホットスワップできること。

05

Q3 2026 は AI 史上最大のフロンティアリリース四半期になる見込みです。確認済みまたは高確度のリリース予測:

Q3 2026 高信頼度リリース予測
モデル 企業 時期 主要アップグレード
GPT-6OpenAI2026年8–9月1.5M コンテキスト、エージェント強化(噂)
Claude Opus 5Anthropic~2026年9月長期エージェント強化、MCP 刷新
Gemini 4GoogleQ3 2026マルチモーダル飛躍:動画・音声・画像生成
DeepSeek V5DeepSeekQ3 2026オープンウェイト、~1T パラメータ、Huawei Ascend スタック
GLM 5.2Z.aiリリース済みトップオープンウェイト、コーディング強み
Grok 4.3+xAIQ3 20261M コンテキスト、リアルタイム Web 強化

2026年下半期の5つのマクロ予測:

  • 「最良のモデル」という問い自体が無意味になる — 90日間に5つのフロンティア級リリースが来れば、ワークロード別ランキングが標準になる。
  • 中国系ボリュームシェアは伸び続けるが、エンタープライズコンプライアンスが天井になる — 個人開発者の OpenRouter シェアは70%超も可能だが、Fortune 500 の調達はデータ residency と議会審査に制約される。
  • エージェント性能が最重要メトリクスになる — 50ステップのエージェントワークフローを詰まらず実行できるか。
  • IPO 圧力が Anthropic と OpenAI の価格を再形成する — 両社が2026年6月に IPO 意向を表明。公開市場はマージンを求め、中国系競合との価格戦を加速させる可能性がある。
  • 12か月以内に消費者ハードウェアで SWE-bench 80%到達 — 32GB 消費者 GPU が2027年中期までに SWE-bench Verified 80%に到達する可能性。

引用可能なハードデータ(2026年6月時点):

  • シェア逆転: OpenRouter 上の米国ラボ 70%(2025年6月)→ 30%(2026年6月);中国系が40ポイント吸収
  • 価格差: MiniMax M3 $0.60/M vs Claude Opus 4.8 $5.00/M(約8倍);サンディエゴ開発者実測 Claude コーディング ~$10/時間 vs DeepSeek ~$0.50/時間
  • 品質指数: Claude Opus 4.8 が61.4(#1);20タスク bake-off で16/20勝;Claude Fable 5 は6月中旬輸出停止前に100/100
  • エージェント利用構成: Anthropic レポート — Claude API 呼び出しの44%が数学・コンピュータタスク
  • 米国ラボの差別化: OpenAI はエコシステム、Anthropic は品質天井、Google はマルチモーダル幅と速度(Gemini Flash)

構造的故事は「中国が勝った」ではありません。モデル層の経済マージンが崩壊しているということです。DeepSeek の2025年1月リリースは、フロンティア級性能にフロンティア級コンピュートは不要であることを証明しました。Xiaomi、Tencent、MiniMax、Moonshot がベース価格を圧縮し、「ほぼ同等だが高い」中間層が空洞化しています。

公式・第三者ソース(上流更新後はリンクを再確認してください):

OpenRouter Rankings — ライブデータ

Artificial Analysis Intelligence Index

OfficeChai: OpenRouter で最も人気の AI モデル(2026年6月)

DataGravity: 中国オープンウェイトの台頭

Anthropic: The 2026 State of AI Agents Report

ルーティング戦略がどれほど柔軟でも、ローカルエージェントオーケストレーション、Xcode ビルド、オープンウェイトセルフホストは VM ハイパーバイザー税と GPU メモリ帯域の切り詰めの下で苦しみます。共有 CI のジッターは最安 API すら無駄にします。ゼロロスネイティブコンピュート、安定 iOS CI/CD、24時間 AI エージェント自動化が必要な本番環境では、ZUKCLOUD ベアメタル Mac mini クラウドノードが通常より良い答えです。専有 Apple Silicon ハードウェア、ハイパーバイザーオーバーヘッドなし、常時オン、日次/週次/月次の柔軟な発注 — GLM 5.2、Kimi K2.6、長期エージェントワークフローの理想的な基盤です。