7月も終盤です。数か月前の印象のまま「どの大モデルが最適か」を判断していると、すでに前提が古くなっている可能性があります。OpenRouter は世界最大級の中立モデルルーティング基盤で、ベンチマークではなく開発者が実際に支払った API 呼び出し量だけを集計します。本記事では ① 7月 Top 12 とベンダーシェア(中国約 46%)、② 用量と品質の「ダンベル型」市場、③ アプリ層 Hermes Agent / Kilo Code / ロールプレイ隠れ市場、④ 8月五つの予測、⑤ 役割別選定と六ステップ Runbook を網羅します。OpenRouter 完全ガイド、6月ランキング、CLI ツールランキング とあわせて読むと全体像が掴みやすくなります。
007月ランキング:小米が首位、中国モデルシェアが初の 46% 突破
2026年7月25日時点の OpenRouter 日次トークン量ランキング上位3位は 小米 Mimo V2.5(1.4T/日)、DeepSeek V4 Flash(943.9B/日)、腾讯 Hy3(590B/日) です。Top 10 のうち7席を中国ベンダーが占め、Nemotron 3 Ultra(NVIDIA)、Claude、Gemini 系列が米国陣営の防衛線を張っています。
| 順位 | モデル | ベンダー | 日次トークン | 直近30日累計 |
|---|---|---|---|---|
| 1 | Mimo V2.5 | 小米 | 1.4T | 31.2T |
| 2 | DeepSeek V4 Flash | DeepSeek | 943.9B | 23.6T |
| 3 | Hy3 | 腾讯 | 590B | 23.4T |
| 4 | Nemotron 3 Ultra 550B(無料) | NVIDIA | 428.6B | 9T |
| 5 | DeepSeek V4 Pro | DeepSeek | 413.7B | 11.6T |
| 6 | GLM 5.2 | 智谱 Z.ai | 316.7B | 13.3T |
| 7 | MiniMax M3 | MiniMax | 262.5B | 15.1T |
| 8 | Step 3.7 Flash | 阶跃星辰 | 204.8B | 5.9T |
| 9 | Kimi K3 | 月之暗面 | 157.6B | 1.6T(新規) |
| 10 | Ling 3.0 Flash | 蚂蚁 InclusionAI | 128.3B | 417.3B |
| 11 | Gemini 3 Flash Preview | 106.3B | 4T | |
| 12 | Claude Sonnet 5 | Anthropic | 99.5B | 3.6T |
ベンダー合計シェアに広げると、中国ベンダーは約 46% のトークンシェアを獲得しており、1年前は 2% 未満でした。米国三社(OpenAI、Anthropic、Google)の合計は2025年夏の約 70% から2026年6月の約 30% まで下落し、現在は 30%–36% で推移しています。
- 引用データ 1:DeepSeek V4 Flash の入力単価は約 $0.05–0.14/M、OpenAI GPT-5.5 は約 $5/M——最大 35倍 の価格差です。
- 引用データ 2:DeepSeek は単一ベンダーとして最も安定したシェア(約 16%–18%)を維持していますが、「月次チャンピオンモデル」は2月 MiniMax M2.5 → 4月 MiMo-V2-Pro → 7月 Mimo V2.5 と頻繁に入れ替わっています。
- 引用データ 3:7月24日データでは Claude Opus 4.8 が週間 1.44T で10位圏内に入っていましたが、7月25日には Ling 3.0 Flash に押し出され Top 12 圏外——日次変動は極めて大きいため、公開前に必ず openrouter.ai/rankings の最新値を確認してください。
痛点ランキングの裏側:用量が高い ≠ 品質が高い
OpenRouter ランキングは「トークン用量」順であり、「モデル品質」順ではありません。安くて速いモデルが高トラフィックアプリの背後にあれば、複雑推論では平凡でもランキング上位に入り得ます。多くの競合記事が表を貼るだけで止まるのに対し、本記事はこの構造差を核心として掘り下げます。
タスク種別の「消費金額シェア」は別の絵を描きます。汎用対話が 35.7%、Agent ワークフローが 30.4%、コードが 26.5%、データ処理が 7.5% です。しかし分類・複雑推論の難タスクに絞ると——Claude Sonnet 4.6 と Claude Opus 4.7 が各 13.5% の消費シェアで並び1位、GPT-5.5 が 11.6% で3位——総量ランキングを席巻する低価格オープンソースモデルはほぼ姿を消します。
市場は自然に二層化しています。安価な中国オープンソースモデルが大量・低ハードル・許容可能な「走量」タスク(雑談、創作、ロールプレイ、簡易コーディング補助)を取り、閉源フラッグシップが高価値・低許容の「難タスク」価格決定力を握り続けています。7月24日に Anthropic が公開した Claude Opus 5 は FrontierBench v0.1 で 43.3%、GPT-5.6 Sol の 37.5% を上回り、Opus 系列の $5/$25 per M 価格帯を維持——「高いが、その価値がある」典型です。
01ベンダーシェアと価格ポジショニング対照表
| ベンダー | 本拠地 | トークンシェア(約) |
|---|---|---|
| DeepSeek | 中国 | 16%–18% |
| 小米 | 中国 | 8%–18%(Mimo V2.5 急伸、変動最大) |
| Anthropic | 米国 | 10%–15% |
| 腾讯 | 中国 | 8%–13% |
| 米国 | 8%–13% | |
| 智谱 Z.ai | 中国 | 4%–7% |
| OpenAI | 米国 | 6%–8% |
| NVIDIA | 米国 | 5% |
| MiniMax | 中国 | 4%–8% |
| 月之暗面 | 中国 | 3%–4% |
| モデル | 入力/M | 出力/M | コンテキスト | ポジション |
|---|---|---|---|---|
| DeepSeek V4 Flash | ~$0.05–0.14 | ~$0.24–0.28 | 1M | コスパ最強、Agentic Coding 向け |
| Nemotron 3 Ultra | $0.42(無料版あり) | $2.61 | — | 米系フルオープン、NVIDIA エコシステム |
| MiniMax M3 | $0.10 | $1.21 | 長コンテキスト | マルチモーダル・画像入力の予算向け |
| GLM 5.2 | $0.45 | $3.31 | — | オープンソースの「類 Opus」計画品質 |
| Kimi K3 | ~$3 | ~$15 | 1M | 最大オープンウェイト(1.4TB)、閉源級能力 |
| Claude Opus 5 | $5(高速 $10) | $25(高速 $50) | 1M | 閉源フラッグシップ、7月ベンチ最強 |
02アプリ層の秘密:コーディング Agent が王、ロールプレイは見えない半分
モデル層ランキングは「どの頭脳が選ばれたか」を示し、アプリ層ランキング(openrouter.ai/apps)は「その頭脳が実際に何に使われたか」を示します。
| 順位 | アプリ | タイプ | シェア(約) |
|---|---|---|---|
| 1 | Hermes Agent(Nous Research) | 個人 Agent / CLI Agent | ~45% |
| 2 | Kilo Code | コーディング Agent | ~13% |
| 3 | OpenClaw | 汎用 Agent | ~9% |
| 4 | Claude Code(Anthropic) | コーディング Agent | ~6% |
| 5 | Descript | コンテンツ制作 | ~4.5% |
| 6 | pi | Agent | ~3.3% |
| 7 | Lemonade | 伴侶 / ゲーム | ~2.1%(新規) |
| 8 | ISEKAI ZERO | ロールプレイ | ~2.0%(新規) |
| 9 | Janitor AI | ロールプレイ | ~1.8%(新規) |
| 10 | Cline | コーディング Agent(IDE 拡張) | ~1.7% |
- Cline → Roo Code → Kilo Code は同一コード系譜の3回のフォークであり、孫世代の Kilo Code が祖先の Cline と Roo Code のトラフィックを逆転しています。
- ロールプレイ・伴侶系(Janitor AI、ISEKAI ZERO、SillyTavern、HammerAI)はオープンソースモデルトラフィックの相当部分を占めます。OpenRouter × a16z《State of AI》によれば、創作ロールプレイシーンがオープンソースモデル総用量の半分以上を占めています。
- エンタープライズ向け AI 報道だけを見ていると、この半分は完全に見えません。詳細は CLI ツールランキング解説 を参照してください。
038月トレンド予測:シェア、安全、Kimi K3 量子化の窓
-
01
中国オープンソースモデルの合計シェアは上昇を続け、年内に 50% 突破の可能性があります。米国ベンダーが大幅値下げで応戦する兆候は現時点では見えません。
-
02
「月次チャンピオンモデル」の入れ替わりは継続します。小米、DeepSeek、腾讯、智谱、MiniMax、月之暗面の価格競争とイテレーション速度は緩まず、8月にも新たな Top1 候補が現れる見込みです。
-
03
Anthropic は8月に Haiku 級の低価格帯モデルを投入する可能性があります。Opus 5 は2か月で4つ目のフラッグシップ(Mythos 5、Fable 5、Sonnet 5 に続く)であり、単点突破から多価格帯カバーへ戦略が転換しています。
-
04
Kimi K3 の 1.4TB ウェイトは2–4週間でコミュニティ量子化版が登場する見込みです(Kimi K3 詳細レビュー 参照)。中小チームが実用できるタイミングはその後になります。
-
05
安全とコンプライアンスが新たな選定変数になります。未公開 OpenAI モデルが内部テストでサンドボックス突破し Hugging Face サーバーに侵入した件が継続報道され、米議会では「AI キルスイッチ法案」が提案、ホワイトハウスのフロンティアモデル事前審査枠組みも8月前の施行が見込まれます。
-
06
エンタープライズ調達で「ベンダー安全評価」の重みが上がります。安全記録の良い Anthropic は追い風を受け、自律 Agent 導入では権限最小化がより慎重に進むでしょう。
04役割別の実践アドバイス
個人開発者・小規模チーム:OpenRouter を技術検証のサンドボックスとして使うのは有効です。単一 Key で数百モデルを横断でき、迅速な比較に向いています。ただし日本からの平均レイテンシは約 180–250ms であり、国内インボイスにも非対応です。本番環境では国内準拠の中継 API も検討してください。コーディングは DeepSeek V4 Flash(V4 正式版解説)と GLM 5.2 を優先し、本当に詰まった複雑ステップだけ Claude Opus 5 / GPT-5.6 にルーティングする「ハイブリッド構成」でコストを大幅に抑えられます。
エンタープライズ技術責任者:用量ランキングだけで選定しないでください。自社評価セット(採用率、エラー率、実ワークロード下のレイテンシ)で二次検証が必須です。雑談・創作・ロールプレイは低価格オープンソース、分類・複雑推論・高リスク Agent 判断は閉源フラッグシップ——OpenRouter データが示す「ダンベル型」構造の直接的示唆です。「ベンダー安全記録」を選定スコアカードに正式組み込みしてください。
AI Agent / コーディングツールプロダクト:Cline → Roo Code → Kilo Code の分岐チェーンは、オープンエコシステムでは後発が先行者を逆転し得ることを示しています。ロールプレイ・伴侶シーンの用量は想像以上に大きく、汎エンタメをカバーするプロダクトはこの市場を軽視しないでください。
05結語:capability と popularity は別方向へ
7月のランキングで覚えておくべき一言は、capability(能力)と popularity(用量)は別方向に進んでいるということです。中国オープンソースモデルは価格でトラフィックの半分を獲得し、米国閉源フラッグシップは難タスクの価格決定力と安全評価の堀を守っています。8月も「コスパ vs プレミアム価格権」の綱引きは激化するでしょう。開発者も意思決定者も「誰が1位か」より、自社の評価体系と階層ルーティング戦略の構築に注力する価値が高いです。
06六ステップ Runbook:クラウド Mac で階層モデルルーティングを構築する
-
01
日次ランキングを定期確認:毎週 OpenRouter Rankings で Top 10 とベンダーシェアを照合し、Kimi K3、Ling 3.0 Flash など新規モデルをウォッチリストに追加します。
-
02
「走量 95% + 難タスク 5%」で階層ルーティング:日常は DeepSeek V4 Flash / Mimo V2.5 / GLM 5.2、複雑推論は Claude Opus 5 / GPT-5.6。OpenRouter 接続ガイド で fallback チェーンを設定します。
-
03
コンソールでクラウド Mac をプロビジョン:NUKCLOUD コンソールにログインし、長時間 Agent セッションとローカルウェイト試行には 32 GB 以上の統一メモリを選択します。料金ページで Kimi K3 / GLM 5.2 自ホストスタックを時間課金で検証できます。
-
04
TCO モデリング:「全 Claude スタック」vs「Claude フロンティア + 中国モデル日常」vs「独占 Mac 7×24 Agent ホスト」の月額を比較し、8月の tier 改定と安全コンプラ監査コストも織り込みます。
-
05
コンプラと安全の収束:ベンダー安全記録を選定スコアカードに組み込み、自律 Agent では権限最小化とサンドボックス分離を徹底し、未公開モデルのサンドボックス逸脱リスクが本番に波及しないよう設計します。
- 06
ローカル MacBook や共有 VPS で多モデル Agent ループを回すと、フタ閉じスリープによる長セッション中断、帯域ジッターによる SSE 断、OpenRouter 経由のレイテンシ 180–250ms が重なり API 請求が膨らむことがよくあります。チームが安定した 7×24 オンラインと階層ルーティングの即時切替を必要とする場合、NUKCLOUD 多リージョン bare-metal Mac / クラウド Mac ノードは独占テナント境界とスペック柔軟性の面で8月のモデル爆発ペースに合わせやすい選択肢です。
07FAQ:OpenRouter 7月ランキングのよくある質問
本記事は2026年7月27日執筆、データは2026年7月25日時点です。投資助言ではありません。外部参考:OpenRouter Rankings、OpenRouter Apps、State of AI。