7月ランキングの読み方:小米が頂点に立ち、中国モデルが 46% シェア
OpenRouter ランキングは Token 使用量順です。つまり「どのモデルが最も賢いか」ではなく、「開発者が本番で何にお金を払っているか」を示します。7月25日時点の日次 Token 量トップ3は 小米 Mimo V2.5(1.4兆/日)、DeepSeek V4 Flash(9439億/日)、腾讯 Hy3(5900億/日)です。Top 10 のうち7席が中国ベンダー、Nemotron 3 Ultra(NVIDIA)、Claude、Gemini 系列だけが米国陣営の座を守っています。
| 順位 | モデル | ベンダー | 日次 Token | 直近30日累計 |
|---|---|---|---|---|
| 1 | Mimo V2.5 | 小米 | 1.4T | 31.2T |
| 2 | DeepSeek V4 Flash | DeepSeek | 943.9B | 23.6T |
| 3 | Hy3 | 腾讯 | 590B | 23.4T |
| 4 | Nemotron 3 Ultra(無料) | NVIDIA | 428.6B | 9T |
| 5 | DeepSeek V4 Pro | DeepSeek | 413.7B | 11.6T |
| 6 | GLM 5.2 | 智谱 Z.ai | 316.7B | 13.3T |
| 7 | MiniMax M3 | MiniMax | 262.5B | 15.1T |
| 8 | Step 3.7 Flash | 阶跃星辰 | 204.8B | 5.9T |
| 9 | Kimi K3 | 月之暗面 | 157.6B | 1.6T(新規) |
| 10 | Ling 3.0 Flash | 蚂蚁 InclusionAI | 128.3B | 417.3B |
| 11 | Gemini 3 Flash Preview | 106.3B | 4T | |
| 12 | Claude Sonnet 5 | Anthropic | 99.5B | 3.6T |
ベンダー合計シェアに広げると、中国ベンダーは約 46% の Token シェア、1年前は 2% 未満でした。米国三強(OpenAI、Anthropic、Google)の合計は昨年夏の約 70% から 30%–36% へ滑落。これはナラティブではなく価格ロジックです——DeepSeek V4 Flash の入力は約 $0.05–0.14/M、GPT-5.5 は約 $5/M、最大 35 倍の価格差が大量タスクを中国オープンソース側へ押し流しています。
DeepSeek がベンダーシェア最安定:単独で約 16%–18%、多くの統計で1位。ただし「月間チャンピオンモデル」は頻繁に入れ替わります。
小米の変動が最大:Mimo V2.5 の急伸でベンダーシェアが 8%–18% の幅で揺れます。
Kimi K3 の伸びが最も急:新規ランクインで即 Top 9、1.4TB オープンウェイトは記録級です。
日次変動は大きい:Claude Opus 4.8 は 7/24 時点で10位、7/25 には Ling 3.0 Flash に押し出され Top 12 圏外へ。
スナップショットだけ見ない:「誰が1位か」より「誰が継続して前列に残るか」が重要です。
ランキングは品質を表すか?使用量と能力のダンベル型分裂
まず冷静な視点を:OpenRouter が並べるのは Token 使用量であり、モデル品質ではありません。安く速いモデルが高トラフィックアプリの裏にいれば、複雑推論が平凡でも上位に来やすいのです。
| 軸 | Token 使用量ランキング | 消費金額(難タスク) |
|---|---|---|
| トップ格局 | 中国オープンソース廉価モデルが席巻 | Claude Sonnet 4.6 / Opus 4.7 が各 13.5% で並び1位 |
| 典型 workload | 雑談・創作・ロールプレイ・簡易コーディング | 複雑推論・企業 Agent 計画・高一貫性分類 |
| 価格ロジック | 大量処理・許容誤差・35倍価格差が駆動 | クローズド旗艦が $5/$25 の価格権を維持 |
| 7月の例 | Mimo V2.5 が日次 1.4T | Claude Opus 5 が FrontierBench v0.1 で 43.3% |
市場は自然に二層化しています。安い中国オープンソースが低ハードルタスクの海量を食い、クローズド旗艦は難タスクの価格権とセキュリティ評判の堀を守っています。
タスク種別の消費金額シェアは、汎用対話 35.7%、Agent ワークフロー 30.4%、コード 26.5%、データ処理 7.5% です。ただし「分類・複雑推論」に絞ると GPT-5.5 が 11.6% で3位、総量ランキングの廉価オープンソースはこの軸ではほぼ見えません。7月24日に Anthropic が公開した Claude Opus 5 は FrontierBench v0.1 で 43.3%(GPT-5.6 Sol 37.5%)、価格は Opus 系列の $5/$25 per M を維持——「高いが、その価値がある」という立場です。
| モデル | 入力/M | 出力/M | ポジション |
|---|---|---|---|
| DeepSeek V4 Flash | $0.05–0.14 | $0.24–0.28 | コスパ王、Agentic Coding 第一候補 |
| GLM 5.2 | $0.45 | $3.31 | オープンソースで Opus 級の計画品質 |
| MiniMax M3 | $0.10 | $1.21 | 長コンテキスト・マルチモーダルの予算案 |
| Kimi K3 | ~$3 | ~$15 | 1.4TB オープンウェイト、クローズド級能力 |
| Claude Opus 5 | $5(高速 $10) | $25(高速 $50) | クローズド旗艦、7月最強ベンチ |
アプリ層ランキング:コーディング Agent 優勢と「見えない」ロールプレイ流量
モデル層ランキングは「どの脳が人気か」を示します。アプリ層(openrouter.ai/apps)は「その脳が実際に何に使われているか」を示します。
| 順位 | アプリ | 種別 | シェア(約) |
|---|---|---|---|
| 1 | Hermes Agent | 個人 Agent / CLI Agent | ~45% |
| 2 | Kilo Code | コーディング Agent | ~13% |
| 3 | OpenClaw | 汎用 Agent | ~9% |
| 4 | Claude Code | コーディング Agent | ~6% |
| 5 | Descript | コンテンツ制作 | ~4.5% |
| 6–10 | pi、Lemonade、ISEKAI ZERO、Janitor AI、Cline | Agent / ロールプレイ | 1.7%–3.3% |
重要な洞察:Cline → Roo Code → Kilo Code は同一コード系譜の3回の分岐で、「孫」にあたる Kilo Code が祖先を逆転しました。OpenRouter × a16z《State of AI》によれば、創作ロールプレイがオープンソースモデル総使用量の半数超を占めます——企業向け AI 報道ではほぼ語られない半分です。
| シーン | 推奨モデル | 理由 |
|---|---|---|
| 日常コーディング / Agentic Coding | DeepSeek V4 Flash | コスパ最適、OpenRouter 使用量2位 |
| オープンソース計画品質 | GLM 5.2 | Opus 風の計画能力に最も近い OSS |
| 複雑推論 / 分類 | Claude Opus 5 / Sonnet 5 | 難タスク消費シェアが先行 |
| 長コンテキスト OSS | Kimi K3 | 1M コンテキスト、1.4TB ウェイト |
| マルチモーダル予算案 | MiniMax M3 | 画像入力のコスパ選択 |
| 米系フル OSS | Nemotron 3 Ultra | NVIDIA エコシステム、無料版あり |
AI モデル API の選び方:六ステップ階層ルーティング Runbook
タスクを二段階に分類:workload を大量処理(雑談・要約・簡易補完)と難タスク(複雑推論・高リスク Agent 判断)に分け、単一モデル全量投入を禁止します。
大量層は DeepSeek V4 Flash をデフォルト:入力 $0.05–0.14/M、Agentic Coding 第一候補。より強い計画が必要な OSS シーンは GLM 5.2 を代替に。
難タスク層に Claude Opus 5 を温存:分類・複雑推論の消費シェアが先行。安価モデルが連続失敗したときだけエスカレートするハイブリッドルーティングを構築します。
OpenRouter 統一エンドポイントを接続:単一 Key で数百モデルにアクセスでき、技術検証と A/B 比較に最適。国内からのレイテンシは約 180–250ms に留意してください。
セキュリティ評判をスコアカードに組み込む:今週の OpenAI モデルサンドボックス脱出事件を受け、企業 Agent では権限収束とベンダーのセキュリティ履歴審査が必須です。
7×24 安定ホストを確保:クラウド Mac Mini 上で Agent ゲートウェイとルーティング層を稼働させ、ローカル PC のスリープによる長時間タスク中断を防ぎます。本番は国内コンプライアンス中継も評価してください。
curl https://openrouter.ai/api/v1/chat/completions \
-H "Authorization: Bearer $OPENROUTER_API_KEY" \
-d '{
"models": [
"deepseek/deepseek-v4-flash",
"anthropic/claude-opus-5"
],
"messages": [{"role": "user", "content": "Plan a multi-step refactor..."}]
}'
2026年8月 OpenRouter トレンド予測と引用可能な数値
7月の推移を踏まえ、8月について以下の判断を示します。
中国 OSS 合計シェアは 50% 突破の可能性が高い。米国ベンダーの大幅値下げは現時点で兆候なし。
月間チャンピオンモデルは引き続き入れ替わる。小米・DeepSeek・腾讯・智谱・MiniMax・月之暗面の価格競争とイテレーションは止まりません。
Anthropic はより低価格帯を投入する可能性。Opus 5 は2か月で4つ目の旗艦であり、単点突破から多価格帯カバーへ戦略が移行しています。
Kimi K3 の 1.4TB ウェイトは 2–4 週間でコミュニティ量子化版が出る可能性。現段階では推論クラウド事業者が主な受益者です。
セキュリティとコンプライアンスが選定の新変数に。米国議会の「AI キルスイッチ法案」とホワイトハウスのフロンティアモデル事前審査枠組みが8月前に成立する見込みです。
中国ベンダー Token シェア:約 46%(1年前 <2%)。過去12か月で最も急なシェア移行の一つです。
Hermes Agent アプリシェア:約 45%。OpenRouter 最大の単一アプリです。
DeepSeek vs GPT-5.5 価格差:入力単価で約 35 倍($0.05–0.14/M vs ~$5/M)。大量タスクの大規模移行を駆動しています。
注意:ランキングは日次で変動します。公開前に openrouter.ai/rankings で最新 Top 10 を確認してください。
7月に覚えておくべき一言:capability(能力)と popularity(使用量)は別方向に進んでいます。「誰が1位か」より、評価体系と階層ルーティング戦略への投資が価値があります。
ローカルノート PC でマルチモデル Agent ゲートウェイを動かすと、スリープ断線・メモリ不足・ネットワーク揺らぎに直面しがちです。Hermes Agent、OpenClaw、マルチモデル CI パイプラインを 7×24 稼働させるチームには、MESHLAUNCH の Mac Mini クラウドベアメタルレンタルが、専有 Apple Silicon と日/週/月の柔軟契約で安定した本番ホストを提供します。
7月25日時点の日次 Token 量では 小米 Mimo V2.5 が 1.4 兆 Token/日で首位。続いて DeepSeek V4 Flash(9439億/日)と腾讯 Hy3(5900億/日)です。Kimi K3 は新規ランクインで9位、伸びが最も急いでいます。
いいえ。Token 使用量順であり、価格敏感な大量タスクを反映します。複雑推論では Claude Sonnet 4.6 と Opus 4.7 が各 13.5% で並び1位です。安定 Agent ホストについては レンタル料金ページをご参照ください。
プログラミングは DeepSeek V4 Flash と GLM 5.2 を優先テストし、詰まった複雑ステップだけ Claude Opus 5 に回すハイブリッドが有効です。OpenRouter は技術検証向き、本番はレイテンシと国内コンプライアンスを評価してください。
OpenRouter / LiteLLM ルーティング層を 7×24 稼働のクラウド Mac にデプロイすることをおすすめします。リージョンと設定は ヘルプセンターを参照し、プロジェクト期間に合わせて日租/月租ノードを選んでください。