OpenRouter 7月排行榜怎么看?小米登顶与中国模型 46% 份额
OpenRouter 排行榜按 Token 用量排序,本质是「开发者真金白银在用什么」,而不是「哪个模型最聪明」。截至 7 月 25 日,单日 Token 用量前三名是 小米 Mimo V2.5(1.4 万亿/天)、DeepSeek V4 Flash(9439 亿/天)、腾讯 Hy3(5900 亿/天)。前十名中中国厂商模型占七席,仅 Nemotron 3 Ultra(NVIDIA)、Claude、Gemini 系列为美国阵营守住位置。
| 排名 | 模型 | 厂商 | 单日 Token | 近30天累计 |
|---|---|---|---|---|
| 1 | Mimo V2.5 | 小米 | 1.4T | 31.2T |
| 2 | DeepSeek V4 Flash | DeepSeek | 943.9B | 23.6T |
| 3 | Hy3 | 腾讯 | 590B | 23.4T |
| 4 | Nemotron 3 Ultra(免费) | NVIDIA | 428.6B | 9T |
| 5 | DeepSeek V4 Pro | DeepSeek | 413.7B | 11.6T |
| 6 | GLM 5.2 | 智谱 Z.ai | 316.7B | 13.3T |
| 7 | MiniMax M3 | MiniMax | 262.5B | 15.1T |
| 8 | Step 3.7 Flash | 阶跃星辰 | 204.8B | 5.9T |
| 9 | Kimi K3 | 月之暗面 | 157.6B | 1.6T(新上榜) |
| 10 | Ling 3.0 Flash | 蚂蚁 InclusionAI | 128.3B | 417.3B |
| 11 | Gemini 3 Flash Preview | 106.3B | 4T | |
| 12 | Claude Sonnet 5 | Anthropic | 99.5B | 3.6T |
拉长到厂商总份额维度:中国厂商合计约 46% Token 份额,一年前不到 2%;美国三巨头(OpenAI、Anthropic、Google)合计从去年年中约 70% 滑落到 30%–36%。这不是叙事驱动,而是价格逻辑——DeepSeek V4 Flash 输入约 $0.05–0.14/M,GPT-5.5 约 $5/M,价差高达 35 倍。
DeepSeek 厂商份额最稳:单一厂商约 16%–18%,多数统计中排第一,但「月度冠军模型」常易主。
小米波动最大:Mimo V2.5 单模型暴涨带动厂商份额 8%–18% 区间跳动。
Kimi K3 涨势最猛:新上榜即进 Top 9,1.4TB 开源权重创纪录。
榜单日波动大:Claude Opus 4.8 在 7/24 仍列第 10,7/25 被 Ling 3.0 Flash 挤出前 12。
看榜不能只看快照:比「谁是第一」更重要的是谁能持续留在前排。
大模型排行榜能代表质量吗?用量与能力的哑铃型分裂
必须泼一盆冷水:OpenRouter 排的是 Token 用量,不是模型质量。便宜又快的模型挂在高流量应用背后,就能轻松刷到前列——哪怕复杂推理表现平平。
| 维度 | 按 Token 用量榜 | 按消费金额(难任务) |
|---|---|---|
| 榜首格局 | 中国开源廉价模型霸屏 | Claude Sonnet 4.6 / Opus 4.7 各 13.5% 并列第一 |
| 典型 workload | 闲聊、创意、角色扮演、简单编程 | 复杂推理、企业 Agent 规划、高一致性分类 |
| 价格逻辑 | 跑量、可容错、35 倍价差驱动 | 闭源旗舰维持 $5/$25 定价权 |
| 7月例证 | Mimo V2.5 单日 1.4T | Claude Opus 5 FrontierBench v0.1 达 43.3% |
市场正在自然分层:便宜的中国开源模型吃下海量低门槛任务,闭源旗舰仍把持难任务的定价权与安全声誉护城河。
按任务类型统计的消费金额占比:通用对话 35.7%、Agent 工作流 30.4%、代码 26.5%、数据处理 7.5%。但专看「分类/复杂推理」,GPT-5.5 以 11.6% 排第三,总量榜上的廉价开源模型在此维度几乎「查无此模型」。7 月 24 日 Anthropic 发布的 Claude Opus 5 在 FrontierBench v0.1 拿下 43.3%(GPT-5.6 Sol 37.5%),价格维持 Opus 系列 $5/$25 per M——「我贵,但我值这个价」。
| 模型 | 输入/M | 输出/M | 定位 |
|---|---|---|---|
| DeepSeek V4 Flash | $0.05–0.14 | $0.24–0.28 | 性价比之王,Agentic Coding 首选 |
| GLM 5.2 | $0.45 | $3.31 | 开源里类 Opus 规划质量 |
| MiniMax M3 | $0.10 | $1.21 | 长上下文多模态预算之选 |
| Kimi K3 | ~$3 | ~$15 | 1.4TB 开源权重,闭源级能力 |
| Claude Opus 5 | $5(快速档 $10) | $25(快速档 $50) | 闭源旗舰,7 月最强基准分 |
OpenRouter 应用层排行:编程 Agent 称王与「看不见的」角色扮演流量
模型层排行榜反映「哪个大脑更受欢迎」;应用层(openrouter.ai/apps)才反映「这些大脑真正被用来做什么」。
| 排名 | 应用 | 类型 | 份额(约) |
|---|---|---|---|
| 1 | Hermes Agent | 个人智能体/CLI Agent | ~45% |
| 2 | Kilo Code | 编程 Agent | ~13% |
| 3 | OpenClaw | 通用 Agent | ~9% |
| 4 | Claude Code | 编程 Agent | ~6% |
| 5 | Descript | 内容生产 | ~4.5% |
| 6–10 | pi、Lemonade、ISEKAI ZERO、Janitor AI、Cline | Agent / 角色扮演 | 1.7%–3.3% |
关键洞察:Cline → Roo Code → Kilo Code 是同一代码血统的三次分叉,「孙子辈」Kilo Code 已反超祖辈。OpenRouter × a16z《State of AI》显示,创意角色扮演场景贡献开源模型总用量的一半以上——企业 AI 报道几乎看不到这半壁江山。
| 场景 | 推荐模型 | 理由 |
|---|---|---|
| 日常编程 / Agentic Coding | DeepSeek V4 Flash | 性价比最优,OpenRouter 用量第二 |
| 开源规划质量 | GLM 5.2 | 最接近 Opus 风格的开源规划能力 |
| 复杂推理 / 分类 | Claude Opus 5 / Sonnet 5 | 难任务消费份额领先 |
| 长上下文开源 | Kimi K3 | 1M 上下文,1.4TB 权重(量化前大厂可用) |
| 多模态预算方案 | MiniMax M3 | 图像输入性价比之选 |
| 美系全开源 | Nemotron 3 Ultra | NVIDIA 生态,有免费版 |
AI 模型 API 怎么选?六步分层路由落地 Runbook
建立任务分级:将 workload 分为跑量(闲聊/摘要/简单补全)与难任务(复杂推理/高风险 Agent 决策)两档,禁止全量走单一模型。
跑量层默认 DeepSeek V4 Flash:输入 $0.05–0.14/M,Agentic Coding 首选;备选 GLM 5.2 处理需更强规划的开源场景。
难任务层保留 Claude Opus 5:分类/复杂推理消费份额领先;仅在 cheaper 模型连续失败时升级,做「混合路由」。
接入 OpenRouter 统一端点:单一 Key 横跨数百模型,适合技术预研与 A/B 对比;注意国内访问延迟约 180–250ms。
把安全声誉纳入评分卡:本周 OpenAI 未发布模型沙盒逃逸事件发酵,企业 Agent 场景须做权限收敛与厂商安全记录审查。
7×24 稳定宿主:在云端 Mac Mini 上运行 Agent 网关与路由层,避免本地笔记本休眠导致长程任务中断;正式生产评估国内合规中转。
curl https://openrouter.ai/api/v1/chat/completions \
-H "Authorization: Bearer $OPENROUTER_API_KEY" \
-d '{
"models": [
"deepseek/deepseek-v4-flash",
"anthropic/claude-opus-5"
],
"messages": [{"role": "user", "content": "Plan a multi-step refactor..."}]
}'
2026年8月 OpenRouter 趋势预测与可引用硬数据
结合 7 月走势,对 8 月做出以下判断:
中国开源合计份额大概率继续爬升,年内有望突破 50%,除非美国厂商重大降价——目前无此迹象。
「月度冠军模型」宝座继续易主:小米、DeepSeek、腾讯、智谱、MiniMax、月之暗面价格战与迭代不会放缓。
Anthropic 或推更平价型号:Opus 5 已是两个月内第四款旗舰,打法从单点突破转向多价位段全覆盖。
Kimi K3 的 1.4TB 权重 2–4 周内或现社区量化版,届时中小团队才能真正落地;现阶段主要受益者为推理云服务商。
安全与合规成新选型变量:美国国会「AI 终止开关法案」与白宫前沿模型预发布审查框架预计 8 月前落地。
中国厂商 Token 份额:约 46%(一年前 <2%),为过去 12 个月 AI 行业最陡峭的份额迁移曲线之一。
Hermes Agent 应用份额:约 45%,为 OpenRouter 平台最大单一应用。
DeepSeek vs GPT-5.5 价差:输入定价差距约 35 倍($0.05–0.14/M vs ~$5/M),驱动跑量任务大规模迁移。
注意:榜单每日变动,发布前请用 openrouter.ai/rankings 核对最新 Top 10 顺序。
7 月最值得记住的一句话:capability(能力)和 popularity(用量)正在分道扬镳。比起纠结「谁是第一」,更值得投入精力的是建立评测体系与分层路由策略。
在本地笔记本跑多模型 Agent 网关,常面临休眠断连、内存不足与网络抖动;VPS 共享 CPU 又难以保证 Xcode 与 Metal 推理的稳定性。对于需要 7×24 运行 Hermes Agent、OpenClaw 或多模型 CI 流水线的团队,MESHLAUNCH 的 Mac Mini 云端裸金属租赁提供独占 Apple Silicon、按天/周/月弹性下单,是更稳定的生产级宿主选择。
截至 7 月 25 日,按单日 Token 用量,小米 Mimo V2.5 以 1.4 万亿 Token/天 居首,其次为 DeepSeek V4 Flash(9439 亿/天)和腾讯 Hy3(5900 亿/天)。Kimi K3 新上榜排第 9,涨势最猛。
不能。排行榜按 Token 用量排序,反映价格敏感型跑量任务。复杂推理上 Claude Sonnet 4.6 与 Opus 4.7 仍以各 13.5% 消费份额并列第一。详见 租赁价格页了解稳定 Agent 宿主方案。
编程类任务优先测试 DeepSeek V4 Flash 与 GLM 5.2,把 Claude Opus 5 留给卡住的复杂步骤。OpenRouter 适合做技术预研沙盒;正式生产须评估延迟与国内合规方案。
建议将 OpenRouter/LiteLLM 路由层部署在 7×24 在线的云端 Mac 上。区域与配置可参考 帮助中心,按项目周期选择日租/月租节点。