OpenRouter 7月排行榜怎麼看?小米登頂與中國模型 46% 份額
OpenRouter 排行榜按 Token 用量排序,本質上是「開發者實際付費在用什麼」,而非「哪個模型最聰明」。截至 7 月 25 日,單日 Token 用量前三名為 小米 Mimo V2.5(1.4 兆/天)、DeepSeek V4 Flash(9439 億/天)、騰訊 Hy3(5900 億/天)。前十名之中,中國廠商模型佔七席,僅 Nemotron 3 Ultra(NVIDIA)、Claude、Gemini 系列為美國陣營守住位置。
| 排名 | 模型 | 廠商 | 單日 Token | 近30天累計 |
|---|---|---|---|---|
| 1 | Mimo V2.5 | 小米 | 1.4T | 31.2T |
| 2 | DeepSeek V4 Flash | DeepSeek | 943.9B | 23.6T |
| 3 | Hy3 | 騰訊 | 590B | 23.4T |
| 4 | Nemotron 3 Ultra(免費) | NVIDIA | 428.6B | 9T |
| 5 | DeepSeek V4 Pro | DeepSeek | 413.7B | 11.6T |
| 6 | GLM 5.2 | 智譜 Z.ai | 316.7B | 13.3T |
| 7 | MiniMax M3 | MiniMax | 262.5B | 15.1T |
| 8 | Step 3.7 Flash | 階躍星辰 | 204.8B | 5.9T |
| 9 | Kimi K3 | 月之暗面 | 157.6B | 1.6T(新上榜) |
| 10 | Ling 3.0 Flash | 螞蟻 InclusionAI | 128.3B | 417.3B |
| 11 | Gemini 3 Flash Preview | 106.3B | 4T | |
| 12 | Claude Sonnet 5 | Anthropic | 99.5B | 3.6T |
拉長到廠商總份額維度:中國廠商合計約 46% Token 份額,一年前不到 2%;美國三巨頭(OpenAI、Anthropic、Google)合計從去年年中約 70% 滑落至 30%–36%。這不是敘事驅動,而是價格邏輯——DeepSeek V4 Flash 輸入約 $0.05–0.14/M,GPT-5.5 約 $5/M,價差高達 35 倍。
DeepSeek 廠商份額最穩:單一廠商約 16%–18%,多數統計中排第一,但「月度冠軍模型」常易主。
小米波動最大:Mimo V2.5 單模型暴漲帶動廠商份額 8%–18% 區間跳動。
Kimi K3 漲勢最猛:新上榜即進 Top 9,1.4TB 開源權重創紀錄。
榜單日波動大:Claude Opus 4.8 在 7/24 仍列第 10,7/25 被 Ling 3.0 Flash 擠出前 12。
看榜不能只看快照:比「誰是第一」更重要的是誰能持續留在前排。
大模型排行榜能代表品質嗎?用量與能力的啞鈴型分裂
必須先潑一盆冷水:OpenRouter 排的是 Token 用量,不是模型品質。便宜又快的模型掛在高流量應用背後,就能輕鬆刷到前列——哪怕複雜推理表現平平。
| 維度 | 按 Token 用量榜 | 按消費金額(難任務) |
|---|---|---|
| 榜首格局 | 中國開源廉價模型霸屏 | Claude Sonnet 4.6 / Opus 4.7 各 13.5% 並列第一 |
| 典型 workload | 閒聊、創意、角色扮演、簡單程式設計 | 複雜推理、企業 Agent 規劃、高一致性分類 |
| 價格邏輯 | 跑量、可容錯、35 倍價差驅動 | 閉源旗艦維持 $5/$25 定價權 |
| 7月例證 | Mimo V2.5 單日 1.4T | Claude Opus 5 FrontierBench v0.1 達 43.3% |
市場正在自然分層:便宜的中國開源模型吃下海量低門檻任務,閉源旗艦仍把持難任務的定價權與安全聲譽護城河。
按任務類型統計的消費金額佔比:通用對話 35.7%、Agent 工作流 30.4%、程式碼 26.5%、資料處理 7.5%。但專看「分類/複雜推理」,GPT-5.5 以 11.6% 排第三,總量榜上的廉價開源模型在此維度幾乎「查無此模型」。7 月 24 日 Anthropic 發布的 Claude Opus 5 在 FrontierBench v0.1 拿下 43.3%(GPT-5.6 Sol 37.5%),價格維持 Opus 系列 $5/$25 per M——「我貴,但我值這個價」。
| 模型 | 輸入/M | 輸出/M | 定位 |
|---|---|---|---|
| DeepSeek V4 Flash | $0.05–0.14 | $0.24–0.28 | 性價比之王,Agentic Coding 首選 |
| GLM 5.2 | $0.45 | $3.31 | 開源裡類 Opus 規劃品質 |
| MiniMax M3 | $0.10 | $1.21 | 長上下文多模態預算之選 |
| Kimi K3 | ~$3 | ~$15 | 1.4TB 開源權重,閉源級能力 |
| Claude Opus 5 | $5(快速檔 $10) | $25(快速檔 $50) | 閉源旗艦,7 月最強基準分 |
OpenRouter 應用層排行:程式設計 Agent 稱王與「看不見的」角色扮演流量
模型層排行榜反映「哪個大腦更受歡迎」;應用層(openrouter.ai/apps)才反映「這些大腦真正被用來做什麼」。
| 排名 | 應用 | 類型 | 份額(約) |
|---|---|---|---|
| 1 | Hermes Agent | 個人智慧體/CLI Agent | ~45% |
| 2 | Kilo Code | 程式設計 Agent | ~13% |
| 3 | OpenClaw | 通用 Agent | ~9% |
| 4 | Claude Code | 程式設計 Agent | ~6% |
| 5 | Descript | 內容生產 | ~4.5% |
| 6–10 | pi、Lemonade、ISEKAI ZERO、Janitor AI、Cline | Agent / 角色扮演 | 1.7%–3.3% |
關鍵洞察:Cline → Roo Code → Kilo Code 是同一代碼血統的三次分叉,「孫子輩」Kilo Code 已反超祖輩。OpenRouter × a16z《State of AI》顯示,創意角色扮演場景貢獻開源模型總用量的一半以上——企業 AI 報導幾乎看不到這半壁江山。
| 場景 | 推薦模型 | 理由 |
|---|---|---|
| 日常程式設計 / Agentic Coding | DeepSeek V4 Flash | 性價比最優,OpenRouter 用量第二 |
| 開源規劃品質 | GLM 5.2 | 最接近 Opus 風格的開源規劃能力 |
| 複雜推理 / 分類 | Claude Opus 5 / Sonnet 5 | 難任務消費份額領先 |
| 長上下文開源 | Kimi K3 | 1M 上下文,1.4TB 權重(量化前大廠可用) |
| 多模態預算方案 | MiniMax M3 | 圖像輸入性價比之選 |
| 美系全開源 | Nemotron 3 Ultra | NVIDIA 生態,有免費版 |
AI 模型 API 怎麼選?六步分層路由落地 Runbook
建立任務分級:將 workload 分為跑量(閒聊/摘要/簡單補全)與難任務(複雜推理/高風險 Agent 決策)兩檔,禁止全量走單一模型。
跑量層預設 DeepSeek V4 Flash:輸入 $0.05–0.14/M,Agentic Coding 首選;備選 GLM 5.2 處理需更強規劃的開源場景。
難任務層保留 Claude Opus 5:分類/複雜推理消費份額領先;僅在 cheaper 模型連續失敗時升級,做「混合路由」。
接入 OpenRouter 統一端點:單一 Key 橫跨數百模型,適合技術預研與 A/B 對比;注意中國大陸存取延遲約 180–250ms。
把安全聲譽納入評分卡:本週 OpenAI 未發布模型沙盒逃逸事件發酵,企業 Agent 場景須做權限收斂與廠商安全紀錄審查。
7×24 穩定宿主:在雲端 Mac Mini 上執行 Agent 閘道與路由層,避免本機筆電休眠導致長程任務中斷;正式生產評估在地合規中轉。
curl https://openrouter.ai/api/v1/chat/completions \
-H "Authorization: Bearer $OPENROUTER_API_KEY" \
-d '{
"models": [
"deepseek/deepseek-v4-flash",
"anthropic/claude-opus-5"
],
"messages": [{"role": "user", "content": "Plan a multi-step refactor..."}]
}'
2026年8月 OpenRouter 趨勢預測與可引用硬數據
結合 7 月走勢,對 8 月做出以下判斷:
中國開源合計份額大概率繼續爬升,年內有望突破 50%,除非美國廠商重大降價——目前無此跡象。
「月度冠軍模型」寶座繼續易主:小米、DeepSeek、騰訊、智譜、MiniMax、月之暗面價格戰與迭代不會放緩。
Anthropic 或推更平價型號:Opus 5 已是兩個月內第四款旗艦,打法從單點突破轉向多價位段全覆蓋。
Kimi K3 的 1.4TB 權重 2–4 週內或現社群量化版,屆時中小團隊才能真正落地;現階段主要受益者為推理雲服務商。
安全與合規成新選型變數:美國國會「AI 終止開關法案」與白宮前沿模型預發布審查框架預計 8 月前落地。
中國廠商 Token 份額:約 46%(一年前 <2%),為過去 12 個月 AI 產業最陡峭的份額遷移曲線之一。
Hermes Agent 應用份額:約 45%,為 OpenRouter 平台最大單一應用。
DeepSeek vs GPT-5.5 價差:輸入定價差距約 35 倍($0.05–0.14/M vs ~$5/M),驅動跑量任務大規模遷移。
注意:榜單每日變動,發布前請用 openrouter.ai/rankings 核對最新 Top 10 順序。
7 月最值得記住的一句話:capability(能力)和 popularity(用量)正在分道揚鑣。比起糾結「誰是第一」,更值得投入精力的是建立評測體系與分層路由策略。
在本機筆電跑多模型 Agent 閘道,常面臨休眠斷連、記憶體不足與網路抖動;VPS 共享 CPU 又難以保證 Xcode 與 Metal 推理的穩定性。對於需要 7×24 執行 Hermes Agent、OpenClaw 或多模型 CI 流水線的團隊,MESHLAUNCH 的 Mac Mini 雲端裸金屬租用提供獨占 Apple Silicon、按天/週/月彈性下單,是更穩定的生產級宿主選擇。
截至 7 月 25 日,按單日 Token 用量,小米 Mimo V2.5 以 1.4 兆 Token/天 居首,其次為 DeepSeek V4 Flash(9439 億/天)和騰訊 Hy3(5900 億/天)。Kimi K3 新上榜排第 9,漲勢最猛。
不能。排行榜按 Token 用量排序,反映價格敏感型跑量任務。複雜推理上 Claude Sonnet 4.6 與 Opus 4.7 仍以各 13.5% 消費份額並列第一。詳見 租用價格頁了解穩定 Agent 宿主方案。
程式設計類任務優先測試 DeepSeek V4 Flash 與 GLM 5.2,把 Claude Opus 5 留給卡住的複雜步驟。OpenRouter 適合做技術預研沙盒;正式生產須評估延遲與在地合規方案。
建議將 OpenRouter/LiteLLM 路由層部署在 7×24 線上的雲端 Mac 上。區域與設定可參考 雲端說明中心,按專案週期選擇日租/月租節點。