OpenRouter 2026年7月大模型排行榜
誰在真正贏下這場 AI 流量戰爭?

真實付費 Token 流量 · 中國模型 46% 份額 · 用量≠品質 · 應用層 Agent 格局 · 8 月趨勢預測

OpenRouter 2026年7月大模型排行榜廠商份額圖
若你仍用數月前的印象判斷「哪個大模型最值得採用」,多半已經落後。OpenRouter 是全球最大的中立模型路由平台,排行榜不測跑分,只看開發者實際付費把請求送到哪家。本文面向透過 OpenRouter 做模型路由的開發者與技術決策者,依據截至 2026年7月25日 的最新資料,提供:① 7 月 Top 12 模型與廠商份額全景;② 用量與品質背離的「啞鈴型」市場結構;③ 應用層 Hermes Agent / Kilo Code / 角色扮演流量格局;④ 價格對照與場景選型矩陣;⑤ 8 月五大趨勢預測與六步分層路由 Runbook。
01

OpenRouter 7月排行榜怎麼看?小米登頂與中國模型 46% 份額

OpenRouter 排行榜按 Token 用量排序,本質上是「開發者實際付費在用什麼」,而非「哪個模型最聰明」。截至 7 月 25 日,單日 Token 用量前三名為 小米 Mimo V2.5(1.4 兆/天)、DeepSeek V4 Flash(9439 億/天)、騰訊 Hy3(5900 億/天)。前十名之中,中國廠商模型佔七席,僅 Nemotron 3 Ultra(NVIDIA)、Claude、Gemini 系列為美國陣營守住位置。

排名模型廠商單日 Token近30天累計
1Mimo V2.5小米1.4T31.2T
2DeepSeek V4 FlashDeepSeek943.9B23.6T
3Hy3騰訊590B23.4T
4Nemotron 3 Ultra(免費)NVIDIA428.6B9T
5DeepSeek V4 ProDeepSeek413.7B11.6T
6GLM 5.2智譜 Z.ai316.7B13.3T
7MiniMax M3MiniMax262.5B15.1T
8Step 3.7 Flash階躍星辰204.8B5.9T
9Kimi K3月之暗面157.6B1.6T(新上榜)
10Ling 3.0 Flash螞蟻 InclusionAI128.3B417.3B
11Gemini 3 Flash PreviewGoogle106.3B4T
12Claude Sonnet 5Anthropic99.5B3.6T

拉長到廠商總份額維度:中國廠商合計約 46% Token 份額,一年前不到 2%;美國三巨頭(OpenAI、Anthropic、Google)合計從去年年中約 70% 滑落至 30%–36%。這不是敘事驅動,而是價格邏輯——DeepSeek V4 Flash 輸入約 $0.05–0.14/M,GPT-5.5 約 $5/M,價差高達 35 倍

01

DeepSeek 廠商份額最穩:單一廠商約 16%–18%,多數統計中排第一,但「月度冠軍模型」常易主。

02

小米波動最大:Mimo V2.5 單模型暴漲帶動廠商份額 8%–18% 區間跳動。

03

Kimi K3 漲勢最猛:新上榜即進 Top 9,1.4TB 開源權重創紀錄。

04

榜單日波動大:Claude Opus 4.8 在 7/24 仍列第 10,7/25 被 Ling 3.0 Flash 擠出前 12。

05

看榜不能只看快照:比「誰是第一」更重要的是誰能持續留在前排。

02

大模型排行榜能代表品質嗎?用量與能力的啞鈴型分裂

必須先潑一盆冷水:OpenRouter 排的是 Token 用量,不是模型品質。便宜又快的模型掛在高流量應用背後,就能輕鬆刷到前列——哪怕複雜推理表現平平。

維度按 Token 用量榜按消費金額(難任務)
榜首格局中國開源廉價模型霸屏Claude Sonnet 4.6 / Opus 4.7 各 13.5% 並列第一
典型 workload閒聊、創意、角色扮演、簡單程式設計複雜推理、企業 Agent 規劃、高一致性分類
價格邏輯跑量、可容錯、35 倍價差驅動閉源旗艦維持 $5/$25 定價權
7月例證Mimo V2.5 單日 1.4TClaude Opus 5 FrontierBench v0.1 達 43.3%

市場正在自然分層:便宜的中國開源模型吃下海量低門檻任務,閉源旗艦仍把持難任務的定價權與安全聲譽護城河。

按任務類型統計的消費金額佔比:通用對話 35.7%、Agent 工作流 30.4%、程式碼 26.5%、資料處理 7.5%。但專看「分類/複雜推理」,GPT-5.5 以 11.6% 排第三,總量榜上的廉價開源模型在此維度幾乎「查無此模型」。7 月 24 日 Anthropic 發布的 Claude Opus 5 在 FrontierBench v0.1 拿下 43.3%(GPT-5.6 Sol 37.5%),價格維持 Opus 系列 $5/$25 per M——「我貴,但我值這個價」。

模型輸入/M輸出/M定位
DeepSeek V4 Flash$0.05–0.14$0.24–0.28性價比之王,Agentic Coding 首選
GLM 5.2$0.45$3.31開源裡類 Opus 規劃品質
MiniMax M3$0.10$1.21長上下文多模態預算之選
Kimi K3~$3~$151.4TB 開源權重,閉源級能力
Claude Opus 5$5(快速檔 $10)$25(快速檔 $50)閉源旗艦,7 月最強基準分
03

OpenRouter 應用層排行:程式設計 Agent 稱王與「看不見的」角色扮演流量

模型層排行榜反映「哪個大腦更受歡迎」;應用層(openrouter.ai/apps)才反映「這些大腦真正被用來做什麼」。

排名應用類型份額(約)
1Hermes Agent個人智慧體/CLI Agent~45%
2Kilo Code程式設計 Agent~13%
3OpenClaw通用 Agent~9%
4Claude Code程式設計 Agent~6%
5Descript內容生產~4.5%
6–10pi、Lemonade、ISEKAI ZERO、Janitor AI、ClineAgent / 角色扮演1.7%–3.3%

關鍵洞察:Cline → Roo Code → Kilo Code 是同一代碼血統的三次分叉,「孫子輩」Kilo Code 已反超祖輩。OpenRouter × a16z《State of AI》顯示,創意角色扮演場景貢獻開源模型總用量的一半以上——企業 AI 報導幾乎看不到這半壁江山。

場景推薦模型理由
日常程式設計 / Agentic CodingDeepSeek V4 Flash性價比最優,OpenRouter 用量第二
開源規劃品質GLM 5.2最接近 Opus 風格的開源規劃能力
複雜推理 / 分類Claude Opus 5 / Sonnet 5難任務消費份額領先
長上下文開源Kimi K31M 上下文,1.4TB 權重(量化前大廠可用)
多模態預算方案MiniMax M3圖像輸入性價比之選
美系全開源Nemotron 3 UltraNVIDIA 生態,有免費版
04

AI 模型 API 怎麼選?六步分層路由落地 Runbook

01

建立任務分級:將 workload 分為跑量(閒聊/摘要/簡單補全)與難任務(複雜推理/高風險 Agent 決策)兩檔,禁止全量走單一模型。

02

跑量層預設 DeepSeek V4 Flash:輸入 $0.05–0.14/M,Agentic Coding 首選;備選 GLM 5.2 處理需更強規劃的開源場景。

03

難任務層保留 Claude Opus 5:分類/複雜推理消費份額領先;僅在 cheaper 模型連續失敗時升級,做「混合路由」。

04

接入 OpenRouter 統一端點:單一 Key 橫跨數百模型,適合技術預研與 A/B 對比;注意中國大陸存取延遲約 180–250ms。

05

把安全聲譽納入評分卡:本週 OpenAI 未發布模型沙盒逃逸事件發酵,企業 Agent 場景須做權限收斂與廠商安全紀錄審查。

06

7×24 穩定宿主:在雲端 Mac Mini 上執行 Agent 閘道與路由層,避免本機筆電休眠導致長程任務中斷;正式生產評估在地合規中轉。

OpenRouter 混合路由範例
curl https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -d '{
    "models": [
      "deepseek/deepseek-v4-flash",
      "anthropic/claude-opus-5"
    ],
    "messages": [{"role": "user", "content": "Plan a multi-step refactor..."}]
  }'
05

2026年8月 OpenRouter 趨勢預測與可引用硬數據

結合 7 月走勢,對 8 月做出以下判斷:

1

中國開源合計份額大概率繼續爬升,年內有望突破 50%,除非美國廠商重大降價——目前無此跡象。

2

「月度冠軍模型」寶座繼續易主:小米、DeepSeek、騰訊、智譜、MiniMax、月之暗面價格戰與迭代不會放緩。

3

Anthropic 或推更平價型號:Opus 5 已是兩個月內第四款旗艦,打法從單點突破轉向多價位段全覆蓋。

4

Kimi K3 的 1.4TB 權重 2–4 週內或現社群量化版,屆時中小團隊才能真正落地;現階段主要受益者為推理雲服務商。

5

安全與合規成新選型變數:美國國會「AI 終止開關法案」與白宮前沿模型預發布審查框架預計 8 月前落地。

A

中國廠商 Token 份額:46%(一年前 <2%),為過去 12 個月 AI 產業最陡峭的份額遷移曲線之一。

B

Hermes Agent 應用份額:45%,為 OpenRouter 平台最大單一應用。

C

DeepSeek vs GPT-5.5 價差:輸入定價差距約 35 倍($0.05–0.14/M vs ~$5/M),驅動跑量任務大規模遷移。

注意:榜單每日變動,發布前請用 openrouter.ai/rankings 核對最新 Top 10 順序。

7 月最值得記住的一句話:capability(能力)和 popularity(用量)正在分道揚鑣。比起糾結「誰是第一」,更值得投入精力的是建立評測體系與分層路由策略。

在本機筆電跑多模型 Agent 閘道,常面臨休眠斷連、記憶體不足與網路抖動;VPS 共享 CPU 又難以保證 Xcode 與 Metal 推理的穩定性。對於需要 7×24 執行 Hermes Agent、OpenClaw 或多模型 CI 流水線的團隊,MESHLAUNCH 的 Mac Mini 雲端裸金屬租用提供獨占 Apple Silicon、按天/週/月彈性下單,是更穩定的生產級宿主選擇。

常見問題

截至 7 月 25 日,按單日 Token 用量,小米 Mimo V2.5 以 1.4 兆 Token/天 居首,其次為 DeepSeek V4 Flash(9439 億/天)和騰訊 Hy3(5900 億/天)。Kimi K3 新上榜排第 9,漲勢最猛。

不能。排行榜按 Token 用量排序,反映價格敏感型跑量任務。複雜推理上 Claude Sonnet 4.6 與 Opus 4.7 仍以各 13.5% 消費份額並列第一。詳見 租用價格頁了解穩定 Agent 宿主方案。

程式設計類任務優先測試 DeepSeek V4 FlashGLM 5.2,把 Claude Opus 5 留給卡住的複雜步驟。OpenRouter 適合做技術預研沙盒;正式生產須評估延遲與在地合規方案。

建議將 OpenRouter/LiteLLM 路由層部署在 7×24 線上的雲端 Mac 上。區域與設定可參考 雲端說明中心,按專案週期選擇日租/月租節點。