OpenRouter июль 2026
Кто реально выигрывает token-war?

Live data до 25.07 · Китай ~46% · volume ≠ quality · Hermes Agent 45% · август forecast

Доли вендоров в рейтинге LLM OpenRouter июль 2026
Если вы всё ещё выбираете LLM по вайбам из весны — вы уже отстали. OpenRouter — крупнейший neutral model router: рейтинг не про benchmarks, а про куда реально летят paid tokens. Гайд для dev'ов и tech leads, кто роутит через OpenRouter. Snapshot на 25 июля 2026: ① top-12 models + vendor share breakdown; ② dumbbell split volume vs spend; ③ app-layer (Hermes Agent, Kilo Code, roleplay traffic); ④ pricing matrix + scenario picks; ⑤ 5 август-трендов и 6-step tiered routing runbook.
01

Июльский рейтинг: Xiaomi #1, Китай ~46% token share

OpenRouter сортирует по token volume — это ground truth «что dev'ы реально шлют», не «кто умнее в leaderboard». На 25.07 top-3 daily: Xiaomi Mimo V2.5 (1,4T/day), DeepSeek V4 Flash (943,9B/day), Tencent Hy3 (590B/day). 7 из top-10 — китайские модели; US держат только Nemotron 3 Ultra (NVIDIA), Claude и Gemini.

#ModelVendorTokens/day30d cumulative
1Mimo V2.5Xiaomi1,4T31,2T
2DeepSeek V4 FlashDeepSeek943,9B23,6T
3Hy3Tencent590B23,4T
4Nemotron 3 Ultra (free)NVIDIA428,6B9T
5DeepSeek V4 ProDeepSeek413,7B11,6T
6GLM 5.2Z.ai316,7B13,3T
7MiniMax M3MiniMax262,5B15,1T
8Step 3.7 FlashStepFun204,8B5,9T
9Kimi K3Moonshot AI157,6B1,6T (new entry)
10Ling 3.0 FlashAnt InclusionAI128,3B417,3B
11Gemini 3 Flash PreviewGoogle106,3B4T
12Claude Sonnet 5Anthropic99,5B3,6T

Vendor rollup: китайские labs суммарно ~46% token share — год назад <2%. US big three (OpenAI, Anthropic, Google) скатились с ~70% до 30–36%. Драйвер — price arbitrage: DeepSeek V4 Flash input ~$0,05–0,14/M vs GPT-5.5 ~$5/M, ~35× spread.

01

DeepSeek — самый стабильный vendor: ~16–18% share, но monthly champion model меняется.

02

Xiaomi — max volatility: Mimo V2.5 качает vendor share между 8% и 18%.

03

Kimi K3 — fastest riser: debut в top-9, 1,4TB open weights — record dump.

04

Daily noise: Claude Opus 4.8 был top-10 на 24.07, на 25.07 вытеснен Ling 3.0 Flash.

05

Snapshot ≠ trend: важнее retention в top tier, чем один lucky day.

02

Volume ≠ quality: dumbbell market structure

Reality check: OpenRouter rank = token throughput, not IQ. Дешёвые fast models за high-traffic apps легко залетают в top — даже если complex reasoning так себе.

AxisBy token volumeBy spend (hard tasks)
LeadersCheap CN open weightsClaude Sonnet 4.6 / Opus 4.7 по 13,5%
Typical workloadChat, creative, roleplay, simple codegenComplex reasoning, enterprise agents, classification
Price logicBulk, fault-tolerant, 35× deltaClosed flagship $5/$25 pricing power
July proofMimo V2.5 1,4T/dayClaude Opus 5 FrontierBench v0.1: 43,3%

Рынок самосегментируется: cheap open weights жрут low-barrier tasks; closed flagship держат pricing power и security rep на hard workloads.

Spend by task type: general chat 35,7%, agent workflows 30,4%, code 26,5%, data processing 7,5%. Slice «classification/complex reasoning»: GPT-5.5 — 11,6%, #3; cheap models из volume chart тут почти invisible. Claude Opus 5 (drop 24.07) — 43,3% FrontierBench v0.1 (GPT-5.6 Sol 37,5%), pricing Opus tier $5/$25 per M.

ModelInput/MOutput/MSlot
DeepSeek V4 Flash$0,05–0,14$0,24–0,28$/perf king, agentic coding default
GLM 5.2$0,45$3,31Opus-like planning в open weights
MiniMax M3$0,10$1,21Long context + multimodal budget pick
Kimi K3~$3~$151,4TB weights, closed-tier capability
Claude Opus 5$5 (fast $10)$25 (fast $50)Closed SOTA, июль benchmark #1
03

App layer: coding agents rule, roleplay — hidden half

Model chart = «какой brain популярен»; app layer (openrouter.ai/apps) = что на нём реально крутят.

#AppTypeShare (~)
1Hermes AgentPersonal agent / CLI~45%
2Kilo CodeCoding agent~13%
3OpenClawUniversal agent~9%
4Claude CodeCoding agent~6%
5DescriptContent pipeline~4,5%
6–10pi, Lemonade, ISEKAI ZERO, Janitor AI, ClineAgent / roleplay1,7%–3,3%

Geek note: lineage Cline → Roo Code → Kilo Code — три форка одной code-agent ветки; «внук» Kilo Code уже обогнал предков. OpenRouter × a16z State of AI: creative roleplay >50% open-source volume — enterprise media это почти не освещает.

ScenarioPickWhy
Daily coding / agenticDeepSeek V4 FlashBest $/token, #2 по volume
Open planning qualityGLM 5.2Closest Opus-style planner в OSS
Hard reasoningClaude Opus 5 / Sonnet 5Spend share leader на tough tasks
Long context OSSKimi K31M context, 1,4TB weights (pre-quant)
Multimodal budgetMiniMax M3Image input без разорения
US full OSSNemotron 3 UltraNVIDIA stack, free tier exists
04

API routing: 6-step tiered runbook для prod

01

Task tiering: split bulk (chat/summary/simple completion) vs hard (reasoning/high-risk agent decisions). Single-model-for-all — anti-pattern.

02

Bulk tier default: DeepSeek V4 Flash — input $0,05–0,14/M; fallback GLM 5.2 когда нужен stronger open planning.

03

Hard tier: Claude Opus 5 reserved — escalate только после repeated cheap-tier failures; hybrid routing > full Opus burn.

04

OpenRouter unified endpoint — один key, сотни models, идеален для A/B; закладывайте ~180–250ms EU→US latency.

05

Security scorecard: sandbox escape incidents, vendor track record, least-privilege для agent tools; audit permissions перед prod.

06

7×24 host: agent gateway на cloud Mac, не на sleeping laptop; setup — центр помощи.

OpenRouter hybrid routing
curl https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -d '{
    "models": [
      "deepseek/deepseek-v4-flash",
      "anthropic/claude-opus-5"
    ],
    "messages": [{"role": "user", "content": "Plan a multi-step refactor..."}]
  }'
05

Август 2026: forecast + citable hard numbers

Extrapolation из июльского тренда:

1

CN open weights → ~50% — unless US vendors slash prices (no signal yet).

2

Monthly champion keeps rotating — price war между Xiaomi, DeepSeek, Tencent, Z.ai, MiniMax, Moonshot не остановится.

3

Anthropic budget tier likely — Opus 5 = 4th flagship за 2 месяца; multi-price coverage strategy.

4

Kimi K3 1,4TB: community quant за 2–4 недели — до тех пор выигрывают inference clouds.

5

Security/compliance = new selection variable — US «AI Kill Switch» bill + frontier pre-release review framework ожидаются до августа.

A

CN vendor token share: ~46% (12 мес назад <2%) — один из steepest share migrations в AI.

B

Hermes Agent app share: ~45% — largest single app на OpenRouter.

C

DeepSeek vs GPT-5.5 input price: ~35× gap ($0,05–0,14/M vs ~$5/M).

Heads up: rankings shift daily — перед deploy сверяйте openrouter.ai/rankings.

July takeaway: capability и popularity расходятся. ROI выше в eval framework + tier routing, чем в погоне за #1 snapshot.

Multi-model agent gateway на laptop = sleep disconnects, RAM pressure, network jitter. Для 7×24 Hermes Agent, OpenClaw или multi-model CI: MESHLAUNCH Mac Mini cloud bare-metal — dedicated Apple Silicon, day/week/month billing. Цены: аренда.

FAQ

На 25.07: Xiaomi Mimo V2.5 — 1,4T tokens/day, затем DeepSeek V4 Flash (943,9B) и Tencent Hy3 (590B). Kimi K3 — новый #9.

Нет — token volume ≠ intelligence. На hard tasks Claude Sonnet 4.6 и Opus 4.7 по 13,5% spend each. Stable agent host: цены аренды.

Coding: DeepSeek V4 Flash + GLM 5.2 first; Claude Opus 5 — только на stuck steps. OpenRouter = sandbox; prod — stable cloud + compliance review.

Deploy OpenRouter/LiteLLM router на cloud Mac. Region & config: центр помощи; day/month rental по длительности проекта.