OpenRouter Juli 2026
Wer gewinnt den Token-Krieg?

Echtdaten bis 25.7. · China ~46% · Volumen ≠ Qualität · Hermes Agent 45% · August-Prognosen

OpenRouter KI-Modell-Rankings Juli 2026 Anbieteranteile
Wer noch mit Juni-2026-Annahmen über „das beste Modell“ entscheidet, liegt bereits falsch. OpenRouter ist die größte neutrale Modell-Routing-Plattform — das Ranking misst keine Benchmarks, sondern bezahlte Token-Flüsse. Dieser Datencheck für Entwickler und Tech-Entscheider basiert auf Stand 25. Juli 2026: ① Top-12-Modelle und Anbieteranteile; ② die „Hantel“-Spaltung Volumen vs. Qualität; ③ App-Layer Hermes Agent / Kilo Code / Roleplay-Traffic; ④ Preisvergleich und Szenario-Matrix; ⑤ fünf August-Trends plus Sechs-Schritte-Routing-Runbook — mit DSGVO-Relevanz bei Enterprise-Auswahl.
01

Juli-Ranking: Xiaomi an der Spitze, China ~46% Token-Anteil

OpenRouter sortiert nach Token-Volumen — das ist der Marktpreis für „was Entwickler wirklich schicken“. Stand 25.7. führen Xiaomi Mimo V2.5 (1,4T/Tag), DeepSeek V4 Flash (943,9B/Tag) und Tencent Hy3 (590B/Tag). Sieben der Top-10-Modelle stammen aus China; nur Nemotron 3 Ultra (NVIDIA), Claude und Gemini halten US-Positionen.

RangModellAnbieterToken/Tag30-Tage-Summe
1Mimo V2.5Xiaomi1,4T31,2T
2DeepSeek V4 FlashDeepSeek943,9B23,6T
3Hy3Tencent590B23,4T
4Nemotron 3 Ultra (kostenlos)NVIDIA428,6B9T
5DeepSeek V4 ProDeepSeek413,7B11,6T
6GLM 5.2Z.ai316,7B13,3T
7MiniMax M3MiniMax262,5B15,1T
8Step 3.7 FlashStepFun204,8B5,9T
9Kimi K3Moonshot AI157,6B1,6T (neu)
10Ling 3.0 FlashAnt InclusionAI128,3B417,3B
11Gemini 3 Flash PreviewGoogle106,3B4T
12Claude Sonnet 5Anthropic99,5B3,6T

Auf Anbieter-Ebene: chinesische Labs zusammen ~46% Token-Anteil — vor einem Jahr unter 2%. US-Trio (OpenAI, Anthropic, Google) fiel von ~70% auf 30–36%. Treiber ist Preislogik: DeepSeek V4 Flash Input ~$0,05–0,14/M vs. GPT-5.5 ~$5/M — Faktor ~35.

01

DeepSeek stabil #1 unter Anbietern: ~16–18% Anteil, aber Monats-Champion-Modell wechselt häufig.

02

Xiaomi höchste Volatilität: Mimo V2.5 treibt Anbieteranteil zwischen 8% und 18%.

03

Kimi K3 stärkster Aufsteiger: Neu in Top 9, 1,4TB Open Weights — Rekord.

04

Tages-Schwankungen: Claude Opus 4.8 noch Top-10 am 24.7., am 25.7. von Ling 3.0 Flash verdrängt.

05

Snapshot ≠ Trend: Entscheidend ist Dauer in der Spitzengruppe, nicht ein einzelner Tag.

02

Volumen ≠ Qualität: die Hantel-Struktur des Marktes

Klarstellung: OpenRouter rankt Token, nicht Intelligenz. Günstige, schnelle Modelle hinter High-Traffic-Apps landen oben — auch wenn komplexe Reasoning-Tasks schwächer sind.

DimensionNach Token-VolumenNach Ausgaben (schwere Tasks)
SpitzeGünstige China-Open-WeightsClaude Sonnet 4.6 / Opus 4.7 je 13,5%
Typische WorkloadsChat, Kreativ, Roleplay, einfaches CodingKomplexes Reasoning, Enterprise-Agenten, Klassifikation
PreislogikMassenverkehr, fehlertolerant, 35× SpreadClosed-Source-Flaggschiffe $5/$25
Juli-BelegMimo V2.5 1,4T/TagClaude Opus 5 FrontierBench v0.1: 43,3%

Der Markt teilt sich: günstige Open Weights fressen Low-Barrier-Tasks; Closed-Source-Flaggschiffe halten Preissetzung und Sicherheitsreputation bei schweren Aufgaben.

Ausgaben nach Task-Typ: Alltagsdialog 35,7%, Agent-Workflows 30,4%, Code 26,5%, Datenverarbeitung 7,5%. Bei Klassifikation/Reasoning: GPT-5.5 11,6% Rang 3 — Billig-Modelle aus dem Volumen-Ranking fehlen hier fast. Claude Opus 5 (24.7. Release) erreicht 43,3% FrontierBench v0.1 (GPT-5.6 Sol 37,5%), Preis Opus-Serie $5/$25 per M.

Für EU-Enterprise zählt zusätzlich: Prompt-Inhalte über US-Router können DSGVO Art. 44 ff. auslösen — Auftragsverarbeitung, AVV und Datenresidenz müssen in die Modell-Scorecard. Self-Hosting oder EU-Region-Hosting reduziert Transfer-Risiko.

ModellInput/MOutput/MPositionierung
DeepSeek V4 Flash$0,05–0,14$0,24–0,28Preis-Leistung, Agentic Coding
GLM 5.2$0,45$3,31Opus-ähnliche Planung, Open Weights
MiniMax M3$0,10$1,21Long Context, Multimodal Budget
Kimi K3~$3~$151,4TB Open Weights, Closed-Level
Claude Opus 5$5 (Fast $10)$25 (Fast $50)Closed Flagship, Juli-Benchmark #1
03

App-Layer: Hermes Agent dominiert, Roleplay unsichtbar groß

Modell-Rankings zeigen „welches Gehirn“; der App-Layer (openrouter.ai/apps) zeigt wofür es genutzt wird.

RangAppTypAnteil (ca.)
1Hermes AgentPersönlicher Agent / CLI~45%
2Kilo CodeCoding-Agent~13%
3OpenClawUniversal-Agent~9%
4Claude CodeCoding-Agent~6%
5DescriptContent-Produktion~4,5%
6–10pi, Lemonade, ISEKAI ZERO, Janitor AI, ClineAgent / Roleplay1,7%–3,3%

Datenpunkt: Cline → Roo Code → Kilo Code — drei Generationen einer Code-Linie; Kilo Code hat die Vorfahren überholt. OpenRouter × a16z „State of AI“: kreatives Roleplay trägt >50% des Open-Source-Volumens — in Enterprise-Berichten kaum sichtbar.

SzenarioEmpfohlenes ModellBegründung
Alltags-Coding / AgenticDeepSeek V4 FlashBestes Preis-Leistungs-Verhältnis, #2 Volumen
Open-Source-PlanungGLM 5.2Opus-nahe Planungsqualität
Schweres ReasoningClaude Opus 5 / Sonnet 5Führend bei Ausgabenanteil
Long Context OpenKimi K31M Context, 1,4TB Weights
Multimodal BudgetMiniMax M3Bild-Input kosteneffizient
US Open WeightsNemotron 3 UltraNVIDIA-Stack, Gratis-Tier
04

API-Routing: Sechs-Schritte-Runbook für Produktion

01

Task-Tiers definieren: Massen-Workloads (Chat, Summary, einfache Completions) vs. schwere Tasks (Reasoning, High-Risk-Agenten). Kein Single-Model für alles.

02

Massen-Layer: DeepSeek V4 Flash default — Input $0,05–0,14/M; GLM 5.2 als Open-Source-Upgrade bei Planungsbedarf.

03

Schwer-Layer: Claude Opus 5 reservieren — nur bei wiederholten Failures des günstigen Tiers; Hybrid-Routing statt Voll-Opus.

04

OpenRouter als Unified Endpoint — ein Key, hunderte Modelle, ideal für A/B; Latenz EU→US ~180–250ms einplanen.

05

DSGVO und Sicherheit in Scorecard: AVV, Datenresidenz, Vendor-Sicherheitshistorie; Sandbox-Escape-Vorfälle bei Enterprise-Agenten berücksichtigen; Berechtigungen minimieren.

06

7×24-Host für Gateway: Agent-Router auf Cloud-Mac statt schlafendem Laptop; Produktion mit EU-konformem Relay evaluieren — Setup im Hilfezentrum.

OpenRouter Hybrid-Routing
curl https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -d '{
    "models": [
      "deepseek/deepseek-v4-flash",
      "anthropic/claude-opus-5"
    ],
    "messages": [{"role": "user", "content": "Plan a multi-step refactor..."}]
  }'
05

August 2026: Prognosen und zitierbare Hard Data

Aus Juli-Trend abgeleitete August-Szenarien:

1

China Open Weights Richtung 50% — ohne US-Preissenkung (derzeit kein Signal).

2

Monats-Champion wechselt weiter — Xiaomi, DeepSeek, Tencent, Z.ai, MiniMax, Moonshot im Preiskampf.

3

Anthropic günstigere Tiers möglich — Opus 5 ist viertes Flagship in zwei Monaten; Multi-Tier-Strategie.

4

Kimi K3 1,4TB: Community-Quantisierung in 2–4 Wochen — bis dahin vor allem Inference-Clouds.

5

Sicherheit & Compliance als Auswahlfaktor — US „AI Kill Switch“-Gesetz und Frontier-Review-Framework voraussichtlich vor August.

A

China Token-Anteil: ~46% (vor 12 Monaten <2%) — steilste Verschiebung im AI-Markt.

B

Hermes Agent App-Anteil: ~45% — größte Einzel-App auf OpenRouter.

C

DeepSeek vs. GPT-5.5 Preis: Input-Faktor ~35× ($0,05–0,14/M vs. ~$5/M).

Hinweis: Rankings ändern sich täglich — vor Deployment openrouter.ai/rankings prüfen.

Juli-Kernbotschaft: Capability und Popularity divergieren. Wertvoller als „Wer ist #1?“ sind Evaluations-Framework und Tier-Routing.

Multi-Modell-Agent-Gateways auf Laptops scheitern an Sleep, RAM und Netz. Für 7×24 Hermes Agent, OpenClaw oder Multi-Modell-CI: MESHLAUNCH Mac Mini Cloud-Bare-Metal — dediziertes Apple Silicon, flexibel tag-/wochen-/monatsweise. Preise: Mietpreise.

FAQ

Stand 25.7.: Xiaomi Mimo V2.5 mit 1,4T Token/Tag, dann DeepSeek V4 Flash (943,9B) und Tencent Hy3 (590B). Kimi K3 neu auf Platz 9.

Nein — Token-Volumen ≠ Intelligenz. Bei schweren Tasks führen Claude Sonnet 4.6 und Opus 4.7 mit je 13,5% Ausgabenanteil. Stabile Agent-Hosts: Mietpreise.

Coding: DeepSeek V4 Flash und GLM 5.2 zuerst; Claude Opus 5 nur für blockierte Schritte. OpenRouter als Sandbox; Produktion mit DSGVO-konformem Setup.

OpenRouter/LiteLLM auf 7×24 Cloud-Mac deployen. Region und Konfiguration: Hilfezentrum; Tages-/Monatsmiete nach Projektlaufzeit.