OpenRouter im Überblick: GPT, Claude, Gemini, DeepSeek — ein Key
OpenRouter ist ein LLM-API-Gateway. Ein Key, ein Endpoint (https://openrouter.ai/api/v1/chat/completions), OpenAI-kompatibles Schema. Auth: Authorization: Bearer $OPENROUTER_API_KEY. Modell-IDs: anbieter/modell — z. B. openai/gpt-4o, anthropic/claude-3.5-sonnet, google/gemini-2.5-pro, deepseek/deepseek-chat.
Bestehender OpenAI-SDK-Code: nur base_url und api_key tauschen. Modellwechsel = ein model-String.
| Routing-Ebene | Entscheidung | Steuerfeld |
|---|---|---|
| Model Routing | Welches Modell antwortet | model oder openrouter/auto |
| Provider Routing | Welcher Anbieter-Rechencluster | provider-Objekt; Default: preis-gewichtete Auto-Auswahl |
Integriertes Fallback: bei Rate Limit oder Fehler des Primäranbieters Wechsel über models-Array. 25+ Gratis-Modelle: ~50 Aufrufe/Tag ohne Aufladung; ab 10 $ Credits: 1.000/Tag, 20/Minute.
Multi-Account-Overhead: Pro Anbieter eigener Key, SDK, Billing — Abstimmungsaufwand skaliert linear mit Modellanzahl.
Failover selbst bauen: Circuit Breaker, Retries und Modellwechsel in App-Code — OpenRouter löst das auf Gateway-Ebene.
Latenz-Overhead: +10–80 ms Gateway-Hop — messbar in TTFT-Benchmarks, relevant für Echtzeit-UX.
DSGVO & Datensouveränität: US-Drittanbieter-Gateway als Zwischenstelle. Personenbezogene Daten erfordern AV-Vertrag, Datenfluss-Dokumentation; BYOK oder Direkt-API oft Pflicht.
Skalierungsgebühr: 5,5 % Aufladegebühr. Ab ~10.000 $/Monat lohnt Direktvertrag-Rechnung.
OpenRouter vs. direkte OpenAI- / Anthropic-API
| Dimension | Direkt-API je Anbieter | OpenRouter-Gateway |
|---|---|---|
| Keys & Konten | Je Anbieter separat | Ein Key, 400+ Modelle |
| SDK-Migration | Anbieter-spezifisch | OpenAI-kompatibel, 2 Zeilen |
| Failover | Eigenimplementierung | Provider + Model Fallback |
| Abrechnung | Mehrere Dashboards | Ein Dashboard, TTFT, Durchsatz |
| Token-Preis | Listenpreis | Kein Markup, Listenpreis |
| Aufladegebühr | Keine | 5,5 % (mind. 0,80 $), Krypto +5 % |
| Latenz | Minimal | +10–80 ms |
| Exklusiv-Features | Prompt Caching, Batch, Vertex | Teilweise nicht verfügbar |
Fünf messbare Vorteile: ① Ein Key — Migrationskosten nahe null; ② Cross-Provider-Failover; ③ zentralisierte Kostenanalyse; ④ kein Token-Markup; ⑤ ideal für A/B-Tests, Prototypen, Agenten unter mittlerem Volumen.
Wann OpenRouter nicht passt: Einzelmodell + sehr hohes Volumen (5,5 % Gebühr); Anthropic Prompt Caching, OpenAI Batch/Assistants, Google Vertex; Latenz <50 ms TTFT; DSGVO-Pflicht ohne US-Zwischenstelle. Suchintention „OpenRouter vs OpenAI API“ deckt genau diese Entscheidungsmatrix ab.
OpenRouter ersetzt keine offiziellen SDKs — es ist die pragmatische Schicht zwischen Multi-Modell-Bedarf und Direktanbindung.
Code-Beispiele: curl, Python, Node.js, OpenAI SDK
curl https://openrouter.ai/api/v1/chat/completions \
-H "Authorization: Bearer $OPENROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "anthropic/claude-3.5-sonnet",
"messages": [
{ "role": "user", "content": "Erkläre Quantencomputing in einem Satz" }
]
}'
import requests, os
response = requests.post(
url="https://openrouter.ai/api/v1/chat/completions",
headers={
"Authorization": f"Bearer {os.environ['OPENROUTER_API_KEY']}",
"Content-Type": "application/json",
},
json={
"model": "google/gemini-2.5-pro",
"messages": [{"role": "user", "content": "Schreibe Quicksort in Python"}],
},
)
print(response.json()["choices"][0]["message"]["content"])
from openai import OpenAI
import os
client = OpenAI(
base_url="https://openrouter.ai/api/v1",
api_key=os.environ["OPENROUTER_API_KEY"],
)
completion = client.chat.completions.create(
model="openai/gpt-4o",
messages=[{"role": "user", "content": "Hello!"}],
extra_headers={
"HTTP-Referer": "https://meshlaunch.com",
"X-Title": "MESHLAUNCH Blog Demo",
},
)
print(completion.choices[0].message.content)
import OpenAI from "openai";
const openai = new OpenAI({
baseURL: "https://openrouter.ai/api/v1",
apiKey: process.env.OPENROUTER_API_KEY,
});
const completion = await openai.chat.completions.create({
model: "deepseek/deepseek-chat",
messages: [{ role: "user", content: "Erkläre OpenRouter in einem Satz" }],
});
console.log(completion.choices[0].message.content);
const stream = await openai.chat.completions.create({
model: "anthropic/claude-3.5-sonnet",
messages: [{ role: "user", content: "Schreibe ein kurzes Herbstgedicht" }],
stream: true,
});
for await (const chunk of stream) {
const content = chunk.choices[0]?.delta?.content;
if (content) process.stdout.write(content);
}
{
"model": "anthropic/claude-3.5-sonnet",
"models": [
"anthropic/claude-3.5-sonnet",
"openai/gpt-4o",
"google/gemini-2.5-pro"
],
"route": "fallback",
"messages": [{ "role": "user", "content": "Hello" }]
}
Modellliste abrufen: curl https://openrouter.ai/api/v1/models -H "Authorization: Bearer $OPENROUTER_API_KEY" — vor Produktions-Deploy Pflicht.
6-Schritte-Runbook: OpenRouter produktiv einbinden
Account & Key: openrouter.ai → GitHub/Google-Login → Settings → Keys → Key in OPENROUTER_API_KEY speichern.
Credits (optional): Gratis-Modelle ohne Aufladung. Paid: 5,5 % Gebühr. Ab 10 $: 1.000 Gratis-Aufrufe/Tag.
Smoke-Test: curl oder SDK mit openai/gpt-4o — HTTP 200 und Token-Response prüfen.
Streaming: stream: true für Chat-UI und Agent-Output.
Fallback-Kette: models + route: "fallback" — Claude-Limit → GPT-4o → Gemini.
Kosten & BYOK: Dashboard-Monitoring. BYOK: 0 % auf erste 1 Mio. Requests/Monat, danach 5 %.
Preisdaten, SEO und Deployment-Metriken
Token-Preise: Kein Markup. Aufladung 5,5 % (Krypto +5 %). Prompt/Completion-Preise pro Modell auf der Preisseite.
Gratis-Tier: 25+ Modelle. ~50/Tag ohne Credits. Ab 10 $: 1.000/Tag, 20/Min.
BYOK: Eigene Anbieter-Keys. 0 % bis 1 Mio. Requests/Monat.
DE-SEO-Keywords: OpenRouter API, OpenRouter Tutorial, OpenRouter vs OpenAI, OpenRouter Kosten, OpenRouter DSGVO — in Titel, Lead, H2, FAQ. Google.de und Bing.de abdecken.
Tracking: GSC Impressions/CTR je Sprachpfad; monatlicher Ranking-Check für „OpenRouter API“ und „OpenRouter Alternative“.
OpenRouter eignet sich für Prototypen, Multi-Modell-A/B und Agenten mit moderatem Volumen. Wer auf dem Mac Kilo Code oder Claude Code CLI 7×24 betreibt, stößt bei Consumer-Hardware an Swap-Limits; VPS ohne Apple-Metal beschleunigt Xcode- und Agent-Pipelines nicht. Für iOS-CI/CD und Always-on-Agenten ist MESHLAUNCH Mac-Mini-Cloud-Miete die stabilere Option: dediziertes Apple Silicon, 7×24, flexible Laufzeiten, BYOK-Kombination senkt API-Kosten weiter. Mietpreise · Hilfezentrum
Token zum Listenpreis, kein Markup. Aufladung 5,5 % (mind. 0,80 $). 25+ Gratis-Modelle, ~50/Tag ohne Credits, ab 10 $: 1.000/Tag. Agent-Hosting: Mietpreise.
HTTPS-API erreichbar, Traffic über US-Gateway. Bei DSGVO-Pflicht: Datenfluss dokumentieren, BYOK oder Direkt-API prüfen.
70+ Anbieter, 400+ Modelle. GET /api/v1/models oder Modell-Rankings.
Nein — nur 5,5 % Aufladegebühr. BYOK: 0 % bis 1 Mio. Requests/Monat.
Gateway sieht Metadaten. Personenbezogene Daten: BYOK oder Direkt-API. Support: Hilfezentrum.