OpenRouter API-Leitfaden
GPT, Claude & Gemini mit einem Key

Ein Endpoint · Dual-Routing · 5 Vorteile · Code · Fallback · Preise & BYOK

OpenRouter API-Leitfaden 2026
Wer für OpenAI, Anthropic und Google jeweils Konten, SDKs und Rechnungen pflegt, verliert messbar Zeit. OpenRouter bündelt 2026 über 70 Anbieter und 400+ Modelle hinter einem API-Key und einem OpenAI-kompatiblen Endpoint. Dieser Leitfaden liefert: ① Model- und Provider-Routing mit harten Zahlen; ② Vergleichstabelle gegen Direkt-APIs inkl. Ausschlusskriterien; ③ curl, Python, Node.js und OpenAI-SDK inkl. Streaming und Fallback; ④ Credits, BYOK und Gratis-Tier-Limits; ⑤ DSGVO-relevante Datenfluss-Hinweise für EU-Teams.
01

OpenRouter im Überblick: GPT, Claude, Gemini, DeepSeek — ein Key

OpenRouter ist ein LLM-API-Gateway. Ein Key, ein Endpoint (https://openrouter.ai/api/v1/chat/completions), OpenAI-kompatibles Schema. Auth: Authorization: Bearer $OPENROUTER_API_KEY. Modell-IDs: anbieter/modell — z. B. openai/gpt-4o, anthropic/claude-3.5-sonnet, google/gemini-2.5-pro, deepseek/deepseek-chat.

Bestehender OpenAI-SDK-Code: nur base_url und api_key tauschen. Modellwechsel = ein model-String.

Routing-EbeneEntscheidungSteuerfeld
Model RoutingWelches Modell antwortetmodel oder openrouter/auto
Provider RoutingWelcher Anbieter-Rechenclusterprovider-Objekt; Default: preis-gewichtete Auto-Auswahl

Integriertes Fallback: bei Rate Limit oder Fehler des Primäranbieters Wechsel über models-Array. 25+ Gratis-Modelle: ~50 Aufrufe/Tag ohne Aufladung; ab 10 $ Credits: 1.000/Tag, 20/Minute.

01

Multi-Account-Overhead: Pro Anbieter eigener Key, SDK, Billing — Abstimmungsaufwand skaliert linear mit Modellanzahl.

02

Failover selbst bauen: Circuit Breaker, Retries und Modellwechsel in App-Code — OpenRouter löst das auf Gateway-Ebene.

03

Latenz-Overhead: +10–80 ms Gateway-Hop — messbar in TTFT-Benchmarks, relevant für Echtzeit-UX.

04

DSGVO & Datensouveränität: US-Drittanbieter-Gateway als Zwischenstelle. Personenbezogene Daten erfordern AV-Vertrag, Datenfluss-Dokumentation; BYOK oder Direkt-API oft Pflicht.

05

Skalierungsgebühr: 5,5 % Aufladegebühr. Ab ~10.000 $/Monat lohnt Direktvertrag-Rechnung.

02

OpenRouter vs. direkte OpenAI- / Anthropic-API

DimensionDirekt-API je AnbieterOpenRouter-Gateway
Keys & KontenJe Anbieter separatEin Key, 400+ Modelle
SDK-MigrationAnbieter-spezifischOpenAI-kompatibel, 2 Zeilen
FailoverEigenimplementierungProvider + Model Fallback
AbrechnungMehrere DashboardsEin Dashboard, TTFT, Durchsatz
Token-PreisListenpreisKein Markup, Listenpreis
AufladegebührKeine5,5 % (mind. 0,80 $), Krypto +5 %
LatenzMinimal+10–80 ms
Exklusiv-FeaturesPrompt Caching, Batch, VertexTeilweise nicht verfügbar

Fünf messbare Vorteile: ① Ein Key — Migrationskosten nahe null; ② Cross-Provider-Failover; ③ zentralisierte Kostenanalyse; ④ kein Token-Markup; ⑤ ideal für A/B-Tests, Prototypen, Agenten unter mittlerem Volumen.

Wann OpenRouter nicht passt: Einzelmodell + sehr hohes Volumen (5,5 % Gebühr); Anthropic Prompt Caching, OpenAI Batch/Assistants, Google Vertex; Latenz <50 ms TTFT; DSGVO-Pflicht ohne US-Zwischenstelle. Suchintention „OpenRouter vs OpenAI API“ deckt genau diese Entscheidungsmatrix ab.

OpenRouter ersetzt keine offiziellen SDKs — es ist die pragmatische Schicht zwischen Multi-Modell-Bedarf und Direktanbindung.

03

Code-Beispiele: curl, Python, Node.js, OpenAI SDK

cURL
curl https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "anthropic/claude-3.5-sonnet",
    "messages": [
      { "role": "user", "content": "Erkläre Quantencomputing in einem Satz" }
    ]
  }'
Python (requests)
import requests, os

response = requests.post(
    url="https://openrouter.ai/api/v1/chat/completions",
    headers={
        "Authorization": f"Bearer {os.environ['OPENROUTER_API_KEY']}",
        "Content-Type": "application/json",
    },
    json={
        "model": "google/gemini-2.5-pro",
        "messages": [{"role": "user", "content": "Schreibe Quicksort in Python"}],
    },
)
print(response.json()["choices"][0]["message"]["content"])
Python (OpenAI SDK)
from openai import OpenAI
import os

client = OpenAI(
    base_url="https://openrouter.ai/api/v1",
    api_key=os.environ["OPENROUTER_API_KEY"],
)
completion = client.chat.completions.create(
    model="openai/gpt-4o",
    messages=[{"role": "user", "content": "Hello!"}],
    extra_headers={
        "HTTP-Referer": "https://meshlaunch.com",
        "X-Title": "MESHLAUNCH Blog Demo",
    },
)
print(completion.choices[0].message.content)
Node.js (OpenAI SDK)
import OpenAI from "openai";

const openai = new OpenAI({
  baseURL: "https://openrouter.ai/api/v1",
  apiKey: process.env.OPENROUTER_API_KEY,
});

const completion = await openai.chat.completions.create({
  model: "deepseek/deepseek-chat",
  messages: [{ role: "user", content: "Erkläre OpenRouter in einem Satz" }],
});
console.log(completion.choices[0].message.content);
Streaming
const stream = await openai.chat.completions.create({
  model: "anthropic/claude-3.5-sonnet",
  messages: [{ role: "user", content: "Schreibe ein kurzes Herbstgedicht" }],
  stream: true,
});
for await (const chunk of stream) {
  const content = chunk.choices[0]?.delta?.content;
  if (content) process.stdout.write(content);
}
Fallback-Konfiguration
{
  "model": "anthropic/claude-3.5-sonnet",
  "models": [
    "anthropic/claude-3.5-sonnet",
    "openai/gpt-4o",
    "google/gemini-2.5-pro"
  ],
  "route": "fallback",
  "messages": [{ "role": "user", "content": "Hello" }]
}

Modellliste abrufen: curl https://openrouter.ai/api/v1/models -H "Authorization: Bearer $OPENROUTER_API_KEY" — vor Produktions-Deploy Pflicht.

04

6-Schritte-Runbook: OpenRouter produktiv einbinden

01

Account & Key: openrouter.ai → GitHub/Google-Login → Settings → Keys → Key in OPENROUTER_API_KEY speichern.

02

Credits (optional): Gratis-Modelle ohne Aufladung. Paid: 5,5 % Gebühr. Ab 10 $: 1.000 Gratis-Aufrufe/Tag.

03

Smoke-Test: curl oder SDK mit openai/gpt-4o — HTTP 200 und Token-Response prüfen.

04

Streaming: stream: true für Chat-UI und Agent-Output.

05

Fallback-Kette: models + route: "fallback" — Claude-Limit → GPT-4o → Gemini.

06

Kosten & BYOK: Dashboard-Monitoring. BYOK: 0 % auf erste 1 Mio. Requests/Monat, danach 5 %.

05

Preisdaten, SEO und Deployment-Metriken

A

Token-Preise: Kein Markup. Aufladung 5,5 % (Krypto +5 %). Prompt/Completion-Preise pro Modell auf der Preisseite.

B

Gratis-Tier: 25+ Modelle. ~50/Tag ohne Credits. Ab 10 $: 1.000/Tag, 20/Min.

C

BYOK: Eigene Anbieter-Keys. 0 % bis 1 Mio. Requests/Monat.

DE-SEO-Keywords: OpenRouter API, OpenRouter Tutorial, OpenRouter vs OpenAI, OpenRouter Kosten, OpenRouter DSGVO — in Titel, Lead, H2, FAQ. Google.de und Bing.de abdecken.

Tracking: GSC Impressions/CTR je Sprachpfad; monatlicher Ranking-Check für „OpenRouter API“ und „OpenRouter Alternative“.

OpenRouter eignet sich für Prototypen, Multi-Modell-A/B und Agenten mit moderatem Volumen. Wer auf dem Mac Kilo Code oder Claude Code CLI 7×24 betreibt, stößt bei Consumer-Hardware an Swap-Limits; VPS ohne Apple-Metal beschleunigt Xcode- und Agent-Pipelines nicht. Für iOS-CI/CD und Always-on-Agenten ist MESHLAUNCH Mac-Mini-Cloud-Miete die stabilere Option: dediziertes Apple Silicon, 7×24, flexible Laufzeiten, BYOK-Kombination senkt API-Kosten weiter. Mietpreise · Hilfezentrum

Häufige Fragen

Token zum Listenpreis, kein Markup. Aufladung 5,5 % (mind. 0,80 $). 25+ Gratis-Modelle, ~50/Tag ohne Credits, ab 10 $: 1.000/Tag. Agent-Hosting: Mietpreise.

HTTPS-API erreichbar, Traffic über US-Gateway. Bei DSGVO-Pflicht: Datenfluss dokumentieren, BYOK oder Direkt-API prüfen.

70+ Anbieter, 400+ Modelle. GET /api/v1/models oder Modell-Rankings.

Nein — nur 5,5 % Aufladegebühr. BYOK: 0 % bis 1 Mio. Requests/Monat.

Gateway sieht Metadaten. Personenbezogene Daten: BYOK oder Direkt-API. Support: Hilfezentrum.