OpenRouter API Anleitung 2026: GPT, Claude, Gemini & 400+ Modelle mit einem Key
Wer parallel OpenAI-, Anthropic-, Google- und DeepSeek-Konten pflegt, zahlt nicht nur vier Rechnungen — er dokumentiert vier AVV-Ketten, vier Rate-Limit-Handler und vier SDK-Varianten. OpenRouter bündelt mehr als 400 Modelle hinter einem OpenAI-kompatiblen Endpoint. Dieser Leitfaden ist unabhängig auf Deutsch verfasst: präzise Routing-Spezifikationen, eine DSGVO-Entscheidungsmatrix gegen Direkt-APIs, lauffähige Codebeispiele und Produktionsmuster für Agenten auf OpenClaw — inklusive der Frage, warum ein 7×24-Remote-Mac mindestens so wichtig ist wie die Modellwahl.
1. Was ist OpenRouter?
Kurzfassung: OpenRouter ist ein aggregierendes LLM-Gateway. Anfragen gehen an https://openrouter.ai/api/v1/chat/completions mit Authorization: Bearer $OPENROUTER_API_KEY. Das Feld model trägt einen Slug wie anthropic/claude-sonnet-4 oder openai/gpt-4o; OpenRouter routet zur jeweiligen Anbieter-Infrastruktur. Request- und Response-Format entsprechen OpenAI Chat Completions — bestehender SDK-Code benötigt in der Regel nur neues base_url und neuen Key.
Pro Request trifft OpenRouter zwei Routing-Entscheidungen. Modell-Routing steuert das Feld model — oder openrouter/auto für automatische Auswahl. Provider-Routing wählt, welche Anbieter-Infrastruktur das Modell bedient; standardmäßig gewichtet OpenRouter nach Preis und Verfügbarkeit. Bei Rate-Limits oder 5xx-Fehlern kann das Gateway auf einen alternativen Provider oder ein Backup-Modell in Ihrer models-Liste umschalten, ohne dass Ihre Anwendung Retry-Logik implementiert.
Modell-IDs folgen dem Muster anbieter/modell. Stand Juli 2026: openai/gpt-4o, anthropic/claude-sonnet-4, google/gemini-2.5-pro, deepseek/deepseek-chat, meta-llama/llama-3.3-70b-instruct. Live-Katalog: GET /api/v1/models. Für reale Ausgabenverteilung siehe unseren Juni-2026-Rankings-Leitfaden und die Mai-Routing-Matrix.
2. OpenRouter vs. Direkt-API (OpenAI, Anthropic, Google)
OpenRouter ersetzt nicht jeden Enterprise-Vertrag — es ist eine Konsolidierungsschicht für Teams mit häufigem Modellwechsel, Multi-Modell-Agenten und integriertem Failover. Die Tabelle unten ist der Entscheidungsrahmen für deutsche Architekten, die „OpenRouter vs. OpenAI API“ oder „DSGVO OpenRouter“ recherchieren.
| Dimension | OpenRouter | Direkt-API (OpenAI / Anthropic / Google) |
|---|---|---|
| Kontoführung | Ein Konto, ein API-Key, ein Dashboard | Separate Registrierung, Abrechnung und Key-Rotation pro Anbieter |
| SDK-Kompatibilität | OpenAI-kompatibel; base_url und Key tauschen |
Native SDKs mit anbieterspezifischen Features (Batch API, Prompt Caching, Vertex-Tools) |
| Modellwechsel | Ein String in model; kein Adapter-Rewrite |
Client-Config, Auth und teils Message-Schema pro Anbieter neu |
| Failover | Integriertes Provider-Failover und optionale Modell-Fallback-Kette | Circuit Breaker und Retry selbst implementieren |
| Token-Preise | Anbieter-Listenpreis, kein Token-Markup; 5,5 % Gebühr auf Credit-Käufe | Direkte Rechnung; Volumenrabatte pro Anbieter verhandelbar |
| Latenz | Zusätzlicher Gateway-Hop, typisch 10–80 ms je nach Region | Theoretisch niedrigste Latenz zum Anbieter-Edge |
| DSGVO / Compliance | Traffic über US-Infrastruktur; AVV und Subprozessor-Liste prüfen | Anbieterspezifische DPA, regionale Endpunkte, VPC-Optionen (z. B. Vertex EU) |
| Best Fit | Prototypen, A/B-Tests, Multi-Modell-Agenten, Monatsausgaben unter ca. 5.000–10.000 USD | Single-Modell-Produktion in sehr hohem Volumen, strikte Datenresidenz, exklusive Anbieter-APIs |
3. Fünf Gründe, warum Entwickler zu OpenRouter wechseln
- Ein Key für alle Frontier-Modelle. Keine parallelen Integrationen für OpenAI, Anthropic, Google, DeepSeek und Open-Weight-Hosts. Onboarding = eine Umgebungsvariable.
- Nahezu null Migrationskosten. OpenAI-SDK auf OpenRouter-
base_urlzeigen, Key tauschen,modelauf vendor-prefixed Slug setzen — Message-Arrays, Tool Calls und Streaming bleiben identisch. - Automatisches Failover. Provider-Rate-Limits und transiente 5xx sind in Agent-Workloads normal. OpenRouter absorbiert diese Fehlerklasse vor Ihrer Anwendung.
- Einheitliche Abrechnung und Latenz-Dashboards. Ausgaben, Time-to-First-Token und Durchsatz über alle produktiv genutzten Modelle — nicht nur das Modell aus dem Architekturdiagramm von Q2.
- Kein Token-Markup und nutzbarer Free Tier. 25+ Modelle mit kostenlosem Tier für Benchmarks: Claude vs. Gemini vs. DeepSeek auf demselben Prompt ohne drei Herstellerkonten.
4. Wann Sie OpenRouter nicht nutzen sollten
- Single-Vendor-Skaleneffekte. Ab zehntausend USD/Monat auf einem Modell kann 5,5 % Credit-Gebühr plus Gateway-Latenz teurer sein als ein direkter Enterprise-Vertrag.
- Anbieter-exklusive Features. OpenAI Batch API, Anthropic Prompt-Caching-Abrechnung, Google Vertex Grounding — nur auf der nativen Control Plane.
- Strikte EU-Datenresidenz. Regulierte Gesundheits-, Finanz- oder Behörden-Workloads ohne US-Aggregator-Routing: Direkt-APIs mit vertraglicher Datenverarbeitung oder self-hosted Open Weights.
- Latenzkritische Echtzeitpfade. Sub-100-ms-Schleifen — zuerst Direkt-Endpunkte benchmarken.
- Unklare Logging-Policies bei Free/Preview-Modellen. Sensible Kundendaten nur über Anbieter mit geprüftem Retention-Modell routen.
Hybrid ist üblich: OpenRouter für Entwicklung und nicht-kritische Agent-Tiers; Direkt-Anthropic oder -OpenAI für den compliance-gebundenen Pfad.
5. Schritt für Schritt: OpenRouter API-Key
- Konto auf openrouter.ai anlegen. E-Mail oder OAuth. Separate OpenAI-/Anthropic-Konten für Gateway-Zugriff nicht nötig.
- Einstellungen → Keys → Create Key. Benennen nach Umgebung —
prod-agent-gateway,local-dev— für auditierbare Rotation. - Key sofort kopieren. Präfix
sk-or-, einmalige Anzeige. In Passwortmanager oderOPENROUTER_API_KEYin Shell-Profil. Niemals in Git. - Credits für kostenpflichtige Modelle. Free Tier funktioniert ohne Guthaben; paid Slugs liefern sonst Payment-Fehler. 5,5 % Bearbeitungsgebühr beim Aufladen beachten.
- Smoke-Test:
export OPENROUTER_API_KEY="sk-or-v1-..."
curl -s https://openrouter.ai/api/v1/chat/completions \
-H "Authorization: Bearer $OPENROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "openai/gpt-4o",
"messages": [{"role": "user", "content": "Antworte exakt: OpenRouter OK"}]
}' | jq -r '.choices[0].message.content'
6. Codebeispiele: cURL, Python, Node.js, OpenAI SDK
Gemeinsames Prinzip: Secrets in Umgebungsvariablen, optionale HTTP-Referer- und X-Title-Header für OpenRouter-Analytics, Modell-Slugs in Config-Dateien statt verstreut im Business-Code.
cURL
curl https://openrouter.ai/api/v1/chat/completions \
-H "Authorization: Bearer $OPENROUTER_API_KEY" \
-H "Content-Type: application/json" \
-H "HTTP-Referer: https://sftpmac.com" \
-H "X-Title: SFTPMAC OpenRouter Demo" \
-d '{
"model": "anthropic/claude-sonnet-4",
"messages": [
{"role": "user", "content": "Erkläre Quantencomputing in einem Satz."}
]
}'
Python (requests)
import os
import requests
response = requests.post(
url="https://openrouter.ai/api/v1/chat/completions",
headers={
"Authorization": f"Bearer {os.environ['OPENROUTER_API_KEY']}",
"Content-Type": "application/json",
"HTTP-Referer": "https://sftpmac.com",
"X-Title": "SFTPMAC OpenRouter Demo",
},
json={
"model": "google/gemini-2.5-pro",
"messages": [
{"role": "user", "content": "Schreibe Quicksort in Python in 15 Zeilen."}
],
},
timeout=60,
)
response.raise_for_status()
print(response.json()["choices"][0]["message"]["content"])
Node.js (OpenAI SDK)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://openrouter.ai/api/v1",
apiKey: process.env.OPENROUTER_API_KEY,
defaultHeaders: {
"HTTP-Referer": "https://sftpmac.com",
"X-Title": "SFTPMAC OpenRouter Demo",
},
});
const completion = await client.chat.completions.create({
model: "deepseek/deepseek-chat",
messages: [{ role: "user", content: "Erkläre OpenRouter in einem Satz." }],
});
console.log(completion.choices[0].message.content);
OpenAI SDK Drop-in (Python)
import os
from openai import OpenAI
client = OpenAI(
base_url="https://openrouter.ai/api/v1",
api_key=os.environ["OPENROUTER_API_KEY"],
)
completion = client.chat.completions.create(
model="openai/gpt-4o",
messages=[{"role": "user", "content": "Hallo von OpenRouter."}],
extra_headers={
"HTTP-Referer": "https://sftpmac.com",
"X-Title": "SFTPMAC OpenRouter Demo",
},
)
print(completion.choices[0].message.content)
Modellkatalog abfragen
curl -s https://openrouter.ai/api/v1/models \
-H "Authorization: Bearer $OPENROUTER_API_KEY" \
| jq '.data[] | {id: .id, pricing: .pricing}' | head
7. Streaming, Fallback-Konfiguration und Preise 2026
Streaming
stream: true wie beim nativen OpenAI SDK; OpenRouter leitet Server-Sent Events vom Upstream weiter.
const stream = await client.chat.completions.create({
model: "anthropic/claude-sonnet-4",
messages: [{ role: "user", content: "Schreibe ein kurzes Gedicht über den Herbst." }],
stream: true,
});
for await (const chunk of stream) {
const text = chunk.choices[0]?.delta?.content;
if (text) process.stdout.write(text);
}
Modell-Fallback für Hochverfügbarkeit
{
"model": "anthropic/claude-sonnet-4",
"models": [
"anthropic/claude-sonnet-4",
"openai/gpt-4o",
"google/gemini-2.5-pro"
],
"route": "fallback",
"messages": [{ "role": "user", "content": "Fasse diesen Vorfall zusammen." }]
}
OpenClaw-Nutzer spiegeln Primary- und Fallback-Slugs in openclaw.json und speichern Keys via SecretRef. Siehe 429- und Channels-Probe-Leitfaden.
Preistabelle 2026
| Kostenkomponente | Betrag | Hinweis |
|---|---|---|
| Kostenpflichtige Token | Anbieter-Listenpreis pro Mio. Input/Output | Kein OpenRouter-Markup; Live-Zahlen auf openrouter.ai/models |
| Credit-Kaufgebühr | 5,5 % (min. 0,80 USD) | Beim Aufladen, nicht pro Request |
| Krypto-Aufladung | ca. +5 % | Optional; Kartenzahlung nutzt Standardgebühr |
| Free Tier | 0 USD auf 25+ Modellen | ~50 Requests/Tag unfunded; ~1.000/Tag ab 10 USD+ bei 20 req/min |
| BYOK | Erste 1 Mio. Requests/Monat frei; danach 5 % | Eigene Hersteller-Keys bei bestehenden Enterprise-Preisen |
8. DSGVO- und Compliance-Rahmen für DACH-Teams
OpenRouter verarbeitet Prompts als Auftragsverarbeiter-ähnlicher Dienst in den USA. Für deutsche Unternehmen bedeutet das:
- Verarbeitungsverzeichnis (Art. 30 DSGVO): Zweck (Inferenz), Kategorien personenbezogener Daten (Prompt-Inhalte), Empfänger (OpenRouter + Upstream-Anbieter), Drittlandtransfer dokumentieren.
- AVV / DPA: OpenRouter-Privacy-Policy und Subprozessor-Liste gegen interne Anforderungen prüfen. Bei personenbezogenen Kundendaten oft BYOK mit EU-fähigen Direkt-Endpunkten oder Self-Hosting.
- Datenminimierung: Keine Roh-PII in Prompts; Pseudonymisierung vor Gateway-Routing. Logging in Agent-Workspaces auf Whitelist setzen — siehe Produktions-Security-Artikel im OpenClaw-Blog.
- Schrems II / TIA: US-Transfer erfordert ergänzende Maßnahmen oder vertragliche Garantien; reine OpenRouter-Nutzung ohne Bewertung reicht für Behörden- oder KRITIS-Kontexte selten.
- Audit-Trail: Getrennte API-Keys pro Umgebung, Rotation dokumentieren, OpenRouter-Dashboard-Exporte für FinOps und Compliance archivieren.
Faustregel: OpenRouter für nicht-personenbezogene Entwicklungs- und Benchmark-Workloads; Direkt-API oder On-Prem für produktive Kundendaten mit Art.-9-Sensibilität.
9. FAQ
Ist OpenRouter kostenlos? Ja für Experimente: 25+ Modelle mit Tageslimits, ~50 Requests/Tag ohne Guthaben, ~1.000/Tag ab 10 USD+ Guthaben bei 20 req/min.
Gibt es Token-Aufschläge? Nein. 5,5 % nur beim Credit-Kauf.
Ist OpenRouter sicher? Etablierter Aggregator — dennoch US-Infrastruktur. Compliance-Review vor regulierten Daten.
OpenRouter vs. LiteLLM? OpenRouter = gehostetes Gateway mit Abrechnung. LiteLLM = self-hosted Proxy. Zero-Ops → OpenRouter; On-Prem-Kontrolle → LiteLLM.
Modell wechseln ohne App-Rewrite? model-String ändern; optional models-Fallback-Array.
10. OpenRouter-Agenten auf einem Remote Mac betreiben
OpenRouter löst Modellzugang — nicht Gateway-Uptime. Laptop-Sleep, VPN-Abbrüche und Hintergrund-Kills erzeugen dieselbe Stille wie ein API-Ausfall, obwohl das Modell gesund ist.
Produktionsmuster: Apple Silicon mit Node 22, OPENROUTER_API_KEY in SecretRef, Primary-/Fallback-Slugs in openclaw.json, Gateway unter launchd, Workspace per SFTP/rsync. Bei Incidents: Gateway → Channels Probe → OpenRouter 429 → Modell-Swap — in einer seriellen Reihenfolge.
SFTPMAC Remote-Mac-Miete zielt auf dieses Profil: native macOS-Permission-Grenzen, 7×24-Konnektivität für Telegram/Slack/WeChat-Callbacks und APFS-freundliches Rollback. Ergänzen Sie diesen Leitfaden mit Modellauswahl-Guide und OpenClaw-Installations-Handbuch.