OpenRouter Unified-API-Gateway: ein Key für GPT, Claude, Gemini und über 400 LLM-Modelle

OpenRouter API Anleitung 2026: GPT, Claude, Gemini & 400+ Modelle mit einem Key

Wer parallel OpenAI-, Anthropic-, Google- und DeepSeek-Konten pflegt, zahlt nicht nur vier Rechnungen — er dokumentiert vier AVV-Ketten, vier Rate-Limit-Handler und vier SDK-Varianten. OpenRouter bündelt mehr als 400 Modelle hinter einem OpenAI-kompatiblen Endpoint. Dieser Leitfaden ist unabhängig auf Deutsch verfasst: präzise Routing-Spezifikationen, eine DSGVO-Entscheidungsmatrix gegen Direkt-APIs, lauffähige Codebeispiele und Produktionsmuster für Agenten auf OpenClaw — inklusive der Frage, warum ein 7×24-Remote-Mac mindestens so wichtig ist wie die Modellwahl.

1. Was ist OpenRouter?

Kurzfassung: OpenRouter ist ein aggregierendes LLM-Gateway. Anfragen gehen an https://openrouter.ai/api/v1/chat/completions mit Authorization: Bearer $OPENROUTER_API_KEY. Das Feld model trägt einen Slug wie anthropic/claude-sonnet-4 oder openai/gpt-4o; OpenRouter routet zur jeweiligen Anbieter-Infrastruktur. Request- und Response-Format entsprechen OpenAI Chat Completions — bestehender SDK-Code benötigt in der Regel nur neues base_url und neuen Key.

Pro Request trifft OpenRouter zwei Routing-Entscheidungen. Modell-Routing steuert das Feld model — oder openrouter/auto für automatische Auswahl. Provider-Routing wählt, welche Anbieter-Infrastruktur das Modell bedient; standardmäßig gewichtet OpenRouter nach Preis und Verfügbarkeit. Bei Rate-Limits oder 5xx-Fehlern kann das Gateway auf einen alternativen Provider oder ein Backup-Modell in Ihrer models-Liste umschalten, ohne dass Ihre Anwendung Retry-Logik implementiert.

Modell-IDs folgen dem Muster anbieter/modell. Stand Juli 2026: openai/gpt-4o, anthropic/claude-sonnet-4, google/gemini-2.5-pro, deepseek/deepseek-chat, meta-llama/llama-3.3-70b-instruct. Live-Katalog: GET /api/v1/models. Für reale Ausgabenverteilung siehe unseren Juni-2026-Rankings-Leitfaden und die Mai-Routing-Matrix.

2. OpenRouter vs. Direkt-API (OpenAI, Anthropic, Google)

OpenRouter ersetzt nicht jeden Enterprise-Vertrag — es ist eine Konsolidierungsschicht für Teams mit häufigem Modellwechsel, Multi-Modell-Agenten und integriertem Failover. Die Tabelle unten ist der Entscheidungsrahmen für deutsche Architekten, die „OpenRouter vs. OpenAI API“ oder „DSGVO OpenRouter“ recherchieren.

Dimension OpenRouter Direkt-API (OpenAI / Anthropic / Google)
Kontoführung Ein Konto, ein API-Key, ein Dashboard Separate Registrierung, Abrechnung und Key-Rotation pro Anbieter
SDK-Kompatibilität OpenAI-kompatibel; base_url und Key tauschen Native SDKs mit anbieterspezifischen Features (Batch API, Prompt Caching, Vertex-Tools)
Modellwechsel Ein String in model; kein Adapter-Rewrite Client-Config, Auth und teils Message-Schema pro Anbieter neu
Failover Integriertes Provider-Failover und optionale Modell-Fallback-Kette Circuit Breaker und Retry selbst implementieren
Token-Preise Anbieter-Listenpreis, kein Token-Markup; 5,5 % Gebühr auf Credit-Käufe Direkte Rechnung; Volumenrabatte pro Anbieter verhandelbar
Latenz Zusätzlicher Gateway-Hop, typisch 10–80 ms je nach Region Theoretisch niedrigste Latenz zum Anbieter-Edge
DSGVO / Compliance Traffic über US-Infrastruktur; AVV und Subprozessor-Liste prüfen Anbieterspezifische DPA, regionale Endpunkte, VPC-Optionen (z. B. Vertex EU)
Best Fit Prototypen, A/B-Tests, Multi-Modell-Agenten, Monatsausgaben unter ca. 5.000–10.000 USD Single-Modell-Produktion in sehr hohem Volumen, strikte Datenresidenz, exklusive Anbieter-APIs

3. Fünf Gründe, warum Entwickler zu OpenRouter wechseln

  1. Ein Key für alle Frontier-Modelle. Keine parallelen Integrationen für OpenAI, Anthropic, Google, DeepSeek und Open-Weight-Hosts. Onboarding = eine Umgebungsvariable.
  2. Nahezu null Migrationskosten. OpenAI-SDK auf OpenRouter-base_url zeigen, Key tauschen, model auf vendor-prefixed Slug setzen — Message-Arrays, Tool Calls und Streaming bleiben identisch.
  3. Automatisches Failover. Provider-Rate-Limits und transiente 5xx sind in Agent-Workloads normal. OpenRouter absorbiert diese Fehlerklasse vor Ihrer Anwendung.
  4. Einheitliche Abrechnung und Latenz-Dashboards. Ausgaben, Time-to-First-Token und Durchsatz über alle produktiv genutzten Modelle — nicht nur das Modell aus dem Architekturdiagramm von Q2.
  5. Kein Token-Markup und nutzbarer Free Tier. 25+ Modelle mit kostenlosem Tier für Benchmarks: Claude vs. Gemini vs. DeepSeek auf demselben Prompt ohne drei Herstellerkonten.

4. Wann Sie OpenRouter nicht nutzen sollten

  • Single-Vendor-Skaleneffekte. Ab zehntausend USD/Monat auf einem Modell kann 5,5 % Credit-Gebühr plus Gateway-Latenz teurer sein als ein direkter Enterprise-Vertrag.
  • Anbieter-exklusive Features. OpenAI Batch API, Anthropic Prompt-Caching-Abrechnung, Google Vertex Grounding — nur auf der nativen Control Plane.
  • Strikte EU-Datenresidenz. Regulierte Gesundheits-, Finanz- oder Behörden-Workloads ohne US-Aggregator-Routing: Direkt-APIs mit vertraglicher Datenverarbeitung oder self-hosted Open Weights.
  • Latenzkritische Echtzeitpfade. Sub-100-ms-Schleifen — zuerst Direkt-Endpunkte benchmarken.
  • Unklare Logging-Policies bei Free/Preview-Modellen. Sensible Kundendaten nur über Anbieter mit geprüftem Retention-Modell routen.

Hybrid ist üblich: OpenRouter für Entwicklung und nicht-kritische Agent-Tiers; Direkt-Anthropic oder -OpenAI für den compliance-gebundenen Pfad.

5. Schritt für Schritt: OpenRouter API-Key

  1. Konto auf openrouter.ai anlegen. E-Mail oder OAuth. Separate OpenAI-/Anthropic-Konten für Gateway-Zugriff nicht nötig.
  2. Einstellungen → Keys → Create Key. Benennen nach Umgebung — prod-agent-gateway, local-dev — für auditierbare Rotation.
  3. Key sofort kopieren. Präfix sk-or-, einmalige Anzeige. In Passwortmanager oder OPENROUTER_API_KEY in Shell-Profil. Niemals in Git.
  4. Credits für kostenpflichtige Modelle. Free Tier funktioniert ohne Guthaben; paid Slugs liefern sonst Payment-Fehler. 5,5 % Bearbeitungsgebühr beim Aufladen beachten.
  5. Smoke-Test:
export OPENROUTER_API_KEY="sk-or-v1-..."

curl -s https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "openai/gpt-4o",
    "messages": [{"role": "user", "content": "Antworte exakt: OpenRouter OK"}]
  }' | jq -r '.choices[0].message.content'

6. Codebeispiele: cURL, Python, Node.js, OpenAI SDK

Gemeinsames Prinzip: Secrets in Umgebungsvariablen, optionale HTTP-Referer- und X-Title-Header für OpenRouter-Analytics, Modell-Slugs in Config-Dateien statt verstreut im Business-Code.

cURL

curl https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -H "HTTP-Referer: https://sftpmac.com" \
  -H "X-Title: SFTPMAC OpenRouter Demo" \
  -d '{
    "model": "anthropic/claude-sonnet-4",
    "messages": [
      {"role": "user", "content": "Erkläre Quantencomputing in einem Satz."}
    ]
  }'

Python (requests)

import os
import requests

response = requests.post(
    url="https://openrouter.ai/api/v1/chat/completions",
    headers={
        "Authorization": f"Bearer {os.environ['OPENROUTER_API_KEY']}",
        "Content-Type": "application/json",
        "HTTP-Referer": "https://sftpmac.com",
        "X-Title": "SFTPMAC OpenRouter Demo",
    },
    json={
        "model": "google/gemini-2.5-pro",
        "messages": [
            {"role": "user", "content": "Schreibe Quicksort in Python in 15 Zeilen."}
        ],
    },
    timeout=60,
)
response.raise_for_status()
print(response.json()["choices"][0]["message"]["content"])

Node.js (OpenAI SDK)

import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://openrouter.ai/api/v1",
  apiKey: process.env.OPENROUTER_API_KEY,
  defaultHeaders: {
    "HTTP-Referer": "https://sftpmac.com",
    "X-Title": "SFTPMAC OpenRouter Demo",
  },
});

const completion = await client.chat.completions.create({
  model: "deepseek/deepseek-chat",
  messages: [{ role: "user", content: "Erkläre OpenRouter in einem Satz." }],
});

console.log(completion.choices[0].message.content);

OpenAI SDK Drop-in (Python)

import os
from openai import OpenAI

client = OpenAI(
    base_url="https://openrouter.ai/api/v1",
    api_key=os.environ["OPENROUTER_API_KEY"],
)

completion = client.chat.completions.create(
    model="openai/gpt-4o",
    messages=[{"role": "user", "content": "Hallo von OpenRouter."}],
    extra_headers={
        "HTTP-Referer": "https://sftpmac.com",
        "X-Title": "SFTPMAC OpenRouter Demo",
    },
)
print(completion.choices[0].message.content)

Modellkatalog abfragen

curl -s https://openrouter.ai/api/v1/models \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  | jq '.data[] | {id: .id, pricing: .pricing}' | head

7. Streaming, Fallback-Konfiguration und Preise 2026

Streaming

stream: true wie beim nativen OpenAI SDK; OpenRouter leitet Server-Sent Events vom Upstream weiter.

const stream = await client.chat.completions.create({
  model: "anthropic/claude-sonnet-4",
  messages: [{ role: "user", content: "Schreibe ein kurzes Gedicht über den Herbst." }],
  stream: true,
});

for await (const chunk of stream) {
  const text = chunk.choices[0]?.delta?.content;
  if (text) process.stdout.write(text);
}

Modell-Fallback für Hochverfügbarkeit

{
  "model": "anthropic/claude-sonnet-4",
  "models": [
    "anthropic/claude-sonnet-4",
    "openai/gpt-4o",
    "google/gemini-2.5-pro"
  ],
  "route": "fallback",
  "messages": [{ "role": "user", "content": "Fasse diesen Vorfall zusammen." }]
}

OpenClaw-Nutzer spiegeln Primary- und Fallback-Slugs in openclaw.json und speichern Keys via SecretRef. Siehe 429- und Channels-Probe-Leitfaden.

Preistabelle 2026

Kostenkomponente Betrag Hinweis
Kostenpflichtige Token Anbieter-Listenpreis pro Mio. Input/Output Kein OpenRouter-Markup; Live-Zahlen auf openrouter.ai/models
Credit-Kaufgebühr 5,5 % (min. 0,80 USD) Beim Aufladen, nicht pro Request
Krypto-Aufladung ca. +5 % Optional; Kartenzahlung nutzt Standardgebühr
Free Tier 0 USD auf 25+ Modellen ~50 Requests/Tag unfunded; ~1.000/Tag ab 10 USD+ bei 20 req/min
BYOK Erste 1 Mio. Requests/Monat frei; danach 5 % Eigene Hersteller-Keys bei bestehenden Enterprise-Preisen

8. DSGVO- und Compliance-Rahmen für DACH-Teams

OpenRouter verarbeitet Prompts als Auftragsverarbeiter-ähnlicher Dienst in den USA. Für deutsche Unternehmen bedeutet das:

  • Verarbeitungsverzeichnis (Art. 30 DSGVO): Zweck (Inferenz), Kategorien personenbezogener Daten (Prompt-Inhalte), Empfänger (OpenRouter + Upstream-Anbieter), Drittlandtransfer dokumentieren.
  • AVV / DPA: OpenRouter-Privacy-Policy und Subprozessor-Liste gegen interne Anforderungen prüfen. Bei personenbezogenen Kundendaten oft BYOK mit EU-fähigen Direkt-Endpunkten oder Self-Hosting.
  • Datenminimierung: Keine Roh-PII in Prompts; Pseudonymisierung vor Gateway-Routing. Logging in Agent-Workspaces auf Whitelist setzen — siehe Produktions-Security-Artikel im OpenClaw-Blog.
  • Schrems II / TIA: US-Transfer erfordert ergänzende Maßnahmen oder vertragliche Garantien; reine OpenRouter-Nutzung ohne Bewertung reicht für Behörden- oder KRITIS-Kontexte selten.
  • Audit-Trail: Getrennte API-Keys pro Umgebung, Rotation dokumentieren, OpenRouter-Dashboard-Exporte für FinOps und Compliance archivieren.

Faustregel: OpenRouter für nicht-personenbezogene Entwicklungs- und Benchmark-Workloads; Direkt-API oder On-Prem für produktive Kundendaten mit Art.-9-Sensibilität.

9. FAQ

Ist OpenRouter kostenlos? Ja für Experimente: 25+ Modelle mit Tageslimits, ~50 Requests/Tag ohne Guthaben, ~1.000/Tag ab 10 USD+ Guthaben bei 20 req/min.

Gibt es Token-Aufschläge? Nein. 5,5 % nur beim Credit-Kauf.

Ist OpenRouter sicher? Etablierter Aggregator — dennoch US-Infrastruktur. Compliance-Review vor regulierten Daten.

OpenRouter vs. LiteLLM? OpenRouter = gehostetes Gateway mit Abrechnung. LiteLLM = self-hosted Proxy. Zero-Ops → OpenRouter; On-Prem-Kontrolle → LiteLLM.

Modell wechseln ohne App-Rewrite? model-String ändern; optional models-Fallback-Array.

10. OpenRouter-Agenten auf einem Remote Mac betreiben

OpenRouter löst Modellzugang — nicht Gateway-Uptime. Laptop-Sleep, VPN-Abbrüche und Hintergrund-Kills erzeugen dieselbe Stille wie ein API-Ausfall, obwohl das Modell gesund ist.

Produktionsmuster: Apple Silicon mit Node 22, OPENROUTER_API_KEY in SecretRef, Primary-/Fallback-Slugs in openclaw.json, Gateway unter launchd, Workspace per SFTP/rsync. Bei Incidents: Gateway → Channels Probe → OpenRouter 429 → Modell-Swap — in einer seriellen Reihenfolge.

SFTPMAC Remote-Mac-Miete zielt auf dieses Profil: native macOS-Permission-Grenzen, 7×24-Konnektivität für Telegram/Slack/WeChat-Callbacks und APFS-freundliches Rollback. Ergänzen Sie diesen Leitfaden mit Modellauswahl-Guide und OpenClaw-Installations-Handbuch.