Das Wichtigste in Kürze (Stand 26.09.2026):
- OpenRouter ist laut eigener Dokumentation ein ausschließlich gehosteter Dienst der OpenRouter, Inc. (New York), der laut Modellübersicht mehr als 400 Modelle und Provider hinter einem Endpunkt und einer Rechnung bündelt; an Funktionsstufen wie Business und Enterprise hängen unter anderem SSO, SCIM und die Datenregionen-Guardrails.
- Das innFactory AI Gateway wird in den Cloud-Tenant des Kunden ausgerollt und bündelt Kostenstellen mit Per-Member-Caps, Budgets in Euro und einen Companion, der die Agent-Zeit von Claude Code, Codex und OpenCode je Repository misst, auch für Abo-Nutzung.
- Laut Dokumentation (Stand 26.09.2026) beziehen sich Budgets und Metriken von OpenRouter auf Anfragen, die über OpenRouter geleitet werden, und werden in US-Dollar geführt; ein lokaler Companion, der Agent-Zeit je Repository inklusive Abo-Sitzungen misst, ist nicht beschrieben – das innFactory AI Gateway bringt diesen Companion mit und zeigt Budgets in Euro zum EZB-Tageskurs.
- OpenRouter passt, wenn Sie viele Modelle mit einem Schlüssel und einer Rechnung nutzen, nichts betreiben wollen und Anfragen über die Infrastruktur von OpenRouter laufen dürfen; das innFactory AI Gateway passt, wenn Datenpfad und Provider-Verträge im eigenen Tenant bleiben sollen und Kostenstellen in Euro sowie Agent-Zeit je Repository gefordert sind.
OpenRouter beschreibt sich auf seiner Startseite als „A unified API for every major LLM. One endpoint, hundreds of models, with routing, fallbacks, and cost tracking across providers.“ Nach eigener Angabe startete das Unternehmen Anfang 2023 als LLM-Marktplatz; laut Modellübersicht stehen heute mehr als 400 Modelle und Provider hinter einem Endpunkt. OpenRouter ist ein starkes Produkt für genau diesen Zweck: viele Modelle, ein Schlüssel, eine Rechnung, ein breites Ökosystem.
Das innFactory AI Gateway löst eine andere Aufgabe. Es ist eine Infrastrukturkomponente, die in Ihren eigenen Cloud-Tenant ausgerollt wird und Ihre eigenen Provider-Verträge nutzt — Azure OpenAI, Vertex AI mit EU-Endpunkt, AWS Bedrock, STACKIT oder IONOS. Dazu kommen Budgets je Kostenstelle, sieben Rollen, Guardrails, ein MCP-Proxy und ein Companion, der die Agent-Zeit von Coding-Agenten je Repository misst.
Die eigentliche Entscheidung lautet daher nicht „welches Gateway hat mehr Funktionen“, sondern: gehosteter Marktplatz mit Abrechnung über einen Anbieter — oder Komponente in der eigenen Infrastruktur, bei der Datenpfad und Verträge bei Ihnen bleiben? Beides sind legitime Antworten.
Was OpenRouter ist
Laut Nutzungsbedingungen ist der Anbieter die OpenRouter, Inc. mit Sitz in New York; anwendbar ist nach eigener Angabe das Recht des Staates New York.
Das Gateway selbst ist kein Open-Source-Produkt; eine Lizenzangabe für die gehostete Plattform haben wir nicht gefunden. Die Dokumentation unterscheidet Funktionsstufen, darunter Business und Enterprise; daran hängen unter anderem SSO, SCIM und die Datenregionen-Guardrails.
Betriebsmodell: SaaS, Self-Hosting oder Infrastruktur im eigenen Tenant
OpenRouter wird ausschließlich als gehosteter Dienst angeboten; eine selbst betreibbare Variante ist nicht dokumentiert. Anfragen laufen über die Infrastruktur von OpenRouter und werden an die jeweiligen „Model Provider“ weitergereicht. Für Business- und Enterprise-Kunden dokumentiert OpenRouter regionsgebundene Endpunkte in der EU und den USA; laut der Seite zu „Sovereign AI“ werden Prompts und Completions dabei vollständig innerhalb der gewählten Region verarbeitet. Die Datenschutzerklärung nennt zugleich mögliche Übertragungen personenbezogener Daten außerhalb des EWR auf Basis von Standardvertragsklauseln; die Nutzungsbedingungen verweisen auf einen Auftragsverarbeitungsvertrag für Unternehmen. Einzelne Modellanbieter können laut OpenRouter Daten zum Training nutzen; Zero Data Retention lässt sich erzwingen.
Das innFactory AI Gateway wird in Ihren eigenen Cloud-Tenant ausgerollt — Azure Container Apps oder AKS als Referenzpfad, ebenso STACKIT oder jedes Kubernetes. innFactory hostet es nicht als SaaS. Der Datenpfad bleibt in Ihrem Tenant, und Modellanfragen laufen über Ihre eigenen Provider-Konten — Azure OpenAI, Vertex mit EU-Endpunkt, AWS Bedrock, STACKIT, IONOS, Mistral oder Ollama. Auftragsverarbeitungsverträge schließen Sie direkt mit Ihren Providern.
Identität, SSO und Rollen
OpenRouter dokumentiert SSO über Okta, Microsoft Entra ID, Google Workspace oder einen beliebigen SAML-Provider; laut Dokumentation ist SSO für Organisationen auf Enterprise-Plänen verfügbar. SCIM-Gruppenzuordnungen sind ebenfalls an Enterprise-Pläne und eine aktive SSO-Verbindung gebunden. Auf Organisationsebene sind zwei Rollen dokumentiert: Administratoren und Mitglieder.
Das innFactory AI Gateway authentifiziert über Microsoft Entra ID oder generisches OIDC (Keycloak, AWS Cognito). Es gibt sieben Rollen: Owner, Admin, Auditor, Finance, Security, Member und Guest — Gäste außerhalb der erlaubten E-Mail-Domänen erhalten keinen Proxy-Zugriff. IdP-Gruppen lassen sich auf sechs Rollen abbilden; Kostenstellen haben eigene Administratoren. All das ist in jeder Lizenzstufe enthalten. SAML und SCIM sind derzeit nicht enthalten; das sagen wir offen.
Kostenkontrolle und AI-FinOps
OpenRouter dokumentiert Budgets je API-Schlüssel, je Workspace mit Tages- bis Lifetime-Fenstern (Enterprise) sowie je Organisationsmitglied über Guardrails. Erreichte Limits sind harte Stopps: „Requests are rejected when the limit is reached.“ Alle dokumentierten Obergrenzen und Kostenfelder sind in US-Dollar angegeben. Jede Antwort enthält ein usage-Objekt mit Token-Klassen und dem berechneten cost-Feld; aggregierte Nutzung lässt sich als CSV oder PDF exportieren. Eine eigene Kostenstellen-Dimension ist nicht dokumentiert; die Zuordnung erfolgt über Workspaces, Schlüssel und freie Trace-Metadaten.
Das innFactory AI Gateway arbeitet mit vier unabhängigen Budget-Gates: Organisation (monatlich), Kostenstelle (monatlich plus Tages- und Wochenfenster, als Pool oder pro Nutzer mit Obergrenzen je Mitglied), Nutzer und API-Schlüssel. Jedes Gate antwortet bei Erschöpfung mit HTTP 402 und Fehlercode E4006 — oder, wenn konfiguriert, mit einem Budget-Fallback-Modell statt einer Ablehnung; Obergrenzen je Mitglied sind immer harte Stopps. Dazu kommen Limits je Modell, Ratenlimits und Warnungen bei 80 und 90 Prozent. Kosten werden bis auf Kostenstelle, Repository und Abrechnungsquelle (Gateway oder Abo) aufgeschlüsselt. Angezeigt wird in Euro zum EZB-Tageskurs; Modellpreise stammen von ai-prices.eu und werden vor der Übernahme von einem Administrator geprüft. Jede gepufferte Antwort trägt den Header x-aigateway-response-cost; Insights und CSV-Export liefern die Auswertungen.
Coding-Agenten, Abos und Agent-Zeit
Das Cookbook von OpenRouter dokumentiert Integrationen für Claude Code, Claude Desktop, Codex CLI, Codex Desktop, Cursor, OpenCode, OpenClaw und Hermes Agent. Mit Ori bietet OpenRouter außerdem einen eigenen CLI-Wrapper: „Ori Harness runs the agent CLI you already use on OpenRouter“ — Allowlists, Budgets und Workspace-Berechtigungen der Organisation gelten laut Anbieter für jeden Agenten auf einer Rechnung. Budgets und Metriken von OpenRouter beziehen sich dabei auf Anfragen, die über OpenRouter geleitet werden. Laut den Dokumentationen von OpenRouter (Stand 26.09.2026) ist ein lokaler Companion, der Agent-Zeit je Repository misst und dabei auch Sitzungen auf dem Abonnement des Tools erfasst, nicht beschrieben.
Im Proxy-Modus des innFactory AI Gateway klonen Entwickler Admin-Vorlagen für sechs Werkzeuge — Claude Code, Codex, OpenCode, Cowork, VS Code Continue und VS Code Copilot (BYOK) — in ein eigenes Setup mit eigenem Schlüssel und eigener Kostenstelle; aigw run claude|codex|opencode startet das Tool mit einem kurzlebigen Proxy-Token. Der Companion aigw läuft als Hintergrunddienst auf Linux, macOS und Windows, liest die lokalen Sitzungsprotokolle von Claude Code, Codex und OpenCode und meldet Agent-Zeit, LLM-Zeit und Token-Klassen je Repository und Kostenstelle. Er erkennt, ob eine Sitzung über das Gateway oder über das Abonnement des Tools lief (Claude Max, Codex-Plan); Abo-Nutzung wird zum Listenpreis bewertet, aber nie berechnet oder budgetiert. Der Rollout erfolgt per Device-Code-Login oder Enrollment-Token über Intune, macOS-Richtlinie oder Linux-Skript. Ehrlich dazu: Die Binaries sind noch nicht code-signiert, und Cursor, Windsurf oder Cline erfasst der Companion nicht.
Provider, Dialekte und Modelle
Hier ist OpenRouter klar breiter: laut Modellübersicht mehr als 400 Modelle und Provider hinter einem Endpunkt, mit Standard-Lastverteilung und Modell-Fallbacks in Prioritätsreihenfolge. Eingehend dokumentiert sind OpenAI-kompatible Chat Completions, die Responses API, Anthropic Messages, Embeddings und Rerank.
Das innFactory AI Gateway kennt 13 Provider-Typen — von OpenAI, Azure OpenAI und Azure AI Foundry über Anthropic (direkt oder über Vertex) und Gemini (AI Studio oder Vertex inklusive EU-Endpunkt), Mistral, AWS Bedrock, STACKIT und IONOS bis Ollama, LM Studio, ElevenLabs und beliebige OpenAI-kompatible Endpunkte. Eingehend werden drei Dialekte akzeptiert — OpenAI, Anthropic und Gemini — dazu Realtime-WebSockets, Audio, Embeddings, Bilder, Moderations, OCR und Files/Batches. Der Katalog ist bei OpenRouter breiter; die Anbindung europäischer Provider über die eigenen Konten des Kunden ist unser Schwerpunkt.
Governance: Guardrails, MCP, Routing und Flow Builder
Die Guardrails von OpenRouter kombinieren laut Dokumentation Budget, Modell- und Provider-Allowlists, Zero Data Retention je Modellgruppe, Datenregionen, regexbasierte Prompt-Injection-Erkennung, PII-Erkennung mit Redaktion oder Blockierung sowie eigene Regex-Filter; ein Shadow-Modus ist nicht dokumentiert. OpenRouter betreibt einen eigenen Remote-MCP-Server für Modelle, Preise, Guthaben und Dokumentation. Beim Routing gibt es Auto Router und Pareto Router, dazu Response-Caching und mit Broadcast ein Tracing an 19 benannte Ziele mit Privacy-Modus je Ziel. Ein visueller Flow Builder ist nicht dokumentiert; Alerting läuft laut Anbieter über die angebundenen Zielsysteme.
Das innFactory AI Gateway bringt neun Guardrail-Regeltypen mit — Secret-Erkennung, PII-Blockierung oder -Redaktion, verbotene Begriffe, Token- und Kostenlimits, Azure Content Safety, Prompt Injection, verbotene Themen, Groundedness und externe Webhooks. Regeln laufen auf Wunsch im Shadow-Modus, redigieren auch mitten im Stream und hinterlassen Audit-Zeilen. Der MCP-Proxy stellt Streamable-HTTP-Server mit acht Upstream-Auth-Modi, Zugriffsrichtlinien, Toolsets und Guardrails auf Tool-Argumenten bereit. Routing: Auto-Router nach Prompt-Komplexität, Aliase, Cross-Provider-Fallbacks, Deployment-Gruppen. Der Flow Builder ist ein visueller Graph mit neun Strategien, Guardrail-Knoten, die nach pass, block oder fail verzweigen, und Ereignis-Triggern für Webhooks; ein Flow ist wie ein Modell aufrufbar und belastet dieselben Budgets.
Was OpenRouter besser kann
- Katalogbreite: laut Modellübersicht mehr als 400 Modelle und Provider hinter einem Schlüssel.
- Coding-Agenten-Cookbook mit acht dokumentierten Integrationen plus Ori als eigenem CLI-Wrapper.
- Enterprise-Identität mit SAML-SSO und SCIM-Gruppenzuordnung — beides haben wir heute nicht.
- Observability: 19 Trace-Ziele, dazu CSV- und PDF-Export.
- Eigener Remote-MCP-Server mit Live-Modell- und Preisdaten.
- Kein Betrieb: keine Container, keine Datenbank, kein Rollout — ein Konto, ein Schlüssel.
Wann OpenRouter die richtige Wahl ist
- Sie wollen viele Modelle verschiedener Anbieter mit einem Schlüssel und einer Rechnung nutzen.
- Sie haben keine eigenen Provider-Verträge und wollen auch keine abschließen.
- Sie wollen nichts betreiben und akzeptieren den Datenpfad über einen Drittanbieter — mit EU-Regionsoption auf Business- und Enterprise-Plänen.
- Sie benötigen SAML-SSO und SCIM heute.
- Ihr Tracing soll ohne eigene Integration an Datadog, Grafana oder LangSmith gehen.
Wann das innFactory AI Gateway die richtige Wahl ist
- Datenpfad und Verträge sollen bei Ihnen bleiben: eigener Tenant, eigene Konten bei Azure OpenAI, Vertex EU, Bedrock, STACKIT oder IONOS.
- Sie wollen Kostenstellen mit Pool- oder Pro-Kopf-Budgets, Budget-Fallback statt Ablehnung und Anzeige in Euro.
- Sie wollen wissen, wie viel Agent-Zeit Claude Code, Codex und OpenCode je Repository leisten — auch auf Abonnements.
- Sie brauchen Guardrails mit Shadow-Modus und einen MCP-Proxy mit Zugriffsrichtlinien und benannten Toolsets.
- Sie betreiben oder planen CompanyGPT und wollen Budgets, Rollen und Guardrails nur einmal pflegen.
Vergleich auf einen Blick
| Kriterium | OpenRouter (laut Dokumentation, Stand 26.09.2026) | innFactory AI Gateway |
|---|---|---|
| Betriebsmodell | Gehosteter Dienst; Self-Hosting nicht dokumentiert | Im eigenen Tenant (Azure, STACKIT, Kubernetes) |
| Datenpfad | Über OpenRouter zu den Model Providern; EU-In-Region-Routing auf Business/Enterprise | Im Kunden-Tenant, eigene Provider-Konten |
| Identität | SSO und SCIM auf Enterprise-Plänen; zwei Organisationsrollen | Entra ID / OIDC in jeder Lizenz; sieben Rollen; SAML/SCIM derzeit nicht enthalten |
| Budgets | Je Schlüssel, Workspace (Enterprise), Mitglied; harte Stopps | Organisation, Kostenstelle, Nutzer, Schlüssel; 402/E4006 oder Fallback-Modell |
| Währung und Kosten je Anfrage | USD; usage-Objekt mit cost-Feld | Anzeige EUR zum EZB-Kurs; Header x-aigateway-response-cost |
| Coding-Agenten | Cookbook für acht Tools; Ori-Wrapper; Metriken für geroutete Anfragen | Sechs Proxy-Setups; Companion für Agent-Zeit je Repository inkl. Abo |
| Guardrails | Budget, Allowlists, ZDR, Datenregionen, Prompt-Injection, PII; Shadow-Modus nicht dokumentiert | Neun Regeltypen, Shadow-Modus, Mid-Stream-Redaktion |
| Observability | Broadcast an 19 Ziele; CSV/PDF-Export | Prometheus, Langfuse, Audit-Log, Alerts bei 80/90 %; CSV |
| Visuelles Routing | Auto Router, Pareto Router; Flow Builder nicht dokumentiert | Flow Builder mit neun Strategien, Guardrail- und Webhook-Knoten |
Fazit
OpenRouter und das innFactory AI Gateway beantworten unterschiedliche Fragen. OpenRouter ist ein gehosteter Marktplatz: ein Konto, ein Schlüssel, eine Rechnung, dahinter ein Katalog, den wir in dieser Breite nicht anbieten. Wer ohne eigenen Betrieb viele Modelle erreichen will, ist dort gut aufgehoben — mit EU-Regionsoption auf den Business- und Enterprise-Plänen und erzwingbarer Zero Data Retention.
Das innFactory AI Gateway ist eine Infrastrukturkomponente für Unternehmen, die Datenpfad, Provider-Verträge und Kostenverantwortung selbst halten wollen — mit Kostenstellen in Euro, Rollen ohne Enterprise-Schwelle und einem Companion für die Agent-Zeit je Repository. Die Frage ist, wo Ihre Verantwortung liegen soll.
Nativ in CompanyGPT integriert, Stack wiederverwendbar
Das AI Gateway ist nativ mit CompanyGPT integriert: Dieselben Budgets, Kostenstellen und Guardrails gelten für Chat, Agenten und Add-ons. Identität über Entra ID oder Keycloak, Kostenstellen, Guardrails und die MCP-Registry sind ein Stack, der über CompanyGPT, das Gateway und alle Anwendungen, die über das Gateway laufen, hinweg wiederverwendet wird — einmal gepflegt, überall wirksam. Das Gateway lässt sich auch ohne CompanyGPT als eigenständige Komponente betreiben. Weitere Gegenüberstellungen finden Sie unter alle Vergleiche, die Produktübersicht unter AI Gateway.
Quellen
Abgerufen am 26. September 2026:
- OpenRouter Startseite —
https://openrouter.ai/ - OpenRouter About —
https://openrouter.ai/about - OpenRouter Quickstart —
https://openrouter.ai/docs/quickstart - OpenRouter Terms of Service —
https://openrouter.ai/terms - OpenRouter Privacy Policy —
https://openrouter.ai/privacy - OpenRouter Enterprise —
https://openrouter.ai/enterprise - Sovereign AI / In-Region-Routing —
https://openrouter.ai/docs/guides/features/sovereign-ai - Guardrails —
https://openrouter.ai/docs/guides/features/guardrails - Guardrails: Sensitive Info —
https://openrouter.ai/docs/guides/features/guardrails/sensitive-info - Zero Data Retention —
https://openrouter.ai/docs/guides/privacy/zdr - SSO —
https://openrouter.ai/docs/guides/features/sso - SCIM Group Mappings —
https://openrouter.ai/docs/guides/features/scim-mappings - Workspaces —
https://openrouter.ai/docs/guides/features/workspaces - Provisioning API Keys —
https://openrouter.ai/docs/features/provisioning-api-keys - Usage Accounting —
https://openrouter.ai/docs/use-cases/usage-accounting - Activity Export —
https://openrouter.ai/docs/cookbook/administration/activity-export - Broadcast —
https://openrouter.ai/docs/guides/features/broadcast - Coding-Agenten-Cookbook —
https://openrouter.ai/docs/cookbook/coding-agents/ - Claude Code Integration —
https://openrouter.ai/docs/cookbook/coding-agents/claude-code-integration - Claude Desktop Integration —
https://openrouter.ai/docs/cookbook/coding-agents/claude-desktop-integration - Codex CLI —
https://openrouter.ai/docs/cookbook/coding-agents/codex-cli - Codex Desktop —
https://openrouter.ai/docs/cookbook/coding-agents/codex-desktop - Cursor Integration —
https://openrouter.ai/docs/cookbook/coding-agents/cursor-integration - OpenCode Integration —
https://openrouter.ai/docs/cookbook/coding-agents/opencode-integration - OpenClaw Integration —
https://openrouter.ai/docs/cookbook/coding-agents/openclaw-integration - Hermes Agent Integration —
https://openrouter.ai/docs/cookbook/coding-agents/hermes-integration - Ori Harness —
https://openrouter.ai/docs/guides/ori/harness - Modellübersicht —
https://openrouter.ai/docs/guides/overview/models - OpenRouter MCP Server —
https://openrouter.ai/docs/guides/overview/mcp-server - Response Caching —
https://openrouter.ai/docs/guides/features/response-caching - Rerank —
https://openrouter.ai/docs/api/api-reference/rerank/create-rerank - Embeddings —
https://openrouter.ai/docs/client-sdks/typescript/api-reference/embeddings - Provider Selection —
https://openrouter.ai/docs/guides/routing/provider-selection - Model Fallbacks —
https://openrouter.ai/docs/guides/routing/model-fallbacks - Auto Router —
https://openrouter.ai/docs/guides/routing/routers/auto-router - Pareto Router —
https://openrouter.ai/docs/guides/routing/routers/pareto-router
Hinweis zu den Angaben: Alle Aussagen über Produkte anderer Anbieter beruhen auf deren öffentlich zugänglicher Dokumentation zum angegebenen Stand. Anbieter entwickeln ihre Produkte, Funktionen und Konditionen laufend weiter — maßgeblich sind stets die aktuellen Angaben des jeweiligen Anbieters. Sollte Ihnen eine Angabe veraltet oder unzutreffend erscheinen, schreiben Sie uns kurz an info@innfactory.ai; wir prüfen und korrigieren zeitnah. Dieser Vergleich ersetzt keine Rechts- oder Datenschutzberatung im Einzelfall.
Weiterführende Artikel
- AI Gateway – Budgets, Guardrails, MCP-Proxy und Companion im Überblick
- CompanyGPT – die Chat-Plattform, mit der das Gateway nativ integriert ist
- Claude Code als AI Harness – Aufbau, Bausteine und Anbindung über das Gateway
- AI Harness erklärt – was einen KI-Agenten von einem Modell unterscheidet
- Alle Vergleiche zum AI Gateway – LiteLLM, OpenRouter, Portkey, Cloudflare, Kong, Bifrost, TrueFoundry, Helicone, Vercel
- AI Gateway vs. Portkey (PRISMA AIRS)
- AI Gateway vs. Cloudflare AI Gateway
- AI Gateway vs. Vercel AI Gateway
