Das Wichtigste in Kürze (Stand 26.09.2026):
- Cloudflare AI Gateway ist laut Dokumentation ein von Cloudflare betriebener, nicht quelloffener Edge-Dienst ohne dokumentierten Selbstbetrieb, verfügbar in den Plan-Stufen Workers Free, Workers Paid und Enterprise.
- Das innFactory AI Gateway wird in den Cloud-Tenant des Kunden ausgerollt und bündelt Kostenstellen mit Per-Member-Caps, Budgets in Euro und einen Companion, der die Agent-Zeit von Claude Code, Codex und OpenCode je Repository misst, auch für Abo-Nutzung.
- In der Kompatibilitätstabelle der Data Localization Suite ist AI Gateway laut Cloudflare als nicht kompatibel mit Regional Services und Geo Key Manager markiert, und laut Dokumentation (Stand 26.09.2026) wird erfasst, was über das Gateway läuft; beim innFactory AI Gateway laufen Gateway, Dashboard und Daten im Tenant des Kunden, und innFactory sitzt nicht im Anfragepfad, und der Companion aigw misst zusätzlich Agent-Zeit und Abo-Nutzung.
- Cloudflare AI Gateway passt, wenn Ihre Anwendung bereits auf Cloudflare Workers läuft, Sie kein Gateway betreiben wollen und die Verarbeitung über das globale Cloudflare-Netz zu Ihrer Datenschutzbewertung passt; das innFactory AI Gateway passt, wenn das Gateway im eigenen Cloud-Tenant laufen soll und Rollen aus Entra ID oder Keycloak, Kostenstellen mit Pro-Kopf-Budgets in Euro und die Agent-Zeit von Coding-Agenten gefordert sind.
Cloudflare beschreibt sein AI Gateway in der Dokumentation mit „Observe and control your AI applications“ und auf der Produktseite als „An intelligent control plane for your AI applications“. Laut Anbieter genügen ein Cloudflare-Konto und eine Zeile Code.
Cloudflare AI Gateway ist ein starkes Produkt, gerade für Teams, die ohnehin auf Cloudflare bauen: kein eigener Betrieb, ein visueller Editor für Dynamic Routing mit Versionierung, Ausgabenlimits mit hartem Stopp.
Die eigentliche Entscheidung ist eine Architekturfrage: KI-Anfragen über einen von Cloudflare betriebenen Edge-Dienst — oder über eine Infrastrukturkomponente im eigenen Cloud-Tenant, angebunden an Ihr Identity-System, die auch die Arbeit von Coding-Agenten außerhalb des Proxys erfasst? Stand des Vergleichs: 26. September 2026.
Was Cloudflare AI Gateway ist
Cloudflare AI Gateway ist ein von Cloudflare betriebener, nicht quelloffener Dienst; Anbieter ist laut Nutzungsbedingungen Cloudflare, Inc., San Francisco. Ein Open-Source-Release des Gateways ist nicht dokumentiert; das Repository cloudflare/ai enthält laut Beschreibung „Packages and examples for building AI-powered applications on Cloudflare“, also SDKs und Beispiele, nicht den Dienst.
Die Dokumentation nennt die Plan-Stufen Workers Free, Workers Paid und Enterprise; Caching und DLP-Scanning sind laut Preisseite auf allen Plänen enthalten.
Betriebsmodell: SaaS, Self-Hosting oder Infrastruktur im eigenen Tenant
Cloudflare AI Gateway ist ein verwalteter Edge-Dienst: Jede Anfrage läuft durch die Infrastruktur von Cloudflare zum Modellanbieter. Ein Docker-Image oder Helm-Chart für den Selbstbetrieb ist nicht dokumentiert.
Für europäische Unternehmen wichtig: In der Kompatibilitätstabelle der Data Localization Suite ist AI Gateway laut Cloudflare als nicht kompatibel mit Regional Services und Geo Key Manager markiert; eine EU-spezifische Verarbeitungsoption für dieses Produkt haben wir nicht gefunden. Cloudflare weist im Trust Hub SOC 2 Type II und ISO 27001 für die gesamte Plattform aus; eine AI-Gateway-spezifische Aussage haben wir nicht gefunden.
Das innFactory AI Gateway wird als cloud-native Infrastrukturkomponente in den Cloud-Tenant des Kunden deployt — Azure Container Apps oder AKS, STACKIT oder ein beliebiges Kubernetes — und dort als Teil des eigenen KI-Stacks betrieben. innFactory hostet es nicht als SaaS. Das in Rust geschriebene Gateway läuft als Container mit PostgreSQL, MongoDB oder Azure Cosmos DB; der Datenpfad bleibt im Tenant.
Identität, SSO und Rollen
Cloudflare dokumentiert SSO und SCIM auf Ebene des Cloudflare-Kontos — laut Cloudflare-One-Dokumentation aus Okta, Microsoft Entra oder Authentik. Das ist eine Konto-Funktion, keine Funktion des AI Gateways. Auf Gateway-Ebene gibt es API-Token-Berechtigungen in drei Stufen — AI Gateway Read, Run und Edit —, die laut Dokumentation nicht auf ein einzelnes Gateway eingeschränkt werden können. Nutzer werden über Anfrage-Metadaten wie user_id zugeordnet. Ein Rollenmodell je Nutzer ist für das AI Gateway nicht dokumentiert.
Das innFactory AI Gateway bindet Microsoft Entra ID oder einen generischen OIDC-Provider wie Keycloak an. Sieben Rollen — Owner, Admin, Auditor, Finance, Security, Member, Guest —, Gruppen-Mapping aus dem IdP und Kostenstellen-Administratoren sind in jeder Lizenzstufe enthalten. Pro Person lassen sich erlaubte Modelle, Budgets und Rate Limits setzen.
Kostenkontrolle und AI-FinOps
Cloudflares Spend Limits werden laut Dokumentation nach Modell, Provider, eigenen Metadaten wie user_id und dem reservierten Feld cf.user_id gesetzt — als eigenständiges Budget je Wert oder als Filter, in festen oder rollierenden Fenstern (täglich, wöchentlich, monatlich). Bei erreichtem Limit blockiert das Gateway mit HTTP 429; mit Dynamic Routing kann stattdessen auf ein anderes Modell ausgewichen werden. Spend Limits sind laut Cloudflare „eventually consistent“, je Gateway sind maximal 20 Regeln vorgesehen, Limits werden in Dollar gesetzt. Ein CSV-Export und ein Kostenstellen-Konzept sind nicht dokumentiert.
Das innFactory AI Gateway führt vier unabhängige Gates: Organisation, Kostenstelle (monatlich plus Tages- und Wochenfenster), Nutzer und API-Key. Kostenstellen sind eigene Objekte im Pool- oder Pro-Kopf-Modus; Obergrenzen je Mitglied greifen immer hart. Ein erschöpftes Gate antwortet mit HTTP 402 und Fehlercode E4006 oder mit einem Fallback-Modell. Warnungen kommen bei 80 und 90 Prozent, ein budget_exceeded-Event kann einen Webhook auslösen. Kosten werden nach Nutzer, Key, Team, Kostenstelle, Modell, Provider, Tool, Repository und Abrechnungsquelle zugeordnet — intern in US-Dollar, angezeigt in Euro zum EZB-Tageskurs. Jede gepufferte Antwort trägt den Header x-aigateway-response-cost, der CSV-Export enthält Agent- und LLM-Zeit.
Coding-Agenten, Abos und Agent-Zeit
Cloudflare dokumentiert Anleitungen für Claude Code, Claude Desktop, GitHub Copilot CLI, OpenAI Codex, OpenCode und Pi. Für Claude Code wird ANTHROPIC_BASE_URL auf den Gateway-Endpunkt gesetzt und das Token per ANTHROPIC_CUSTOM_HEADERS mitgegeben. Erfasst wird, was über das Gateway läuft. Laut den Dokumentationen von Cloudflare (Stand 26.09.2026) ist ein lokaler Companion, der Agent-Zeit oder die Nutzung von Tool-Abos misst, nicht beschrieben.
Das innFactory AI Gateway hat dafür zwei Bausteine. Erstens Proxy-Setups aus Admin-Vorlagen mit eigenem Key und eigener Kostenstelle je Entwickler — für Claude Code, Codex, OpenCode, Cowork, VS Code Continue und VS Code Copilot. Zweitens der Companion aigw: ein Hintergrunddienst auf dem Entwicklerrechner, der die Session-Logs von Claude Code, Codex und OpenCode liest und Agent-Zeit, LLM-Zeit und Token-Klassen je Repository, Nutzer, Tool und Kostenstelle meldet. Er erkennt, ob eine Session über das Gateway oder das Abo des Tools lief — Claude Max, ChatGPT- oder Codex-Plan; Abo-Nutzung wird zum Listenpreis bewertet, getrennt ausgewiesen und nie berechnet. Gesendet wird nur eine im Code fixierte Allow-List ohne Prompts. Der Rollout läuft über Intune, macOS-Policy oder Linux-Skript. Die Binaries sind noch nicht code-signiert, ein Self-Update fehlt.
Provider, Dialekte und Modelle
Bei der Anbieterbreite ist Cloudflare weiter. Die Dokumentation des OpenAI-kompatiblen Endpunkts nennt „14+ providers“, darunter Anthropic, OpenAI, Google, xAI, Groq, Mistral, Cohere, Perplexity, Workers AI, DeepSeek und Cerebras; STACKIT und IONOS sind nicht dokumentiert. Eingangs-Dialekte sind die REST-API, der Endpunkt /compat/chat/completions (Voraussetzung für Dynamic Routing) und providernative Endpunkte wie /anthropic; ein Gemini-Dialekt und Realtime per WebSocket waren nicht dokumentiert.
Das innFactory AI Gateway kennt 13 Provider-Typen, darunter OpenAI, Azure OpenAI, Anthropic (direkt oder Vertex), Gemini (AI Studio oder Vertex mit EU-Endpunkt), Mistral, AWS Bedrock, STACKIT, IONOS, Ollama und ElevenLabs. Eingehend spricht es die Dialekte OpenAI, Anthropic und Gemini, dazu Realtime-WebSockets, Audio, Embeddings und Bilder.
Governance: Guardrails, MCP, Routing und Flow Builder
Cloudflare Guardrails prüfen laut Dokumentation Prompts und Antworten mit einer Policy, die markiert oder blockiert, und einem Audit-Trail. Getrennt davon nutzt die DLP-Funktion die Erkennungs-Engines von Cloudflares Data-Loss-Prevention-Produkt für Text in Anfragen, Antworten und Tool-Call-Argumenten, mit den Aktionen Flag und Block. Ein MCP-Proxy ist als AI-Gateway-Funktion nicht dokumentiert.
Dynamic Routing ist Cloudflares Stärke in diesem Abschnitt: Routen entstehen im visuellen Editor oder als JSON mit den sieben Knotentypen Start, Conditional, Percentage, Model, Rate Limit, Budget Limit und End — für A/B-Tests, schrittweise Rollouts und Quoten je Nutzer, Projekt oder Team. Routen sind versioniert, mit Deploy und Rollback.
Das innFactory AI Gateway setzt neun Guardrail-Regeltypen ein — darunter Secret-Erkennung, PII-Maskierung, Prompt Injection und externer Webhook — mit Shadow-Modus, Maskierung mitten im Stream und DSGVO-Preset. Der MCP-Proxy stellt Streamable-HTTP-Server mit acht Upstream-Auth-Modi bereit, darunter per-User OAuth PKCE und Entra On-Behalf-Of. Der Flow Builder ist ein visueller Graph mit neun Strategien; der Unterschied zu Cloudflare liegt in den Knotentypen: Guardrail-Knoten verzweigen nach Pass, Block oder Fail, Event-Trigger wie budget_exceeded lösen Webhooks aus.
Was Cloudflare AI Gateway besser kann
- Kein eigener Betrieb. Teil des globalen Cloudflare-Netzwerks.
- BYOK über den Secrets Store. Anbieter-Keys liegen laut Dokumentation im Cloudflare-Dashboard.
- DLP-Engines aus der Zero-Trust-Produktlinie, laut Preisseite auf allen Plänen enthalten.
- Sechs Coding-Agent-Anleitungen, darunter Claude Desktop, Copilot CLI und Pi.
- Plattformweite Zertifizierungen. SOC 2 Type II und ISO 27001 für die gesamte Plattform.
- Dynamic Routing mit Versionen. Visueller Editor, A/B-Tests, sofortiges Rollback.
- Anbieterbreite, etwa xAI, Groq, Cohere, DeepSeek, Cerebras und Workers AI.
Wann Cloudflare AI Gateway die richtige Wahl ist
- Ihre Anwendung läuft bereits auf Cloudflare Workers, und Sie wollen kein Gateway selbst betreiben.
- Verarbeitung über das globale Cloudflare-Netz passt zu Ihrer Datenschutzbewertung.
- Sie wollen Anbieter wie Groq, Cerebras oder Workers AI über denselben Endpunkt nutzen.
Wann das innFactory AI Gateway die richtige Wahl ist
- Das Gateway soll im eigenen Cloud-Tenant laufen — Azure, STACKIT oder Kubernetes — und der Datenpfad dort bleiben.
- Sie brauchen Rollen aus Entra ID oder Keycloak im Gateway selbst, mit Auditor-, Finance- und Security-Sicht.
- Kostenstellen mit Pool- oder Pro-Kopf-Budgets, Obergrenzen je Mitglied und Anzeige in Euro sind gefordert.
- Sie wollen die Agent-Zeit von Claude Code, Codex und OpenCode je Repository und Kostenstelle sehen — auch auf Abos.
- Guardrails mit Shadow-Modus, Webhook-Knoten, ein MCP-Proxy oder Provider wie STACKIT und IONOS gehören zur Anforderung.
Vergleich auf einen Blick
| Kriterium | Cloudflare AI Gateway (laut Dokumentation, Stand 26.09.2026) | innFactory AI Gateway |
|---|---|---|
| Betrieb | Edge-Dienst; Selbstbetrieb nicht dokumentiert | Container im eigenen Tenant |
| EU-Verarbeitung | Nicht kompatibel mit Regional Services und Geo Key Manager | Datenpfad bleibt im Tenant des Kunden |
| Identität | SCIM auf Kontoebene; Token-Rechte Read/Run/Edit | Entra ID/OIDC, sieben Rollen, in jeder Lizenz |
| Budgets | Spend Limits je Modell, Provider, Metadaten; 429 oder Routing-Fallback | Gates auf Organisation, Kostenstelle, Nutzer, Key; Pro-Kopf-Obergrenzen |
| Währung | Limits in Dollar | USD intern, Anzeige in Euro zum EZB-Kurs |
| Coding-Agenten | Sechs Anleitungen; erfasst Proxy-Anfragen | Sechs Proxy-Setups plus Companion für Agent-Zeit |
| Guardrails | Flag/Block mit Audit-Trail; DLP-Engines | Neun Regeltypen, Shadow-Modus, Mid-Stream-Redaction |
| MCP | Als AI-Gateway-Funktion nicht dokumentiert | MCP-Proxy mit acht Auth-Modi und Toolsets |
| Routing-Editor | Dynamic Routing, sieben Knotentypen, Versionen, Rollback | Flow Builder, neun Strategien, Guardrail- und Webhook-Knoten |
Fazit
Cloudflare AI Gateway ist eine gute Wahl, wenn die Anwendung ohnehin auf Cloudflare läuft, niemand ein Gateway betreiben will und die Verarbeitung über das globale Netz zum Datenschutzkonzept passt. Routing-Editor und Ausgabenlimits sind sauber dokumentiert, die Anbieterbreite ist größer als unsere.
Das innFactory AI Gateway ist die Wahl, wenn das Gateway im eigenen Tenant liegen soll, Rollen und Kostenstellen aus dem Identity-System kommen und auch die Arbeitszeit von Coding-Agenten sichtbar werden soll. Beide lösen das Proxy-Problem; sie unterscheiden sich darin, wo die Kontrolle liegt.
Nativ in CompanyGPT integriert, Stack wiederverwendbar
Das innFactory AI Gateway ist nativ mit CompanyGPT verbunden: Dieselben Budgets, Kostenstellen und Guardrails gelten für Chat, Agenten und Add-ons. Identität über Entra ID oder Keycloak, Kostenstellen, Guardrails und MCP-Registry sind ein Stack, der in CompanyGPT, im Gateway und in Ihren eigenen Werkzeugen wiederverwendet wird. Das Gateway läuft auch eigenständig. Weitere Gegenüberstellungen: alle Vergleiche; Produktseite: AI Gateway.
Quellen
Abgerufen am 26. September 2026:
- AI Gateway Dokumentation —
https://developers.cloudflare.com/ai-gateway/ - Produktseite —
https://www.cloudflare.com/products/ai-gateway/ - Nutzungsbedingungen —
https://www.cloudflare.com/terms/ - Repository cloudflare/ai —
https://github.com/cloudflare/ai - Pricing —
https://developers.cloudflare.com/ai-gateway/reference/pricing/ - Data Localization —
https://developers.cloudflare.com/data-localization/compatibility/ - Trust Hub —
https://www.cloudflare.com/trust-hub/ - SCIM —
https://developers.cloudflare.com/cloudflare-one/team-and-resources/users/scim/ - Spend Limits —
https://developers.cloudflare.com/ai-gateway/features/spend-limits/ - Analytics —
https://developers.cloudflare.com/ai-gateway/observability/analytics/ - Coding Agents —
https://developers.cloudflare.com/ai-gateway/integrations/coding-agents/ - Claude Code —
https://developers.cloudflare.com/ai-gateway/integrations/coding-agents/claude-code/ - Chat Completions —
https://developers.cloudflare.com/ai-gateway/usage/chat-completion/ - Guardrails —
https://developers.cloudflare.com/ai-gateway/features/guardrails/ - DLP —
https://developers.cloudflare.com/ai-gateway/features/dlp/ - Dynamic Routing —
https://developers.cloudflare.com/ai-gateway/features/dynamic-routing/ - BYOK —
https://developers.cloudflare.com/ai-gateway/configuration/bring-your-own-keys/
Hinweis zu den Angaben: Alle Aussagen über Produkte anderer Anbieter beruhen auf deren öffentlich zugänglicher Dokumentation zum angegebenen Stand. Anbieter entwickeln ihre Produkte, Funktionen und Konditionen laufend weiter — maßgeblich sind stets die aktuellen Angaben des jeweiligen Anbieters. Sollte Ihnen eine Angabe veraltet oder unzutreffend erscheinen, schreiben Sie uns kurz an info@innfactory.ai; wir prüfen und korrigieren zeitnah. Dieser Vergleich ersetzt keine Rechts- oder Datenschutzberatung im Einzelfall.
Weiterführende Artikel
- AI Gateway
- CompanyGPT
- Claude Code als AI Harness
- AI Harness erklärt
- Alle Vergleiche zum AI Gateway – LiteLLM, OpenRouter, Portkey, Cloudflare, Kong, Bifrost, TrueFoundry, Helicone, Vercel
- AI Gateway vs. OpenRouter
- AI Gateway vs. Portkey (PRISMA AIRS)
- AI Gateway vs. Vercel AI Gateway
