↓ Zum Hauptinhalt springen
9 – 17 UHR +49 8031 3508270 LUITPOLDSTR. 9, 83022 ROSENHEIM
DE / EN

AI Gateway vs. Vercel AI Gateway: Managed Gateway beim Anbieter oder Infrastrukturkomponente im eigenen Tenant?

Tobias Jonas Tobias Jonas | | 12 min Lesezeit

Das Wichtigste in Kürze (Stand 26.09.2026):

  • Vercel AI Gateway ist laut Dokumentation ein ausschließlich verwalteter Dienst von Vercel Inc. unter ai-gateway.vercel.sh ohne dokumentierten Eigenbetrieb, mit regionaler Inferenz in den Zonen us und eu; einzelne Funktionen sind an die Plattformpläne Pro und Enterprise gebunden.
  • Das innFactory AI Gateway wird in den Cloud-Tenant des Kunden ausgerollt und bündelt Kostenstellen mit Per-Member-Caps, Budgets in Euro und einen Companion, der die Agent-Zeit von Claude Code, Codex und OpenCode je Repository misst, auch für Abo-Nutzung.
  • Laut Dokumentation (Stand 26.09.2026) sind Budgets bei Vercel AI Gateway ein soft cap in US-Dollar auf den Ebenen Team, Projekt, API-Schlüssel und Nutzer, BYOK-Ausgaben zählen nicht gegen Budgets, und gemessen werden Anfragen über das Gateway; beim innFactory AI Gateway sind Obergrenzen je Kostenstellenmitglied harte Stopps in Euro, und der Companion aigw misst die Agent-Zeit von Claude Code, Codex und OpenCode auch bei Abo-Nutzung.
  • Vercel AI Gateway passt, wenn Sie mit dem AI SDK oder auf Vercel entwickeln, ohne eigene Infrastruktur starten und Budgets als weiche Obergrenzen in US-Dollar ausreichen; das innFactory AI Gateway passt, wenn das Gateway im eigenen Tenant ohne Gateway-Betreiber im Anfragepfad laufen soll, mit harten Budgetgrenzen je Mitglied, Rollen aus Entra ID oder Keycloak und Agent-Zeit je Repository.

Vercel beschreibt sein Produkt auf der Produktseite als „The AI Gateway for developers“ und in der Dokumentation als „managed gateway“, das Zugangsdaten, Request-Logs, Ausgabenbudgets, Routing und Provider-Failover zentralisiert. Nach eigener Angabe trieb das System zunächst v0.app an und wurde 2025 als allgemein verfügbar erklärt.

Vercel AI Gateway ist ein gutes Produkt: sehr breite Modell- und Anbieterabdeckung, ausgereiftes Provider-Routing, ein Setup-Befehl für rund dreißig Coding-Agenten und die native Einbindung in das AI SDK - ohne eigene Infrastruktur.

Die eigentliche Entscheidung ist eine Betriebsfrage: Sollen alle KI-Anfragen Ihres Unternehmens über eine von Vercel betriebene Infrastruktur laufen, oder soll das Gateway im eigenen Cloud-Tenant liegen - mit harten Budgetgrenzen, Rollen aus dem eigenen Identity Provider und Messung der Agent-Zeit von Coding-Agenten, auch dort, wo kein Gateway zwischen Tool und Modell steht?

Was Vercel AI Gateway ist

Vercel AI Gateway ist ein von Vercel Inc. betriebener Dienst; die Datenschutzerklärung des Anbieters nennt eine Kontaktadresse in Covina, Kalifornien. Das Gateway selbst ist ein geschlossenes, verwaltetes Produkt; die Client-Seite ist das AI SDK mit dem Paket @ai-sdk/gateway. Einzelne Funktionen sind laut Dokumentation an die Plattformpläne Pro und Enterprise gebunden. Eigentümerwechsel sind auf den abgerufenen Seiten nicht dokumentiert.

Betriebsmodell: SaaS, Self-Hosting oder Infrastruktur im eigenen Tenant

Vercel AI Gateway wird ausschließlich als verwalteter Dienst unter https://ai-gateway.vercel.sh angeboten; ein Container-Image oder Binary für den Eigenbetrieb ist auf den abgerufenen Seiten nicht dokumentiert. Die Anwendung darf laut Dokumentation überall laufen: „Your application does not need to run on Vercel.“ Der Datenpfad führt aber immer über die Infrastruktur von Vercel, auch mit eigenen Provider-Schlüsseln (BYOK).

Vercel dokumentiert eine regionale Inferenz mit den Zonen us und eu, gesetzt pro Anfrage; nicht jedes Modell unterstützt beide. Ohne explizite Region gilt: „If you request no region, AI Gateway routes your data globally.“ Die Regionsangabe bindet den Ort der Inferenz, nicht den Ort, an dem die Anfrage das Gateway erreicht. Vercel schreibt selbst, dass regionales Routing die Ortsfrage beantwortet, eine Workload dadurch aber nicht von sich aus DSGVO-konform werde. Zero Data Retention ist laut Dokumentation der Standard.

Das innFactory AI Gateway wird nicht von uns gehostet, sondern als Infrastrukturkomponente in Ihren eigenen Cloud-Tenant ausgerollt: Azure Container Apps oder AKS als Referenzpfad, STACKIT für den souveränen Weg, jedes Kubernetes. Das Backend ist ein Rust-Binary im Container plus Next.js-Dashboard, mit PostgreSQL, MongoDB oder Azure Cosmos DB. Das Gateway und seine Daten bleiben in Ihrem Tenant; innFactory sitzt nicht im Anfragepfad zu den Modellanbietern; die innFactory GmbH unterstützt beim Rollout. Das Gateway läuft seit August 2026 bei ersten Kunden produktiv, aktuell in Version 1.0.0-rc16.

Identität, SSO und Rollen

Die Authentifizierung am Vercel AI Gateway erfolgt laut Dokumentation über API-Schlüssel oder Vercel-OIDC-Tokens, die für ein Vercel-Projekt erzeugt werden und zwölf Stunden gültig sind. SSO für Personen ist Sache der Vercel-Plattform: SAML Single Sign-On ist laut Dokumentation für Enterprise-Teams verfügbar, Pro-Teams können es als Add-on hinzubuchen; Directory Sync (SCIM) ist Enterprise-Teams vorbehalten. Das Rollenmodell entspricht den Vercel-Teamrollen Owner, Member, Developer, Security, Viewer und Billing, ergänzt um die Berechtigung „AI Gateway Budget Manager“.

Das innFactory AI Gateway authentifiziert gegen Microsoft Entra ID oder einen generischen OIDC-Anbieter (Keycloak dokumentiert, AWS-Cognito-Claims werden verarbeitet). Es gibt sieben Rollen: Owner, Admin, Auditor, Finance, Security, Member und Guest; Gäste entstehen bei Logins außerhalb der erlaubten E-Mail-Domains und erhalten keinen Proxy-Zugriff. IdP-Gruppen lassen sich auf sechs Rollen abbilden, und pro Person lassen sich Modelle, Budgets und Rate Limits setzen - in jeder Lizenzstufe.

Kostenkontrolle und AI-FinOps

Vercel dokumentiert Budgets auf genau vier Ebenen: Team, Projekt, API-Schlüssel und Nutzer. Ein Budget ist nach Angabe des Anbieters „a soft cap, not a hard limit“: Die Prüfung läuft zu Beginn jeder Anfrage, die überschreitende Anfrage wird noch ausgeführt, danach antwortet das Gateway mit HTTP 402. Zeitfenster sind täglich, wöchentlich, monatlich oder ohne Reset, jeweils in UTC. Budgets werden in US-Dollar gesetzt; eine andere Währung ist nicht erwähnt. BYOK-Anfragen zählen laut Dokumentation nicht gegen Budgets: „A budget can’t be used to cap BYOK spend.“ Warnungen bei 50, 75 und 100 Prozent gehen per E-Mail. Jede Antwort enthält gateway.cost und eine generationId; die Logs-Seite exportiert als CSV oder JSON.

Das innFactory AI Gateway arbeitet mit unabhängigen Gates: Organisation (monatlich), Kostenstelle (monatlich plus Tages- und Wochenfenster, Pool- oder Pro-Nutzer-Modus mit Obergrenzen je Mitglied), Nutzer und API-Schlüssel. Jedes erschöpfte Gate antwortet mit HTTP 402 und E4006; optional greift ein Budget-Fallback-Modell, wobei die Obergrenzen je Mitglied harte Stopps bleiben. Dazu kommen TPM- und RPM-Limits, Warnungen bei 80 und 90 Prozent und ein budget_exceeded-Ereignis für Flows und Webhooks. Angezeigt wird in Euro zum EZB-Tageskurs, die Preisbasis liefert ai-prices.eu. Jede gepufferte Antwort trägt den Header x-aigateway-response-cost; die Insights werten nach Nutzer, Kostenstelle, Modell, Tool und Repository aus, der CSV-Export enthält Agent- und LLM-Zeit.

Coding-Agenten, Abos und Agent-Zeit

Hier ist Vercel stark. Die Dokumentation listet rund dreißig Coding-Agenten, darunter Aider, Claude Code, Cline, Codex, Cursor, OpenCode und Zed. Der Befehl npx vercel ai-gateway setup erkennt laut Dokumentation installierte Agenten und schreibt deren Konfigurationsdateien; Claude Code, Codex und Cursor erhalten eigene Kompatibilitätsendpunkte. Gemessen wird, was über das Gateway läuft: Anfragen, Tokens und Kosten je Schlüssel, Projekt oder Nutzer. Laut den Dokumentationen von Vercel (Stand 26.09.2026) ist ein lokaler Companion, der Agent-Zeit misst oder Nutzung über Abonnements wie Claude Max oder einen Codex-Plan erfasst, nicht beschrieben; eine MDM-Verteilung einer Client-Komponente ebenfalls nicht.

Das innFactory AI Gateway bietet Proxy-Setups für sechs Tools: Claude Code, Codex, OpenCode, Cowork, VS Code Continue und VS Code Copilot (BYOK). Jeder Entwickler klont eine Admin-Vorlage in ein eigenes Setup mit eigenem Schlüssel und eigener Kostenstelle; aigw run claude|codex|opencode startet das Tool mit einem kurzlebigen Proxy-Token. Ergänzend läuft der Companion aigw als Hintergrunddienst auf Linux, macOS und Windows. Er liest die lokalen Sitzungsprotokolle von Claude Code, Codex und OpenCode und meldet Agent-Zeit, LLM-Zeit und Token-Klassen je Repository, Nutzer, Tool und Kostenstelle. Er erkennt, ob eine Sitzung über das Gateway oder über das Abonnement des Tools lief; Abo-Nutzung wird zum Listenpreis bewertet und separat ausgewiesen, aber nie abgerechnet oder budgetiert. Die Verteilung erfolgt per Device-Code-Login oder mit Enrollment-Tokens über Intune, macOS-Richtlinie oder Linux-Skript; übertragen wird nur eine fest kodierte Allow-List ohne Prompts. Cursor, Windsurf, Aider und Cline deckt der Companion derzeit nicht ab.

Provider, Dialekte und Modelle

Bei der Breite liegt Vercel vorn. Die Provider-Tabelle der Dokumentation nennt mehrere Dutzend Anbieter, von Anthropic, OpenAI, Google, Azure und Bedrock bis zu Spezialanbietern wie Groq oder Cerebras; der Anbieter spricht von „hundreds of models“. Aus Europa erscheint Mistral in der Tabelle; STACKIT, IONOS und Aleph Alpha sind dort nicht als Provider aufgeführt. Eingehend werden die OpenAI Chat Completions API, die Responses API und die Anthropic Messages API implementiert; als Modalitäten nennt Vercel unter anderem Text, Bild- und Videogenerierung, Sprache, Realtime, Embeddings und Reranking.

Das innFactory AI Gateway unterstützt 13 Provider-Typen, darunter OpenAI, Azure OpenAI, Azure AI Foundry, Anthropic (direkt oder Vertex), Gemini (inklusive Vertex-EU-Endpunkt), Mistral, AWS Bedrock, STACKIT, IONOS, Ollama, ElevenLabs und OpenAI-kompatible Endpunkte. Eingehend gibt es drei Dialekte (OpenAI, Anthropic, Gemini), Realtime-WebSockets für OpenAI, Azure OpenAI, ElevenLabs und Gemini Live, dazu Audio, Embeddings, Bilder und OCR. Wer viele Nischenanbieter braucht, findet bei Vercel den größeren Katalog; wer STACKIT oder IONOS anbinden will, findet sie bei uns.

Governance: Guardrails, MCP, Routing und Flow Builder

Vercel dokumentiert als Sicherheitsfunktionen Zero Data Retention (standardmäßig aktiv), eine Einstellung gegen Prompt-Training, eine Modell-Allowlist und eine teamweite Provider-Allowlist für die Pläne Pro und Enterprise. Das Routing ist gut ausgebaut: Standardmäßig wählt das Gateway Provider nach Verfügbarkeit und Latenz, pro Anfrage lassen sich order, only und sort nach cost, ttft oder tps setzen, dazu Modell-Fallbacks. Guardrails wie PII-Redaktion oder Prompt-Injection-Erkennung, ein Shadow-Modus, ein separates Audit-Log, generische Webhooks und ein visueller Flow-Editor sind auf den abgerufenen Seiten nicht dokumentiert. Vercel MCP ist ein Server zur Verwaltung der eigenen Plattform; ein gateway-seitiger MCP-Proxy für die Tools Ihrer Anwendungen war auf den abgerufenen AI-Gateway-Seiten nicht beschrieben.

Das innFactory AI Gateway bringt neun Guardrail-Regeltypen mit, von Secret-Erkennung und PII-Redaktion über Prompt Injection bis zum externen Webhook, mit Shadow-Modus und DSGVO-Preset. Der MCP-Proxy stellt Streamable-HTTP-Server bereit, mit acht Upstream-Auth-Modi (unter anderem OAuth PKCE je Nutzer, Entra On-Behalf-Of, AWS SigV4), Zugriffsrichtlinien, Toolsets und Guardrails auf Tool-Argumenten. Routing umfasst einen Auto-Router nach Prompt-Komplexität, Fallbacks und Deployment-Gruppen. Der Flow Builder ist ein visueller Graph mit neun Strategien, Guardrail-Knoten mit pass/block/fail-Zweigen und Ereignis-Triggern für Webhooks; ein Flow ist wie ein Modell aufrufbar und belastet dieselben Budgets. Konfiguriert wird als YAML, per Terraform-Provider oder in natürlicher Sprache über einen eingebauten MCP-Server.

Was Vercel AI Gateway besser kann

  • Coding-Agenten-Setup: Ein Befehl konfiguriert rund dreißig Agenten, mit eigenen Endpunkten für Claude Code, Codex und Cursor.
  • Katalogbreite: Mehrere Dutzend Provider und nach Angabe des Anbieters Hunderte Modelle, inklusive Bild-, Video- und Reranking-Modellen.
  • AI-SDK-Integration: Laut Dokumentation der Standard-Provider des AI SDK, sobald ein Modell als String angegeben wird.
  • Provider-Routing und Betrieb: Dynamische Auswahl nach Verfügbarkeit und Latenz, Sortierung nach Kosten, Time-to-first-token oder Durchsatz - ohne Proxy, Datenbank oder Routing-Steuerung im eigenen Betrieb.
  • Abrechnung und Zertifizierungen: Abrechnung über die bestehende Vercel-Rechnung; plattformweit nennt Vercel SOC 2 Type 2 und ISO 27001:2022.

Wann Vercel AI Gateway die richtige Wahl ist

  • Sie entwickeln mit dem AI SDK oder auf Vercel, wollen ohne eigene Infrastruktur starten und brauchen einen sehr breiten Modellkatalog.
  • Ihr Datenschutzkonzept erlaubt den Datenpfad über einen Drittanbieter, und Sie setzen die Inferenz-Region bewusst.
  • Budgets als weiche Obergrenzen in US-Dollar reichen für Ihre Steuerung aus.
  • Ihre Coding-Agenten laufen ohnehin über Gateway-Schlüssel und nicht über Abonnements.

Wann das innFactory AI Gateway die richtige Wahl ist

  • Das Gateway soll im eigenen Tenant laufen (Azure, STACKIT, Kubernetes), ohne Gateway-Betreiber im Anfragepfad.
  • Rollen und Kostenstellen kommen aus Entra ID oder Keycloak, in jeder Lizenzstufe.
  • Sie brauchen harte Budgetgrenzen je Mitglied, Euro-Anzeige und ein Fallback-Modell statt Fehlermeldung.
  • Sie wollen die Agent-Zeit von Claude Code, Codex und OpenCode je Repository und Kostenstelle sehen, auch bei Abo-Nutzung.
  • Guardrails, MCP-Proxy und Flow Builder sollen ein Stack mit CompanyGPT sein; STACKIT oder IONOS sollen als Provider angebunden werden.
  • Die Lizenz ist eine monatliche Pauschale nach Nutzerzahl (199 bis 749 EUR zzgl. USt.); Token-Kosten rechnen die Anbieter direkt ab.

Vergleich auf einen Blick

KriteriumVercel AI Gateway (laut Dokumentation, Stand 26.09.2026)innFactory AI Gateway
BetriebsmodellVerwalteter Dienst; Eigenbetrieb nicht dokumentiertIm eigenen Tenant: Azure, STACKIT, Kubernetes
DatenpfadÜber Vercel-Infrastruktur, auch bei BYOK; Inferenz-Region us/eu wählbarBleibt im eigenen Tenant
IdentitätAPI-Schlüssel, Vercel-OIDC-Tokens; SAML-SSO Enterprise, Pro als Add-onEntra ID, Keycloak, Cognito per OIDC; sieben Rollen, jede Lizenz
BudgetsTeam, Projekt, API-Schlüssel, Nutzer; soft cap, dann 402; BYOK ausgenommen; US-DollarOrganisation, Kostenstelle (Mitglieds-Caps hart), Nutzer, Schlüssel; 402 oder Fallback-Modell; EUR
Coding-AgentenRund 30 Agenten per Setup-Befehl; eigene Endpunkte für Claude Code, Codex, CursorSechs Proxy-Setups; Companion für Claude Code, Codex, OpenCode mit Agent-Zeit
Abo-Nutzung (Claude Max, Codex-Plan)Nicht dokumentiertErkannt, zum Listenpreis bewertet, nie abgerechnet
ProviderMehrere Dutzend, u. a. Mistral; STACKIT, IONOS nicht aufgeführt13 Typen inkl. STACKIT, IONOS, Bedrock, Vertex EU
GuardrailsZDR, Prompt-Training-Sperre, Modell- und Provider-Allowlist; PII-Redaktion nicht dokumentiertNeun Regeltypen, Shadow-Modus, DSGVO-Preset
MCPVercel MCP für Plattformverwaltung; gateway-seitiger Proxy nicht beschriebenMCP-Proxy mit acht Auth-Modi, Toolsets, Audit
Routingorder/only/sort (cost, ttft, tps), Modell-Fallbacks; visueller Editor nicht dokumentiertAuto-Router, Deployment-Gruppen, Flow Builder

Fazit

Vercel AI Gateway löst ein klares Problem gut: Entwicklerteams bekommen ohne eigene Infrastruktur einen sehr breiten Modellkatalog, robustes Provider-Routing und ein Setup für die gängigen Coding-Agenten. Wer den Datenpfad über einen verwalteten Dienst akzeptiert, hat damit eine stimmige Lösung.

Das innFactory AI Gateway beantwortet eine andere Frage: Wie bekommt ein Unternehmen Governance und FinOps für KI in den eigenen Tenant, mit Rollen aus dem eigenen Identity Provider, harten Budgetgrenzen und einer Messung, die auch die Agent-Zeit über Abonnements sichtbar macht? Beide Antworten sind legitim; welche passt, entscheidet sich an Betriebsmodell, Datenpfad und dem Grad an Steuerung, den Sie brauchen.

Nativ in CompanyGPT integriert, Stack wiederverwendbar

Das innFactory AI Gateway ist nativ in CompanyGPT integriert: Dieselben Budgets, Kostenstellen und Guardrails gelten für Chat, Agenten und Add-ons. Identität über Entra ID oder Keycloak, Kostenstellen, Guardrails und die MCP-Registry sind ein Stack, wiederverwendet in CompanyGPT, im Gateway und in Ihren eigenen Anwendungen. Das Gateway lässt sich ebenso eigenständig betreiben. Weitere Gegenüberstellungen finden Sie unter alle Vergleiche, die Produktübersicht unter AI Gateway.

Quellen

Abgerufen am 26. September 2026:

  • Vercel AI Gateway Produktseite — https://vercel.com/ai-gateway
  • Vercel AI Gateway Dokumentation, Übersicht — https://vercel.com/docs/ai-gateway
  • Vercel Blog: AI Gateway is now generally available — https://vercel.com/blog/ai-gateway-is-now-generally-available
  • Vercel Privacy Policy — https://vercel.com/legal/privacy-policy
  • Regional Inference — https://vercel.com/docs/ai-gateway/security-and-compliance/regional-inference
  • Security and Compliance — https://vercel.com/docs/ai-gateway/security-and-compliance
  • Budgets — https://vercel.com/docs/ai-gateway/observability-and-spend/budgets
  • Bring Your Own Key — https://vercel.com/docs/ai-gateway/authentication-and-byok/byok
  • OIDC Authentication — https://vercel.com/docs/ai-gateway/authentication-and-byok/oidc
  • Logs — https://vercel.com/docs/ai-gateway/observability-and-spend/logs
  • Pricing — https://vercel.com/docs/ai-gateway/pricing
  • Coding Agents — https://vercel.com/docs/ai-gateway/coding-agents
  • Anthropic Messages API — https://vercel.com/docs/ai-gateway/sdks-and-apis/anthropic-messages-api
  • OpenAI Chat Completions — https://vercel.com/docs/ai-gateway/sdks-and-apis/openai-chat-completions
  • Models and Providers — https://vercel.com/docs/ai-gateway/models-and-providers
  • Provider Options — https://vercel.com/docs/ai-gateway/models-and-providers/provider-options
  • Provider Filtering and Ordering — https://vercel.com/docs/ai-gateway/models-and-providers/provider-filtering-and-ordering
  • SAML Single Sign-On — https://vercel.com/docs/saml
  • Directory Sync — https://vercel.com/docs/directory-sync
  • Vercel Security and Compliance — https://vercel.com/docs/security/compliance

Hinweis zu den Angaben: Alle Aussagen über Produkte anderer Anbieter beruhen auf deren öffentlich zugänglicher Dokumentation zum angegebenen Stand. Anbieter entwickeln ihre Produkte, Funktionen und Konditionen laufend weiter — maßgeblich sind stets die aktuellen Angaben des jeweiligen Anbieters. Sollte Ihnen eine Angabe veraltet oder unzutreffend erscheinen, schreiben Sie uns kurz an info@innfactory.ai; wir prüfen und korrigieren zeitnah. Dieser Vergleich ersetzt keine Rechts- oder Datenschutzberatung im Einzelfall.

Weiterführende Artikel

Tobias Jonas
Geschrieben von

Tobias Jonas

Co-CEO, M.Sc.

Tobias Jonas, M.Sc. ist Mitgründer und Co-CEO der innFactory AI Consulting GmbH. Er ist ein führender Innovator im Bereich Künstliche Intelligenz und Cloud Computing. Als Co-Founder der innFactory GmbH hat er hunderte KI- und Cloud-Projekte erfolgreich geleitet und das Unternehmen als wichtigen Akteur im deutschen IT-Sektor etabliert. Dabei ist Tobias immer am Puls der Zeit: Er erkannte früh das Potenzial von KI Agenten und veranstaltete dazu eines der ersten Meetups in Deutschland. Zudem wies er bereits im ersten Monat nach Veröffentlichung auf das MCP Protokoll hin und informierte seine Follower am Gründungstag über die Agentic AI Foundation. Neben seinen Geschäftsführerrollen engagiert sich Tobias Jonas in verschiedenen Fach- und Wirtschaftsverbänden, darunter der KI Bundesverband und der Digitalausschuss der IHK München und Oberbayern, und leitet praxisorientierte KI- und Cloudprojekte an der Technischen Hochschule Rosenheim. Als Keynote Speaker teilt er seine Expertise zu KI und vermittelt komplexe technologische Konzepte verständlich.

LinkedIn