Das Wichtigste in Kürze (Stand 26.09.2026):
- Bifrost von Maxim AI ist laut Dokumentation ein in Go geschriebenes, selbst betriebenes AI Gateway (Binary, Docker-Image oder Helm-Chart), dessen Kern unter der Apache-Lizenz 2.0 steht, während SSO, RBAC, Guardrails, Audit-Logs, Clustering und In-VPC-Support laut Anbieter einem separat lizenzierten Enterprise-Tier zugeordnet sind.
- Das innFactory AI Gateway wird in den Cloud-Tenant des Kunden ausgerollt und bündelt Kostenstellen mit Per-Member-Caps, Budgets in Euro und einen Companion, der die Agent-Zeit von Claude Code, Codex und OpenCode je Repository misst, auch für Abo-Nutzung.
- Laut Dokumentation führt Bifrost Budgets je Customer, Team, Virtual Key und Provider-Konfiguration und protokolliert Agenten-Anfragen serverseitig im Gateway-Log; ein lokaler Companion, der Agent-Zeit unabhängig vom Gateway-Log erfasst, ist laut Bifrost-Dokumentation (Stand 26.09.2026) nicht beschrieben, während das innFactory AI Gateway SSO, sieben Rollen und Guardrails in jeder Lizenzstufe enthält und den Companion mitbringt.
- Bifrost passt, wenn Sie Kubernetes ohnehin betreiben, ein Gateway per Helm selbst verantworten und SAML, SCIM, Air-Gapped-Betrieb oder externe Guardrail-Anbieter brauchen; das innFactory AI Gateway passt, wenn Kostenstellen mit Caps je Mitglied, EUR zum EZB-Kurs, Agent-Zeit inklusive Abo-Nutzung und der Flow Builder im Vordergrund stehen und Sie den Rollout nicht selbst bauen wollen.
Bifrost ist ein quelloffenes AI Gateway von Maxim AI. Die Dokumentation beschreibt es nach eigener Angabe als „A high-performance AI gateway unifying 20+ providers through a single OpenAI-compatible API“ - ein in Go geschriebener Proxy, den Sie selbst betreiben. Als Binary, Docker-Image oder Helm-Chart in der eigenen Infrastruktur betrieben und bei Bedarf um ein Enterprise-Tier ergänzt, ist Bifrost ein solides, breit dokumentiertes Produkt.
Das innFactory AI Gateway setzt anders an: keine Bibliothek zum Selbstbetrieb, sondern eine Infrastrukturkomponente, die innFactory in Ihren Cloud-Tenant ausrollt - mit einer FinOps-Schicht aus Kostenstellen, Member-Caps und EUR-Anzeige und einem Companion, der die Arbeitszeit von Coding-Agenten auch dann erfasst, wenn sie über ein Abo laufen und das Gateway nie sehen.
Die Entscheidung lautet also nicht „welches Gateway ist besser“, sondern: Open-Source-Kern mit Enterprise-Erweiterungen selbst betreiben - oder eine Governance- und FinOps-Komponente im eigenen Tenant, die mit CompanyGPT den Stack teilt?
Was Bifrost ist
Bifrost wird von Maxim AI entwickelt; Rechtsträger ist laut Datenschutzerklärung die H3 Labs Inc mit Sitz in Mountain View, Kalifornien. Der Kern steht unter der Apache-Lizenz 2.0 („Copyright 2025 H3 Labs Inc.“). Eine Übernahme ist nicht dokumentiert.
Open Source sind laut Preisseite unter anderem Routing, Fallbacks, Virtual Keys, Budgets, MCP-Gateway, semantisches Caching und Observability. Daneben gibt es ein separat lizenziertes Enterprise-Tier: „Enterprise features such as adaptive load balancing, clustering, guardrails, RBAC, SSO, audit logs, and in-VPC support are licensed separately.“ Ein großer Teil dessen, was Unternehmen unter Governance verstehen, liegt bei Bifrost also im Enterprise-Tier.
Betriebsmodell: SaaS, Self-Hosting oder Infrastruktur im eigenen Tenant
Bifrost betreiben Sie selbst: laut README per npx -y @maximhq/bifrost oder docker run maximhq/bifrost, dazu ein Go-SDK. Für Kubernetes dokumentiert der Anbieter ein Helm-Chart mit Beispielwerten bis hin zu Produktions-HA. Das Enterprise-Tier ergänzt einen Cluster-Modus („Peer-to-peer clustering where every instance is equal“) sowie In-VPC-, Air-Gapped- und Multi-Cloud-Betrieb. Ein vom Anbieter gehostetes Gateway als SaaS haben wir nicht gefunden; der Anbieter betont: „Keep all request data within your own infrastructure.“
Das innFactory AI Gateway läuft ebenfalls bei Ihnen, aber mit anderem Betriebsmodell: innFactory hostet nicht, sondern rollt das Gateway als cloud-native Komponente in Ihren Tenant aus - Referenzpfad Azure Container Apps oder AKS, alternativ STACKIT oder beliebiges Kubernetes. Das Backend ist ein Rust-Binary im Container plus Dashboard-Image, als Datenbank dienen PostgreSQL (etwa STACKIT PostgreSQL Flex), MongoDB oder Azure Cosmos DB; der Datenpfad bleibt im Tenant, die Konfiguration als YAML oder Terraform bei Ihnen. Die innFactory GmbH begleitet als Microsoft CSP den Rollout und kann die Azure-Subscription stellen. Ein Helm-Chart liefern wir derzeit nicht; hier ist Bifrost für Kubernetes-Teams unmittelbarer.
Identität, SSO und Rollen
Bifrost bindet laut Dokumentation Identity Provider über OIDC an - Okta, Microsoft Entra, Keycloak, Zitadel, Auth0, Google Workspace „or any OIDC provider“, mit Authorization Code plus PKCE. Dazu kommen SAML und Inbound SCIM 2.0 über eine /scim/v2-API. Rollen: Admin, Developer, Viewer und eigene Rollen. All das ordnet die Preisseite dem Enterprise-Tier zu; eine SSO-Nutzergrenze im Open-Source-Umfang ist nicht dokumentiert. Modelle, Budgets und Limits werden über Virtual Keys „per user, team, or business unit“ zugewiesen.
Beim innFactory AI Gateway ist die Identitätsanbindung Teil jeder Lizenzstufe: Microsoft Entra ID oder generisches OIDC (Keycloak dokumentiert, AWS-Cognito-Claims verarbeitet), OIDC/JWT auf dem Proxy-Pfad optional. Sieben Rollen - Owner, Admin, Auditor, Finance, Security, Member, Guest - mit IdP-Gruppen-Mapping. Finance sieht Kosten und Margen, Security Guardrails und Audit-Log; Kostenstellen haben eigene Administratoren, fremde E-Mail-Domains landen automatisch als Guest ohne Proxy-Zugriff. SAML und SCIM sind bei uns nicht enthalten; wer sie zwingend braucht, findet bei Bifrost im Enterprise-Tier den breiteren Katalog.
Kostenkontrolle und AI-FinOps
Bifrost organisiert Budgets laut Dokumentation in einer Hierarchie aus Customer, Team, Virtual Key und Provider-Konfiguration; jede Ebene hat ein eigenes Budget. Eine Anfrage läuft nur, wenn auf jeder betroffenen Ebene Guthaben vorhanden ist, danach werden die Kosten von allen Ebenen abgezogen. Reset-Fenster reichen von einer Minute bis zu einem Jahr, kalendarisch an UTC ausgerichtet. Basis-Budgets mit Virtual Keys sind Open Source; hierarchische Budgets, Alerts („on Email, Slack, PagerDuty, Teams, Webhook and more“), Log-Exporte und Audit-Logs sind Enterprise. Nicht dokumentiert sind Währung, Kostenausweisung pro Anfrage und die Quelle der Modellpreise.
Das innFactory AI Gateway ist hier bewusst tiefer gebaut. Vier unabhängige Gates prüfen jede Anfrage: Organisation (monatlich), Kostenstelle (monatlich plus Tages- und Wochenfenster, im Pool- oder Pro-Nutzer-Modus mit Caps je Mitglied), Nutzer und API-Key. Jedes Gate antwortet bei Erschöpfung mit HTTP 402 und Fehlercode E4006, optional greift ein Budget-Fallback-Modell; Member-Caps sind immer harte Stopps. Dazu Caps pro Modell, TPM- und RPM-Limits, Alerts bei 80 und 90 Prozent und ein budget_exceeded-Event für Flows und Webhooks. Kosten werden nach Nutzer, Key, Team, Kostenstelle, Modell, Provider, Tool, Repository und Abrechnungsquelle (Gateway oder Abo) zugeordnet, intern in USD-Mikrodollar geführt und in EUR zum EZB-Tageskurs angezeigt; Modellpreise stammen von ai-prices.eu und werden erst nach Admin-Freigabe übernommen. Jede gepufferte Antwort trägt den Header x-aigateway-response-cost, Insights und CSV-Export enthalten auch Agent- und LLM-Zeit.
Coding-Agenten, Abos und Agent-Zeit
Bifrost dokumentiert Integrationen für Claude Code, Codex CLI, Gemini CLI, Qwen Code, Opencode, GitHub Copilot, Cursor, Zed, Roo Code, LibreChat, Open WebUI, Claude for Office und Claude Desktop. Eine eigene Bifrost CLI verbindet Agenten „with one command“ mit dem Gateway. Gemessen wird serverseitig: „All agent interactions are automatically logged and can be monitored at http://localhost:8080/logs.“ Laut der Dokumentation von Bifrost (Stand 26.09.2026) ist ein lokaler Companion, der Agent-Arbeitszeit unabhängig vom Gateway-Log erfasst, nicht beschrieben; ebenso wenig ein MDM-Rollout einer Client-Komponente.
Das innFactory AI Gateway bietet sechs Proxy-Setups: Claude Code, Codex, OpenCode, Cowork (macOS-.mobileconfig, Windows-.reg), VS Code Continue und VS Code Copilot (BYOK). Admins legen Vorlagen an, jeder Entwickler klont sie mit eigenem Key und eigener Kostenstelle; aigw run claude|codex|opencode startet das Tool mit kurzlebigem Proxy-Token.
Der eigentliche Unterschied ist der Companion aigw: ein kleiner Hintergrunddienst für Linux, macOS und Windows, der die lokalen Session-Logs von Claude Code, Codex und OpenCode liest und Agent-Zeit, LLM-Zeit und Token-Klassen je Repository, Nutzer, Tool und Kostenstelle meldet. Er erkennt, ob eine Session über das Gateway oder über das Abo des Tools lief (Claude Max, Codex-Plan); Abo-Nutzung wird als Shadow-Token zum Listenpreis bewertet, aber nie abgerechnet, budgetiert oder limitiert und immer getrennt ausgewiesen. Der Rollout läuft per Device-Code-Login oder mit Enrollment-Tokens über Intune, macOS-Richtlinie oder Linux-Skript; hochgeladen wird eine im Code fixierte Allow-List ohne Prompts, absolute Pfade oder Remote-URLs mit Zugangsdaten. Andere Tools wie Cursor oder Gemini CLI deckt der Companion nicht ab, und die Binaries sind noch nicht code-signiert.
Provider, Dialekte und Modelle
Bifrost ist hier breiter. Die Dokumentation nennt über 20 Provider und mehr als 1000 Modelle, darunter Anthropic, Azure, Bedrock, Cohere, DeepSeek, ElevenLabs, Gemini, Groq, Mistral, Ollama, OpenAI, OpenRouter, Runway, Vertex AI, vLLM und xAI. STACKIT und IONOS sind in der Provider-Referenz (Stand 26.09.2026) nicht aufgeführt. Primäre Schnittstelle ist die OpenAI-kompatible API; laut Dokumentation gibt es außerdem einen Anthropic-Messages-kompatiblen Modus und die Responses API. Als Drop-in versteht sich Bifrost für die SDKs von OpenAI, Anthropic, Bedrock und Google GenAI.
Das innFactory AI Gateway kennt 13 Provider-Typen: OpenAI, Azure OpenAI, Azure AI Foundry, Anthropic (direkt oder Vertex), Gemini (AI Studio oder Vertex inklusive EU-Endpunkt), Mistral, AWS Bedrock inklusive Mantle, STACKIT, IONOS, Ollama, LM Studio, ElevenLabs und OpenAI-kompatible Endpunkte. Drei eingehende Dialekte - OpenAI, Anthropic, Gemini -, dazu Realtime-WebSocket inklusive Gemini Live über Vertex EU, Audio, Embeddings, Bilder, OCR sowie Files und Batches. Wer viele Spezialanbieter braucht, ist bei Bifrost besser aufgehoben; wer STACKIT oder IONOS als souveräne Provider will, findet sie bei uns.
Governance: Guardrails, MCP, Routing und Flow Builder
Guardrails. Bei Bifrost Teil des Enterprise-Tiers: PII-Erkennung und -Redaktion auf Basis von Presidio, Prompt-Injection-Erkennung, Jailbreak-Schutz über Azure Content Safety sowie Anbindungen an AWS Bedrock Guardrails, Google Model Armor und Patronus AI. Die Redaktionsmodi runtime, logs_only und runtime_reversible sind klar beschrieben; ein benannter Shadow-Modus ist nicht dokumentiert. Das Audit-Log beschreibt der Anbieter als auf Rahmenwerke wie SOC 2, DSGVO, HIPAA und ISO 27001 ausgerichtet.
Das innFactory AI Gateway bringt neun Regeltypen in jeder Lizenz mit - Secret-Erkennung, PII blockieren oder redigieren, verbotene Keywords, Token-Limit inklusive Maximalkosten, Azure Content Safety, Prompt Injection, verbotene Themen, Groundedness, externer Webhook - mit den Aktionen block, redact, warn und audit, Shadow Mode, Redaktion mitten im Stream, DSGVO-Preset und /check-Dry-Run.
MCP. Bifrost hat ein natives MCP-Gateway: Server werden einmal registriert, das Gateway authentifiziert sich per OAuth 2.0 auf Server- oder Nutzerebene und begrenzt Tool-Zugriff über Virtual Keys und SSO-Rollen; das Basis-Gateway ist Open Source, „MCP with Federated Auth“ Enterprise. Unser MCP-Proxy kennt acht Upstream-Auth-Modi - von statischen Headern über Per-User-PKCE und Entra On-Behalf-Of bis AWS SigV4 - plus Toolsets, semantische Tool-Suche, Guardrails auf Tool-Argumente und Audit pro Aufruf.
Routing und Flows. Bifrost verteilt laut Dokumentation Anfragen gewichtet je Virtual Key, legt Fallback-Ketten automatisch an und stuft Prompts per Complexity Router in drei Stufen ein; Enterprise ergänzt Adaptive Load Balancing. Konfiguriert wird über Web-UI, API oder config.json; ein visueller Flow Builder ist nicht dokumentiert. Das innFactory AI Gateway hat Auto-Router, Aliase, Fallbacks und Deployment-Gruppen - und darüber den Flow Builder: ein visueller Graph mit neun Strategien (darunter least_cost, cost_cascade, capability_match), Guardrail-Knoten mit pass/block/fail-Verzweigung und Event-Triggern, die Webhooks auslösen. Ein Flow ist wie ein Modell aufrufbar und belastet dieselben Budgets.
Was Bifrost besser kann
- Provider-Breite: über 20 dokumentierte Provider inklusive Bild, Video, Sprache und Inference-Plattformen wie vLLM.
- Kubernetes: Helm-Chart mit Beispielwerten und Enterprise-Cluster-Modus.
- Deployment: In-VPC-, Air-Gapped- und Multi-Cloud-Betrieb.
- Identität: SAML zusätzlich zu OIDC, Inbound SCIM 2.0.
- Externe Guardrail-Anbieter: AWS Bedrock Guardrails, Google Model Armor, Patronus AI.
- Secret-Manager: HashiCorp Vault, AWS, Google und Azure Key Vault im Enterprise-Tier.
- Agenten-Ökosystem: Anleitungen für 13 Agenten und Oberflächen plus eigene CLI.
- Support: SLA-gestützter Enterprise-Support laut Preisseite.
Wann Bifrost die richtige Wahl ist
- Sie betreiben Kubernetes ohnehin und wollen ein Gateway per Helm ausrollen, das Ihr Team selbst verantwortet.
- Sie brauchen SAML oder SCIM und lizenzieren dafür das Enterprise-Tier.
- Sie binden viele Spezialanbieter an - Inference-Plattformen, Bild- und Videomodelle.
- Sie nutzen bereits Guardrail-Dienste von AWS, Google oder Patronus.
- Sie brauchen Air-Gapped-Betrieb.
Wann das innFactory AI Gateway die richtige Wahl ist
- Sie wollen wissen, wie viel Arbeitszeit Coding-Agenten leisten - auch über Claude Max oder Codex-Plan.
- Sie brauchen Kostenstellen mit Caps je Mitglied, EUR zum EZB-Kurs und Kosten pro Anfrage.
- Sie wollen SSO, sieben Rollen und Guardrails in jeder Lizenzstufe.
- Sie wollen Routing, Guardrails und Webhooks visuell im Flow Builder modellieren.
- Sie nutzen CompanyGPT und wollen einen gemeinsamen Stack aus Identität, Kostenstellen, Guardrails und MCP-Registry.
- Sie wollen das Gateway im eigenen Tenant, den Rollout aber nicht selbst bauen.
Vergleich auf einen Blick
| Kriterium | Bifrost (laut Dokumentation, Stand 26.09.2026) | innFactory AI Gateway |
|---|---|---|
| Lizenz | Kern Apache 2.0; Enterprise-Tier separat lizenziert | Monatliche Lizenz nach Nutzerzahl, ab 199 EUR |
| Betrieb | Selbst: npx, Docker, Helm; Enterprise mit Cluster-Modus, In-VPC, Air-Gapped | In den Kunden-Tenant ausgerollt; kein Helm-Chart |
| Identität | OIDC, SAML, SCIM 2.0 - Enterprise; Rollen Admin, Developer, Viewer, eigene | OIDC in jeder Lizenz; sieben Rollen; kein SAML/SCIM |
| Budgets | Customer, Team, Virtual Key, Provider-Config; Fenster 1 Minute bis 1 Jahr | Organisation, Kostenstelle (Member-Caps), Nutzer, API-Key; 402/E4006; Fallback-Modell |
| Währung, Kosten je Anfrage | Nicht dokumentiert | EUR zum EZB-Tageskurs; x-aigateway-response-cost |
| Coding-Agenten | 13 Integrationen, Bifrost CLI; Messung über Gateway-Logs | Sechs Proxy-Setups; Companion misst Agent-Zeit inkl. Abo-Nutzung |
| Provider | Über 20; STACKIT/IONOS nicht aufgeführt | 13 Typen inkl. STACKIT, IONOS, Vertex EU |
| Guardrails | Enterprise; Presidio-PII, externe Anbieter | Neun Regeltypen, Shadow Mode, in jeder Lizenz |
| Routing und Flows | Gewichtet, Fallbacks, Complexity Router; visueller Flow Builder nicht dokumentiert | Auto-Router, Deployment-Gruppen, Flow Builder mit neun Strategien |
| Chat-Plattform | LibreChat und Open WebUI dokumentiert | Nativ in CompanyGPT integriert |
Fazit
Bifrost ist ein gutes Produkt für Teams, die ein AI Gateway als Open-Source-Baustein in die eigene Kubernetes- oder VPC-Landschaft stellen und Governance bei Bedarf über das Enterprise-Tier hinzunehmen. Provider-Breite, Helm-Chart, SAML, SCIM und Anbindungen an AWS Bedrock Guardrails, Google Model Armor und Patronus AI hat Bifrost, wir derzeit nicht.
Das innFactory AI Gateway ist die richtige Wahl, wenn die Frage nicht „welcher Proxy“, sondern „wer bezahlt was, und wie viel Agentenarbeit findet wirklich statt“ lautet. Kostenstellen mit Member-Caps, EUR zum EZB-Kurs, der Companion für Agent-Zeit inklusive Abo-Nutzung und der Flow Builder beantworten genau das - als Komponente in Ihrem Tenant, ausgerollt von innFactory.
Nativ in CompanyGPT integriert, Stack wiederverwendbar
Das AI Gateway ist nativ in CompanyGPT integriert: Dieselben Budgets, Kostenstellen und Guardrails gelten für Chat, Agenten und Add-ons. Identität über Entra ID oder Keycloak, Kostenstellen, Guardrails und die MCP-Registry sind ein Stack, der in CompanyGPT, im Gateway und in Ihren eigenen Tools wiederverwendet wird. Das Gateway läuft auf Wunsch auch eigenständig. Weitere Gegenüberstellungen finden Sie unter alle Vergleiche, die Produktseite unter AI Gateway.
Quellen
Abgerufen am 26. September 2026:
- Bifrost Produktseite —
https://getmaxim.ai/bifrost - Bifrost Repository und README —
https://github.com/maximhq/bifrost - Bifrost LICENSE (Apache 2.0) —
https://github.com/maximhq/bifrost/blob/main/LICENSE - Bifrost Dokumentation, Startseite —
https://docs.getbifrost.ai - Bifrost Dokumentation, Overview —
https://docs.getbifrost.ai/overview - Bifrost Pricing (Tier-Umfang) —
https://www.getmaxim.ai/bifrost/pricing - Bifrost Enterprise —
https://www.getmaxim.ai/bifrost/enterprise - Enterprise Deployment —
https://www.getmaxim.ai/bifrost/resources/enterprise-deployment - Helm Deployment Guide —
https://docs.getbifrost.ai/deployment-guides/helm - Enterprise Governance (SSO, SCIM, Rollen) —
https://docs.getbifrost.ai/enterprise/governance - Budgets und Limits —
https://docs.getbifrost.ai/features/governance/budget-and-limits - Routing —
https://docs.getbifrost.ai/features/governance/routing - Guardrails —
https://docs.getbifrost.ai/enterprise/guardrails - MCP Gateway —
https://www.getmaxim.ai/mcp-gateway - CLI Agents Overview —
https://docs.getbifrost.ai/cli-agents/overview - Supported Providers —
https://docs.getbifrost.ai/providers/supported-providers - Anthropic SDK Integration —
https://docs.getbifrost.ai/integrations/anthropic-sdk/overview - Changelog v2.0.0 (Responses API) —
https://docs.getbifrost.ai/changelogs/v2.0.0 - Maxim AI Privacy Policy (Rechtsträger) —
https://getmaxim.ai/privacy-policy
Hinweis zu den Angaben: Alle Aussagen über Produkte anderer Anbieter beruhen auf deren öffentlich zugänglicher Dokumentation zum angegebenen Stand. Anbieter entwickeln ihre Produkte, Funktionen und Konditionen laufend weiter — maßgeblich sind stets die aktuellen Angaben des jeweiligen Anbieters. Sollte Ihnen eine Angabe veraltet oder unzutreffend erscheinen, schreiben Sie uns kurz an info@innfactory.ai; wir prüfen und korrigieren zeitnah. Dieser Vergleich ersetzt keine Rechts- oder Datenschutzberatung im Einzelfall.
Weiterführende Artikel
- AI Gateway – Proxy, FinOps-Schicht und Companion im Überblick
- CompanyGPT – die Chat-Plattform, mit der das Gateway den Stack teilt
- Claude Code als AI Harness – der Coding-Agent, den der Companion misst
- AI Harness erklärt – Grundlagen zu Agenten-Harnesses
- Alle Vergleiche zum AI Gateway – LiteLLM, OpenRouter, Portkey, Cloudflare, Kong, Bifrost, TrueFoundry, Helicone, Vercel
- AI Gateway vs. LiteLLM
- AI Gateway vs. Helicone
- AI Gateway vs. Kong AI Gateway
