Als KI-Beratung aus Rosenheim ordnen wir auf dieser Seite das Angebot von Aleph Alpha ein: das Heidelberger Unternehmen, das 2019 mit eigenen Sprachmodellen gestartet ist, 2024 den Schwerpunkt auf die Enterprise-Plattform PhariaAI verlagert hat, seit September 2026 die Fusion mit Cohere vorbereitet und am 3. Oktober 2026 mit Kolibri-1 wieder ein eigenes Modell mit offener Lizenz veröffentlicht hat. Grundlage sind die Modellkarten auf Hugging Face, die PhariaAI-Dokumentation, die Unternehmenswebsite und die Ankündigungen zur Cohere-Fusion. Stand dieser Übersicht: Oktober 2026.
Aleph Alpha auf einen Blick
| Sitz | Heidelberg; weitere Standorte laut Website Berlin, Bayreuth, München |
| Gegründet | 2019 von Jonas Andrulis und Samuel Weinbach |
| Führung | Ilhan Scheer (CEO), Samuel Weinbach und Yasser Jadidi (Co-Chief Research Officers) |
| Investor | Schwarz-Gruppe und Dieter Schwarz Stiftung als Co-Leads der Finanzierungsrunde vom November 2023 |
| Referenzen laut Website | Bundesagentur für Arbeit, Land Baden-Württemberg, Bundesministerium für Digitales und Verkehr, Deutsche Bank, SAP, Infineon, Hella |
| Aktuelles Modell | Kolibri-1 (3. Oktober 2026), Apache 2.0 |
| Plattform | PhariaAI v1.260900.0 (Assistant, Studio, OS, Catch, Government Assistant) |
| Unternehmensstatus | Definitive Fusionsvereinbarung mit Cohere vom 16. September 2026, Vollzug ausstehend |
Aleph Alpha unterliegt als deutsches Unternehmen deutschem und europäischem Recht. Das Unternehmen positioniert sich laut Website für „Mission Critical Environments“ in Behörden, Automobil, Finanzdienstleistungen und Halbleiterfertigung; Kernversprechen ist der Betrieb auf Infrastruktur, die der Kunde kontrolliert.
Modellportfolio: von Luminous zu Kolibri-1
| Modell | Jahr | Architektur | Kontext | Lizenz | Status |
|---|---|---|---|---|---|
| Kolibri-1 | Okt. 2026 | MoE, 78,1 Mrd. / 3,46 Mrd. aktiv | 1.048.576 | Apache 2.0 | aktuell, empfohlen |
| Pharia-1 LLM-7B | 2024 | dense, 7,04 Mrd. | 8.192 | Open Aleph License (nicht-kommerziell) | aktuell, PhariaAI-Standardmodell |
| T-Free HAT (Llama 3.1 8B/70B) | 2025 | tokenizer-frei auf Llama-Backbone | wie Llama 3.1 | Open Aleph License | Forschung |
| Luminous Base/Extended/Supreme | 2022 bis 2024 | dense, bis ~70 Mrd. | 2.048 | proprietär | nicht mehr vermarktet |
Luminous war die erste Modellfamilie, angeboten über eine eigene API aus deutschen Rechenzentren und mit Erklärbarkeitsfunktionen. Im September 2024 verlagerte Aleph Alpha den Schwerpunkt vom Modellgeschäft auf die Plattform PhariaAI; Luminous wird seitdem nicht mehr für Neukunden vermarktet, und die frühere Entwicklerdokumentation leitet auf die PhariaAI-Dokumentation um. Pharia-1 LLM-7B erschien im selben Jahr als dichtes 7-Milliarden-Modell für sieben europäische Sprachen. Wichtig für die Einordnung: Die Gewichte liegen zwar offen auf Hugging Face, die Open Aleph License erlaubt aber nur nicht-kommerzielle Forschungs- und Bildungsnutzung. Produktiver Einsatz läuft über eine Vereinbarung mit Aleph Alpha, in der Regel über PhariaAI.
Mit den T-Free-Modellen (Januar 2025, 70B-Variante September 2025) hat Aleph Alpha Research eine tokenizer-freie Architektur veröffentlicht: Ein Zeichen-Encoder und -Decoder umschließen ein Wort-Backbone auf Basis von Llama 3.1. Aleph Alpha berichtet bessere Kompression und Anpassbarkeit an neue Sprachen sowie Vorteile auf deutschen Benchmarks; die Modellkarte bezeichnet die Veröffentlichung als frühes Forschungsergebnis mit nicht optimierter Inferenz. Kolibri-1 setzt diese Architektur nicht fort, sondern nutzt einen klassischen UniBPE-Tokenizer mit 128.000 Einträgen.
Kolibri-1 ist seit dem 3. Oktober 2026 das aktuelle Modell: ein von Grund auf trainierter deutsch-englischer Mixture-of-Experts-Transformer mit 78,1 Milliarden Parametern (3,46 Milliarden aktiv), 1 Million Token Kontext, vier Reasoning-Stufen, Tool-Calling und Apache-2.0-Lizenz. Laut Tech Report liegt es bei den Gesamtwerten in Deutsch (70,8) und Englisch (75,5) vor den offenen MoE-Modellen seiner Klasse, mit Schwächen bei geschlossenem Faktenwissen und mehrstufigem Tool-Calling. Architektur, Benchmarks, Hardware und Betrieb beschreiben wir ausführlich auf der Kolibri-1-Seite.
PhariaAI: die Enterprise-Plattform
PhariaAI ist seit 2024 das Hauptprodukt von Aleph Alpha und laut Dokumentation aktuell in Version v1.260900.0 verfügbar. Die Bausteine:
- PhariaAssistant: Chat-Oberfläche mit vorgefertigten Werkzeugen und Workflows für Fachanwender.
- PhariaStudio: Entwicklungsumgebung, in der Teams KI-Anwendungen bauen, testen und auswerten.
- PhariaOS: Betriebsschicht zum Ausrollen und Skalieren der Workloads auf eigener Infrastruktur.
- PhariaCatch: Erfassung und Bewahrung von Wissen aus der Zusammenarbeit von Mensch und Maschine.
- Pharia Government Assistant (Version PGA 2025.08.20): Variante für Behörden.
Als Modell nennt die Dokumentation Pharia-1 LLM-7B. Die Plattform ist für den Betrieb im eigenen Rechenzentrum oder in einer souveränen Cloud ausgelegt; mit STACKIT besteht seit der Finanzierungsrunde 2023 eine Partnerschaft, die laut Cohere-Ankündigung das „technische Rückgrat“ des gemeinsamen Angebots bilden soll. Ob und wann Kolibri-1 als Modell in PhariaAI dokumentiert wird, ist derzeit nicht ersichtlich.
Fusion mit Cohere
Am 24. April 2026 haben das kanadische KI-Unternehmen Cohere und Aleph Alpha den geplanten Zusammenschluss angekündigt, am 16. September 2026 folgte laut gemeinsamer Mitteilung die definitive Fusionsvereinbarung. Die Eckpunkte laut Ankündigungen:
- Marke und Struktur: Das kombinierte Unternehmen tritt weltweit als Cohere auf, mit Doppel-Hauptsitz in Berlin und Toronto; Heidelberg bleibt Forschungszentrum. Zusammen mehr als 1.000 Mitarbeitende auf beiden Kontinenten.
- Führung: Mit Vollzug wird Aleph-Alpha-CEO Ilhan Scheer Chief Operating Officer von Cohere, Mitgründer Samuel Weinbach Chief Research Officer; Aidan Gomez bleibt CEO.
- Bewertung und Investor: Medienberichte nennen übereinstimmend eine Gesamtbewertung von rund 20 Mrd. USD; die Schwarz-Gruppe beteiligt sich laut Cohere mit 600 Mio. USD an Coheres kommender Series-E-Runde. Laut der Ankündigung vom April halten Aleph-Alpha-Aktionäre rund 10 Prozent am kombinierten Unternehmen.
- Positionierung: „erste transatlantische Sovereign-AI-Lösung“ für Regierungen und regulierte Branchen in Europa und Kanada, bereitgestellt auf STACKIT.
- Produktroadmap: Im April war ein vereinheitlichtes Modell Command-Pharia 1 für Q4 2026 angekündigt; die September-Mitteilung verweist auf weitere Produktdetails. Kolibri-1 erschien unabhängig davon unter der Marke Aleph Alpha Research.
- Vollzug: erwartet im weiteren Jahresverlauf 2026, vorbehaltlich behördlicher Freigaben in beiden Rechtsräumen.
Für Kunden gilt bis zum Vollzug: Beide Unternehmen operieren rechtlich getrennt, laufende Verträge bleiben bestehen. Für neue Projekte empfehlen wir, Modell- und Plattformroadmap des kombinierten Unternehmens aktiv zu verfolgen, insbesondere das Verhältnis von Kolibri-1 zu Coheres Command-Modellen.
Datenschutz, Souveränität und Betrieb
Der Souveränitätsanspruch von Aleph Alpha beruht auf drei Punkten: Das Unternehmen sitzt in Deutschland, die Modelle werden auf europäischer Infrastruktur trainiert (Kolibri-1 laut Tech Report in Deutschland und Finnland), und der Betrieb findet auf Infrastruktur des Kunden statt. Für Kolibri-1 beschreibt der Tech Report zudem eine Datenpipeline, die mit Blick auf EU AI Act, GPAI-Verhaltenskodex und DSGVO illegale, schädliche und raubkopierte Inhalte filtert und personenbezogene Daten entfernt.
Drei Punkte sollten Sie vor einer Entscheidung prüfen:
- Lizenz: Nur Kolibri-1 steht unter Apache 2.0. Pharia-1 und die T-Free-Modelle dürfen ohne Vereinbarung mit Aleph Alpha nur nicht-kommerziell genutzt werden.
- Betriebsweg: Eine öffentliche Pay-per-Token-API bietet Aleph Alpha Neukunden nicht an. Die Wahl liegt zwischen Self-Hosting der offenen Gewichte, PhariaAI im eigenen Rechenzentrum und dem angekündigten STACKIT-Angebot.
- Hardware: Kolibri-1 braucht in FP8 rund 78 GB GPU-Speicher (zwei H100 oder eine H200/B200), Pharia-1 läuft auf einer einzelnen GPU.
| Modell | GPU-Speicher | Beispielkonfiguration |
|---|---|---|
| Kolibri-1 (FP8) | ~78 GB | 2× H100 SXM5 / 2× A100 80 GB / 1× H200 / 1× B200 |
| Pharia-1 LLM-7B | ~14 GB | 1× L40S / RTX 4090 / A10 |
Einsatzbereiche
Aleph Alpha adressiert Organisationen, die sensible Daten unter Regulierung verarbeiten:
- Öffentliche Verwaltung: Bundes-, Landes- und Kommunalbehörden (Referenzen laut Website: Bundesagentur für Arbeit, Land Baden-Württemberg, BMDV).
- Industrie: Automobilzulieferer, Halbleiter, Antriebstechnik; der Kolibri-Tech-Report nennt eigene Industry-RAG-Evaluationen für diese Branchen.
- Finanzsektor: Banken und Versicherungen mit Residenz- und Nachweispflichten.
- Luft- und Raumfahrt: laut Tech Report eine der Zielbranchen von Kolibri-1.
Integration mit CompanyGPT
Kolibri-1 lässt sich als OpenAI-kompatibler vLLM-Endpunkt in CompanyGPT anbinden und hinter dem AI Gateway betreiben: Mitarbeitende erhalten eine vertraute Chat-Oberfläche, Prompts und Dokumente bleiben auf der eigenen Infrastruktur. Pharia-1 ist dafür nur mit kommerzieller Vereinbarung geeignet.
Unsere Empfehlung
Für neue Projekte ist Kolibri-1 die relevante Option aus dem Aleph-Alpha-Portfolio: Apache 2.0, deutsche Sprachqualität in seiner Klasse, 1 Million Token Kontext und ein Betriebspfad, der mit zwei H100 oder einer B200 auskommt. Prüfen Sie vor dem Einsatz die Qualität bei mehrstufigem Tool-Calling und bei Faktenfragen ohne Retrieval, in beiden Punkten liegt das Modell laut Herstellerangaben hinter Vergleichsmodellen. Pharia-1 LLM-7B bleibt für Umgebungen mit einer einzelnen GPU oder bestehende PhariaAI-Installationen sinnvoll, erfordert kommerziell aber eine Vereinbarung mit Aleph Alpha. Luminous sollten Sie nur in Bestandsprojekten weiterbetreiben.
Wer Bild-Eingabe, breite Sprachabdeckung oder eine gehostete API mit EU-Datenresidenz braucht, vergleicht Mistral als europäische Alternative oder OpenAI GPT über die EU-Data-Zones von Microsoft Foundry. Angesichts der laufenden Fusion mit Cohere empfehlen wir, Verträge mit Blick auf die Produktroadmap des kombinierten Unternehmens zu gestalten. Für eine Einschätzung, welche Option zu Ihren Anforderungen passt, kontaktieren Sie innFactory AI Consulting.
