↓ Zum Hauptinhalt springen
9 – 17 UHR +49 8031 3508270 LUITPOLDSTR. 9, 83022 ROSENHEIM
DE / EN
LLM MiniMax AI China

MiniMax-M3

MiniMax-M3: Open-Weight-Modell mit 1M-Token-Kontext und MSA-Architektur für agentic Coding. API-Preise, Lizenz, Bedrock-Verfügbarkeit und DSGVO-Self-Hosting.

Lizenz MiniMax Community License (M3); Non-Commercial License (M2.7); Modified MIT (M2)
DSGVO-Hosting Verfügbar
Kontext 1M Tokens
Modalität Text, Bild, Video → Text

Versionen

Verfügbare Modellvarianten im Überblick

ModellReleaseEUStärkenSchwächenStatus
MiniMax-M3 Empfohlen
2026-06-01
1 Mio. Token Kontextfenster Native Multimodalität (Bild- und Video-Verständnis) MSA-Architektur (MiniMax Sparse Attention) – bis zu 20× geringere Per-Token-Compute bei 1M Kontext 9× schnellerer Prefill, 15× schnelleres Decoding ggü. Vorgänger 59,0 % auf SWE-Bench Pro (übertrifft GPT-5.5 und Gemini 3.1 Pro) Offene Gewichte seit Juli 2026 auf Hugging Face verfügbar (MiniMaxAI/MiniMax-M3, ~428B Parameter, ~23B aktiv)
Keine native EU Cloud-Verfügbarkeit (weder Bedrock noch Azure Foundry noch Vertex AI gelistet) Offizielle API läuft über chinesische Infrastruktur Lizenz ist die MiniMax Community License, keine MIT-Lizenz: kommerzielle Nutzung erfordert laut Lizenztext eine Attributionspflicht ("Built with MiniMax M3") sowie ab 20 Mio. USD Jahresumsatz eine vorherige schriftliche Genehmigung durch MiniMax, unterhalb dieser Schwelle genügt eine einmalige Meldung an MiniMax
Aktuell
MiniMax-H3 (Video, Open Weights H3-Base)
2026-07-31
Text, Bild, Video und Audio als gemeinsamer Kontext, Ausgabe als Video mit nativem Stereo-Ton (32 kHz), 4 bis 15 Sekunden bei 24 fps Offene H3-Base-Gewichte (33 Mrd. Parameter, dichter Single-Stream-Transformer) für 768p; 2K nur in Kombination mit den gehosteten Modulen H3-Context-IR und H3-Regenerate-2K Laut Modellkarte 11 Sprachen mit stabiler Dialogausgabe
Lizenz schließt die EU ausdrücklich aus – für Unternehmen im DACH-Raum ohne Sonderlizenz nicht lokal einsetzbar API läuft über chinesische Infrastruktur, keine EU-Residenz Ab 20 Mio. USD Jahresumsatz zusätzliche schriftliche Autorisierung nötig; Attributionspflicht „Powered by MiniMax H3“ Open Weights liefern nur 768p, die volle 2K-Qualität bleibt an die gehostete API gebunden; Deployment-Beispiel mit vier GPUs
Aktuell
MiniMax-M2.7
2026-05-19
Sparse Mixture-of-Experts (MoE) Architektur Speziell für Agent-Teams und komplexe Coding-Workflows optimiert Top-Performance auf SWE-Pro, Terminal Bench 2 und MLE-Bench Lite Native Multi-Agent-Collaboration
Von M3 abgelöst Keine MIT-Lizenz: Laut LICENSE-Datei auf Hugging Face (MiniMaxAI/MiniMax-M2.7) ist jede kommerzielle Nutzung ohne vorherige schriftliche Genehmigung durch MiniMax untersagt – strenger als die spätere MiniMax Community License von M3, die unterhalb 20 Mio. USD Jahresumsatz nur eine Meldung verlangt Keine native EU Cloud-Verfügbarkeit API läuft über chinesische Infrastruktur
Veraltet
MiniMax-M2
Oktober 2025
Erste Generation des agentic Coding-Modells Open Source via Hugging Face und GitHub unter Modified-MIT-Lizenz Auf AWS Bedrock als In-Region-Modell in mehreren EU-Regionen verfügbar
Von M2.7 und M3 abgelöst
Veraltet

Einsatzbereiche

Typische Anwendungsgebiete für dieses Modell

Agentic Coding & Software Engineering
Multi-Agent-Workflows
SRE-Incident-Response
Komplexe Productivity-Tasks
Dokumentenverarbeitung (Word, Excel, PowerPoint)
ML-Engineering & Experimentation
Tool-/Function-Calling

Technische Details

API, Features und Capabilities

API & Verfügbarkeit
Verfügbarkeit Public
Features & Capabilities
Tool Use Function Calling Structured Output Vision Reasoning Mode Code Execution Web Browsing Datei-Upload
Training & Wissen
Wissensstand Anfang 2026
Fine-Tuning Verfügbar (Full Fine-tuning, LoRA)
Sprachunterstützung
Beste Qualität Englisch, Chinesisch
Unterstützt Multilingual
Beste Qualität in Englisch und Chinesisch

Hosting & Compliance

DSGVO-konforme Hosting-Optionen und Lizenzierung

DSGVO-konforme Hosting-Optionen
Self-Hosted
EU (selbst gewählt)
Deployment auf eigener Infrastruktur in EU-Rechenzentren möglich
AWS Bedrock
EU (In-Region wählbar, z. B. eu-central-1 Frankfurt, eu-west-1 Irland, eu-north-1 Stockholm)
MiniMax M2, M2.1 und M2.5 (Modell-ID minimax.minimax-m2 u. a.) sind laut AWS-Bedrock-Modellkarten nur als In-Region-Inferenz verfügbar (kein Geo- oder Global-Cross-Region-Routing) – die Verarbeitung lässt sich auf eine gewählte EU-Region festlegen. M2.7 und M3 sind auf Bedrock nicht gelistet.
Lizenz & Hosting
Lizenz MiniMax Community License (M3); Non-Commercial License (M2.7); Modified MIT (M2)
Sicherheitsfilter Konfigurierbar
On-Premise

Benchmarks

Leistungsvergleich mit standardisierten Tests

SWE-Bench Pro (M3)
59 2026-06
SWE-Pro (M2.7)
56.22 2026
MLE-Bench Lite (Medal Rate, M2.7)
66.6 2026
VIBE-Pro (M2.7)
55.6 2026
Terminal Bench 2 (M2.7)
57 2026
Toolathon (M2.7)
46.3 2026

Als KI-Beratungsunternehmen aus Rosenheim unterstützen wir Unternehmen in Deutschland, Österreich und der Schweiz bei der DSGVO-konformen Integration von Open-Weight-Modellen wie MiniMax-M3. Durch Self-Hosting in EU-Rechenzentren lässt sich das Modell datenschutzkonform für agentische Workflows und Long-Context-Tasks einsetzen. Stand dieser Übersicht: Oktober 2026.

MiniMax-M3: Frontier Coding mit 1M-Kontext

MiniMax hat am 1. Juni 2026 MiniMax-M3 vorgestellt – nach eigenen Angaben das erste Open-Weight-Modell, das frontier-Coding, ein 1-Million-Token-Kontextfenster und native Multimodalität (Bild- und Video-Verständnis) in einem Modell vereint.

MSA-Architektur (MiniMax Sparse Attention)

Das neue Architektur-Design ist der Schlüssel für die Effizienz bei langen Kontexten:

  • Bis zu 20× geringere Per-Token-Compute bei 1M-Token-Kontext gegenüber dem Vorgänger
  • Mehr als 9× schnellerer Prefill, mehr als 15× schnelleres Decoding
  • Deutlich niedrigere Inferenzkosten für Long-Context-Workloads

Native Multimodalität

M3 versteht Text, Bilder und Videos in einem einheitlichen Modell – ideal für agentic Coding mit UI-Screenshots, Dokumenten-Verarbeitung und multimodale Recherche.

Coding-Performance

  • 59,0 % auf SWE-Bench Pro – übertrifft GPT-5.5 und Gemini 3.1 Pro, knapp hinter Claude Opus 4.7
  • Optimiert für komplexe, mehrstufige Software-Engineering-Aufgaben
  • Geeignet für autonome Agent-Harnesses

API-Pricing

  • ca. $0,60 / Mio. Input-Tokens und $2,40 / Mio. Output-Tokens
  • Launch-Aktion: 50 % Rabatt ($0,30 / $1,20)
  • Damit deutlich günstiger als Claude Opus 4.7 oder GPT-5.5 bei vergleichbarer Coding-Performance

Open Weights und Lizenz

MiniMax hat die Gewichte wie angekündigt kurz nach dem Launch veröffentlicht: Auf Hugging Face stehen MiniMaxAI/MiniMax-M3 (rund 428 Mrd. Parameter, davon rund 23 Mrd. aktiv) sowie eine quantisierte Variante MiniMaxAI/MiniMax-M3-MXFP8 bereit – damit ist Self-Hosting auf eigener EU-Infrastruktur technisch möglich.

Wichtig für die Lizenzeinordnung: M3 steht nicht unter MIT, sondern unter der eigens formulierten MiniMax Community License. Laut LICENSE-Datei im Hugging-Face-Repository ist die private und nicht-kommerzielle Nutzung frei. Bei jeder kommerziellen Nutzung ist zusätzlich eine sichtbare Attribution (“Built with MiniMax M3”) erforderlich; überschreiten die damit erzielten Produkte oder Dienste 20 Mio. US-Dollar Jahresumsatz, ist vorab eine schriftliche Genehmigung von MiniMax einzuholen, unterhalb dieser Schwelle genügt eine einmalige Meldung per E-Mail. Für den typischen Einsatz im DACH-Mittelstand ist die Schwelle meist nicht einschlägig, die Attributions- und Meldepflicht gilt aber unabhängig vom Umsatz und sollte vor dem Rollout geprüft werden.

Vorgängermodell: MiniMax-M2.7

MiniMax-M2.7 (Release Mai 2026) bleibt für reine Coding-Agent-Workflows ohne Multimodalität und mit kleinerem Kontextbedarf weiterhin relevant. Es punktet mit:

  • Sparse Mixture-of-Experts (MoE) Architektur
  • 56,22 % auf SWE-Pro, 57,0 % auf Terminal Bench 2, 66,6 % auf MLE-Bench Lite

Lizenz: M2.7 steht nicht unter der MIT-Lizenz. Laut LICENSE-Datei auf Hugging Face (MiniMaxAI/MiniMax-M2.7) handelt es sich um eine Non-Commercial License nach MIT-Vorbild: Private Nutzung, Forschung und nicht-kommerzielle Zwecke sind frei, jede kommerzielle Nutzung – ohne Umsatzschwelle – erfordert eine vorherige schriftliche Genehmigung durch MiniMax sowie die Attribution “Built with MiniMax M2.7”. Das ist strenger als die Lizenz von M3, die unterhalb 20 Mio. USD Jahresumsatz nur eine Meldung verlangt.

Für neue Projekte empfehlen wir wegen 1M-Kontext, Multimodalität und höherer Coding-Performance in der Regel MiniMax-M3 – wer aber kommerziell ohne separate Genehmigung von MiniMax arbeiten möchte, sollte für beide Modelle vorab den jeweiligen Lizenztext prüfen lassen.

Zwischen dem ursprünglichen MiniMax-M2 und M2.7 hat MiniMax laut Hugging-Face-Organisationsseite außerdem die Zwischenversionen MiniMax-M2.1 (Februar 2026) und MiniMax-M2.5 (März 2026) veröffentlicht. Beide sind laut AWS-Modellkarten auch auf Amazon Bedrock gelistet.

EU-Deployment Optionen

Self-Hosting in EU-Rechenzentren

Für DSGVO-Compliance bieten wir Unterstützung bei:

  • Deployment auf AWS EU-Regionen (Frankfurt, Irland)
  • Azure EU-Regionen (West Europe, Germany)
  • Google Cloud EU-Regionen (Frankfurt, Belgien)
  • Private Cloud oder On-Premise im eigenen Rechenzentrum

Hyperscaler-Kataloge im Überblick

  • AWS Bedrock führt MiniMax M2, M2.1 und M2.5 als native Modelle. Laut AWS-Modellkarten ist ausschließlich In-Region-Inferenz verfügbar (kein Geo- oder Global-Cross-Region-Routing) – darunter auch eu-central-1 (Frankfurt), eu-west-1 (Irland), eu-west-2 (London, UK), eu-south-1 (Mailand) und eu-north-1 (Stockholm). Die aktuellen Flaggschiffe M2.7 und M3 sind auf Bedrock nicht gelistet.
  • Azure AI Foundry listet MiniMax M2 und M2.5 über Fireworks AI (“Fireworks on Foundry”) – laut Microsoft-Dokumentation ohne eigene Azure-Region-Zusicherung für dieses Angebot; Pay-per-Token-Deployments laufen über US-Regionen.
  • Google Vertex AI (Gemini Enterprise Agent Platform) führt bislang nur MiniMax M2 als Model-as-a-Service, laut Google-Dokumentation ausschließlich über den Endpunkt-Typ „global“ – ohne EU-spezifische Region.

Hardware-Anforderungen

MiniMax-M3 und M2.7 sind in verschiedenen Quantisierungen einsetzbar:

  • BF16: Volle Präzision für Forschung und Benchmarks
  • FP8: Empfohlen für produktives Deployment
  • INT4/INT8: Effiziente Quantisierung für begrenzte Ressourcen

Alternative API-Zugang

Für schnelles Prototyping ohne eigene Infrastruktur:

  • MiniMax API: Offizieller Zugang über platform.minimaxi.com
  • Third-Party Provider: Together.ai, Fireworks AI, OpenRouter
  • Modellgewichte: Hugging Face (MiniMaxAI) und GitHub

Hinweis: Direkte API-Nutzung erfolgt über chinesische Infrastruktur und ist ohne AVV und Self-Hosting nicht DSGVO-konform.

Lokal oder Cloud? Kosten berechnen

Für agentische Coding-Workloads lohnt sich oft eine genaue Kostenkalkulation zwischen API-Nutzung und Self-Hosting. Mit dem Lokal-vs-Cloud-KI-Inferenz-Rechner von ai-prices.eu können Sie Hardware-, Strom- und Betriebskosten gegen Cloud-API-Preise gegenrechnen und den Break-Even-Punkt für Ihre Workload bestimmen.

Integration & Support

Unsere Empfehlung

Self-Hosting in EU-Rechenzentren ist die beste Option für DSGVO-konforme Nutzung von MiniMax-M3. Wir unterstützen Sie bei:

  • Infrastruktur-Planung und Hardware-Dimensionierung (insb. für 1M-Kontext-Workloads)
  • Deployment, Quantisierung und Optimierung
  • Integration in bestehende Agent-Frameworks
  • Compliance-konforme Nutzung in CompanyGPT
  • Fine-Tuning für spezifische Anwendungsfälle

Für Unternehmen, die ein führendes Open-Weight-Modell mit Frontier-Coding, 1M-Kontext und nativer Multimodalität suchen, ist MiniMax-M3 eine exzellente Wahl – vorausgesetzt, die entsprechende Infrastruktur steht zur Verfügung.

Kostenkalkulation für dieses Modell

Eine aktuelle Übersicht über Token-Preise, Modellvarianten und EU-Verfügbarkeit finden Sie auf unserem Schwesterprojekt ai-prices.eu. Dort lassen sich die laufenden Betriebskosten für Ihren konkreten Anwendungsfall vergleichen und abschätzen.

Preise auf ai-prices.eu vergleichen

ai-prices.eu ist ein Projekt der innFactory AI Consulting GmbH und hilft bei der transparenten Preisabschätzung führender KI-Modelle.

Beratung zu diesem Modell?

Wir helfen Ihnen bei der Auswahl und Integration des richtigen KI-Modells für Ihren Anwendungsfall.