Zum Hauptinhalt springen
9 – 17 UHR +49 8031 3508270 LUITPOLDSTR. 9, 83022 ROSENHEIM
DE / EN
LLM OpenAI USA

OpenAI GPT

Neu am 3. September 2026: GPT-6 Astra (gpt-6-astra, $10/$50 pro 1M Token, 1,05M Kontext, Cutoff 30. April 2026) – zunächst nur für das Trusted Access Program, API und ChatGPT-Pläne folgen; in Microsoft Foundry nur Global und US Data Zone, keine EU Data Zone. GPT-5.6 (Sol, Terra, Luna) bleibt das höchste EU-Data-Zone-fähige OpenAI-Modell (alle neun europäischen Foundry-Regionen); Sol zum Aktionspreis $4/$20, Empfehlung für den Großteil der Workloads GPT-5.6 Luna ($0,20/$1,20). KI-Beratung aus Rosenheim. Stand: 3. September 2026.

Lizenz Proprietär
DSGVO-Hosting Verfügbar
Kontext 1,05M (GPT-6 Astra, GPT-5.6/5.5/5.4), 400k (GPT-5.2) Tokens
Modalität Text, Image, Audio, PDF → Text, Image, Audio, Video

Versionen

Verfügbare Modellvarianten im Überblick

ModellReleaseEUStärkenSchwächenStatus
GPT-6 Astra
3. September 2026 (Limited Rollout)
Laut OpenAI das bislang leistungsstärkste Modell („generational leap“), erstes Modell der sechsten Generation Benchmarks laut OpenAI: ARC-AGI-3 98,6 %, FrontierMath Tier 4 v2 97,6 %, GPQA Diamond 96 %, DeepSWE v1.1 74,1 %, OSWorld 2.0 72,6 % (GPT-5.6 Sol: 65,7 %) Computer Use über Browser, Tabellen, Desktop-Anwendungen (u. a. CRM, Notebooks, Power BI, KiCad, FreeCAD) statt nur über APIs 1,05M Token Kontextfenster (922k Input, 128k Output), Knowledge Cutoff 30. April 2026 Fünf Reasoning-Stufen (low bis max); neu in der Responses API: asynchrone Tool-Aufrufe, Mid-Turn-Steuerung per WebSocket, Effort-Wechsel mitten in der Konversation ohne Cache-Verlust Tools: Web Search, File Search, Code Interpreter, Hosted Shell, Apply Patch, Skills, Computer Use, MCP, Tool Search; Structured Outputs, Function Calling, Prompt Caching
Erstes OpenAI-Modell mit Einstufung „Critical“ für Cybersecurity im Preparedness Framework – die allgemein verfügbare Variante verweigert laut OpenAI fortgeschrittene Cybersecurity-Aufgaben, Monitoring kann legitime Arbeit verlangsamen oder pausieren Noch kein allgemeiner Zugang: Trusted Access Program zuerst, API und ChatGPT-Pläne „in den kommenden Tagen“ (Stand 3. September 2026) Keine EU Data Zone in Microsoft Foundry (nur Global und US), Bedrock noch nicht gelistet – nicht für EU-Residenzpflicht geeignet Kein Reasoning-Effort none, keine eigenen temperature/top_p-Werte, keine Logprobs; Tool-Calling nur über die Responses API, nicht über Chat Completions Long-Context-Aufschlag über 272k Token ($20,00 / $75,00) und doppelter Preis im Fast Mode Kein Realtime, keine Assistants API, kein Fine-Tuning
Preview
GPT-5.6 Sol Empfohlen
9. Juli 2026 (GA, Preview seit 26. Juni)
Flaggschiff der 5.6-Generation (Tier 'Sol' im Sol/Terra/Luna-Namensschema) für Coding, Knowledge Work, Cybersecurity und Wissenschaft; der Alias 'gpt-5.6' routet auf Sol; seit 3. September 2026 von GPT-6 Astra als Spitzenmodell abgelöst, bleibt aber das höchste EU-Data-Zone-fähige Modell Terminal-Bench 2.1: 88,8 %, mit 'Ultra'-Konfiguration (Subagenten) 91,9 % – neuer State of the Art 80 Punkte auf dem Artificial Analysis Coding Agent Index v1.1 (maximales Reasoning) 1,05M Token Kontextfenster, 128k Output, Knowledge Cutoff 16. Februar 2026 Sechs Reasoning-Stufen (none bis max) plus reasoning.mode 'pro' als Ersatzpfad für gpt-5-pro / o3-pro Aktionspreis seit 21. August 2026: $4,00/1M Input, $0,40/1M Cached Input, $20,00/1M Output – laut OpenAI mindestens bis 21. November 2026 (zuvor $5,00/$0,50/$30,00) In Microsoft Foundry als EU Data Zone Standard deploybar – Daten bleiben in der EU Seit 21. August 2026 regionale Verarbeitung pro Request in der OpenAI-API (Prefix-Domain mit API-Key eines Projekts mit Geografie „Global“) Ultrafast-Tier laut OpenAI bis zu 14× schneller als Standard (Limited Preview seit 13. August 2026)
SWE-Bench Pro nur 64,6 % vs. 80 % bei Claude Fable 5 – OpenAI hält den Benchmark allerdings für teilweise fehlerhaft Long-Context-Aufschlag: Prompts über 272k Token werden mit $8,00/1M Input und $30,00/1M Output abgerechnet Aktionspreis befristet – OpenAI garantiert ihn nur „mindestens bis 21. November 2026“ 'High'-Einstufung in Cybersecurity und Bio/Chem im OpenAI Preparedness Framework Foundry-Deployment erfordert bei niedrigeren Quota-Tiers einen Quota-Antrag (Tier 5/6 haben Standard-Quota) Auf Bedrock nur US-Regionen, reduziertes Kontextfenster (272k) und nur die Reasoning-Stufen 'medium' und 'maximum' Teuerstes Tier der Familie – für Routine-Workloads meist überdimensioniert
Aktuell
GPT-5.6 Terra
9. Juli 2026 (GA, Preview seit 26. Juni)
Ausgewogenes Tier zwischen Sol und Luna Preis $2,00/1M Input, $0,20/1M Cached Input, $12,00/1M Output (über 272k Token: $4,00/$18,00) 1,05M Token Kontextfenster, Knowledge Cutoff 16. Februar 2026 Volle Reasoning-Skala (none bis max) und voller Tool-Support In Microsoft Foundry als EU Data Zone Standard und Data Zone Provisioned Managed deploybar
Auf Bedrock nur US-Regionen und reduziertes Kontextfenster (272k) Für viele Standard-Workloads deutlich teurer als Luna, ohne die Reasoning-Tiefe von Sol
Aktuell
GPT-5.6 Luna Empfohlen
9. Juli 2026 (GA, Preview seit 26. Juni)
Preis-Leistungs-Empfehlung: $0,20/1M Input, $0,02/1M Cached Input, $1,20/1M Output Gleiches Kontextfenster wie Sol und Terra: 1,05M Token, 128k Output, Knowledge Cutoff 16. Februar 2026 Voller Tool-Support (Web Search, File Search, Code Interpreter, MCP, Computer Use) und volle Reasoning-Skala Seit 6. August 2026 laut Medienberichten Standard-Modell für ChatGPT Free und Go In Microsoft Foundry als EU Data Zone Standard in allen neun europäischen Regionen deploybar Ideal für Sub-Agenten, hohe Volumina und kostensensitive Workloads
Geringere Reasoning-Tiefe als Sol und Terra – für die härtesten Coding- und Analyse-Aufgaben nicht die erste Wahl Kostenfalle bei sehr langem Kontext: Prompts über 272k Token werden mit $0,40/1M Input und $1,80/1M Output abgerechnet (2x Input, 1,5x Output – gilt laut OpenAI-Preisliste für alle drei Tiers) Nicht in der Data-Zone-Provisioned-Managed-Tabelle gelistet – für PTU-Kunden derzeit keine Option Auf Bedrock nur US-Regionen und reduziertes Kontextfenster (272k)
Aktuell
GPT-5.5 Instant
Mai 2026
Neuer Standard-Chat-Modell für ChatGPT (ersetzt GPT-5.3 Instant) 52,5% weniger Halluzinationen als GPT-5.3 Instant Stärkere Faktentreue und Tool-Calls In Microsoft Foundry als 'gpt-chat-latest' verfügbar
Kein dediziertes Reasoning-Modell
Aktuell
GPT-Realtime-2.1
2026 (Nachfolger von GPT-Realtime-2 aus Mai 2026)
Aktuelle Realtime-Voice-Generation (`gpt-realtime-2.1`), zusätzlich als `gpt-realtime-2.1-mini` Zielmodell für die Migration der Legacy-Audio- und Realtime-Modelle Natürlichere Sprachsynthese
Audio-Token sind deutlich teurer als Text-Token Legacy-Audio-/Realtime-Modelle werden am 20. Januar 2027 abgeschaltet – Migration erforderlich
Aktuell
GPT-5.6 Cyber / Daybreak Red & Blue
August 2026
Spezialmodelle für Cybersecurity: GPT-5.6 Cyber, Daybreak Red (Vulnerability Research), Daybreak Blue (Defensive) Seit 7. August 2026 in der OpenAI-API als Daybreak-Blue- und Daybreak-Red-Tier (`gpt-daybreak-red-latest`) für freigegebene Defender, seit 11. August 2026 auf Amazon Bedrock für berechtigte Kunden
Nur für berechtigte Kunden nach Freigabe zugänglich Auf Bedrock nur US-Regionen – keine EU-Region
Aktuell
GPT Image 2
21. April 2026
Aktuelles Bildgenerierungsmodell (`gpt-image-2`) Nachfolger von `gpt-image-1`, das am 23. Oktober 2026 abgeschaltet wird
Reines Bildmodell – keine Text- oder Reasoning-Fähigkeiten
Aktuell
Sora 2 / Sora 2 Pro
2025/2026
Videogenerierung über die Videos API
Abkündigung: `sora-2`, `sora-2-pro` und die Videos API werden zum 24. September 2026 abgeschaltet – ohne Nachfolgemodell
Veraltet
GPT-Realtime-Translate
Mai 2026
Live-Übersetzung in Echtzeit 70+ Eingabesprachen, 13 Ausgabesprachen Pro Minute abgerechnet ($0,034/Min.)
Begrenzte Ausgabesprachen
Aktuell
GPT-Realtime-Whisper
Mai 2026
Live Speech-to-Text in der Realtime-API Pro Minute abgerechnet ($0,017/Min.)
Spezialisiert auf Transkription
Aktuell
GPT Transcribe / GPT Live Transcribe
2026
Von OpenAI benannte Zielmodelle für die Migration von whisper-1 und der gpt-4o-transcribe-Familie Batch-Transkription (gpt-transcribe) und Streaming-Transkription (gpt-live-transcribe)
Spezialisiert auf Transkription
Aktuell
Whisper-1 / GPT-4o Transcribe
2023–2025
Bewährte Transkriptionsmodelle, weiterhin bis zur Abschaltung nutzbar
Am 26. August 2026 abgekündigt – Abschaltung am 26. Februar 2027; Nachfolger gpt-transcribe bzw. gpt-live-transcribe
Veraltet
GPT-5.5
April 2026
Flaggschiff (Codename 'Spud') Effizienter als GPT-5.4 Verbesserte Coding-Fähigkeiten Varianten: GPT-5.5 Thinking, GPT-5.5 Pro EU-verfügbar über Microsoft Foundry (EU Data Zone) und AWS Bedrock
Hohe Kosten bei großem Kontext
Aktuell
GPT-5.4
März 2026
Flaggschiff – 1M Token Kontextfenster Native Computer Use (Desktop & Browser) 33% weniger Halluzinationen als GPT-5.2 GDPval 83%, OSWorld-Verified 75% EU-verfügbar über Microsoft Foundry (EU Data Zone)
Premium-Preis ($2,50/1M Input, $15/1M Output) Von GPT-5.6 als Empfehlung abgelöst
Aktuell
GPT-5.4 Pro
März 2026
Tiefstes Reasoning aller OpenAI-Modelle Maximale Präzision für komplexe Aufgaben
Deutlich höhere Kosten ($30/1M Input, $180/1M Output) Langsamste Variante
Aktuell
GPT-5.4 mini
März 2026
2x schneller als Vorgänger Ideal für schnelle Code-Edits und Klassifikation
Geringere Kapazität als GPT-5.4
Aktuell
GPT-5.4 nano
März 2026
Niedrigste Latenz Ideal für Sub-Agenten und repetitive Tasks
Eingeschränkter Funktionsumfang
Aktuell
GPT-5.3 Codex
Februar 2026
Agentic Coding Modell 25% schneller als GPT-5.2 Selbstoptimierend
Spezialmodell für Entwicklung
Aktuell
o3
2025
Reasoning-Fokus
Langsamer Abkündigung zum 11. Dezember 2026 – Nachfolger: GPT-5.6 Sol (o3-pro über reasoning.mode 'pro')
Veraltet
o4-mini
2025
Reasoning-Fokus Kompaktes Reasoning-Modell
Spezialisiert auf Reasoning Abkündigung zum 23. Oktober 2026 – Nachfolger: GPT-5.6 Terra
Veraltet
GPT-5.2
Dezember 2025
Bewährtes Modell 400k Token Kontextfenster
Wird durch GPT-5.4 abgelöst
Veraltet
GPT-5.2 pro
Januar 2026
Höhere Präzision
Durch GPT-5.4 Pro ersetzt
Veraltet
GPT-4.1
2025
Starkes Allround-Modell
Veraltet
GPT-4o
Mai 2024
Multimodal
Veraltet

Einsatzbereiche

Typische Anwendungsgebiete für dieses Modell

Coding & Softwareentwicklung
Kundenservice & Chatbots
Content-Erstellung
Datenanalyse
Übersetzung
Agentic Workflows
Native Computer Use & Desktop-Automatisierung
Bildgenerierung
Videogenerierung
Sprachassistenz

Technische Details

API, Features und Capabilities

API & Verfügbarkeit
Verfügbarkeit Public
Requests/Min 10000
Tokens/Min 2000000
Latenz (TTFT) ~300ms
Durchsatz ~200 Tokens/Sek
Features & Capabilities
Tool Use Function Calling Structured Output Vision Reasoning Mode Code Execution Web Browsing Datei-Upload Realtime API
Training & Wissen
Wissensstand 30. April 2026 (GPT-6 Astra), 16. Februar 2026 (GPT-5.6 Sol/Terra/Luna), variiert je nach Modell
Fine-Tuning Verfügbar (Fine-tuning API, Custom Models)
Sprachunterstützung
Beste Qualität Englisch, Deutsch, Französisch, Spanisch, Chinesisch
Unterstützt 100+ Sprachen
Beste Qualität in Englisch, sehr gute Qualität in europäischen Sprachen

Hosting & Compliance

DSGVO-konforme Hosting-Optionen und Lizenzierung

DSGVO-konforme Hosting-Optionen
Microsoft Foundry
Data Zone Standard (EU) – alle neun europäischen Regionen: France Central, Germany West Central, Italy North, Norway East, Poland Central, Spain Central, Sweden Central, Switzerland North, West Europe
GPT-5.6 Sol, Terra und Luna sind in allen neun Regionen als Data Zone Standard gelistet; Prompts und Responses werden innerhalb der EU-Datenzone verarbeitet. Zusätzlich Data Zone Batch. GPT-5.5 und GPT-5.4 ebenfalls über Data Zone Standard, GPT-5.5 Instant als 'gpt-chat-latest'.
Microsoft Foundry
Data Zone Provisioned Managed (EU)
Nur GPT-5.6 Sol und Terra gelistet – GPT-5.6 Luna ist in der PTU-Tabelle nicht enthalten.
Microsoft Foundry
Global Standard in EU-Regionen (u.a. Germany West Central, Sweden Central, Poland Central)
Deploybar, aber die Inferenz kann weltweit erfolgen. Für EU-Datenverarbeitung ausdrücklich Data Zone Standard (EU) wählen.
OpenAI (First Party)
Data Residency Europa (EWR + Schweiz)
Für Modelle ab dem 5. März 2026 – darunter GPT-5.6 – mit 10 Prozent Preisaufschlag. Zero Data Retention nur nach vorheriger Genehmigung durch OpenAI. Seit 21. August 2026 lässt sich die regionale Verarbeitung auch pro Request wählen (Prefix-Domain mit API-Key eines Projekts mit Geografie „Global“).
Azure OpenAI
West Europe (Niederlande), Germany West Central (Frankfurt), Sweden Central
Azure OpenAI Service – EU Data Boundary, klassische GPT-5-Familie
AWS
Nur US-Regionen (us-east-1, us-east-2, teils us-west-2)
Amazon Bedrock – GPT-5.5/5.4/Codex seit 1. Juni, GPT-5.6 seit Juli 2026 GA. Laut AWS-Dokumentation keine EU-Region verfügbar (Stand 3. September 2026) – für DSGVO-Workloads mit EU-Residenzpflicht nicht geeignet.
Lizenz & Hosting
Lizenz Proprietary
Sicherheitsfilter Anpassbar
Enterprise Support Ja
SLA verfügbar Ja
Nur Cloud

Benchmarks

Leistungsvergleich mit standardisierten Tests

ARC-AGI-3 (GPT-6 Astra)
98.6
FrontierMath Tier 4 v2 (GPT-6 Astra)
97.6
GPQA Diamond (GPT-6 Astra)
96
DeepSWE v1.1 (GPT-6 Astra)
74.1
OSWorld 2.0 (GPT-6 Astra)
72.6
GDPval (GPT-5.4)
83
SWE-bench Pro (GPT-5.4)
57.7
OSWorld-Verified (GPT-5.4)
75
Investment Banking Modeling (GPT-5.4)
87.3

Als KI-Beratung aus Rosenheim unterstützen wir Unternehmen im DACH-Raum bei der DSGVO-konformen Integration von OpenAI-Modellen. Mit unserem CompanyGPT können Sie GPT-Modelle sicher in Ihrer eigenen Infrastruktur betreiben.

Was ist GPT?

GPT (Generative Pre-trained Transformer) ist die KI-Modellfamilie von OpenAI. Neu am 3. September 2026: OpenAI hat mit GPT-6 Astra (gpt-6-astra) die sechste Generation vorgestellt – zunächst nur für Unternehmen im Trusted Access Program, API und ChatGPT-Pläne folgen laut OpenAI „in den kommenden Tagen“; eine EU Data Zone gibt es dafür bislang nicht (Details im Abschnitt GPT-6 Astra). Seit dem 9. Juli 2026 ist GPT-5.6 (Tiers Sol, Terra, Luna) allgemein verfügbar – in ChatGPT, Codex und der API – und bleibt das höchste EU-Data-Zone-fähige OpenAI-Modell. Der Start erfolgte gestaffelt: Nach einer staatlich freigegebenen Limited Preview ab dem 26. Juni schloss das US-Handelsministerium seine Prüfung am 8. Juli ab und gab das Modell für den öffentlichen Launch frei. Die wichtigste Neuigkeit für EU-Kunden: Microsoft Foundry listet alle drei Tiers – gpt-5.6-sol, gpt-5.6-terra und gpt-5.6-luna – als Data Zone Standard (EU) in allen neun europäischen Foundry-Regionen, darunter Germany West Central (Frankfurt), West Europe und Sweden Central. Prompts und Responses werden dabei innerhalb der EU-Datenzone verarbeitet. Damit ist GPT-5.6 DSGVO-konform in EU-Data-Zones deploybar und löst GPT-5.5 als höchstes EU-verfügbares OpenAI-Modell ab. Amazon Bedrock bietet GPT-5.6 seit Juli 2026 GA an – allerdings ausschließlich in US-Regionen; eine EU-Region listet die AWS-Dokumentation weder für GPT-5.6 noch für GPT-5.5 (Stand 3. September 2026). Seit dem 21. August 2026 gilt für GPT-5.6 Sol zudem ein Aktionspreis von $4/1M Input und $20/1M Output (zuvor $5/$30), den OpenAI mindestens bis zum 21. November 2026 zusichert. Daneben bleiben GPT-5.5 (April 2026) und GPT-5.4 (März 2026, 1-Million-Token-Kontextfenster, native Computer-Steuerung) als bewährte EU-Optionen über Microsoft Foundry verfügbar, GPT-5.5 Instant steht als gpt-chat-latest bereit. Für spezialisierte Coding-Aufgaben steht weiterhin GPT-5.3 Codex zur Verfügung; die o-Serie mit o3 und o4-mini ist dagegen abgekündigt und wandert bis Ende 2026 auf GPT-5.6.

GPT-6 Astra: Sechste Generation im gestaffelten Rollout (3. September 2026)

Am 3. September 2026 hat OpenAI GPT-6 Astra (gpt-6-astra) vorgestellt. OpenAI-Präsident Greg Brockman spricht von einem „generational leap“ und begrüßt die „AGI era“; OpenAI beschreibt das Modell als sein bislang intelligentestes und am besten ausgerichtetes. Die Codename-Vorgeschichte: Bereits am 1. August 2026 hatte OpenAI „Astra“ als nächstes großes Modell genannt, am 18. August das Training wegen der Cyber-Fähigkeiten für zwei Wochen pausiert.

Zugang – bewusst gestaffelt: Zum Start erhalten Unternehmen im Trusted Access Program (Daybreak-Programm für Cybersecurity-Defender) Zugriff. Der Zugang über die API sowie die ChatGPT-Pläne Plus, Pro, Business und Enterprise folgt laut OpenAI „in den kommenden Tagen“; Medienberichte nennen den 9. September 2026 als erwarteten breiten Start – von OpenAI nicht bestätigt. Microsoft Foundry startet parallel über das Foundry Limited Access Program, Amazon Bedrock ist angekündigt, in der AWS-Modell-Dokumentation zum Stand 3. September aber noch nicht gelistet.

Leistung (Angaben OpenAI): ARC-AGI-3 98,6 %, FrontierMath Tier 4 v2 97,6 % (Claude Fable 5.1 laut OpenAI-Vergleich 87,8 %), GPQA Diamond 96 %, DeepSWE v1.1 74,1 %, BenchCAD 95,9 %, OSWorld 2.0 72,6 % bei rund 40 Minuten pro Aufgabe (GPT-5.6 Sol: 65,7 % bei 75 Minuten). Der Schwerpunkt liegt auf Computer Use: Astra bedient Browser, Tabellen, Websites und Desktop-Anwendungen – Formulare, CRMs, Kalender, Python-Notebooks, Power BI, KiCad, FreeCAD – über die menschliche Oberfläche statt über APIs. Beim DeepSWE-Vergleich nennt OpenAI rund 57 % geringere geschätzte API-Kosten pro Aufgabe gegenüber der besten GPT-5.6-Sol-Konfiguration. Auffällig: Der GDPval-Benchmark für reale Berufsaufgaben fehlt in den Launch-Materialien.

Technische Daten: Kontextfenster 1.050.000 Token (922k Input, 128k Output), Knowledge Cutoff 30. April 2026, Eingabe Text und Bild, Ausgabe Text. Fünf Reasoning-Stufen (low, medium, high, xhigh, max) – die Stufe none entfällt. Endpunkte: Responses, Chat Completions und Batch; kein Realtime, keine Assistants API, kein Fine-Tuning. Eigene temperature- oder top_p-Werte und Logprobs werden nicht unterstützt, Tool-Calling läuft ausschließlich über die Responses API. Neu in der Responses API sind asynchrone Tool-Aufrufe, Mid-Turn-Steuerung per WebSocket und der Wechsel des Reasoning-Efforts mitten in der Konversation unter Erhalt des Prompt-Caches.

Preise (OpenAI First Party, pro 1M Token): $10,00 Input, $1,00 Cached Input, $12,50 Cache Write, $50,00 Output bis 272k Token; darüber $20,00 / $2,00 / $75,00. Batch und Flex jeweils 50 %, Fast Mode $20,00 / $100,00 (Long Context $40,00 / $150,00). Damit liegt Astra beim 2,5-Fachen des Sol-Aktionspreises. OpenAI argumentiert, dass der Vergleich künftig über den Preis pro erledigter Aufgabe statt pro Token laufen sollte – für Budgetplanungen empfehlen wir genau diese Messung, bevor ein Workload migriert wird.

Sicherheit – der Punkt, den Compliance-Verantwortliche kennen sollten: Astra ist laut OpenAI das erste Modell, das im Preparedness Framework die Stufe „Critical“ für Cybersecurity erreicht – es kann bislang unbekannte Schwachstellen finden und Exploits entwickeln. Die Folge ist ein Defense-in-Depth-Ansatz aus Modellverhalten, Klassifikatoren, Sicherheitskontrollen, Monitoring und Post-Deployment-Reaktion: Die allgemein verfügbare Variante verweigert fortgeschrittene Cybersecurity-Aufgaben, und OpenAI räumt ein, dass legitime Arbeit durch das Monitoring verlangsamt oder pausiert werden kann. Fortgeschrittene Cyber-Fähigkeiten gibt es nur über Daybreak Blue für geprüfte Defender. Wer Astra in Sicherheits- oder Entwicklungsteams einsetzen will, sollte diese Eingriffe im Betriebskonzept einplanen.

EU-Verfügbarkeit (Stand 3. September 2026): Der Azure-Blog listet für GPT-6 Astra in Microsoft Foundry ausschließlich Standard Global ($10,00 / $50,00) und Standard Data Zone (US) ($11,00 / $55,00; Long Context $22,00 / $82,50) – keine EU Data Zone, kein Provisioned, kein Batch. Auf Bedrock fehlt das Modell noch. Für Workloads mit EU-Residenzpflicht bleibt damit GPT-5.6 über die EU-Data-Zones von Foundry das höchste verfügbare OpenAI-Modell; wir aktualisieren diese Seite, sobald Microsoft eine EU Data Zone für Astra dokumentiert.

GPT-5.6 (Sol, Terra, Luna): Seit 9. Juli 2026 allgemein verfügbar

Am 9. Juli 2026 hat OpenAI die GPT-5.6-Familie öffentlich gelauncht – in ChatGPT, Codex und der API. Das neue Namensschema trennt die Generationsnummer (5.6) von dauerhaften Leistungs-Tiers; mini/nano-Varianten gibt es nicht mehr:

  • GPT-5.6 Sol (gpt-5.6-sol) – Flaggschiff, laut OpenAI das bisher stärkste Modell (Fokus Coding, Knowledge Work, Cybersecurity, Wissenschaft). Terminal-Bench 2.1: 88,8 %, mit der Ultra-Konfiguration (Subagenten) 91,9 % – neuer State of the Art. Der Alias gpt-5.6 routet auf Sol.
  • GPT-5.6 Terra (gpt-5.6-terra) – ausgewogenes Tier zwischen Sol und Luna.
  • GPT-5.6 Luna (gpt-5.6-luna) – schnelles, sehr günstiges Tier mit demselben Kontextfenster und Funktionsumfang wie Sol und Terra.

Preise pro 1 Million Token (OpenAI First Party, USD)

ModellInputCached InputCache WriteOutputInput / Output über 272k Token
GPT-5.6 Sol (Aktionspreis)$4,00$0,40$5,00$20,00$8,00 / $30,00
GPT-5.6 Terra$2,00$0,20$2,50$12,00$4,00 / $18,00
GPT-5.6 Luna$0,20$0,02$0,25$1,20$0,40 / $1,80

Preissenkung bei Sol: Seit dem 21. August 2026 kostet GPT-5.6 Sol $4,00/1M Input (minus 20 Prozent) und $20,00/1M Output (minus 33 Prozent) statt zuvor $5,00/$30,00. OpenAI bezeichnet das ausdrücklich als Aktionspreis („promotional pricing“), der mindestens bis zum 21. November 2026 gilt – für Budgetplanungen über diesen Termin hinaus sollten Sie mit dem Listenpreis rechnen.

Für alle drei Tiers gilt laut OpenAI-Preisliste: Prompts oberhalb von 272.000 Token werden mit dem doppelten Input- und dem 1,5-fachen Output-Preis abgerechnet (Stand 3. September 2026). Wer regelmäßig sehr lange Kontexte verarbeitet, sollte das in der Kostenrechnung berücksichtigen. Seit dem 5. August 2026 unterstützt zudem der Fast-Modus Prompts über 272k Token für Sol, Terra und Luna (laut OpenAI bis zu 2,5× schneller als Standard); am 13. August folgte ein Ultrafast-Tier für Sol als Limited Preview (laut OpenAI bis zu 14× schneller als Standard).

Alle drei Modelle bieten ein Kontextfenster von 1.050.000 Token (922k Input, 128k Output) mit Knowledge Cutoff 16. Februar 2026. Als Modalitäten unterstützt GPT-5.6 Text und Bild als Eingabe und Text als Ausgabe – Audio- und Videoausgabe decken andere Modelle der Familie ab (Realtime, GPT Image). Der Reasoning-Aufwand lässt sich in sechs Stufen steuern – none, low, medium (Standard), high, xhigh und max –, zusätzlich gibt es reasoning.mode: pro als Ersatzpfad für die früheren Pro-Modelle. Unterstützt werden Web Search, File Search, Image Generation, Code Interpreter, Hosted Shell, Apply Patch, Skills, Computer Use, MCP und Tool Search sowie Streaming, Structured Outputs, Function Calling und Prompt Caching. Neu in der API sind außerdem Programmatic Tool Calling, erweiterte Multi-Agent-Fähigkeiten und Prompt-Cache-Breakpoints. Parallel zum Launch hat OpenAI ChatGPT Work vorgestellt – einen von Sol angetriebenen Arbeits-Agenten mit Codex-Integration, zunächst für Pro-, Enterprise- und Edu-Kunden.

GPT-5.6 in ChatGPT: Luna als neuer Standard für Free und Go

Laut Medienberichten hat OpenAI am 6. August 2026 die Modellzuordnung in ChatGPT umgestellt: GPT-5.6 Luna ist seitdem das Standard-Modell für Free- und Go-Nutzer und ersetzt dort GPT-5.5 Instant. Im API-Changelog vom selben Tag bestätigt OpenAI ein Update des Snapshots chat-latest auf das aktuelle ChatGPT-Modell und empfiehlt für Produktions-Workloads GPT-5.6 Sol. Free und Go erhalten damit unbegrenzte Textchats; Limits bleiben für Uploads, Bildgenerierung und Tool-Nutzung bestehen. GPT-5.6 Sol ist das Modell für Plus, Pro, Business und Enterprise. Ergänzend gibt es einen „Think“-Button, mit dem sich für eine Anfrage gezielt mehr Reasoning anfordern lässt.

Ein ehrlicher Blick auf die Benchmarks gehört dazu: Auf SWE-Bench Pro erreicht Sol laut unabhängiger Auswertung nur 64,6 % gegenüber rund 80 % bei Claude Fable 5 – OpenAI hält allerdings rund 30 % der SWE-Bench-Pro-Aufgaben für fehlerhaft. Bei agentischen Benchmarks wie Terminal-Bench liegt Sol dagegen vorn; auf dem Artificial Analysis Coding Agent Index v1.1 erreicht Sol mit maximalem Reasoning 80 Punkte. OpenAI gibt zudem an, dass Sol bei Coding-Aufgaben rund 54 Prozent token-effizienter arbeite als der Vorgänger – diese Angabe stammt aus Sekundärquellen und ist von uns nicht unabhängig überprüft.

Vom staatlichen Freigabeprozess zum Public Launch

Update – Stand 3. September 2026: GPT-5.6 ist in EU-Data-Zones deploybar. Microsoft Foundry führt alle drei Tiers (Sol, Terra, Luna) als Data Zone Standard (EU) in allen neun europäischen Regionen. Amazon Bedrock bietet GPT-5.6 seit Juli 2026 ebenfalls GA an, dort jedoch nur in US-Regionen. Für DSGVO-konforme EU-Deployments ist damit GPT-5.6 über Microsoft Foundry die Referenz – als Preis-Leistungs-Empfehlung neu GPT-5.6 Luna.

Der Weg zum Launch war ungewöhnlich: GPT-5.6 startete am 26. Juni 2026 zunächst nur als staatlich freigegebene Limited Preview für eine kleine Gruppe geprüfter Organisationen. Hintergrund war eine US-Cybersecurity-Anordnung, nach der das US-Handelsministerium (Center for AI Standards and Innovation) das Modell vor dem öffentlichen Release prüfen konnte – ausgelöst durch die „High“-Einstufung in Cybersecurity im OpenAI Preparedness Framework. Am 8. Juli 2026 wurde die Prüfung abgeschlossen und die Beschränkung aufgehoben; einen Tag später folgte der öffentliche Launch. Damit wiederholte sich das Muster von Anthropic (Claude Fable 5 / Mythos 5, Anthropic Claude) nur wenige Tage später – inklusive Aufhebung. Mehr zur Vorgeschichte in unserem Blogbeitrag zu GPT-5.6 und Claude Fable 5.

GPT-5.5 – Das Flaggschiff der Vorgängergeneration

GPT-5.5 (23. April 2026, Codename „Spud”) war bis zum GPT-5.6-Launch das Spitzenmodell von OpenAI. Es ist effizienter als GPT-5.4 und bietet verbesserte Coding-Fähigkeiten. Neben dem Basismodell stehen die Varianten GPT-5.5 Thinking und GPT-5.5 Pro zur Verfügung. Seit dem 24. April 2026 ist GPT-5.5 auch in der API verfügbar ($5/1M Input, $30/1M Output, 1M Kontextfenster).

GPT-5.5 Instant (Mai 2026)

Am 5. Mai 2026 hat OpenAI GPT-5.5 Instant als neues Standard-Chat-Modell in ChatGPT eingeführt – es ersetzt GPT-5.3 Instant. In internen Evaluierungen produziert GPT-5.5 Instant 52,5 Prozent weniger Halluzinationen als GPT-5.3 Instant bei High-Stakes-Prompts (Medizin, Recht, Finanzen). In der API ist es als chat-latest und in Microsoft Foundry als gpt-chat-latest verfügbar – damit ist es auch für DSGVO-konforme Enterprise-Deployments in EU-Regionen erreichbar (je nach Foundry-Region-Konfiguration).

Realtime-Voice- und Transkriptionsmodelle

Die Realtime-Familie hat seit Mai 2026 eine Generation übersprungen. Aktueller Stand (3. September 2026):

  • GPT-Realtime-2.1 (gpt-realtime-2.1) und GPT-Realtime-2.1-mini – die aktuelle Realtime-Voice-Generation. Sie lösen das im Mai 2026 eingeführte GPT-Realtime-2 (128k Token Kontextfenster, $32/1M Audio-Input, $64/1M Audio-Output) ab.
  • GPT-Realtime-Translate – Live-Übersetzung in Echtzeit, 70+ Eingabesprachen, 13 Ausgabesprachen. Preis: $0,034/Min.
  • Transkriptiongpt-transcribe ($0,0045/Min.), gpt-live-transcribe ($0,017/Min.) und gpt-realtime-whisper (Live Speech-to-Text in der Realtime-API, $0,017/Min.).

Diese Modelle eignen sich für Voice-Agenten, Konferenz-Übersetzung und Echtzeit-Notizen. Wichtig für laufende Projekte: Die Legacy-Audio- und Realtime-Modelle werden zum 20. Januar 2027 abgeschaltet; Zielmodelle der Migration sind gpt-realtime-2.1 und gpt-realtime-2.1-mini.

Neu seit 26. August 2026 – Whisper-Abkündigung: OpenAI hat whisper-1, gpt-4o-transcribe, gpt-4o-mini-transcribe und gpt-4o-transcribe-diarize abgekündigt. Die Modelle werden am 26. Februar 2027 aus der API entfernt; als Nachfolger nennt OpenAI gpt-live-transcribe (Streaming) und gpt-transcribe (Batch). Wer Whisper über die OpenAI-API für Meeting-Protokolle, Call-Center-Transkripte oder Diarisierung einsetzt, sollte die Migration jetzt einplanen – insbesondere, weil sich Ausgabeformate und Diarisierungslogik beim Modellwechsel ändern können.

Embeddings

Für Retrieval- und RAG-Szenarien bleiben text-embedding-3-large ($0,13/1M Token) und text-embedding-3-small ($0,02/1M Token) die aktuellen Modelle – einen angekündigten Nachfolger gibt es derzeit nicht.

Cybersecurity-Modelle

Am 7. August 2026 hat OpenAI laut API-Changelog die Tiers Daybreak Blue und Daybreak Red mit dem Modell gpt-daybreak-red-latest für freigegebene Defender in der API veröffentlicht; seit dem 11. August 2026 stehen berechtigten Kunden auf Amazon Bedrock zudem GPT-5.6 Cyber, Daybreak Red (Vulnerability Research) und Daybreak Blue (Defensive) zur Verfügung. Der Zugang ist jeweils an eine Freigabe gebunden; eine EU-Region ist auf Bedrock nicht verfügbar. Seit dem 3. September 2026 erhalten Teilnehmer des Daybreak-Programms als Erste Zugriff auf GPT-6 Astra; dessen fortgeschrittene Cyber-Fähigkeiten stehen laut OpenAI ausschließlich über Daybreak Blue bereit (siehe Abschnitt GPT-6 Astra).

GPT-5.4 – Das bewährte Flaggschiff

GPT-5.4 (5. März 2026) vereint alle wesentlichen Fähigkeiten in einem Modell und setzt neue Maßstäbe in mehreren Bereichen:

Native Computer Use

GPT-5.4 kann Desktop-Anwendungen und Browser nativ steuern – ein Durchbruch für die Automatisierung realer Workflows. Mit 75 Prozent auf dem OSWorld-Verified-Benchmark übertrifft es die menschliche Baseline (72,4 Prozent) bei GUI-Automatisierung.

1 Million Token Kontextfenster

Mit bis zu 1.050.000 Token (922K Input + 128K Output) verarbeitet GPT-5.4 Dokumente, die mehrere tausend Seiten umfassen – ideal für umfangreiche Vertragsanalysen, Code-Reviews oder Forschungsdokumente.

Tool Search

Statt alle Tool-Definitionen vorab zu laden, kann GPT-5.4 Werkzeuge dynamisch suchen und nutzen. Das reduziert Token-Kosten in tool-intensiven Workflows um rund 47 Prozent.

Modellvarianten

VarianteStärkePreis (Input/1M Token)
GPT-5.4Allround-Flaggschiff$2,50
GPT-5.4 ProTiefstes Reasoning$30,00
GPT-5.4 miniSchnelle AufgabenGünstig
GPT-5.4 nanoSub-Agenten & RepetitivesSehr günstig

GPT-5.3 Codex: Agentic Coding

GPT-5.3 Codex (Februar 2026) bleibt das spezialisierte Modell für agentic coding. Es war das erste OpenAI-Modell, das bei seiner eigenen Entwicklung half, und liefert über 1.000 Token pro Sekunde in der Codex-Spark-Variante.

Weitere APIs

Realtime API

Echtzeit-Konversationen mit niedriger Latenz:

  • Speech-to-Speech: Natürliche Gespräche
  • Text, Audio, Bild: Multimodale Eingaben in Echtzeit

Videos API: Sora 2 wird eingestellt

OpenAI hat die Videogenerierung abgekündigt: sora-2, sora-2-pro und die Videos API werden zum 24. September 2026 abgeschaltet – ohne Nachfolgemodell. Wer Videogenerierung produktiv einsetzt, sollte jetzt eine Alternative evaluieren. Wir unterstützen bei der Auswahl und Migration.

GPT Image 2 (Bildgenerierung)

Aktuelles Bildgenerierungsmodell von OpenAI (gpt-image-2, seit 21. April 2026):

  • High-Fidelity: Hochwertige Bildausgabe
  • Bildbearbeitung: Modifikation bestehender Bilder
  • Migration: Der Vorgänger gpt-image-1 wird am 23. Oktober 2026 abgeschaltet

Abkündigungen und Migrationsfahrplan

OpenAI hat für die zweite Jahreshälfte 2026 einen dichten Deprecation-Kalender veröffentlicht. Der erste Termin ist bereits Vergangenheit: Die Assistants API wurde am 26. August 2026 abgeschaltet – wer noch nicht migriert hat, muss jetzt auf die Responses API und die Conversations API wechseln. Für Bestandsprojekte lohnt sich ein früher Blick auf die übrigen Termine:

DatumBetroffenNachfolger
26. August 2026 (erfolgt)Assistants APIResponses API + Conversations API
24. September 2026sora-2, sora-2-pro, Videos APIkein Nachfolger
23. Oktober 2026gpt-image-1gpt-image-2
23. Oktober 2026o1, o3-miniGPT-5.6 Sol
23. Oktober 2026o4-miniGPT-5.6 Terra
23. Oktober 2026diverse GPT-3.5- und GPT-4-ModelleGPT-5.6-Familie
30. November 2026Reusable Prompts, Evals-Plattform, Agent Builder
11. Dezember 2026gpt-5, o3GPT-5.6 Sol
11. Dezember 2026gpt-5-miniGPT-5.6 Terra
11. Dezember 2026gpt-5-nanoGPT-5.6 Luna
11. Dezember 2026gpt-5-pro, o3-proGPT-5.6 Sol mit reasoning.mode: pro
20. Januar 2027Legacy Audio/Realtimegpt-realtime-2.1, gpt-realtime-2.1-mini
26. Februar 2027whisper-1, gpt-4o-transcribe, gpt-4o-mini-transcribe, gpt-4o-transcribe-diarizegpt-transcribe, gpt-live-transcribe

Datenspeicherung, Zero Data Retention und Data Residency

Für DSGVO-Projekte ist neben der Region entscheidend, was mit den Daten passiert:

OpenAI direkt (Platform API): Standardmäßig speichert OpenAI Logs für das Abuse-Monitoring bis zu 30 Tage. Zero Data Retention (ZDR) ist möglich, erfordert aber eine vorherige Genehmigung durch OpenAI und zusätzliche Vertragsbedingungen; danach lässt sich ZDR auf Organisations- oder Projektebene aktivieren, wobei der Parameter store zwangsweise als false behandelt wird. ZDR-fähig sind unter anderem /v1/chat/completions, /v1/responses, /v1/images/*, /v1/embeddings, /v1/audio/*, /v1/realtime und /v1/moderationsnicht ZDR-fähig sind Assistants, Conversations und Vector Stores. Für Europa (EWR und Schweiz) bietet OpenAI zusätzlich Data Residency an; bei Modellen ab dem 5. März 2026 – und damit auch bei GPT-5.6 – fällt dafür ein Preisaufschlag von 10 Prozent an.

Neu seit 21. August 2026 – regionale Verarbeitung pro Request: Laut API-Changelog können API-Kunden die regionale Verarbeitung jetzt für einzelne Requests wählen, indem sie eine Prefix-Domain zusammen mit dem API-Key eines Projekts mit der Geografie „Global“ verwenden. Für gemischte Architekturen ist das relevant: Ein Projekt kann damit EU-relevante Anfragen regional verarbeiten lassen, ohne für alles ein separates Residency-Projekt zu betreiben. Welche Regionen und Modelle im Einzelnen unterstützt werden, prüfen wir projektspezifisch anhand der OpenAI-Dokumentation. Ergänzend sind seit dem 29. August 2026 Mutual TLS (mTLS) und X.509 Workload Identity Federation für die OpenAI-API allgemein verfügbar – hilfreich für Enterprise-Anforderungen an die Authentifizierung ohne langlebige API-Keys.

Microsoft Foundry / Azure OpenAI: Auch hier gilt standardmäßig eine Abuse-Monitoring-Retention von 30 Tagen, die nicht selbst abgeschaltet werden kann. Modified Abuse Monitoring beziehungsweise ZDR ist nur nach Freigabe durch Microsoft über das Azure-OpenAI-Limited-Access-Programm möglich und setzt in der Regel ein Enterprise Agreement oder MCA-E voraus – ein Self-Service-Schalter existiert nicht.

Wir klären diese Punkte in Projekten vor dem Go-live und dokumentieren sie im Verarbeitungsverzeichnis.

DSGVO-konformer Einsatz in der EU

Stand 3. September 2026: GPT-5.6 (Sol/Terra/Luna) ist in Microsoft Foundry als Data Zone Standard (EU) in allen neun europäischen Regionen verfügbar – inklusive Germany West Central (Frankfurt). Damit ist GPT-5.6 das höchste DSGVO-konform in EU-Data-Zones deploybare OpenAI-Modell – das heute vorgestellte GPT-6 Astra gibt es in Foundry bislang nur als Global und US Data Zone. Amazon Bedrock bietet die OpenAI-Modelle (GPT-5.6 seit Juli 2026, GPT-5.5/5.4/Codex seit 1. Juni) dagegen nur in US-Regionen an – für EU-Workloads mit Residenz-Pflicht derzeit keine Option.

Aktuell verfügbar (EU): Microsoft Foundry

GPT-5.6 (Sol, Terra, Luna), GPT-5.5 und GPT-5.4 sind in Microsoft Foundry generell verfügbar. Für DSGVO-konforme Deployments entscheidend ist der Deployment-Typ:

  • Data Zone Standard (EU) – alle drei GPT-5.6-Tiers sind laut Microsoft-Learn-Dokumentation in allen neun europäischen Foundry-Regionen gelistet: France Central, Germany West Central (Frankfurt), Italy North, Norway East, Poland Central, Spain Central, Sweden Central, Switzerland North und West Europe. Prompts und Responses werden innerhalb der angegebenen Datenzone verarbeitet („European Union: data processed within any EU member nation“), die ruhenden Daten bleiben in der Azure-Geografie. GPT-5.5 und GPT-5.4 sind hier ebenfalls verfügbar.
  • Data Zone Provisioned Managed (EU) – für planbaren Durchsatz mit reservierter Kapazität. Nur Sol und Terra sind gelistet – Luna nicht. Wer Luna produktiv einsetzen will, ist damit auf Data Zone Standard beziehungsweise Batch angewiesen.
  • Data Zone Batch (EU) – für asynchrone Massenverarbeitung, ebenfalls innerhalb der EU-Datenzone.
  • Global Standard – deploybar, die Inferenz kann jedoch weltweit erfolgen. Für EU-Datenverarbeitung ist ausdrücklich Data Zone Standard (EU) zu wählen.

Für GPT-5.6 gilt: Tier-5- und Tier-6-Subscriptions haben Standard-Quota, niedrigere Quota-Tiers müssen einen Quota-Antrag stellen. Daneben steht die klassische GPT-5-Familie weiterhin über den Azure OpenAI Service in West Europe (Niederlande, EU Data Boundary), Germany West Central (Frankfurt) und Sweden Central bereit. Die konkrete Region- und Deployment-Verfügbarkeit prüfen wir projektspezifisch.

Amazon Bedrock: GPT-5.6 GA – aber nur US-Regionen

Seit Juli 2026 sind GPT-5.6 Sol, Terra und Luna generell auf Amazon Bedrock verfügbar (Model-IDs openai.gpt-5.6-sol, openai.gpt-5.6-terra, openai.gpt-5.6-luna über den bedrock-mantle-Endpoint mit der OpenAI Responses API). Bereits seit dem 1. Juni 2026 stehen GPT-5.5, GPT-5.4 und Codex auf Bedrock bereit. Hintergrund ist die strategische Partnerschaft zwischen Amazon und OpenAI (50 Mrd. USD Investment), mit der AWS exklusiver Third-Party-Cloud-Distributionspartner für OpenAI Frontier wird.

Wichtig für EU-Kunden – hier korrigieren wir unsere frühere Einschätzung: Die AWS-Dokumentation listet für die OpenAI-Modelle auf Bedrock ausschließlich US-Regionen – GPT-5.6 Sol in us-east-1 (N. Virginia) und us-east-2 (Ohio), Terra und Luna zusätzlich in us-west-2 (Oregon); Cross-Region-Inference-Profile (Geo/Global) werden nicht unterstützt. Eine EU-Region (etwa eu-central-1 Frankfurt) ist bislang nicht verfügbar. Zudem ist das Kontextfenster auf Bedrock mit 272k Token deutlich kleiner als die 1,05M Token über OpenAI-API und Foundry, und Sol lässt sich dort nur mit den Reasoning-Stufen medium und maximum betreiben – die volle sechsstufige Skala steht nicht zur Verfügung. Positiv: Die Preise entsprechen den OpenAI-First-Party-Raten, Prompt Caching wird mit 90 Prozent Rabatt auf gecachte Inputs unterstützt, und AWS beschreibt für die OpenAI-Modelle einen „Zero-operator access“ auf Chip-Ebene; von Klassifizierern markierter Traffic wird bis zu 30 Tage gespeichert. Für DSGVO-Workloads mit EU-Residenz-Pflicht bleibt Bedrock bei OpenAI-Modellen damit vorerst außen vor – wir prüfen die EU-Region-Verfügbarkeit laufend.

Integration mit CompanyGPT

Mit CompanyGPT können Sie GPT-Modelle DSGVO-konform in Ihrem Unternehmen einsetzen – ohne dass Ihre Daten zum Training verwendet werden.

Unsere Empfehlung

Zu GPT-6 Astra: Beobachten, noch nicht migrieren. Das Modell ist zum Stand 3. September 2026 nur für das Trusted Access Program freigeschaltet, in Foundry ohne EU Data Zone und mit Cyber-Monitoring, das legitime Arbeit ausbremsen kann. Sinnvoll ist ein Evaluations-Slot, sobald die API offen ist – gemessen am Preis pro erledigter Aufgabe, nicht pro Token, weil Astra beim 2,5-Fachen des Sol-Aktionspreises liegt.

Mit den aktuellen Preisen und der breiten Data-Zone-Verfügbarkeit hat sich unsere Empfehlung verschoben – wir empfehlen zwei Modelle mit klar getrennten Rollen:

  • GPT-5.6 Luna über Microsoft Foundry (Data Zone Standard, EU) – der neue Default für den Großteil der Unternehmens-Workloads. Luna bietet dasselbe Kontextfenster wie das Flaggschiff (1,05M Token), den vollen Tool-Support und die EU Data Zone in allen neun europäischen Foundry-Regionen – zu einem Bruchteil der Kosten ($0,20/1M Input, $1,20/1M Output). Für Chat-Assistenten, Klassifikation, Extraktion, Zusammenfassungen, RAG und Sub-Agenten ist das in der Regel die wirtschaftlich richtige Wahl.
  • GPT-5.6 Sol über Microsoft Foundry (Data Zone Standard, EU) – das Flaggschiff für die anspruchsvollsten Aufgaben. Für tiefe Reasoning-Ketten, komplexes Coding und autonome agentische Workflows bleibt Sol die Referenz – seit dem 21. August 2026 zum Aktionspreis von $4,00/1M Input und $20,00/1M Output (mindestens bis 21. November 2026; Listenpreis zuvor $5,00/$30,00). Ob der Foundry-Preis dem OpenAI-Aktionspreis folgt, prüfen wir projektspezifisch. Quota-Hinweis: Tier 5/6 haben Standard-Quota, darunter ist ein Quota-Antrag nötig.
  • GPT-5.6 Terra – der Mittelweg ($2,00/1M Input, $12,00/1M Output). Sinnvoll, wenn Luna in der Qualität nicht ausreicht, Sol aber überdimensioniert ist – oder wenn Data Zone Provisioned Managed benötigt wird, das für Luna nicht gelistet ist.

Ehrlich zu den Grenzen von Luna: Die Reasoning-Tiefe liegt unter der von Sol und Terra – bei anspruchsvollen Analyse- und Coding-Aufgaben lohnt der Vergleich mit dem größeren Tier. Prompts oberhalb von 272.000 Token werden – wie bei Sol und Terra – mit doppeltem Input- und 1,5-fachem Output-Preis abgerechnet, was den Kostenvorteil bei sehr langem Kontext relativiert. Und für PTU-Kunden ist Luna derzeit keine Option, weil es in der Data-Zone-Provisioned-Managed-Tabelle nicht gelistet ist. Unsere Empfehlung lautet daher: Workloads standardmäßig auf Luna aufsetzen und gezielt dort auf Terra oder Sol eskalieren, wo die Qualität es erfordert.

Weitere Optionen:

  • GPT-5.5 / GPT-5.4 über Microsoft Foundry (Data Zone Standard) – bewährte Optionen für Bestandsprojekte; ein Wechsel auf GPT-5.6 lohnt sich wegen des identischen Kontextfensters (1,05M Token) und der besseren Benchmarks meist kurzfristig.
  • GPT-5.5 Instant in Microsoft Foundry (gpt-chat-latest) – weiterhin gute Wahl für Chat-Workloads in EU-Regionen.
  • Amazon Bedrock – GPT-5.6/5.5/5.4 sind dort GA, aber nur in US-Regionen, mit reduziertem 272k-Kontextfenster und bei Sol nur mit zwei Reasoning-Stufen. Für EU-Workloads mit Residenz-Pflicht derzeit keine Option; als Multi-Cloud-Pfad für US-Workloads aber interessant.

Die Plattformlandschaft bewegt sich derzeit schnell: Microsoft Foundry und AWS Bedrock erweitern Modell- und Region-Abdeckung laufend. Wir prüfen die jeweils aktuelle EU-Verfügbarkeit projektspezifisch. Für spezialisierte Coding-Aufgaben eignet sich GPT-5.3 Codex (ebenfalls GA auf Bedrock). Wer noch auf gpt-5, o3 oder o4-mini läuft, sollte die Migration jetzt einplanen – der Abkündigungskalender reicht bis Februar 2027 (Whisper-Transkriptionsmodelle). Die Assistants API ist seit dem 26. August 2026 bereits abgeschaltet.

Kostenkalkulation für dieses Modell

Eine aktuelle Übersicht über Token-Preise, Modellvarianten und EU-Verfügbarkeit finden Sie auf unserem Schwesterprojekt ai-prices.eu. Dort lassen sich die laufenden Betriebskosten für Ihren konkreten Anwendungsfall vergleichen und abschätzen.

Preise auf ai-prices.eu vergleichen

ai-prices.eu ist ein Projekt der innFactory AI Consulting GmbH und hilft bei der transparenten Preisabschätzung führender KI-Modelle.

Häufig gestellte Fragen

Was ist GPT-6 Astra und wer kann es nutzen?

GPT-6 Astra (gpt-6-astra) ist das am 3. September 2026 vorgestellte Modell der sechsten OpenAI-Generation. Zum Start erhalten nur Unternehmen im Trusted Access Program (Daybreak) Zugriff; der Zugang über die API und die ChatGPT-Pläne Plus, Pro, Business und Enterprise folgt laut OpenAI in den kommenden Tagen. Microsoft Foundry startet über das Limited Access Program, Amazon Bedrock ist angekündigt.

Was kostet GPT-6 Astra?

In der OpenAI-API 10 USD pro 1 Million Input-Token, 1 USD für Cached Input und 50 USD pro 1 Million Output-Token bis 272k Token Kontext; darüber 20 / 2 / 75 USD. Batch und Flex kosten die Hälfte, der Fast Mode das Doppelte (20 / 100 USD). In Microsoft Foundry kostet die US Data Zone 11 / 55 USD. Das ist das 2,5-Fache des Aktionspreises von GPT-5.6 Sol (4 / 20 USD).

Ist GPT-6 Astra in der EU mit Datenresidenz verfügbar?

Nein, Stand 3. September 2026. Microsoft Foundry bietet GPT-6 Astra laut Azure-Blog nur als Standard Global und Standard Data Zone (US) an, eine EU Data Zone ist nicht gelistet; auf Amazon Bedrock ist das Modell noch nicht verfügbar. Für EU-Residenzpflicht bleibt GPT-5.6 (Sol, Terra, Luna) über die Data Zone Standard (EU) in allen neun europäischen Foundry-Regionen das höchste OpenAI-Modell.

Welche Einschränkungen hat GPT-6 Astra?

Astra ist das erste OpenAI-Modell mit der Einstufung Critical für Cybersecurity im Preparedness Framework. Die allgemein verfügbare Variante verweigert fortgeschrittene Cybersecurity-Aufgaben, und Monitoring kann legitime Arbeit verlangsamen oder pausieren. Technisch entfallen der Reasoning-Effort none, eigene temperature- und top_p-Werte sowie Logprobs; Tool-Calling läuft nur über die Responses API, Realtime, Assistants API und Fine-Tuning werden nicht unterstützt.

Welches OpenAI-Modell empfehlen wir für DSGVO-pflichtige Workloads?

GPT-5.6 Luna über Microsoft Foundry als Data Zone Standard (EU) für den Großteil der Unternehmens-Workloads (0,20 / 1,20 USD pro 1M Token, 1,05M Kontext) und GPT-5.6 Sol für die anspruchsvollsten Aufgaben (Aktionspreis 4 / 20 USD mindestens bis 21. November 2026). Beide laufen in allen neun europäischen Foundry-Regionen, darunter Germany West Central. GPT-6 Astra empfehlen wir erst zu evaluieren, wenn die API offen ist und eine EU Data Zone dokumentiert wird.

Wie schneidet GPT-6 Astra in Benchmarks ab?

Laut OpenAI erreicht GPT-6 Astra 98,6 Prozent auf ARC-AGI-3, 97,6 Prozent auf FrontierMath Tier 4 v2, 96 Prozent auf GPQA Diamond, 74,1 Prozent auf DeepSWE v1.1 und 72,6 Prozent auf OSWorld 2.0 (GPT-5.6 Sol: 65,7 Prozent). Der Knowledge Cutoff liegt beim 30. April 2026, das Kontextfenster bei 1.050.000 Token. Unabhängige Messungen lagen zum Launch noch nicht vor.

Beratung zu diesem Modell?

Wir helfen Ihnen bei der Auswahl und Integration des richtigen KI-Modells für Ihren Anwendungsfall.