Als KI-Beratung aus Rosenheim unterstützen wir Unternehmen im DACH-Raum bei der DSGVO-konformen Integration von OpenAI-Modellen. Mit unserem CompanyGPT können Sie GPT-Modelle sicher in Ihrer eigenen Infrastruktur betreiben.
Was ist GPT?
GPT (Generative Pre-trained Transformer) ist die KI-Modellfamilie von OpenAI. Neu am 3. September 2026: OpenAI hat mit GPT-6 Astra (gpt-6-astra) die sechste Generation vorgestellt – zunächst nur für Unternehmen im Trusted Access Program, API und ChatGPT-Pläne folgen laut OpenAI „in den kommenden Tagen“; eine EU Data Zone gibt es dafür bislang nicht (Details im Abschnitt GPT-6 Astra). Seit dem 9. Juli 2026 ist GPT-5.6 (Tiers Sol, Terra, Luna) allgemein verfügbar – in ChatGPT, Codex und der API – und bleibt das höchste EU-Data-Zone-fähige OpenAI-Modell. Der Start erfolgte gestaffelt: Nach einer staatlich freigegebenen Limited Preview ab dem 26. Juni schloss das US-Handelsministerium seine Prüfung am 8. Juli ab und gab das Modell für den öffentlichen Launch frei. Die wichtigste Neuigkeit für EU-Kunden: Microsoft Foundry listet alle drei Tiers – gpt-5.6-sol, gpt-5.6-terra und gpt-5.6-luna – als Data Zone Standard (EU) in allen neun europäischen Foundry-Regionen, darunter Germany West Central (Frankfurt), West Europe und Sweden Central. Prompts und Responses werden dabei innerhalb der EU-Datenzone verarbeitet. Damit ist GPT-5.6 DSGVO-konform in EU-Data-Zones deploybar und löst GPT-5.5 als höchstes EU-verfügbares OpenAI-Modell ab. Amazon Bedrock bietet GPT-5.6 seit Juli 2026 GA an – allerdings ausschließlich in US-Regionen; eine EU-Region listet die AWS-Dokumentation weder für GPT-5.6 noch für GPT-5.5 (Stand 3. September 2026). Seit dem 21. August 2026 gilt für GPT-5.6 Sol zudem ein Aktionspreis von $4/1M Input und $20/1M Output (zuvor $5/$30), den OpenAI mindestens bis zum 21. November 2026 zusichert. Daneben bleiben GPT-5.5 (April 2026) und GPT-5.4 (März 2026, 1-Million-Token-Kontextfenster, native Computer-Steuerung) als bewährte EU-Optionen über Microsoft Foundry verfügbar, GPT-5.5 Instant steht als gpt-chat-latest bereit. Für spezialisierte Coding-Aufgaben steht weiterhin GPT-5.3 Codex zur Verfügung; die o-Serie mit o3 und o4-mini ist dagegen abgekündigt und wandert bis Ende 2026 auf GPT-5.6.
GPT-6 Astra: Sechste Generation im gestaffelten Rollout (3. September 2026)
Am 3. September 2026 hat OpenAI GPT-6 Astra (gpt-6-astra) vorgestellt. OpenAI-Präsident Greg Brockman spricht von einem „generational leap“ und begrüßt die „AGI era“; OpenAI beschreibt das Modell als sein bislang intelligentestes und am besten ausgerichtetes. Die Codename-Vorgeschichte: Bereits am 1. August 2026 hatte OpenAI „Astra“ als nächstes großes Modell genannt, am 18. August das Training wegen der Cyber-Fähigkeiten für zwei Wochen pausiert.
Zugang – bewusst gestaffelt: Zum Start erhalten Unternehmen im Trusted Access Program (Daybreak-Programm für Cybersecurity-Defender) Zugriff. Der Zugang über die API sowie die ChatGPT-Pläne Plus, Pro, Business und Enterprise folgt laut OpenAI „in den kommenden Tagen“; Medienberichte nennen den 9. September 2026 als erwarteten breiten Start – von OpenAI nicht bestätigt. Microsoft Foundry startet parallel über das Foundry Limited Access Program, Amazon Bedrock ist angekündigt, in der AWS-Modell-Dokumentation zum Stand 3. September aber noch nicht gelistet.
Leistung (Angaben OpenAI): ARC-AGI-3 98,6 %, FrontierMath Tier 4 v2 97,6 % (Claude Fable 5.1 laut OpenAI-Vergleich 87,8 %), GPQA Diamond 96 %, DeepSWE v1.1 74,1 %, BenchCAD 95,9 %, OSWorld 2.0 72,6 % bei rund 40 Minuten pro Aufgabe (GPT-5.6 Sol: 65,7 % bei 75 Minuten). Der Schwerpunkt liegt auf Computer Use: Astra bedient Browser, Tabellen, Websites und Desktop-Anwendungen – Formulare, CRMs, Kalender, Python-Notebooks, Power BI, KiCad, FreeCAD – über die menschliche Oberfläche statt über APIs. Beim DeepSWE-Vergleich nennt OpenAI rund 57 % geringere geschätzte API-Kosten pro Aufgabe gegenüber der besten GPT-5.6-Sol-Konfiguration. Auffällig: Der GDPval-Benchmark für reale Berufsaufgaben fehlt in den Launch-Materialien.
Technische Daten: Kontextfenster 1.050.000 Token (922k Input, 128k Output), Knowledge Cutoff 30. April 2026, Eingabe Text und Bild, Ausgabe Text. Fünf Reasoning-Stufen (low, medium, high, xhigh, max) – die Stufe none entfällt. Endpunkte: Responses, Chat Completions und Batch; kein Realtime, keine Assistants API, kein Fine-Tuning. Eigene temperature- oder top_p-Werte und Logprobs werden nicht unterstützt, Tool-Calling läuft ausschließlich über die Responses API. Neu in der Responses API sind asynchrone Tool-Aufrufe, Mid-Turn-Steuerung per WebSocket und der Wechsel des Reasoning-Efforts mitten in der Konversation unter Erhalt des Prompt-Caches.
Preise (OpenAI First Party, pro 1M Token): $10,00 Input, $1,00 Cached Input, $12,50 Cache Write, $50,00 Output bis 272k Token; darüber $20,00 / $2,00 / $75,00. Batch und Flex jeweils 50 %, Fast Mode $20,00 / $100,00 (Long Context $40,00 / $150,00). Damit liegt Astra beim 2,5-Fachen des Sol-Aktionspreises. OpenAI argumentiert, dass der Vergleich künftig über den Preis pro erledigter Aufgabe statt pro Token laufen sollte – für Budgetplanungen empfehlen wir genau diese Messung, bevor ein Workload migriert wird.
Sicherheit – der Punkt, den Compliance-Verantwortliche kennen sollten: Astra ist laut OpenAI das erste Modell, das im Preparedness Framework die Stufe „Critical“ für Cybersecurity erreicht – es kann bislang unbekannte Schwachstellen finden und Exploits entwickeln. Die Folge ist ein Defense-in-Depth-Ansatz aus Modellverhalten, Klassifikatoren, Sicherheitskontrollen, Monitoring und Post-Deployment-Reaktion: Die allgemein verfügbare Variante verweigert fortgeschrittene Cybersecurity-Aufgaben, und OpenAI räumt ein, dass legitime Arbeit durch das Monitoring verlangsamt oder pausiert werden kann. Fortgeschrittene Cyber-Fähigkeiten gibt es nur über Daybreak Blue für geprüfte Defender. Wer Astra in Sicherheits- oder Entwicklungsteams einsetzen will, sollte diese Eingriffe im Betriebskonzept einplanen.
EU-Verfügbarkeit (Stand 3. September 2026): Der Azure-Blog listet für GPT-6 Astra in Microsoft Foundry ausschließlich Standard Global ($10,00 / $50,00) und Standard Data Zone (US) ($11,00 / $55,00; Long Context $22,00 / $82,50) – keine EU Data Zone, kein Provisioned, kein Batch. Auf Bedrock fehlt das Modell noch. Für Workloads mit EU-Residenzpflicht bleibt damit GPT-5.6 über die EU-Data-Zones von Foundry das höchste verfügbare OpenAI-Modell; wir aktualisieren diese Seite, sobald Microsoft eine EU Data Zone für Astra dokumentiert.
GPT-5.6 (Sol, Terra, Luna): Seit 9. Juli 2026 allgemein verfügbar
Am 9. Juli 2026 hat OpenAI die GPT-5.6-Familie öffentlich gelauncht – in ChatGPT, Codex und der API. Das neue Namensschema trennt die Generationsnummer (5.6) von dauerhaften Leistungs-Tiers; mini/nano-Varianten gibt es nicht mehr:
- GPT-5.6 Sol (
gpt-5.6-sol) – Flaggschiff, laut OpenAI das bisher stärkste Modell (Fokus Coding, Knowledge Work, Cybersecurity, Wissenschaft). Terminal-Bench 2.1: 88,8 %, mit der Ultra-Konfiguration (Subagenten) 91,9 % – neuer State of the Art. Der Aliasgpt-5.6routet auf Sol. - GPT-5.6 Terra (
gpt-5.6-terra) – ausgewogenes Tier zwischen Sol und Luna. - GPT-5.6 Luna (
gpt-5.6-luna) – schnelles, sehr günstiges Tier mit demselben Kontextfenster und Funktionsumfang wie Sol und Terra.
Preise pro 1 Million Token (OpenAI First Party, USD)
| Modell | Input | Cached Input | Cache Write | Output | Input / Output über 272k Token |
|---|---|---|---|---|---|
| GPT-5.6 Sol (Aktionspreis) | $4,00 | $0,40 | $5,00 | $20,00 | $8,00 / $30,00 |
| GPT-5.6 Terra | $2,00 | $0,20 | $2,50 | $12,00 | $4,00 / $18,00 |
| GPT-5.6 Luna | $0,20 | $0,02 | $0,25 | $1,20 | $0,40 / $1,80 |
Preissenkung bei Sol: Seit dem 21. August 2026 kostet GPT-5.6 Sol $4,00/1M Input (minus 20 Prozent) und $20,00/1M Output (minus 33 Prozent) statt zuvor $5,00/$30,00. OpenAI bezeichnet das ausdrücklich als Aktionspreis („promotional pricing“), der mindestens bis zum 21. November 2026 gilt – für Budgetplanungen über diesen Termin hinaus sollten Sie mit dem Listenpreis rechnen.
Für alle drei Tiers gilt laut OpenAI-Preisliste: Prompts oberhalb von 272.000 Token werden mit dem doppelten Input- und dem 1,5-fachen Output-Preis abgerechnet (Stand 3. September 2026). Wer regelmäßig sehr lange Kontexte verarbeitet, sollte das in der Kostenrechnung berücksichtigen. Seit dem 5. August 2026 unterstützt zudem der Fast-Modus Prompts über 272k Token für Sol, Terra und Luna (laut OpenAI bis zu 2,5× schneller als Standard); am 13. August folgte ein Ultrafast-Tier für Sol als Limited Preview (laut OpenAI bis zu 14× schneller als Standard).
Alle drei Modelle bieten ein Kontextfenster von 1.050.000 Token (922k Input, 128k Output) mit Knowledge Cutoff 16. Februar 2026. Als Modalitäten unterstützt GPT-5.6 Text und Bild als Eingabe und Text als Ausgabe – Audio- und Videoausgabe decken andere Modelle der Familie ab (Realtime, GPT Image). Der Reasoning-Aufwand lässt sich in sechs Stufen steuern – none, low, medium (Standard), high, xhigh und max –, zusätzlich gibt es reasoning.mode: pro als Ersatzpfad für die früheren Pro-Modelle. Unterstützt werden Web Search, File Search, Image Generation, Code Interpreter, Hosted Shell, Apply Patch, Skills, Computer Use, MCP und Tool Search sowie Streaming, Structured Outputs, Function Calling und Prompt Caching. Neu in der API sind außerdem Programmatic Tool Calling, erweiterte Multi-Agent-Fähigkeiten und Prompt-Cache-Breakpoints. Parallel zum Launch hat OpenAI ChatGPT Work vorgestellt – einen von Sol angetriebenen Arbeits-Agenten mit Codex-Integration, zunächst für Pro-, Enterprise- und Edu-Kunden.
GPT-5.6 in ChatGPT: Luna als neuer Standard für Free und Go
Laut Medienberichten hat OpenAI am 6. August 2026 die Modellzuordnung in ChatGPT umgestellt: GPT-5.6 Luna ist seitdem das Standard-Modell für Free- und Go-Nutzer und ersetzt dort GPT-5.5 Instant. Im API-Changelog vom selben Tag bestätigt OpenAI ein Update des Snapshots chat-latest auf das aktuelle ChatGPT-Modell und empfiehlt für Produktions-Workloads GPT-5.6 Sol. Free und Go erhalten damit unbegrenzte Textchats; Limits bleiben für Uploads, Bildgenerierung und Tool-Nutzung bestehen. GPT-5.6 Sol ist das Modell für Plus, Pro, Business und Enterprise. Ergänzend gibt es einen „Think“-Button, mit dem sich für eine Anfrage gezielt mehr Reasoning anfordern lässt.
Ein ehrlicher Blick auf die Benchmarks gehört dazu: Auf SWE-Bench Pro erreicht Sol laut unabhängiger Auswertung nur 64,6 % gegenüber rund 80 % bei Claude Fable 5 – OpenAI hält allerdings rund 30 % der SWE-Bench-Pro-Aufgaben für fehlerhaft. Bei agentischen Benchmarks wie Terminal-Bench liegt Sol dagegen vorn; auf dem Artificial Analysis Coding Agent Index v1.1 erreicht Sol mit maximalem Reasoning 80 Punkte. OpenAI gibt zudem an, dass Sol bei Coding-Aufgaben rund 54 Prozent token-effizienter arbeite als der Vorgänger – diese Angabe stammt aus Sekundärquellen und ist von uns nicht unabhängig überprüft.
Vom staatlichen Freigabeprozess zum Public Launch
Update – Stand 3. September 2026: GPT-5.6 ist in EU-Data-Zones deploybar. Microsoft Foundry führt alle drei Tiers (Sol, Terra, Luna) als Data Zone Standard (EU) in allen neun europäischen Regionen. Amazon Bedrock bietet GPT-5.6 seit Juli 2026 ebenfalls GA an, dort jedoch nur in US-Regionen. Für DSGVO-konforme EU-Deployments ist damit GPT-5.6 über Microsoft Foundry die Referenz – als Preis-Leistungs-Empfehlung neu GPT-5.6 Luna.
Der Weg zum Launch war ungewöhnlich: GPT-5.6 startete am 26. Juni 2026 zunächst nur als staatlich freigegebene Limited Preview für eine kleine Gruppe geprüfter Organisationen. Hintergrund war eine US-Cybersecurity-Anordnung, nach der das US-Handelsministerium (Center for AI Standards and Innovation) das Modell vor dem öffentlichen Release prüfen konnte – ausgelöst durch die „High“-Einstufung in Cybersecurity im OpenAI Preparedness Framework. Am 8. Juli 2026 wurde die Prüfung abgeschlossen und die Beschränkung aufgehoben; einen Tag später folgte der öffentliche Launch. Damit wiederholte sich das Muster von Anthropic (Claude Fable 5 / Mythos 5, Anthropic Claude) nur wenige Tage später – inklusive Aufhebung. Mehr zur Vorgeschichte in unserem Blogbeitrag zu GPT-5.6 und Claude Fable 5.
GPT-5.5 – Das Flaggschiff der Vorgängergeneration
GPT-5.5 (23. April 2026, Codename „Spud”) war bis zum GPT-5.6-Launch das Spitzenmodell von OpenAI. Es ist effizienter als GPT-5.4 und bietet verbesserte Coding-Fähigkeiten. Neben dem Basismodell stehen die Varianten GPT-5.5 Thinking und GPT-5.5 Pro zur Verfügung. Seit dem 24. April 2026 ist GPT-5.5 auch in der API verfügbar ($5/1M Input, $30/1M Output, 1M Kontextfenster).
GPT-5.5 Instant (Mai 2026)
Am 5. Mai 2026 hat OpenAI GPT-5.5 Instant als neues Standard-Chat-Modell in ChatGPT eingeführt – es ersetzt GPT-5.3 Instant. In internen Evaluierungen produziert GPT-5.5 Instant 52,5 Prozent weniger Halluzinationen als GPT-5.3 Instant bei High-Stakes-Prompts (Medizin, Recht, Finanzen). In der API ist es als chat-latest und in Microsoft Foundry als gpt-chat-latest verfügbar – damit ist es auch für DSGVO-konforme Enterprise-Deployments in EU-Regionen erreichbar (je nach Foundry-Region-Konfiguration).
Realtime-Voice- und Transkriptionsmodelle
Die Realtime-Familie hat seit Mai 2026 eine Generation übersprungen. Aktueller Stand (3. September 2026):
- GPT-Realtime-2.1 (
gpt-realtime-2.1) und GPT-Realtime-2.1-mini – die aktuelle Realtime-Voice-Generation. Sie lösen das im Mai 2026 eingeführte GPT-Realtime-2 (128k Token Kontextfenster, $32/1M Audio-Input, $64/1M Audio-Output) ab. - GPT-Realtime-Translate – Live-Übersetzung in Echtzeit, 70+ Eingabesprachen, 13 Ausgabesprachen. Preis: $0,034/Min.
- Transkription –
gpt-transcribe($0,0045/Min.),gpt-live-transcribe($0,017/Min.) undgpt-realtime-whisper(Live Speech-to-Text in der Realtime-API, $0,017/Min.).
Diese Modelle eignen sich für Voice-Agenten, Konferenz-Übersetzung und Echtzeit-Notizen. Wichtig für laufende Projekte: Die Legacy-Audio- und Realtime-Modelle werden zum 20. Januar 2027 abgeschaltet; Zielmodelle der Migration sind gpt-realtime-2.1 und gpt-realtime-2.1-mini.
Neu seit 26. August 2026 – Whisper-Abkündigung: OpenAI hat whisper-1, gpt-4o-transcribe, gpt-4o-mini-transcribe und gpt-4o-transcribe-diarize abgekündigt. Die Modelle werden am 26. Februar 2027 aus der API entfernt; als Nachfolger nennt OpenAI gpt-live-transcribe (Streaming) und gpt-transcribe (Batch). Wer Whisper über die OpenAI-API für Meeting-Protokolle, Call-Center-Transkripte oder Diarisierung einsetzt, sollte die Migration jetzt einplanen – insbesondere, weil sich Ausgabeformate und Diarisierungslogik beim Modellwechsel ändern können.
Embeddings
Für Retrieval- und RAG-Szenarien bleiben text-embedding-3-large ($0,13/1M Token) und text-embedding-3-small ($0,02/1M Token) die aktuellen Modelle – einen angekündigten Nachfolger gibt es derzeit nicht.
Cybersecurity-Modelle
Am 7. August 2026 hat OpenAI laut API-Changelog die Tiers Daybreak Blue und Daybreak Red mit dem Modell gpt-daybreak-red-latest für freigegebene Defender in der API veröffentlicht; seit dem 11. August 2026 stehen berechtigten Kunden auf Amazon Bedrock zudem GPT-5.6 Cyber, Daybreak Red (Vulnerability Research) und Daybreak Blue (Defensive) zur Verfügung. Der Zugang ist jeweils an eine Freigabe gebunden; eine EU-Region ist auf Bedrock nicht verfügbar. Seit dem 3. September 2026 erhalten Teilnehmer des Daybreak-Programms als Erste Zugriff auf GPT-6 Astra; dessen fortgeschrittene Cyber-Fähigkeiten stehen laut OpenAI ausschließlich über Daybreak Blue bereit (siehe Abschnitt GPT-6 Astra).
GPT-5.4 – Das bewährte Flaggschiff
GPT-5.4 (5. März 2026) vereint alle wesentlichen Fähigkeiten in einem Modell und setzt neue Maßstäbe in mehreren Bereichen:
Native Computer Use
GPT-5.4 kann Desktop-Anwendungen und Browser nativ steuern – ein Durchbruch für die Automatisierung realer Workflows. Mit 75 Prozent auf dem OSWorld-Verified-Benchmark übertrifft es die menschliche Baseline (72,4 Prozent) bei GUI-Automatisierung.
1 Million Token Kontextfenster
Mit bis zu 1.050.000 Token (922K Input + 128K Output) verarbeitet GPT-5.4 Dokumente, die mehrere tausend Seiten umfassen – ideal für umfangreiche Vertragsanalysen, Code-Reviews oder Forschungsdokumente.
Tool Search
Statt alle Tool-Definitionen vorab zu laden, kann GPT-5.4 Werkzeuge dynamisch suchen und nutzen. Das reduziert Token-Kosten in tool-intensiven Workflows um rund 47 Prozent.
Modellvarianten
| Variante | Stärke | Preis (Input/1M Token) |
|---|---|---|
| GPT-5.4 | Allround-Flaggschiff | $2,50 |
| GPT-5.4 Pro | Tiefstes Reasoning | $30,00 |
| GPT-5.4 mini | Schnelle Aufgaben | Günstig |
| GPT-5.4 nano | Sub-Agenten & Repetitives | Sehr günstig |
GPT-5.3 Codex: Agentic Coding
GPT-5.3 Codex (Februar 2026) bleibt das spezialisierte Modell für agentic coding. Es war das erste OpenAI-Modell, das bei seiner eigenen Entwicklung half, und liefert über 1.000 Token pro Sekunde in der Codex-Spark-Variante.
Weitere APIs
Realtime API
Echtzeit-Konversationen mit niedriger Latenz:
- Speech-to-Speech: Natürliche Gespräche
- Text, Audio, Bild: Multimodale Eingaben in Echtzeit
Videos API: Sora 2 wird eingestellt
OpenAI hat die Videogenerierung abgekündigt: sora-2, sora-2-pro und die Videos API werden zum 24. September 2026 abgeschaltet – ohne Nachfolgemodell. Wer Videogenerierung produktiv einsetzt, sollte jetzt eine Alternative evaluieren. Wir unterstützen bei der Auswahl und Migration.
GPT Image 2 (Bildgenerierung)
Aktuelles Bildgenerierungsmodell von OpenAI (gpt-image-2, seit 21. April 2026):
- High-Fidelity: Hochwertige Bildausgabe
- Bildbearbeitung: Modifikation bestehender Bilder
- Migration: Der Vorgänger
gpt-image-1wird am 23. Oktober 2026 abgeschaltet
Abkündigungen und Migrationsfahrplan
OpenAI hat für die zweite Jahreshälfte 2026 einen dichten Deprecation-Kalender veröffentlicht. Der erste Termin ist bereits Vergangenheit: Die Assistants API wurde am 26. August 2026 abgeschaltet – wer noch nicht migriert hat, muss jetzt auf die Responses API und die Conversations API wechseln. Für Bestandsprojekte lohnt sich ein früher Blick auf die übrigen Termine:
| Datum | Betroffen | Nachfolger |
|---|---|---|
| 26. August 2026 (erfolgt) | Assistants API | Responses API + Conversations API |
| 24. September 2026 | sora-2, sora-2-pro, Videos API | kein Nachfolger |
| 23. Oktober 2026 | gpt-image-1 | gpt-image-2 |
| 23. Oktober 2026 | o1, o3-mini | GPT-5.6 Sol |
| 23. Oktober 2026 | o4-mini | GPT-5.6 Terra |
| 23. Oktober 2026 | diverse GPT-3.5- und GPT-4-Modelle | GPT-5.6-Familie |
| 30. November 2026 | Reusable Prompts, Evals-Plattform, Agent Builder | — |
| 11. Dezember 2026 | gpt-5, o3 | GPT-5.6 Sol |
| 11. Dezember 2026 | gpt-5-mini | GPT-5.6 Terra |
| 11. Dezember 2026 | gpt-5-nano | GPT-5.6 Luna |
| 11. Dezember 2026 | gpt-5-pro, o3-pro | GPT-5.6 Sol mit reasoning.mode: pro |
| 20. Januar 2027 | Legacy Audio/Realtime | gpt-realtime-2.1, gpt-realtime-2.1-mini |
| 26. Februar 2027 | whisper-1, gpt-4o-transcribe, gpt-4o-mini-transcribe, gpt-4o-transcribe-diarize | gpt-transcribe, gpt-live-transcribe |
Datenspeicherung, Zero Data Retention und Data Residency
Für DSGVO-Projekte ist neben der Region entscheidend, was mit den Daten passiert:
OpenAI direkt (Platform API): Standardmäßig speichert OpenAI Logs für das Abuse-Monitoring bis zu 30 Tage. Zero Data Retention (ZDR) ist möglich, erfordert aber eine vorherige Genehmigung durch OpenAI und zusätzliche Vertragsbedingungen; danach lässt sich ZDR auf Organisations- oder Projektebene aktivieren, wobei der Parameter store zwangsweise als false behandelt wird. ZDR-fähig sind unter anderem /v1/chat/completions, /v1/responses, /v1/images/*, /v1/embeddings, /v1/audio/*, /v1/realtime und /v1/moderations – nicht ZDR-fähig sind Assistants, Conversations und Vector Stores. Für Europa (EWR und Schweiz) bietet OpenAI zusätzlich Data Residency an; bei Modellen ab dem 5. März 2026 – und damit auch bei GPT-5.6 – fällt dafür ein Preisaufschlag von 10 Prozent an.
Neu seit 21. August 2026 – regionale Verarbeitung pro Request: Laut API-Changelog können API-Kunden die regionale Verarbeitung jetzt für einzelne Requests wählen, indem sie eine Prefix-Domain zusammen mit dem API-Key eines Projekts mit der Geografie „Global“ verwenden. Für gemischte Architekturen ist das relevant: Ein Projekt kann damit EU-relevante Anfragen regional verarbeiten lassen, ohne für alles ein separates Residency-Projekt zu betreiben. Welche Regionen und Modelle im Einzelnen unterstützt werden, prüfen wir projektspezifisch anhand der OpenAI-Dokumentation. Ergänzend sind seit dem 29. August 2026 Mutual TLS (mTLS) und X.509 Workload Identity Federation für die OpenAI-API allgemein verfügbar – hilfreich für Enterprise-Anforderungen an die Authentifizierung ohne langlebige API-Keys.
Microsoft Foundry / Azure OpenAI: Auch hier gilt standardmäßig eine Abuse-Monitoring-Retention von 30 Tagen, die nicht selbst abgeschaltet werden kann. Modified Abuse Monitoring beziehungsweise ZDR ist nur nach Freigabe durch Microsoft über das Azure-OpenAI-Limited-Access-Programm möglich und setzt in der Regel ein Enterprise Agreement oder MCA-E voraus – ein Self-Service-Schalter existiert nicht.
Wir klären diese Punkte in Projekten vor dem Go-live und dokumentieren sie im Verarbeitungsverzeichnis.
DSGVO-konformer Einsatz in der EU
Stand 3. September 2026: GPT-5.6 (Sol/Terra/Luna) ist in Microsoft Foundry als Data Zone Standard (EU) in allen neun europäischen Regionen verfügbar – inklusive Germany West Central (Frankfurt). Damit ist GPT-5.6 das höchste DSGVO-konform in EU-Data-Zones deploybare OpenAI-Modell – das heute vorgestellte GPT-6 Astra gibt es in Foundry bislang nur als Global und US Data Zone. Amazon Bedrock bietet die OpenAI-Modelle (GPT-5.6 seit Juli 2026, GPT-5.5/5.4/Codex seit 1. Juni) dagegen nur in US-Regionen an – für EU-Workloads mit Residenz-Pflicht derzeit keine Option.
Aktuell verfügbar (EU): Microsoft Foundry
GPT-5.6 (Sol, Terra, Luna), GPT-5.5 und GPT-5.4 sind in Microsoft Foundry generell verfügbar. Für DSGVO-konforme Deployments entscheidend ist der Deployment-Typ:
- Data Zone Standard (EU) – alle drei GPT-5.6-Tiers sind laut Microsoft-Learn-Dokumentation in allen neun europäischen Foundry-Regionen gelistet: France Central, Germany West Central (Frankfurt), Italy North, Norway East, Poland Central, Spain Central, Sweden Central, Switzerland North und West Europe. Prompts und Responses werden innerhalb der angegebenen Datenzone verarbeitet („European Union: data processed within any EU member nation“), die ruhenden Daten bleiben in der Azure-Geografie. GPT-5.5 und GPT-5.4 sind hier ebenfalls verfügbar.
- Data Zone Provisioned Managed (EU) – für planbaren Durchsatz mit reservierter Kapazität. Nur Sol und Terra sind gelistet – Luna nicht. Wer Luna produktiv einsetzen will, ist damit auf Data Zone Standard beziehungsweise Batch angewiesen.
- Data Zone Batch (EU) – für asynchrone Massenverarbeitung, ebenfalls innerhalb der EU-Datenzone.
- Global Standard – deploybar, die Inferenz kann jedoch weltweit erfolgen. Für EU-Datenverarbeitung ist ausdrücklich Data Zone Standard (EU) zu wählen.
Für GPT-5.6 gilt: Tier-5- und Tier-6-Subscriptions haben Standard-Quota, niedrigere Quota-Tiers müssen einen Quota-Antrag stellen. Daneben steht die klassische GPT-5-Familie weiterhin über den Azure OpenAI Service in West Europe (Niederlande, EU Data Boundary), Germany West Central (Frankfurt) und Sweden Central bereit. Die konkrete Region- und Deployment-Verfügbarkeit prüfen wir projektspezifisch.
Amazon Bedrock: GPT-5.6 GA – aber nur US-Regionen
Seit Juli 2026 sind GPT-5.6 Sol, Terra und Luna generell auf Amazon Bedrock verfügbar (Model-IDs openai.gpt-5.6-sol, openai.gpt-5.6-terra, openai.gpt-5.6-luna über den bedrock-mantle-Endpoint mit der OpenAI Responses API). Bereits seit dem 1. Juni 2026 stehen GPT-5.5, GPT-5.4 und Codex auf Bedrock bereit. Hintergrund ist die strategische Partnerschaft zwischen Amazon und OpenAI (50 Mrd. USD Investment), mit der AWS exklusiver Third-Party-Cloud-Distributionspartner für OpenAI Frontier wird.
Wichtig für EU-Kunden – hier korrigieren wir unsere frühere Einschätzung: Die AWS-Dokumentation listet für die OpenAI-Modelle auf Bedrock ausschließlich US-Regionen – GPT-5.6 Sol in us-east-1 (N. Virginia) und us-east-2 (Ohio), Terra und Luna zusätzlich in us-west-2 (Oregon); Cross-Region-Inference-Profile (Geo/Global) werden nicht unterstützt. Eine EU-Region (etwa eu-central-1 Frankfurt) ist bislang nicht verfügbar. Zudem ist das Kontextfenster auf Bedrock mit 272k Token deutlich kleiner als die 1,05M Token über OpenAI-API und Foundry, und Sol lässt sich dort nur mit den Reasoning-Stufen medium und maximum betreiben – die volle sechsstufige Skala steht nicht zur Verfügung. Positiv: Die Preise entsprechen den OpenAI-First-Party-Raten, Prompt Caching wird mit 90 Prozent Rabatt auf gecachte Inputs unterstützt, und AWS beschreibt für die OpenAI-Modelle einen „Zero-operator access“ auf Chip-Ebene; von Klassifizierern markierter Traffic wird bis zu 30 Tage gespeichert. Für DSGVO-Workloads mit EU-Residenz-Pflicht bleibt Bedrock bei OpenAI-Modellen damit vorerst außen vor – wir prüfen die EU-Region-Verfügbarkeit laufend.
Integration mit CompanyGPT
Mit CompanyGPT können Sie GPT-Modelle DSGVO-konform in Ihrem Unternehmen einsetzen – ohne dass Ihre Daten zum Training verwendet werden.
Unsere Empfehlung
Zu GPT-6 Astra: Beobachten, noch nicht migrieren. Das Modell ist zum Stand 3. September 2026 nur für das Trusted Access Program freigeschaltet, in Foundry ohne EU Data Zone und mit Cyber-Monitoring, das legitime Arbeit ausbremsen kann. Sinnvoll ist ein Evaluations-Slot, sobald die API offen ist – gemessen am Preis pro erledigter Aufgabe, nicht pro Token, weil Astra beim 2,5-Fachen des Sol-Aktionspreises liegt.
Mit den aktuellen Preisen und der breiten Data-Zone-Verfügbarkeit hat sich unsere Empfehlung verschoben – wir empfehlen zwei Modelle mit klar getrennten Rollen:
- GPT-5.6 Luna über Microsoft Foundry (Data Zone Standard, EU) – der neue Default für den Großteil der Unternehmens-Workloads. Luna bietet dasselbe Kontextfenster wie das Flaggschiff (1,05M Token), den vollen Tool-Support und die EU Data Zone in allen neun europäischen Foundry-Regionen – zu einem Bruchteil der Kosten ($0,20/1M Input, $1,20/1M Output). Für Chat-Assistenten, Klassifikation, Extraktion, Zusammenfassungen, RAG und Sub-Agenten ist das in der Regel die wirtschaftlich richtige Wahl.
- GPT-5.6 Sol über Microsoft Foundry (Data Zone Standard, EU) – das Flaggschiff für die anspruchsvollsten Aufgaben. Für tiefe Reasoning-Ketten, komplexes Coding und autonome agentische Workflows bleibt Sol die Referenz – seit dem 21. August 2026 zum Aktionspreis von $4,00/1M Input und $20,00/1M Output (mindestens bis 21. November 2026; Listenpreis zuvor $5,00/$30,00). Ob der Foundry-Preis dem OpenAI-Aktionspreis folgt, prüfen wir projektspezifisch. Quota-Hinweis: Tier 5/6 haben Standard-Quota, darunter ist ein Quota-Antrag nötig.
- GPT-5.6 Terra – der Mittelweg ($2,00/1M Input, $12,00/1M Output). Sinnvoll, wenn Luna in der Qualität nicht ausreicht, Sol aber überdimensioniert ist – oder wenn Data Zone Provisioned Managed benötigt wird, das für Luna nicht gelistet ist.
Ehrlich zu den Grenzen von Luna: Die Reasoning-Tiefe liegt unter der von Sol und Terra – bei anspruchsvollen Analyse- und Coding-Aufgaben lohnt der Vergleich mit dem größeren Tier. Prompts oberhalb von 272.000 Token werden – wie bei Sol und Terra – mit doppeltem Input- und 1,5-fachem Output-Preis abgerechnet, was den Kostenvorteil bei sehr langem Kontext relativiert. Und für PTU-Kunden ist Luna derzeit keine Option, weil es in der Data-Zone-Provisioned-Managed-Tabelle nicht gelistet ist. Unsere Empfehlung lautet daher: Workloads standardmäßig auf Luna aufsetzen und gezielt dort auf Terra oder Sol eskalieren, wo die Qualität es erfordert.
Weitere Optionen:
- GPT-5.5 / GPT-5.4 über Microsoft Foundry (Data Zone Standard) – bewährte Optionen für Bestandsprojekte; ein Wechsel auf GPT-5.6 lohnt sich wegen des identischen Kontextfensters (1,05M Token) und der besseren Benchmarks meist kurzfristig.
- GPT-5.5 Instant in Microsoft Foundry (
gpt-chat-latest) – weiterhin gute Wahl für Chat-Workloads in EU-Regionen. - Amazon Bedrock – GPT-5.6/5.5/5.4 sind dort GA, aber nur in US-Regionen, mit reduziertem 272k-Kontextfenster und bei Sol nur mit zwei Reasoning-Stufen. Für EU-Workloads mit Residenz-Pflicht derzeit keine Option; als Multi-Cloud-Pfad für US-Workloads aber interessant.
Die Plattformlandschaft bewegt sich derzeit schnell: Microsoft Foundry und AWS Bedrock erweitern Modell- und Region-Abdeckung laufend. Wir prüfen die jeweils aktuelle EU-Verfügbarkeit projektspezifisch. Für spezialisierte Coding-Aufgaben eignet sich GPT-5.3 Codex (ebenfalls GA auf Bedrock). Wer noch auf gpt-5, o3 oder o4-mini läuft, sollte die Migration jetzt einplanen – der Abkündigungskalender reicht bis Februar 2027 (Whisper-Transkriptionsmodelle). Die Assistants API ist seit dem 26. August 2026 bereits abgeschaltet.
