For the complete documentation index, see llms.txt. Markdown versions of documentation pages are available by appending .md to the page URL.
Hauptnavigation

Änderungsprotokoll

Informationen zu bevorstehenden Abkündigungen findest du auf der Seite zu Abkündigungen.

September 2026

15. Sept.
Funktion

Auf Organisations- und Projektebene gibt es jetzt Governance-Einstellungen für das Erstellen von API-Schlüsseln. Wer Administratorrechte hat, kann ausschließlich Schlüssel für Dienstkonten zulassen, ausschließlich Projekt-Schlüssel im Besitz von Nutzenden zulassen oder das Erstellen neuer API-Schlüssel vollständig deaktivieren. Beschränkungen auf Organisationsebene haben Vorrang vor Projekteinstellungen. Bestehende API-Schlüssel sind davon nicht betroffen. Details findest du unter Bewährte Methoden für den Produktivbetrieb.

10. Sept.
Funktion

Du kannst jetzt beim Erstellen von Projekt-API-Schlüsseln ein Ablaufdatum festlegen. Wer Administratorrechte hat, kann außerdem in den Plattform-Einstellungen auf Organisations- oder Projektebene eine maximale Gültigkeitsdauer für Schlüssel vorgeben. Neu erstellte Schlüssel müssen dann innerhalb dieses Zeitraums ablaufen. Hinweise zum Ablauf und zur Rotation von Schlüsseln findest du unter Bewährte Methoden für den Produktivbetrieb.

10. Sept.
Funktion

Die Agents API ist jetzt als öffentliche Betaversion verfügbar. Entwickle Agenten mit einem verwalteten Codex-Harness, während OpenAI die Orchestrierung der Sitzungen, die Compaction (Kontextverdichtung) und die Wiederherstellung übernimmt.

Nutze persistente Sitzungen, um die Arbeit über mehrere Gesprächsrunden hinweg fortzusetzen, Fortschritte per Streaming zu übertragen und eigene Werkzeuge und MCP-Server anzubinden. Führe Agenten in von OpenAI gehosteten Sandboxen aus oder binde eine Sandbox aus deiner eigenen Infrastruktur oder von einem unterstützten Anbieter an.

Beginne mit dem Schnellstart für die Agents API.

10. Sept.
Funktion
gpt-live-1
v1/live/sessions

GPT-Live 1 ist jetzt in der API allgemein verfügbar. Entwickle Vollduplex-Sprachunterhaltungen, die weiterlaufen können, während ein Backend-Modell oder Agent den Reasoning-Aufwand und den Einsatz von Werkzeugen übernimmt.

Nutze die Delegierung über Responses mit einem OpenAI-Modell oder die clientseitige Delegierung, um dein eigenes Backend anzubinden. Sprachsitzungen kosten 0,05 USD pro Minute und werden sekundengenau abgerechnet. Die Nutzung des Backend-Modells und der Werkzeuge wird separat berechnet.

Lies zum Einstieg die Anleitungen zu GPT-Live, Prompts formulieren und Migration. Einzelheiten findest du unter Preise.

8. Sept.
Funktion
v1/responses

Die Diagnose des Prompt-Caches ist jetzt in der Responses API für GPT-5.6 und spätere unterstützte Modelle allgemein verfügbar.

Vergleiche die Cache-Wiederverwendung mit einer vorherigen Antwort, ermittle die Ursachen für Cache-Fehlzugriffe und folge den Hinweisen zur Fehlerbehebung, um den Cache besser wiederzuverwenden.

8. Sept.
Funktion
gpt-image-2.5-sunburst
gpt-image-2.5-flare
v1/images
v1/responses

GPT Image 2.5 Sunburst und GPT Image 2.5 Flare wurden veröffentlicht. Sie ermöglichen Bildgenerierung und -bearbeitung über die Image API und das Bildgenerierungstool der Responses API.

Verwende Sunburst für Arbeitsabläufe, bei denen präzise Bearbeitung besonders wichtig ist, oder Flare für schnelle, hochwertige Bildgenerierung im Alltag. Beide Modelle unterstützen die neuen Qualitätseinstellungen xhigh und max und verwenden die Tokenpreise von GPT Image 2. Weitere Informationen findest du im Leitfaden zur Bildgenerierung und unter Preise.

8. Sept.
Funktion
gpt-rosalind-research

GPT-Rosalind (gpt-rosalind-research) ist jetzt über das Programm für vertrauenswürdigen Zugriff für genehmigte interne Forschung in den Lebenswissenschaften allgemein verfügbar.

Die Standardpreise betragen 5 USD pro 1 Million Eingabe-Token, 0,50 USD pro 1 Million zwischengespeicherte Eingabe-Token und 25 USD pro 1 Million Ausgabe-Token. Die Abrechnung beginnt am 5. Oktober 2026. Einzelheiten findest du unter Preise.

3. Sept.
Funktion
gpt-6-astra
v1/responses
v1/chat/completions

GPT-6 Astra wurde veröffentlicht: unser leistungsfähigstes Modell, das für die durchgängige Bearbeitung besonders anspruchsvoller Aufgaben entwickelt wurde.

Verwende GPT-6 Astra für anspruchsvolle Denkaufgaben, Programmierung, Computernutzung, Recherche und Dokumenterstellung. Das Modell kombiniert diese Fähigkeiten, um komplexe Aufgaben von der ersten Anfrage bis zum fertigen Ergebnis zu bearbeiten. Dabei nutzt es den Kontext und die Werkzeuge, die du bereitstellst.

Wichtige Änderungen, die du bei der Migration berücksichtigen solltest:

  • GPT-6 Astra unterstützt die Stufe none für den Reasoning-Aufwand nicht.
  • GPT-6 Astra unterstützt weder benutzerdefinierte Werte für temperature oder top_p noch logarithmische Wahrscheinlichkeiten (logprobs).
  • Tool-Aufrufe erfordern die Responses API. Wenn du Werkzeuge mit Chat Completions verwendest, folge dem Migrationsleitfaden für die Responses API.
  • Die Überwachung auf Alignment-Abweichungen prüft bei unterstützten Responses-API-Anfragen asynchron auf mögliche Probleme während der Arbeit von Agenten. Die Prüfungen können Sicherheitswarnungen auslösen oder eine Unterhaltung zur Überprüfung anhalten.

Beginne mit GPT-6 Astra verwenden, um mehr über Funktionen, das Formulieren von Prompts und die Migration zu erfahren. Entdecke die Computernutzung für Arbeitsabläufe im Browser und auf dem Desktop. Informationen zu den verfügbaren Inferenzstufen findest du unter Preise.

3. Sept.
Funktion
v1/responses

Neue Steuerungsmöglichkeiten für lang laufende Aufgaben mit GPT-6 Astra wurden zur Responses API hinzugefügt:

  • Asynchrone Tool-Aufrufe: Lass das Modell weiterarbeiten, während deine Anwendung Funktionswerkzeuge oder benutzerdefinierte Werkzeuge ausführt, und übermittle die Ergebnisse, sobald sie vorliegen.
  • Während der Ausführung nachsteuern: Sende über WebSockets zusätzliche Anweisungen, während eine Antwort erstellt wird, damit das Modell Korrekturen oder geänderte Anforderungen berücksichtigen kann.
  • Reasoning-Aufwand während einer Unterhaltung ändern: Erhöhe den Aufwand für schwierige Aufgaben oder reduziere ihn für routinemäßige Folgeanfragen. Das zwischengespeicherte Prompt-Präfix bleibt dabei erhalten.
2. Sept.
Aktualisierung

Die API-Fehler wurden aktualisiert, damit Anwendungen zwischen zu schnell zunehmendem Anfrageaufkommen und einer vorübergehenden Überlastung des Modells unterscheiden können.

Steigt das Anfrageaufkommen zu schnell, kann ein 429-Fehler mit dem Code slow_down zurückgegeben werden. Eine vorübergehende Überlastung des Modells führt zu einem 503-Fehler mit dem Code server_is_overloaded. Beide Antworten können Retry-After enthalten. Wenn dieser Header vorhanden ist, warte vor einem erneuten Versuch mindestens so lange, wie darin angegeben. Fehlt er, verwende exponentielles Backoff. Weitere Informationen findest du im Leitfaden zu Fehlercodes und im Leitfaden zu Ratenlimits.

1. Sept.
Aktualisierung

Verbindungen zu api.openai.com können jetzt IPv6 verwenden.

August 2026

29. Aug.
Funktion

Mutual TLS (mTLS) und die Föderation von Workload-Identitäten mit X.509 sind jetzt für die OpenAI API allgemein verfügbar. Konfiguriere Zertifikate und X.509-Identitätsanbieter direkt in der Plattformkonsole. Der Zugriff wird über die Rollen und Berechtigungen deiner Organisation gesteuert.

26. Aug.
Aktualisierung
whisper-1
gpt-4o-transcribe
gpt-4o-mini-transcribe
gpt-4o-transcribe-diarize
v1/audio/transcriptions
v1/realtime

Die Abkündigung von whisper-1, gpt-4o-transcribe, gpt-4o-mini-transcribe und gpt-4o-transcribe-diarize wurde angekündigt. Diese Modelle werden am 26. Februar 2027 abgeschaltet. Migriere zu gpt-live-transcribe oder gpt-transcribe. Weitere Informationen findest du im Leitfaden zur Transkription und auf der Seite zu Abkündigungen.

Die Assistants API wurde am 26. August 2026 abgeschaltet. Migriere mithilfe des Migrationsleitfadens zur Responses API und zur Conversations API.

21. Aug.
Funktion

API-Kundschaft kann jetzt für einzelne Anfragen eine regionale Verarbeitung auswählen. Verwende dazu eine Domain mit Präfix und einen API-Schlüssel aus einem Projekt mit der geografischen Einstellung „Global“. Die bestehenden Voraussetzungen für die Berechtigung, die Steuerung der Datenaufbewahrung sowie die Unterstützung von Endpunkten und Modellen gelten weiterhin. Weitere Informationen findest du im Leitfaden zur Datenkontrolle.

21. Aug.
Aktualisierung
gpt-5.6-sol

GPT-5.6 Sol kostet jetzt 4 USD pro Million Eingabetoken und 20 USD pro Million Ausgabetoken. Damit sinken die Preise für Eingaben um 20 % und für Ausgaben um 33 %. Die Aktionspreise für GPT-5.6 Sol gelten mindestens bis einschließlich 21. November 2026. Siehe Preisdetails.

20. Aug.
Funktion

Das Dashboard für Prompt-Caching wurde auf der OpenAI API-Plattform veröffentlicht. Verfolge deine Cache-Trefferrate im Zeitverlauf, die Anzahl der Cache-Lesevorgänge pro Schreibvorgang und die Aufteilung der Token in aus dem Cache gelesene, in den Cache geschriebene und nicht zwischengespeicherte Token. So kannst du die Effizienz deines Cachings nachvollziehen und Verbesserungsmöglichkeiten erkennen. Filtere die Kennzahlen nach Modell und Servicestufe.

20. Aug.
Aktualisierung
gpt-image-2
gpt-image-2-2026-04-21
v1/images/generations
v1/images/edits
v1/responses

Transparente Hintergründe sind jetzt als Vorschau für gpt-image-2 und gpt-image-2-2026-04-21 in der Images API und im Bildgenerierungstool der Responses API verfügbar. Setze background auf transparent und verwende png oder webp als Ausgabeformat. jpeg unterstützt keine transparenten Hintergründe. Weitere Informationen findest du im Leitfaden zur Bildgenerierung.

13. Aug.
Ankündigung

Der Ultraschnellmodus wurde angekündigt: eine neue API-Servicestufe für GPT-5.6 Sol, die bis zu 14-mal so schnell ist wie die Standardverarbeitung. Sie ist für ausgewählte Kundschaft als begrenzte Vorschau verfügbar. Melde dich hier an, um Neuigkeiten zum Ultraschnellmodus zu erhalten.

7. Aug.
Funktion
gpt-5.6-cyber
gpt-daybreak-red-latest
gpt-daybreak-blue-latest
v1/responses

Daybreak bietet jetzt zwei Zugriffsstufen für zugelassene Fachkräfte in der Cyberabwehr: Daybreak Blue und Daybreak Red. Nutze sie, um bei ausdrücklich autorisierten Einsätzen aus Sicherheitsbefunden validierte Korrekturen zu entwickeln.

Beginne für die meisten Aufgaben in der Cyberabwehr mit Daybreak Blue. Es bietet Zugriff auf vielseitig einsetzbare Modelle wie GPT-5.6 Sol, um Schwachstellen zu finden, Code auf Sicherheit zu überprüfen, Erkennungsverfahren zu entwickeln, auf Sicherheitsvorfälle zu reagieren, Malware zu analysieren und Patches zu validieren. Weitere Informationen findest du hier.

Daybreak Red bietet separat genehmigten Zugriff auf speziell trainierte Modelle wie GPT-5.6 Cyber für autorisierte Aufgaben: die Reproduktion von Schwachstellen, die Validierung von Exploits, Penetrationstests, Red Teaming und die Analyse komplexer Systeme.

Diese Modelle erfordern eine separate Genehmigung und Bereitstellung. Du kannst dich hier für die Teilnahme am Daybreak-Programm bewerben. Weitere Preisdetails findest du hier.

6. Aug.
Aktualisierung
chat-latest

Der Snapshot chat-latest wurde aktualisiert. Er verweist auf das neueste Modell, das in ChatGPT für Personen mit Plus oder Pro verfügbar ist. Für den produktiven API-Einsatz empfehlen wir GPT-5.6 Sol. Du kannst dieses Modell aber nutzen, um die neuesten Verbesserungen für Chat-Anwendungsfälle zu testen. Der zugrunde liegende Modell-Snapshot wird regelmäßig aktualisiert. Weitere Informationen findest du hier.

5. Aug.
Aktualisierung
gpt-5.6-sol
gpt-5.6-terra
gpt-5.6-luna

Der Schnellmodus unterstützt jetzt Anfragen mit langem Kontext für GPT-5.6 Sol, GPT-5.6 Terra und GPT-5.6 Luna. Ab heute können Prompts mit mehr als 272.000 Token im Schnellmodus verarbeitet werden, bis zu 2,5-mal so schnell wie in der Standardstufe. Siehe Preisdetails.

4. Aug.
Funktion

Die Kundschaft kann Daten in den Dashboards für Nutzung und Kosten jetzt nach API-Schlüssel filtern und gruppieren. Die Usage API und die Costs API unterstützen die Dimension „API-Schlüssel“ auch für die programmatische Berichterstellung und Analyse.

Juli 2026

30. Juli
Aktualisierung
gpt-5.6-sol
gpt-5.6-terra
gpt-5.6-luna
v1/responses
v1/chat/completions

Ab dem 30. Juli kostet GPT-5.6 Luna 80 % weniger und GPT-5.6 Terra 20 % weniger. Siehe Preisdetails.

Wir führen außerdem den Schnellmodus in der API ein. Er ersetzt unser Angebot zur priorisierten Verarbeitung. Für GPT-5.6 Sol bietet der Schnellmodus jetzt bis zu 2,5-mal die Geschwindigkeit der Standardverarbeitung zum doppelten Preis. Diese Änderung ist abwärtskompatibel: Mit priority gekennzeichnete Anfragen verwenden automatisch den Schnellmodus.

29. Juli
Funktion

Der offizielle OpenAI Terraform-Provider wurde veröffentlicht. Damit lassen sich Ressourcen der OpenAI API-Plattform als Infrastructure as Code verwalten.

Erstelle und verwalte Projekte, Nutzende, Gruppen, Rollen, Zugriffszuweisungen, Dienstkonten, Zertifikate, Einladungen und Ratenlimits auf Projektebene. Nutze die üblichen Terraform-Arbeitsabläufe, um Änderungen zu überprüfen und anzuwenden, bestehende Ressourcen zu importieren sowie Konfigurationsabweichungen zu erkennen und zu beheben. Installiere den Provider aus der Terraform Registry.

28. Juli
Funktion
gpt-transcribe
gpt-live-transcribe
v1/audio/transcriptions
v1/realtime

GPT Transcribe wurde für die präzise Transkription von Dateien und endgültige Transkripte bestätigter Realtime-Gesprächsbeiträge veröffentlicht. Ebenfalls veröffentlicht wurde GPT Live Transcribe für Streaming-Transkription mit geringer Latenz.

Beide Modelle unterstützen frei formulierten Kontext zur Transkription, Schlüsselworthinweise und die Angabe mehrerer erwarteter Eingabesprachen. Vergleiche die unterstützten Ausgaben und Arbeitsabläufe im Leitfaden zur Transkription.

22. Juli
Funktion

Feste Ausgabenlimits für Organisationen und Projekte wurden zur OpenAI API-Plattform hinzugefügt. Lege eine monatliche Obergrenze fest. Sobald die erfassten Ausgaben dieses Limit erreichen, geben betroffene API-Anfragen einen 429-Fehler zurück. Nutze Ausgabenwarnungen, um vor einer Unterbrechung der Anfragen benachrichtigt zu werden. Weitere Informationen findest du im Leitfaden zu Ausgabenlimits.

9. Juli
Funktion
gpt-5.6-sol
gpt-5.6-terra
gpt-5.6-luna
v1/responses
v1/chat/completions
v1/batch

Die GPT-5.6-Modellfamilie wurde veröffentlicht. Dazu gehören GPT-5.6 Sol für Leistungsfähigkeit auf höchstem Niveau, GPT-5.6 Terra für ein ausgewogenes Verhältnis von Intelligenz und Kosten sowie GPT-5.6 Luna für die effiziente Bearbeitung großer Anfragevolumen. Der Alias gpt-5.6 leitet Anfragen an gpt-5.6-sol weiter.

GPT-5.6 ergänzt programmatische Tool-Aufrufe, explizite Steuerungsmöglichkeiten für Prompt-Caching, persistente Denkprozesse, die Stufe max für den Reasoning-Aufwand und den Pro-Modus sowie die Orchestrierung mehrerer Agenten als Beta für die Responses API. GPT-5.6 akzeptiert außerdem Bilder in ihren ursprünglichen Abmessungen, wenn der Bilddetailgrad auf original oder auto gesetzt ist.

6. Juli
Funktion
gpt-realtime-2.1
gpt-realtime-2.1-mini
v1/realtime

GPT-Realtime-2.1 wurde veröffentlicht: ein aktualisiertes Echtzeit-Reasoning-Modell mit verbesserter Erkennung alphanumerischer Zeichen, besserem Umgang mit Stille und Störgeräuschen sowie verbessertem Verhalten bei Unterbrechungen. Ebenfalls veröffentlicht wurde GPT-Realtime-2.1 mini, ein schnelleres, kostengünstigeres destilliertes Reasoning-Modell für Echtzeit-Sprachanwendungen.

Juni 2026

24. Juni
Aktualisierung
chat-latest

Der Snapshot chat-latest wurde aktualisiert. Er verweist auf das neueste Instant-Modell, das derzeit in ChatGPT verwendet wird. Für den produktiven API-Einsatz empfehlen wir GPT-5.5. Du kannst dieses Modell aber nutzen, um die neuesten Verbesserungen für Chat-Anwendungsfälle zu testen. Der zugrunde liegende Modell-Snapshot wird regelmäßig aktualisiert. Weitere Informationen findest du hier.

23. Juni
Funktion

Das Dashboard zur sicherheitsbezogenen Nutzung wurde auf der OpenAI API-Plattform veröffentlicht. Das Sicherheitsdashboard zeigt blockierte Responses-Anfragen anhand der safety_identifier-Werte an, die zur Identifizierung der Endnutzenden mit den Anfragen gesendet werden. Öffne das Sicherheitsdashboard.

9. Juni
Funktion
v1/responses

Die Websuche kann jetzt neben den üblichen Textergebnissen auch Bildergebnisse zurückgeben. Verwende die Bildersuche, wenn deine Anwendung aktuelle Bilder oder Bildmaterial aus dem Web benötigt, etwa Produktfotos, Sehenswürdigkeiten, Orte, Veranstaltungen oder visuelle Referenzen. Weitere Informationen findest du im Leitfaden zur Websuche.

5. Juni
Aktualisierung

Die Navigation der OpenAI API-Plattform wurde überarbeitet. Sieh sie dir hier an.

4. Juni
Funktion
omni-moderation-latest
v1/responses
v1/chat/completions

Moderationsbewertungen wurden zur Responses API und zur Chat Completions API hinzugefügt. Übergib ein moderation-Objekt in einer Generierungsanfrage, um Moderationsergebnisse sowohl für die Modelleingabe als auch für die generierte Ausgabe in derselben Antwort zu erhalten.

Weitere Informationen findest du im Leitfaden zur Moderation.

3. Juni
Aktualisierung

Die Abkündigung wiederverwendbarer Prompt-Objekte, der Evaluationsplattform und von Agent Builder wurde angekündigt. Abschaltungstermine und Hinweise zur Migration findest du auf der Seite zu Abkündigungen.

2. Juni
Aktualisierung

Ab dem 2. Juni 2026 werden berechtigte Containersitzungen pro Minute mit einer Mindestabrechnungsdauer von 5 Minuten abgerechnet, statt zum vollen Preis einer 20-minütigen Sitzung. Der zugrunde liegende Minutenpreis bleibt unverändert.

Diese Änderung soll eine feinere Abrechnung kürzerer Sitzungen ermöglichen und senkt die tatsächlich anfallenden Kosten für die Kundschaft.

Die aktuellen Preise für integrierte Werkzeuge findest du in unserer Dokumentation zu API-Preisen.

1. Juni
Funktion
gpt-5.4
gpt-5.5
v1/responses

OpenAI-Modelle sind jetzt in Amazon Bedrock über einen OpenAI-kompatiblen Endpunkt der Responses API verfügbar. Die unterstützten Modelle und Funktionen variieren je nach AWS-Region. Mehr erfahren.

Mai 2026

29. Mai
Aktualisierung
v1/responses
v1/chat/completions
v1/batch

Für Organisationen, bei denen ZDR nicht aktiviert ist, ist prompt_cache_retention jetzt standardmäßig auf 24h statt auf in_memory gesetzt. Damit ist erweitertes Prompt-Caching standardmäßig aktiviert. Mehr erfahren.

28. Mai
Aktualisierung
chat-latest

Der Snapshot chat-latest wurde veröffentlicht. Er verweist auf das neueste Instant-Modell, das derzeit in ChatGPT verwendet wird. Für den produktiven API-Einsatz empfehlen wir GPT-5.5. Du kannst dieses Modell aber nutzen, um die neuesten Verbesserungen für Chat-Anwendungsfälle zu testen. Der zugrunde liegende Modell-Snapshot wird regelmäßig aktualisiert. Weitere Informationen findest du hier.

26. Mai
Funktion

Die Föderation von Workload-Identitäten wurde veröffentlicht. Vertrauenswürdige Workloads können extern ausgestellte Identitätstoken gegen kurzlebige OpenAI-Zugriffstoken austauschen, ohne langlebige API-Schlüssel zu speichern.

26. Mai
Aktualisierung

Die Admin-API wurde um Funktionen zur Verwaltung von Ausgabenwarnungen, Modellzulassungslisten, Einstellungen zur Datenaufbewahrung und Berechtigungen für gehostete Werkzeuge sowie zur Abfrage detaillierter Abrechnungspositionen erweitert.

19. Mai
Funktion

Der sichere MCP-Tunnel wurde für Unternehmenskunden veröffentlicht. Mit dem sicheren MCP-Tunnel können unterstützte OpenAI-Produkte, darunter ChatGPT im Web, Codex, die Responses API und AgentKit, über einen kundenseitig gehosteten tunnel-client eine Verbindung zu privaten oder lokal betriebenen MCP-Servern herstellen, ohne diese Server im öffentlichen Internet zugänglich zu machen.

19. Mai
Aktualisierung

Du kannst jetzt mehrere IP-Zulassungslisten verwalten und jede davon auf Projektebene oder für die gesamte Organisation anwenden. Öffne zum Konfigurieren Einstellungen > Sicherheit > IP-Zulassungsliste.

12. Mai
Aktualisierung
dall-e-2
dall-e-3
v1/realtime

DALL·E-Modell-Snapshots und die Beta der Realtime API wurden abgekündigt.

Die DALL·E-Modell-Snapshots dall-e-2 und dall-e-3 wurden am 12. Mai 2026 abgekündigt und aus der API entfernt. Wir empfehlen, stattdessen gpt-image-2, gpt-image-1 oder gpt-image-1-mini zu verwenden.

Die Beta-Version der Realtime API wurde am 12. Mai 2026 abgekündigt und aus der API entfernt. Wenn du noch die Beta-Schnittstelle verwendest, migriere zur veröffentlichten Realtime API. Sieh dir dazu den Migrationsleitfaden und die vollständige Seite zu Abkündigungen an.

11. Mai
Funktion
v1/responses

return_token_budget wurde für das Websuche-Tool der Responses API hinzugefügt. Damit kannst du längere Websuchen mit Reasoning-Aufwand für GPT-5+ aktivieren, wenn du aufwendige Recherche- und Evaluierungsaufgaben bearbeitest.

7. Mai
Funktion
gpt-realtime-2
gpt-realtime-translate
gpt-realtime-whisper
v1/realtime
v1/realtime/translations
v1/realtime/transcription_sessions

GPT-Realtime-2 wurde veröffentlicht, ein neues Echtzeit-Sprachmodell mit konfigurierbarem Reasoning-Aufwand für Speech-to-Speech-Agenten. Ebenfalls veröffentlicht wurden GPT-Realtime-Translate für die Übersetzung von Sprache im Streaming-Verfahren und GPT-Realtime-Whisper für die Umwandlung von Sprache in Text im Streaming-Verfahren.

Der Leitfaden zu Echtzeit und Audio wurde aktualisiert und ein eigener Leitfaden zur Echtzeitübersetzung hinzugefügt. Die Dokumentation zur Echtzeittranskription wurde für Streaming-Transkripte überarbeitet. Hinweise zum Formulieren von Prompts für Echtzeitmodelle findest du jetzt unter Echtzeitmodelle verwenden.

7. Mai
Funktion

Das OpenAI Developers-Plug-in für Codex wurde veröffentlicht. Es hilft dir, KI-Anwendungen und Agenten in Codex zu entwickeln, und bietet dafür Zugriff auf die OpenAI-Plattform sowie Anleitungen zum Einrichten der OpenAI API.

6. Mai
Aktualisierung

Das aktualisierte Agents SDK ist jetzt in TypeScript verfügbar, mit integrierter Unterstützung für Sandbox-Agenten und einem Open-Source-Harness. Mehr erfährst du hier.

5. Mai
Aktualisierung
chat-latest

Der Snapshot chat-latest wurde veröffentlicht. Er verweist auf das neueste Instant-Modell, das derzeit in ChatGPT verwendet wird. Für den API-Einsatz im Produktivbetrieb empfehlen wir GPT-5.5. Mit diesem Modell kannst du unsere neuesten Verbesserungen für Chat-Anwendungsfälle testen. Der zugrunde liegende Modell-Snapshot wird regelmäßig aktualisiert. Mehr erfährst du hier.

4. Mai
Aktualisierung

Die OpenAI SDKs für Node, Python, Go, Ruby und Java unterstützen jetzt Admin-APIs. Anleitungen zum Setup und Beispiele findest du im Leitfaden zu Admin-APIs.

April 2026

24. Apr.
Funktion
gpt-5.5
gpt-5.5-pro
v1/responses
v1/chat/completions
v1/batch

GPT-5.5, ein neues Spitzenmodell für komplexe berufliche Aufgaben, wurde in der Chat Completions API und der Responses API veröffentlicht. Außerdem wurde GPT-5.5 Pro für Anfragen über die Responses API veröffentlicht, um schwierigere Probleme zu lösen, die von mehr Rechenleistung profitieren.

GPT-5.5 unterstützt ein Kontextfenster mit 1 Million Token, Bildeingaben, strukturierte Ausgaben, Funktionsaufrufe, Prompt-Caching, Stapelverarbeitung, Tool-Suche, integrierte Computernutzung, Hosted Shell, Patch anwenden, Skills, MCP und Websuche. Zu den wichtigsten Neuerungen gehören:

  • Der Reasoning-Aufwand ist jetzt standardmäßig auf medium eingestellt.
  • Wenn image_detail nicht gesetzt oder auf auto eingestellt ist, verwendet das Modell jetzt das Verhalten der Einstellung original.
  • Caching funktioniert bei GPT-5.5 nur mit erweitertem Prompt-Caching. Prompt-Caching im Arbeitsspeicher wird nicht unterstützt. Mehr erfährst du hier.
21. Apr.
Funktion
gpt-image-2
v1/images/generations
v1/images/edits
v1/batch

GPT Image 2 wurde veröffentlicht, ein hochmodernes Modell zur Bildgenerierung und -bearbeitung. GPT Image 2 unterstützt flexible Bildgrößen, detailgetreue Bildeingaben, tokenbasierte Bildpreise und die Stapelverarbeitungs-API mit 50 % Rabatt.

15. Apr.
Aktualisierung

Das Agents SDK wurde um neue Funktionen erweitert, darunter:

  • Agenten in kontrollierten Sandboxes ausführen;
  • den Open-Source-Harness untersuchen und anpassen; und
  • steuern, wann Erinnerungen erstellt und wo sie gespeichert werden.

März 2026

17. März
Funktion
gpt-5.4-mini
gpt-5.4-nano
v1/responses
v1/chat/completions

GPT-5.4 mini und GPT-5.4 nano wurden in der Chat Completions API und der Responses API veröffentlicht. GPT-5.4 mini bietet Fähigkeiten auf dem Niveau von GPT-5.4 in einem schnelleren, effizienteren Modell für ein hohes Anfragevolumen. GPT-5.4 nano ist für einfache Aufgaben mit hohem Anfragevolumen optimiert, bei denen Geschwindigkeit und Kosten im Vordergrund stehen.

GPT-5.4 mini unterstützt Tool-Suche, integrierte Computernutzung und Compaction (Kontextverdichtung). GPT-5.4 nano unterstützt Compaction (Kontextverdichtung), jedoch weder Tool-Suche noch Computernutzung.

16. März
Aktualisierung
gpt-5.3-chat-latest

Der Slug gpt-5.3-chat-latest wurde aktualisiert und verweist jetzt auf das neueste Modell, das derzeit in ChatGPT verwendet wird.

13. März
Fehlerbehebung
gpt-5.4
v1/responses
v1/chat/completions

Wir haben unseren Bildencoder aktualisiert, um einen kleinen Fehler bei input_image-Eingaben in GPT-5.4 zu beheben. Bei einigen Anwendungsfällen zum Bildverständnis kann sich dadurch die Qualität verbessern. Du musst nichts unternehmen.

12. März
Funktion
sora-2
sora-2-pro
v1/videos
v1/videos/characters
v1/videos/extensions
v1/batch

Die Sora API wurde um wiederverwendbare Charakterreferenzen, längere Generierungen von bis zu 20 Sekunden, eine Ausgabe in 1080p für sora-2-pro, Videoverlängerungen und Unterstützung der Stapelverarbeitungs-API für POST /v1/videos erweitert. Generierungen in 1080p mit sora-2-pro werden mit $0.70 pro Sekunde abgerechnet. Mehr erfährst du hier.

12. März
Aktualisierung
sora-2
sora-2-pro
v1/videos/edits
v1/videos/{video_id}/remix

POST /v1/videos/edits wurde zum Bearbeiten vorhandener Videos hinzugefügt. Dieser Endpunkt wird POST /v1/videos/{video_id}/remix ersetzen, der in 6 Monaten abgekündigt wird. Mehr erfährst du hier.

5. März
Funktion
gpt-5.4
gpt-5.4-pro
v1/responses
v1/chat/completions

GPT-5.4, unser neuestes Spitzenmodell für berufliche Aufgaben, wurde in der Chat Completions API und der Responses API veröffentlicht. Außerdem wurde GPT-5.4 Pro in der Responses API veröffentlicht, um schwierigere Probleme zu lösen, die von mehr Rechenleistung profitieren.

Ebenfalls veröffentlicht:

  • Tool-Suche in der Responses API: Damit können Modelle umfangreiche Tool-Definitionen erst zur Laufzeit laden. Das reduziert den Tokenverbrauch, erhält die Cache-Leistung und senkt die Latenz.
  • Integrierte Unterstützung für Computernutzung in GPT-5.4 über das Tool computer der Responses API für die Interaktion mit Benutzeroberflächen anhand von Screenshots.
  • Ein Kontextfenster mit 1 Million Token und native Unterstützung für Compaction (Kontextverdichtung) für länger laufende Agentenabläufe.
3. März
Funktion
gpt-5.3-chat-latest
v1/chat/completions
v1/responses

gpt-5.3-chat-latest wurde in der Chat Completions API und der Responses API veröffentlicht. Dieses Modell verweist auf den Snapshot von GPT-5.3 Instant, der derzeit in ChatGPT verwendet wird. Mehr erfährst du hier.

Februar 2026

24. Feb.
Funktion
v1/responses

Die Unterstützung für input_file in der Responses API wurde erweitert: Sie akzeptiert jetzt weitere Dateitypen für Dokumente, Präsentationen, Tabellenkalkulationen, Code und Text. Mehr erfährst du hier.

24. Feb.
Funktion
v1/responses

phase wurde in der Responses API veröffentlicht. Es kennzeichnet eine Assistentennachricht als Zwischenkommentar (commentary) oder abschließende Antwort (final_answer). Mehr erfährst du hier.

24. Feb.
Funktion
gpt-5.3-codex
v1/responses

gpt-5.3-codex wurde in der Responses API veröffentlicht. Mehr erfährst du hier.

23. Feb.
Funktion
v1/responses

Der WebSocket-Modus für die Responses API wurde eingeführt. Mehr erfährst du hier.

23. Feb.
Funktion
gpt-realtime-1.5
gpt-audio-1.5
v1/realtime
v1/chat/completions

GPT-Realtime-1.5 wurde in der Realtime API veröffentlicht.

gpt-audio-1.5 wurde in der Chat Completions API veröffentlicht. Mehr erfährst du hier.

10. Feb.
Funktion
gpt-image-1.5
gpt-image-1
gpt-image-1-mini
chatgpt-image-latest
v1/batch

Die Stapelverarbeitungs-API wird jetzt für die GPT Image-Modelle gpt-image-1.5, chatgpt-image-latest, gpt-image-1 und gpt-image-1-mini unterstützt.

10. Feb.
Aktualisierung
gpt-5.2-chat-latest

Der Slug gpt-5.2-chat-latest wurde aktualisiert und verweist jetzt auf das neueste Modell, das derzeit in ChatGPT verwendet wird.

10. Feb.
Funktion
v1/responses

Serverseitige Compaction (Kontextverdichtung) wurde in der Responses API eingeführt.

10. Feb.
Funktion
v1/responses

Die Unterstützung für Skills wurde in der Responses API eingeführt. Wir unterstützen Skills sowohl bei der lokalen Ausführung als auch bei der Ausführung in gehosteten Containern.

10. Feb.
Funktion
v1/responses

Das neue Tool Hosted Shell und die Unterstützung für Netzwerkzugriffe in Containern wurden eingeführt.

9. Feb.
Funktion
gpt-image-1.5
gpt-image-1
gpt-image-1-mini
chatgpt-image-latest
v1/images/edits

Für GPT-Bildmodelle wurde die Unterstützung für Anfragen mit application/json an /v1/images/edits hinzugefügt. JSON-Anfragen verwenden images (und optional mask) mit Referenzen über image_url oder file_id anstelle von Multipart-Uploads.

3. Feb.
Aktualisierung
gpt-5.2
gpt-5.2-codex

Wir haben unseren Inferenz-Stack für die API-Kundschaft optimiert. GPT-5.2 und GPT-5.2-Codex laufen jetzt rund 40 % schneller. Die Modelle und ihre Gewichte bleiben unverändert.

Januar 2026

15. Jan.
Ankündigung

Open Responses wurde angekündigt: eine Open-Source-Spezifikation für die Entwicklung interoperabler LLM-Schnittstellen für mehrere Anbieter auf Basis der ursprünglichen OpenAI Responses API.

14. Jan.
Funktion
gpt-5.2-codex
v1/responses

gpt-5.2-codex wurde in der Responses API veröffentlicht. GPT-5.2-Codex ist eine Version von GPT-5.2, die für agentische Programmieraufgaben in Codex oder ähnlichen Umgebungen optimiert ist. Mehr erfährst du hier.

13. Jan.
Funktion
v1/realtime

Dedizierte IP-Bereiche für SIP wurden für die Realtime API hinzugefügt. sip.api.openai.com nutzt GeoIP-Routing und leitet SIP-Datenverkehr an die nächstgelegene Region weiter. Mehr erfahren.

13. Jan.
Aktualisierung
gpt-realtime-mini
gpt-audio-mini

Die Slugs gpt-realtime-mini und gpt-audio-mini wurden aktualisiert und verweisen jetzt auf die Snapshots vom 15. Dezember 2025. Wenn du die vorherigen Modell-Snapshots benötigst, verwende gpt-realtime-mini-2025-10-06 und gpt-audio-mini-2025-10-06.

13. Jan.
Aktualisierung
sora-2

Der Slug sora-2 wurde aktualisiert und verweist jetzt auf sora-2-2025-12-08. Wenn du den vorherigen Modell-Snapshot benötigst, verwende sora-2-2025-10-06.

13. Jan.
Aktualisierung
gpt-4o-mini-tts
gpt-4o-mini-transcribe

Die Slugs gpt-4o-mini-tts und gpt-4o-mini-transcribe wurden aktualisiert und verweisen jetzt auf die Snapshots vom 2025-12-15. Wenn du die vorherigen Modell-Snapshots benötigst, verwende gpt-4o-mini-tts-2025-03-20 und gpt-4o-mini-transcribe-2025-03-20. Für die besten Ergebnisse empfehlen wir derzeit gpt-4o-mini-transcribe anstelle von gpt-4o-transcribe.

9. Jan.
Fehlerbehebung
gpt-image-1.5
chatgpt-image-latest

Ein Fehler wurde behoben, bei dem gpt-image-1.5 und chatgpt-image-latest für Bildbearbeitungen über /v1/images/edits fälschlicherweise eine hohe Detailtreue verwendeten, selbst wenn fidelity ausdrücklich auf low (den Standardwert) gesetzt war.

Dezember 2025

19. Dez.
Aktualisierung
gpt-image-1.5
chatgpt-image-latest

gpt-image-1.5 und chatgpt-image-latest wurden zum Bildgenerierungstool der Responses API hinzugefügt.

16. Dez.
Funktion
gpt-image-1.5
chatgpt-image-latest

gpt-image-1.5 und chatgpt-image-latest, unsere neuesten und fortschrittlichsten Modelle zur Bildgenerierung, wurden veröffentlicht. Mehr erfährst du hier.

15. Dez.
Funktion
gpt-realtime-mini
gpt-audio-mini
gpt-4o-mini-transcribe
gpt-4o-mini-tts

Vier neue Audio-Snapshots mit Datumskennung wurden veröffentlicht. Diese Updates verbessern die Zuverlässigkeit, Qualität und Stimmwiedergabe bei sprachgesteuerten Echtzeitanwendungen. Mehr erfährst du hier.

  • gpt-realtime-mini-2025-12-15
  • gpt-audio-mini-2025-12-15
  • gpt-4o-mini-transcribe-2025-12-15
  • gpt-4o-mini-tts-2025-12-15

Diese Veröffentlichung umfasst außerdem Unterstützung für benutzerdefinierte Stimmen für berechtigte Kundschaft.

11. Dez.
Funktion
gpt-5.2
gpt-5.2-chat-latest
v1/responses
v1/chat/completions

GPT-5.2, das neueste Flagship-Modell der GPT-5-Modellfamilie, wurde veröffentlicht. Gegenüber dem Vorgängermodell GPT-5.1 bietet GPT-5.2 Verbesserungen in folgenden Bereichen:

  • Allgemeine Intelligenz
  • Befolgen von Anweisungen
  • Genauigkeit und Tokeneffizienz
  • Multimodalität, insbesondere Bildverständnis
  • Codegenerierung, insbesondere das Erstellen von Frontend-Benutzeroberflächen
  • Werkzeugaufrufe und Kontextverwaltung in der API
  • Verstehen und Erstellen von Tabellen.

Neu in 5.2 sind die Stufe xhigh für den Reasoning-Aufwand, prägnante Zusammenfassungen der Gedankengänge und eine neue Kontextverwaltung mithilfe von Compaction (Kontextverdichtung).

11. Dez.
Funktion
v1/responses/compact

Wir haben clientseitige Compaction (Kontextverdichtung) veröffentlicht. Bei länger laufenden Unterhaltungen mit der Responses API kannst du den Endpunkt /responses/compact verwenden, um den Kontext zu verkleinern, den du bei jedem Gesprächsschritt sendest.

4. Dez.
Funktion
gpt-5.1-codex-max
v1/responses

Wir haben gpt-5.1-codex-max in der Responses API veröffentlicht. GPT-5.1-Codex ist unser intelligentestes Programmiermodell, optimiert für agentische Programmieraufgaben über längere Zeiträume. Mehr dazu erfährst du hier.

November 2025

20. Nov.
Funktion
v1/realtime

Die Realtime API unterstützt jetzt DTMF-Tastendrücke. Du kannst nun DTMF-Ereignisse empfangen, während du eine Realtime-Sideband-Verbindung verwendest. Weitere Informationen findest du hier in der Dokumentation.

13. Nov.
Funktion
gpt-5.1
gpt-5.1-codex
gpt-5.1-chat-latest
gpt-5.1-codex-mini
v1/responses
v1/chat/completions

Wir haben GPT-5.1 veröffentlicht, das neueste Flagship-Modell der GPT-5-Modellfamilie. GPT-5.1 wurde darauf trainiert, in folgenden Bereichen besonders leistungsfähig zu sein:

  • Steuerbarkeit und schnellere Antworten, wenn weniger Nachdenken erforderlich ist
  • Codegenerierung und Programmieranwendungen
  • Agentische Arbeitsabläufe

Beachte, dass GPT-5.1 standardmäßig die neue Einstellung none für den Reasoning-Aufwand verwendet, um schneller zu antworten, wenn weniger Nachdenken erforderlich ist. Bei GPT-5 war zuvor medium die Standardeinstellung.

13. Nov.
Funktion

Wir haben erweiterte rollenbasierte Zugriffskontrollen (RBAC) veröffentlicht. Mit rollenbasierter Zugriffskontrolle (RBAC) legst du fest, wer in deiner Organisation und deinen Projekten welche Aktionen ausführen darf, sowohl über die API als auch im Dashboard.

13. Nov.
Funktion
gpt-5.1-codex
gpt-5.1-codex-mini
v1/responses

Wir haben gpt-5.1-codex und gpt-5.1-codex-mini in der Responses API veröffentlicht. GPT-5.1-Codex ist eine Version von GPT-5.1, die für agentische Programmieraufgaben in Codex oder ähnlichen Umgebungen optimiert ist. Mehr dazu erfährst du hier.

13. Nov.
Funktion

Wir haben eine verlängerte Aufbewahrungsdauer für den Prompt-Cache eingeführt. Damit bleiben zwischengespeicherte Präfixe länger aktiv, maximal 24 Stunden. Beim erweiterten Prompt-Caching werden die Key/Value-Tensoren in GPU-lokalen Speicher ausgelagert, sobald der Arbeitsspeicher voll ist. Dadurch steht deutlich mehr Speicherkapazität für das Caching zur Verfügung.

Oktober 2025

29. Okt.
Funktion
gpt-oss-safeguard-120b
gpt-oss-safeguard-20b

gpt-oss-safeguard-120b und gpt-oss-safeguard-20b sind Reasoning-Modelle für Sicherheitsaufgaben, die auf gpt-oss basieren. Mehr dazu erfährst du hier.

24. Okt.
Funktion

Wir haben Enterprise Key Management (EKM) veröffentlicht. Mit Enterprise Key Management (EKM) kannst du deine Kundeninhalte bei OpenAI mit Schlüsseln verschlüsseln, die dein eigenes externes Schlüsselverwaltungssystem (KMS) verwaltet.

24. Okt.
Funktion
6. Okt.
Funktion
gpt-5-pro
gpt-realtime-mini
gpt-audio-mini
gpt-image-1-mini
sora-2
sora-2-pro
v1/responses
v1/batch
v1/chat/completions
v1/videos
v1/realtime
v1/images/generations

Wir haben beim OpenAI DevDay mehrere neue Funktionen veröffentlicht:

Wir haben GPT-5 Pro veröffentlicht, eine Version von GPT-5, die mehr Rechenleistung nutzt, um gründlicher nachzudenken und durchgehend bessere Antworten zu liefern.

Wir haben GPT-Realtime mini und gpt-audio-mini für kosteneffizientere Speech-to-Speech-Verarbeitung veröffentlicht.

Wir haben gpt-image-1-mini für kosteneffizientere Bildgenerierung und -bearbeitung veröffentlicht.

Wir haben v1/videos eingeführt, um mit unseren neuesten Modellen Sora 2 und Sora 2 Pro ausdrucksstarke, detailreiche und dynamische Videos zu generieren und zu remixen.

Wir haben Agent Builder eingeführt, mit dem du individuelle Arbeitsabläufe mit mehreren Agenten visuell erstellen kannst.

Wir haben ChatKit eingeführt, eine einbettbare Chat-Oberfläche zur Bereitstellung von Agenten.

Wir haben Werkzeuge für Trace-Evaluationen, Datensätze und Prompt-Optimierung veröffentlicht.

Evaluationen: Modelle von Drittanbietern werden jetzt unterstützt.

Wir haben das Dashboard zum Dienststatus eingeführt.

1. Okt.
Funktion

Wir haben die IP-Zulassungsliste eingeführt. Damit lässt sich der API-Zugriff auf die von dir angegebenen IP-Adressen oder IP-Bereiche beschränken.

September 2025

26. Sept.
Funktion
v1/responses

Die Responses API unterstützt jetzt Bilder und Dateien als Ausgabe eines Werkzeugaufrufs.

23. Sept.
Funktion
gpt-5-codex
v1/responses

Wir haben das spezialisierte Modell gpt-5-codex eingeführt, das für den Einsatz mit der Codex CLI entwickelt und optimiert wurde.

August 2025

28. Aug.
Funktion
v1/realtime

Die OpenAI Realtime API ist jetzt allgemein verfügbar. Mehr dazu erfährst du in unserem Leitfaden zur Realtime API.

21. Aug.
Funktion
v1/responses

Die Responses API unterstützt jetzt Konnektoren. Konnektoren sind von OpenAI gepflegte MCP-Wrapper für beliebte Dienste wie Google-Apps, Dropbox und weitere. Damit kannst du dem Modell Lesezugriff auf Daten geben, die in diesen Diensten gespeichert sind.

20. Aug.
Funktion
v1/conversations
v1/responses
v1/assistants

Wir haben die Conversations API veröffentlicht. Damit kannst du länger laufende Unterhaltungen mit der Responses API erstellen und verwalten. Im Migrationsleitfaden findest du einen direkten Vergleich und erfährst, wie du von einer Assistants-API-Integration zu Responses und Conversations migrierst.

7. Aug.
Funktion
v1/chat/completions
v1/responses

Wir haben die GPT-5-Modellfamilie in der API veröffentlicht, darunter gpt-5, gpt-5-mini und gpt-5-nano.

Wir haben den Wert minimal für den Reasoning-Aufwand eingeführt, um GPT-5-Modelle (die Reasoning unterstützen) auf schnelle Antworten zu optimieren.

Wir haben den Typ custom für Werkzeugaufrufe eingeführt. Damit sind bei Werkzeugaufrufen frei formatierte Eingaben an das Modell und Ausgaben vom Modell möglich.

Juni 2025

27. Juni
Funktion

Wir haben Unterstützung für priorisierte Verarbeitung eingeführt. Sie bietet deutlich geringere und konstantere Latenzen als die Standardverarbeitung und behält die Flexibilität der nutzungsabhängigen Abrechnung bei.

24. Juni
Funktion
o3-deep-research
o3-deep-research-2025-06-26
o4-mini-deep-research
o4-mini-deep-research-2025-06-26
v1/responses

Wir haben o3-deep-research und o4-mini-deep-research veröffentlicht. Diese Deep-Research-Varianten unserer Reasoning-Modelle der o-Serie sind für tiefgehende Analysen und Rechercheaufgaben optimiert. Mehr dazu erfährst du im Leitfaden zu Deep Research.

Wir haben Unterstützung für die asynchrone Ereignisverarbeitung mit Webhooks hinzugefügt. Die Preise für das Websuchwerkzeug wurden gesenkt und vereinfacht. Außerdem haben wir Unterstützung für das Websuchwerkzeug hinzugefügt.

13. Juni
Funktion
v1/responses

Neue wiederverwendbare Prompts sind jetzt im Dashboard und in der Responses API verfügbar. Über die API kannst du nun mit dem Parameter prompt (mit der id eines Prompts und optional einer version) auf Vorlagen verweisen, die im Dashboard erstellt wurden. Außerdem kannst du dynamische variables übergeben, die Zeichenfolgen, Bilder oder Dateieingaben enthalten können. Wiederverwendbare Prompts sind in Chat Completions nicht verfügbar. Mehr erfahren.

10. Juni
Funktion
o3-pro
v1/responses
v1/batch

Wir haben o3-pro veröffentlicht, eine Version des Reasoning-Modells o3. Sie nutzt mehr Rechenleistung, um schwierige Probleme mit besseren Schlussfolgerungen und konsistenteren Ergebnissen zu lösen. Auch die Preise für das Modell o3 wurden gesenkt, und zwar für alle API-Anfragen, einschließlich Stapelverarbeitung und Flex-Verarbeitung.

4. Juni
Funktion
v1/fine_tuning

Die Modelle gpt-4.1-2025-04-14, gpt-4.1-mini-2025-04-14 und gpt-4.1-nano-2025-04-14 unterstützen jetzt Fine-Tuning mit direkter Präferenzoptimierung.

3. Juni
Funktion
v1/chat/completions
v1/realtime

Für gpt-4o-audio-preview und gpt-4o-realtime-preview sind neue Modell-Snapshots verfügbar. Wir haben das Agents SDK für TypeScript veröffentlicht.

Mai 2025

20. Mai
Funktion
v1/responses

Die Responses API unterstützt jetzt weitere integrierte Werkzeuge, darunter Remote-MCP-Server und Code Interpreter. Mehr über Werkzeuge erfahren.

20. Mai
Funktion
v1/responses
v1/chat/completions

Bei parallelen Werkzeugaufrufen mit Modellen ohne Fine-Tuning lässt sich jetzt der Modus strict für Werkzeugschemas verwenden. Wir haben neue Schemafunktionen hinzugefügt, darunter die Validierung von Zeichenfolgen für email und andere Muster sowie die Angabe von Grenzen für Zahlen und Arrays.

15. Mai
Funktion
codex-mini-latest
v1/responses
v1/chat/completions

Wir haben codex-mini-latest in der API eingeführt, optimiert für den Einsatz mit der Codex CLI.

7. Mai
Funktion
v1/fine-tuning
v1/responses
v1/chat/completions

Wir haben Unterstützung für Reinforcement Fine-Tuning eingeführt. Erfahre mehr über die verfügbaren Fine-Tuning-Methoden. gpt-4.1-nano ist jetzt für Fine-Tuning verfügbar.

April 2025

30. Apr.
Funktion
23. Apr.
Funktion
v1/images/generations
v1/images/edits

Wir haben ein neues Modell zur Bildgenerierung hinzugefügt: gpt-image-1. Es setzt neue Maßstäbe bei der Bildgenerierung, mit besserer Qualität und einer präziseren Befolgung von Anweisungen.

Wir haben die Endpunkte für Bildgenerierung und -bearbeitung aktualisiert. Sie unterstützen jetzt neue Parameter speziell für das Modell gpt-image-1.

16. Apr.
Funktion
v1/chat/completions
v1/responses

Wir haben zwei neue Reasoning-Modelle der o-Serie hinzugefügt: o3 und o4-mini. Sie setzen neue Maßstäbe in Mathematik, Naturwissenschaften und Programmierung sowie beim logischen Schlussfolgern anhand visueller Informationen und beim Verfassen technischer Texte.

Wir haben Codex eingeführt, unser CLI-Werkzeug zur Codegenerierung.

14. Apr.
Funktion
gpt-4.1
gpt-4.1-mini
gpt-4.1-nano
v1/responses
v1/chat/completions
v1/fine_tuning

Wir haben die Modelle gpt-4.1, gpt-4.1-mini und gpt-4.1-nano zur API hinzugefügt. Diese neuen Modelle befolgen Anweisungen besser, programmieren besser und bieten ein größeres Kontextfenster (bis zu 1 Million Token). gpt-4.1 und gpt-4.1-mini sind für überwachtes Fine-Tuning verfügbar. Wir haben die Einstellung von gpt-4.5-preview angekündigt.

März 2025

20. März
Aktualisierung
v1/audio

Wir haben die Modelle gpt-4o-mini-tts, gpt-4o-transcribe, gpt-4o-mini-transcribe und whisper-1 zur Audio API hinzugefügt.

19. März
Funktion
o1-pro
v1/responses
v1/batch

Wir haben o1-pro veröffentlicht, eine Version des Reasoning-Modells o1. Sie nutzt mehr Rechenleistung, um schwierige Probleme mit besseren Schlussfolgerungen und konsistenteren Ergebnissen zu lösen.

11. März
Funktion
gpt-4o-search-preview
gpt-4o-mini-search-preview
computer-use-preview
v1/chat/completions
v1/assistants
v1/responses

Wir haben mehrere neue Modelle und Werkzeuge sowie eine neue API für agentische Arbeitsabläufe veröffentlicht:

  • Wir haben die Responses API veröffentlicht, eine neue API zum Erstellen und Verwenden von Agenten und Werkzeugen.
  • Wir haben eine Reihe integrierter Werkzeuge für die Responses API veröffentlicht: Websuche, Dateisuche und Computernutzung.
  • Wir haben das Agents SDK veröffentlicht, ein Orchestrierungsframework zum Entwerfen, Entwickeln und Bereitstellen von Agenten.
  • Wir haben neue Modelle angekündigt: gpt-4o-search-preview, gpt-4o-mini-search-preview, computer-use-preview.
  • Wir haben Pläne angekündigt, alle Funktionen der Assistants API in die einfacher zu bedienende Responses API zu übernehmen. Die Abschaltung von Assistants ist voraussichtlich für 2026 vorgesehen, nachdem der vollständige Funktionsumfang übernommen wurde.
3. März
Funktion
v1/fine_tuning/jobs

Fine-Tuning-Jobs unterstützen jetzt das Feld metadata.

Februar 2025

27. Feb.
Funktion
GPT-4.5
v1/chat/completions
v1/assistants
v1/batch

Wir haben eine Forschungsvorschau von GPT-4.5 veröffentlicht, unserem bisher größten und leistungsfähigsten Chat-Modell. Der hohe „EQ“ von GPT-4.5 und sein Verständnis dafür, was Nutzende erreichen möchten, verbessern seine Leistung bei kreativen Aufgaben und agentischer Planung.

25. Feb.
Funktion

Das Update für das Dashboard zur API-Nutzung wurde veröffentlicht. Es ergänzt gewünschte Datenfilter wie Projektauswahl, Datumsauswahl und fein abgestufte Zeitintervalle. Auch die Anzeige der Nutzung über verschiedene Produkte und Servicestufen hinweg wurde verbessert.

5. Feb.
Funktion

Datenresidenz in Europa ist jetzt verfügbar. Mehr dazu erfährst du hier.

Januar 2025

31. Jan.
Funktion
o3-mini
o3-mini-2025-01-31
v1/chat/completions

o3-mini wurde veröffentlicht, ein neues kleines Reasoning-Modell, das für Aufgaben in Wissenschaft, Mathematik und Programmierung optimiert ist.

21. Jan.
Funktion
o1

Der Zugang zum Modell o1 wurde erweitert. Die Modelle der o1-Serie werden mit Reinforcement Learning trainiert, um komplexe Denkaufgaben zu lösen.

Dezember 2024

18. Dez.
Funktion

Die Rotation von Admin-API-Schlüsseln ist jetzt verfügbar. Damit kannst du deine Admin-API-Schlüssel programmgesteuert rotieren.

Einladungen über die Admin-API wurden aktualisiert. Damit kannst du Personen programmgesteuert gleichzeitig in Organisationen und Projekte einladen.

17. Dez.
Funktion
o1
gpt-4o
gpt-4o-mini
v1/fine_tuning
v1/chat/completions
v1/realtime

Neue Modelle für o1, gpt-4o-realtime, gpt-4o-audio und weitere wurden hinzugefügt.

WebRTC wurde als Verbindungsmethode für die Realtime API hinzugefügt.

Der Parameter reasoning_effort wurde für o1-Modelle hinzugefügt.

Die Nachrichtenrolle developer wurde für das Modell o1 hinzugefügt. Beachte, dass o1-preview und o1-mini keine Nachrichten mit den Rollen system oder developer unterstützen.

Präferenzbasiertes Fine-Tuning mit direkter Präferenzoptimierung (DPO) ist jetzt verfügbar.

Beta-SDKs für Go und Java wurden veröffentlicht. Mehr erfahren.

Das Python SDK unterstützt jetzt die Realtime API.

4. Dez.
Funktion

Die Usage API wurde veröffentlicht. Damit kannst du Aktivitäten und Ausgaben über die OpenAI-APIs hinweg programmgesteuert abfragen.

November 2024

20. Nov.
Aktualisierung
v1/chat/completions

gpt-4o-2024-11-20, unser neuestes Modell der gpt-4o-Serie, wurde veröffentlicht.

4. Nov.
Funktion
v1/chat/completions

Vorhergesagte Ausgaben sind jetzt verfügbar. Sie reduzieren die Latenz bei Modellantworten erheblich, wenn ein Großteil der Antwort bereits im Voraus bekannt ist. Das ist besonders häufig der Fall, wenn Inhalte von Dokumenten und Codedateien mit nur geringfügigen Änderungen neu generiert werden.

Oktober 2024

30. Okt.
Funktion
gpt-4o-realtime-preview
gpt-4o-audio-preview
v1/chat/completions

Fünf neue Stimmen wurden in der Realtime API und der Chat Completions API hinzugefügt.

17. Okt.
Funktion
gpt-4o-audio-preview
v1/chat/completions

Das neue Modell gpt-4o-audio-preview wurde für Chat Completions veröffentlicht und unterstützt sowohl Audioeingaben als auch Audioausgaben. Es basiert auf demselben Modell wie die Realtime API.

1. Okt.
Funktion
v1/realtime
v1/chat/completions
v1/fine_tuning

Beim OpenAI DevDay in San Francisco wurden mehrere neue Funktionen veröffentlicht:

Realtime API: Integriere über eine WebSockets-Schnittstelle schnelle Speech-to-Speech-Funktionen in deine Anwendungen.

Modelldestillation: Eine Plattform für das Fine-Tuning kosteneffizienter Modelle mit deinen Ausgaben aus einem großen Modell auf dem neuesten Stand der Technik.

Fine-Tuning mit Bildern: Passe GPT-4o durch Fine-Tuning mit Bildern und Text an, um sein Bildverständnis zu verbessern.

Evaluationen: Erstelle eigene Evaluationen und führe sie aus, um die Modellleistung bei bestimmten Aufgaben zu messen.

Prompt-Caching: Preisnachlässe und kürzere Verarbeitungszeiten für kürzlich verarbeitete Eingabetokens.

Generieren im Playground: Erstelle im Playground über die Schaltfläche „Generieren“ ganz einfach Prompts, Funktionsdefinitionen und Schemas für strukturierte Ausgaben.

September 2024

26. Sept.
Funktion
omni-moderation-latest
v1/moderations

Das neue Moderationsmodell omni-moderation-latest wurde veröffentlicht. Es unterstützt in einigen Kategorien sowohl Bilder als auch Text, bietet zwei neue Kategorien für schädliche Inhalte ausschließlich in Texten und liefert genauere Bewertungen.

12. Sept.
Funktion
o1-preview
o1-mini
v1/chat/completions

o1-preview und o1-mini wurden veröffentlicht. Diese neuen großen Sprachmodelle wurden mit Reinforcement Learning trainiert, um komplexe Denkaufgaben zu lösen.

August 2024

29. Aug.
20. Aug.
Funktion
gpt-4o
v1/fine_tuning

Fine-Tuning für gpt-4o-2024-08-06 ist jetzt allgemein verfügbar. Alle, die die API nutzen, können nun das neueste GPT-4o-Modell durch Fine-Tuning anpassen.

15. Aug.
Aktualisierung
gpt-4o
v1/chat/completions

Ein dynamisches Modell für chatgpt-4o-latest wurde veröffentlicht. Es wird auf das jeweils neueste GPT-4o-Modell verweisen, das ChatGPT verwendet.

6. Aug.
Aktualisierung

Strukturierte Ausgaben sind jetzt verfügbar. Modellausgaben halten sich damit zuverlässig an die von Entwickelnden vorgegebenen JSON-Schemas.

gpt-4o-2024-08-06, unser neuestes Modell der gpt-4o-Serie, wurde veröffentlicht.

1. Aug.
Aktualisierung

Die Admin-API und Audit Log API wurden veröffentlicht. Damit kannst du deine Organisation programmgesteuert verwalten und Änderungen anhand der Auditprotokolle überwachen. Die Auditprotokollierung muss in den Einstellungen aktiviert werden.

Juli 2024

24. Juli
Aktualisierung

Die SSO-Konfiguration im Self-Service ist jetzt verfügbar. Unternehmenskunden mit individueller oder unbegrenzter Abrechnung können damit die Authentifizierung über den gewünschten Identitätsanbieter (IDP) einrichten.

23. Juli
Aktualisierung

Fine-Tuning für GPT-4o mini ist jetzt verfügbar und ermöglicht eine noch höhere Leistung bei bestimmten Anwendungsfällen.

18. Juli
Aktualisierung

GPT-4o mini wurde veröffentlicht, unser kostengünstiges und intelligentes kleines Modell für schnelle, einfache Aufgaben.

17. Juli
Aktualisierung

Uploads wurde veröffentlicht, um große Dateien in mehreren Teilen hochzuladen.

Juni 2024

6. Juni
Aktualisierung

Parallele Funktionsaufrufe lassen sich in Chat Completions und der Assistants API durch Übergabe von parallel_tool_calls=false deaktivieren.

Das .NET SDK wurde als Beta veröffentlicht.

3. Juni

Mai 2024

15. Mai
Aktualisierung

Projekte lassen sich jetzt archivieren. Diese Funktion steht nur Personen zur Verfügung, denen die Organisation gehört.

Bei nutzungsbasierter Abrechnung kannst du jetzt für jedes Projekt einzeln Kostenlimits festlegen.

13. Mai
Aktualisierung

GPT-4o wurde in der API veröffentlicht. GPT-4o ist unser schnellstes und kostengünstigstes Flagship-Modell.

9. Mai
7. Mai
Aktualisierung

Unterstützung für durch Fine-Tuning angepasste Modelle in der Batch API wurde hinzugefügt.

6. Mai
Aktualisierung

Der Parameter stream_options: {"include_usage": true} wurde zur Chat Completions API und zur Completions API hinzugefügt. Mit dieser Einstellung können Entwickelnde beim Streaming auf Nutzungsstatistiken zugreifen.

2. Mai
Aktualisierung

Ein neuer Endpunkt zum Löschen einer Nachricht aus einem Thread in der Assistants API wurde hinzugefügt.

April 2024

29. Apr.
Aktualisierung

Die neue Option tool_choice: "required" für Funktionsaufrufe wurde zur Chat Completions API und zur Assistants API hinzugefügt.

Ein Leitfaden zur Batch API und Unterstützung für Embedding-Modelle in der Batch API wurden hinzugefügt

17. Apr.
Aktualisierung

Eine Reihe von Updates für die Assistants API wurde eingeführt. Dazu gehören ein neues Dateisuchtool für bis zu 10.000 Dateien pro Assistent, neue Einstellungen zur Token-Steuerung und Unterstützung für die Toolauswahl.

16. Apr.
Aktualisierung

Eine projektbasierte Hierarchie wurde eingeführt, mit der du deine Arbeit nach Projekten organisieren kannst. Du kannst API-Schlüssel erstellen sowie Raten- und Kostenlimits für jedes Projekt einzeln verwalten. Kostenlimits stehen nur Unternehmenskunden zur Verfügung.

15. Apr.
Aktualisierung

Die Batch API wurde veröffentlicht

9. Apr.
Aktualisierung

GPT-4 Turbo with Vision wurde in der API allgemein verfügbar gemacht

4. Apr.
Aktualisierung

Die Fine-Tuning-API unterstützt jetzt seed

Die Fine-Tuning-API unterstützt jetzt Checkpoints

In der Assistants API kannst du jetzt beim Erstellen eines Runs Nachrichten hinzufügen

1. Apr.
Aktualisierung

In der Assistants API kannst du jetzt Nachrichten nach run_id filtern

März 2024

29. März
Aktualisierung

Die Assistants API unterstützt jetzt temperature und das Erstellen von Assistentennachrichten

14. März
Aktualisierung

Die Assistants API unterstützt jetzt Streaming

Februar 2024

9. Feb.
Aktualisierung

Der Parameter timestamp_granularities wurde zur Audio API hinzugefügt

1. Feb.

Januar 2024

25. Jan.
Aktualisierung

Embedding-Modelle der Version V3 und eine aktualisierte Vorschauversion von GPT-4 Turbo wurden veröffentlicht

Der Parameter dimensions wurde zur Embeddings API hinzugefügt

Dezember 2023

20. Dez.
Aktualisierung

Der Parameter additional_instructions wurde für das Erstellen von Runs in der Assistants API hinzugefügt

15. Dez.
Aktualisierung

Die Parameter logprobs und top_logprobs wurden zur Chat Completions API hinzugefügt

14. Dez.
Aktualisierung

Das Argument für Funktionsparameter bei einem Tool-Aufruf ist jetzt optional

November 2023

30. Nov.
Aktualisierung

OpenAI Deno SDK wurde veröffentlicht

6. Nov.
Aktualisierung

GPT-4 Turbo Preview, eine aktualisierte Version von GPT-3.5 Turbo, GPT-4 Turbo with Vision, die Assistants API, DALL·E 3 in der API und die Text-to-Speech-API wurden veröffentlicht

Der Parameter functions der Chat Completions API wurde zugunsten von tools abgekündigt

OpenAI Python SDK V1.0 wurde veröffentlicht

Oktober 2023

16. Okt.
Aktualisierung

Der Parameter encoding_format wurde zur Embeddings API hinzugefügt

max_tokens wurde zu den Moderationsmodellen hinzugefügt

6. Okt.
Aktualisierung

Die Fine-Tuning-API unterstützt jetzt Funktionsaufrufe