Änderungsprotokoll
September 2026
Auf Organisations- und Projektebene gibt es jetzt Governance-Einstellungen für das Erstellen von API-Schlüsseln. Wer Administratorrechte hat, kann ausschließlich Schlüssel für Dienstkonten zulassen, ausschließlich Projekt-Schlüssel im Besitz von Nutzenden zulassen oder das Erstellen neuer API-Schlüssel vollständig deaktivieren. Beschränkungen auf Organisationsebene haben Vorrang vor Projekteinstellungen. Bestehende API-Schlüssel sind davon nicht betroffen. Details findest du unter Bewährte Methoden für den Produktivbetrieb.
Du kannst jetzt beim Erstellen von Projekt-API-Schlüsseln ein Ablaufdatum festlegen. Wer Administratorrechte hat, kann außerdem in den Plattform-Einstellungen auf Organisations- oder Projektebene eine maximale Gültigkeitsdauer für Schlüssel vorgeben. Neu erstellte Schlüssel müssen dann innerhalb dieses Zeitraums ablaufen. Hinweise zum Ablauf und zur Rotation von Schlüsseln findest du unter Bewährte Methoden für den Produktivbetrieb.
Die Agents API ist jetzt als öffentliche Betaversion verfügbar. Entwickle Agenten mit einem verwalteten Codex-Harness, während OpenAI die Orchestrierung der Sitzungen, die Compaction (Kontextverdichtung) und die Wiederherstellung übernimmt.
Nutze persistente Sitzungen, um die Arbeit über mehrere Gesprächsrunden hinweg fortzusetzen, Fortschritte per Streaming zu übertragen und eigene Werkzeuge und MCP-Server anzubinden. Führe Agenten in von OpenAI gehosteten Sandboxen aus oder binde eine Sandbox aus deiner eigenen Infrastruktur oder von einem unterstützten Anbieter an.
Beginne mit dem Schnellstart für die Agents API.
GPT-Live 1 ist jetzt in der API allgemein verfügbar. Entwickle Vollduplex-Sprachunterhaltungen, die weiterlaufen können, während ein Backend-Modell oder Agent den Reasoning-Aufwand und den Einsatz von Werkzeugen übernimmt.
Nutze die Delegierung über Responses mit einem OpenAI-Modell oder die clientseitige Delegierung, um dein eigenes Backend anzubinden. Sprachsitzungen kosten 0,05 USD pro Minute und werden sekundengenau abgerechnet. Die Nutzung des Backend-Modells und der Werkzeuge wird separat berechnet.
Lies zum Einstieg die Anleitungen zu GPT-Live, Prompts formulieren und Migration. Einzelheiten findest du unter Preise.
Die Diagnose des Prompt-Caches ist jetzt in der Responses API für GPT-5.6 und spätere unterstützte Modelle allgemein verfügbar.
Vergleiche die Cache-Wiederverwendung mit einer vorherigen Antwort, ermittle die Ursachen für Cache-Fehlzugriffe und folge den Hinweisen zur Fehlerbehebung, um den Cache besser wiederzuverwenden.
GPT Image 2.5 Sunburst und GPT Image 2.5 Flare wurden veröffentlicht. Sie ermöglichen Bildgenerierung und -bearbeitung über die Image API und das Bildgenerierungstool der Responses API.
Verwende Sunburst für Arbeitsabläufe, bei denen präzise Bearbeitung besonders wichtig ist, oder Flare für schnelle, hochwertige Bildgenerierung im Alltag. Beide Modelle unterstützen die neuen Qualitätseinstellungen xhigh und max und verwenden die Tokenpreise von GPT Image 2. Weitere Informationen findest du im Leitfaden zur Bildgenerierung und unter Preise.
GPT-Rosalind (gpt-rosalind-research) ist jetzt über das Programm für vertrauenswürdigen Zugriff für genehmigte interne Forschung in den Lebenswissenschaften allgemein verfügbar.
Die Standardpreise betragen 5 USD pro 1 Million Eingabe-Token, 0,50 USD pro 1 Million zwischengespeicherte Eingabe-Token und 25 USD pro 1 Million Ausgabe-Token. Die Abrechnung beginnt am 5. Oktober 2026. Einzelheiten findest du unter Preise.
GPT-6 Astra wurde veröffentlicht: unser leistungsfähigstes Modell, das für die durchgängige Bearbeitung besonders anspruchsvoller Aufgaben entwickelt wurde.
Verwende GPT-6 Astra für anspruchsvolle Denkaufgaben, Programmierung, Computernutzung, Recherche und Dokumenterstellung. Das Modell kombiniert diese Fähigkeiten, um komplexe Aufgaben von der ersten Anfrage bis zum fertigen Ergebnis zu bearbeiten. Dabei nutzt es den Kontext und die Werkzeuge, die du bereitstellst.
Wichtige Änderungen, die du bei der Migration berücksichtigen solltest:
- GPT-6 Astra unterstützt die Stufe
nonefür den Reasoning-Aufwand nicht. - GPT-6 Astra unterstützt weder benutzerdefinierte Werte für
temperatureodertop_pnoch logarithmische Wahrscheinlichkeiten (logprobs). - Tool-Aufrufe erfordern die Responses API. Wenn du Werkzeuge mit Chat Completions verwendest, folge dem Migrationsleitfaden für die Responses API.
- Die Überwachung auf Alignment-Abweichungen prüft bei unterstützten Responses-API-Anfragen asynchron auf mögliche Probleme während der Arbeit von Agenten. Die Prüfungen können Sicherheitswarnungen auslösen oder eine Unterhaltung zur Überprüfung anhalten.
Beginne mit GPT-6 Astra verwenden, um mehr über Funktionen, das Formulieren von Prompts und die Migration zu erfahren. Entdecke die Computernutzung für Arbeitsabläufe im Browser und auf dem Desktop. Informationen zu den verfügbaren Inferenzstufen findest du unter Preise.
Neue Steuerungsmöglichkeiten für lang laufende Aufgaben mit GPT-6 Astra wurden zur Responses API hinzugefügt:
- Asynchrone Tool-Aufrufe: Lass das Modell weiterarbeiten, während deine Anwendung Funktionswerkzeuge oder benutzerdefinierte Werkzeuge ausführt, und übermittle die Ergebnisse, sobald sie vorliegen.
- Während der Ausführung nachsteuern: Sende über WebSockets zusätzliche Anweisungen, während eine Antwort erstellt wird, damit das Modell Korrekturen oder geänderte Anforderungen berücksichtigen kann.
- Reasoning-Aufwand während einer Unterhaltung ändern: Erhöhe den Aufwand für schwierige Aufgaben oder reduziere ihn für routinemäßige Folgeanfragen. Das zwischengespeicherte Prompt-Präfix bleibt dabei erhalten.
Die API-Fehler wurden aktualisiert, damit Anwendungen zwischen zu schnell zunehmendem Anfrageaufkommen und einer vorübergehenden Überlastung des Modells unterscheiden können.
Steigt das Anfrageaufkommen zu schnell, kann ein 429-Fehler mit dem Code slow_down zurückgegeben werden. Eine vorübergehende Überlastung des Modells führt zu einem 503-Fehler mit dem Code server_is_overloaded. Beide Antworten können Retry-After enthalten. Wenn dieser Header vorhanden ist, warte vor einem erneuten Versuch mindestens so lange, wie darin angegeben. Fehlt er, verwende exponentielles Backoff. Weitere Informationen findest du im Leitfaden zu Fehlercodes und im Leitfaden zu Ratenlimits.
Verbindungen zu api.openai.com können jetzt IPv6 verwenden.
August 2026
Mutual TLS (mTLS) und die Föderation von Workload-Identitäten mit X.509 sind jetzt für die OpenAI API allgemein verfügbar. Konfiguriere Zertifikate und X.509-Identitätsanbieter direkt in der Plattformkonsole. Der Zugriff wird über die Rollen und Berechtigungen deiner Organisation gesteuert.
Die Abkündigung von whisper-1, gpt-4o-transcribe, gpt-4o-mini-transcribe und gpt-4o-transcribe-diarize wurde angekündigt. Diese Modelle werden am 26. Februar 2027 abgeschaltet. Migriere zu gpt-live-transcribe oder gpt-transcribe. Weitere Informationen findest du im Leitfaden zur Transkription und auf der Seite zu Abkündigungen.
Die Assistants API wurde am 26. August 2026 abgeschaltet. Migriere mithilfe des Migrationsleitfadens zur Responses API und zur Conversations API.
API-Kundschaft kann jetzt für einzelne Anfragen eine regionale Verarbeitung auswählen. Verwende dazu eine Domain mit Präfix und einen API-Schlüssel aus einem Projekt mit der geografischen Einstellung „Global“. Die bestehenden Voraussetzungen für die Berechtigung, die Steuerung der Datenaufbewahrung sowie die Unterstützung von Endpunkten und Modellen gelten weiterhin. Weitere Informationen findest du im Leitfaden zur Datenkontrolle.
GPT-5.6 Sol kostet jetzt 4 USD pro Million Eingabetoken und 20 USD pro Million Ausgabetoken. Damit sinken die Preise für Eingaben um 20 % und für Ausgaben um 33 %. Die Aktionspreise für GPT-5.6 Sol gelten mindestens bis einschließlich 21. November 2026. Siehe Preisdetails.
Das Dashboard für Prompt-Caching wurde auf der OpenAI API-Plattform veröffentlicht. Verfolge deine Cache-Trefferrate im Zeitverlauf, die Anzahl der Cache-Lesevorgänge pro Schreibvorgang und die Aufteilung der Token in aus dem Cache gelesene, in den Cache geschriebene und nicht zwischengespeicherte Token. So kannst du die Effizienz deines Cachings nachvollziehen und Verbesserungsmöglichkeiten erkennen. Filtere die Kennzahlen nach Modell und Servicestufe.
Transparente Hintergründe sind jetzt als Vorschau für gpt-image-2 und gpt-image-2-2026-04-21 in der Images API und im Bildgenerierungstool der Responses API verfügbar. Setze background auf transparent und verwende png oder webp als Ausgabeformat. jpeg unterstützt keine transparenten Hintergründe. Weitere Informationen findest du im Leitfaden zur Bildgenerierung.
Der Ultraschnellmodus wurde angekündigt: eine neue API-Servicestufe für GPT-5.6 Sol, die bis zu 14-mal so schnell ist wie die Standardverarbeitung. Sie ist für ausgewählte Kundschaft als begrenzte Vorschau verfügbar. Melde dich hier an, um Neuigkeiten zum Ultraschnellmodus zu erhalten.
Daybreak bietet jetzt zwei Zugriffsstufen für zugelassene Fachkräfte in der Cyberabwehr: Daybreak Blue und Daybreak Red. Nutze sie, um bei ausdrücklich autorisierten Einsätzen aus Sicherheitsbefunden validierte Korrekturen zu entwickeln.
Beginne für die meisten Aufgaben in der Cyberabwehr mit Daybreak Blue. Es bietet Zugriff auf vielseitig einsetzbare Modelle wie GPT-5.6 Sol, um Schwachstellen zu finden, Code auf Sicherheit zu überprüfen, Erkennungsverfahren zu entwickeln, auf Sicherheitsvorfälle zu reagieren, Malware zu analysieren und Patches zu validieren. Weitere Informationen findest du hier.
Daybreak Red bietet separat genehmigten Zugriff auf speziell trainierte Modelle wie GPT-5.6 Cyber für autorisierte Aufgaben: die Reproduktion von Schwachstellen, die Validierung von Exploits, Penetrationstests, Red Teaming und die Analyse komplexer Systeme.
Diese Modelle erfordern eine separate Genehmigung und Bereitstellung. Du kannst dich hier für die Teilnahme am Daybreak-Programm bewerben. Weitere Preisdetails findest du hier.
Der Snapshot chat-latest wurde aktualisiert. Er verweist auf das neueste Modell, das in ChatGPT für Personen mit Plus oder Pro verfügbar ist. Für den produktiven API-Einsatz empfehlen wir GPT-5.6 Sol. Du kannst dieses Modell aber nutzen, um die neuesten Verbesserungen für Chat-Anwendungsfälle zu testen. Der zugrunde liegende Modell-Snapshot wird regelmäßig aktualisiert. Weitere Informationen findest du hier.
Der Schnellmodus unterstützt jetzt Anfragen mit langem Kontext für GPT-5.6 Sol, GPT-5.6 Terra und GPT-5.6 Luna. Ab heute können Prompts mit mehr als 272.000 Token im Schnellmodus verarbeitet werden, bis zu 2,5-mal so schnell wie in der Standardstufe. Siehe Preisdetails.
Die Kundschaft kann Daten in den Dashboards für Nutzung und Kosten jetzt nach API-Schlüssel filtern und gruppieren. Die Usage API und die Costs API unterstützen die Dimension „API-Schlüssel“ auch für die programmatische Berichterstellung und Analyse.
Juli 2026
Ab dem 30. Juli kostet GPT-5.6 Luna 80 % weniger und GPT-5.6 Terra 20 % weniger. Siehe Preisdetails.
Wir führen außerdem den Schnellmodus in der API ein. Er ersetzt unser Angebot zur priorisierten Verarbeitung. Für GPT-5.6 Sol bietet der Schnellmodus jetzt bis zu 2,5-mal die Geschwindigkeit der Standardverarbeitung zum doppelten Preis. Diese Änderung ist abwärtskompatibel: Mit priority gekennzeichnete Anfragen verwenden automatisch den Schnellmodus.
Der offizielle OpenAI Terraform-Provider wurde veröffentlicht. Damit lassen sich Ressourcen der OpenAI API-Plattform als Infrastructure as Code verwalten.
Erstelle und verwalte Projekte, Nutzende, Gruppen, Rollen, Zugriffszuweisungen, Dienstkonten, Zertifikate, Einladungen und Ratenlimits auf Projektebene. Nutze die üblichen Terraform-Arbeitsabläufe, um Änderungen zu überprüfen und anzuwenden, bestehende Ressourcen zu importieren sowie Konfigurationsabweichungen zu erkennen und zu beheben. Installiere den Provider aus der Terraform Registry.
GPT Transcribe wurde für die präzise Transkription von Dateien und endgültige Transkripte bestätigter Realtime-Gesprächsbeiträge veröffentlicht. Ebenfalls veröffentlicht wurde GPT Live Transcribe für Streaming-Transkription mit geringer Latenz.
Beide Modelle unterstützen frei formulierten Kontext zur Transkription, Schlüsselworthinweise und die Angabe mehrerer erwarteter Eingabesprachen. Vergleiche die unterstützten Ausgaben und Arbeitsabläufe im Leitfaden zur Transkription.
Feste Ausgabenlimits für Organisationen und Projekte wurden zur OpenAI API-Plattform hinzugefügt. Lege eine monatliche Obergrenze fest. Sobald die erfassten Ausgaben dieses Limit erreichen, geben betroffene API-Anfragen einen 429-Fehler zurück. Nutze Ausgabenwarnungen, um vor einer Unterbrechung der Anfragen benachrichtigt zu werden. Weitere Informationen findest du im Leitfaden zu Ausgabenlimits.
Die GPT-5.6-Modellfamilie wurde veröffentlicht. Dazu gehören GPT-5.6 Sol für Leistungsfähigkeit auf höchstem Niveau, GPT-5.6 Terra für ein ausgewogenes Verhältnis von Intelligenz und Kosten sowie GPT-5.6 Luna für die effiziente Bearbeitung großer Anfragevolumen. Der Alias gpt-5.6 leitet Anfragen an gpt-5.6-sol weiter.
GPT-5.6 ergänzt programmatische Tool-Aufrufe, explizite Steuerungsmöglichkeiten für Prompt-Caching, persistente Denkprozesse, die Stufe max für den Reasoning-Aufwand und den Pro-Modus sowie die Orchestrierung mehrerer Agenten als Beta für die Responses API. GPT-5.6 akzeptiert außerdem Bilder in ihren ursprünglichen Abmessungen, wenn der Bilddetailgrad auf original oder auto gesetzt ist.
GPT-Realtime-2.1 wurde veröffentlicht: ein aktualisiertes Echtzeit-Reasoning-Modell mit verbesserter Erkennung alphanumerischer Zeichen, besserem Umgang mit Stille und Störgeräuschen sowie verbessertem Verhalten bei Unterbrechungen. Ebenfalls veröffentlicht wurde GPT-Realtime-2.1 mini, ein schnelleres, kostengünstigeres destilliertes Reasoning-Modell für Echtzeit-Sprachanwendungen.
Juni 2026
Der Snapshot chat-latest wurde aktualisiert. Er verweist auf das neueste Instant-Modell, das derzeit in ChatGPT verwendet wird. Für den produktiven API-Einsatz empfehlen wir GPT-5.5. Du kannst dieses Modell aber nutzen, um die neuesten Verbesserungen für Chat-Anwendungsfälle zu testen. Der zugrunde liegende Modell-Snapshot wird regelmäßig aktualisiert. Weitere Informationen findest du hier.
Das Dashboard zur sicherheitsbezogenen Nutzung wurde auf der OpenAI API-Plattform veröffentlicht. Das Sicherheitsdashboard zeigt blockierte Responses-Anfragen anhand der safety_identifier-Werte an, die zur Identifizierung der Endnutzenden mit den Anfragen gesendet werden. Öffne das Sicherheitsdashboard.
Die Websuche kann jetzt neben den üblichen Textergebnissen auch Bildergebnisse zurückgeben. Verwende die Bildersuche, wenn deine Anwendung aktuelle Bilder oder Bildmaterial aus dem Web benötigt, etwa Produktfotos, Sehenswürdigkeiten, Orte, Veranstaltungen oder visuelle Referenzen. Weitere Informationen findest du im Leitfaden zur Websuche.
Die Navigation der OpenAI API-Plattform wurde überarbeitet. Sieh sie dir hier an.
Moderationsbewertungen wurden zur Responses API und zur Chat Completions API hinzugefügt. Übergib ein moderation-Objekt in einer Generierungsanfrage, um Moderationsergebnisse sowohl für die Modelleingabe als auch für die generierte Ausgabe in derselben Antwort zu erhalten.
Weitere Informationen findest du im Leitfaden zur Moderation.
Die Abkündigung wiederverwendbarer Prompt-Objekte, der Evaluationsplattform und von Agent Builder wurde angekündigt. Abschaltungstermine und Hinweise zur Migration findest du auf der Seite zu Abkündigungen.
Ab dem 2. Juni 2026 werden berechtigte Containersitzungen pro Minute mit einer Mindestabrechnungsdauer von 5 Minuten abgerechnet, statt zum vollen Preis einer 20-minütigen Sitzung. Der zugrunde liegende Minutenpreis bleibt unverändert.
Diese Änderung soll eine feinere Abrechnung kürzerer Sitzungen ermöglichen und senkt die tatsächlich anfallenden Kosten für die Kundschaft.
Die aktuellen Preise für integrierte Werkzeuge findest du in unserer Dokumentation zu API-Preisen.
OpenAI-Modelle sind jetzt in Amazon Bedrock über einen OpenAI-kompatiblen Endpunkt der Responses API verfügbar. Die unterstützten Modelle und Funktionen variieren je nach AWS-Region. Mehr erfahren.
Mai 2026
Für Organisationen, bei denen ZDR nicht aktiviert ist, ist prompt_cache_retention jetzt standardmäßig auf 24h statt auf in_memory gesetzt. Damit ist erweitertes Prompt-Caching standardmäßig aktiviert. Mehr erfahren.
Der Snapshot chat-latest wurde veröffentlicht. Er verweist auf das neueste Instant-Modell, das derzeit in ChatGPT verwendet wird. Für den produktiven API-Einsatz empfehlen wir GPT-5.5. Du kannst dieses Modell aber nutzen, um die neuesten Verbesserungen für Chat-Anwendungsfälle zu testen. Der zugrunde liegende Modell-Snapshot wird regelmäßig aktualisiert. Weitere Informationen findest du hier.
Die Föderation von Workload-Identitäten wurde veröffentlicht. Vertrauenswürdige Workloads können extern ausgestellte Identitätstoken gegen kurzlebige OpenAI-Zugriffstoken austauschen, ohne langlebige API-Schlüssel zu speichern.
Die Admin-API wurde um Funktionen zur Verwaltung von Ausgabenwarnungen, Modellzulassungslisten, Einstellungen zur Datenaufbewahrung und Berechtigungen für gehostete Werkzeuge sowie zur Abfrage detaillierter Abrechnungspositionen erweitert.
Der sichere MCP-Tunnel wurde für Unternehmenskunden veröffentlicht. Mit dem sicheren MCP-Tunnel können unterstützte OpenAI-Produkte, darunter ChatGPT im Web, Codex, die Responses API und AgentKit, über einen kundenseitig gehosteten tunnel-client eine Verbindung zu privaten oder lokal betriebenen MCP-Servern herstellen, ohne diese Server im öffentlichen Internet zugänglich zu machen.
Du kannst jetzt mehrere IP-Zulassungslisten verwalten und jede davon auf Projektebene oder für die gesamte Organisation anwenden. Öffne zum Konfigurieren Einstellungen > Sicherheit > IP-Zulassungsliste.
DALL·E-Modell-Snapshots und die Beta der Realtime API wurden abgekündigt.
Die DALL·E-Modell-Snapshots dall-e-2 und dall-e-3 wurden am 12. Mai 2026 abgekündigt und aus der API entfernt. Wir empfehlen, stattdessen gpt-image-2, gpt-image-1 oder gpt-image-1-mini zu verwenden.
Die Beta-Version der Realtime API wurde am 12. Mai 2026 abgekündigt und aus der API entfernt. Wenn du noch die Beta-Schnittstelle verwendest, migriere zur veröffentlichten Realtime API. Sieh dir dazu den Migrationsleitfaden und die vollständige Seite zu Abkündigungen an.
return_token_budget wurde für das Websuche-Tool der Responses API hinzugefügt. Damit kannst du längere Websuchen mit Reasoning-Aufwand für GPT-5+ aktivieren, wenn du aufwendige Recherche- und Evaluierungsaufgaben bearbeitest.
GPT-Realtime-2 wurde veröffentlicht, ein neues Echtzeit-Sprachmodell mit konfigurierbarem Reasoning-Aufwand für Speech-to-Speech-Agenten. Ebenfalls veröffentlicht wurden GPT-Realtime-Translate für die Übersetzung von Sprache im Streaming-Verfahren und GPT-Realtime-Whisper für die Umwandlung von Sprache in Text im Streaming-Verfahren.
Der Leitfaden zu Echtzeit und Audio wurde aktualisiert und ein eigener Leitfaden zur Echtzeitübersetzung hinzugefügt. Die Dokumentation zur Echtzeittranskription wurde für Streaming-Transkripte überarbeitet. Hinweise zum Formulieren von Prompts für Echtzeitmodelle findest du jetzt unter Echtzeitmodelle verwenden.
Das OpenAI Developers-Plug-in für Codex wurde veröffentlicht. Es hilft dir, KI-Anwendungen und Agenten in Codex zu entwickeln, und bietet dafür Zugriff auf die OpenAI-Plattform sowie Anleitungen zum Einrichten der OpenAI API.
Das aktualisierte Agents SDK ist jetzt in TypeScript verfügbar, mit integrierter Unterstützung für Sandbox-Agenten und einem Open-Source-Harness. Mehr erfährst du hier.
Der Snapshot chat-latest wurde veröffentlicht. Er verweist auf das neueste Instant-Modell, das derzeit in ChatGPT verwendet wird. Für den API-Einsatz im Produktivbetrieb empfehlen wir GPT-5.5. Mit diesem Modell kannst du unsere neuesten Verbesserungen für Chat-Anwendungsfälle testen. Der zugrunde liegende Modell-Snapshot wird regelmäßig aktualisiert. Mehr erfährst du hier.
Die OpenAI SDKs für Node, Python, Go, Ruby und Java unterstützen jetzt Admin-APIs. Anleitungen zum Setup und Beispiele findest du im Leitfaden zu Admin-APIs.
April 2026
GPT-5.5, ein neues Spitzenmodell für komplexe berufliche Aufgaben, wurde in der Chat Completions API und der Responses API veröffentlicht. Außerdem wurde GPT-5.5 Pro für Anfragen über die Responses API veröffentlicht, um schwierigere Probleme zu lösen, die von mehr Rechenleistung profitieren.
GPT-5.5 unterstützt ein Kontextfenster mit 1 Million Token, Bildeingaben, strukturierte Ausgaben, Funktionsaufrufe, Prompt-Caching, Stapelverarbeitung, Tool-Suche, integrierte Computernutzung, Hosted Shell, Patch anwenden, Skills, MCP und Websuche. Zu den wichtigsten Neuerungen gehören:
- Der Reasoning-Aufwand ist jetzt standardmäßig auf
mediumeingestellt. - Wenn
image_detailnicht gesetzt oder aufautoeingestellt ist, verwendet das Modell jetzt das Verhalten der Einstellung original. - Caching funktioniert bei GPT-5.5 nur mit erweitertem Prompt-Caching. Prompt-Caching im Arbeitsspeicher wird nicht unterstützt. Mehr erfährst du hier.
GPT Image 2 wurde veröffentlicht, ein hochmodernes Modell zur Bildgenerierung und -bearbeitung. GPT Image 2 unterstützt flexible Bildgrößen, detailgetreue Bildeingaben, tokenbasierte Bildpreise und die Stapelverarbeitungs-API mit 50 % Rabatt.
Das Agents SDK wurde um neue Funktionen erweitert, darunter:
- Agenten in kontrollierten Sandboxes ausführen;
- den Open-Source-Harness untersuchen und anpassen; und
- steuern, wann Erinnerungen erstellt und wo sie gespeichert werden.
März 2026
GPT-5.4 mini und GPT-5.4 nano wurden in der Chat Completions API und der Responses API veröffentlicht. GPT-5.4 mini bietet Fähigkeiten auf dem Niveau von GPT-5.4 in einem schnelleren, effizienteren Modell für ein hohes Anfragevolumen. GPT-5.4 nano ist für einfache Aufgaben mit hohem Anfragevolumen optimiert, bei denen Geschwindigkeit und Kosten im Vordergrund stehen.
GPT-5.4 mini unterstützt Tool-Suche, integrierte Computernutzung und Compaction (Kontextverdichtung). GPT-5.4 nano unterstützt Compaction (Kontextverdichtung), jedoch weder Tool-Suche noch Computernutzung.
Der Slug gpt-5.3-chat-latest wurde aktualisiert und verweist jetzt auf das neueste Modell, das derzeit in ChatGPT verwendet wird.
Wir haben unseren Bildencoder aktualisiert, um einen kleinen Fehler bei input_image-Eingaben in GPT-5.4 zu beheben. Bei einigen Anwendungsfällen zum Bildverständnis kann sich dadurch die Qualität verbessern. Du musst nichts unternehmen.
Die Sora API wurde um wiederverwendbare Charakterreferenzen, längere Generierungen von bis zu 20 Sekunden, eine Ausgabe in 1080p für sora-2-pro, Videoverlängerungen und Unterstützung der Stapelverarbeitungs-API für POST /v1/videos erweitert. Generierungen in 1080p mit sora-2-pro werden mit $0.70 pro Sekunde abgerechnet. Mehr erfährst du hier.
POST /v1/videos/edits wurde zum Bearbeiten vorhandener Videos hinzugefügt. Dieser Endpunkt wird POST /v1/videos/{video_id}/remix ersetzen, der in 6 Monaten abgekündigt wird. Mehr erfährst du hier.
GPT-5.4, unser neuestes Spitzenmodell für berufliche Aufgaben, wurde in der Chat Completions API und der Responses API veröffentlicht. Außerdem wurde GPT-5.4 Pro in der Responses API veröffentlicht, um schwierigere Probleme zu lösen, die von mehr Rechenleistung profitieren.
Ebenfalls veröffentlicht:
- Tool-Suche in der Responses API: Damit können Modelle umfangreiche Tool-Definitionen erst zur Laufzeit laden. Das reduziert den Tokenverbrauch, erhält die Cache-Leistung und senkt die Latenz.
- Integrierte Unterstützung für Computernutzung in GPT-5.4 über das Tool
computerder Responses API für die Interaktion mit Benutzeroberflächen anhand von Screenshots. - Ein Kontextfenster mit 1 Million Token und native Unterstützung für Compaction (Kontextverdichtung) für länger laufende Agentenabläufe.
gpt-5.3-chat-latest wurde in der Chat Completions API und der Responses API veröffentlicht. Dieses Modell verweist auf den Snapshot von GPT-5.3 Instant, der derzeit in ChatGPT verwendet wird. Mehr erfährst du hier.
Februar 2026
Die Unterstützung für input_file in der Responses API wurde erweitert: Sie akzeptiert jetzt weitere Dateitypen für Dokumente, Präsentationen, Tabellenkalkulationen, Code und Text. Mehr erfährst du hier.
phase wurde in der Responses API veröffentlicht. Es kennzeichnet eine Assistentennachricht als Zwischenkommentar (commentary) oder abschließende Antwort (final_answer). Mehr erfährst du hier.
gpt-5.3-codex wurde in der Responses API veröffentlicht. Mehr erfährst du hier.
Der WebSocket-Modus für die Responses API wurde eingeführt. Mehr erfährst du hier.
GPT-Realtime-1.5 wurde in der Realtime API veröffentlicht.
gpt-audio-1.5 wurde in der Chat Completions API veröffentlicht. Mehr erfährst du hier.
Die Stapelverarbeitungs-API wird jetzt für die GPT Image-Modelle gpt-image-1.5, chatgpt-image-latest, gpt-image-1 und gpt-image-1-mini unterstützt.
Der Slug gpt-5.2-chat-latest wurde aktualisiert und verweist jetzt auf das neueste Modell, das derzeit in ChatGPT verwendet wird.
Serverseitige Compaction (Kontextverdichtung) wurde in der Responses API eingeführt.
Die Unterstützung für Skills wurde in der Responses API eingeführt. Wir unterstützen Skills sowohl bei der lokalen Ausführung als auch bei der Ausführung in gehosteten Containern.
Das neue Tool Hosted Shell und die Unterstützung für Netzwerkzugriffe in Containern wurden eingeführt.
Für GPT-Bildmodelle wurde die Unterstützung für Anfragen mit application/json an /v1/images/edits hinzugefügt. JSON-Anfragen verwenden images (und optional mask) mit Referenzen über image_url oder file_id anstelle von Multipart-Uploads.
Wir haben unseren Inferenz-Stack für die API-Kundschaft optimiert. GPT-5.2 und GPT-5.2-Codex laufen jetzt rund 40 % schneller. Die Modelle und ihre Gewichte bleiben unverändert.
Januar 2026
Open Responses wurde angekündigt: eine Open-Source-Spezifikation für die Entwicklung interoperabler LLM-Schnittstellen für mehrere Anbieter auf Basis der ursprünglichen OpenAI Responses API.
gpt-5.2-codex wurde in der Responses API veröffentlicht. GPT-5.2-Codex ist eine Version von GPT-5.2, die für agentische Programmieraufgaben in Codex oder ähnlichen Umgebungen optimiert ist. Mehr erfährst du hier.
Dedizierte IP-Bereiche für SIP wurden für die Realtime API hinzugefügt. sip.api.openai.com nutzt GeoIP-Routing und leitet SIP-Datenverkehr an die nächstgelegene Region weiter. Mehr erfahren.
Die Slugs gpt-realtime-mini und gpt-audio-mini wurden aktualisiert und verweisen jetzt auf die Snapshots vom 15. Dezember 2025. Wenn du die vorherigen Modell-Snapshots benötigst, verwende gpt-realtime-mini-2025-10-06 und gpt-audio-mini-2025-10-06.
Der Slug sora-2 wurde aktualisiert und verweist jetzt auf sora-2-2025-12-08. Wenn du den vorherigen Modell-Snapshot benötigst, verwende sora-2-2025-10-06.
Die Slugs gpt-4o-mini-tts und gpt-4o-mini-transcribe wurden aktualisiert und verweisen jetzt auf die Snapshots vom 2025-12-15. Wenn du die vorherigen Modell-Snapshots benötigst, verwende gpt-4o-mini-tts-2025-03-20 und gpt-4o-mini-transcribe-2025-03-20. Für die besten Ergebnisse empfehlen wir derzeit gpt-4o-mini-transcribe anstelle von gpt-4o-transcribe.
Ein Fehler wurde behoben, bei dem gpt-image-1.5 und chatgpt-image-latest für Bildbearbeitungen über /v1/images/edits fälschlicherweise eine hohe Detailtreue verwendeten, selbst wenn fidelity ausdrücklich auf low (den Standardwert) gesetzt war.
Dezember 2025
gpt-image-1.5 und chatgpt-image-latest wurden zum Bildgenerierungstool der Responses API hinzugefügt.
gpt-image-1.5 und chatgpt-image-latest, unsere neuesten und fortschrittlichsten Modelle zur Bildgenerierung, wurden veröffentlicht. Mehr erfährst du hier.
Vier neue Audio-Snapshots mit Datumskennung wurden veröffentlicht. Diese Updates verbessern die Zuverlässigkeit, Qualität und Stimmwiedergabe bei sprachgesteuerten Echtzeitanwendungen. Mehr erfährst du hier.
- gpt-realtime-mini-2025-12-15
- gpt-audio-mini-2025-12-15
- gpt-4o-mini-transcribe-2025-12-15
- gpt-4o-mini-tts-2025-12-15
Diese Veröffentlichung umfasst außerdem Unterstützung für benutzerdefinierte Stimmen für berechtigte Kundschaft.
GPT-5.2, das neueste Flagship-Modell der GPT-5-Modellfamilie, wurde veröffentlicht. Gegenüber dem Vorgängermodell GPT-5.1 bietet GPT-5.2 Verbesserungen in folgenden Bereichen:
- Allgemeine Intelligenz
- Befolgen von Anweisungen
- Genauigkeit und Tokeneffizienz
- Multimodalität, insbesondere Bildverständnis
- Codegenerierung, insbesondere das Erstellen von Frontend-Benutzeroberflächen
- Werkzeugaufrufe und Kontextverwaltung in der API
- Verstehen und Erstellen von Tabellen.
Neu in 5.2 sind die Stufe xhigh für den Reasoning-Aufwand, prägnante Zusammenfassungen der Gedankengänge und eine neue Kontextverwaltung mithilfe von Compaction (Kontextverdichtung).
Wir haben clientseitige Compaction (Kontextverdichtung) veröffentlicht. Bei länger laufenden Unterhaltungen mit der Responses API kannst du den Endpunkt /responses/compact verwenden, um den Kontext zu verkleinern, den du bei jedem Gesprächsschritt sendest.
Wir haben gpt-5.1-codex-max in der Responses API veröffentlicht. GPT-5.1-Codex ist unser intelligentestes Programmiermodell, optimiert für agentische Programmieraufgaben über längere Zeiträume. Mehr dazu erfährst du hier.
November 2025
Die Realtime API unterstützt jetzt DTMF-Tastendrücke. Du kannst nun DTMF-Ereignisse empfangen, während du eine Realtime-Sideband-Verbindung verwendest. Weitere Informationen findest du hier in der Dokumentation.
Wir haben GPT-5.1 veröffentlicht, das neueste Flagship-Modell der GPT-5-Modellfamilie. GPT-5.1 wurde darauf trainiert, in folgenden Bereichen besonders leistungsfähig zu sein:
- Steuerbarkeit und schnellere Antworten, wenn weniger Nachdenken erforderlich ist
- Codegenerierung und Programmieranwendungen
- Agentische Arbeitsabläufe
Beachte, dass GPT-5.1 standardmäßig die neue Einstellung none für den Reasoning-Aufwand verwendet, um schneller zu antworten, wenn weniger Nachdenken erforderlich ist. Bei GPT-5 war zuvor medium die Standardeinstellung.
Wir haben erweiterte rollenbasierte Zugriffskontrollen (RBAC) veröffentlicht. Mit rollenbasierter Zugriffskontrolle (RBAC) legst du fest, wer in deiner Organisation und deinen Projekten welche Aktionen ausführen darf, sowohl über die API als auch im Dashboard.
Wir haben gpt-5.1-codex und gpt-5.1-codex-mini in der Responses API veröffentlicht. GPT-5.1-Codex ist eine Version von GPT-5.1, die für agentische Programmieraufgaben in Codex oder ähnlichen Umgebungen optimiert ist. Mehr dazu erfährst du hier.
Wir haben eine verlängerte Aufbewahrungsdauer für den Prompt-Cache eingeführt. Damit bleiben zwischengespeicherte Präfixe länger aktiv, maximal 24 Stunden. Beim erweiterten Prompt-Caching werden die Key/Value-Tensoren in GPU-lokalen Speicher ausgelagert, sobald der Arbeitsspeicher voll ist. Dadurch steht deutlich mehr Speicherkapazität für das Caching zur Verfügung.
Oktober 2025
gpt-oss-safeguard-120b und gpt-oss-safeguard-20b sind Reasoning-Modelle für Sicherheitsaufgaben, die auf gpt-oss basieren. Mehr dazu erfährst du hier.
Wir haben Enterprise Key Management (EKM) veröffentlicht. Mit Enterprise Key Management (EKM) kannst du deine Kundeninhalte bei OpenAI mit Schlüsseln verschlüsseln, die dein eigenes externes Schlüsselverwaltungssystem (KMS) verwaltet.
Wir haben Datenresidenz im Vereinigten Königreich eingeführt.
Wir haben beim OpenAI DevDay mehrere neue Funktionen veröffentlicht:
Wir haben GPT-5 Pro veröffentlicht, eine Version von GPT-5, die mehr Rechenleistung nutzt, um gründlicher nachzudenken und durchgehend bessere Antworten zu liefern.
Wir haben GPT-Realtime mini und gpt-audio-mini für kosteneffizientere Speech-to-Speech-Verarbeitung veröffentlicht.
Wir haben gpt-image-1-mini für kosteneffizientere Bildgenerierung und -bearbeitung veröffentlicht.
Wir haben v1/videos eingeführt, um mit unseren neuesten Modellen Sora 2 und Sora 2 Pro ausdrucksstarke, detailreiche und dynamische Videos zu generieren und zu remixen.
Wir haben Agent Builder eingeführt, mit dem du individuelle Arbeitsabläufe mit mehreren Agenten visuell erstellen kannst.
Wir haben ChatKit eingeführt, eine einbettbare Chat-Oberfläche zur Bereitstellung von Agenten.
Wir haben Werkzeuge für Trace-Evaluationen, Datensätze und Prompt-Optimierung veröffentlicht.
Evaluationen: Modelle von Drittanbietern werden jetzt unterstützt.
Wir haben das Dashboard zum Dienststatus eingeführt.
Wir haben die IP-Zulassungsliste eingeführt. Damit lässt sich der API-Zugriff auf die von dir angegebenen IP-Adressen oder IP-Bereiche beschränken.
September 2025
Die Responses API unterstützt jetzt Bilder und Dateien als Ausgabe eines Werkzeugaufrufs.
Wir haben das spezialisierte Modell gpt-5-codex eingeführt, das für den Einsatz mit der Codex CLI entwickelt und optimiert wurde.
August 2025
Die OpenAI Realtime API ist jetzt allgemein verfügbar. Mehr dazu erfährst du in unserem Leitfaden zur Realtime API.
Die Responses API unterstützt jetzt Konnektoren. Konnektoren sind von OpenAI gepflegte MCP-Wrapper für beliebte Dienste wie Google-Apps, Dropbox und weitere. Damit kannst du dem Modell Lesezugriff auf Daten geben, die in diesen Diensten gespeichert sind.
Wir haben die Conversations API veröffentlicht. Damit kannst du länger laufende Unterhaltungen mit der Responses API erstellen und verwalten. Im Migrationsleitfaden findest du einen direkten Vergleich und erfährst, wie du von einer Assistants-API-Integration zu Responses und Conversations migrierst.
Wir haben die GPT-5-Modellfamilie in der API veröffentlicht, darunter gpt-5, gpt-5-mini und gpt-5-nano.
Wir haben den Wert minimal für den Reasoning-Aufwand eingeführt, um GPT-5-Modelle (die Reasoning unterstützen) auf schnelle Antworten zu optimieren.
Wir haben den Typ custom für Werkzeugaufrufe eingeführt. Damit sind bei Werkzeugaufrufen frei formatierte Eingaben an das Modell und Ausgaben vom Modell möglich.
Juni 2025
Wir haben Unterstützung für priorisierte Verarbeitung eingeführt. Sie bietet deutlich geringere und konstantere Latenzen als die Standardverarbeitung und behält die Flexibilität der nutzungsabhängigen Abrechnung bei.
Wir haben o3-deep-research und o4-mini-deep-research veröffentlicht. Diese Deep-Research-Varianten unserer Reasoning-Modelle der o-Serie sind für tiefgehende Analysen und Rechercheaufgaben optimiert. Mehr dazu erfährst du im Leitfaden zu Deep Research.
Wir haben Unterstützung für die asynchrone Ereignisverarbeitung mit Webhooks hinzugefügt. Die Preise für das Websuchwerkzeug wurden gesenkt und vereinfacht. Außerdem haben wir Unterstützung für das Websuchwerkzeug hinzugefügt.
Neue wiederverwendbare Prompts sind jetzt im Dashboard und in der Responses API verfügbar. Über die API kannst du nun mit dem Parameter prompt (mit der id eines Prompts und optional einer version) auf Vorlagen verweisen, die im Dashboard erstellt wurden. Außerdem kannst du dynamische variables übergeben, die Zeichenfolgen, Bilder oder Dateieingaben enthalten können. Wiederverwendbare Prompts sind in Chat Completions nicht verfügbar. Mehr erfahren.
Wir haben o3-pro veröffentlicht, eine Version des Reasoning-Modells o3. Sie nutzt mehr Rechenleistung, um schwierige Probleme mit besseren Schlussfolgerungen und konsistenteren Ergebnissen zu lösen. Auch die Preise für das Modell o3 wurden gesenkt, und zwar für alle API-Anfragen, einschließlich Stapelverarbeitung und Flex-Verarbeitung.
Die Modelle gpt-4.1-2025-04-14, gpt-4.1-mini-2025-04-14 und gpt-4.1-nano-2025-04-14 unterstützen jetzt Fine-Tuning mit direkter Präferenzoptimierung.
Für gpt-4o-audio-preview und gpt-4o-realtime-preview sind neue Modell-Snapshots verfügbar. Wir haben das Agents SDK für TypeScript veröffentlicht.
Mai 2025
Die Responses API unterstützt jetzt weitere integrierte Werkzeuge, darunter Remote-MCP-Server und Code Interpreter. Mehr über Werkzeuge erfahren.
Bei parallelen Werkzeugaufrufen mit Modellen ohne Fine-Tuning lässt sich jetzt der Modus strict für Werkzeugschemas verwenden.
Wir haben neue Schemafunktionen hinzugefügt, darunter die Validierung von Zeichenfolgen für email und andere Muster sowie die Angabe von Grenzen für Zahlen und Arrays.
Wir haben codex-mini-latest in der API eingeführt, optimiert für den Einsatz mit der Codex CLI.
Wir haben Unterstützung für Reinforcement Fine-Tuning eingeführt. Erfahre mehr über die verfügbaren Fine-Tuning-Methoden. gpt-4.1-nano ist jetzt für Fine-Tuning verfügbar.
April 2025
Wir haben Unterstützung für erweiterte API-Budgetwarnungen und Limits für das automatische Aufladen eingeführt.
Wir haben ein neues Modell zur Bildgenerierung hinzugefügt: gpt-image-1. Es setzt neue Maßstäbe bei der Bildgenerierung, mit besserer Qualität und einer präziseren Befolgung von Anweisungen.
Wir haben die Endpunkte für Bildgenerierung und -bearbeitung aktualisiert. Sie unterstützen jetzt neue Parameter speziell für das Modell gpt-image-1.
Wir haben zwei neue Reasoning-Modelle der o-Serie hinzugefügt: o3 und o4-mini. Sie setzen neue Maßstäbe in Mathematik, Naturwissenschaften und Programmierung sowie beim logischen Schlussfolgern anhand visueller Informationen und beim Verfassen technischer Texte.
Wir haben Codex eingeführt, unser CLI-Werkzeug zur Codegenerierung.
Wir haben die Modelle gpt-4.1, gpt-4.1-mini und gpt-4.1-nano zur API hinzugefügt. Diese neuen Modelle befolgen Anweisungen besser, programmieren besser und bieten ein größeres Kontextfenster (bis zu 1 Million Token). gpt-4.1 und gpt-4.1-mini sind für überwachtes Fine-Tuning verfügbar. Wir haben die Einstellung von gpt-4.5-preview angekündigt.
März 2025
Wir haben die Modelle gpt-4o-mini-tts, gpt-4o-transcribe, gpt-4o-mini-transcribe und whisper-1 zur Audio API hinzugefügt.
Wir haben mehrere neue Modelle und Werkzeuge sowie eine neue API für agentische Arbeitsabläufe veröffentlicht:
- Wir haben die Responses API veröffentlicht, eine neue API zum Erstellen und Verwenden von Agenten und Werkzeugen.
- Wir haben eine Reihe integrierter Werkzeuge für die Responses API veröffentlicht: Websuche, Dateisuche und Computernutzung.
- Wir haben das Agents SDK veröffentlicht, ein Orchestrierungsframework zum Entwerfen, Entwickeln und Bereitstellen von Agenten.
- Wir haben neue Modelle angekündigt:
gpt-4o-search-preview,gpt-4o-mini-search-preview,computer-use-preview. - Wir haben Pläne angekündigt, alle Funktionen der Assistants API in die einfacher zu bedienende Responses API zu übernehmen. Die Abschaltung von Assistants ist voraussichtlich für 2026 vorgesehen, nachdem der vollständige Funktionsumfang übernommen wurde.
Fine-Tuning-Jobs unterstützen jetzt das Feld metadata.
Februar 2025
Wir haben eine Forschungsvorschau von GPT-4.5 veröffentlicht, unserem bisher größten und leistungsfähigsten Chat-Modell. Der hohe „EQ“ von GPT-4.5 und sein Verständnis dafür, was Nutzende erreichen möchten, verbessern seine Leistung bei kreativen Aufgaben und agentischer Planung.
Das Update für das Dashboard zur API-Nutzung wurde veröffentlicht. Es ergänzt gewünschte Datenfilter wie Projektauswahl, Datumsauswahl und fein abgestufte Zeitintervalle. Auch die Anzeige der Nutzung über verschiedene Produkte und Servicestufen hinweg wurde verbessert.
Datenresidenz in Europa ist jetzt verfügbar. Mehr dazu erfährst du hier.
Januar 2025
o3-mini wurde veröffentlicht, ein neues kleines Reasoning-Modell, das für Aufgaben in Wissenschaft, Mathematik und Programmierung optimiert ist.
Der Zugang zum Modell o1 wurde erweitert. Die Modelle der o1-Serie werden mit Reinforcement Learning trainiert, um komplexe Denkaufgaben zu lösen.
Dezember 2024
Die Rotation von Admin-API-Schlüsseln ist jetzt verfügbar. Damit kannst du deine Admin-API-Schlüssel programmgesteuert rotieren.
Einladungen über die Admin-API wurden aktualisiert. Damit kannst du Personen programmgesteuert gleichzeitig in Organisationen und Projekte einladen.
Neue Modelle für o1, gpt-4o-realtime, gpt-4o-audio und weitere wurden hinzugefügt.
WebRTC wurde als Verbindungsmethode für die Realtime API hinzugefügt.
Der Parameter reasoning_effort wurde für o1-Modelle hinzugefügt.
Die Nachrichtenrolle developer wurde für das Modell o1 hinzugefügt. Beachte, dass o1-preview und o1-mini keine Nachrichten mit den Rollen system oder developer unterstützen.
Präferenzbasiertes Fine-Tuning mit direkter Präferenzoptimierung (DPO) ist jetzt verfügbar.
Beta-SDKs für Go und Java wurden veröffentlicht. Mehr erfahren.
Das Python SDK unterstützt jetzt die Realtime API.
Die Usage API wurde veröffentlicht. Damit kannst du Aktivitäten und Ausgaben über die OpenAI-APIs hinweg programmgesteuert abfragen.
November 2024
gpt-4o-2024-11-20, unser neuestes Modell der gpt-4o-Serie, wurde veröffentlicht.
Vorhergesagte Ausgaben sind jetzt verfügbar. Sie reduzieren die Latenz bei Modellantworten erheblich, wenn ein Großteil der Antwort bereits im Voraus bekannt ist. Das ist besonders häufig der Fall, wenn Inhalte von Dokumenten und Codedateien mit nur geringfügigen Änderungen neu generiert werden.
Oktober 2024
Fünf neue Stimmen wurden in der Realtime API und der Chat Completions API hinzugefügt.
Das neue Modell gpt-4o-audio-preview wurde für Chat Completions veröffentlicht und unterstützt sowohl Audioeingaben als auch Audioausgaben. Es basiert auf demselben Modell wie die Realtime API.
Beim OpenAI DevDay in San Francisco wurden mehrere neue Funktionen veröffentlicht:
Realtime API: Integriere über eine WebSockets-Schnittstelle schnelle Speech-to-Speech-Funktionen in deine Anwendungen.
Modelldestillation: Eine Plattform für das Fine-Tuning kosteneffizienter Modelle mit deinen Ausgaben aus einem großen Modell auf dem neuesten Stand der Technik.
Fine-Tuning mit Bildern: Passe GPT-4o durch Fine-Tuning mit Bildern und Text an, um sein Bildverständnis zu verbessern.
Evaluationen: Erstelle eigene Evaluationen und führe sie aus, um die Modellleistung bei bestimmten Aufgaben zu messen.
Prompt-Caching: Preisnachlässe und kürzere Verarbeitungszeiten für kürzlich verarbeitete Eingabetokens.
Generieren im Playground: Erstelle im Playground über die Schaltfläche „Generieren“ ganz einfach Prompts, Funktionsdefinitionen und Schemas für strukturierte Ausgaben.
September 2024
Das neue Moderationsmodell omni-moderation-latest wurde veröffentlicht. Es unterstützt in einigen Kategorien sowohl Bilder als auch Text, bietet zwei neue Kategorien für schädliche Inhalte ausschließlich in Texten und liefert genauere Bewertungen.
o1-preview und o1-mini wurden veröffentlicht. Diese neuen großen Sprachmodelle wurden mit Reinforcement Learning trainiert, um komplexe Denkaufgaben zu lösen.
August 2024
Die Assistants API unterstützt jetzt das Einbeziehen der vom Dateisuchtool verwendeten Suchergebnisse und das Anpassen ihrer Rangfolge.
Fine-Tuning für gpt-4o-2024-08-06 ist jetzt allgemein verfügbar. Alle, die die API nutzen, können nun das neueste GPT-4o-Modell durch Fine-Tuning anpassen.
Ein dynamisches Modell für chatgpt-4o-latest wurde veröffentlicht. Es wird auf das jeweils neueste GPT-4o-Modell verweisen, das ChatGPT verwendet.
Strukturierte Ausgaben sind jetzt verfügbar. Modellausgaben halten sich damit zuverlässig an die von Entwickelnden vorgegebenen JSON-Schemas.
gpt-4o-2024-08-06, unser neuestes Modell der gpt-4o-Serie, wurde veröffentlicht.
Die Admin-API und Audit Log API wurden veröffentlicht. Damit kannst du deine Organisation programmgesteuert verwalten und Änderungen anhand der Auditprotokolle überwachen. Die Auditprotokollierung muss in den Einstellungen aktiviert werden.
Juli 2024
Die SSO-Konfiguration im Self-Service ist jetzt verfügbar. Unternehmenskunden mit individueller oder unbegrenzter Abrechnung können damit die Authentifizierung über den gewünschten Identitätsanbieter (IDP) einrichten.
Fine-Tuning für GPT-4o mini ist jetzt verfügbar und ermöglicht eine noch höhere Leistung bei bestimmten Anwendungsfällen.
GPT-4o mini wurde veröffentlicht, unser kostengünstiges und intelligentes kleines Modell für schnelle, einfache Aufgaben.
Uploads wurde veröffentlicht, um große Dateien in mehreren Teilen hochzuladen.
Juni 2024
Parallele Funktionsaufrufe lassen sich in Chat Completions und der Assistants API durch Übergabe von parallel_tool_calls=false deaktivieren.
Das .NET SDK wurde als Beta veröffentlicht.
Mai 2024
Projekte lassen sich jetzt archivieren. Diese Funktion steht nur Personen zur Verfügung, denen die Organisation gehört.
Bei nutzungsbasierter Abrechnung kannst du jetzt für jedes Projekt einzeln Kostenlimits festlegen.
GPT-4o wurde in der API veröffentlicht. GPT-4o ist unser schnellstes und kostengünstigstes Flagship-Modell.
Unterstützung für Bildeingaben in der Assistants API wurde hinzugefügt.
Unterstützung für durch Fine-Tuning angepasste Modelle in der Batch API wurde hinzugefügt.
Der Parameter stream_options: {"include_usage": true} wurde zur Chat Completions API und zur Completions API hinzugefügt. Mit dieser Einstellung können Entwickelnde beim Streaming auf Nutzungsstatistiken zugreifen.
Ein neuer Endpunkt zum Löschen einer Nachricht aus einem Thread in der Assistants API wurde hinzugefügt.
April 2024
Die neue Option tool_choice: "required" für Funktionsaufrufe wurde zur Chat Completions API und zur Assistants API hinzugefügt.
Ein Leitfaden zur Batch API und Unterstützung für Embedding-Modelle in der Batch API wurden hinzugefügt
Eine Reihe von Updates für die Assistants API wurde eingeführt. Dazu gehören ein neues Dateisuchtool für bis zu 10.000 Dateien pro Assistent, neue Einstellungen zur Token-Steuerung und Unterstützung für die Toolauswahl.
Eine projektbasierte Hierarchie wurde eingeführt, mit der du deine Arbeit nach Projekten organisieren kannst. Du kannst API-Schlüssel erstellen sowie Raten- und Kostenlimits für jedes Projekt einzeln verwalten. Kostenlimits stehen nur Unternehmenskunden zur Verfügung.
Die Batch API wurde veröffentlicht
GPT-4 Turbo with Vision wurde in der API allgemein verfügbar gemacht
Die Fine-Tuning-API unterstützt jetzt seed
Die Fine-Tuning-API unterstützt jetzt Checkpoints
In der Assistants API kannst du jetzt beim Erstellen eines Runs Nachrichten hinzufügen
In der Assistants API kannst du jetzt Nachrichten nach run_id filtern
März 2024
Die Assistants API unterstützt jetzt temperature und das Erstellen von Assistentennachrichten
Die Assistants API unterstützt jetzt Streaming
Februar 2024
Der Parameter timestamp_granularities wurde zur Audio API hinzugefügt
gpt-3.5-turbo-0125, ein aktualisiertes GPT-3.5 Turbo-Modell, wurde veröffentlicht
Januar 2024
Embedding-Modelle der Version V3 und eine aktualisierte Vorschauversion von GPT-4 Turbo wurden veröffentlicht
Der Parameter dimensions wurde zur Embeddings API hinzugefügt
Dezember 2023
Der Parameter additional_instructions wurde für das Erstellen von Runs in der Assistants API hinzugefügt
Die Parameter logprobs und top_logprobs wurden zur Chat Completions API hinzugefügt
Das Argument für Funktionsparameter bei einem Tool-Aufruf ist jetzt optional
November 2023
OpenAI Deno SDK wurde veröffentlicht
GPT-4 Turbo Preview, eine aktualisierte Version von GPT-3.5 Turbo, GPT-4 Turbo with Vision, die Assistants API, DALL·E 3 in der API und die Text-to-Speech-API wurden veröffentlicht
Der Parameter functions der Chat Completions API wurde zugunsten von tools abgekündigt
OpenAI Python SDK V1.0 wurde veröffentlicht
Oktober 2023
Der Parameter encoding_format wurde zur Embeddings API hinzugefügt
max_tokens wurde zu den Moderationsmodellen hinzugefügt
Die Fine-Tuning-API unterstützt jetzt Funktionsaufrufe