For the complete documentation index, see llms.txt. Markdown versions of documentation pages are available by appending .md to the page URL.
Hauptnavigation
gpt-5.4
GPT-5.4
Ein günstigeres Modell für Programmierung und professionelle Aufgaben.
Reasoning-Aufwand
Geschwindigkeit
Preis
$2.5$15
Eingabe
Ausgabe

GPT-5.4 ist ein Flagship-Modell für komplexe professionelle Aufgaben. Mehr dazu erfährst du in unserem Leitfaden zum Modell GPT-5.4. Reasoning.effort unterstützt: none (Standard), low, medium, high und xhigh.

Kontextfenster: 1,050,000
Maximal 128,000 Ausgabe-Token
Wissensstand: Aug 31, 2025
Unterstützung für Reasoning-Token
Preise
Die Preise richten sich nach der Anzahl der verwendeten Token oder, je nach Modelltyp, nach anderen Messgrößen. Bei Modellen für bestimmte Werkzeuge, etwa für die Suche und die Computernutzung, fällt eine Gebühr pro Werkzeugaufruf an. Details findest du auf der Preisübersicht.
Text-Token
Pro 1 Mio. Token
Preis der Batch API
Eingabe
$2.50
Zwischengespeicherte Eingabe
$0.25
Ausgabe
$15.00
Kurzvergleich
Eingabe
Zwischengespeicherte Eingabe
Ausgabe
GPT-5.4
$2.50
GPT-5.2
$1.75
GPT-5.4 Mini
$0.75

Bei Modellen mit einem Kontextfenster von 1,05 Millionen Token (GPT-5.4 und GPT-5.4 Pro) werden Prompts mit mehr als 272.000 Eingabetoken bei Standard, Stapelverarbeitung und Flex für die gesamte Sitzung zum doppelten Eingabepreis und zum 1,5-fachen Ausgabepreis abgerechnet.

Für Endpunkte mit regionaler Verarbeitung (Datenresidenz) wird bei GPT-5.4 und GPT-5.4 Pro ein Aufschlag von 10 % berechnet.

Modalitäten
Text
Eingabe und Ausgabe
Bild
Nur Eingabe
Audio
Nicht unterstützt
Video
Nicht unterstützt
Endpunkte
Live
v1/live/sessions
Chat Completions
v1/chat/completions
Responses
v1/responses
Realtime
v1/realtime
Echtzeitübersetzung
v1/realtime/translations
Echtzeittranskription
v1/realtime/transcription_sessions
Assistants
v1/assistants
Stapelverarbeitung
v1/batch
Fine-Tuning
v1/fine-tuning
Embeddings
v1/embeddings
Bildgenerierung
v1/images/generations
Videos
v1/videos
Bildbearbeitung
v1/images/edits
Sprachgenerierung
v1/audio/speech
Transkription
v1/audio/transcriptions
Übersetzung
v1/audio/translations
Moderation
v1/moderations
Completions (Legacy)
v1/completions
Funktionen
Streaming
Unterstützt
Funktionsaufruf
Unterstützt
Strukturierte Ausgaben
Unterstützt
Fine-Tuning
Nicht unterstützt
Werkzeuge
Werkzeuge, die dieses Modell bei Verwendung der Responses API unterstützt.
Websuche
Unterstützt
Dateisuche
Unterstützt
Bildgenerierung
Unterstützt
Code Interpreter
Unterstützt
Hosted Shell
Unterstützt
Patch anwenden
Unterstützt
Skills
Unterstützt
Computernutzung
Unterstützt
MCP
Unterstützt
Tool-Suche
Unterstützt
Snapshots
Mit Snapshots kannst du eine bestimmte Modellversion festlegen, damit Leistung und Verhalten konsistent bleiben. Unten findest du eine Liste aller verfügbaren Snapshots und Aliasse für GPT-5.4.
gpt-5.4
gpt-5.4
gpt-5.4-2026-03-05
gpt-5.4-2026-03-05
Ratenlimits
Ratenlimits gewährleisten einen fairen und zuverlässigen Zugriff auf die API. Dazu begrenzen sie die Anzahl der Anfragen und Token, die Audiodauer oder andere Nutzungsgrößen innerhalb eines bestimmten Zeitraums. Deine Nutzungsstufe bestimmt die Höhe dieser Limits. Sie steigt automatisch, wenn du mehr Anfragen sendest und mehr für die API ausgibst.
StufeRPMTPMWarteschlangenlimit für die Stapelverarbeitung
KostenlosNicht unterstützt
Stufe 1500500,0001,500,000
Stufe 25,0001,000,0003,000,000
Stufe 35,0002,000,000100,000,000
Stufe 410,0004,000,000200,000,000
Stufe 515,00040,000,00015,000,000,000