For the complete documentation index, see llms.txt. Markdown versions of documentation pages are available by appending .md to the page URL.
Hauptnavigation

Preise

Flagship-Modelle

Unsere neuesten Modelle
Preise pro 1 Mio. Token.
Kurzer KontextLanger Kontext
ModellEingabeEingabe aus dem CacheCache-SchreibvorgängeAusgabeEingabeEingabe aus dem CacheCache-SchreibvorgängeAusgabe
gpt-6-astra$10.00$1.00$12.50$50.00$20.00$2.00$25.00$75.00
gpt-5.6-sol$4.00$0.40$5.00$20.00$8.00$0.80$10.00$30.00
gpt-5.6-terra$2.00$0.20$2.50$12.00$4.00$0.40$5.00$18.00
gpt-5.6-luna$0.20$0.02$0.25$1.20$0.40$0.04$0.50$1.80
Für Endpunkte mit regionaler Verarbeitung (Datenresidenz) wird bei Modellen, die am oder nach dem 5. März 2026 veröffentlicht wurden und Datenresidenz unterstützen, ein Aufschlag von 10% erhoben. Unterstützte Regionen und Details zur Verarbeitung findest du in unserem Leitfaden Deine Daten. OpenAI-Modelle in Amazon Bedrock werden über AWS abgerechnet. Die Bedrock-Preise in kommerziellen Regionen entsprechen den Preisen von OpenAI bei direkter Nutzung gleichwertiger Dienste.

Die priorisierte Verarbeitung wurde am 30. Juli 2026 in Schnellmodus umbenannt. Du kannst in deinen API-Anfragen entweder service_tier: "priority" oder service_tier: "fast" verwenden. Mehr über den Schnellmodus erfahren.

Die Aktionspreise für GPT-5.6 Sol gelten mindestens bis zum 21. November 2026.

Cyber-Modelle

Unsere neuesten Daybreak-Modelle.
Preise pro 1 Mio. Token.
Kurzer KontextLanger Kontext
ModellEingabeZwischengespeicherte EingabeCache-SchreibvorgängeAusgabeEingabeZwischengespeicherte EingabeCache-SchreibvorgängeAusgabe
gpt-5.6-sol$4.00$0.40$5.00$20.00$8.00$0.80$10.00$30.00
gpt-5.6-cyber$12.50$1.25$15.625$75.00----

gpt-daybreak-blue-latest und gpt-daybreak-red-latest sind Aliase, die derzeit auf gpt-5.6-sol beziehungsweise gpt-5.6-cyber verweisen. Sobald im Rahmen des Daybreak-Programms neue Modelle veröffentlicht werden, werden diese Aliase aktualisiert, sodass sie auf die neuesten Modelle verweisen. Die Preise werden dabei an das jeweils zugrunde liegende Modell angepasst.

Multimodale Modelle

Um die Eingabekosten für Modelle mit Bildverarbeitung abzuschätzen, verwende den Kostenrechner für Bildeingaben.

GPT-Live-Sitzungen

Sprachsitzungen mit GPT-Live 1 werden sekundengenau abgerechnet, ohne auf volle Minuten aufzurunden. Die Nutzung von Modellen und Tools im Backend wird separat berechnet.

ModellPreis pro Minute
gpt-live-1$0.05

Echtzeitmodelle und Modelle zur Audiogenerierung

ModellModalitätEingabeZwischengespeicherte EingabeAusgabe / Kosten
gpt-realtime-2.1Audio$32.00$0.40$64.00
Text$4.00$0.40$24.00
Bild$5.00$0.50-
gpt-realtime-2.1-miniAudio$10.00$0.30$20.00
Text$0.60$0.06$2.40
Bild$0.80$0.08-

Modelle zur Bildgenerierung

Preise pro 1 Mio. Token.
ModellModalitätEingabeEingabe aus dem CacheAusgabe
gpt-image-2.5-sunburstBild$8.00$2.00$30.00
Text$5.00$1.25-
gpt-image-2.5-flareBild$8.00$2.00$30.00
Text$5.00$1.25-

Modelle zur Videogenerierung

Preise pro Sekunde.
ModellGrößeHochformatQuerformatPreis pro Sekunde
sora-2720p720x12801280x720$0.10
sora-2-pro720p720x12801280x720$0.30
1024p1024x17921792x1024$0.50
1080p1080x19201920x1080$0.70

Transkriptionsmodelle

ModellAnwendungsfallEingabeAusgabeGeschätzte Kosten
gpt-realtime-translateLive-Übersetzung--$0.034 / Minute
gpt-live-transcribeLive-Transkription--$0.017 / Minute
gpt-realtime-whisperLive-Transkription--$0.017 / Minute
gpt-transcribeTranskription--$0.0045 / Minute
gpt-4o-transcribeTranskription$2.50$10.00$0.006 / Minute
gpt-4o-mini-transcribeTranskription$1.25$5.00$0.003 / Minute

Werkzeuge

WerkzeugDetailsPreise
WebsucheWebsuche (alle Modelle)$10.00 / 1 Tsd. Aufrufe
+ Token für Suchinhalte werden zu den Modellpreisen abgerechnet.
Bildersuche im Web (alle Modelle)$10.00 / 1 Tsd. Aufrufe
+ Token für Suchinhalte werden zu den Modellpreisen abgerechnet.
Vorschauversion der Websuche (Reasoning-Modelle, einschließlich gpt-5, o-series)$10.00 / 1 Tsd. Aufrufe
+ Token für Suchinhalte werden zu den Modellpreisen abgerechnet.
Vorschauversion der Websuche (Modelle ohne Reasoning-Funktion)$25.00 / 1 Tsd. Aufrufe
+ Token für Suchinhalte sind kostenlos.
ContainerHosted Shell und Code Interpreter1 GB $0.03, 4 GB $0.12, 16 GB $0.48, 64 GB $1.92 pro Sitzung von 20 Minuten je Container.
DateisucheSpeicher$0.10 / GB pro Tag (1 GB kostenlos)
Werkzeugaufruf$2.50 / 1 Tsd. Aufrufe
Agent KitSpeicher für Datei- und Bild-Uploads in ChatKit$0.10 / GB und Tag nach Ausschöpfung von 1 GB kostenlosem Speicher pro Konto und Monat

Spezialisierte Modelle

Preise pro 1 Mio. Token.
KategorieModellEingabeEingabe aus dem CacheAusgabe
ChatGPTchat-latest$5.00$0.50$30.00
Codexgpt-5.3-codex$1.75$0.175$14.00
Lebenswissenschaftengpt-rosalind-research$5.00$0.50$25.00
Die Abrechnung für gpt-rosalind-research beginnt am 5. Oktober 2026. Die Preise für Cache-Schreibvorgänge gelten für dieses Modell nicht. Der Zugriff ist auf genehmigte interne Forschung im Rahmen des Programms für vertrauenswürdigen Zugang beschränkt. Alle berechtigten Organisationen erhalten weiterhin Zugriff auf die neuesten GPT-Rosalind-Modelle, sobald diese veröffentlicht werden.

Bei Modellen, die ab dem 5. März 2026 veröffentlicht wurden und für Datenresidenz infrage kommen, wird für Endpunkte zur regionalen Verarbeitung (Datenresidenz) ein Aufschlag von 10% berechnet. Informationen zu unterstützten Regionen und Details zur Verarbeitung findest du in unserem Leitfaden Deine Daten.

Fine-Tuning

Preise pro 1 Mio. Token.

OpenAI stellt die Fine-Tuning-Plattform schrittweise ein. Für neue Nutzende ist die Plattform nicht mehr zugänglich. Wer sie bereits nutzt, kann in den kommenden Monaten weiterhin Trainingsaufträge erstellen.


Alle mit Fine-Tuning angepassten Modelle bleiben für die Inferenz verfügbar, bis ihre Basismodelle abgekündigt werden. Den vollständigen Zeitplan findest du hier.

ModellSchulungenEingabeZwischengespeicherte EingabeAusgabe
o4-mini-2025-04-16$100.00 / Stunde$4.00$1.00$16.00
o4-mini-2025-04-16
mit Datenfreigabe
$100.00 / Stunde$2.00$0.50$8.00