GPT-5.4 Pro utilise davantage de ressources de calcul pour approfondir son raisonnement et fournir systématiquement de meilleures réponses.
GPT-5.4 Pro est disponible uniquement dans l’API Responses afin de permettre des interactions en plusieurs tours avec le modèle avant de répondre aux requêtes API, ainsi que la prise en charge d’autres fonctionnalités avancées de l’API à l’avenir. Comme GPT-5.4 Pro est conçu pour résoudre des problèmes difficiles, le traitement de certaines requêtes peut prendre plusieurs minutes. Pour éviter les dépassements de délai, essayez le mode en arrière-plan. Reasoning.effort prend en charge les valeurs suivantes : medium (par défaut), high et xhigh.
Pour les modèles dotés d’une fenêtre de contexte de 1,05 million de tokens (GPT-5.4 et GPT-5.4 Pro), les prompts contenant plus de 272 000 tokens d’entrée sont facturés au double du tarif d’entrée et à 1,5 fois le tarif de sortie pour l’ensemble de la session, en traitement standard, par lots et flex.
Les points de terminaison de traitement régional (résidence des données) font l’objet d’une majoration de 10 % pour GPT-5.4 et GPT-5.4 Pro.
| Niveau | RPM | TPM | Limite de la file d’attente du traitement par lots |
|---|---|---|---|
| Gratuit | Non pris en charge | ||
| Niveau 1 | 50 | 50,000 | 900,000 |
| Niveau 2 | 500 | 100,000 | 1,350,000 |
| Niveau 3 | 500 | 200,000 | 100,000,000 |
| Niveau 4 | 1,000 | 400,000 | 200,000,000 |
| Niveau 5 | 1,500 | 4,000,000 | 15,000,000,000 |