GPT-5.4 Pro usa más recursos de cómputo para razonar con mayor profundidad y ofrecer mejores respuestas de forma consistente.
GPT-5.4 Pro está disponible únicamente en la API Responses para permitir interacciones de varios turnos con el modelo antes de responder a las solicitudes de la API, así como otras funciones avanzadas de la API en el futuro. Como GPT-5.4 Pro está diseñado para resolver problemas difíciles, algunas solicitudes pueden tardar varios minutos en completarse. Para evitar que se agote el tiempo de espera, prueba usar el modo en segundo plano. Reasoning.effort admite: medium (predeterminado), high y xhigh.
Para los modelos con una ventana de contexto de 1,05 millones de tokens (GPT-5.4 y GPT-5.4 Pro), los prompts con más de 272 000 tokens de entrada se cobran al doble de la tarifa de entrada y a 1,5 veces la tarifa de salida durante toda la sesión, tanto en el procesamiento estándar como en el procesamiento por lotes y flex.
Se aplica un recargo del 10 % a los puntos de acceso de procesamiento regional (residencia de datos) para GPT-5.4 y GPT-5.4 Pro.
| Nivel | RPM | TPM | Límite de la cola de procesamiento por lotes |
|---|---|---|---|
| Gratis | No compatible | ||
| Nivel 1 | 50 | 50,000 | 900,000 |
| Nivel 2 | 500 | 100,000 | 1,350,000 |
| Nivel 3 | 500 | 200,000 | 100,000,000 |
| Nivel 4 | 1,000 | 400,000 | 200,000,000 |
| Nivel 5 | 1,500 | 4,000,000 | 15,000,000,000 |