O GPT-5.4 Pro usa mais recursos computacionais para raciocinar com mais profundidade e fornecer respostas consistentemente melhores.
O GPT-5.4 Pro está disponível apenas na Responses API para permitir interações com o modelo em múltiplos turnos antes de responder às solicitações da API, além de outros recursos avançados da API no futuro. Como o GPT-5.4 Pro foi projetado para resolver problemas difíceis, algumas solicitações podem levar vários minutos para serem concluídas. Para evitar que o tempo limite seja excedido, experimente usar o modo em segundo plano. Reasoning.effort aceita: medium (padrão), high e xhigh.
Para modelos com uma janela de contexto de 1.05M (GPT-5.4 e GPT-5.4 Pro), prompts com >272K tokens de entrada são cobrados a 2x o preço de entrada e 1.5x o preço de saída durante toda a sessão, nas modalidades padrão, processamento em lote e flex.
Os endpoints de processamento regional (residência de dados) têm um acréscimo de 10% no preço para o GPT-5.4 e o GPT-5.4 Pro.
| Nível | RPM | TPM | Limite da fila de processamento em lote |
|---|---|---|---|
| Gratuito | Sem suporte | ||
| Nível 1 | 50 | 50,000 | 900,000 |
| Nível 2 | 500 | 100,000 | 1,350,000 |
| Nível 3 | 500 | 200,000 | 100,000,000 |
| Nível 4 | 1,000 | 400,000 | 200,000,000 |
| Nível 5 | 1,500 | 4,000,000 | 15,000,000,000 |