For the complete documentation index, see llms.txt. Markdown versions of documentation pages are available by appending .md to the page URL.
Navegação principal
o4-mini
o4-mini
Modelo de raciocínio rápido e econômico, sucedido pelo GPT-5 Mini
Raciocínio
Velocidade
Preço
$1.1$4.4
Entrada
Saída

O o4-mini é nosso modelo de pequeno porte mais recente da série o. Ele é otimizado para um raciocínio rápido e eficaz, com desempenho excepcionalmente eficiente em tarefas de programação e tarefas visuais. Seu sucessor é o GPT-5 Mini.

Saiba mais sobre como usar nossos modelos de raciocínio no nosso guia de raciocínio.

Janela de contexto de 200,000
Máximo de 100,000 tokens de saída
Data de corte do conhecimento: Jun 01, 2024
Suporte a tokens de raciocínio
Preços
Os preços se baseiam no número de tokens usados ou em outras métricas, conforme o tipo de modelo. Para modelos específicos de ferramentas, como pesquisa e uso do computador, há uma cobrança por chamada de ferramenta. Veja os detalhes na página de preços.
Tokens de texto
Por 1M tokens
Preço da API Batch
Entrada
$1.10
Entrada em cache
$0.275
Saída
$4.40
Comparação rápida
Entrada
Entrada em cache
Saída
o3
$2.00
o4-mini
$1.10
o3-mini
$1.10
Modalidades
Texto
Entrada e saída
Imagem
Somente entrada
Áudio
Sem suporte
Vídeo
Sem suporte
Endpoints
Ao vivo
v1/live/sessions
Chat Completions
v1/chat/completions
Responses
v1/responses
Realtime
v1/realtime
Tradução em tempo real
v1/realtime/translations
Transcrição em tempo real
v1/realtime/transcription_sessions
Assistants
v1/assistants
Processamento em lote
v1/batch
Ajuste fino
v1/fine-tuning
Embeddings
v1/embeddings
Geração de imagens
v1/images/generations
Vídeos
v1/videos
Edição de imagem
v1/images/edits
Geração de fala
v1/audio/speech
Transcrição
v1/audio/transcriptions
Tradução
v1/audio/translations
Moderação
v1/moderations
Completions (legado)
v1/completions
Recursos
Streaming
Com suporte
Chamada de função
Com suporte
Saídas estruturadas
Com suporte
Ajuste fino
Com suporte
Saídas previstas
Sem suporte
Instantâneos
Os instantâneos permitem fixar uma versão específica do modelo para manter o desempenho e o comportamento consistentes. Abaixo está a lista de todos os instantâneos e nomes alternativos disponíveis para o4-mini.
o4-mini
o4-mini
o4-mini-2025-04-16
Obsoleto
o4-mini-2025-04-16
Limites de taxa
Os limites de taxa garantem acesso justo e confiável à API ao estabelecer limites específicos para solicitações, tokens, duração de áudio ou outras formas de uso em um determinado período. Seu nível de uso determina o valor desses limites e aumenta automaticamente à medida que você envia mais solicitações e gasta mais com a API.
NívelRPMTPMLimite da fila de processamento em lote
GratuitoSem suporte
Nível 11,000100,0001,000,000
Nível 22,0002,000,0002,000,000
Nível 35,0004,000,00040,000,000
Nível 410,00010,000,0001,000,000,000
Nível 530,000150,000,00015,000,000,000