codex-mini-latest
Padrão
Modelo de raciocínio rápido otimizado para o Codex CLI
Modelo de raciocínio rápido otimizado para o Codex CLI
Desempenho
Mais alto
Velocidade
Médio
Preço
$1.5•$6
Entrada•Saída
Entrada
Texto, Imagem
Saída
Texto
codex-mini-latest é uma versão do o4-mini com ajuste fino especificamente para uso no Codex CLI. Para uso direto na API, recomendamos começar com gpt-4.1.
Janela de contexto de 200,000
Máximo de 100,000 tokens de saída
Data de corte do conhecimento: Jun 01, 2024
Suporte a tokens de raciocínio
Preços
Os preços se baseiam no número de tokens usados ou em outras métricas, conforme o tipo de modelo. Para modelos específicos de ferramentas, como pesquisa e uso do computador, há uma cobrança por chamada de ferramenta. Veja os detalhes na página de preços.
Tokens de texto
Por 1M tokens
Entrada
$1.50
Entrada em cache
$0.375
Saída
$6.00
Comparação rápida
Entrada
Entrada em cache
Saída
GPT-4.1
$2.00
codex-mini-latest
$1.50
o4-mini
$1.10
Modalidades
Texto
Entrada e saída
Imagem
Somente entrada
Áudio
Sem suporte
Vídeo
Sem suporte
Endpoints
Ao vivo
v1/live/sessions
Chat Completions
v1/chat/completions
Responses
v1/responses
Realtime
v1/realtime
Tradução em tempo real
v1/realtime/translations
Transcrição em tempo real
v1/realtime/transcription_sessions
Assistants
v1/assistants
Processamento em lote
v1/batch
Ajuste fino
v1/fine-tuning
Embeddings
v1/embeddings
Geração de imagens
v1/images/generations
Vídeos
v1/videos
Edição de imagem
v1/images/edits
Geração de fala
v1/audio/speech
Transcrição
v1/audio/transcriptions
Tradução
v1/audio/translations
Moderação
v1/moderations
Completions (legado)
v1/completions
Recursos
Streaming
Com suporte
Chamada de função
Com suporte
Saídas estruturadas
Com suporte
Ajuste fino
Sem suporte
Saídas previstas
Sem suporte
Instantâneos
Os instantâneos permitem fixar uma versão específica do modelo para manter o desempenho e o comportamento consistentes. Abaixo está a lista de todos os instantâneos e nomes alternativos disponíveis para codex-mini-latest.
codex-mini-latest
codex-mini-latest
Obsoleto
codex-mini-latest
Limites de taxa
Os limites de taxa garantem acesso justo e confiável à API ao estabelecer limites específicos para solicitações, tokens, duração de áudio ou outras formas de uso em um determinado período. Seu nível de uso determina o valor desses limites e aumenta automaticamente à medida que você envia mais solicitações e gasta mais com a API.
| Nível | RPM | TPM | Limite da fila de processamento em lote |
|---|---|---|---|
| Gratuito | Sem suporte | ||
| Nível 1 | 1,000 | 100,000 | 1,000,000 |
| Nível 2 | 2,000 | 200,000 | 2,000,000 |
| Nível 3 | 5,000 | 4,000,000 | 40,000,000 |
| Nível 4 | 10,000 | 10,000,000 | 1,000,000,000 |
| Nível 5 | 30,000 | 150,000,000 | 15,000,000,000 |