o3-mini
Predeterminado
Un modelo pequeño como alternativa a o3
Un modelo pequeño como alternativa a o3
Razonamiento
Más alta
Velocidad
Media
Precio
$1.1•$4.4
Entrada•Salida
Entrada
Texto
Salida
Texto
Ejemplo de prompt
Landing Page Generation
Ejemplo de prompt
Analyze Return Policy
Ejemplo de prompt
Text to SQL
Ejemplo de prompt
Graph Entity Extraction
o3-mini es nuestro modelo de razonamiento pequeño más reciente y ofrece un alto nivel de inteligencia con los mismos objetivos de costo y latencia que o1-mini. o3-mini admite funciones clave para desarrolladores, como resultados estructurados, llamada a funciones y la API de procesamiento por lotes.
Ventana de contexto de 200,000
Máximo de 100,000 tokens de salida
Fecha límite de conocimiento: Oct 01, 2023
Compatibilidad con tokens de razonamiento
Precios
Los precios se basan en la cantidad de tokens utilizados o en otras métricas según el tipo de modelo. Para los modelos específicos de herramientas, como búsqueda y uso de la computadora, se cobra una tarifa por cada llamada a la herramienta. Consulta los detalles en la página de precios.
Tokens de texto
Por 1M tokens
∙
Precio de la API de procesamiento por lotes
Entrada
$1.10
Entrada en caché
$0.55
Salida
$4.40
Comparación rápida
Entrada
Entrada en caché
Salida
o3-mini
$1.10
o1-mini
$1.10
GPT-4o Mini
$0.15
Modalidades
Texto
Entrada y salida
Imagen
No compatible
Audio
No compatible
Video
No compatible
Puntos de acceso
En vivo
v1/live/sessions
Chat Completions
v1/chat/completions
Responses
v1/responses
Realtime
v1/realtime
Traducción en tiempo real
v1/realtime/translations
Transcripción en tiempo real
v1/realtime/transcription_sessions
Assistants
v1/assistants
Procesamiento por lotes
v1/batch
Ajuste fino
v1/fine-tuning
Embeddings
v1/embeddings
Generación de imágenes
v1/images/generations
Videos
v1/videos
Edición de imágenes
v1/images/edits
Generación de voz
v1/audio/speech
Transcripción
v1/audio/transcriptions
Traducción
v1/audio/translations
Moderación
v1/moderations
Completions (heredado)
v1/completions
Funciones
Transmisión continua
Compatible
Llamada a funciones
Compatible
Resultados estructurados
Compatible
Ajuste fino
No compatible
Resultados predichos
No compatible
Instantáneas
Las instantáneas te permiten fijar una versión específica del modelo para que su rendimiento y comportamiento se mantengan constantes. A continuación se muestra una lista de todas las instantáneas y los alias disponibles para o3-mini.
o3-mini
o3-mini-2025-01-31
En desuso
o3-mini-2025-01-31
Límites de solicitudes
Los límites de solicitudes garantizan un acceso equitativo y confiable a la API al establecer topes específicos para las solicitudes, los tokens, la duración del audio u otras medidas de uso dentro de un período determinado. Tu nivel de uso determina el valor de estos límites y aumenta automáticamente a medida que envías más solicitudes y gastas más en la API.
| Nivel | RPM | TPM | Límite de la cola de procesamiento por lotes |
|---|---|---|---|
| Gratis | No compatible | ||
| Nivel 1 | 1,000 | 100,000 | 1,000,000 |
| Nivel 2 | 2,000 | 200,000 | 2,000,000 |
| Nivel 3 | 5,000 | 4,000,000 | 40,000,000 |
| Nivel 4 | 10,000 | 10,000,000 | 1,000,000,000 |
| Nivel 5 | 30,000 | 150,000,000 | 15,000,000,000 |