For the complete documentation index, see llms.txt. Markdown versions of documentation pages are available by appending .md to the page URL.
Navegación principal
o3-pro
o3-pro
Versión de o3 con más recursos de cómputo para ofrecer mejores respuestas
Razonamiento
Velocidad
Precio
$20$80
Entrada
Salida

Los modelos de la serie o se entrenan con aprendizaje por refuerzo para pensar antes de responder y realizar razonamientos complejos. El modelo o3-pro utiliza más recursos de cómputo para pensar con mayor profundidad y ofrecer mejores respuestas de manera consistente.

o3-pro está disponible solo en la API Responses para permitir interacciones de varios turnos con el modelo antes de responder a las solicitudes de la API y admitir otras funciones avanzadas de la API en el futuro. Como o3-pro está diseñado para abordar problemas difíciles, algunas solicitudes pueden tardar varios minutos en completarse. Para evitar que se agote el tiempo de espera, prueba usar el modo en segundo plano.

Ventana de contexto de 200,000
Máximo de 100,000 tokens de salida
Fecha límite de conocimiento: Jun 01, 2024
Compatibilidad con tokens de razonamiento
Precios
Los precios se basan en la cantidad de tokens utilizados o en otras métricas según el tipo de modelo. Para los modelos específicos de herramientas, como búsqueda y uso de la computadora, se cobra una tarifa por cada llamada a la herramienta. Consulta los detalles en la página de precios.
Tokens de texto
Por 1M tokens
Precio de la API de procesamiento por lotes
Entrada
$20.00
Salida
$80.00
Comparación rápida
Entrada
Salida
o3-pro
$20.00
o3
$2.00
o3-mini
$1.10
Modalidades
Texto
Entrada y salida
Imagen
Solo entrada
Audio
No compatible
Video
No compatible
Puntos de acceso
En vivo
v1/live/sessions
Chat Completions
v1/chat/completions
Responses
v1/responses
Realtime
v1/realtime
Traducción en tiempo real
v1/realtime/translations
Transcripción en tiempo real
v1/realtime/transcription_sessions
Assistants
v1/assistants
Procesamiento por lotes
v1/batch
Ajuste fino
v1/fine-tuning
Embeddings
v1/embeddings
Generación de imágenes
v1/images/generations
Videos
v1/videos
Edición de imágenes
v1/images/edits
Generación de voz
v1/audio/speech
Transcripción
v1/audio/transcriptions
Traducción
v1/audio/translations
Moderación
v1/moderations
Completions (heredado)
v1/completions
Funciones
Transmisión continua
No compatible
Llamada a funciones
Compatible
Resultados estructurados
Compatible
Ajuste fino
No compatible
Resultados predichos
No compatible
Instantáneas
Las instantáneas te permiten fijar una versión específica del modelo para que su rendimiento y comportamiento se mantengan constantes. A continuación se muestra una lista de todas las instantáneas y los alias disponibles para o3-pro.
o3-pro
o3-pro
o3-pro-2025-06-10
o3-pro-2025-06-10
En desuso
Límites de solicitudes
Los límites de solicitudes garantizan un acceso equitativo y confiable a la API al establecer topes específicos para las solicitudes, los tokens, la duración del audio u otras medidas de uso dentro de un período determinado. Tu nivel de uso determina el valor de estos límites y aumenta automáticamente a medida que envías más solicitudes y gastas más en la API.
NivelRPMTPMLímite de la cola de procesamiento por lotes
GratisNo compatible
Nivel 150030,00090,000
Nivel 25,000450,0001,350,000
Nivel 35,000800,00050,000,000
Nivel 410,0002,000,000200,000,000
Nivel 510,00030,000,0005,000,000,000