For the complete documentation index, see llms.txt. Markdown versions of documentation pages are available by appending .md to the page URL.
Navegación principal
gpt-realtime-whisper
GPT-Realtime-Whisper
Modelo de voz a texto en streaming para transcripción en tiempo real
Rendimiento
Velocidad
Precio
$0.017
Entrada
Salida

GPT-Realtime-Whisper es un modelo de voz a texto en streaming para aplicaciones que necesitan actualizaciones incrementales de la transcripción con baja latencia a partir de audio en vivo. Está diseñado para casos de uso en tiempo real en los que los desarrolladores necesitan ajustar la latencia y la precisión. El precio de GPT-Realtime-Whisper se calcula según la duración del audio en lugar de los tokens de texto.

Ventana de contexto de 16,000
Máximo de 2,000 tokens de salida
Fecha límite de conocimiento: Sep 30, 2024
Precios
Los precios se basan en la cantidad de tokens utilizados o en otras métricas según el tipo de modelo. Para los modelos específicos de herramientas, como búsqueda y uso de la computadora, se cobra una tarifa por cada llamada a la herramienta. Consulta los detalles en la página de precios.
Duración del audio en tiempo real
Por minuto
Precio
$0.017

El precio de GPT-Realtime-Whisper se calcula según la duración del audio en lugar de los tokens de texto.

Modalidades
Texto
Entrada y salida
Imagen
No compatible
Audio
Solo entrada
Video
No compatible
Puntos de acceso
En vivo
v1/live/sessions
Chat Completions
v1/chat/completions
Responses
v1/responses
Realtime
v1/realtime
Traducción en tiempo real
v1/realtime/translations
Transcripción en tiempo real
v1/realtime/transcription_sessions
Assistants
v1/assistants
Procesamiento por lotes
v1/batch
Ajuste fino
v1/fine-tuning
Embeddings
v1/embeddings
Generación de imágenes
v1/images/generations
Videos
v1/videos
Edición de imágenes
v1/images/edits
Generación de voz
v1/audio/speech
Transcripción
v1/audio/transcriptions
Traducción
v1/audio/translations
Moderación
v1/moderations
Completions (heredado)
v1/completions
Funciones
Transmisión continua
Compatible
Llamada a funciones
No compatible
Resultados estructurados
No compatible
Ajuste fino
No compatible
Resultados predichos
No compatible
Instantáneas
Las instantáneas te permiten fijar una versión específica del modelo para que su rendimiento y comportamiento se mantengan constantes. A continuación se muestra una lista de todas las instantáneas y los alias disponibles para GPT-Realtime-Whisper.
gpt-realtime-whisper
gpt-realtime-whisper
gpt-realtime-whisper
gpt-realtime-whisper
Límites de solicitudes
Los límites de solicitudes garantizan un acceso equitativo y confiable a la API al establecer topes específicos para las solicitudes, los tokens, la duración del audio u otras medidas de uso dentro de un período determinado. Tu nivel de uso determina el valor de estos límites y aumenta automáticamente a medida que envías más solicitudes y gastas más en la API.
NivelMinutos de audio por minuto
GratisNo compatible
Nivel 1100
Nivel 2350
Nivel 3650
Nivel 41,000
Nivel 51,300