For the complete documentation index, see llms.txt. Markdown versions of documentation pages are available by appending .md to the page URL.
Navegación principal
gpt-4o-transcribe
GPT-4o Transcribe
Modelo de voz a texto basado en GPT-4o
Rendimiento
Velocidad
Precio
$2.5$10
Entrada
Salida

GPT-4o Transcribe es un modelo de voz a texto que usa GPT-4o para transcribir audio. Ofrece mejoras en la tasa de error de palabras, así como un mejor reconocimiento de idiomas y una mayor precisión, en comparación con los modelos Whisper originales. Úsalo para obtener transcripciones más precisas.

Ventana de contexto de 16,000
Máximo de 2,000 tokens de salida
Fecha límite de conocimiento: Jun 01, 2024
Precios
Los precios se basan en la cantidad de tokens utilizados o en otras métricas según el tipo de modelo. Para los modelos específicos de herramientas, como búsqueda y uso de la computadora, se cobra una tarifa por cada llamada a la herramienta. Consulta los detalles en la página de precios.
Tokens de audio
Por 1M tokens
Entrada
$2.50
Salida
$10.00
Comparación rápida
Entrada
Salida
GPT-4o Transcribe
$2.50
GPT-4o Mini Transcribe
$1.25
Modalidades
Texto
Entrada y salida
Imagen
No compatible
Audio
Solo entrada
Video
No compatible
Puntos de acceso
En vivo
v1/live/sessions
Chat Completions
v1/chat/completions
Responses
v1/responses
Realtime
v1/realtime
Traducción en tiempo real
v1/realtime/translations
Transcripción en tiempo real
v1/realtime/transcription_sessions
Assistants
v1/assistants
Procesamiento por lotes
v1/batch
Ajuste fino
v1/fine-tuning
Embeddings
v1/embeddings
Generación de imágenes
v1/images/generations
Videos
v1/videos
Edición de imágenes
v1/images/edits
Generación de voz
v1/audio/speech
Transcripción
v1/audio/transcriptions
Traducción
v1/audio/translations
Moderación
v1/moderations
Completions (heredado)
v1/completions
Instantáneas
Las instantáneas te permiten fijar una versión específica del modelo para que su rendimiento y comportamiento se mantengan constantes. A continuación se muestra una lista de todas las instantáneas y los alias disponibles para GPT-4o Transcribe.
gpt-4o-transcribe
gpt-4o-transcribe
gpt-4o-transcribe
gpt-4o-transcribe
Límites de solicitudes
Los límites de solicitudes garantizan un acceso equitativo y confiable a la API al establecer topes específicos para las solicitudes, los tokens, la duración del audio u otras medidas de uso dentro de un período determinado. Tu nivel de uso determina el valor de estos límites y aumenta automáticamente a medida que envías más solicitudes y gastas más en la API.
NivelRPMTPM
GratisNo compatible
Nivel 150010,000
Nivel 22,000100,000
Nivel 35,000400,000
Nivel 410,0002,000,000
Nivel 510,0006,000,000