For the complete documentation index, see llms.txt. Markdown versions of documentation pages are available by appending .md to the page URL.
Navigation principale
whisper-1
Whisper
Modèle généraliste de reconnaissance vocale
Performances
Vitesse
Prix
$0.006
Entrée
Sortie

Whisper est un modèle généraliste de reconnaissance vocale, entraîné sur un vaste jeu de données audio variées. Vous pouvez également l’utiliser comme modèle multitâche pour la reconnaissance vocale multilingue, la traduction de la parole et l’identification des langues.

Tarifs
La tarification repose sur le nombre de tokens utilisés ou sur d’autres mesures selon le type de modèle. Pour les modèles dédiés à des outils, comme la recherche et l’utilisation de l’ordinateur, chaque appel d’outil est facturé. Consultez les détails sur la page des tarifs.
Tarifs
Cas d’usage / 1M tokens
Transcription
Coût / minute
$0.006
Modalités
Texte
Sortie uniquement
Image
Non pris en charge
Audio
Entrée uniquement
Vidéo
Non pris en charge
Points de terminaison
En direct
v1/live/sessions
Chat Completions
v1/chat/completions
Responses
v1/responses
Realtime
v1/realtime
Traduction en temps réel
v1/realtime/translations
Transcription en temps réel
v1/realtime/transcription_sessions
Assistants
v1/assistants
Traitement par lots
v1/batch
Affinage
v1/fine-tuning
Plongements vectoriels
v1/embeddings
Génération d’images
v1/images/generations
Vidéos
v1/videos
Modification d’images
v1/images/edits
Génération de parole
v1/audio/speech
Transcription
v1/audio/transcriptions
Traduction
v1/audio/translations
Modération
v1/moderations
Completions (ancienne version)
v1/completions
Instantanés
Les instantanés vous permettent de fixer une version précise du modèle afin de maintenir des performances et un comportement constants. Vous trouverez ci-dessous la liste de tous les instantanés et alias disponibles pour Whisper.
whisper-1
whisper-1
whisper-1
whisper-1
Limites de débit
Les limites de débit garantissent un accès équitable et fiable à l’API en fixant des plafonds précis pour les requêtes, les tokens, la durée audio ou d’autres usages sur une période donnée. Votre niveau d’utilisation détermine ces plafonds et augmente automatiquement à mesure que vous envoyez davantage de requêtes et dépensez davantage pour l’API.
NiveauRPMRPD
Gratuit3200
Niveau 1500-
Niveau 22,500-
Niveau 35,000-
Niveau 47,500-
Niveau 510,000-