GPT-4o Mini
Par défaut
Petit modèle rapide et abordable pour des tâches ciblées
Petit modèle rapide et abordable pour des tâches ciblées
Intelligence
Moyen
Vitesse
Rapide
Prix
$0.15•$0.6
Entrée•Sortie
Entrée
Texte, Image
Sortie
Texte
Exemple de prompt
Intent Classification
Exemple de prompt
Extract search keywords
Exemple de prompt
Translate text
Exemple de prompt
Generate tags
GPT-4o Mini (« o » pour « omni ») est un petit modèle rapide et abordable pour des tâches ciblées. Il accepte du texte et des images en entrée et produit des sorties textuelles (y compris des sorties structurées). Il est idéal pour l’affinage. Les sorties d’un modèle plus grand comme GPT-4o peuvent être distillées dans GPT-4o-Mini pour obtenir des résultats similaires avec un coût et une latence réduits.
Fenêtre de contexte de 128,000
16,384 tokens de sortie au maximum
Date limite des connaissances : Oct 01, 2023
Tarifs
La tarification repose sur le nombre de tokens utilisés ou sur d’autres mesures selon le type de modèle. Pour les modèles dédiés à des outils, comme la recherche et l’utilisation de l’ordinateur, chaque appel d’outil est facturé. Consultez les détails sur la page des tarifs.
Tokens de texte
Par 1M tokens
∙
Prix de l’API Batch
Entrée
$0.15
Entrée en cache
$0.075
Sortie
$0.60
Comparaison rapide
Entrée
Entrée en cache
Sortie
GPT-4o
$2.50
o3-mini
$1.10
GPT-4o Mini
$0.15
Modalités
Texte
Entrée et sortie
Image
Entrée uniquement
Audio
Non pris en charge
Vidéo
Non pris en charge
Points de terminaison
En direct
v1/live/sessions
Chat Completions
v1/chat/completions
Responses
v1/responses
Realtime
v1/realtime
Traduction en temps réel
v1/realtime/translations
Transcription en temps réel
v1/realtime/transcription_sessions
Assistants
v1/assistants
Traitement par lots
v1/batch
Affinage
v1/fine-tuning
Plongements vectoriels
v1/embeddings
Génération d’images
v1/images/generations
Vidéos
v1/videos
Modification d’images
v1/images/edits
Génération de parole
v1/audio/speech
Transcription
v1/audio/transcriptions
Traduction
v1/audio/translations
Modération
v1/moderations
Completions (ancienne version)
v1/completions
Fonctionnalités
Diffusion en continu
Pris en charge
Appel de fonction
Pris en charge
Sorties structurées
Pris en charge
Affinage
Pris en charge
Sorties prédites
Pris en charge
Instantanés
Les instantanés vous permettent de fixer une version précise du modèle afin de maintenir des performances et un comportement constants. Vous trouverez ci-dessous la liste de tous les instantanés et alias disponibles pour GPT-4o Mini.
gpt-4o-mini
gpt-4o-mini-2024-07-18
gpt-4o-mini-2024-07-18
Limites de débit
Les limites de débit garantissent un accès équitable et fiable à l’API en fixant des plafonds précis pour les requêtes, les tokens, la durée audio ou d’autres usages sur une période donnée. Votre niveau d’utilisation détermine ces plafonds et augmente automatiquement à mesure que vous envoyez davantage de requêtes et dépensez davantage pour l’API.
| Niveau | RPM | RPD | TPM | Limite de la file d’attente du traitement par lots |
|---|---|---|---|---|
| Gratuit | Non pris en charge | |||
| Niveau 1 | 500 | 10,000 | 200,000 | 2,000,000 |
| Niveau 2 | 5,000 | - | 2,000,000 | 20,000,000 |
| Niveau 3 | 5,000 | - | 4,000,000 | 40,000,000 |
| Niveau 4 | 10,000 | - | 10,000,000 | 1,000,000,000 |
| Niveau 5 | 30,000 | - | 150,000,000 | 15,000,000,000 |