For the complete documentation index, see llms.txt. Markdown versions of documentation pages are available by appending .md to the page URL.
主要導覽
o4-mini
o4-mini
速度快、成本效益高的推理模型,後繼模型為 GPT-5 Mini
推理
速度
價格
$1.1$4.4
輸入
輸出

o4-mini 是我們最新的小型 o 系列模型。此模型經過最佳化,可進行快速、 有效的推理,並在程式碼編寫和 視覺任務中展現極高的效率。其後繼模型為 GPT-5 Mini

請參閱我們的 推理指南,進一步瞭解如何使用我們的推理模型。

200,000 上下文視窗
最多輸出 100,000 個 Token
知識截止日期:Jun 01, 2024
推理 Token 支援
定價
費用依使用的 Token 數量計算,或依模型類型採用其他計費指標。搜尋和電腦等工具專用模型,則按每次工具呼叫收費。詳情請參閱 定價頁面
文字 Token
每 1M 個 Token
Batch API 價格
輸入
$1.10
已快取的輸入
$0.275
輸出
$4.40
快速比較
輸入
已快取的輸入
輸出
o3
$2.00
o4-mini
$1.10
o3-mini
$1.10
模態
文字
輸入與輸出
圖像
僅限輸入
音訊
不支援
影片
不支援
端點
即時
v1/live/sessions
Chat Completions
v1/chat/completions
Responses
v1/responses
Realtime
v1/realtime
即時翻譯
v1/realtime/translations
即時轉錄
v1/realtime/transcription_sessions
Assistants
v1/assistants
批次處理
v1/batch
微調
v1/fine-tuning
嵌入向量
v1/embeddings
圖像生成
v1/images/generations
影片
v1/videos
圖像編輯
v1/images/edits
語音生成
v1/audio/speech
轉錄
v1/audio/transcriptions
翻譯
v1/audio/translations
內容審核
v1/moderations
Completions(舊版)
v1/completions
功能
串流
支援
函式呼叫
支援
結構化輸出
支援
微調
支援
預測輸出
不支援
快照
快照可讓你固定使用特定版本的模型,確保效能與行為保持一致。以下列出 o4-mini 所有可用的快照與別名。
o4-mini
o4-mini
o4-mini-2025-04-16
已棄用
o4-mini-2025-04-16
速率限制
速率限制會對特定時間內的請求數、Token 數、音訊時長或其他用量設定明確上限,確保 API 存取公平且可靠。這些上限取決於你的使用量層級;隨著你傳送的請求與 API 支出增加,使用量層級也會自動提升。
層級RPMTPM批次處理佇列上限
免費不支援
層級 11,000100,0001,000,000
層級 22,0002,000,0002,000,000
層級 35,0004,000,00040,000,000
層級 410,00010,000,0001,000,000,000
層級 530,000150,000,00015,000,000,000