o3-pro
默认
使用更多计算资源以提供更优回答的 o3 版本
使用更多计算资源以提供更优回答的 o3 版本
推理
最高
速度
最慢
价格
$20•$80
输入•输出
输入
文本, 图像
输出
文本
o 系列模型通过强化学习训练,能够在回答前进行思考,并执行复杂推理。o3-pro 模型使用更多计算资源来深入思考,持续提供更优质的回答。
o3-pro 仅通过 Responses API 提供, 以支持在响应 API 请求前与模型进行多轮交互, 并在未来支持其他高级 API 功能。由于 o3-pro 专为解决复杂问题而设计, 某些请求可能需要几分钟才能完成。 为避免超时,请尝试使用后台模式。
200,000 上下文窗口
最多输出 100,000 个 Token
知识截止日期:Jun 01, 2024
推理 Token 支持
定价
费用根据使用的 Token 数量计算,也可能根据模型类型采用其他计量方式。对于搜索和计算机使用等专用工具模型,每次工具调用均收取费用。详情请参阅定价页面。
文本 Token
每 1M 个 Token
∙
Batch API 价格
输入
$20.00
输出
$80.00
快速比较
输入
输出
o3-pro
$20.00
o3
$2.00
o3-mini
$1.10
模态
文本
输入和输出
图像
仅输入
音频
不支持
视频
不支持
端点
实时
v1/live/sessions
Chat Completions
v1/chat/completions
Responses
v1/responses
Realtime
v1/realtime
实时翻译
v1/realtime/translations
实时转录
v1/realtime/transcription_sessions
Assistants
v1/assistants
批处理
v1/batch
微调
v1/fine-tuning
嵌入向量
v1/embeddings
图像生成
v1/images/generations
视频
v1/videos
图像编辑
v1/images/edits
语音生成
v1/audio/speech
转录
v1/audio/transcriptions
翻译
v1/audio/translations
内容审核
v1/moderations
Completions(旧版)
v1/completions
功能
流式传输
不支持
函数调用
支持
结构化输出
支持
微调
不支持
预测输出
不支持
快照
快照可让您锁定模型的特定版本,使其性能和行为保持一致。以下列出了 o3-pro 的所有可用快照和别名。
o3-pro
o3-pro-2025-06-10
o3-pro-2025-06-10
已弃用
速率限制
速率限制通过对特定时间段内的请求数、Token 数、音频时长或其他用量设置具体上限,确保 API 访问的公平性和可靠性。您的用量层级决定了这些上限的高低,并会随着请求数量和 API 支出的增加而自动提升。
| 层级 | RPM | TPM | 批处理队列上限 |
|---|---|---|---|
| 免费 | 不支持 | ||
| 层级 1 | 500 | 30,000 | 90,000 |
| 层级 2 | 5,000 | 450,000 | 1,350,000 |
| 层级 3 | 5,000 | 800,000 | 50,000,000 |
| 层级 4 | 10,000 | 2,000,000 | 200,000,000 |
| 层级 5 | 10,000 | 30,000,000 | 5,000,000,000 |