For the complete documentation index, see llms.txt. Markdown versions of documentation pages are available by appending .md to the page URL.
主导航
gpt-5.4-pro
GPT-5.4 Pro
能够生成更智能、更精准回答的 GPT-5.4 版本。
推理
速度
价格
$30$180
输入
输出

GPT-5.4 Pro 使用更多算力进行更深入的思考,持续提供更优质的回答。

GPT-5.4 Pro 仅通过 Responses API 提供,以支持模型在响应 API 请求前进行多轮交互,并在未来支持其他高级 API 功能。GPT-5.4 Pro 专为解决复杂问题而设计,因此某些请求可能需要几分钟才能完成。为避免超时,请尝试使用后台模式。Reasoning.effort 支持以下值:medium(默认)、high 和 xhigh。

1,050,000 上下文窗口
最多输出 128,000 个 Token
知识截止日期:Aug 31, 2025
推理 Token 支持
定价
费用根据使用的 Token 数量计算,也可能根据模型类型采用其他计量方式。对于搜索和计算机使用等专用工具模型,每次工具调用均收取费用。详情请参阅定价页面
文本 Token
每 1M 个 Token
Batch API 价格
输入
$30.00
输出
$180.00
快速比较
输入
输出
GPT-5.4 Pro
$30.00
o3-pro
$20.00
GPT-5.4
$2.50

对于上下文窗口为 1.05M 的模型(GPT-5.4 和 GPT-5.4 Pro),如果提示的输入 Token 数超过 272K,整个会话的输入和输出费用将分别按常规价格的 2 倍和 1.5 倍计收,适用于标准、批处理和 flex 模式。

通过区域处理(数据驻留)端点使用 GPT-5.4 和 GPT-5.4 Pro 时,需额外支付 10% 的费用。

模态
文本
输入和输出
图像
仅输入
音频
不支持
视频
不支持
端点
实时
v1/live/sessions
Chat Completions
v1/chat/completions
Responses
v1/responses
Realtime
v1/realtime
实时翻译
v1/realtime/translations
实时转录
v1/realtime/transcription_sessions
Assistants
v1/assistants
批处理
v1/batch
微调
v1/fine-tuning
嵌入向量
v1/embeddings
图像生成
v1/images/generations
视频
v1/videos
图像编辑
v1/images/edits
语音生成
v1/audio/speech
转录
v1/audio/transcriptions
翻译
v1/audio/translations
内容审核
v1/moderations
Completions(旧版)
v1/completions
功能
流式传输
支持
函数调用
支持
结构化输出
不支持
微调
不支持
工具
使用 Responses API 时,此模型支持的工具。
网页搜索
支持
文件搜索
支持
图像生成
支持
代码解释器
不支持
托管式 Shell
不支持
应用补丁
支持
技能
不支持
计算机使用
支持
MCP
支持
工具搜索
支持
快照
快照可让您锁定模型的特定版本,使其性能和行为保持一致。以下列出了 GPT-5.4 Pro 的所有可用快照和别名。
gpt-5.4-pro
gpt-5.4-pro
gpt-5.4-pro-2026-03-05
gpt-5.4-pro-2026-03-05
速率限制
速率限制通过对特定时间段内的请求数、Token 数、音频时长或其他用量设置具体上限,确保 API 访问的公平性和可靠性。您的用量层级决定了这些上限的高低,并会随着请求数量和 API 支出的增加而自动提升。
层级RPMTPM批处理队列上限
免费不支持
层级 15050,000900,000
层级 2500100,0001,350,000
层级 3500200,000100,000,000
层级 41,000400,000200,000,000
层级 51,5004,000,00015,000,000,000