For the complete documentation index, see llms.txt. Markdown versions of documentation pages are available by appending .md to the page URL.
主导航
gpt-5.4-nano
GPT-5.4 nano
我们价格最低的 GPT-5.4 级别模型,适用于简单的大批量任务
推理
速度
价格
$0.2$1.25
输入
输出

GPT-5.4 nano 专为最看重速度和成本的任务而设计,例如 分类、数据提取、排序和子智能体任务。请参阅我们的 模型指南页面,了解更多信息。Reasoning.effort 支持:none(默认)、low、medium、high 和 xhigh。

400,000 上下文窗口
最多输出 128,000 个 Token
知识截止日期:Aug 31, 2025
推理 Token 支持
定价
费用根据使用的 Token 数量计算,也可能根据模型类型采用其他计量方式。对于搜索和计算机使用等专用工具模型,每次工具调用均收取费用。详情请参阅定价页面
文本 Token
每 1M 个 Token
Batch API 价格
输入
$0.20
缓存输入
$0.02
输出
$1.25
快速比较
输入
缓存输入
输出
GPT-5.4 Mini
$0.75
GPT-5.4 nano
$0.20
GPT-5 nano
$0.05

GPT-5.4 nano 的区域处理(数据驻留)端点加收 10% 的费用。

模态
文本
输入和输出
图像
仅输入
音频
不支持
视频
不支持
端点
实时
v1/live/sessions
Chat Completions
v1/chat/completions
Responses
v1/responses
Realtime
v1/realtime
实时翻译
v1/realtime/translations
实时转录
v1/realtime/transcription_sessions
Assistants
v1/assistants
批处理
v1/batch
微调
v1/fine-tuning
嵌入向量
v1/embeddings
图像生成
v1/images/generations
视频
v1/videos
图像编辑
v1/images/edits
语音生成
v1/audio/speech
转录
v1/audio/transcriptions
翻译
v1/audio/translations
内容审核
v1/moderations
Completions(旧版)
v1/completions
功能
流式传输
支持
函数调用
支持
结构化输出
支持
微调
不支持
工具
使用 Responses API 时,此模型支持的工具。
网页搜索
支持
文件搜索
支持
图像生成
支持
代码解释器
支持
托管式 Shell
支持
应用补丁
支持
技能
支持
计算机使用
不支持
MCP
支持
工具搜索
不支持
快照
快照可让您锁定模型的特定版本,使其性能和行为保持一致。以下列出了 GPT-5.4 nano 的所有可用快照和别名。
gpt-5.4-nano
gpt-5.4-nano
gpt-5.4-nano-2026-03-17
gpt-5.4-nano-2026-03-17
速率限制
速率限制通过对特定时间段内的请求数、Token 数、音频时长或其他用量设置具体上限,确保 API 访问的公平性和可靠性。您的用量层级决定了这些上限的高低,并会随着请求数量和 API 支出的增加而自动提升。
层级RPMTPM批处理队列上限
免费不支持
层级 1500200,0002,000,000
层级 25,0002,000,00020,000,000
层级 35,0004,000,00040,000,000
层级 410,00010,000,0001,000,000,000
层级 530,000180,000,00015,000,000,000