For the complete documentation index, see llms.txt. Markdown versions of documentation pages are available by appending .md to the page URL.
主导航
gpt-5-nano
GPT-5 nano
速度最快、成本效益最高的 GPT-5 版本
推理
速度
价格
$0.05$0.4
输入
输出

GPT-5 Nano 是我们速度最快、价格最低的 GPT-5 版本,非常适合 摘要生成和分类任务。对于大多数对速度和 成本敏感的新工作负载,我们建议您先使用 GPT-5.6 Luna。如需了解更多信息,请参阅我们的 模型指南页面。

400,000 上下文窗口
最多输出 128,000 个 Token
知识截止日期:May 31, 2024
推理 Token 支持
定价
费用根据使用的 Token 数量计算,也可能根据模型类型采用其他计量方式。对于搜索和计算机使用等专用工具模型,每次工具调用均收取费用。详情请参阅定价页面
文本 Token
每 1M 个 Token
Batch API 价格
输入
$0.05
缓存输入
$0.005
输出
$0.40
快速比较
输入
缓存输入
输出
GPT-5.4 Mini
$0.75
GPT-5.4 nano
$0.20
GPT-5 nano
$0.05
模态
文本
输入和输出
图像
仅输入
音频
不支持
视频
不支持
端点
实时
v1/live/sessions
Chat Completions
v1/chat/completions
Responses
v1/responses
Realtime
v1/realtime
实时翻译
v1/realtime/translations
实时转录
v1/realtime/transcription_sessions
Assistants
v1/assistants
批处理
v1/batch
微调
v1/fine-tuning
嵌入向量
v1/embeddings
图像生成
v1/images/generations
视频
v1/videos
图像编辑
v1/images/edits
语音生成
v1/audio/speech
转录
v1/audio/transcriptions
翻译
v1/audio/translations
内容审核
v1/moderations
Completions(旧版)
v1/completions
功能
流式传输
支持
函数调用
支持
结构化输出
支持
微调
不支持
预测输出
不支持
快照
快照可让您锁定模型的特定版本,使其性能和行为保持一致。以下列出了 GPT-5 nano 的所有可用快照和别名。
gpt-5-nano
gpt-5-nano
gpt-5-nano-2025-08-07
gpt-5-nano-2025-08-07
已弃用
速率限制
速率限制通过对特定时间段内的请求数、Token 数、音频时长或其他用量设置具体上限,确保 API 访问的公平性和可靠性。您的用量层级决定了这些上限的高低,并会随着请求数量和 API 支出的增加而自动提升。
层级RPMTPM批处理队列上限
免费不支持
层级 1500200,0002,000,000
层级 25,0002,000,00020,000,000
层级 35,0004,000,00040,000,000
层级 410,00010,000,0001,000,000,000
层级 530,000180,000,00015,000,000,000