For the complete documentation index, see llms.txt. Markdown versions of documentation pages are available by appending .md to the page URL.
主导航
chat-latest
Chat Latest
ChatGPT 使用的最新即时模型
智能
速度
价格
$5$30
输入
输出

chat-latest 指向 ChatGPT 当前使用的最新即时模型。 我们建议在生产环境中通过 API 使用 GPT-6 Astra。有关详情,请参阅模型指南页面。底层模型快照将定期更新。

400,000 上下文窗口
最多输出 128,000 个 Token
知识截止日期:Aug 31, 2025
定价
费用根据使用的 Token 数量计算,也可能根据模型类型采用其他计量方式。对于搜索和计算机使用等专用工具模型,每次工具调用均收取费用。详情请参阅定价页面
文本 Token
每 1M 个 Token
Batch API 价格
输入
$5.00
缓存输入
$0.50
输出
$30.00
模态
文本
输入和输出
图像
仅输入
音频
不支持
视频
不支持
端点
实时
v1/live/sessions
Chat Completions
v1/chat/completions
Responses
v1/responses
Realtime
v1/realtime
实时翻译
v1/realtime/translations
实时转录
v1/realtime/transcription_sessions
Assistants
v1/assistants
批处理
v1/batch
微调
v1/fine-tuning
嵌入向量
v1/embeddings
图像生成
v1/images/generations
视频
v1/videos
图像编辑
v1/images/edits
语音生成
v1/audio/speech
转录
v1/audio/transcriptions
翻译
v1/audio/translations
内容审核
v1/moderations
Completions(旧版)
v1/completions
功能
流式传输
支持
函数调用
支持
结构化输出
支持
微调
不支持
预测输出
不支持
工具
使用 Responses API 时,此模型支持的工具。
网页搜索
支持
文件搜索
支持
图像生成
支持
代码解释器
支持
托管式 Shell
不支持
应用补丁
不支持
技能
不支持
计算机使用
不支持
MCP
支持
工具搜索
不支持
快照
快照可让您锁定模型的特定版本,使其性能和行为保持一致。以下列出了 Chat Latest 的所有可用快照和别名。
chat-latest
chat-latest
chat-latest
chat-latest
速率限制
速率限制通过对特定时间段内的请求数、Token 数、音频时长或其他用量设置具体上限,确保 API 访问的公平性和可靠性。您的用量层级决定了这些上限的高低,并会随着请求数量和 API 支出的增加而自动提升。
层级RPMTPM批处理队列上限
免费不支持
层级 150030,00050,000
层级 25,000450,0001,350,000
层级 35,000800,000100,000,000
层级 410,0002,000,000200,000,000
层级 515,00040,000,00015,000,000,000