更新日誌
2026年9月
新增治理控制功能,可在組織與專案層級管理 API 金鑰的建立。管理員可以僅允許建立服務帳戶金鑰、僅允許建立使用者擁有的專案金鑰,或禁止建立任何新的 API 金鑰。組織層級的限制優先於專案設定,現有的 API 金鑰則不受影響。詳情請參閱正式環境最佳實務。
現在建立專案 API 金鑰時,即可設定到期日。管理員也可以在平台設定中,於組織或專案層級強制設定金鑰的最長有效期限,要求新建立的金鑰在設定的期限內到期。如需金鑰到期與輪替的相關指引,請參閱正式環境最佳實務。
推出 Agents API 公開測試版。使用託管的 Codex 任務執行框架建置智慧體,由 OpenAI 負責工作階段編排、上下文壓縮與復原。
使用持久性工作階段,跨對話回合持續執行工作、串流傳送進度,並連接自己的工具與 MCP 伺服器。在 OpenAI 託管的沙盒中執行智慧體,或連接自有基礎架構或支援的供應商所提供的沙盒。
請從 Agents API 快速入門開始。
GPT-Live 1 現已在 API 正式推出。您可以打造全雙工語音對話,讓對話在後端模型或智慧體處理推理與工具操作時持續進行。
使用 Responses 委派搭配 OpenAI 模型,或使用用戶端委派連接自己的後端。語音工作階段費率為每分鐘 $0.05,按秒計費;後端模型與工具用量另行收費。
提示詞快取診斷現已在 Responses API 正式推出,適用於 GPT-5.6 及後續支援的模型。
與先前回應的快取重用情況進行比較,找出快取未命中的原因,並依照疑難排解指引改善快取重用情況。
推出 GPT Image 2.5 Sunburst 和 GPT Image 2.5 Flare,可透過 Image API 和 Responses API 的圖像生成工具生成及編輯圖像。
對於最重視編輯精準度的工作流程,請使用 Sunburst;若要快速生成高品質的日常圖像,則可使用 Flare。這兩款模型都支援新的 xhigh 和 max 品質設定,並採用 GPT Image 2 的 Token 費率。請參閱圖像生成指南與定價。
推出 GPT-6 Astra,這是我們能力最強的模型,專為最艱鉅的端到端工作打造。
使用 GPT-6 Astra 進行推理、程式碼編寫、電腦操作、研究及文件建立。它結合這些能力,運用你提供的上下文與工具,從最初的請求一路執行複雜任務,直到產出完整成果。
遷移時需留意的主要變更:
- GPT-6 Astra 不支援
none推理強度。 - GPT-6 Astra 不支援自訂
temperature或top_p值,也不支援對數機率(logprobs)。 - 工具呼叫需要使用 Responses API。如果你目前透過 Chat Completions 使用工具,請依照 Responses 遷移指南進行遷移。
- 在支援的 Responses API 請求中,失準監控會在智慧體執行工作時,以非同步方式檢查潛在問題。檢查結果可能觸發安全警示,或停止對話以供審查。
請先閱讀使用 GPT-6 Astra,了解模型能力、提示詞與遷移指引。探索電腦功能,了解瀏覽器與桌面工作流程,並參閱定價,了解可用的推論層級。
Responses API 新增控制功能,支援使用 GPT-6 Astra 執行長時間工作:
- 非同步工具呼叫:讓模型在應用程式執行函式或自訂工具時繼續工作,並在各項結果就緒後回傳。
- 回合中調整方向:在回應仍在進行時,透過 WebSockets 傳送額外指示,讓模型納入修正或變更後的需求。
- 在對話中途變更推理強度:針對困難工作提高推理強度,或針對例行後續工作降低推理強度,同時保留已快取的提示詞前綴。
現在可以使用 IPv6 連線至 api.openai.com。
2026年8月
雙向 TLS(mTLS)與 X.509 工作負載身分聯合現已在 OpenAI API 正式推出。你可以直接在平台主控台設定憑證和 X.509 身分提供者,並透過組織的角色與權限控制存取。
宣布 whisper-1、gpt-4o-transcribe、gpt-4o-mini-transcribe 和 gpt-4o-transcribe-diarize 已棄用。這些模型將於 2027 年 2 月 26 日停止服務。請遷移至 gpt-live-transcribe 或 gpt-transcribe。請參閱轉錄指南與已棄用項目頁面。
Assistants API 已於 2026 年 8 月 26 日停止服務。請依照遷移指南,遷移至 Responses API 和 Conversations API。
API 客戶現在可以使用地理範圍設為全球的專案所屬 API 金鑰,搭配帶有前綴的網域,為個別請求選擇區域處理。現有的資格、資料保留控制、端點及模型支援要求仍然適用。詳情請參閱資料控制指南。
GPT-5.6 Sol 現在每百萬輸入 Token 的費用為 4 美元,每百萬輸出 Token 的費用為 20 美元,輸入價格降低了 20%,輸出價格降低了 33%。GPT-5.6 Sol 的優惠價格至少將持續至 2026 年 11 月 21 日。請參閱定價詳情。
OpenAI API 平台推出提示詞快取儀表板。你可以追蹤快取命中率隨時間的變化、每次寫入對應的快取讀取次數,以及快取讀取、快取寫入與未快取的 Token 分布,藉此了解快取效率並找出改善機會。你也可以依模型和服務層級篩選指標。
Images API 和 Responses API 的圖像生成工具現已為 gpt-image-2 和 gpt-image-2-2026-04-21 提供透明背景預覽功能。請將 background 設為 transparent,並使用 png 或 webp 輸出;jpeg 不支援透明背景。詳情請參閱圖像生成指南。
宣布推出超高速模式,這是 GPT-5.6 Sol 的全新 API 服務層級,執行速度最高可達標準處理的 14 倍。目前以限量預覽形式提供給特定客戶。請在這裡登記,接收超高速模式的最新消息。
Daybreak 現在為經核准的防禦人員提供兩種存取層級:Daybreak Blue 和 Daybreak Red。在已明確授權的專案中,你可以運用它們,從發現安全問題一路推進到驗證修正。
大多數防禦性安全工作可從 Daybreak Blue 開始。它提供 GPT-5.6 Sol 等通用模型的存取權,可用於漏洞探索、安全程式碼審查、偵測工程、事件應變、惡意軟體分析及修補驗證。詳情請見這裡。
Daybreak Red 提供需另行核准的專用訓練模型存取權,例如 GPT-5.6 Cyber,可用於經授權的漏洞重現、漏洞利用驗證、滲透測試、紅隊演練及複雜系統分析。
更新 chat-latest 快照,使其指向 ChatGPT 提供給 Plus 和 Pro 使用者的最新模型。我們建議在正式環境使用 API 時採用 GPT-5.6 Sol,也歡迎使用此模型測試對話使用案例的最新改進。底層模型快照將定期更新。詳情請見這裡。
2026年7月
推出官方 OpenAI Terraform 供應器,讓你以基礎架構即程式碼的方式管理 OpenAI API 平台資源。
佈建與管理專案、使用者、群組、角色、存取權指派、服務帳戶、憑證、邀請及專案層級的速率限制。使用標準 Terraform 工作流程審查及套用變更、匯入現有資源,並偵測及修正組態漂移。請從 Terraform Registry 安裝此供應器。
推出 GPT Transcribe,用於精準的檔案轉錄及產出已提交 Realtime 回合的最終轉錄稿;同時推出 GPT Live Transcribe,用於低延遲串流轉錄。
這兩款模型都支援自由格式的轉錄上下文、關鍵字提示,以及指定多種預期輸入語言。請參閱轉錄指南,比較支援的輸出與工作流程。
OpenAI API 平台新增組織與專案的強制支出上限。你可以設定每月上限,當追蹤到的支出達到上限時,受影響的 API 請求就會回傳 429 錯誤。使用支出警示,即可在流量中斷前收到通知。詳情請參閱支出上限指南。
推出 GPT-5.6 模型系列,包括具備前沿能力的 GPT-5.6 Sol、兼顧智慧與成本的 GPT-5.6 Terra,以及能高效處理大量工作負載的 GPT-5.6 Luna。gpt-5.6 別名會將請求路由至 gpt-5.6-sol。
GPT-5.6 新增以程式呼叫工具、明確的提示詞快取控制、持久化推理、max 推理強度和 Pro 模式,以及 Responses API 的多智慧體編排 Beta 功能。GPT-5.6 也支援在圖像細節設為 original 或 auto 時,以原始尺寸接收圖像。
推出 GPT-Realtime-2.1,這款更新的即時推理模型改善了英數字元辨識、靜音與雜訊處理,以及中斷行為。同時推出 GPT-Realtime-2.1 mini,這款用於即時語音應用程式的蒸餾推理模型速度更快、成本更低。
2026年6月
OpenAI API 平台推出安全用量儀表板。安全儀表板會根據請求中用來識別終端使用者的 safety_identifier 值,顯示遭封鎖的 Responses 請求。前往安全儀表板。
網頁搜尋現在可以在回傳一般文字結果的同時,回傳圖像結果。當應用程式需要最新或有網頁來源依據的視覺素材時,例如產品照片、地標、地點、活動或視覺參考資料,就可以使用圖像搜尋。詳情請參閱網頁搜尋指南。
OpenAI API 平台推出重新設計的導覽介面,請前往這裡查看。
Responses API 和 Chat Completions API 新增內容審核分數。在生成請求中傳入 moderation 物件,即可在同一份回應中取得模型輸入與生成輸出的內容審核結果。
詳情請參閱內容審核指南。
宣布可重複使用的提示詞物件、評估平台及智慧體建構工具已棄用。停止服務的時程與遷移指引,請參閱已棄用項目頁面。
自 2026 年 6 月 2 日起,符合資格的容器工作階段將按分鐘計費,最低計費時間為 5 分鐘,不再收取完整 20 分鐘工作階段的費用。每分鐘的基本費率維持不變。
這項更新旨在讓較短工作階段的計費更精細,並將降低客戶的實際成本。
你可以在我們的 API 定價文件中查看目前的內建工具定價。
現在可以在 Amazon Bedrock 中,透過與 OpenAI 相容的 Responses API 端點使用 OpenAI 模型。支援的模型與功能因 AWS 區域而異。了解詳情。
2026年5月
對於未啟用 ZDR 的組織,prompt_cache_retention 的預設值現在由 in_memory 改為 24h,因此預設會啟用延長提示詞快取。了解詳情。
推出工作負載身分聯合。受信任的工作負載可以將外部簽發的身分權杖交換為短效的 OpenAI 存取權杖,無須儲存長效 API 金鑰。
管理 API 新增功能,可管理支出警示、模型允許清單、資料保留設定及託管工具權限,並查詢細項帳單明細。
為企業客戶推出安全 MCP 通道。安全 MCP 通道讓支援的 OpenAI 產品,包括 ChatGPT 網頁版、Codex、Responses API 和 AgentKit,透過客戶自行託管的 tunnel-client 連線至私有或內部部署的 MCP 伺服器,無須將這些伺服器暴露於公用網際網路。
你現在可以管理多份 IP 允許清單,並將各份清單套用至專案層級或整個組織。若要設定,請前往設定 > 安全性 > IP 允許清單。
為 Responses API 的網頁搜尋工具新增 return_token_budget。你可以使用此參數啟用執行時間更長的 GPT-5+ 推理網頁搜尋,以處理需要投入更多推理的研究和評估工作負載。
推出 GPT-Realtime-2,這款全新的即時語音模型為語音到語音智慧體提供可設定的推理功能。同時推出用於串流語音翻譯的 GPT-Realtime-Translate,以及用於串流語音轉文字的 GPT-Realtime-Whisper。
更新了即時互動與音訊指南,新增專門的即時翻譯指南,修訂了即時轉錄中的串流轉錄內容,並將即時模型的提示詞指引移至使用即時模型。
推出適用於 Codex 的 OpenAI Developers 外掛程式。此外掛程式提供 OpenAI 平台存取功能和 OpenAI API 設定指引,協助你在 Codex 中建置 AI 應用程式和智慧體。
更新版 Agents SDK 現已提供 TypeScript 版本,內建沙盒智慧體支援和開放原始碼任務執行框架。請參閱此處以瞭解詳情。
Node、Python、Go、Ruby 和 Java 的 OpenAI SDK 現已支援管理 API。設定說明與範例請參閱管理 API 指南。
2026年4月
在 Chat Completions API 和 Responses API 推出 GPT-5.5,這是針對複雜專業工作打造的全新前沿模型。同時推出 GPT-5.5 Pro,可透過 Responses API 請求處理能受益於更多運算資源的高難度問題。
GPT-5.5 支援 100 萬 Token 的上下文視窗、圖像輸入、結構化輸出、函式呼叫、提示詞快取、批次處理、工具搜尋、內建電腦功能、託管 Shell 環境、套用修補程式、技能、MCP 和網頁搜尋。主要更新包括:
推出 GPT Image 2,這是一款用於圖像生成與編輯的頂尖圖像生成模型。GPT Image 2 支援彈性圖像尺寸、高傳真度圖像輸入、依 Token 計算的圖像定價,以及享有 50% 折扣的 Batch API。
更新 Agents SDK,新增功能包括:
- 在受控沙盒中執行智慧體;
- 檢視並自訂開放原始碼任務執行框架;以及
- 控制記憶的建立時機和儲存位置。
2026年3月
在 Chat Completions API 和 Responses API 推出 GPT-5.4 mini 和 GPT-5.4 nano。GPT-5.4 mini 以更快速、更有效率的模型提供 GPT-5.4 等級的能力,適合大量工作負載;GPT-5.4 nano 則針對以速度和成本為首要考量的大量簡單任務進行最佳化。
GPT-5.4 mini 支援工具搜尋、內建電腦功能和壓縮。GPT-5.4 nano 支援壓縮,但不支援工具搜尋或電腦功能。
更新 gpt-5.3-chat-latest Slug,使其指向 ChatGPT 目前使用的最新模型。
更新圖像編碼器,修正 GPT-5.4 處理 input_image 輸入時的一個小錯誤。部分圖像理解使用案例的品質現在可能有所提升。你不需要採取任何行動。
擴充 Sora API,新增可重複使用的角色參考、最長 20 秒的生成內容、sora-2-pro 的 1080p 輸出、影片延長功能,以及 POST /v1/videos 的 Batch API 支援。使用 sora-2-pro 生成 1080p 內容的費用為每秒 $0.70。請參閱此處以瞭解詳情。
新增 POST /v1/videos/edits,用於編輯現有影片。此端點將取代 POST /v1/videos/{video_id}/remix,後者將於 6 個月後棄用。請參閱此處以瞭解詳情。
在 Chat Completions API 和 Responses API 推出 GPT-5.4,這是我們針對專業工作打造的最新前沿模型。同時在 Responses API 推出 GPT-5.4 Pro,用於處理能受益於更多運算資源的高難度問題。
另外也推出:
在 Chat Completions API 和 Responses API 推出 gpt-5.3-chat-latest。此模型指向 ChatGPT 目前使用的 GPT-5.3 Instant 快照。請參閱此處以瞭解詳情。
2026年2月
Responses API 已擴充對 input_file 的支援,可接受更多類型的文件、簡報、試算表、程式碼和文字檔案。請參閱此處以瞭解詳情。
在 Responses API 推出 phase,用於將助理訊息標記為中途說明(commentary)或最終答案(final_answer)。請參閱此處以瞭解詳情。
在 Responses API 推出 gpt-5.3-codex。請參閱此處以瞭解詳情。
推出 Responses API 的 WebSocket 模式。請參閱此處以瞭解詳情。
在 Realtime API 推出 GPT-Realtime-1.5。
在 Chat Completions API 推出 gpt-audio-1.5。請參閱此處以瞭解詳情。
Batch API 現已支援以下 GPT Image 模型:gpt-image-1.5、chatgpt-image-latest、gpt-image-1 和 gpt-image-1-mini。
更新 gpt-5.2-chat-latest Slug,使其指向 ChatGPT 目前使用的最新模型。
在 Responses API 推出伺服器端壓縮功能。
Responses API 現已支援技能。技能可在本機執行,也可在託管容器中執行。
推出全新的託管 Shell 環境工具,並新增容器內的網路連線支援。
為 GPT 圖像模型新增在 /v1/images/edits 上使用 application/json 請求的支援。JSON 請求使用 images(以及選用的 mask),並透過 image_url 或 file_id 參照圖像,取代 multipart 上傳。
我們已為 API 客戶最佳化推論技術堆疊,GPT-5.2 和 GPT-5.2-Codex 的執行速度現在提升約 40%。模型與模型權重皆未變更。
2026年1月
發表 Open Responses:一套以原始 OpenAI Responses API 為基礎的開放原始碼規格,用於建置支援多家供應商且可互通的 LLM 介面。
在 Responses API 推出 gpt-5.2-codex。GPT-5.2-Codex 是 GPT-5.2 的一個版本,針對 Codex 或類似環境中的智慧體式程式碼編寫任務進行最佳化。請參閱此處以瞭解詳情。
為 Realtime API 新增專用 SIP IP 範圍。sip.api.openai.com 會執行 GeoIP 路由,將 SIP 流量導向最近的區域。瞭解詳情。
更新 gpt-realtime-mini 和 gpt-audio-mini Slug,使其指向 2025-12-15 快照。如果需要先前的模型快照,請使用 gpt-realtime-mini-2025-10-06 和 gpt-audio-mini-2025-10-06。
更新 sora-2 Slug,使其指向 sora-2-2025-12-08。如果需要先前的模型快照,請使用 sora-2-2025-10-06。
更新 gpt-4o-mini-tts 和 gpt-4o-mini-transcribe Slug,使其指向 2025-12-15 快照。如果需要先前的模型快照,請使用 gpt-4o-mini-tts-2025-03-20 和 gpt-4o-mini-transcribe-2025-03-20。目前我們建議優先使用 gpt-4o-mini-transcribe 而非 gpt-4o-transcribe,以獲得最佳結果。
修正了 gpt-image-1.5 和 chatgpt-image-latest 透過 /v1/images/edits 編輯圖像時的問題:即使已明確將 fidelity 設為 low(預設值),仍會錯誤地使用高傳真度。
2025年12月
為 Responses API 的圖像生成工具新增 gpt-image-1.5 和 chatgpt-image-latest。
推出 gpt-image-1.5 和 chatgpt-image-latest,這是我們最新、最先進的圖像生成模型。請參閱此處以瞭解詳情。
推出 GPT-5.2,這是 GPT-5 模型系列中的最新旗艦模型。相較於先前的 GPT-5.1,GPT-5.2 在以下方面有所改進:
- 通用智慧
- 遵循指示
- 準確度和 Token 使用效率
- 多模態能力,尤其是視覺能力
- 程式碼生成,尤其是前端 UI 建置
- API 中的工具呼叫與上下文管理
- 試算表理解與建立。
5.2 的新功能包括全新的 xhigh 推理強度等級、精簡的推理摘要,以及透過壓縮進行上下文管理的新方式。
推出用戶端壓縮。使用 Responses API 進行長時間對話時,你可以透過 /responses/compact 端點縮減每一輪傳送的上下文。
在 Responses API 推出 gpt-5.1-codex-max。GPT-5.1-Codex 是我們最聰明的程式碼編寫模型,專為長時間跨度的智慧體式程式碼編寫任務最佳化。詳情請見這裡。
2025年11月
Realtime API 新增 DTMF 按鍵支援。現在使用 Realtime 側通道連線時,可以接收 DTMF 事件。詳情請參閱相關文件。
推出 GPT-5.1,這是 GPT-5 模型系列的最新旗艦模型。GPT-5.1 經過訓練,特別擅長以下方面:
- 依照指示調整行為,並在無需太多思考時更快回應
- 程式碼生成與程式碼編寫使用案例
- 智慧體式工作流程
請注意,GPT-5.1 預設使用全新的 none 推理設定,在無需太多思考時更快回應;這與先前 GPT-5 預設的 medium 設定不同。
推出增強版角色型存取控制 (RBAC)。角色型存取控制 (RBAC) 可讓你決定組織與專案中各成員能執行哪些操作,涵蓋 API 與儀表板。
在 Responses API 推出 gpt-5.1-codex 與 gpt-5.1-codex-mini。GPT-5.1-Codex 是 GPT-5.1 的一個版本,專為 Codex 或類似環境中的智慧體式程式碼編寫任務最佳化。詳情請見這裡。
推出延長提示詞快取保留時間功能。此功能讓快取的前綴維持有效的時間更長,最長可達 24 小時。延長提示詞快取會在記憶體已滿時,將鍵/值張量卸載至 GPU 本機儲存空間,大幅增加可用於快取的儲存容量。
2025年10月
gpt-oss-safeguard-120b 和 gpt-oss-safeguard-20b 是以 gpt-oss 為基礎建構的安全推理模型。詳情請見這裡。
推出企業金鑰管理 (EKM)。企業金鑰管理 (EKM) 可讓你使用自己外部金鑰管理系統 (KMS) 所管理的金鑰,加密你在 OpenAI 的客戶內容。
推出英國資料駐留。
在 OpenAI DevDay 推出多項新功能:
推出 GPT-5 Pro,這是 GPT-5 的一個版本,運用更多運算資源深入思考,持續提供更好的答案。
推出 GPT-Realtime mini 與 gpt-audio-mini,提供更具成本效益的語音到語音效能。
推出 gpt-image-1-mini,提供更具成本效益的圖像生成與編輯功能。
推出 v1/videos,可使用我們最新的 Sora 2 與 Sora 2 Pro 模型,生成及混編內容豐富、細節細膩且充滿動感的影片。
推出智慧體建構工具,可透過視覺化介面建立自訂的多智慧體工作流程。
推出 ChatKit,這是用於部署智慧體的可嵌入式對話介面。
評估:新增第三方模型支援。
推出服務健康狀態儀表板。
推出 IP 允許清單。IP 允許清單將 API 存取限制為僅允許你指定的 IP 位址或範圍。
2025年9月
Responses API 新增支援,可將圖像與檔案作為工具呼叫輸出。
推出專用模型 gpt-5-codex,專為搭配 Codex CLI 使用而建構及最佳化。
2025年8月
OpenAI Realtime API 現已正式推出。詳情請參閱我們的 Realtime API 指南。
Responses API 新增連接器支援。連接器是由 OpenAI 維護的 MCP 封裝,適用於 Google 應用程式、Dropbox 等熱門服務,可讓模型取得這些服務中所儲存資料的讀取權限。
推出 Conversations API,可讓你搭配 Responses API 建立及管理長時間對話。請參閱遷移指南中的並列比較,了解如何將 Assistants API 整合遷移至 Responses 與 Conversations。
在 API 推出 GPT-5 系列模型,包括 gpt-5、gpt-5-mini 與 gpt-5-nano。
新增 minimal 推理強度值,讓支援推理的 GPT-5 模型能以快速回應為優先。
新增 custom 工具呼叫類型,讓模型在呼叫工具時能使用自由格式的輸入與輸出。
2025年6月
推出優先處理支援。相較於標準處理,優先處理的延遲大幅降低且更穩定,同時保有隨用隨付的彈性。
推出 o3-deep-research 與 o4-mini-deep-research,這是我們 o 系列推理模型的深度研究版本,專為深入分析與研究任務最佳化。詳情請參閱深度研究指南。
儀表板與 Responses API 現已提供全新的可重複使用提示詞。現在可以透過 API 的 prompt 參數,使用提示詞 id 與選填的 version,參照在儀表板建立的範本,並提供可包含字串、圖像或檔案輸入的動態 variables。Chat Completions 不支援可重複使用提示詞。了解詳情。
推出 o3-pro,這是 o3 推理模型的一個版本,運用更多運算資源,以更好的推理能力與一致性回答難題。所有 API 請求的 o3 模型價格也已調降,包括批次處理與彈性處理。
gpt-4.1-2025-04-14、gpt-4.1-mini-2025-04-14 與 gpt-4.1-nano-2025-04-14 模型新增使用直接偏好最佳化進行微調的支援。
gpt-4o-audio-preview 與 gpt-4o-realtime-preview 現已提供新的模型快照。推出 TypeScript 版 Agents SDK。
2025年5月
Responses API 新增內建工具支援,包括遠端 MCP 伺服器與程式碼解譯器。進一步了解工具。
使用未經微調的模型進行平行工具呼叫時,現在可對工具結構描述使用 strict 模式。
新增結構描述功能,包括針對 email 與其他模式進行字串驗證,以及指定數字與陣列的範圍。
在 API 推出 codex-mini-latest,專為搭配 Codex CLI 使用而最佳化。
推出強化微調支援。了解可用的微調方法。gpt-4.1-nano 現已支援微調。
2025年4月
推出增強版 API 預算警示與自動加值上限支援。
新增圖像生成模型 gpt-image-1。此模型提升了品質與指令遵循能力,為圖像生成樹立新標準。
更新圖像生成與編輯端點,支援 gpt-image-1 模型專用的新參數。
新增兩款 o 系列推理模型:o3 與 o4-mini。它們為數學、科學、程式碼編寫、視覺推理任務及技術寫作樹立新標準。
推出 Codex,這是我們的程式碼生成 CLI 工具。
API 新增 gpt-4.1、gpt-4.1-mini 與 gpt-4.1-nano 模型。這些新模型提升了指令遵循與程式碼編寫能力,並提供更大的上下文視窗(最多 100 萬個 Token)。gpt-4.1 與 gpt-4.1-mini 可用於監督微調。同時宣布 gpt-4.5-preview 已棄用。
2025年3月
Audio API 新增 gpt-4o-mini-tts、gpt-4o-transcribe、gpt-4o-mini-transcribe 與 whisper-1 模型。
推出多款新模型與工具,以及用於智慧體式工作流程的新 API:
- 推出 Responses API,這是用於建立及使用智慧體與工具的全新 API。
- 為 Responses API 推出一組內建工具:網頁搜尋、檔案搜尋與電腦。
- 推出 Agents SDK,這是用於設計、建構及部署智慧體的編排框架。
- 宣布推出新模型:
gpt-4o-search-preview、gpt-4o-mini-search-preview、computer-use-preview。 - 宣布計畫將 Assistants API 的所有功能引入更容易使用的 Responses API,並預計在 2026 年(達到完整功能對等之後)停止提供 Assistants。
微調作業新增 metadata 欄位支援。
2025年2月
推出 GPT-4.5 研究預覽版,這是我們迄今規模最大、能力最強的對話模型。GPT-4.5 憑藉高「EQ」與對使用者意圖的理解,在創意任務與智慧體式規劃方面表現更出色。
推出 API 用量儀表板更新。此次更新回應了使用者對更多資料篩選功能的需求,包括專案選擇、日期選擇器,以及更細緻的時間間隔。此外,也改善了跨產品與服務層級查看用量的支援。
推出歐洲資料駐留功能。請參閱詳細資訊。
2025年1月
推出全新小型推理模型 o3-mini,專為科學、數學和程式碼編寫任務最佳化。
擴大 o1 模型的開放使用範圍。o1 系列模型透過強化學習訓練,能夠執行複雜推理。
2024年12月
推出管理 API 金鑰輪替功能,讓客戶能以程式化方式輪替管理 API 金鑰。
更新管理 API 邀請功能,讓客戶能以程式化方式邀請使用者加入組織,並同時邀請他們加入專案。
新增 o1、gpt-4o-realtime、gpt-4o-audio 及其他系列的新模型。
為 Realtime API 新增 WebRTC 連線方式。
為 o1 模型新增 reasoning_effort 參數。
為 o1 模型新增 developer 訊息角色。請注意,o1-preview 和 o1-mini 不支援 system 或 developer 訊息。
推出採用直接偏好最佳化(DPO)的偏好微調功能。
推出 Go 和 Java SDK 的測試版。了解詳情。
在 Python SDK 中新增對 Realtime API 的支援。
推出 Usage API,讓客戶能以程式化方式查詢各項 OpenAI API 的活動與支出。
2024年11月
發布 gpt-4o-2024-11-20,這是 gpt-4o 系列的最新模型。
推出預測輸出功能,可在預先知道大部分回應內容的情況下,大幅降低模型回應延遲。這種情況最常見於僅有少量變更、需要重新生成文件和程式碼檔案內容時。
2024年10月
在 Realtime API 和 Chat Completions API 中新增五種聲音。
發布用於 Chat Completions 的全新 gpt-4o-audio-preview 模型,同時支援音訊輸入與輸出。其底層模型與 Realtime API 相同。
在舊金山舉行的 OpenAI DevDay 上發布多項新功能:
Realtime API:透過 WebSockets 介面,在應用程式中打造快速的語音到語音體驗。
模型蒸餾:提供一個平台,讓你利用大型前沿模型的輸出,微調具成本效益的模型。
圖像微調:使用圖像和文字微調 GPT-4o,提升視覺能力。
評估:建立並執行自訂評估,衡量模型在特定任務上的表現。
提示詞快取:針對近期處理過的輸入 Token,提供費用折扣並縮短處理時間。
在 Playground 中生成:使用 Playground 中的「生成」按鈕,輕鬆生成提示詞、函式定義和結構化輸出的結構描述。
2024年9月
發布全新 omni-moderation-latest 內容審核模型,可同時支援圖像與文字(適用於部分類別),新增兩種僅適用於文字的危害類別,並提供更準確的分數。
發布 o1-preview 和 o1-mini,這兩款全新大型語言模型透過強化學習訓練,能夠執行複雜推理任務。
2024年8月
Assistants API 現在支援納入檔案搜尋工具使用的檔案搜尋結果,以及自訂排名行為。
gpt-4o-2024-08-06 微調功能正式推出,所有 API 使用者現在都能微調最新的 GPT-4o 模型。
發布動態模型 chatgpt-4o-latest,此模型將指向 ChatGPT 使用的最新 GPT-4o 模型。
推出結構化輸出,模型輸出現在能可靠地遵循開發人員提供的 JSON 結構描述。
發布 gpt-4o-2024-08-06,這是 gpt-4o 系列的最新模型。
推出管理與稽核記錄 API,讓客戶能以程式化方式管理組織,並透過稽核記錄監控變更。稽核記錄功能必須在設定中啟用。
2024年7月
推出自助式 SSO 組態設定,讓採用自訂與無上限計費方式的企業客戶,能設定透過所選 IDP 進行身分驗證。
推出 GPT-4o mini 微調功能,進一步提升模型在特定使用案例中的表現。
發布 GPT-4o mini,這是一款價格實惠且具備智慧的小型模型,適合快速、輕量的任務。
推出 Uploads,可將大型檔案分成多個部分上傳。
2024年5月
在 API 中發布 GPT-4o。GPT-4o 是我們速度最快、價格最實惠的旗艦模型。
新增支援,讓 Assistants API 能接收圖像輸入。
新增支援,讓 Batch API 能使用微調模型。
在 Chat Completions 和 Completions API 中新增 stream_options: {"include_usage": true} 參數。設定此參數後,開發人員便能在使用串流時取得用量統計資料。
在 Assistants API 中新增端點,用於刪除對話串中的訊息。
2024年4月
在 Chat Completions 和 Assistants API 中新增函式呼叫選項 tool_choice: "required"。
新增 Batch API 指南,並讓 Batch API 支援嵌入向量模型
推出 Assistants API 的一系列更新,包括全新檔案搜尋工具,每個助理最多可使用 10,000 個檔案;新的 Token 控制項;以及工具選擇支援。
推出以專案為基礎的階層架構,方便依專案組織工作,並可針對個別專案建立 API 金鑰、管理速率限制與費用上限(費用上限僅適用於企業客戶)。
推出 Batch API
在 API 中正式推出 GPT-4 Turbo with Vision
在 Assistants API 中新增支援,可依 run_id 篩選訊息
2024年2月
在 Audio API 中新增 timestamp_granularities 參數
2024年1月
發布 V3 嵌入向量模型與更新版的 GPT-4 Turbo 預覽模型
在 Embeddings API 中新增 dimensions 參數
2023年12月
在 Assistants API 的 Run 建立功能中新增 additional_instructions 參數
Chat Completions API 新增 logprobs 和 top_logprobs 參數
工具呼叫中的函式參數引數已改為選填
2023年11月
推出 GPT-4 Turbo Preview、更新版 GPT-3.5 Turbo、GPT-4 Turbo with Vision、Assistants API、API 中的 DALL·E 3 及文字轉語音 API
Chat Completions 的 functions 參數已棄用,請改用 tools