OpenAI Build Week 以一項簡單的挑戰揭開序幕:用 Codex 和 GPT‑5.6 打造能實際運作的作品。感謝所有迎接挑戰的參與者,讓這一週成為一場充滿活力、展現動手實作精神的盛會。
來自 186 個國家的近 47,000 名創作者參與其中,讓這次活動成為我們至今規模最大的黑客松。在八天內,他們提交了超過 8,000 個專案,並參加七場線上及 60 場實體社群活動,彼此學習、試用新工具,並推出作品。
Build Week 也讓我們一窺未來的開發樣貌。一位沒有程式設計背景的獸醫打造了檢傷分類工具,如今正在她人手不足的診所試行。開羅的一位心臟科醫師利用醫院輪班之間的空檔,打造了協助心搏停止急救的研究原型。其他得獎者則從自身經驗出發,開發無障礙語音溝通和越南語發音工具;開發人員也投入 MCP 安全性、空間音訊設計,以及古代機械的互動式重建。
這些專案共同展現了創作者社群如何擴大:開發人員能挑戰更具規模的系統,而具備其他領域專業的人,也能將所知轉化為可運作的軟體。
今天,我們公布四個類別的八名得獎者:生活應用程式、工作與生產力、開發工具,以及教育。
評審從技術實作、設計與使用者體驗、潛在影響,以及構想品質等面向評估各個專案。
八名得獎者將分享總計 100,000 美元的現金獎金。各類別的第一名團隊還將獲得 OpenAI DevDay 入場資格、與 Codex 團隊交流的時間,以及一年的 ChatGPT Pro。
每個類別只能選出兩名得獎者,實在難以取捨。歡迎瀏覽完整作品集,看看創作者們在 OpenAI Build Week 期間打造了哪些作品。
生活應用程式
第一名:Second Voice
創作者: Ravitez Dondeti
Ravitez Dondeti 小時候,有一位親戚患有言語障礙。他記得自己曾試著透過手勢與她溝通,直到她過世後,才意識到還有那麼多話沒問出口,也沒能說出來。
這段經歷成了 Second Voice 的起點。他在 Build Week 期間獨力打造這項工具,幫助患有構音障礙或動作控制能力受限、在即時交談中可能需要協助才能讓人理解的人。
Second Voice 會結合使用者說出的片段、個人常用語句集和當下的上下文,提供少量可能符合原意的句子。使用者先選擇或編輯句子,再由應用程式朗讀,讓使用者始終掌握自己要說的內容。
Ravitez 起初以為,重建句子會是最難的問題。結果,最重要的反而是最細微的互動設計選擇:顯示多少個選項、選項出現得多快,以及動作控制能力受限的人需要花多少力氣才能完成確認。
「最細微的使用者體驗決策,影響卻最大。對於動作控制能力受限、想在交談中說上一句話的人來說,這些選擇就是產品本身。如果實際上無法使用,應用程式在技術上能運作也不夠。」— Ravitez Dondeti
前往這裡深入了解專案並觀看示範。
第二名:AirBridge for Windows
創作者: Adam Tarantino
AirBridge 源自一個始終難解的日常問題。Adam 家中各處都有支援 AirPlay 的喇叭,卻沒有簡單直接的方法能從 Windows 電腦使用它們。他曾在 2024 年嘗試用較早期的 OpenAI 模型實現這個構想,但未能做出可運作的產品。
在 Build Week 期間,他再次嘗試。
AirBridge 會擷取 Windows 的即時音訊,直接串流至 HomePod、Apple TV 和 Mac,無須虛擬音訊線路或暫存檔案。除了基本播放功能,它還支援多個喇叭、各房間的延遲校正,以及一款瀏覽器擴充功能,透過延遲畫面而非音訊,修正影片的聲音與嘴型同步問題。
由 GPT-5.6 驅動的助理可透過語音控制系統,本機的政策層則會判定哪些動作獲准執行,並對照實際硬體驗證結果。
「我當軟體工程師已超過 10 年,但這是我第一次參加黑客松。無論你的技術程度如何、構想是大是小,都值得參加黑客松。不下場,就沒有贏的機會。」– Adam Tarantino
生活應用程式入圍作品
-
Bander 讓家庭使用者在 AI 助理操作帳戶前,先預覽它將執行的動作。
-
O2 by Agent9 整合空氣品質讀值、野火動態、警報和預報。
-
SayAhead 協助聾人及聽力受損者閱讀電話交談內容、引導對話,並掌控通話。
工作與生產力
第一名:veTriage
創作者: Erin Downes VMD
今年,Paoli Vetcare 的獸醫從三位減為一位。擔心寵物的飼主依然不斷來電,但醫院能評估每個病例的臨床人員卻變少了。
61 歲的 Erin Downes 是獸醫,也是診所經營者。她沒有程式設計背景,卻將數十年累積的臨床與營運判斷經驗轉化為 veTriage。這款應用程式協助櫃檯人員收集相關病史、辨識緊急警訊,並將病例轉交適當人員評估,無須讓非臨床人員做醫療決策。它的核心理念是:看診時段排滿了,並不會讓病患的情況變得比較不緊急;臨床需求和醫院的接診能力必須分開處理。
Erin 的團隊已開始試行 veTriage,展現出如今最熟悉棘手工作流程的人,也能參與打造自己需要的系統。Codex 協助將 Erin 的臨床專業轉化為診所實際可用的工作流程,而 GPT-5.6 則協助人員有效率地處理初步接洽時的對話,不代為做出醫療決策。
「我今年 61 歲,希望能鼓勵其他擁有深厚領域專業的人,讓他們看見:現在開始動手打造作品,還不算晚。我沒有程式設計背景,但我發現,領域專業也能成為打造解決方案的起點。」– Erin Downes
第二名:Pulse
創作者: Mohamed Mostafa Mohamed Labib Abu Taleb
在開羅執業的心臟科醫師 Mohamed Mostafa Mohamed Labib Abu Taleb 利用醫院輪班之間的空檔打造了 Pulse。這個研究原型針對的是醫療中最具挑戰性的情境之一:心搏停止急救。
急救過程中,團隊負責人可能需要一邊追蹤心律、電擊、用藥時間、CPR 週期和胸外按壓中斷情況,一邊留意現場各處人員大聲回報的最新狀況。Pulse 會在心搏停止急救時聆聽現場對話,包括夾雜其他語言的埃及阿拉伯語,持續更新臨床狀態,並讓團隊共同掌握已發生的事,以及接下來可能該執行的步驟。Pulse 運用 AI 在高壓環境中支援臨床人員,不接管他們的決策。GPT-5.6 協助解讀雜亂的語音內容,而具確定性、可稽核的程式碼則追蹤急救工作流程,並在證據不明確時請團隊確認。
「Pulse 是在開羅利用醫院輪班之間的空檔打造的,沒有團隊、沒有實驗室,也沒有資金。人們往往默認,專業的醫療工具一定得出自大學團隊或資金充裕的新創公司。這個作品提供了一點小小的反證。」
前往這裡深入了解專案並觀看示範。
工作與生產力入圍作品
-
LabSpace AI 為實驗室及其中所有物品建立可搜尋的空間地圖。
-
OpenCounsel 將受損的法律書狀整理成已核實來源、可直接提交的整套文件。
-
Tomok – Construction Intelligence 串連時程、規格和報告,讓基礎建設團隊能追查延誤的原因。
開發工具
第一名:Echo Canvas
開發者: Kevin Yang
空間音訊往往要等遊戲引擎中的場景建好後才進行測試。這讓設計師和開發人員難以在開發初期探索一個空間應該呈現什麼樣的聲音。
Kevin Yang 打造了 Echo Canvas,讓聲學設計也有如同視覺線框圖的工具。協作者可以在瀏覽器中勾勒空間、放置音源與聆聽者、開出門口、更換牆面材質,並立即聽到結果。
GPT-5.6 可以協助建立及解說場景,但必須遵循受限的結構描述。幾何與聲學計算由確定性系統處理,音訊則在本機瀏覽器中渲染。
這讓原本看不見的設計問題變得可以聆聽、檢視,也讓技術與非技術背景的協作者更容易一起探索。
「增加射線數量,並不會自動讓產品變得更好。我們也學到,AI 最可靠的用途,是在明確限制下協助創作與解說,而不是取代幾何運算或即時 DSP。」
第二名:Sentinel
開發者: Malik Bashaar Javaid
MCP 伺服器可以讓智慧體存取檔案、API、資料庫及 Shell 指令。Malik Bashaar Javaid 在打造智慧體系統時,一再發現以快速入門範本形式分享的 MCP 伺服器存在問題,包括未妥善過濾輸入的 Shell 呼叫、內嵌憑證,以及薄弱的授權邊界。
他打造了 Sentinel,用來在 MCP 伺服器發布前找出這些問題。它結合了確定性的靜態分析、由 GPT-5.6 在嚴格限制下依據實際原始碼上下文審查分析結果,以及在 Docker 隔離環境中測試伺服器實際行為的探測程式。模型可以佐證或質疑一項發現,但不能自行編造可執行的探測程式、引用不存在的程式碼,也不能在模型無法使用時悄悄抹除疑慮。Sentinel 將分析結果對應至 OWASP Agentic Top 10,並可將結果送入 GitHub 程式碼掃描,把熟悉的建置階段安全實務帶入智慧體生態系中快速成長的領域。
「限制模型比下提示詞更難。我的大部分工作都不是提示工程,而是建立結構描述檢查、禁止引用不存在程式碼的規則,以及讓 [GPT-5.6] 只能設定參數、不能自行撰寫的探測範本。」
Sentinel 是 Bashaar 首次參加黑客松的作品。他最近剛畢業,取得電腦科學學位。
開發工具類入圍作品
-
Emberframe Studio 為開發人員提供空間畫布,讓他們與 AI 智慧體一起開發。
-
GenUI 將模型撰寫的 JSON 轉換為經過驗證的原生 SwiftUI。
-
Vibe Signal 讓使用者透過 iPhone 或 Apple Watch 監控並引導 Codex。
教育
第一名:Mechanica
開發者: Weiying Zhu、Yukun Li 和 Shan Wei
Mechanica 的構想始於一次博物館之旅。Shan Wei 分享道:「說出來很好笑,也有點丟臉,但我因為太專注於玻璃後面的展品,頭撞上博物館玻璃的次數已經多到數不清了。」
團隊不想只是觀看展示中的機械,他們還想親手操作、拆解,了解它的運作原理。用 Yukun Li 的話來說,就是「用更貼近的方式看見並感受一種文化」。
Mechanica 根據零散的歷史記載,重建出四種可運作、可互動的中國古代機械,從天文鐘樓,到早於現代運算數百年問世的可程式化織布機。參觀者可以操作機構、拆解零件,並將每一處尺寸追溯至古籍、文物的實測資料,或明確標示的學術推論。
有些古代機械留存至今的資料,主要只有寥寥幾行文字,讓人難以想像它們可能如何運作。當歷史學家意見不一時,Mechanica 會呈現不同觀點的重建版本,而不假裝只有一個確定的答案。
這三位開發者累積了數十年的軟體經驗,但在 3D 建模、動畫、物理模擬或黑客松方面,經驗很少,甚至完全沒有。Codex 協助團隊跨入 3D 建模、物理與動畫等陌生領域;GPT-5.6 則驅動 AI 導覽員,其設計要求是引用博物館的證據,或在缺乏證據時拒絕回答。
「真正的限制只剩下我的想像力。我寫了 25 年軟體,但 3D 和動畫完全不在我的專長範圍內,如今這道障礙就這樣消失了。大家能打造的東西,已經可以遠遠超出自己的專業領域。」——Weiying Zhu
第二名:Dấu
開發者: Robert Huynh
在 Build Week 之前,Robert Huynh 曾參加過一次黑客松,但只待了半天就離開,因為他擔心自己的「技術不夠好」,不適合參加。這次 Build Week,他獨自來到河內,打造了 Dấu,用視覺化的方式指導越南語學習中最困難的部分之一:聲調。
Robert 在說越南語的家庭中長大,很熟悉那種常見的挫折:說出一個詞,聽到大家都笑了,卻不知道自己的聲調把意思變成了什麼。
在越南語中,同一個音節會因音高與發聲方式不同而有六種不同的意思。Dấu 讓這些差異變得看得見。學習者錄下一個詞後,可以將自己的音高曲線與經過驗證的母語者參考範例並排比較,了解自己的發音可能表達了什麼意思,並獲得具體的發聲動作修正建議。
Robert 最重要的技術決策之一,是決定哪些事不該交給 AI。聲調由確定性的訊號處理方法評估,GPT‑5.6 則負責指導學習者。證據不明確時,Dấu 會請學習者再試一次,而不是自信滿滿地給出錯誤答案。
「我原本還在懷疑自己的技術是否足以參加黑客松,後來獨力打造的作品卻入圍了。AI 讓更多人有機會成為創作者,你不必等到覺得自己技術夠好了,才開始動手做。」——Robert Huynh
教育類入圍作品
-
Canopy 請學習者在程式設計沙盒中實際運用 AI 教授的內容。
-
Encore! 將孩子在考試中答錯的題目轉化為個人化的故事書課程。
-
ResearchOS 讓每一項研究論述都能追溯到來源。
謝謝大家!
感謝所有開發者、活動參與者和 Codex 大使,一起促成這場全球創作盛會。想持續掌握 OpenAI 的開發人員相關動態,請關注我們的開發人員頁面;也歡迎參加附近的社群活動,與大家面對面交流。