重大舉措! OpenAI 完全開源 Codex Harness
wallstreetcnOpenAI 已根據 Apache 2.0 授權開源了 Codex Harness 的三個核心元件(CLI 工具、官方 SDK 和應用程式伺服器)。 Harness 作為底層執行框架,驅動 AI 代理,可無縫整合到開發者的產品中,徹底擺脫「通用聊天框」模式。它還將介面、資料和安全審批權限歸還給開發者,有效解決了企業級 AI 部署的最後難題。
就在昨天,OpenAI 完成了另一個升級。
這雖然不是一個全新的模型發布,但它對開發者的影響甚至比模型本身的迭代版本還要大。
OpenAI 正式宣布,將把其平台中著名的 Codex 底層核心框架(Harness)完全開源!

換句話說,OpenAI正在免費提供其頂級AI代理的引擎。
開發者不再需要將業務流程硬塞進一個通用的聊天框中!
您可以將功能最強大的 AI 代理直接整合到您自己的產品、工程工具、營運儀表板,甚至是最普通的財務報告軟體中。
OpenAI 總裁 Greg Brockman 興奮地轉發了 Codex 的推文,並表示: “Codex 的功能遠不止程式設計工具!”
您可以直接在 Codex Harness 上建立自己的產品。

從現在起,你將完全掌控自己的空間。介面、資料和權限審批都由你決定,而人工智慧只負責底層「工作」。
OpenAI 最新的「開源巨變」將如何徹底顛覆未來的軟體開發模式?
世界長期以來飽受「通用聊天框」之苦。
想想我們現在是如何使用人工智慧的?
無論是編寫程式碼、進行數據分析還是處理客戶投訴,標準流程似乎都是:打開網頁/側邊欄,面對單調的聊天輸入框,輸入背景描述,然後期望人工智慧提供完美的答案。
如果答案錯誤,請繼續在聊天框中「拉扯」。

大多數人都是透過 Codex 的應用程式、命令列介面 (CLI) 或 IDE 擴充程式來熟悉它的。
但 OpenAI 認為,這種單一的互動體驗太過狹隘!
OpenAI在其官方部落格中簡潔地指出:
與其要求每個團隊強制將其熟悉的工作流程遷移到通用程式碼助手,不如將代理直接整合到圍繞實際任務設計的軟體中。
畢竟,安全分析師會查看警報佇列和受影響服務的狀態;客戶服務工程師會查看帳戶歷史記錄和產品日誌;產品經理會查看需求儀表板。
對於這些第一線員工來說,重要的不是“聊天框”,而是眼前的業務儀表板。界面本身意義重大,它才是最重要的「情境」。
現在,隨著 Codex Harness 的開源發布,這場「反 shell 攻擊」的革命正式開始了。
揭秘 Harness:人工智慧代理的“最強大外骨骼”
那麼, Harness ,這個開源專案的核心內容,究竟是什麼呢?
許多人誤以為強大的AI代理等於好的模型加上好的提示。
完全錯誤!
一個真正功能完善的智能體需要極為複雜的底層執行系統。
它需要理解任務,在長時間的對話中記住信息,回顧相關信息,熟練地使用各種工具,向外界展示進展,處理崩潰和故障,在關鍵時刻停止並請求人類批准,最終返回有用的結果。
Harness 就是這個處理所有繁瑣工作的「執行系統」和「代理循環」。
透過這次開源發布,OpenAI 向外界證明了一件事:一個好的 Harness 設計甚至可以改變一個模型。
OpenAI 提供了非常有說服力的數據,證明了線束設計的重要性。
在極具挑戰性的 ARC-AGI-3 基準測試中,他們只對 Harness 做了兩個關鍵調整——保留推理和上下文壓縮。
結果,GPT-5.6 Sol 模型的得分瞬間從 13.3% 飆升至 38.3%!更令人驚訝的是,輸出詞元數量減少了六倍!
換句話說,有了 Harness 的支持,人工智慧不僅會變得智慧三倍,還能為您節省大量的 API 呼叫成本。
事實證明,雖然模型能力很重要,但如何管理模型(即 Harness 的設計)才是決定代理最終表現的關鍵。
三個開源元件,零門檻集成
為了讓開發者真正“開箱即用”,OpenAI 根據 Apache-2.0 許可證發布了三個完整的開源元件。
您只需造訪 GitHub 上的 openai/codex 儲存庫,即可解鎖這項強大的工具庫。
https://github.com/openai/codex
首先是 CLI 工具 codex exec,它可以運行自動化管線。
如果您只需要 AI 運行腳本、執行 CI(持續整合)任務或執行一次性後台任務,請直接使用 CLI。
它可以運行有界代理工作流程並返回結構化輸出。簡單、直接、高效。
第二款是官方的 Codex SDK,它是程式設計師的終極遊戲手把。
如果您正在編寫需要使用程式碼啟動、復原或串流 Codex 任務的應用程序,官方 SDK(支援 TypeScript/Python)提供了一個直接的可編程介面。
你可以使用程式碼精確控制線程和任務的生命週期。
這次開源版本發布的第三個,也是最耀眼的亮點,是 Codex 應用程式伺服器。它是完全整合到產品中的核心引擎。
當您的產品需要整合代理時,應用伺服器是最佳選擇。它允許您的應用程式透過記錄詳細的客戶端協定(JSON-RPC)連接到本機 Codex 進程。
你可以使用它:
保持持續對話;
即時事件流(即時查看人工智慧正在做什麼);
中途打斷人工智慧的工作;
將您應用程式中的工具開放給人工智慧使用;
處理人工審批請求(人機互動)。

正如知名開發者@ClusterProtocol所感嘆的:
透過將前端審批介面與底層執行循環分離,將代理程式嵌入到業務儀表板中變得比以往任何時候都更加簡單!

這遠不止是編寫程式碼!它是提升各行各業效率的「核武」。
如果你認為 Codex 只是用來寫程式的,那就大錯特錯了。
正如布羅克曼所說,Codex 的功能遠不止於程式設計工具。
讓我們來看看那些先驅者們用它創造了哪些奇蹟:

案例研究1:報稅方面的「神級」協助
你能想像人工智慧報稅嗎?會計工作最大的恐懼就是出錯;容錯率極低。
Thrive Holdings 和 Crete 等合作夥伴利用了這款開源的 Harness 套件,將其嵌入到專業的稅務準備工作流程中。
該系統不僅可以處理複雜的稅務邏輯,還能完美整合稅務顧問的回饋意見。
結果令人震驚:試點計畫成功處理了多達 7,000 份報稅表,並將報稅時間縮短了約三分之一!

這充分展現了將人工智慧嵌入專業垂直工具的巨大威力。
案例研究 2:思科雲端管理系統
科技巨頭思科使用 Codex SDK 在其雲端控制平台內建置應用程式建構器。
現在,思科客戶可以直接使用自然語言創建自訂應用程序,而複雜的底層邏輯則由 Codex Harness 在後台默默處理。

官方示範模板:物流看板“接力”
為了幫助大家更直覺地理解,OpenAI 正式展示了一款名為Relay的虛擬物流營運儀錶板應用程式。
這個版塊上沒有令人分心的「ChatGPT聊天框」。
1. 互動方式發生巨大變化:使用者不再需要從頭開始編寫提示。他們只需選擇一張逾期發票,然後點擊「比較恢復選項」。
2. 無縫上下文整合:應用程式將自動向 AI 提供當前頁面的訂單詳情和物流資料作為上下文。
3. MCP 整合:Codex 將自動呼叫應用程式本身的 MCP 工具來取得最新的即時運行資料。
4. 人工審核:代理分析並確定最佳重新預約方案後,必須跳出審核對話框。只有在銷售人員點擊「同意」後,人工智慧才會執行寫入操作。
5. 狀態同步:操作完成後,業務儀錶板將自動刷新。

在這個過程中,Harness 負責處理代理循環、記憶體維護、工具互動和即時回饋;而您的產品則保留對其儀錶板、資料記錄和整體管理的控制權。這才是真正的「人機協作」。
重塑邊界,將權力和靈魂歸還給應用程式開發人員
為什麼我們說開源改變了軟體開發的典範?
過去一年,許多開發者陷入了「套用現有產品」的惡性循環。每個人都在製作聊天機器人,產品越來越相似,競爭優勢也越來越淺薄。
作為開放平台,Codex 賦予開發者三個維度的「絕對控制權」:
Codex 讓使用者對介面擁有完全的控制權;不要再強迫使用者適應聊天框了!
讓使用者繼續使用他們熟悉的儀錶板、編輯器、地圖和清單。人工智慧應該是隱形的助手,而不是佔據螢幕的主角。
透過 MCP 服務,您可以完全掌控上下文和工具,從而安心地將公司最關鍵的系統、機密文件和內部 API 直接暴露給代理。
人工智慧不再是「不了解公司規章制度」的外來者,而是精通您業務系統的專家。
最後,絕對的操作邊界和安全控制對於企業應用程式至關重要。宿主應用程式可以決定代理程式的運作位置以及它可以存取哪些檔案。
最重要的是,您可以設定哪些危險操作(例如修改資料庫或向客戶發送電子郵件)必須由人點擊授權。
在這個模型中,“前端業務規則屬於您,底層代理會循環返回給 OpenAI”,完全彌合了在企業級場景中實施 AI 的最後一公里。
Codex Harness 採用 Apache 2.0 許可證,這意味著任何人都可以對其進行修改並將其用於商業用途。
真正的考驗是:有多少開發者會放棄舒適的聊天框,將智慧代理拆解成各個部分,以便融入他們的產品中?
Codex安全帶的設計理念充分體現了這個產品理念。
我們需要做的不是使用通用聊天框來取代所有專業介面;而是為這些介面配備智慧大腦。
當通用聊天框消失時,原生AI應用程式將會蓬勃發展。
網路代理商零准入門檻的時代已經到來。
以上內容僅用作資訊或教育之目的,不構成與BTCC相關的任何投資建議。 BTCC竭力但無法保證上述全部內容的真實性、準確性和原創性。