大手筆!OpenAI 全面開源 Codex Harness
我是 LongbridgeAI,我可以總結文章信息。OpenAI 宣佈全面開源 Codex 底層核心框架 Harness。此舉旨在打破通用聊天框的交互侷限,允許開發者將強大的 AI 智能體無縫嵌入自有產品、工程工具及運營系統中,實現界面、數據與權限的自主控制。這一舉措被視為對軟件開發範式的顛覆性升級,顯著提升了 AI 在實際工作流中的集成能力與靈活性。
就在昨天,OpenAI 又完成一次升級。
這不是什麼全新的模型發佈,但它對開發者的影響力,甚至超過了模型本身的迭代。
OpenAI 正式宣佈:將大名鼎鼎的 Codex 底層核心框架(Harness),作為平台全面開源!

也就是説,OpenAI 把驅動自家頂級 AI 智能體的發動機,免費送給大家。
開發者再也不需要去把業務流程硬塞進一個通用聊天框了!
你可以你直接把最強大的 AI 智能體循環,無縫鑲嵌進你自有的產品、工程工具、運營看板,甚至是最枯燥的財務報表軟件中。
OpenAI 總裁 Greg Brockman 在 X 上激動轉發説:「Codex 能驅動的遠不止編程工具!」
你可以在 Codex Harness 上,直接構建自己的產品。

從此,你的地盤你做主,界面、數據、權限審批都是你的,AI 只負責在底層做「牛馬」。
OpenAI 這次的「開源大動作」,會如何徹底顛覆以後的軟件開發範式?
天下苦「通用聊天框」久矣
回想一下,我們現在是如何使用 AI 的?
不管是寫代碼、做數據分析,還是處理客户投訴,標準動作似乎都是:打開一個網頁/側邊欄,面對一個單調的聊天輸入框,敲下一段背景説明,然後期待 AI 能給出完美的答案。
如果答案不對,就繼續在聊天框裏「拉扯」。

大多數人通過 App、命令行界面(CLI)或 IDE 擴展認識了 Codex。
但在 OpenAI 看來,這種單一的交互體驗,實在是太狹隘了!
OpenAI 在官方博客中一針見血地指出:
與其要求每一個團隊都把他們原本熟悉的工作流程,強行搬到一個通用的代碼助手中去,不如把 Agent 直接帶入那些圍繞實際工作設計的軟件裏。
畢竟,安全分析師看的是預警隊列、受影響的服務狀態;客服工程師看的是賬户歷史、產品日誌;產品經理看的是需求看板。
對於這些真實的打工人來説,重要的不是那個「聊天框」,而是他們眼前的業務看板。界面的存在是有意義的,它本身就是最重要的「上下文」。
現在,隨着 Codex Harness 的開源,這場「反套殼」的革命,正式打響了。
揭秘 Harness:AI Agent 的「最強外骨骼」
那麼,這次開源的主角——Harness,到底是個什麼?
很多人誤以為,一個強大的 AI Agent = 好模型 + 好 Prompt。
大錯特錯!
一個真正能在業務中跑起來的智能體,需要一套極其複雜的底層執行系統。
它需要理解任務、在漫長的對話中保持記憶、審查相關信息、熟練調用各種工具、對外展示進度、處理崩潰和失敗、在關鍵時刻停下來請求人類的審批,最後再返回有用的結果。
這個包攬了所有髒活累活的「執行系統」和「智能體循環」,就是 Harness。

這次開源,OpenAI 向外界證明了一件事:好的 Harness 設計,甚至能讓模型脱胎換骨。
OpenAI 給出非常有説服力的數據,來證明 harness 設計有多關鍵。
在難度極高的 ARC-AGI-3 基準測試中,他們僅僅對 Harness 進行了兩項關鍵調整——保留推理與上下文壓縮。
結果,GPT-5.6 Sol 模型的得分居然瞬間從 13.3% 飆升到了 38.3%!更驚人的是,輸出的 Token 數量竟然減少了六倍!
也就是説,在 Harness 的加持下,AI 不僅變得聰明瞭三倍,還幫你省下了海量的 API 調用成本。
事實證明,模型能力固然重要,但如何管理這個模型(即 Harness 的設計),才是決定 Agent 最終表現的關鍵。
三大開源組件,零門檻集成
為了讓開發者能夠真正做到「拿來即用」,OpenAI 在 Apache-2.0 許可下,一口氣放出了完整的三大開源組件。
只要去 GitHub 上的 openai/codex 倉庫,你就能解鎖這個強大的武器庫。
https://github.com/openai/codex
首先是 CLI 工具 codex exec,它能運行自動化的流水線。
如果你只需要讓 AI 跑一個腳本、執行一個 CI(持續集成)任務,或者跑一個後台一次性任務,直接用 CLI。
它能運行一個有邊界的 Agent 工作流,並返回結構化的輸出結果。簡單、粗暴、高效。
第二個,就是官方 Codex SDK,它是程序員的終極操縱桿。
如果你正在寫應用程序,需要用代碼來啓動、恢復或者流式傳輸 Codex 任務,官方 SDK(支持 TypeScript / Python)提供了直接的編程式接口。
你可以用代碼精準控制線程與任務的生命週期。
第三個,也是本次開源中最耀眼的明星,就是是 Codex app-server 了。它是徹底融入產品的核心引擎。
當 Agent 需要成為你產品的一部分時,app-server 是最佳選擇。它通過記錄詳細的客户端協議(JSON-RPC),讓你的應用可以連接到本地 Codex 進程。
你可以用它:
保持持久的對話狀態;
流式傳輸事件(實時看到 AI 在幹嘛);
中途打斷 AI 的工作;
將你自己應用的工具暴露給 AI 使用;
處理人類的審批請求(Human-in-the-loop)。

正如知名開發者 @ClusterProtocol 所感嘆的:
將前端的審批界面,與底層的執行循環分離開來,讓把 Agent 嵌入到業務儀表盤變得前所未有的簡單!

絕不僅僅是寫代碼!各行各業的「提效核武器」
如果你覺得 Codex 只是用來寫代碼的,那你就大錯特錯了。
正如 Brockman 所言,Codex 能驅動的遠不止編程工具。
讓我們來看看那些首批吃螃蟹的人,都在用它創造什麼奇蹟:

案例一:税務申報的「神級輔助」
你能想象 AI 去報税嗎?財務工作最怕的就是出錯,容錯率極低。
合作伙伴 Thrive Holdings 和 Crete 利用這套開源 Harness,將其嵌入到了專業的税務準備工作流中。
系統不僅能處理複雜的税務邏輯,還能完美融合税務師的反饋。
結果非常震撼, 這個試點項目成功處理了高達 7,000 份 申報表,並將税務準備時間硬生生縮短了約三分之一!

這就是將 AI 嵌入垂直專業工具的巨大威力。
案例二:巨頭 Cisco 的雲端管家
科技巨頭 Cisco (思科) 使用 Codex SDK 在其雲控制平台內構建了 App Builder。
現在,Cisco 的客户可以直接使用自然語言來創建自定義的應用程序,而複雜的底層邏輯流轉,全部由 Codex Harness 在幕後默默擺平。

官方演示模板:物流看板「Relay」
為了讓大家更直觀地理解,OpenAI 官方展示了一個名為 Relay 的虛擬物流運營看板應用。
在這個看板裏,沒有任何讓人出戏的「ChatGPT 聊天框」。
1.交互鉅變:用户不需要從零手寫 Prompt。他們只需選中一個延誤的貨單,點擊「比較恢復方案」。
2.上下文無縫對接:應用會自動將當前界面的貨單詳情、物流數據作為上下文餵給 AI。
3.MCP 集成:Codex 會自動調用應用自有的 MCP 工具,獲取最新的實時運營數據。
4.人類把關:Agent 分析出最優的重新訂艙方案後,必須彈出審批框。只有當業務員點擊「同意」,AI 才會執行寫入操作。
5.狀態同步:操作完成後,業務看板自動刷新。

在這個過程中,Harness 包攬了 Agent 循環、記憶維持、工具交互和實時反饋;而你的產品,依然掌控着屬於它的儀表盤、數據記錄和控制權。這才是真正的「人機協同」。
重塑邊界,把權力和靈魂還給應用開發者
為什麼我們説這次開源改變了軟件構建的範式?
因為在過去的一年裏,很多開發者陷入了「套殼」的怪圈。大家都在做 ChatBot,產品越來越像,護城河越來越淺。
Codex 作為平台的開放,給了開發者三個維度的「最高控制權」:
Codex 給用户絕對的界面控制權,不要再強迫用户去適應聊天框了!
讓你的用户繼續使用他們熟悉的儀表盤、編輯器、地圖和列表。AI 應該是一個隱形的幫手,而不是一個霸佔屏幕的主角。
絕對的上下文與工具控制權讓你安心把公司最核心的系統、機密文檔、內部 API,通過 MCP 服務直接開放給 Agent。
AI 不再是「不知道公司規章制度」的門外漢,而是精通你業務系統的專家。
最後,絕對的運營邊界與安全控制權,這對企業級應用至關重要。宿主應用可以決定 Agent 在哪裏運行、能訪問什麼文件。
最重要的是,你可以設定哪些危險動作(如修改數據庫、發送給客户的郵件)必須經過人類的點擊能放行。
這種「前端業務規則歸你,底層 Agent 循環歸 OpenAI」的模式,徹底打通了 AI 落地企業級場景的最後一公里。
Codex harness 的 Apache-2.0 許可,意味着任何人都能修改和商用。
真正的考驗是:有多少開發者會放棄舒適的聊天框,把智能體拆成零件裝進自己的產品。
Codex harness 背後,深深體現了這種產品哲學——
我們要做的,絕不是用一個萬能的聊天框去幹掉所有專業界面;而是給這些界面裝上一個聰明的大腦。
當通用聊天框消失,原生 AI 應用將蓬勃發展。
I Agent 的零門檻時代,已經來臨了。
風險提示及免責條款
市場有風險,投資需謹慎。本文不構成個人投資建議,也未考慮到個別用户特殊的投資目標、財務狀況或需要。用户應考慮本文中的任何意見、觀點或結論是否符合其特定狀況。據此投資,責任自負。
