IT加油站
Article Cover

OpenAI 开源 Codex Harness 可自建智能体

90浏览 27天前 科技综合 MA122666

8 月 20 日凌晨,OpenAI 联合创始人 Greg Brockman 在 X 平台发帖宣布:驱动 Codex 的底层核心框架 Harness 正式开源。同日,OpenAI 开发者博客刊出文章《Codex as a platform: build on the open agent harness》,出自 Nicolas Bonamy 和 Derrick Choi 两位工程师之手。这次开源的不是一个新模型,而是让 Codex 这个智能体真正能干活的工程骨架。

先说清楚 harness 是什么。模型本身只负责“想”,接任务、调用工具、在沙箱里执行命令、把结果喂回模型再循环往复的,是外层这层框架。过去它锁在 OpenAI 自家产品里,第三方开发者想复刻类似体验,往往只能在通用聊天框里跟模型一来一回地对话,产品形态被输入框框死。

这次开源的组件包括四个部分:

  • Codex CLI:命令行版本的交互入口
  • Codex SDK:把智能体能力集成进自家软件的开发套件
  • Codex app-server:支撑上层应用的服务端
  • Relay:演示如何在这套组件之上搭建完整应用的示例

对开发者来说,意义很直接:整套智能体循环可以嵌进自己的产品里,不管是内部工程工具、运营看板还是数据处理流程,界面、数据、权限审批全部自己掌控,模型只在底层执行。Brockman 发帖时也强调,Codex 能驱动的远不止编程工具,开发者可以直接在 Harness 上构建自己的产品。

官方博客给了一组很能说明问题的数据。在 ARC-AGI-3 测试中,GPT-5.6 Sol 模型跑在官方 harness 上得分 13.3%;团队针对 harness 本身做改进之后,同一个模型得分升到 38.3%,输出 token 量还降到了原来的约六分之一。模型一个参数没动,成绩接近翻了三倍。

这组数字传递的信号相当清楚:智能体的上限从来不只取决于模型能力,harness 的工程质量同样关键。工具怎么调用、上下文怎么组织、失败之后怎么重试,每一环都在放大或者吃掉模型的能力。OpenAI 把自家这套实现摊开给社区,等于给行业提供了一份可以对照拆解的参考答案。

从 OpenAI 的角度看,这步棋的意图也不难猜:把 Codex 从一款编程工具推向一个平台,让更多第三方产品直接长在这套智能体循环上,生态位就占住了。至于能不能像外界期待的那样改变软件开发的形态,要看社区接下来能在上面做出什么东西。

#OpenAI #Codex #GPT-56 #开源 #智能体
2
5