说真的,看到OpenAI把Codex Harness开源这条消息,我第一反应是:这比发新模型猛多了。
很多人对Codex的印象还停留在一个写代码的AI,但这次开源的不是模型,是模型外面那层底层执行框架全给你扒开了,Apache 2.0协议,CLI、SDK、app-server三件套齐活。
什么概念?以前你想在自己产品里塞个AI agent,得从零搭运行时,上下文怎么管、工具怎么调、权限怎么控,全是坑。现在直接拿Codex的harness当底座,你只管自己的界面、数据和业务逻辑,agent的脏活累活它包了。
最狠的是官方博客里那个数据:同样的GPT-5.6 Sol,光靠harness层面的上下文压缩和推理保留,ARC-AGI-3得分从13.3%直接飙到38.3%,输出token还砍了六倍。这说明什么?模型脑子再好使,没有一套靠谱的工程框架兜着,战斗力根本发挥不出来。大家天天卷模型参数,结果真正拉开差距的可能是框架层。
当然,模型权重和托管服务没开源,OpenAI没疯。但这步棋信号很明确:agent的runtime层要开始标准化了,以后卷的不是"谁能做agent",而是"谁的agent嵌得更深、场景更准"。开源harness本质上是在给行业铺地基——地基用我的,上面盖什么楼你随意,但楼里跑的模型,你猜大家会接谁的?
对开发者来说,这波属于天上掉脚手架,别犹豫,先跑起来再说。CodexHarness开源


