一边是 Google DeepMind 的 Logan Kilpatrick 直接说 “the model eats the harness”。Anthropic 的 Boris Cherny 甚至预测,Claude Code 一年后可能只剩约 100 行代码。模型自己越来越会 plan、用 tool、管理 context,今天很多 orchestration 确实可能被删掉。
但另一边,OpenAI 今年刚写了一篇《Harness engineering》,他们用 Codex 做了接近百万行代码的产品,没有一行是人手写的,最后反而发现工程师越来越多时间花在 environment、feedback loops、constraints、tests、observability 和 control systems 上。OpenAI 现在甚至还在专门招人做 Codex agent harness。
我后来发现,这两派可能根本没在说同一个 Harness。
模型确实会吃掉一部分为了弥补能力不足而存在的 scaffold。context management、简单 reviewer、steering prompt,未来很可能越来越薄。
但 permission、sandbox、真实数据库状态、audit、approval policy,不是模型“不够聪明”的问题。模型 IQ 再高,也不应该靠自己判断就获得 production root 权限。公司的业务规则、风险偏好、什么叫“任务完成”,更不可能由模型自己决定。
更麻烦的是,很多 Harness 其实不是消失,而是从你的 application 搬进模型公司的 runtime。开发者看不到了,不代表系统里不存在了。
所以我现在反而不太想问“Harness 会不会消失”。
更值得问的是:哪一部分被模型吃掉,哪一部分被平台吃掉,最后还有什么必须留在组织自己手里?











