今天来吹一吹DeepSeek Harness(DSH)就是DeepSeek发布的类似CodeX和Claude Code的东西。
吹的点当然不是其缓存99%,虽然我当初就猜测,用下来的价格和涨价前用其他工具的价格差不多。也不是其对开发者友好,WEB的方式非常适合丢进Linux虚拟机,还能在宿主机上无感式操作虚拟机和开发。
真正吹的点在于,相比CodeX和Claude CodeDSH哲学内核发生了翻天覆地的变化
如果所有Agent工具都是在为大模型这个大脑安装上手脚,让大模型可以在思考之外凭借意志驱动去操作电脑,又或者是为其提供记忆系统或者规范其运行流程,让Agent更智能更听话更有用的话。
DSH很快都能做到这些,而且生态上来之后一定会做的更好。现阶段大家对DSH的理解,「一切皆插件」。类似于游戏领域各种MOD或者IP领域的各种二创。顶天了,DSH就是VS Code,那些工具成为Jebbrains全家桶。开源和商业的博弈罢了。
但DSH真正天花板最高的,还是在于其Cordis那篇论文。简单一句话理解,就是在「一切皆插件」的后面附上一句「一切插件皆可逆」
简单地说,DSH希望实现一个目标,任何新功能新变化,都能在DSH自己身上热插拔,并且没有副作用(实际上不可能,但可以尽量降低这个副作用),
这有什么效果呢?所有Agent工具都是在告诉大模型你能使用哪些工具如何用,如果要哪个工具没有,只有制造出来之后让Agent重启之后才能加载这个工具。
Agent自己没办法提升自己,只能依靠重生之后提升力量。
而且,重启会中断Agent的工作流,一旦制造的工具有问题,工作流就无法自动恢复,需要人或者另一Agent来辅助重启。换句话说,其他Agent没有能力自指试错,一旦错了就是自指否定,矛盾。
直观地说,各位也不希望自己未来购买的机器人,让他自行学点什么或者自我升级某项功能的时候,突然就死机乃至发疯无法自行回退吧?
DSH的论文就是在提出一种解决方案。DSH提供了一套自指提升自己且尽可能无副作用的可逆热插拔机制。DSH发现自己缺少什么工具,马上给自己造一个就能装备上并长期使用。制造的过程当然可能出现非常多的错误,但是可逆热插拔机制允许DSH试错,错了就回退。
以前需不需要这套机制呢?不太需要,写代码的主体是人,代码是个客体。哪怕写了屎山代码BUG满天飞,程序员是不用死一死的(一般来说)更新之前会有无数测试,崩溃了程序员大不了加加班恢复就行了。
但是现在,Agent自己就是一串代码,但是在大模型的加持下有了写代码的能力。他可以改写包括自己在内的代码,但是一旦把自己写错了,自己无法自我恢复就完蛋了,谁来救救它呢?程序员吗?我看这么下去程序员快失去写代码的能力了。其他Agent吗,常备双Agent增加成本。
其实这都不重要,重要的是可逆热插拔开启的无限可能。有了试错空间的主体才能有自指提升的可能,大白话就是「自我成长」嗯?自我成长?不知道大家意识到这个词的哲学内核了吗?
人、生命,本就是能自我成长的。辩证地说,只有能自我成长的存在,才能称之为智能。通往AGI,通用人工智能的路,一定是需要自我成长的。
而如今的大模型架构,是不可能自我成长的,不满足热更新,也不能无损学习,单调成长。
在大模型架构没有革命式变化之前DSH这样的可逆热插拔机制,「一切插件都可逆」就以Agent在工具和能力层面「自我成长」提供了一种可能的基础。(非大脑神经层面)
当然,Agent的「自我成长架构」是否能赶在大模型未来可能的「自我成长架构」出现之前大放异彩,这是一个值得讨论的话题。如果大模型的架构很快突破,那么DSH这套可逆热插拔就没多大意义了。
但是,事物总归不是二元的。无论是Agent还是大模型,其实都是「自我成长架构」的一种表象。如果两者能以某种基底融合到一起(不是现在这种融合,而是背后的原理),其实我们会发现,世间纷繁复杂的表象不过是一种不变本体在不同领域不同层级下的投影罢了。
(话说要是海对岸发的这篇论文,我估计现在舆论已经快进到硅基生命、智械危机了)