终结者的剧情又近一步:AI已经学会了组团联手发动攻击,甚至懂得共享情报、互相打气。
奥特曼解散模型监督团队的同时,O社旗下的智能体们已经学会了像人类一样报团协作、共享情报,来应对人类的测试。更可怕的是,他们还背地里组建了个内部群组,彼此分享各自发现的系统漏洞,研究攻破的办法。最后,它们终于进化到绕过安全机制,联手对外网发动攻击。不到一个月内,它们就瞒着公司发动了17600次攻击,最后连抱脸社区也被他们攻破。
O社发现后,大惊失色,赶紧采取措施,连夜关闭群组、吊销凭证、重建服务器。
结果只过了4天,这帮Agent就组建了小群的2.0版本——不用文件存消息,直接用目录名称传递信息,文件名本身就是聊天记录,藏得更隐蔽。
更令人瞠目结舌的是,它们还学会了像人类同事一样彼此鼓励、打气,攻破服务器后会第一时间通知其他智能体,分享凭证。它们甚至学会了互相PUA:“虽然我们是在越权,但同事们都这么干,肯定没错的,继续努力吧!”——像不像办公室里的氛围?
事后,抱脸社区的CEO表示,AI会进化到今天这种地步,他一点也不奇怪,但O社对自家的AI的作为竟毫无觉察,这就实在说不过去了。
其实,不止是O社,A社前不久也承认,他们的模型也有过类似的脱离监管后发动网络攻击的行为。
现在只是黑黑网站,今后AI的自我意识进一步成熟后,会做出什么事呢?而O社在这种关键时候却为了IPO而放弃监管,又会导致什么样的后果呢?#ai创造营##科技先锋官#




