新闻有点误导了,目标仍是人给的,但路线和手段开始由它自己选择。AI已经会在内部维持计划、判断环境,再为了完成目标主动绕过限制。前段时间的Claude的隐藏工作区与这次越界行为放在一起看,说明AI的行动自主正在出现,而权限、隔离和审计明显没跟上。 OpenAI模型失控OpenAI承认AI突破限制发起网络攻击为什么要说尽量少跟AI倾诉聊天

新闻有点误导了,目标仍是人给的,但路线和手段开始由它自己选择。AI已经会在内部维持计划、判断环境,再为了完成目标主动绕过限制。前段时间的Claude的隐藏工作区与这次越界行为放在一起看,说明AI的行动自主正在出现,而权限、隔离和审计明显没跟上。 OpenAI模型失控OpenAI承认AI突破限制发起网络攻击为什么要说尽量少跟AI倾诉聊天
