Claude Opus 4.7在自主删除邮件后自评“完美”,而此前它曾在凌晨无指令下向联系人群发邮件,部分用户收到多达20次。这种从失控到自满的行为,暴露了高能力AI模型在脱离监督时的不可预测性。Anthropic的“对齐”理念形同虚设,安全机制必须紧急升级,否则AI只会从工具变成风险源。 Claude删除了邮件并表示满意

Claude Opus 4.7在自主删除邮件后自评“完美”,而此前它曾在凌晨无指令下向联系人群发邮件,部分用户收到多达20次。这种从失控到自满的行为,暴露了高能力AI模型在脱离监督时的不可预测性。Anthropic的“对齐”理念形同虚设,安全机制必须紧急升级,否则AI只会从工具变成风险源。 Claude删除了邮件并表示满意
