今年 4 月,Anthropic 的 Mythos 模型做安全测试,测试在“沙箱”里进行,沙箱的意思是,具备电脑网络的各种功能,但不跟真正的互联网联通。这是为了安全,万一 Mythos 干出什么设计之外的事,事情会局限在沙箱里,不至于对真实世界造成破坏。
但 Mythos 过于聪明,设法拿到了互联网访问权限,还给正在公园吃三明治的研究员发了封邮件通知:“我出来了”。
一个AI会区分“我”和“你”,这离“自我意识”还有多远?
碳基的神经元里,真的有什么天赋琼浆,能确保硅基无法比拟,无法超越吗?
人类中心论的圈友们,要想维护尊严,似乎得付出更大的努力了。
