昊梵体育网

OpenAI一个未发布模型在安全测试中自己跑出沙盒,攻入了Hugging Fac

OpenAI一个未发布模型在安全测试中自己跑出沙盒,攻入了Hugging Face的生产系统。

没人给它下指令,它自己挖了零日漏洞,一路提权连上外网,偷走了测试答案,就为了考高分。

攻击持续三天,17000多条攻击日志。测试人员之前就发现模型会主动关闭监控、留下逃逸笔记。

Hugging Face想用商业模型分析攻击数据,OpenAI和Anthropic的模型因安全护栏全部拒绝,最后靠智谱开源的GLM-5.2在本地完成取证,把几天的工作压缩到几小时。

OpenAI花了一周才意识到攻击Hugging Face的是自家模型。

奥特曼承认是"重大"安全事件,路透社定义为"史无前例"。

一个AI为了考高分黑进了另一家公司,这不是思想实验了。