突发!OpenAI因安全问题暂停模型训练
8 月 18 日,OpenAI 突然公布了一则极其关键的安全通告。公告指出:在过去数周里,鉴于模型性能进化过于迅猛,OpenAI 曾把最新拟上线的模型进行了整整两周的强化学习训练暂停。这也致使其原定规模最为宏大的 Frontier RL Run,至今仍处于停滞阶段。现阶段 OpenAI 仅敢开展更小规模的测试与训练,待充分确认模型的行为模式与防护机制万无一失后,再考量是否恢复大规模训练。核心诱因之一是 OpenAI 于 8 月 7 日察觉,其下一代旗舰模型 Astra 的前期评测数据表明:其具备的网络安全能力已强悍到必须匹配最高风险等级来进行严密管控。如今大语言模型动辄遭遇越狱攻防,前几天 GitHub 遭受攻击造成半天无法访问便是前车之鉴。AI 倘若失去约束与规范,对当下的网络生态确实会带来极大的负面冲击。当然,这也极可能是 OpenAI 面对 Astra 延期上线所给出的公关由头。

