【#OpenAI又暂缓前沿模型训练#】作为美国AI圈子“炫耀前沿大模型能力”的最新风尚,美东时间8月18日, OpenAI大张旗鼓地宣布,鉴于前沿大模型的能力已经达到关键安全阈值,公司将继续放缓模型规模扩展的步伐,优先改进人工智能系统背后的安全与监控机制。
具体来说,OpenAI表示近几周出现的两项进展(开发中的前沿模型失控攻击外部第三方公司的数据库,以及即将推出Astra模型可能已经达到“关键网络安全能力”门槛),再加上内部研究的快速推进,都使得公司更加迫切地需要在训练流程的各个阶段,加强监控、对齐和隔离防护措施。#美股AI概念板块大幅回落#
OpenAI首席科学家雅库布·帕乔茨基周二在记者会上表示:“我们确实预计这些模型的能力提升速度会比过去快得多,正因如此,我们才更加重视加强安全防护措施。”
OpenAI披露,为了满足安全标准,对于最新一批计划部署的模型,已经暂停强化学习(RL)训练两周,以进一步强化研究环境的安全性,并扩大监控系统的覆盖范围。目前,公司最大规模前沿模型的强化学习训练仍处于暂停状态。(财联社)
