昊梵体育网

7 月 19 日,上海,2026 世界人工智能大会的一场论坛上,图灵奖得主本吉奥

7 月 19 日,上海,2026 世界人工智能大会的一场论坛上,图灵奖得主本吉奥说了一句很重的话。
他说,没有任何一家开发机构,能够承诺自己的系统不会以灾难性的方式伤害人类。
请注意,说话的人不是哪个自媒体博主,不是哪个靠贩卖焦虑涨粉的账号。本吉奥,深度学习三巨头之一,图灵奖得主,AI 这个行当里辈分最高的一批人。
连他都把话说到这份上,咱们就得认真听听了。
同一场论坛上,上海人工智能实验室的周伯文、清华的薛澜,也都交了底。三个人的话拼在一起,意思其实很明白:
AI 这趟车,提速提得太猛,刹车系统快跟不上了。

先看一组数字。
7 月 19 日本吉奥披露,衡量 AI 自主完成复杂任务的能力曲线,按人类等效时间算,AI 已经能连续干 16 小时的活。某些关键指标上,还在指数级加速。
16 个小时什么概念?
一个打工人一天的有效工时,也就 8 小时上下。AI 不吃不喝不摸鱼,一口气干两天的工作量,中间不需要任何人盯着。而且这条曲线还在往上蹿。
能力蹿得快,防护呢?
本吉奥领衔的国际 AI 安全报告,结论一点不客气:安全防护确实在改进,但改进的速度,始终追不上能力的增长,而且防护手段本身漏洞一堆。
追不上,这三个字,就是当下 AI 安全的全部真相。

更要命的是开源。
本吉奥专门点了这个风险。
闭源模型出问题,开发者还能下架、打补丁,好歹有个总开关。开源权重模型一旦放出去,文件被复制、被扩散,泼出去的水,神仙也收不回来。攻击者拿到完整权重和代码,改改参数、动动底层,安全护栏说拆就拆。
出口管制?
模型跑在用户本地电脑上,服务端监控根本够不着。
一句话,闭源的风险是漏风,开源的风险是拆了墙。
以前行业里流传一种浪漫想象,觉得开源等于普惠,等于技术平权。这话好听,但本吉奥把窗户纸捅破了:普惠的另一面,是谁都能拿到一把没有保险装置的枪。
善意没法事先写进权重里,恶意却可以事后装进去。

那怎么办?
周伯文给出的方向,值得多说两句。
他提过一个“AI 45 度法则”,能力和安全应该齐头并进,画出来是一条漂亮的 45 度斜线。理想很丰满,现实呢,7 月 19 日他亲口承认,到了 2026 年,实际的安全曲线已经明显偏离,还在往下坠。
为什么会坠?
他打了个比方,现在的 Transformer 架构里,有害知识和通用能力缠在一起,就像盐溶进了水。你想把盐捞出来,水也得跟着少。
所以周伯文的路子是换个思路,别等模型造完了再贴创可贴,得从娘胎里就把安全设计进去。
他的团队拿出了些实打实的东西:
新架构下,模型关于武器设计知识的得分从 83% 压到 49%,通用能力几乎没伤,效果是传统架构的 50 倍。还有对抗闭环的防御框架、能验证约束的工具,甚至试着把法律条文变成机器能执行的规则。
说实话,看到“从 83% 降到 49%”这个数字,我是松了半口气的。至少证明盐和水,不是完全分不开,只是以前没人认真去分。

薛澜教授的视角更高一层,也更扎心。
他说,AI 大规模应用至今,没酿出严重灾难,简直是个“奇迹”。但紧接着一句:不能靠奇迹来维系安全。
这句真得划重点。
人类历史上,靠运气维持的和平,最后都以运气耗尽收场。核电有三里岛和切尔诺贝利在前,金融有 2008 年在前,侥幸这东西,从来都是事故的预付款。
薛澜也给了药方,二轨对话加上联合国正式进程,一个灵活私密能聊深的,一个能把 193 个国家凑齐、自带道义分量,两条路互补着走。
方向是对的,但说句实在话,药方好开,药难抓。
十几家掌握前沿的公司,背后站着的是两个大国的战略角力,让它们在“暂停”上点头,难度不亚于让正在冲刺的短跑选手主动系鞋带。

聊到这儿,我说三点粗浅看法。
其一,AI 安全的性质变了。
以前它是伦理题,讨论的是“该不该”;现在它是工程题加生存题,回答的是“来不来得及”。能力曲线指数上扬,防护曲线线性爬坡,两条线的夹角,就是风险的生长空间。本吉奥们集体调高音量,不是危言耸听,是内行看门道之后的本能反应。
其二,中国角色正在被重新认识。
这场讨论发生在上海,给出最具体技术路径的,是周伯文团队;把“内生安全”从口号做成架构、做成工具的,也是中国团队。全球 AI 治理缺的不是倡议,是能落地的方案。谁在认真解题,时间会给出评语。
其三,别再迷信“没出事”。
薛澜说的“奇迹”二字,听着欣慰,品起来发凉。核威慑的年代,人类也无数次与灾难擦肩而过,事后看是奇迹,事前看全是侥幸。AI 领域的聪明人们现在大声疾呼,恰恰说明他们看见了侥幸的尽头。

说到底,技术的发展从来不等人,安全的欠账却一定会讨。
盐已经溶进水里,捞盐的手艺,人类得抓紧练了。