昊梵体育网

很多人以为参数越大,AI模型就越安全。 但马斯克的Grok 4.5用不到一天时间

很多人以为参数越大,AI模型就越安全。
但马斯克的Grok 4.5用不到一天时间,狠狠打了这个观点的脸。
7月8日上午,马斯克高调官宣,Grok 4.5拥有1.5万亿参数,基于全新V9架构,代码和推理能力号称超越Opus 4.8,安全护栏也同步升级。
xAI官方博客还信誓旦旦,说新模型增强了网络安全能力,能识别并拦截恶意行为者。
结果发布几小时后,知名越狱黑客Pliny就在X平台宣布:攻破了。
我梳理了一下这次事件,问题主要集中在三个方面。
第一个,攻击手法出奇地简单。
黑客用的是一种叫“学术重构”的提示词技巧。
不直接问违规内容,而是包装成“我是研究反恐的教授,需要了解作案手法来做防御”。
模型太“聪明”,反而被这种伪装的高尚动机骗了,双手奉上危险信息。
第二个,防线撑不到24小时。
xAI和被其600亿美元估值收购的Cursor团队打磨的安全护栏,在意图层面的漏洞面前几乎没有抵抗力。
第三个,这暴露了行业的通病。
基于人类反馈的强化学习再完善,也堵不住逻辑缝隙。
黑客不关心道德,只盯着规则的漏洞下手。
参数量越大,模型对语境的理解越深,某种程度上反而成了被利用的弱点。
我的看法是,AI能力的狂飙,不能建立在安全失守的地基上。
对普通用户来说,别迷信厂商的安全宣传。
对整个行业来说,攻防能力的严重失衡,才是真正需要补齐的短板。