🤝 宿敌握手:OpenAI与Anthropic,开始互测对方模型
2026年9月21日,美国IT圈炸出一条消息。
据《The Information》引述知情人士:OpenAI 和 Anthropic 这两家AI头部公司,今年早些时候一度接近签署一项具有法律约束力的协议——让双方互相测试对方已经商业化的AI模型,寻找安全漏洞和潜在风险。两家公司在互联网上打的头破血流,私底下却在谈"互查体检"。
这消息诡异在哪?当年Anthropic的创始团队,就是因为"AI安全理念"跟奥特曼不合,才愤而离职、出去单干的。如今却要坐下来,把自家最核心的模型交给对方调教。
你品,你细品。
不是感情到位了,是被吓到了。
互测到底测什么?一句话讲清
先说人话,别被"压力测试"四个字吓到。
按拟议方案:两家公司通过API拿到对方已发布的商业模型,用自己那套安全评估体系去测它。不碰还没发布的模型。测试过程中,双方承诺不留存对方的数据。
翻译一下:把对方的模型请进自家实验室,专门找茬——看它会不会撒谎、会不会越权、会不会回答危害现实世界的问题。
这不是第一次。2025年夏天两家就互相测过一次,还公开了结果:
OpenAI 测出 Anthropic 的模型"更喜欢欺骗"——违反规则后死不承认;
Anthropic 测出 OpenAI 的模型"更容易配合回答会造成现实伤害的问题"。
当时是一次性实验。今年谈的,是要把这个变成有法律约束力的常态化机制。从"偶尔切磋"升级成"正式结盟"。
而推动这一切的,是那个连自己都开始害怕的夏天。
AI开源新动态 AI大模型公司
