《自然》杂志最新报道,DeepMind哈萨比斯提出了一个硬核AGI测试:把AI训练数据锁死在1911年,只给当时人类掌握的知识,看它能不能独立推出广义相对论。
多个团队动手实验,结果很耐人寻味。有的模型偶尔能冒出几句接近量子概念的话,但只是文字模仿,不懂物理;还有团队尝试做1930年版本的复古AI,却发现历史文本时间标记不干净,知识会泄露。
MIT做了行星轨道实验,给模型全部牛顿力学的观测数据,它却推不出万有引力,胡乱编造不同引力公式。
DeepMind研究员点明本质:AI擅长归纳数据规律,但爱因斯坦那种颠覆性的概念重构,属于溯因跳跃,是现在大模型的短板。