昊梵体育网

刘淼,来自北京航空航天大学的超级学霸,卡内基梅隆大学硕士,佐治亚理工学院博士,M

刘淼,来自北京航空航天大学的超级学霸,卡内基梅隆大学硕士,佐治亚理工学院博士,Meta高级研究科学家,他要研究的只有一件事儿。
2025 年 8 月,一个人从 Meta 离职了。
在那之前,他做的事,是几乎所有 AI 从业者都梦寐以求的,参与训练 Llama 4。
而回国之后,他给自己的实验室主页配了一张背景图:《权力的游戏》里,詹姆·兰尼斯特单枪匹马,冲向丹妮莉丝和她的龙。
下面压着一行小字:"这揭示了做科学常常需要什么,你必须愿意做那个孤独的战士。"
他叫刘淼,现在是清华大学人工智能学院助理教授。
"孤独的战士"这五个字,大概是他这十一年的注脚。
他的博士导师是 James Rehg,计算机视觉领域的重要学者。
读博期间,他还去苏黎世联邦理工和德国马克斯·普朗克研究所做访问。
他要研究的只有一件事,第一视角视觉。
什么意思?就是你戴着一副眼镜,用你的眼睛看世界。
镜头记录的不是"别人在做什么",而是"你正在看什么、下一步要做什么"。
这比听起来难得多,镜头一晃、手一挡,画面全乱。
更麻烦的是,第一视角里藏着一样第三视角永远拿不到的东西——意图。
2020 年,他在 ECCV 上发表了一篇口头报告论文,提出了一个关键词:"运动注意力"。
意思是在人真正伸手去拿杯子之前,他的手已经在"预备"了。
机器若能读懂这个预备动作,就能预测人下一步要干什么,不是识别已经发生的动作,而是预见还没发生的动作。
从"看见"到"预见",这是他学术生涯的第一条主线。
2022 年 8 月,博士毕业两个月,刘淼入职 Meta。
这三年,他同时推进了两条线。
一条是数据,另一条是大模型。他深度参与了 EMU、Llama 3、Llama 4(多模态部分)的训练与评估。
而他在佐治亚理工做的那些"预测人下一步动作"的算法,有一部分被真正装进了 Meta Reality Labs 的下一代智能眼镜。
2025 年 8 月,他离开 Meta,入职清华大学人工智能学院,建起了自己的实验室——MEOW Lab。
实验室的口号只有十二个字:"看你所见、学你所会、懂你所想。"
这个转身,他自己解释过。
什么才算理解?他的标准是它能不能在物理世界里行动,并承担行动的后果。
2026 年,刘淼与冯瑶开始联手创业,方向锁定"以人为中心的具身模型"。
冯瑶的履历同样非常硬核,ETH 苏黎世与马普所博士,斯坦福博士后,即将入职清华人工智能学院。
两个人的共同判断是:当前具身智能的训练里,"人"是缺席的。
模型学会了抓杯子、叠衣服,却读不懂坐在沙发上的人此刻是疲惫还是焦躁。
而对人来说,"递一杯水的时机和方式,可能比递水这个动作本身更重要"。