硅谷这周的气氛,有点微妙。
7 月 17 日,月之暗面发布了 Kimi K3,全球首个 2.8 万亿参数的开源模型。然后,美国科技圈就炸了。
Axios 说,它“让开发者们眼前一亮,也震惊了硅谷,让竞争局势在一夜之间发生了改变”。Box 的首席执行官亚伦·列维透露,硅谷“所有人都在讨论这件事”。
彭博社的用词更直接,这让人想起去年 DeepSeek 发布时的那场震荡。
有意思的是,就在本周早些时候,一位 Anthropic 高管还在放话,说 Claude 大约领先中国对手 6 至 12 个月。
话音未落,加州大学伯克利分校教授、Arena 评测平台联合创始人斯托卡就把话接了过去:
“过去我们常说,中国的开源模型落后大概 6 到 9 个月吧。现在,他们可能只落后 2 到 3 个月。”
月之暗面自己的说法是,K3 的综合能力超过了除 Claude Fable 5 和 GPT-5.6 之外的所有竞争对手。
Arena 排行榜上,Kimi 的评分高过 Anthropic 的 Opus 4.8,价格还低了 40%。截至 17 日下午,K3 已经在 Arena 网页开发任务榜上排到了第一。斯托卡的早期测试结论是,它的代码能力已经与 Claude Fable 和 GPT-5.6 Sol 站在“同一水平线”。
排行榜第一,同一水平线,价格更低。
这几样东西凑在一起,硅谷的反应就不难理解了。
真正让美方坐不住的,还不是一个模型的分数,而是分数背后的趋势。英国人工智能安全研究所 17 日发了一份报告,在网络安全能力上,中国开源模型与美国模型的差距,已经从 1 年前的 6 至 10 个月,缩小到 4 至 7 个月。
曲线一直在往上走,而且斜率越来越陡。
不过,有一个细节,被很多人忽略了,我觉得反而是最值得说道的。
这次的 K3,不便宜。
去年 DeepSeek 震惊世界,靠的是把成本打到美国同行的几分之一。这一回,西蒙·威利森在博客里写得很直白,K3 是“迄今为止中国 AI 实验室发布的最昂贵模型”。业内估算,它的价格和 Anthropic 的中端模型相当。
听起来像缺点,对吧?中国模型怎么也贵了?
恰恰相反,我认为这才是这次发布真正的分水岭。
过去中国 AI 公司手里的牌,说白了就一张,性价比。一样的活,我便宜,你用我的。这是追赶者的打法,省出来的都是自己的利润空间。而月之暗面这次押的注是,高性能本身就能撑起高定价,尤其在代码开发这种高价值的智能体任务上。
敢定这个价,前提是你真敢跟对方摆在同一张桌上比性能。
从“我更便宜”到“我值这个价”,中间隔着的是底气的代际差。便宜是姿态,贵,且有人买,才是地位。
最后说三点,粗浅看法。
第一,美国的技术封锁叙事,又被打了一个洞。
芯片管制层层加码,出口的口子越收越紧,按某些人的设想,中国 AI 应该被锁死在落后一两年的位置上。结果差距从 1 年缩到几个月。封锁能挡住设备,挡不住工程能力,挡不住人才密度,更挡不住一个 10 亿级用户市场养出来的迭代速度。
这个道理,华盛顿每验证一次,脸就肿一次,然后继续验证下一次。
第二,定价权之战,才刚刚开始。
彭博社点到了要害,OpenAI 和 Anthropic 正被用户抱怨 AI 成本上涨,而一个性能接近、价格更低的开源对手出现,会逼着美国实验室证明自己贵得有道理。这个“证明”,以后会越来越难。闭源的高墙,以前靠的是性能碾压,如今性能被追平,墙就只剩下习惯和品牌了。
习惯这个东西,在开发者圈子里,是最不值钱的护城河。
第三,别急着开香槟,差距还在,而且最硬的骨头还在前面。
K3 很强,但排在前面的还有 Fable 5 和 GPT-5.6,斯托卡说的也是“落后 2 到 3 个月”,不是反超。越是逼近最前沿,每往前挪一步的代价越是指数级上升,前面没有参照物了,每一步都得自己摸。
奥特曼嘴上说着“OpenAI 仍将拥有世界上最好的模型”,心里多半也在打鼓,因为他比谁都清楚,这个“仍将”两个字,保质期正在按月缩短。
17 日那天,硅谷的会议室里大概很安静。所有人都在刷同一个榜单,看同一个名字。
上一次让他们这么安静,是 DeepSeek。这一次,这个名字叫 Kimi。
下一次会是谁,隔多久,没人敢打包票了。这恐怕才是让硅谷真正睡不着的地方。
