昊梵体育网

【Kimi K3是什么?为什么美国对此如此不安?】(CNN)还记得DeepSee

【Kimi K3是什么?为什么美国对此如此不安?】

(CNN)还记得DeepSeek吗?这家中国人工智能初创公司凭借其训练成本仅为顶尖竞争对手一小部分、性能却几乎与其持平的模型,曾让美国科技界为之震动。中国或许再次做到了。

最近引起轰动的这款中国AI模型,是由一家名不见经传的初创公司Moonshot AI开发的。发布仅两天后,由于需求远超其计算能力,Moonshot便暂停了新用户订阅。

人们对Moonshot的Kimi K3模型表现出意想不到的热情,原因在于它能够免费媲美——甚至在某些情况下超越——美国最先进的竞争对手,例如OpenAI的GPT最新版本和Anthropic的Claude。

如今,Moonshot的崛起正加剧中美两国在争夺尖端人工智能主导权方面本已充满争议的竞争。近年来,华盛顿不断加强对中国的出口限制,旨在遏制中国在人工智能和芯片领域的发展,因为这些技术可能被用于军事领域。

Kimi K3发布后,美国官员和Anthropic公司再次指责Moonshot对美国模型进行了“蒸馏”——即利用另一个AI模型的输出结果来训练新模型。Moonshot对此予以否认。

尽管如此,美国企业及政府官员中蔓延的担忧凸显了这场人工智能竞争的利害关系,以及它对经济、国防和国家安全产生的深远影响。

更广泛地说,Kimi K3的性能再次引发了人们对华盛顿技术出口限制有效性的质疑。这一新模型还挑战了业界的一种普遍看法,即尖端人工智能需要对数据中心以及美国已限制获取的高端芯片进行巨额投入。

与大多数美国专有模型不同,Kimi K3是以开放式模型的形式发布的。这使得开发者可以免费下载、修改并在自己的服务器上运行该模型,从而使其更易于被采用,并在全球范围内拥有更广阔的市场。

与美国企业相比,中国在人工智能硬件和投资方面受到限制,因此中国拥抱了所谓的开放模型,这与主要依靠付费订阅模式的美国竞争对手形成了鲜明对比。

“许多组织重视自主托管开放模型的能力,这使他们能够保留对敏感数据的控制权,而不是完全依赖封闭模型提供商,”金融服务公司晨星(Morningstar)的高级股票分析师切尔西·谭(Chelsey Tam)表示。

——中国最新的人工智能突破背后是谁?

Moonshot AI 由杨植麟于三年前创立,他是一位来自中国东南沿海城市汕头的、年仅三十出头、前途无量的软件工程师。

早在中国最顶尖的工程学府——清华大学求学期间,他就展现出了非凡的潜力。当时他的导师是唐杰教授,后者于2019年创立了另一家知名人工智能初创公司Z.ai。

“他是我近年来遇到的最有才华、最杰出的学生,”唐杰在2014年为杨推荐奖学金时说道。

随后,杨前往卡内基梅隆大学攻读计算机科学博士学位,师从曾任Meta和苹果公司人工智能高管的鲁斯兰·萨拉胡特迪诺夫。萨拉胡特迪诺夫回忆说,在学业结束时,杨婉拒了苹果公司一位直接向蒂姆·库克汇报的高管发出的工作邀请。

“我记得他曾对我说,如果他不至少尝试一下创办自己的公司,他会后悔一辈子。我尊重这种态度,而且他是对的,”萨拉胡特迪诺夫在X平台的一篇帖子中写道。

杨后来表示,这一决定主要基于两点考虑。“首先是环境。我们看到了巨大的机遇,从政府和风险投资的支持,到中国过去几十年在教育领域取得的进步,所有这些都为人工智能初创企业创造了有利条件,”他在2024年接受官方媒体采访时说道。“其次,我们相信人工智能蕴藏着巨大的机遇。”

杨在中国的人工智能行业脱颖而出,不仅因为他在32岁时创立了Moonshot,成为中国最年轻的人工智能企业家之一,还因为他选择回到中国创办自己的公司。

从一开始,杨就怀揣着远大抱负。他在2024年的一期播客中透露,公司名称致敬了他最喜欢的英国摇滚乐队平克·弗洛伊德(Pink Floyd)的专辑《月之暗面》(Dark Side of the Moon),希望公司能“成就一件既能创造巨大价值、又极其困难的事——就像登月一样。”

2023年,Moonshot发布了首款以杨的英文名命名的“Kimi”模型后,迅速声名鹊起。据2024年接受中国媒体采访时透露,同年,Moonshot在前两轮融资中筹集了近3亿美元。

——这又是一个“DeepSeek时刻”吗?

Kimi K3引发的国际关注,让人联想到2025年初DeepSeek的崛起——当时其R1推理模型曾在全球人工智能界掀起轩然大波。

此次,K3在多项基准测试中展现出了接近OpenAI的GPT 5.6 Sol和Anthropic的Claude Fable 5等前沿系统的性能,进一步缩小了中美AI模型之间的差距。

但分析人士表示,应从不同角度看待Moonshot取得的成就。

DeepSeek 挑战了“开发先进 AI 模型需要巨额资金投入和海量计算能力”这一传统观念,并提供了极具竞争力的定价。

但晨星(Morningstar)董事伊万·苏(Ivan Su)指出,与前沿模型相比,K3 的价格优势远小于 R1 刚推出时的水平,这表明其成本优势可能不如 DeepSeek 显著。

“K3所展现的是,中国企业正在延续DeepSeek的成功,并不断缩小中美人工智能模型之间的差距,”时事通讯《Hello China Tech》的分析师兼创始人赵波表示。

“其更广泛的意义在于,DeepSeek越来越像是一种趋势的开端,”他说,“DeepSeek曾令人意外。而K3则证明,中国的进步正变得越来越具有可重复性。”

自DeepSeek问世以来,Moonshot、阿里巴巴和Z.ai等中国人工智能企业推出的每一款新模型都备受关注,且发布节奏正在加快。

市场分析公司Counterpoint Research的首席人工智能分析师魏孙表示,随着K3的推出,中美模型之间的总体差距已缩小至3至6个月,尽管不同任务之间的差距差异显著。

不过,其他分析师对K3的实际能力仍持保留态度。

晨星公司高级股票分析师马利克·艾哈迈德·汗在上周五的一份研究报告中表示:“虽然K3代表了一定的进步,但我们不敢断言它在实际任务中已与Fable 5等美国前沿模型基本持平。”他解释道,过去许多开源模型开发者曾围绕基准测试对软件性能进行优化,以获得更好的结果。

——这对美国构成威胁吗?

对于美国科技公司而言,像K3这样价格低廉且性能相当的中国模型,可能会削弱其自身产品的竞争力。

美国领先的人工智能公司Anthropic和OpenAI长期以来一直指责包括Moonshot、DeepSeek和阿里巴巴在内的中国实验室从其模型中提取能力。随着K3的推出,这些指控愈演愈烈。

Moonshot AI企业业务负责人黄振新周一在接受官方媒体采访时,否认了有关“模型蒸馏”的指控。

“我们掌握的信息显示,Moonshot AI 为开发其 K3 模型而对 Anthropic 的 Fable 模型进行了技术提炼,”白宫科技政策办公室主任迈克尔·克拉齐奥斯(Michael Kratsios)周三在 X 平台的一篇帖子中表示。“这种旨在窃取美国专有技术并破坏美国研究的大规模、隐蔽的工业技术提炼行为是不可接受的。”

Anthropic政策主管莎拉·赫克在X平台的一篇帖子中呼应了克拉齐奥斯的观点,指责Moonshot从事“知识产权盗窃和工业间谍活动”,称其为“造成严重国家安全风险的国家挑战”。

CNN已联系Moonshot公司寻求置评。

美国财政部长斯科特·贝森特周三也重申,美国可能会因此类知识产权“盗窃”行为对中国企业实施制裁,但未点名提及Moonshot或其他公司。

“当中国企业实施隐蔽的、工业规模的‘蒸馏’攻击,且这种行为越界构成知识产权盗窃时,制裁和列入实体清单的措施将被提上议程,”他在X平台上表示。

然而,大多数分析师认为,针对Moonshot的“知识蒸馏”指控不太可能成立。

Counterpoint的孙女士表示,Moonshot没有足够的时间利用竞争对手的最新模型来训练其AI模型,因为在K3发布之前,这些模型的获取渠道十分有限。她补充道,仅靠“知识蒸馏”无法解释Kimi K3的卓越表现。

“这一时间线难以令人信服,”她说。