昊梵体育网

谁能想到,全球AI圈炸锅的源头,竟然来自一家中国公司。 2026年7月16日深

谁能想到,全球AI圈炸锅的源头,竟然来自一家中国公司。

2026年7月16日深夜,月之暗面在上海发布了新一代大模型Kimi K3,参数规模2.8万亿,100万Token上下文窗口,原生支持视觉理解,这几个数字一出来,整个硅谷的灯估计亮了一整夜。

消息传出的第二天,美股盘前纳斯达克100指数期货一度跌逾1.8%,英伟达等AI龙头普遍走低。市场的条件反射不难理解,2025年初DeepSeek R1发布时,算力股就经历过一轮急跌。但这次华尔街的反应更直接:彭博社报道称,Kimi K3的表现正在动摇“美国尖端AI技术仍明显领先中国”的固有认知。

先看看这款模型到底什么来头,Kimi K3在加州大学伯克利分校创建的Frontend Code Arena编程榜单上,以1679分的成绩登顶榜首,超过了Anthropic的Claude Fable 5(1631分)和OpenAI的GPT-5.6 Sol(1618分)。这是开源模型首次在该榜单上超越全部海外闭源模型登顶。

而且Kimi上一代K2.6在同一榜单只排第18名,新模型一代之内跃升了17个名次。在七个前端编程细分类别中,K3拿下了六个第一。

在Artificial Analysis智能指数上,K3得分57分,综合能力仅次于Claude Fable 5的60分和GPT-5.6 Sol的59分。美国加州大学伯克利分校计算机科学教授斯托伊卡表示:“过去我们一直认为中国的开源模型大约落后最先进模型6到9个月。而现在,这种差距可能已经缩小到2到3个月。”

技术上的突破才是根本,Kimi K3采用自研KDA混合线性注意力机制与注意力残差技术。整个模型设置了896个独立专家模块,单次推理只激活16个单元。算力使用效率较前代提升了2.5倍。

更惊人的是,在Kimi披露的早期概念验证中,K3曾自主运行48小时,仅依靠开源EDA工具和Nangate 45nm工艺库,独立完成了一款专门用于运行其自身Nano模型的芯片构建、优化与验证。

埃隆·马斯克第一时间在相关评测报道评论区留言,“令人印象深刻”,这已经不是他第一次注意到这家中国公司。今年3月,月之暗面发布《Attention Residuals》论文时,马斯克就转发并评论:“Kimi的工作令人印象深刻。”当时月之暗面官方幽默回应:“你的火箭造得也不错!”

但这次不一样,7月18日,马斯克在社交平台X上宣布,xAI正在训练参数规模达2万亿的Grok 4.6大模型,计划一周内完成首轮完整训练。他直言不讳地说:“它有可能超越Kimi。”措辞直白,把Kimi列成了明确要追赶的目标。

月之暗面官方微博直接@ElonMusk回应:“欢迎加入‘2万亿+’俱乐部。”月之暗面企业业务负责人黄震昕后来补充:“可能这次K3的表现让他们得到一点震撼的感觉。现在拭目以待,希望他们出来跟我们掰一掰手腕。”一个中国开源模型让硅谷最著名的科技狂人公开喊话要“超越”,这件事本身已经说明了很多。

价格方面同样值得关注,Kimi K3的API定价为每百万输入Token3美元、每百万输出Token15美元。对比来看,Claude Fable 5是输入10美元、输出50美元;GPT-5.6 Sol是输入5美元、输出30美元。K3的定价大概是Fable 5的三分之一,相当于GPT-5.6 Sol的60%。

按Artificial Analysis口径综合测算,K3每项任务成本约0.94美元,比Claude Fable 5的2.75美元低了65%以上。用更低的成本接近甚至在某些领域超越全球最顶尖的闭源模型,这条路一旦走通,硅谷数千亿美元砸在算力上的商业模式,恐怕要重新算账了。

摩根士丹利评价称,Kimi K3证明中国大模型在模型规模、性能、定价层面对美国头部模型实现“全方位追赶”。高盛研报则指出,Kimi K3标志着中国模型走向定价权的全新节点。

但热闹背后也有隐忧,Kimi K3发布后用户请求量远超预估,7月20日,月之暗面宣布暂停C端新用户付费订阅,将已有算力全部投入服务已订阅用户。一款国产大模型因为需求过载主动限流,这在行业里确实罕见。

中信建投将此次发布定义为“另一个DeepSeek时刻”,中国大模型第一次以竞争威胁身份进入全球叙事。上一次是2025年1月DeepSeek发布R1。时隔一年半,中国AI又给了世界一次震动。
从追赶者变成被追赶的对象,这个转变来得比所有人预想的都快。