国产模型高端化的拐点
1、Kimi K3模型发布整体情况从昨天晚上开始,无论是外网还是国内很多体验到的用户,对这个模型所展现出来的能力,已经有了相对较高的评价。我们简单跟进一下情况。
首先,从定价角度来理解Kimi K3模型。过去一两个月,市场一直担心大模型降价和激烈竞争。大家看到GPT 5.6虽然不完全是绝对意义上的降价,但它分了三个档次,最低档输出价格已经干到了6美元左右。所以这段时间,我们观察各种新模型的定价策略,总体来说大家都有点跟随策略,至少不太会涨价,或者做分层定价,这是海外模型公司干的事。
但昨天第一个让大家非常冲击的点,就是Kimi的价格做到了输入3美元、输出15美元。 我们之前大概分析过,国产模型每百万token的输出价格差不多在几毛到5块钱人民币左右,但Kimi K3一次性的把输出价格做到了15美元。在海外,比如Fable 5、GPT 5.6的最高级版本,输出价格在30到50美元之间。但国产模型之前没有人在双位数定价,Kimi K3是第一个将国产模型定价直接给到双位数的。
更重要的是,在大家都认为降价或至少分层定价的大背景下,Kimi给了这么大一个价格提升——它之前的K2.6、K2.7版本定价在4块钱每百万token输出,这次翻了接近4倍,相较于中国模型惯常的定价也翻了3倍以上。从定价角度,就让大家非常有好奇心:它为什么有这么大的底气,在降价叙事下给到这么高的定价?简单来说,Kimi就像海外的SotA 一样,并不是一个纯粹想走低价模型逻辑的,它想做的是一个高端产品。
2、Kimi K3模型核心能力首先,它是一个2.8万亿参数MoE架构的模型,激活参数在40B以上。 如果用最简单的指标——激活参数来看,它现在是国内激活参数量最大的模型,这是它最简单的一个底气来源。其次,这个2.8万亿参数的模型,还拥有原生的视觉理解能力和百万token的上下文窗口。
同时,它是全球首个开源的三万亿级别模型,面向长程编程、知识工作和推理前沿场景而设计。从它对自己的描述来看,想做的这几个事情,也是目前模型领域变现能力最强的几个方向。长程编程、知识工作和推理前沿,这些前沿智能场景,就是目前国产最贵模型想要做的事情。那么,这个模型整体体验下来,大概在什么水平?
从它自己的推文中可以看到,目前只是略微落后于最强的两个闭源模型——Fable 5和GPT 5.6的最高级版本。但我们自己体验下来,它大致和GPT 5.6的中档版本(Terra版本)以及Opus 4.8处于同一水平线。我们自己做了一些新任务,比如网页开发、3D游戏设计等,它的交付质量是在GPT 5.6的Terra版和Opus 4.8这个水平之上的。所以简单来说,它之所以有这么强的信心做定价,本质也是因为对自己模型的信心。
3、Kimi Works产品生态Kimi K3里有一个叫Kimi Works的功能。从我们体验来看,它基本上可以当成一个在国内不需要翻墙就能用的Codex。这里面既包含了模型能力,也包含了它的Harness能力。
首先,Kimi Works有很丰富的插件, 通过浏览器可以做控制,原生封装了万得、WPS、同花顺等插件,无论是金融还是办公场景都做了非常好的适配。这种插件的丰富度,对Kimi Works是一个很大的使用增量。
其次,它设置了目标模式(Loop机制), 简单来说,你给它下一个任务或目标,它会不断去做,无限接近这个目标想要做的事情。
第三,它还有一个面板功能, 你可以在桌面设计很多小组件,比如今天的Todo List、每日简报等。整体来看,在Kimi Works上,用户界面和可操作性的自主性非常强。简单来说,这个模型不仅是参数量大、定价贵,也仍然考虑了用户的使用体验。 在国内不翻墙,但又想用到类似Codex或上周更新的GPT Works这样的产品,我相信Kimi Works是一个非常非常好的国内平替。
4、Kimi公司战略转型与行业意义我们今年6月发过关于Kimi K3的报告,梳理了这家公司的发展历史,会发现它潜藏了很多成为国产第一梯队模型的特点。2024年,这个公司做了很多流量采买, 因为当时Kimi的小程序在市场上非常火,拥有20万字以上的长上下文解析能力。
但在2025年,它基本上把这些C端产品的买量全停掉了, 用户量一直在下滑。但你会发现这个公司很沉得住气,它发现C端可能不是AI接下来唯一的场景,或者是最有增量价值的场景。它曾经在C端成功过,很快就把买量停下来了。2025年在市场上感觉没什么声音,大家不知道他们在做什么,其实他们在2025年7月攻克了万亿参数模型训练的工程化卡点。
现在这个K3,其实就是去年一系列转型和用户流失的成果,某种意义上是一种资源聚焦和能力聚焦的必然结果。上周我们看到,海外最高端的模型已经立住了,Fable 5和GPT 5.6,剩下的公司做的是有点二线的模型。国内其实已经有了好几家对标海外二线的模型,现在有公司跳出来要做国内的Fable 5模型。
虽然Kimi K3现在还差一点,但我相信国产模型和海外模型中间的差距一定在持续缩小。当下,大模型领域是整个AI产业跳动的心脏核心, 决定了上游硬件的资本开支和下游应用的发展。对于大模型整体的演进和变化,尤其是国产模型能力的提升,我认为可以保持非常积极和乐观的状态。
5、下游AI应用的观点站在现在这个时间点,大家看到海外和国产大模型的能力提升和分层定价,价和质都在持续提升。在这个时间点,可以花一点时间去关注应用端。很长一段时间,大家担忧的是:大模型会不会替代你?以及大模型很贵,下游应用公司用不上或用不起,没法大规模做应用。
但现在,有了更便宜的大模型,有了大模型能力的提升,你想要量还是想要更便宜的价格,都能选到相应的模型。所以,在下游应用侧,接下来可能大家能看到各家公司推出更丰富的应用。
在这个层面,我们认为首先可以关注两个最大的权重公司:tx和阿里。 它们不是纯粹的应用公司,自己也有模型,阿里可能接下来会发千问3.8,tx的wb里也直接接入了Kimi的模型。
在偏软的领域,可以先配大公司。其次,我们能看到一些中型公司最近动作很密集, 比如阅文在做短剧产业链布局,其他公司也在持续做。很长一段时间,大家对下游应用基本不闻不问,但我觉得现在这个阶段,无论是tx、阿里,还是更垂直、更纯粹的应用公司,都是值得关注的。