Moonshot 开源 Kimi K3 权重,智能指数 57 分登顶开源模型榜
[权重落地] Moonshot 把 2.8 万亿参数的 Kimi K3 权重放了出来,据评测机构 Artificial Analysis 官方发布的智能指数,它拿到 57 分、就此坐上开源模型头把交椅,与领先闭源模型的差距收窄到 4 分——按该机构口径,这是开源与闭源之间有史以来最窄的一次。权重附带一份自拟的「Kimi K3 License」,被该机构归类为「商用受限」。
[窄到 4 分] 拆开榜单看位次会更清楚:Artificial Analysis 给出的 57.1 分排在 Claude Fable 5 与 GPT-5.6 Sol 之后(两者分别为 59.9 和 58.9),与 Opus 4.8、GPT-5.5 同一档。参数规模是它另一个记号——2.8 万亿比 DeepSeek V4-Pro 的 1.6 万亿高出约七成,是目前公开权重的模型里最大的一个,上下文窗口 100 万 token。代理任务上,该机构测得 K3 在 GDPval v2 拿到 Elo 1668,较上一代 K2.6 的 1190 抬升近 400 分。第三方实测还给出两个细节:研究者称它的 KV cache 经济性仅次于 DeepSeek V4,而 K3 Max 在 Arena 的全栈编码测试里排到第一,压过 GPT-5.6 Sol(xHigh)和 Claude Fable 5。许可证一栏则埋了钩子:据该机构解读,年收入超过 2000 万美元的模型即服务厂商须另行与 Moonshot 签协议才能托管。
[自建这笔账] 这份许可证把开源的受益人划得很清楚。大厂托管商想直接把 K3 变成自家 API 卖,绕不开 Moonshot 那张桌子;白拿的是自建推理的企业团队,他们现在能在自己机房里跑一个只落后头部三四分的模型。但账不止一笔——2.8 万亿参数决定了部署它要押上多少张卡,据从业者公开估算,跑 K3 大约要 20 张 H100,而 DeepSeek V4 Pro 只要八张。所以接下来要看的是,愿意为这 4 分差距多养一倍硬件的团队究竟有多少。
▮ SIGNAL 开源追平的那部分是分数,没追平的是把分数跑起来的电费。