Kimi K3引发算力逻辑讨论 Kimi K3发布那天,市场吓得半导体股集体跳水,理由是这模型效率太高,以后不用囤那么多算力了。
结果48小时后,月之暗面自己扛不住了,直接宣布暂停新用户订阅,理由是算力不够用。
同一个模型,两种完全相反的解读。
一开始大家看到的是KDA混合线性注意力机制,觉得这套架构省了缓存传输,顺手就把GPU、显存、带宽的需求也一起省掉了,股票市场立刻按算力不需要了来定价,跌得干脆利落,那几天唱衰算力股的分析师,语气笃定得很。
可拆开看这模型才发现,2.8万亿参数这身家当,自己就得占1.5TB以上的存储空间,留给临时数据的地方没剩多少,只能往别的硬盘上搬。模型内部又分成大几百个小模块,干活时得互相传数据,量比想象中大得多,省下来的那点传输空间,全被这套内部沟通吃回去了。真要跑起来,一台机器根本扛不住,得六十多张显卡拼在一起才够用。
效率是真提上去了,可需求没降,反而被顶得更高。
为什么会这样。
因为效率从来不是拿来省资源的,是拿来放大需求的。价格降下来一点,愿意用的人就多一截,用的场景就宽一圈,总盘子只会越滚越大,不会缩水。这套逻辑经济学里早有名字,杰文斯悖论,蒸汽机效率提上去,煤没少烧,反而烧得更多。
带团队、抓运营的时候,你是不是也犯过这个判断。
把一个流程提效了,就以为团队能歇口气,结果订单量跟着涨上来,人反而比以前更忙。省下来的时间,从来不是拿来歇着的,是拿来接更多活的。
以为效率是关水龙头,其实效率是拆大水管,管子越粗,接水的人越多,那口井永远不够深。