昊梵体育网

梁文锋疯了!国产大模型DeepSeek拿到500多亿融资后,梁文锋竟打算不在外面

梁文锋疯了!国产大模型DeepSeek拿到500多亿融资后,梁文锋竟打算不在外面租用算力,而是自己跑到我国内蒙古乌兰察布,砸大钱要修一座超大AI机房,目的只有一个,就是为了多用国产芯片,减少依赖英伟达。

这已经不是多租几排服务器的问题,而是准备把模型、机房、电力和算力调度一起握到自己手里。
 
更值得注意的是钱从哪里来,梁文锋此前完成的首轮融资规模约74亿美元,折合人民币500多亿元。
 
新一轮融资原本还准备按照约5000亿元人民币估值推进,只是7月暂时停了下来,梁文锋现在考虑的显然已经不是一家模型公司该租多少服务器,而是未来几年最核心的算力资产到底归谁控制。
 
很多人工智能公司前期喜欢租云算力,道理很好懂,自己不用盖机房、不用管电力和运维,需要多少就租多少,可模型越大,这种模式越像长期住五星级酒店,刚入住觉得省心,账单拉到几年以后再看,就知道为什么有人开始惦记着自己盖房子了。
 
DeepSeek真正想改变的,就是这种长期被别人拿着钥匙的状态。
 
外媒披露的方案并不是今后一台机器都不租,而是自建大型数据中心的同时继续保留部分外部租赁,这反而更说明问题,短期租赁解决弹性需求,长期核心训练能力逐渐搬进自己的基础设施,两条腿走路,比把全部算力押在云厂商手里稳得多。
 
为什么偏偏挑乌兰察布?这笔账当地早就算明白了。
 
内蒙古能源部门公开材料显示,乌兰察布距离北京直线只有300多公里,数据传输延迟可低至约3.5毫秒,再加上绿电资源丰富、气候冷凉,服务器放在草原上,既能省电费,也不会因为距离远就让模型训练变得慢吞吞。
 
国家发改委此前公布的数据更直观,乌兰察布数据中心利用当地气候条件,可以实现全年超过80%的时间采用新风冷却,年平均电能利用效率低于1.2,对于一天24小时不停发热的服务器来说,冷风可不是天气福利,而是真金白银。
 
人工智能算到最后,拼的不只是芯片,也是在拼谁家的电更便宜。
 
内蒙古公开材料提到,电费可能占算力中心运营成本60%以上,这就解释了为什么1吉瓦级项目会选择能源富集地区,机房规模越大,电价、散热和电网稳定性带来的差距越明显,省下来的每一度电,最后都会变成模型训练可以继续烧下去的底气。
 
这里还有梁文锋更看重的一层,自建超大规模机房,意味着未来适配国产人工智能芯片时拥有更大的主动权,不必完全围着某一种海外芯片的服务器标准转,而可以从网络、集群、存储到模型架构一起优化,国产芯片单卡不够强,就想办法把更多卡组织得更有效率。
 
DeepSeek过去的技术路线本来就在干这种事,它采用混合专家架构,每次计算只调用模型的一部分参数,用软件设计减少不必要的计算量,深度求索自己的论文显示,这套思路能够明显降低训练和推理成本,硬件差距并不意味着只能坐等更好的芯片。
 
所以真正值得看的,不是乌兰察布最后摆进去多少张昇腾、寒武纪或者海光芯片,而是中国大模型企业正在形成一种新的思路,芯片受限制,那就从模型架构、集群互联、电力成本和数据中心建设一起补,单点暂时追不上,就靠整个系统把差距往回拉。
 
DeepSeek官网本身已经把自研训练框架和自建智算集群作为技术能力展示,招聘页面如今又直接出现乌兰察布的数据中心岗位,这说明它已经不满足于只做模型软件,而是在往真正掌握底层基础设施的方向走。
 
梁文锋这一步真正狠的地方就在这里,美国限制高端芯片,本来想卡住中国人工智能往上冲的速度,可中国企业现在正在琢磨的已经不是还能买多少,而是没有无限供应的海外高端芯片以后,怎么照样把自己的算力体系搭起来。
 
能不能成功还要看建设和芯片适配,可方向已经很清楚,模型自己做,集群自己调,机房自己建,电力成本自己算,国产芯片能用多少就把系统潜力榨出多少。
 
中国人工智能真正想争的,已经不只是一个模型排名,而是一套不容易被别人拔掉电源的算力底座。

以上是小编个人看法,如果您有更好的见解欢迎在评论区留言,方便大家一同探讨。