昊梵体育网

西方:卡算力,饿死中国AI! 没想到中国把1024张卡先连成一台巨型电脑,最高还

西方:卡算力,饿死中国AI!
没想到中国把1024张卡先连成一台巨型电脑,最高还要扩到8192张;这场算力较量最反常的地方,不是谁单卡更强,而是谁先把整套系统跑起来,真正悬念才刚刚出现。

西方卡住高端芯片,中国把算力战换了打法:1024张卡先像一台电脑协同,最高还要扩到8192张
2026年7月20日,世界人工智能大会闭幕。展馆里最值得看的,不是某一张芯片跑出了多高的数字,而是一排排连在一起的机柜。

中国证券报当天披露,华为现场展出的昇腾950超节点真机,让1024张处理卡高速互联,逻辑上像一台计算机协同工作。很多人随即把它概括成“8192张卡捏成一台电脑”,但准确说法是:现场真机规模是1024卡,整套系统最高规划支持8192卡,按华为公布的时间表,满配产品要到2026年第四季度上市。

这处差别不能含糊,因为它决定我们是在看一件已经完成的产品,还是在看一条正在兑现的技术路线。可即便把数字说准,这件事仍然值得重视。美国商务部工业与安全局2025年5月撤销一项人工智能扩散规则时,同时宣布加强芯片相关出口管制,并专门提示使用部分中国先进计算芯片的风险。
由此可见,围绕高端算力的限制并没有消失,只是政策工具在调整。中国企业面对的现实也很直接:单张芯片暂时难以在所有指标上追平,就必须想办法把更多芯片组织得更有效率。

我认为,真正的变化不是“卡不够就多堆几张”,而是算力竞争的评分标准正在变。过去大家盯着单卡峰值,好比只看一名运动员能跑多快;现在训练和推理面对的是超大模型、超长文本和海量并发,决定结果的往往不是某张卡的最好成绩,而是上千张卡能不能少等待、少掉线、少重复搬运数据,最终稳定产出多少有用结果。

单卡很强,彼此通信却堵在路上,昂贵设备照样会大量空转。

这就是“像一台电脑”的真正含义。鹏城实验室和全球计算联盟在2026年世界人工智能大会期间发布的《超节点定义与实践白皮书》,把跨物理节点的统一内存编址列为核心特征,同时强调低时延和大带宽。

说得通俗一点,过去每个机柜更像各管各的仓库,程序要反复询问数据放在哪里,再经过网络搬来搬去;统一编址之后,软件看到的是一个更大的资源空间,调度更直接,通信损耗也可能下降。

但我并不赞成把8192这个数字直接当成“已经赢了”。机器越大,麻烦也会跟着放大。华为2025年9月公布的方案显示,满配系统由160个机柜组成,占地约1000平方米。卡越多,任何一处光模块、线路、散热设备或软件调度出现问题,都可能拖累整个任务。

7月20日消息,高密度机柜带来的供电、散热、承重和布线压力明显上升。把8192张卡装进去只是第一关,让它们连续数周稳定训练、不因局部故障全盘停工,才是更难的一关。

这也解释了为什么全球头部企业都在做“整机系统”,而不是只卖孤零零的芯片。英伟达2026年1月发布的鲁宾七十二卡系统,同样强调让整个机架作为统一加速平台运行。
路线不同,方向却很接近:芯片、互联、内存、散热、软件和调度必须一起设计。换句话说,中国不是突然发明了“多卡协同”这个概念,而是在受限条件下,把系统规模推得更激进,希望用更大的统一计算域补偿单卡和制造环节的不足。

在我看来,这场较量接下来影响最大的,首先不是普通消费者,而是云计算企业、模型公司和数据中心。客户不会因为机柜看起来壮观就掏钱,他们最终看的是训练一次要花多少钱,生成同样数量的有效内容要耗多少电,故障后多久能恢复,原有程序迁移过去是否麻烦。

若一套设备总算力很大,却需要长期调试、软件适配困难、利用率上不去,那么账面数字再漂亮,也很难转化成市场份额。

这里还有一个容易被忽略的误区:不能拿8192和72直接做除法,然后宣布谁领先几十倍。一个强调跨越大量机柜形成更大的统一计算域,另一个强调单机架密度、性能功耗和成熟生态,口径并不相同。真正公平的比较,应放到同一个模型、同一种精度、同样电力和运行时长下,看谁完成任务更快、成本更低。

反过来看,一旦超节点真正跑通,受益的也不只是某一家芯片企业。高速光互联、液冷、电源、存储、运维软件都会被带起来,国产模型企业也可能得到更稳定的算力选择。

我认为,这件事最值得普通人看懂的,不是谁用一句狠话压过了谁,而是外部限制常常会逼着后来者改换赛道。

别人把竞争锁定在单张芯片上,中国企业便尝试把芯片、网络、软件和机房重新拼成一个整体。这条路未必轻松,也不能掩盖单卡、制造和生态上的差距,但它至少说明,技术竞争从来不只有一张考卷。

真正可靠的底气,不是宣布已经反超,而是在限制存在时仍能找到替代方案,再用产品、成本和客户把方案做实。你觉得未来算力竞争更重要的是单卡性能,还是整套系统的稳定效率?