WAIC展会的曙光8000展区,这两天几乎被围得水泄不通。所有人都在确认一条刚传出的硬消息:这个十万卡级别的超集群,上线仅仅第一周,就直接满载运转了。
在算力圈,这个操作相当生猛。
很多人不知道,把一万张卡绑在一起干活,故障率会成倍往上翻。哪怕只是机架上的某一张卡稍微卡顿了一下,整个庞大的计算任务可能就得当场停摆,从头再来。要是把规模一口气放大到十万张卡,机器掉链子简直就成了家常便饭。
所以业内有个心照不宣的默契:机房盖得再气派,机器也得收着劲儿用,谁也不敢轻易把负荷拉满,生怕当场暴露问题。
结果曙光8000完全没按套路出牌。刚投产,直接把油门踩到底。
接入超算互联网后,它一口气连上了全国14个省区的30多个超算智算中心。上线第一周,一天就能吞下15万个作业任务,最高峰的时候,一天狂刷50万个。70多个万卡级别的大活儿,直接在上面全线铺开。
前阵子业内总有人抱怨,说各地建了那么多算力中心,最后全在机房里闲着“晒太阳”。现在这么一看,根本不是市场不需要算力。那种真正高端的、能扛住极限测试的硬核算力,从来就不愁没活儿干。
敢在刚通电的第一周就把机器往死里用,考验的早就不是拼凑几块板子的组装能力了。你看这波首周满载的操作,是纯粹为了展会造势,还是彻底扯下了算力圈那块“不敢跑满”的遮羞布?
