
观点网讯:7月21日,英伟达发文表示,VeraRubin正在全面量产。这款机架级AI超级计算机整合了七款共同设计的芯片,将驱动下一代MistralCompute和Microsoft欧洲AI基础设施,搭载数万块GPU。
同日,英伟达发布了新一代Spectrum-6以太网交换系统,用于支持基于VeraRubin平台的超大规模AI基础设施。该系统单交换容量达102.4Tbps,是上一代产品的两倍,旨在连接大规模GPU和CPU,为大规模AI训练、智能体应用及推理任务提供网络支持。CoreWeave、微软、Nebius、SpaceXAI和特斯拉等AI基础设施建设者将成为首批部署用户。
英伟达还宣布,CoreWeave、谷歌云、微软Azure和甲骨文云等已开始采用VeraRubinNVL72系统。据CoreWeave测试显示,VeraRubinNVL72相比GraceBlackwellNVL72,每兆瓦可实现10倍Token吞吐提升。该平台整合VeraCPU、RubinGPU、NVLink6、ConnectX-9SuperNIC、BlueField-4DPU及Spectrum-6交换系统,旨在提升AI训练和推理效率。英伟达表示,VeraRubin已覆盖全球350多个工厂节点、30个国家。
在CPU方面,英伟达发布了数据中心CPUVera的新信息,包括规格参数、基准测试和架构信息。英伟达代表表示,Vera芯片已于6月交付给OpenAI、Anthropic和SpaceX等客户。AI云平台DeepInfra的基准测试显示,VeraCPU在AI智能体工作负载下可实现最高2.2倍编排速度提升,并支持最高1.6倍更多智能体并发运行。DeepInfra平台每周处理近5万亿Token,其中约30%来自智能体应用。英伟达称,随着AI智能体承担更多推理、规划和工具调用任务,CPU在模型调用过程中的调度效率将成为AI基础设施性能的重要因素。