还是梁文锋够意思!DeepSeek 16万颗大单力挺华为,这才是国产大模型该有的担当,其他大模型厂商还是要学习一下,虽然目前DeepSeek只把昇腾910系列用于推理,训练卡的还是英伟达的,之所以训练还是用英伟达的,主要是被CUDA软件生态卡着了,过渡切换还要点时间,但是拿下推理,也拿下了未来,因为训练是一次性工程,推理是每天烧的运营成本,用黄仁勋的判断来看,那就是未来推理的规模将是训练的十亿倍。

还是梁文锋够意思!DeepSeek 16万颗大单力挺华为,这才是国产大模型该有的担当,其他大模型厂商还是要学习一下,虽然目前DeepSeek只把昇腾910系列用于推理,训练卡的还是英伟达的,之所以训练还是用英伟达的,主要是被CUDA软件生态卡着了,过渡切换还要点时间,但是拿下推理,也拿下了未来,因为训练是一次性工程,推理是每天烧的运营成本,用黄仁勋的判断来看,那就是未来推理的规模将是训练的十亿倍。

评论列表