科技媒体The Information近日报道,谷歌正在开发一款名为“Frozen”(或Frozen v2)的新型服务器芯片,核心思路是将部分Gemini AI模型的决策逻辑和权重相关设置直接“烘焙”进硬件。
这一设计与近期崛起的AI芯片初创公司Taalas的技术路径高度相似,旨在解决谷歌当前面临的AI算力紧张问题,同时换取显著的性能与能效提升。
根据报道,该项目并非要取代谷歌现有的张量处理单元(TPU),而是打造一个新的芯片分支。
就像英伟达GPU目前广泛用于多种AI模型一样,现有TPU需要为不同模型进行大量动态决策和数据搬运,导致效率损耗。而Frozen芯片则会将Gemini模型的部分关键决策“内置”到硅片中,从而减少芯片运行时的计算步骤和数据移动量。
预计性能提升显著。报道称,新芯片的能效预计比谷歌当前TPU高出6至10倍。这不仅能让Gemini模型响应查询更快,还可能催生全新的AI应用场景。
不过,这一设计也意味着谷歌对当前Gemini模型架构的“押注”—只有后续Gemini版本保持相同底层架构时,该芯片才能继续使用。谷歌仍保留一定灵活性,其可以对芯片进行更新,包括通过调整模型权重来利用新的训练成果。
但整体而言,这是一次从“通用灵活”向“专用高效”的战略转变。科技AI
