笑了,张一鸣把大模型的捷径焊死了,疑似为了防美国?最近外媒报道,张一鸣给大模型业务划红线,禁止员工蒸馏美国AI模型,字节也不会把蒸馏当作提升大模型能力的捷径,哪怕短期落后同行。
不知道消息来源是否可靠,目前都是匿名爆料和外媒报道,尚未得到字节跳动官方证实。但说实话,还是挺意外的,因为蒸馏本身就是常规训练技术,不管是蒸馏公开知识还是自有平台数据,都是正常研发手段。
最现实的问题是,模型蒸馏能省大量时间,也是现在行业心照不宣的捷径。小公司靠它快速追平进度,大厂也能不断刷榜单成绩。
但站在字节的角度,其实也能理解,字节海外业务铺的太大,这几年更是有点如履薄冰了,万一哪天又因为模型蒸馏的事被找茬,很可能给整个海外业务惹麻烦。要知道,过去一段时间Anthropic已接连公开点名四家中国AI公司对其Claude模型进行大规模蒸馏攻击。所以,张一鸣主张长期主义,其实还是看的长远。
