小鹏 VLA2.0 蒸馏版体验(后半段有比较长的技术分析)
车型: G9L Max,单颗图灵,软件版本6.3
小鹏公关这一点比别家要强,各个版本的车都能找来,而不是“老师我们只有顶配版”;媒体们体验的倒都是顶配,可消费者买的是吗?
双图灵的6.3我们之前已经体验过了,模型智商非常高,而且没装激光雷达,纯靠视觉干到顶尖水平
但是单颗图灵的Max版体验会如何呢?小鹏会不会随便蒸了个版本出来乱跑?
反正就我这几天体验而言,水平跟双图灵版本没有什么差别
比较考验模型智商的极端路况,比如说绕行施工路,绕行障碍车,绕行事故现场......都做得非常好,通行效率拉满
在安全感上,也强于绝大多数激光雷达车型,我开到现在还没有一次惊吓时刻,哪怕是拥堵博弈也不吓人,不会赌旁边的车一定让行
而特别考验厂家是否花费资源的舒适性上,纵向的加减速,和横向的转向变道,都明显看得出来花了大量人力去调教,尤其是刹车点头的情况控制的很好
如果说问题的话,那其实目前只发现两点:偶发性红绿灯前排错队,地面标线被遮挡之后,直行进了左转道;偶发性转弯之后直行,特别靠右,大概花了10秒钟自我纠正。
这里给一个结论——“哪怕是1颗图灵的小鹏,我也没发现国内有哪一款车能在智驾上明显超过它”
当然,可能因为我不具备严格的控制变量实验条件,我的确没感觉出来一颗图灵和两颗图灵的版本有什么特别大的区别
我这不是黑小鹏啊,我觉得这符合当前模型发展的科学规律——智驾模型毕竟是小模型,参数量做到5个B已经很了不起了;可能小鹏比别家更大一点,我们往大了算,10个B以上?
那么蒸馏出来的模型,参数量往极端小了说,也就是3-5个B,我认为在日常城市行车当中不会以体现巨大的差距
所以我给个一句话结论——“只要智驾模型本体不发生大变动,短期内1/2个芯片差异很微小”
我觉得小鹏还是非常用心去做了图灵单芯片蒸馏版的,这一点值得各家竞品去学习;用户是少花了钱,但不意味着智驾团队就可以少花资源
那这里很多买了双图灵甚至3图灵的朋友就得炸锅了:“合着我白花钱了?”
我知道你很急,但你先别急首先小鹏在智驾上最高配置其实就是双图灵,三图灵是在座舱里面多了一颗,并不用于智能驾驶
然后我上面的结论其实有个前提,那就是模型本体不发生大变动
先来看一下新势力智驾硬件的发展,我觉得双Orin X那一代,大家并没有摸到双芯片的智驾到底要怎么搞:因为Nvidia也是赶鸭子上架,芯片互联做得很不成熟,芯片架构也比较老,模型并不能很好地利用双芯算力
直到大家都开始做自研芯片,才开始摸索怎么利用双芯架构;这中间涉及到两颗芯片的互联设计,也涉及到模型在软件层面的配合
而且小鹏还要面临大破大立的问题,第1代VLA其实修修补补到了极限,刘先明半路接手搞的VLA2.0等于是推倒重来了
所以他首先要在6.1版本上把软件跑起来,然后6.2到6.3一路迭代,证明全新模型的领先性
边开车边修车,再结合严格的时间节点,做到这样已经是人力极限,我并不认为小鹏的软件团队已经挖干净了两颗图灵的潜力
所以只要VLA 2.0没有再度推翻重来,1/2颗图灵的车型在最近这一年应该不会有本质差别,低配用户确实赚到
但是高配用户别急一年之后可就说不准了
刘先明是25年中那段时间,火线接手烂摊子,花了半年时间整理团队,重构技术底层;去年12月出了比较不错的内部测试版,但是他不满意,摁着脑袋改到今年过年之后才发,最近这半年才是正常迭代
从我自己的感受来看,6.1到6.3已经算是非常大的版本迭代;那么哪怕线性外推,一年之后刘先明至少会干出2到3个大版本,到时候单颗芯片恐怕就撑不住了
随着参数量拉大,对内存带宽和总内存容量的要求也是水涨船高;有可能到一个临界点之后,芯片算力还撑得住,但是单芯片的内存规格较低,蒸馏的时候会被迫减掉更多参数
其实现在Orin X已经是个比较负面的案例:你要说算力其实勉强也能跑;但是内存带宽问题,芯片不支持FP8等新数据格式的问题......
导致新势力各家事实上无法蒸馏模型,如果你的双Orin X车型能拿到新的城区领航版本,那不是蒸馏,那一定是重做的,这就是老芯片的代价
所以我个人估计,明年年中到年末,随着小鹏智驾模型参数量进一步膨胀,单芯片和双芯片的体验就会拉开较大差距
所以买车的时候,你自己按照这个时间点来进行估算——
你如果能承受6~12个月的预期,希望能拿到更加顶级的体验,那你就上双芯片版本;
如果你能接受6~12个月之后体验差距拉开,自己平时也不怎么用智驾,不能后期加装芯片也OK,那你就买单芯片版本
这个规律不仅仅适用于小鹏,我觉得对于其他新势力也是一样的
