小鹏发布X-Mind:给自动驾驶装上“预知未来”的大脑
小鹏发布X-Mind:给自动驾驶装上“预知未来”的大脑
别总盯着自动驾驶安不安全了,现在的技术,已经开始有点“未卜先知”的意思了。
最近车圈挺热闹,不过不是因为降价,而是小鹏搞了个大动作。今年夏天,他们把X-Mind正式推了出来,说是给自动驾驶装上了能“预见未来”的大脑。
这不是吹牛,是实打实的技术升级。以前的车是“看见啥开啥”,现在的逻辑变了:“预判你要干啥,所以我提前做准备”。这就好比从“条件反射”变成了“深思熟虑”。
大家可能听过VLA大模型,觉得挺高深。但X-Mind把这个概念落地了。它不光看路,还用了一种叫“显式思维链”的技术,把开车的推理过程展示给你看。
以前AI像个黑箱,不知道它咋想的;现在它把你的意图看得明明白白。这就解决了信任问题。你敢把命交给一个能清楚解释“我为啥要刹车”的系统,总比交给一个只会报错的机器强。
不只是开车,是在“懂”世界
小鹏在CVPR上的这次亮相,确实让人眼前一亮。何小鹏和刘先明团队,把VLA和世界模型这两个东西揉到了一起。
VLA是向人类学习驾驶技巧,世界模型是向物理规律学习运行机制。小鹏的想法很简单:我都要,而且要让它们配合得天衣无缝。这就是他们说的“物理世界基座模型”。
用理解去驱动驾驶,用预测来实现理解,靠大规模数据来提升预测精度。这话听着专业,说白了就是让车像老司机:懂交规,懂人情,也懂物理。
为了支撑这套系统,小鹏用了近1亿段真实驾驶视频来训练。什么概念?相当于人类开了6.5万年的车。数据量这么大,难怪它能认出交警的手势这种没专门教过的动作。
更厉害的是X-Foresight功能,它能提前预测未来的画面和车辆动作。简单说,它在脑子里先模拟了一遍事故,然后在现实中避开了它。这种“预演”能力,才是L4级自动驾驶真正的门槛。
纯视觉才是终极答案?
很多人还在纠结要不要激光雷达。小鹏这次态度很明确:纯视觉最好。为啥?因为摄像头里的信息量,比激光雷达大多了。
想让AI像人一样聪明,就得给它看人眼看到的世界。激光雷达给的只是点云,太抽象;摄像头能给纹理、光影甚至表情,这才是理解世界的原材料。
当AI开始思考“为什么”,自动驾驶才真正算开始了。
当然,算力是个大难题。小鹏搞了个X-Cache,砍掉了70%的冗余计算,推理速度提升了近3倍。就像给大脑装了个强力散热片,转得快也不发烫。
看看现在的趋势,特斯拉搞FSD,小鹏搞X-Mind。两家理念不同,但都在往“纯视觉+大模型”这个方向冲。以后的车,不只是交通工具,更像是会思考的机器人。
对咱们消费者来说,这是好事。竞争越激烈,技术迭代越快,我们买到的车就越聪明、越安全。小鹏这波操作,把“科技感”和“实用性”平衡得不错。
关键数据:8906名研发人员,研发投入占比44.79%,1亿+视频片段训练,消除70%计算冗余。
总之,别再用老眼光看自动驾驶了。现在的它,不仅能开,还能“想”。小鹏的X-Mind,可能就是让大家彻底放心、接受全自动驾驶的那把钥匙。
···
#小鹏集团#自动驾驶#X-Mind#AI大模型