互联网圈有条铁律:字节看上的赛道,从来不会小打小闹。最近,据36氪独家报道,字节跳动正在低调布局自动驾驶赛道。项目由旗下Seed团队的世界模型小组牵头,负责人正是前阿里通义大模型技术负责人——周畅。
这意味着,在内容推荐算法领域封神之后,字节终于把手伸向了被视为"AI皇冠明珠"的自动驾驶。
官方回应:字节方面表示"字节在AI大模型前沿探索领域,包括物理AI领域,有很多早期研究和探索,但并没有做智能驾驶业务的计划。"然而,业内人士透露,字节的自动驾驶项目已进入早期筹备状态,团队已开始与头部自动驾驶企业进行业务探讨交流。字节智驾什么来头
Seed团队成立于2023年,是字节的一级战略部门,汇聚了多模态模型、世界模型、大语言模型等多条技术路线。周畅于2024年加入字节,负责多模态大模型研发,此后管理边界不断扩大——视觉生成、具身智能团队均向其汇报。早在2020年,字节就组建了车联网团队,将抖音、头条等内容接入座舱生态。2023年,豆包大模型实现"上车",今年北京车展期间,火山引擎披露:搭载豆包的车辆已突破700万台,覆盖50多个品牌、145款车型。字节汽车云则提供仿真训练、数据标注、图像渲染等平台服务。说白了,字节在汽车行业已经深度潜伏多年。但问题来了:座舱做得好,不代表能把智驾也拿下。舱驾分离的时代或许可以,但舱驾一体的趋势下,缺失智驾核心能力,就像缺了条腿。字节的打法路数
说字节做智驾,会成为华为的硬对手。这话不是空穴来风。小鹏、理想等新势力已经把自动驾驶团队和智能座舱团队合并了。舱驾一体架构具备低成本、低时延、原生联动等优势,是行业大趋势。字节现在座舱做得风生水起,但没有智驾能力,就意味着:整车的智能化体验无法闭环,核心算法和数据闭环掌握在第三方手中。这对想深度参与汽车行业的字节来说,是不可接受的。世界模型能让AI在虚拟环境中模拟物理世界的运行规律,为自动驾驶系统提供大规模仿真训练数据,降低对实车路测的依赖。—— 行业技术人士分析
小鹏今年发布的X-World世界模型、理想GTC大会上展示的MindVLA O1,都表明行业正全面拥抱世界模型路线。而字节的Seed团队在多模态和世界模型领域积累深厚,这才是它敢于跨界的后台。"字节的优势在于,有足够的钱去烧,有足够多的人才,有足够多的卡,完全能负担得起他们后发先至。"当然,字节也面临挑战。通用世界模型与智驾专用世界模型在技术细节上差距挺大,智驾专用模型对交通物理的理解要求更深刻。好在字节有足够算力,只要能拿到足够多的交通数据,重新训练一个智驾世界模型并非难事。当前现状
字节的打法相当务实:初期不碰乘用车,先从无人物流车切入。知情人士透露,字节有意布局的自动驾驶场景包括无人物流,该业务隶属于字节旗下火山引擎汽车行业线。无人物流车行驶场景单一,实现高阶智驾的难度较低,适合初期验证技术。目前字节参与度最高的汽车项目是赛力斯旗下的赛豆汽车。今年6月,赛力斯与火山引擎合作的AIVA品牌正式发布。不过值得注意的是,赛豆AIVA ME7的智驾方案选择了元戎启行,而非字节。这说明字节的智驾能力尚未成熟,还没有进入"可选项"。技术成熟后,字节的智驾方案有望替代第三方方案。这不仅是商业考量,更是字节补全"舱驾一体"拼图的关键。
醉翁之意:自动驾驶只是入口
如果只把字节入局智驾理解为"眼红汽车蛋糕",那就太小看张一鸣的野心了。自动驾驶只是字节的短期切入点,物理AI与全域具身智能才是最终目标。汽车是现阶段最优、最庞大、最真实的物理数据场。智驾技术迭代,本质是字节世界模型完成"虚拟认知"向"物理认知"进化的必经之路。看看特斯拉就明白了:马斯克曾说,"如果没有先做FSD自动驾驶汽车,研发Optimus机器人难度会高出一个数量级。"FSD收集的数十亿英里真实数据,正是Optimus快速迭代的底气。最终,字节会把自动驾驶中沉淀的世界模型能力,全面复制到机器人、工业设备、智能家居等领域,构建覆盖"人车家"的全场景物理AI生态。最后
字节入局自动驾驶,搅动的绝不只是汽车行业。
当内容互联网的增长见顶,字节需要新的数据场来喂养它的AI大模型。自动驾驶、具身智能、物理AI……这些词汇背后,是一个万亿级的市场,也是通往AGI的必经之路。
华为有鸿蒙座舱+MDC智驾的完整闭环,有问界、智界的量产背书。字节有世界模型+豆包的多模态积累,有抖音、TikTok的海量数据。
这场对决,才刚刚开始。
往期阅读:
无人配送,凭什么是首个规模化的物理AI?
常州这盘棋:从无人物流试点到"全域具身智能"的城市野心
无人车"省人不省心"?行深智能安向京:问题不在车,在于没解决"服务"
易咖智车牵手九识:一场"功能型无人车"的双向奔赴
校园无人车的N种可能:不只送快递,还能培养人才
#无人车小白 #无人驾驶 #自动驾驶 #无人车
期待您的关注、点赞、在看、转发