“如果AI真的要走进物理世界,它需要一副身体。那这副身体,除了人形,还有没有其它可能?”2026世界机器人大会·火山引擎具身智能技术与应用论坛上,AIVA总裁、产品经理李博抛出的这句话,在满场聚焦人形机器人的行业语境里,显得格外清醒。
当下行业探讨物理AI与具身智能,目光几乎全部锁定在人形形态。展馆里的各大展台上,无论是行走、抓取还是陪伴、交互,行业都在不断强化一种默认认知,AI走进现实最优解就是模仿人类躯体。但李博的提问,似乎是给这个行业撕开一道口子,除了人形,还有没有其它可能?
这个问题值得审视,AI本质上是一套智能能力的赋能,而非固化的外壳。它可以注入机械结构,诞生机器人;同样也可以搭载各类移动终端,演化出不同形态的智能体。载体从来不是“谁取代谁”,产业真正需要回答的核心命题是:哪一种“身体”,能够更高效地在对应场景承接AI能力,支撑人与智能体建立长期、可信的共处关系。
李博和AIVA给出的答案是——汽车。
AI下一阶段真正的分水岭,应该在于能否跳出屏幕,从数字世界走入物理世界。而想要走入物理世界,更好的大模型显然还不够,它需要一个可以感知环境、执行动作,能够与人长期共处的在场者。机器人是一条路径,而汽车是另一条落地速度更快的路径。
这是对物理AI落地路径的冷静拓宽。就比如本届世界机器人大会以“人机共生,产需共融”为主题,行业重心正从实验室转向真实场景的商业化落地。行业共识正在转变,评判具身智能载体,不再只看能不能动、能不能执行指令,而是考察能否持续完成真实场景任务、实现从感知到理解再到决策的执行闭环。
对照这套标准,汽车拥有多数终端难以比拟的三重先天条件。
首先,汽车有充足的能源底座:几十,甚至上百度的车载电池,能支撑本地高算力与端侧大模型的部署,可以实现低时延响应,同时大量数据可在本地处理,能更好地保护数据和隐私安全。
其次,汽车有完备的感知与执行能力:摄像头、麦克风、雷达等传感器,以及座椅、空调、灯光、底盘等整套机构,相当于 AI 的眼睛、耳朵与手脚,融合感知输入和物理执行的硬件储备更完善。
最后,汽车有不可替代的、长期共处的场景:这一点更容易被忽视。日常通勤、接送家人、周末出行,用户每天会有两三个小时身处车内、而且车的用户使用周期长达好几年。这样高频的、周期性的、多场景的长时间陪伴,是很多终端所不具备的。
三重优势叠加,让汽车成为物理AI落地大众生活的高成熟度载体之一。长久以来,行业习惯性将具身智能与人形机器人画等号,但载体的核心竞争力在于闭环能力,而非外在形态。汽车,正是当前被严重低估的物理AI载体之一。
李博多次对外阐释AIVA的核心造车理念“先有AI,再有车”,这不是先造出一台整车,再往里堆智能功能;而是反过来,在产品定义阶段,先理清楚 AI 要理解人、更好与人相处的话,需要怎样的能力,再让整车围绕这套 AI所需的能力,生长成型。这样,车就变成了一个AI生命体。
这一理念最直观的外化成果,便是灵动光眸交互大灯。灵动光眸所有灯光表情,并非预设程序编排的表演,而是AI感知场景之后自然做出的反馈。这也指向物理AI更深层的追求:智能体不能只拥有行动能力,更需要让人感知到鲜活的生命感。
这套全新造车范式,同样需要匹配全新的产业协作模式。AIVA与火山引擎深度合作,双方联合定义、联合设计、共同打造AI汽车体验。不同于常规技术采购关系,双方共享在市场趋势和用户场景上的理解,发挥彼此的长板优势,共同讨论AI硬件选型、共同评审产品需求、共同推敲设计方案。
李博讲到:“在物理 AI 这条赛道,最终比拼的或许不只是模型能力有多强大、硬件本体有多灵巧,而是它能否和人之间,构建起一段真实可感的信任关系。”
信任,无法靠一场发布会一蹴而就,它是在一次次真实交互中层层累积出来的:AI 真切看见你、记住你,并在你真正需要的时候提供帮助。每一次反馈都贴合场景、恰到好处,久而久之,信任自然会建立。
物理AI走向规模化普及真正的门槛,在于用户是否愿意将日常生活、家人出行托付给智能体。汽车是第一个大规模面对这道考题的物理AI载体——它已经有数亿用户,每天都在真实场景里接受检验。
回到开头那个问题:AI真的要走进物理世界,它需要一副身体。那这副身体,除了人形,还有没有其它可能?
AIVA给出的答案是汽车。但比答案更重要的是这个问题本身——它提醒行业,AI的身体从来不是一道单选题,载体的形态终将服务于一个更本质的目标,让物理AI真正走进人的生活,赢得人的信赖。