|用户侧智慧能源管理领航者 - AIoT驱动数字能源升级|用户侧智慧能源管理领航者 - AIoT驱动数字能源升级

聚力发展 引领未来
新能源 + 储能配套 —— 赋能城市化建设
/
/
从 VLA 到 WBI,具身智能的大脑在如何改变?

从 VLA 到 WBI,具身智能的大脑在如何改变?

  • 分类:新闻动态
  • 发布时间:2026-08-30 21:12:09
  • 访问量:4

从 VLA 到 WBI,具身智能的大脑在如何改变?

  • 分类:新闻动态
  • 发布时间:2026-08-30 21:12:09
  • 访问量:4

在过去几年间,具身智能领域流行的 VLA 路线极大地推动了机器人对开放环境的认知与泛化操作能力。然而,大多基于桌面或双臂静态基座的数据进行训练的 VLA 在具身智能体进入双足人形机器人时,其动作空间无法完成数十个自由度、处于严重欠驱动状态且需要时刻维持动态平衡运动需求。以更高的协调性为目标,业界近期的注意力开始聚焦于全身智能(WBI)的目标,以求设计出能够真正掌握身体的具身大脑。

目录

01. 如何理解具身智能的「WBI」新目标?WBI 与 WBC、VLA 有何关联?业界对 WBI 有哪些共识与非共识?...

02.技术路线的非共识下,近期工作如何实现 WBI?分层架构如何实现更优的全身协调?WBI 需要什么数据?端到端模型是否更容易实现 WBI 的目标?...

如何理解具身智能的「WBI」新目标?

1、在人工智能向物理世界延伸的进程中,具身智能的研究热点正在「高层语义理解」转向「底层物理掌控」,其「大脑」在表征维度、控制接口、物理推理能力以及数据感知源头上经历着持续重构。

2、过去几年,以视觉-语言-动作(VLA)模型为代表的工作在固定基座或局限场景中取得了突破。然而,当具身智能体拓展至双足人形机器人等高自由度构型时,业界开始追求将导航移动、姿态平衡与灵巧操作在策略层面深度耦合的「Whole-Body Intelligence」(WBI)范式。[1-1] [1-2] [1-3] 

① 传统 VLA 模型的大脑试图将物理世界抽象为「视觉输入 $$\rightarrow$$ 末端位姿(轨迹)」的简单映射,但容易忽略基座移动、躯干扭转与重心转移。

② 在传统架构中,底盘移动或双足行走被作为独立模块切分出去。上层规划器通常只给出末端轨迹或离散的足迹指令,全身控制(WBC)只能被动地在底层进行力矩补偿,导致机器人无法实现真正的「全身协同」。

③ 近期兴起的全身智能(WBI)强调机器人能够原生理解物理世界的力学规律,并通过单一或紧密耦合的神经网络策略,将高级多模态语义指令直接转化为包含全身重心调整、四肢协同、多触点平衡以及精细力控的连贯运动输出的能力。

3、在 WBI 的目标下,业界尝试推动具身大脑从「局部位姿预测器」向「全身物理协调大脑」的跃迁,探索更具协调性的具身智能系统。

① 香港大学助理教授、源策未来创始人李弘扬在 7 月中旬的 RSS 2026 的演讲中阐述了从「全身控制(WBC)」向「全身智能(WBI)」演进的范式转移,指出机器人未来需要实现覆盖移动、平衡、接触和操作的全身智能。[1-4] 】

② 谷歌 DeepMind 在 7 月末发布的 Gemini Robotics 2 介绍文档中强调了由三款模型组合形成的「智能层」(Intelligence Layer)及其为机器人带来的全身智能。[1-1] 

③ Current Robotics、与 Symbiosis Robotics(共生知行)等初创团队同样在最新成果中展示了机器人系统在全身协调性的突破,并引起大量关注。[1-5] [1-6] 

技术路线的非共识下,近期工作如何实现 WBI?

1、尽管「走向全身智能」已成为具身智能学术界与工业界对下一阶段的共同追求,但由于不同团队在系统架构的选择、数据采集范式的定义以及动作生成引擎的底层设计上均存在既有的非共识,业界对于如何构建 WBI 系统同样存在路线差异。

2、Google DeepMind 在 7 月 Gemini Robotics 2 工作中采用了一种分工明确的三模型堆栈架构,通过兼顾大模型的长程推理能力与本地的高频响应需求。

① 该工作通过组合 VLA 模型 Gemini Robotics 2、具身推理模型 Gemini Robotics ER 2(VLM)和轻量级 VLA 模型 Gemini Robotics On-Device 2 三款模型,以「ER 2」作为高级大脑进行决策,协调 VLA 执行动作完成任务...

 关注👇🏻「机器之心PRO会员」,前往「收件箱」查看完整解读 

从 VLA 到 WBI,具身智能的大脑在如何改变?

从 VLA 到 WBI,具身智能的大脑在如何改变?

在过去几年间,具身智能领域流行的 VLA 路线极大地推动了机器人对开放环境的认知与泛化操作能力。然而,大多基于桌面或双臂静态基座的数据进行训练的 VLA 在具身智能体进入双足人形机器人时,其动作空间无法完成数十个自由度、处于严重欠驱动状态且需要时刻维持动态平衡运动需求。以更高的协调性为目标,业界近期的注意力开始聚焦于全身智能(WBI)的目标,以求设计出能够真正掌握身体的具身大脑。目录01. 如何理
2026-08-30
消息称百度智能云分拆平台产品事业部

消息称百度智能云分拆平台产品事业部

IT之家 8 月 30 日消息,据《晚点 LatePost》8 月 29 日报道,百度智能云近日完成一轮产研组织调整。原平台产品事业部更名为智能体事业部,其下 MaaS 业务、千帆品牌及与 MaaS 相关的产品体系转入基础设施事业部,数据平台部更名为数据智能部,转入由原应用产品事业部更名而来的智能应用事业部。调整后,百度智能云的三个事业部分别由侯震宇、殷大伟和阮瑜负责:侯震宇负责基础设施事业部,管
2026-08-30
苹果首款AI智能眼镜定档2027年,不配镜片显示系统

苹果首款AI智能眼镜定档2027年,不配镜片显示系统

【#苹果首款AI智能眼镜定档2027年#,#苹果AI眼镜不会配备镜片显示系统#】8月30日消息,据9to5mac报道,苹果公司正加速推进其首款消费级人工智能智能眼镜的研发进程,该产品预计最早将于2027年正式面世。与Vision Pro主打空间计算和沉浸式AR体验不同,这款全新智能眼镜定位为轻量化AI穿戴设备,将视觉智能技术深度整合至Siri,为用户带来全新的现实世界交互体验。据悉,这款内部代号为
2026-08-30
苹果首款AI智能眼镜定档2027年,主打无屏视觉智能驱动Siri

苹果首款AI智能眼镜定档2027年,主打无屏视觉智能驱动Siri

来源:环球网 【环球网科技综合报道】8月30日消息,据9to5mac报道,苹果公司正加速推进其首款消费级人工智能智能眼镜的研发进程,该产品预计最早将于2027年正式面世。与Vision Pro主打空间计算和沉浸式AR体验不同,这款全新智能眼镜定位为轻量化AI穿戴设备,将视觉智能技术深度整合至Siri,为用户带来全新的现实世界交互体验。据悉,这款内部代号为“N50”的设备并非传统意义上的增强现实(A
2026-08-30
青豫特高压工程安全运行五周年

青豫特高压工程安全运行五周年

【导(dǎo)语(yǔ)】2025年(nián)12月(yuè)30日(rì),横(héng)跨四省的青豫特高压工程迎来安全运行五周年。作为全球首条专为清洁能源外送而建的特高压通道,它输送“绿电”点亮杭州亚运会、成都大运会,更以技术创新破解新能源外送难题,为西北与中原搭建起绿色能源桥梁。
2026-01-05
老挝230千伏马哈赛输变电工程开工

老挝230千伏马哈赛输变电工程开工

【导语】当地时间12月29日,230千伏马哈赛输变电工程在老挝万象开工,老挝副总理等多方代表出席。该工程是中老电力合作重点标杆项目,对完善老挝电网、推动区域发展意义重大。 当地时间12月29日,中国能建云南院牵头总承包的老挝国家重
2026-01-05
蒙西到京津冀特高压工程开工

蒙西到京津冀特高压工程开工

【导语】日前,总投资约172亿元的国家电网蒙西至京津冀±800千伏特高压直流工程正式开工,作为内蒙古首条“沙戈荒”新能源外送通道,该工程途经三省区、全长700千米,计划2027年底投运。 日前,国家电网蒙西到京津冀正负800千伏特
2026-01-05
南方电网“西电东送”年送电量首超2600亿千瓦时

南方电网“西电东送”年送电量首超2600亿千瓦时

【导语】中国能源新闻网讯,1月4日记者从南方电网获悉,2025年其“西电东送”全年送电量达2616亿千瓦时,创历史新高。“十四五”期间累计送电1.14万亿千瓦时,减排成效显著。这得益于供需协同、数字运维、市场助力等多举措,后续南方电网还将多举措做好能源电力保供。
2026-01-05
  

联系我们

地址:四川成都市青羊区顺城大街206号四川国际大厦3楼

公众号

公众号

Copyrights © 2025  四川新能源技术有限公司【官方网站】版权所有 . 冀ICP备2023040327号  . 网站地图 | 登录入口