首页 / 新闻中心 / 正文
再进阶!北京人形重磅发布全球首个全尺寸全身 VLA 技术框架,持续夯实「慧思开物最强大小脑」
北京人形机器人创新中心
2026-07-02


2026 年 7 月 2 日,作为国家地方共建具身智能机器人创新中心、具身智能国家队,北京人形机器人创新中心今日正式发布全球首个全尺寸全身 VLA 框架——TG-VLA,围绕 HEX、HAF-VLA、DSRL-DCT 三大全球首创核心技术,打通人形机器人 “高层语义决策 - 全身协调运动 - 动态环境自适应” 全链路能力,持续夯实「慧思开物最强大小脑」技术底座,推动人形机器人从 “会移动的双臂” 迈向类人全身协同作业新阶段。

01/ 破解行业共性瓶颈:国家队攻坚全身协同核心难题

当前全球人形机器人产业普遍存在关键技术卡点:主流 VLA 模型多适配低自由度机械臂,迁移至高维全身人形本体时极易出现步态震荡、动作失稳;传统控制依赖预设运动库,无法基于开放式语言指令和动态环境针对性完成任务;大模型 “大脑” 高层规划与底层运控 “小脑” 存在部署鸿沟,长序列、移动 + 操作耦合任务泛化能力薄弱,难以适配家庭、工业等真实非结构化场景。
作为具身智能国家队,北京人形肩负突破通用人形机器人底层核心技术、构建自主可控具身智能产业体系的使命。依托自研通用具身智能平台「慧思开物」“大小脑协同” 架构,本次 TG-VLA 框架针对性攻克高维动作耦合、数据效率低下、长短时序任务割裂三大行业痛点,实现一套系统统一覆盖工业精密运维、家庭全流程家务等长程、精细、强泛化作业需求,让机器人拥有与人类同频的全身协调能力,解锁全能作业全新边界。

02/ 三大全球首创技术落地:重构人形机器人全身控制范式

本次发布的全新 TG-VLA 框架 搭载 HEX、HAF-VLA、DSRL-DCT 三项原创底层技术,形成 “跨具身通用底座 - 分层全身动作生成 - 动态环境自适应强化学习” 完整技术闭环,是「慧思开物最强大小脑」体系的重大迭代升级:
HEX 跨具身人形对齐混合专家底座
HEX 搭建以人形本体动力学为核心的统一状态表征体系,通过混合专家本体感知预测器建模全身多关节联动规律,轻量化时序记忆模块压缩视觉语言重复编码开销,实现跨不同型号人形机器人(天工 2.0/3.0 等)的通用预训练,为全身 VLA 提供高兼容、低延迟的底层感知融合基座,解决多机型迁移适配难、全身运动耦合紊乱问题。
HAF-VLA 分层动作流框架 类人递进式全身动作生成
作为本次 TG-VLA 框架核心,HAF-VLA(Hierarchical Action Flow)创新采用 “先移动、后操作” 生物启发分层逻辑,分三阶段有序激活机器人全身自由度:第一阶段规划腿部移动与头部凝视,搭建全局空间轨迹;第二阶段优化腰部躯干姿态,第三阶段拓展到双臂精细操作。
依托跨阶段 KV 缓存复用机制,视觉语言信息仅单次编码全流程共享,各阶段运动记忆递进传递,从根源规避多关节动作纠缠、动力学失稳。在天工全尺寸人形机器人实体平台完成六大真实家庭任务闭环验证,洗衣装载、浇花、搬运、投球等复杂长流程任务平均归一化得分达 68.3%,较 GR00T N1.7、π0.5 等国际主流 SOTA 模型领先 15 个百分点;消融实验证实,分层架构相比无分层全局生成方案任务成功率提升超 13 个百分点,面对障碍物干扰、初始位姿偏移等扰动仍保持稳定作业。
DSRL-DCT  动态稀疏强化学习适配方案
针对离线示范数据与真实物理环境的适配鸿沟,DSRL-DCT 创新提出冻结预训练模型、仅优化动作生成潜在噪声的训练范式,通过离散余弦变换(DCT)对高维噪声降维压缩,在低维空间完成 SAC 最大熵策略优化,搭配行为克隆正则项稳定训练过程。 该方案无需大规模重训基座模型,大幅降低算力、硬件损耗与真实环境探索安全风险;分布外(OOD)场景测试中,HAF-VLA 搭配 DSRL-DCT 实现全部测试任务满分完成,在未知物体、场景布局变动下泛化能力实现跨越式提升,补齐人形机器人真实场景落地的鲁棒性短板。

03/ 大小脑协同再进阶:打通从“理解”到“全身执行”闭环

「慧思开物」平台核心逻辑为 “大脑决策、小脑执行” 协同架构:具身大脑依托大模型完成自然语言解读、场景语义推理、复杂任务分层规划;具身小脑搭载本次全新 TG-VLA 框架,将抽象语义指令转化为符合机器人运动学、动力学约束的稳定全身关节动作,弥合高层规划与底层实时运控的延迟、平滑性鸿沟。
本次发布的 TG-VLA 框架,为 「慧思开物最强大小脑」 补齐全身协同执行核心能力:以往机器人仅能完成单臂简单操作,如今可自主完成 “行走 - 姿态调整 - 全身精细操作” 一体化长时序复合任务,半跪浇花、负重搬运、衣物拾取入筒等类人全身动作流畅稳定,单套系统可同时适配家庭服务、工业巡检、物料转运等多元场景,大幅降低行业客户二次开发成本。

04/ 双平台驱动:锚定具身智能长期路线

作为具身智能国家队,本次全球首个全尺寸全身 VLA 框架 TG-VLA 发布,是「慧思开物最强大小脑」技术路线的又一里程碑,标志着北京人形在具身智能全身多模态协同控制领域实现原创技术领跑。下一步,北京人形将围绕三大方向持续迭代:一是推进多机器人协同全身 VLA 技术研发;二是优化模型轻量化,适配嵌入式端侧低算力部署;三是拓展极端动态工业场景适配能力。持续攻克通用人形机器人产业化核心技术,以国家级创新平台之力,引领全球具身智能产业突破。
北京人形持续围绕「具身天工」与「慧思开物」双平台协同演进、深度耦合,既攻克人形机器人 “身体” 硬件性能短板,又探索通用具身智能 “大脑小脑” 协同控制的技术边界,聚焦人形机器人在3D 五大场景中的应用落地,推动具身智能产业落地千行百业,为新型工业化与新质生产力注入硬核的具身动能。

Top