7月2日,由京城机电牵头成立的北京人形机器人创新中心正式发布全球首个全尺寸全身VLA框架“TG-VLA”。这一技术突破标志着人形机器人从“会移动的双臂”向类人全身协同作业迈出关键一步。
VLA是“视觉-语言-动作”模型的英文缩写,可以理解为机器人的“眼睛、耳朵和手脚”的统一指挥系统。TG-VLA框架搭载了HEX、HAF-VLA、DSRL-DCT三项原创底层技术,形成了从通用底座到动作生成、再到环境自适应的完整技术闭环。
HEX技术搭建了以人形机器人身体结构为核心的统一感知体系,通过建模全身多关节的联动规律,让同一套系统能够适配不同型号的人形机器人,解决了“换一个型号就得重新训练”的难题。
HAF-VLA是本次框架的核心技术,创新采用“先移动、后操作”的分层逻辑——模仿人类完成任务的顺序:先迈腿走过去,再调整身体姿态,最后动手操作。这种分层设计避免了全身数十个关节同时动作时的“打架”和失衡问题。在天工全尺寸人形机器人实体平台测试中,洗衣、浇花、搬运、投球等复杂长流程任务的平均得分达68.3%,较国际主流模型领先15个百分点;分层架构相比不分层的方案,任务成功率提升超过13个百分点。
DSRL-DCT技术则解决了机器人从“实验室训练”到“真实环境干活”的适应问题。它无需重新训练整个模型,只需优化动作执行中的细微偏差,大幅降低了算力和硬件成本。在从未见过的物体和场景变动测试中,搭载该方案的机器人实现全部测试任务满分完成。
TG-VLA框架依托的是北京人形机器人自研的通用具身智能平台“慧思开物”。该平台采用“大脑决策、小脑执行”的协同架构:具身“大脑”负责理解语言指令、分析场景、规划任务;具身“小脑”则将抽象指令转化为符合机器人身体约束的稳定全身动作。TG-VLA的发布,为“慧思开物”补齐了全身协同执行的核心能力。以往机器人只能完成单臂简单操作,如今可自主完成“行走—姿态调整—全身精细操作”的一体化长序列任务——半跪浇花、负重搬运、衣物拾取等类人动作流畅稳定,单套系统可同时适配家庭服务、工业巡检、物料转运等多元场景。
发表评论 取消回复