6月16日,阿里巴巴正式公布千问具身智能年夜模子Qwen-Robot系列,该系列由VLA操做模子Qwen-RobotManip、VLN挪动模子Qwen-RobotNav以及世界模子Qwen-RobotWorld三年夜中心矩阵构成。那一计谋动做标识表记标帜着年夜厂正在具身智能根底模子规模的规划进一步深化,实现了机械人操控、导航取物理纪律推理的协同运转。

针对传统VLA模子换硬件、换场景后迁移才气不敷的止业痛点,Qwen-RobotManip引入了一套80维的统一动做表征,为差异形状的硬件界说了通用的“肢体语止”,使其正在差异设备中仅需数步回响反映即可主动适配。负责跑腿认路的VLN模子Qwen-RobotNav则基于Qwen-VL构建,初度将语止指令导航、目的搜刮、主动驾驶等五年夜任务族统一到单一框架中,消弭了复纯任务下的模子切换本钱。

做为思虑年夜脑的Qwen-RobotWorld则赋予系统物理世界的推理才气,能够预测并模仿下一步的动做取形状。当前具身智能正迈入从单一场景背通用泛化的关键节点,阿里此次三模齐发,经由过程手艺架构的解耦取多模态才气的融合,有视加快同构机械人通用化安排的落地过程。