首页 > 股市 > 正文

北京人形发布大一统模型与新一代天工Omni两项成果

新华财经|2026年08月20日
阅读量:

测评数据显示,Pelican-VL 2.0具身业务评测表现大幅领先GPT5.5,通用Agent能力达到或超越国内头部商用大模型水平。

新华财经北京8月20日电(记者孙广见)北京人形机器人创新中心有限公司(下称“北京人形”)在20日举行的具身智能应用创新主题活动上,发布大一统模型与新一代硬件产品天工Omni两项重要成果,从软件大脑、硬件本体两端发力,夯实软硬一体的人形机器人全栈技术底座。

长期以来,视觉语言理解、任务规划、动作执行、世界预测等具身智能核心能力,大多被拆分为多个独立模型分模块实现。模块化架构虽降低单点开发难度,却造成能力割裂:模型之间频繁调用带来误差累积,容易引发任务失败,也很难依托真实场景数据协同迭代,难以突破性能天花板。瞄准这一行业痛点,北京人形推出具身大脑Pelican-VL 2.0,推动具身智能技术路线从传统模块化迈向端到端新范式。

所谓端到端,并非简单拼接多路输出,核心在于构建共享表征,实现能力相互增强、协同进化。北京人形大模型负责人鞠笑竹现场阐释,该模型实现三重统一:统一理解,将场景、指令、视觉上下文与动作历史映射至共享语义空间;统一推理,把任务意图、动作选择、未来后果转化为可监督的演化推理过程;统一生成,在同一扩散解码流程中联合输出未来视频与底层动作。文字、图片、视频、动作编码等多维度输入统一对齐,完成理解、推理、规划、行动完整闭环,推动机器人从“看懂世界”升级为“预演未来、精准执行”。

具身大脑Pelican-VL 2.0在原有时空理解、物理感知能力基础上,依托完备的后训练基建与强化学习训练,模型Agent智能体能力显著增强,长程任务、工具调用等核心具身能力大幅提升,真正实现从“看得懂”到“做得到”。测评数据显示,Pelican-VL 2.0具身业务评测表现大幅领先GPT5.5,通用Agent能力达到或超越国内头部商用大模型水平。

如果说大一统模型是机器人的智慧大脑,天工Omni就是与之匹配、搭载运动小脑的实体本体。北京人形创新人形部负责人郭宜劼发布《天工Omni:面向Humanoid Native具身智能任务的开放底座》。该开放平台对全身运动控制、灵巧操作、多模态交互能力全面升级,全面开放底层接口、运动控制框架与具身操作能力。产品线分为旗舰版、标准版、基础版,覆盖算法开发、数据采集、实训教学、导览互动、表演展示等多元场景。产品立足人形原生任务设计,而非简单移植通用能力;开放底座便于开发者快速二次开发,为具身智能规模化落地提供支撑。

北京人形机器人创新中心CTO唐剑表示,具身智能正处于从技术验证迈向规模化应用的关键转折点。作为国内聚焦具身智能软硬件全栈的机构,北京人形将依托全栈自研技术与开放生态,推动机器人从“更能跑”向“更会干活”演进。具身智能研发需要锚定真实场景痛点,打通产研壁垒,让机器人在解决实际问题中持续进化,迈向人机共生的发展愿景。

 

编辑:罗浩

 

声明:新华财经(中国金融信息网)为新华社承建的国家金融信息平台。任何情况下,本平台所发布的信息均不构成投资建议。如有问题,请联系客服:400-6123115

传播矩阵