![]()
Pelican-VL 2.0在具身业务评测上大幅领先GPT5.5。
本文为IPO早知道原创
作者|SY
据IPO早知道消息,8月19日-23日,2026 世界机器人大会(WRC 2026)期间,北京人形机器人创新中心有限公司(以下简称"北京人形”)推出了最新发布的具身大脑模型Pelican-VL 2.0,并发布大一统模型与新一代产品天工Omni,并完成多轮海内外战略签约。
长期以来,具身智能的多项核心能力——视觉语言理解、任务规划、动作执行、世界预测——往往被拆分为多个独立模型、分而治之。这种"模块化"的架构虽然降低了单点实现的难度,却也带来了能力割裂:模型之间反复调用,误差不断累积,最终导致任务失败,难以在真实场景中随着数据的积累协同进化,突破各自的能力上限。
北京人形此次发布的新一代具身大一统模型,推动技术路线从“模块化”迈向“端到端”。所谓“端到端”,其要义并非简单地把多个输出拼接在一起,而是实现共享表示、相互增强、协同进化。
北京人形将这一理念解释为统一理解、统一推理和统一生成。统一理解是将场景、指令、视觉上下文和动作历史映射到共享语义空间;统一推理是将任务意图、动作选择和未来后果转化为可监督的演化推理过程;统一生成是在同一个扩散解码过程中联合生成未来视频与底层动作。
在这个过程中,多维度的输入(文字、图片、视频、动作编码)被统一对齐到共享表征空间,进行统一推理并完成规划,最后端到端的进行视频和动作生成,使“理解—推理-规划—行动”成为闭环,让机器人从“看懂世界”走向“预演未来、精准执行”。
![]()
来源:北京人形(下同)
北京人形最新发布的具身大脑模型Pelican-VL 2.0,在已具备较好时空理解、物理感知等能力的基础上,依托强大的后训练基建与强化学习训练,其Agentic能力大幅增强,尤其在长程任务与工具调用等具身关键能力上实现显著提升,真正做到不仅“看得懂”,而且“做得到”。
在权威测评中,Pelican-VL 2.0在具身业务评测上大幅领先GPT5.5,在通用Agent能力评测上已达到或超越国内头部商用大模型水平。目前,Pelican-VL 2.0正面向社会全面开放服务,在业界率先实现具身大小脑协同功能的落地与商业化。从模型能力跃升到商业服务开放,北京人形正在用扎实的节奏,兑现“最强大脑”的产业价值。
![]()
如果说大一统模型是机器人的“大脑”,那么紧随其后发布的天工Omni,则是与之匹配的“具备小脑的身体”。
此次发布的超智能新品天工Omni是全球首个面向Humanoid Native具身智能任务的开放底座。这款面向人形原生具身智能任务全新打造的开放平台,在全身运动控制、灵巧操作、多模态交互等核心能力上实现全面升级,并将底层接口、运动控制框架与具身操作能力全面开放。
作为“Humanoid Native”理念的载体,天工Omni从设计之初便以人形原生具身智能任务为核心,而非简单地将通用能力移植到人形形态上。其开放底座特性,使开发者与生态伙伴能够在标准化、可扩展的底层能力之上,快速完成二次开发与场景适配,为具身智能应用的规模化开发与快速落地提供了坚实的支撑。
发布会现场,天工Omni正式推出旗舰版、标准版、基础版三条产品线,覆盖算法开发、数据采集、实训教学、导览互动与表演展示等多元场景。
WRC 2026期间,北京人形还与Eutectical、Blue Holding等多家合作伙伴举行签约。这些签约伙伴覆盖中国、德国、韩国、日本、西班牙等6个国家与地区,行业包括智能制造、人工智能基础设施、量子计算、数字孪生、大数据等多个前沿领域。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.