8月19日,以“人机共生产需共融”为主题的2026世界机器人大会在北京启幕。北京人形机器人创新中心在大会上同步发布具身多模态大模型Pelican-Unify 1.0,围绕“感知—理解—决策—执行”核心能力,推动大模型与机器人本体、真实场景深度融合。相关负责人表示,这意味着具身智能从功能拼凑迈入了协同进化的新阶段。
此次大会上,异构多机协同成为最受关注的看点:两台人形机器人协同摇绳、四足机器狗跟随跳跃的全球首次实机验证,直观展现了运动控制与多机协同能力。具身智能正从“能跑会跳”向“能想会干”加速进化,大模型与机器人本体的结合进入深水区。

Pelican-Unify 1.0的意义在于把多智能体协同从纯软件层面延伸到物理世界。此前的Agent协作大多发生在云端与API之间,而具身大模型要让多台异构机器人围绕同一目标联合调度、分工作业,这对感知、决策与实时控制的一致性提出了极高要求,也标志着多Agent协同进入虚实结合的新阶段。
虚实结合的落地也伴随挑战。异构多机协同涉及不同本体、不同传感器与不同控制栈,统一调度需要强大的算力与稳定的通信协同;从实验室演示到工厂产线的规模化应用,还有数据、可靠性与成本的多重门槛,行业的耐心与基础设施投入缺一不可。
从云端Agent到物理机器人,多智能体协作对算力与调度的要求正在全面升级。星战科技在GPU算力平台与DiWorker多智能体协作平台的布局,覆盖的正是多Agent协同背后的算力供给与协作编排环节,为具身智能这类新场景的规模化落地提供支撑。
放眼行业,具身大模型与机器人本体正在形成新的产业闭环:模型负责“大脑”,芯片与算力负责“神经”,本体负责“手脚”。辉羲智能发布全栈“中国芯”方案、灵足时代推出一体化关节模组,都说明产业链正在为具身智能的大规模部署储备弹药,多Agent协同的物理版图正在展开。

Pelican-Unify 1.0只是一个开始。当多台机器人能围绕统一目标协同作业,具身智能便真正从展台走向车间与生活。多智能体时代的价值,最终要看它能否在真实场景中稳定、高效地完成联合任务。