酷哇科技亮相WAIC2026,解密行业首个双层智能体世界模型
统一物理与社会的世界模型,才是机器人真正需要的底座
机器人真正需要的世界模型,不是单一的物理世界模型,而是物理世界模型与人类社会世界模型的统一。这个观点,在2026年世界人工智能大会上被酷哇科技用一场实演和一次演讲,清晰地推到了台前。
7月17日,上海世博展览馆,2026世界人工智能大会开幕。酷哇科技在上海国投展区亮相,展台现场,由全栈自研的COOWAM双层智能体世界模型驱动的机械臂,流畅完成了一整套长程复杂操作——“夏日特调”饮品的制作演示。与此同时,面向城市复杂场景研发的首款重载型四足机器狗X0,也完成了线下首秀。
同期举行的“解码世界”发展创新分论坛上,酷哇科技创始人、CTO廖文龙博士发表了题为《世界模型:物理世界Agent的技术底座》的主题演讲。他在会上向业界披露了行业首个双层智能体世界模型架构——
COOWAM(Co-Optimized World Action Model)
从技术实演、新品亮相到解密底层模型架构,深耕城市场景的酷哇科技,正以世界模型为底座,推动城市具身智能从单体作业走向多智能体协同,加速让智能成为新的生产力。
01 拧瓶盖、切西瓜、制作特调——COOWAM世界模型的「实战场」
在展台现场,由COOWAM世界模型驱动的机械臂全天候持续“上岗”,为现场观众制作“夏日特调”——将西瓜切块榨汁,拧开瓶盖、再按照一定配比加入柠檬片、倒入苏打水,整套动作完全自主,流畅自然。
这个任务看似简单,实则涉及多机械臂协同以及对接触力、流体等物理规律的处理。在光照、水杯位置等环境因素动态变化的条件下,机械臂需要进行实时预测与修正。
与依赖预设程序在固定环境中重复特定动作的传统机器人不同,基于COOWAM的机器人在理解任务目标的基础上,能够根据实时环境反馈进行推演、决策与行动,完成非固定流程的复杂任务。
该演示验证了COOWAM作为通用底座,支撑不同机器人形态适应多类物理交互任务的技术可行性,为具身智能设备在城市公共服务与物流配送等场景的落地提供技术支撑。
02 四足作业平台X0亮相——打造城市场景服务「全能标杆」
展台的另一侧,基于酷哇“Aether以太”重载型四足平台打造的
X0机器狗
高达68kg的重载能力与全地形自适应行走能力,让X0能够轻松突破传统轮式设备的平面作业限制,将作业范围延伸至楼梯、斜坡、碎石路面、花坛周边等立体复杂空间。
对X0而言,能走、能负重只是基础,“全能”的价值在于深入城市毛细血管,实现“一机多用”。凭借高度模块化的设计,X0可快速更换上装模块,无缝适配市政环卫、末端配送、安防巡检等多样化任务。目前,X0已完成多场景验证并步入真机部署阶段,应用于城市精细化运维场景。
03 重构「城市具身智能」技术底座——披露行业首个双层智能体世界模型架构
7月18日,酷哇科技创始人兼CTO廖文龙博士在论坛演讲中阐述了自研双层智能体世界模型COOWAM(Co-Optimized World Action Model)架构的设计逻辑。他指出,
Physical Agent面对的是两个同时存在且彼此耦合的世界:遵循物理规律的自然世界和遵循社会规则的人类世界
在廖文龙看来,机器人要实现应用价值,至少需要具备三种能力:
理解自然规律(如重力、摩擦、惯性);在行动前推演不同动作选择带来的结果;认知人类社会规则与行业SOP(标准作业程序)
“机器人真正需要的世界模型,并不是单一的物理世界模型,而是物理世界模型与人类社会世界模型的统一。”廖文龙表示,“只有同时理解这两个世界,Physical Agent才能真正走出实验室,进入真实社会,并持续创造生产力价值。”
基于此,酷哇研发了COOWAM双层智能体世界模型:
- :负责处理物理规律。该模型聚焦0~4秒短时未来窗口,在机器人产生动作时,同步推演环境变化并修正当前动作,形成“动作→未来推演→动作修正”的决策闭环。
CooWAIM(交互式世界动作模型)
- :基于城市服务数据构建,负责理解任务语义、行业SOP和生产力价值导向。
Urban VLM(人类社会世界模型)
在Urban VLM内部,酷哇构建了
PVM(生产力价值模块)
模型架构之外,廖文龙还提到一个关键问题:世界模型如何变得更强?酷哇的答案是:
通过与真实世界的持续交互,让模型在数据闭环中不断自我进化。
依托全球范围内超过50个城市及地区的常态化运营,酷哇目前已建立了“
真实世界交互→数据沉淀→模型学习→能力提升
04 从单体智能到互联协同——迈向「Robocity」未来之城
2026年,具身智能正在跨越拐点,从单纯的技术探索,逐渐走向规模化应用。
在酷哇的战略蓝图中,单个Physical Agent或商业场景的成熟仅仅是一个开端。当我们真正实现了“一脑多态”,让同一套COOWAM统一底座,去驱动形态各异的轮式机器人、无人小巴、机器狗和人形机器人时,目标就已经不再是造好一台自动化的设备,而是要去
重构未来城市的运行方式
这就是酷哇眼中的未来图景——一个由统一模型驱动的“RoboCity(机器人城市)”。
在未来的RoboCity愿景中,机器人将告别执行固定任务的孤立状态,进化为具备自主决策能力、持续创造价值的Physical Agent(具身智能体)网络。基于共享的“物理-社会”统一世界模型,它们将打破信息孤岛,构建起真正默契的城市级协同生态。
为实现这一图景,酷哇规划了一条“从围墙外走向围墙内”的清晰演进路径:
- 深耕垂直领域。在城市出行、市政环卫及物业服务等场景,率先完成单一设备的智能化落地。
第一阶段(单体智能):
- 拓展复合场景。以统一世界模型为驱动,在园区、社区及工业等场景中,实现不同形态智能体的高效协同作业。
第二阶段(多机协同):
- 迈向家庭场景。攻克复杂操作与高泛化能力的壁垒,让具身智能真正走进千家万户。
第三阶段(全面泛化):
这也是酷哇持续探索World Model的终极目标: