在今年的世界人工智能大会上,具身智能成为最受瞩目的板块之一。擎朗智能在本届展会上,打造了一个覆盖商超零售、咖啡亭、甜品屋及全新酒店洗衣房场景的“具身社区”,每一个场景均源自真实合作品牌的运营需求,而且现场的机器人皆是“全程零遥操,纯自主运行”。

据现场工作人员介绍,支撑“全程零遥操,纯自主运行”的是擎朗自研的融合世界模型的VLA架构,其核心逻辑在于四个层面:将视觉理解、语言指令、动作生成统一在单一端到端模型中,大幅减少传统模块化架构的信息损耗;在VLA(视觉-语言-行动模型)架构中嵌入世界模型,让机器人在执行动作前于脑中预演物理结果——预测物体受力后的运动轨迹、衣物折叠时的形变路径——从而提前规避失败,实现预判式而非试错式的行动;在通用VLA架构之上,针对咖啡师、零售拣选、洗衣等具体岗位,训练了岗位级垂域模型;真实场景数据驱动迭代,海量真机运行数据形成数据飞轮效应,持续反哺优化。
与挪瓦咖啡联合呈现的“特聘咖啡师”、模拟丽柏酒店洗衣房作业、甜品屋中人形机器人通过视觉识别系统实时辨别并精准抓取目标颜色MM豆、零售店里人形机器人模拟了零售物流中的典型拣选动作……每一个场景背后,都有真实的商业需求在驱动。
展台现场,配送机器人T10与清洁机器人C40同步作业,与人形机器人形成“通用+专用”协同的完整服务闭环。专用机器人在配送、清洁等效率型岗位上各司其职,人形机器人则负责操作、舞蹈等复杂交互任务——两者配合覆盖服务业复杂需求。
擎朗智能创始人兼CEO李通在现场表示,“是不是能够干活,才是人形机器人商业化的本质,这也就是为什么擎朗提出岗位化观点,这是人形机器人大规模商业化的必由之路”。所谓岗位化,即找到流程可拆细、结果可量化的具体点位,让机器人在这个岗位上先做到连续工作、稳定产出,用真实数据跑通闭环。
擎朗智能在本届展会上呈现的,不仅是四个看得见的服务场景,更是一套完整的技术与商业化逻辑:以融合世界模型的VLA架构为技术底座、以通用人形+专用服务机器人协同为产品策略、以岗位化落地为商业化路径,让具身智能一步步走进真实服务场景。
文、图/广州日报新花城记者:周裕妩
广州日报新花城编辑:龙嘉丽







































