自变量机器人王昊:训练世界模型需付出“时间税”,解决模态对齐是当务之急
2026-06-15 16:48:59AI云资讯4240
近日,2026北京智源大会召开。世界模型作为具身智能模型的最新范式,论坛吸引了广泛关注。自变量机器人联合创始人兼CTO王昊,分享了“事件驱动的世界模型”的前沿成果。
王昊表示,所有的智能都是在特定尺度下涌现出来的。需要找到不同模态各自表示的尺度,加上规模化,最终才能通向多模态基础模型。

过去在大语言模型上存在着“对齐税”,与之类似,目前训练世界模型的方式也需要付出“时间税”,这是以固定长度定义世界预测长度的弊端。
自变量近期发布的“事件级”世界模型WALL-WM,则使用以事件为边界拆分数据的方法,实现语言、视觉和动作的更好的对齐。自变量发现,事件是连接语言、视觉和动作的天然尺度:事件是基于语言表达,因此边界清晰;视觉也由事件分割,同一事件内的动作更容易预测。“以事件为尺度做变长分割,能够实现对三个模态的天然统一。”王昊表示。

以事件为数据边界训练的世界模型WALL-WM,也在多个测试上都取得了出色效果:
具身视频生成方面,在运动质量、语义一致性和物理合理性上,都超过WAN 2.1 / WAN 2.2;在隐式3D感知和多视角一致性上,全面优于目前开源视觉模型
;在真机测试方面,在基础任务、推理任务、灵巧任务、泛化任务等四大类操作评测benchmark上,分数大幅超过π 0.5、DreamZero。
据公开信息,自变量机器人是国内最早采用完全端到端路径,实现通用具身智能大模型的公司之一。其近期开源的VLA模型Wall-OSS-0.5,实现了在自研本体上部分任务仅需预训练、无需后训练,就能接近过去后训练微调后的零样本泛化水平。开源的数采方案XRZero-G0 则构建起一套软硬一体的全身无本体数采与训练系统,能将数据采集成本降低到过去的1/20。
相关文章
- 声网联手瑞芯微,平行操控方案落地机器人小脑芯片RK3588/3576
- 菲柯机器人战略携手影智科技,软硬双自主重塑餐饮具身智能新消费
- 两年翻倍,海康机器人第20万台移动机器人下线背后的产业加速度
- 打破末端配送壁垒,佑驾创新正式发布四轮足机器人
- 上海智位机器人(DFRobot)慕尼黑电子展分享:以供应链创新赋能智能硬件与开发者市场
- 影智XBOT战略携手亦庄机器人,以“交钥匙”级OEM方案共做具身智能时代“技术基建商”
- 机器人跳舞、沉浸式看戏!这场省级演艺盛会在余杭举行,解锁文旅新玩法
- 芯原推出CPP2000摄像头后处理IP,赋能具身机器人和移动视觉应用
- 世界模型与VLA并非对立,云迹科技单臂协作机器人如何融合两条技术路线
- 云迹科技发布单臂协作机器人,VLA架构正成为2026具身智能主航道
- 小雨智造乔忠良首提“具身红利”,三大技术发布与首款焊接机器人同步落地
- 京东与影智XBOT达成深度战略合作,共推餐饮机器人规模化普及
- 小雨智造发布首款具身智能焊接机器人,三大底层技术揭开面纱
- 中国移动携手产业合作伙伴打造业界首个5G-A具身智能人形机器人训练场及消防救援应用示范
- 云迹科技与顺丰同城签署战略合作 “骑手+机器人“模式落地全国 300 余城市
- 影智XBOT发布通用餐饮服务机器人矩阵与“一脑多形”具身智能体系,率先跑通商业落地闭环
人工智能企业
更多>>人工智能硬件
更多>>人工智能产业
更多>>人工智能技术
更多>>- 自变量机器人王昊:训练世界模型需付出“时间税”,解决模态对齐是当务之急
- 腾讯发布CodeBuddy Security,用AI Agent实现更高效的代码审计
- Twinkle x昇腾,率先实现Deepseek-V4系列模型高效训练
- 高德发布鸿蒙首个生成式 UI 开源框架 AGenUI,告别传统 UI 开发模式
- 发布即适配| 天数智芯全力支持腾讯混元Hy3 preview 开源落地,共推国内大模型产业普惠
- Seedance 2.0面向企业公测,豆包大模型日均Token使用量突破120万亿
- 端到端OCR模型第一!百度千帆Qianfan-OCR正式发布
- 云知声Unisound U1-OCR大模型发布!首个工业级文档智能基础大模型,开启OCR 3.0时代









