群发资讯网

【奇点智能技术大会嘉宾快讯 | 刘昊】世界模型需要理解物体与动作:统一架构与具身落地实战 刘昊,现任视启未来联合创始人、世界模型与具身方向负责人,打造行业首个万物泛化抓取大脑(DINO-X-Grasp)与行业领先的"生成 + 理解"统一世界模型。曾任滴滴量产智驾算法负责人,推动行业首个舱驾一体算 ​

【奇点智能技术大会嘉宾快讯 | 刘昊】世界模型需要理解物体与动作:统一架构与具身落地实战

刘昊,现任视启未来联合创始人、世界模型与具身方向负责人,打造行业首个万物泛化抓取大脑(DINO-X-Grasp)与行业领先的"生成 + 理解"统一世界模型。曾任滴滴量产智驾算法负责人,推动行业首个舱驾一体算法量产落地(小鹏 MONA);曾任文远知行 L4 感知负责人,打造行业首个低算力激光多模态感知算法,完成文远知行 AI 推理框架和中间件 0 到 1;前百度 AI Infra 负责人,主导 AI 推理框架 Anakin、AI 分布式训练 PaddlePaddle 通信库、百度公司统一 AI 异构计算集群等,获 2017 百度百万美金最高奖(孔明团队)。

本届奇点智能技术大会大会,刘昊将带来议题《世界模型需要理解物体与动作:统一架构与具身落地实战》:世界模型的目标是学习物理规律和因果交互规律。 📅 11月20-21日,北京万达文华酒店 。2026 奇点智能技术大会与 C++ 及系统软件技术大会,首次双会并行,70+技术嘉宾同台,18大前沿专题。大会官网:ml-summit.org

🎟️ 心动不如行动,领取资料、购票:zhangyl1 视启未来认为,所有的物理规律是作用在物体上的,因此世界模型需要先理解物体再学习物理规律;因果交互规律在具身领域本质是动作交互引起的,因此世界模型需要先理解动作再学习因果交互规律。

本议题将基于视启未来"生成 + 理解"统一世界模型(视觉原生基模 DINO-X),分享在物理规律和因果交互规律学习中的最新进展,同时结合"万物泛化抓取大脑"的实际落地,探讨如何从第一性原理出发破解模型的"物理幻觉",并分享背后的架构设计与工程优化经验。

大纲速览:

当前痛点:世界模型为什么是视觉原生的?

第一性原理:世界模型为什么需要先理解物体/理解动作?

架构解析:视启未来"生成 + 理解"统一世界模型(DINO-X)的核心网络设计与训练数据构造实践

具身实战与工程优化:多视角能力在复杂物理交互中的表现,以及结合底层硬件的推理框架部署经验

案例与复盘:视频生成与具身抓取 DEMO 演示,及典型实战 Bad Case 避坑分享

听众收益: ✅ 从第一性原理角度了解世界模型如何学好物理规律和因果交互规律,看清世界模型前沿和趋势 ✅ 了解"生成 + 理解"统一多模态架构的设计思路 ✅ 获取前沿模型在具身智能场景(泛化抓取)中从训练到推理部署的实战落地经验ai世界模型具身智能视觉机器人极客头条