应用介绍
机器人策略大多直接从画面映射到动作,缺乏对「动作之后世界会怎样」的理解,换个任务就不灵。LingBot-VA 是一个因果的视频-动作世界模型,同时预测未来画面和机器人动作,用于通用机器人控制。
它在多种操作任务上展现出良好的泛化能力,论文收录于 RSS 2026。
视频动作联合:画面与动作一起预测。
因果建模:理解动作后果。
通用控制:多任务泛化。
它在多种操作任务上展现出良好的泛化能力,论文收录于 RSS 2026。
软件功能
视频动作联合:画面与动作一起预测。
因果建模:理解动作后果。
通用控制:多任务泛化。

