LingBot-VA

LingBot-VA

通用机器人控制的因果视频动作世界模型

AI官网

应用介绍

机器人策略大多直接从画面映射到动作,缺乏对「动作之后世界会怎样」的理解,换个任务就不灵。LingBot-VA 是一个因果的视频-动作世界模型,同时预测未来画面和机器人动作,用于通用机器人控制。

它在多种操作任务上展现出良好的泛化能力,论文收录于 RSS 2026。

软件功能



视频动作联合:画面与动作一起预测。

因果建模:理解动作后果。

通用控制:多任务泛化。

应用截图