LingBot-Vision

LingBot-Vision

面向空间感知的自监督视觉骨干

AI官网

应用介绍

做深度估计、分割这类稠密空间任务,通用视觉骨干在细节和几何上常常不够好。LingBot-Vision 是一个面向稠密空间感知的自监督视觉 Transformer 骨干网络家族,从 ViT-S/16 到 11 亿参数版本都有。

预训练好的骨干可以作为下游机器人感知和三维理解任务的基础。

软件功能



自监督预训练:无需人工标注。

多种规模:ViT-S 到 1.1B 参数。

稠密感知:适合深度、分割等任务。