CLIP

CLIP

OpenAI的图文对比预训练模型

AI官网

应用介绍

想按文字描述搜索图片、或者不训练就给图片分类,传统视觉模型要为每个任务单独训练。CLIP 是 OpenAI 的对比式语言图像预训练模型,能判断图片和文字描述是否匹配。

它支持零样本分类和图文检索,是 Stable Diffusion 等众多多模态模型的基础组件。

软件功能



零样本分类:无需训练。

图文检索:文字搜图。

通用表示:多任务可用。

生态基础:广泛使用。

应用截图