应用介绍
想按文字描述搜索图片、或者不训练就给图片分类,传统视觉模型要为每个任务单独训练。CLIP 是 OpenAI 的对比式语言图像预训练模型,能判断图片和文字描述是否匹配。
它支持零样本分类和图文检索,是 Stable Diffusion 等众多多模态模型的基础组件。
零样本分类:无需训练。
图文检索:文字搜图。
通用表示:多任务可用。
生态基础:广泛使用。
它支持零样本分类和图文检索,是 Stable Diffusion 等众多多模态模型的基础组件。
软件功能
零样本分类:无需训练。
图文检索:文字搜图。
通用表示:多任务可用。
生态基础:广泛使用。

