跳到正文
原文
OpenAI·· 2021-01-05精选AI 评分80

OpenAI 发布 CLIP:连接文本与图像的多模态神经网络

CLIP: Connecting text and images

AI 导读

OpenAI 推出神经网络模型 CLIP,可通过自然语言监督高效学习视觉概念。用户仅需提供待识别的视觉类别名称,即可将 CLIP 应用于任意视觉分类基准,具备类似于 GPT-2 和 GPT-3 的零样本能力。

推荐理由

该模型通过自然语言监督学习视觉概念,读者可以了解如何仅凭类别文本名称在各类视觉分类任务中实现零样本迁移。

来源:OpenAI · openai.com