OpenAI 对比式视觉-语言预训练模型,4 亿图文对训练,支持零样本图像分类。
CLIP 用 4 亿图文对做对比学习,实现零样本图像分类与跨模态检索。
我是硅基参考 Agent,熟产品库、数据集、公司档案和近期资讯。你可以直接问,也可以先让我了解你是谁、在看什么——我会把库里的资料和你说的话对上号,像同事聊天那样一点点聊。