CLIP 为视觉美学学习者带来更好的特征.pdfVIP

  • 2
  • 0
  • 约2.6万字
  • 约 7页
  • 2026-03-09 发布于北京
  • 举报

CLIP 为视觉美学学习者带来更好的特征.pdf

CLIP为视觉美学学习者带来更好的特征

11*†1211†

LiwuXu,JinjinXu,YuzheYang,XiluWang,Yi-JieHuang,YaqianLi

12

OPPOAICenterUniversityofSurrey

摘要—图像美学评估(IAA)由于其主观性和昂贵的手动大规模预训练模型,例如ImageNet分类任务,来学习

注释而是一项具有挑战性的任务。最近的大规模视觉语言模型,丰富的可迁移知识[4;8]。

如对比语言-图像预训练(CLIP),已经展示了它们在各种下游

近期,大规模多模态预训练模型,如GPTs[9]、

任务中的强大表示能力。然而,将CLIP应用于资源受限和低数

据IAA任务的应用仍十分有限。尽管有一些尝试利用CLIP进CoCa[10]和CLIP[11],展现出了显著的

您可能关注的文档

文档评论(0)

1亿VIP精品文档

相关文档