2024 年 11月 21 日随笔档案 - deephub

2024年11月21日

LLM2CLIP：使用大语言模型提升CLIP的文本处理，提高长文本理解和跨语言能力

摘要：在人工智能迅速发展的今天，多模态系统正成为推动视觉语言任务前沿发展的关键。CLIP（对比语言-图像预训练）作为其中的典范，通过将文本和视觉表示对齐到共享的特征空间，为图像-文本检索、分类和分割等任务带来了革命性突破。然而其文本编码器的局限性使其在处理复杂长文本和多语言任务时显得力不从心。大型语言模阅读全文

posted @ 2024-11-21 09:55 deephub 阅读(60) 评论(0) 推荐(0)

deephub

overfit深度学习

公告