实战|CLIP+Milvus,多模态embedding 如何用于以文搜图
· 阅读需 17 分钟

为了在朋友圈优雅地假装文艺青年,之前,我用向量数据库Milvus开发了应用语义搜索古诗词,它可以把白话文“变成”古诗词(详见朋友圈装腔指南:如何用向量数据库把大白话变成古诗词)。
但是,在朋友圈只发文字未免单调了些,还是需要搭配与古诗词意境相似的图片才行。但是,直接用古诗词检索图片,效果不太理想。
那么,可以通过向量数据库检索和古诗词含义相近的图片吗?
答案是当然可以,实现方法和文本的语义检索相似,只不过这次我们要使用多模态的embedding模型。

