跳到主要内容

2 篇博文 含有标签「技术解析」

拆解模型、检索与基础设施背后的原理和选型方法。

查看所有标签

Embedding 模型怎么选:中文、长文本与多模态评测方法

· 阅读需 9 分钟
XlongLab
AI 产品、技术与工程实践

Embedding 模型正在快速分化:有的强调中文与多语言,有的面向长文本,有的支持图像、视频或 PDF,还有的允许通过 Matryoshka Representation Learning(MRL)裁剪向量维度。面对几十个模型,最危险的做法是直接抄一张排行榜,然后把第一名接进生产系统。

更可靠的结论只有一句话:先建立评测流程,再选择模型。 模型会更新,业务数据也会变化;一套能反复运行的评测流程,比一次性的“冠军模型”更有长期价值。

Milvus、Qdrant、Chroma 怎么选:一套可复现的比较方法

· 阅读需 7 分钟
XlongLab
AI 产品、技术与工程实践

“哪个向量数据库最快”是一个容易提问、却很难诚实回答的问题。Milvus、Qdrant 和 Chroma 的产品边界并不完全相同:它们面向的数据规模、部署方式、扩展模型和运维要求都有差异。只比较一组 QPS,往往会把不同定位的产品拉进一场不公平的比赛。

本文不复用某次旧版本跑分,也不宣布一个永久冠军,而是给出一套可以在自己的硬件和数据上重复运行的比较方法。