跳到主要内容

工程实践

覆盖模型、检索与基础设施的原理、选型及落地实现。

ETCD 损坏,还没有备份,Milvus 数据还有救吗?

预计阅读 16 分钟

最近在 Milvus 社区里,我们帮一位用户处理了个比较棘手的问题。 他的 Milvus 实例遇到了 ETCD 数据损坏。更麻烦的是,他没有保留原始数据,也没有提前使用 Milvus Backup 做备份,业务数据还不知道能不能拿回来。 这基本上是所有主流数据库能想象的最差的情况了。 但好在当时还有一个机会:Mi...

Force Merge Compaction:让你的 Milvus 性能原地翻倍

预计阅读 9 分钟

做向量检索性能优化时,很多人第一反应是调索引参数、加机器、换检索参数。但在 Milvus 里,还有一个容易被忽略的变量:Segment 的形态。 Segment 是 Milvus 组织数据、加载索引和执行搜索的基本单位。随着数据写入、增量更新、删除和 flush,系统会不断生成新的 Segment。为了保证写入效...

2500 万向量,1G 内存,毫秒级检索:一台 Windows 一体机上的 Milvus 实战

预计阅读 6 分钟

前几天在 Milvus 社区,一位做以图搜图的朋友提了一个问题: “我们要对2500 万张图片(转为1280 维向量)做以图搜图,单机支撑亿级数据的查询。但内存配置只有64GB,其中能分给向量数据库的最多32GB。但我用 Sizing Tool 算了一下,说要 139GB 内存,是不是没戏了?" ▲ Sizing...

OpenClaw的记忆系统,用在企业场景还是太粗糙了

预计阅读 16 分钟

用OpenClaw这类个人AI助手久了,很多人都会遇到一个棘手问题:当你询问上周刚确认的API限流方案时,AI翻出来的却是三个月前的过期内容。 其实记忆记录本身是存在的,核心问题在于,龙虾无法判断哪条记忆更重要、更具时效性。 而OpenClaw、NanoClaw这些产品默认的全量写入上下文方案,天生就存在时效性缺...

开源:我们复刻了OpenClaw的mem系统,为所有Agent打造透明、可控的记忆

预计阅读 12 分钟

最近,OpenClaw全球刷屏,GitHub近20 w stars的成绩背后,很多人都盯着它的多平台对话能力。 但在我们看来,它能够够跨平台、跨会话的长期AI记忆系统的设计,也同样可圈可点。 在OpenClaw,AI会自动写 daily logs并以md格式存储,人类可以手动对其进行维护,并提炼长期原则,让AI记...

浅谈 SCANN 索引

预计阅读 10 分钟

但肯定也有用户发现了,Milvus中,还有ScaNN这么一个索引类型怎么没有放进来,这个索引究竟要怎么用?适合什么场景用?