ETCD 损坏,还没有备份,Milvus 数据还有救吗?
最近在 Milvus 社区里,我们帮一位用户处理了个比较棘手的问题。 他的 Milvus 实例遇到了 ETCD 数据损坏。更麻烦的是,他没有保留原始数据,也没有提前使用 Milvus Backup 做备份,业务数据还不知道能不能拿回来。 这基本上是所有主流数据库能想象的最差的情况了。 但好在当时还有一个机会:Mi...
覆盖模型、检索与基础设施的原理、选型及落地实现。
最近在 Milvus 社区里,我们帮一位用户处理了个比较棘手的问题。 他的 Milvus 实例遇到了 ETCD 数据损坏。更麻烦的是,他没有保留原始数据,也没有提前使用 Milvus Backup 做备份,业务数据还不知道能不能拿回来。 这基本上是所有主流数据库能想象的最差的情况了。 但好在当时还有一个机会:Mi...
做向量检索性能优化时,很多人第一反应是调索引参数、加机器、换检索参数。但在 Milvus 里,还有一个容易被忽略的变量:Segment 的形态。 Segment 是 Milvus 组织数据、加载索引和执行搜索的基本单位。随着数据写入、增量更新、删除和 flush,系统会不断生成新的 Segment。为了保证写入效...
前几天在 Milvus 社区,一位做以图搜图的朋友提了一个问题: “我们要对2500 万张图片(转为1280 维向量)做以图搜图,单机支撑亿级数据的查询。但内存配置只有64GB,其中能分给向量数据库的最多32GB。但我用 Sizing Tool 算了一下,说要 139GB 内存,是不是没戏了?" ▲ Sizing...
用OpenClaw这类个人AI助手久了,很多人都会遇到一个棘手问题:当你询问上周刚确认的API限流方案时,AI翻出来的却是三个月前的过期内容。 其实记忆记录本身是存在的,核心问题在于,龙虾无法判断哪条记忆更重要、更具时效性。 而OpenClaw、NanoClaw这些产品默认的全量写入上下文方案,天生就存在时效性缺...
本文将完整讲解开源环境下,如何基于 CDC 快速搭建主备复制架构,补齐机房级、集群级灾难容错能力,助力私有化部署业务平稳运行。
当前向量数据库的核心应用场景集中于知识库构建,而在此类场景中,向量数据库成本,有时候会占总支出的 ~45%,仅次于 LLM 调用。
最近和开发者交流,发现一个很有意思的现象,很多初学者做RAG,一上手就直奔OpenAI的text-embedding-3-small。的确,这是个无功无过的模型。
最近,OpenClaw全球刷屏,GitHub近20 w stars的成绩背后,很多人都盯着它的多平台对话能力。 但在我们看来,它能够够跨平台、跨会话的长期AI记忆系统的设计,也同样可圈可点。 在OpenClaw,AI会自动写 daily logs并以md格式存储,人类可以手动对其进行维护,并提炼长期原则,让AI记...
但肯定也有用户发现了,Milvus中,还有ScaNN这么一个索引类型怎么没有放进来,这个索引究竟要怎么用?适合什么场景用?
前面几期内容,我们聊了agent 常见的坑有哪些,memory怎么管理,还有一些rerank细节,今天从部署层面看看怎么选一个不错的agent框架。
假设你要在一个新闻应用中落地语义检索功能,让用户搜索雷军的投资版图盘点时,能自动关联顺为资本、小米战投等核心关联信息。
Milvus 宣称2.5 版本就已经引入了全文检索(Full-text Search)