#AI 编程# 给一个 300 万条文档的检索服务做选型。先用 pgvector 跑,单表 300 万向量加 HNSW 索引,P99 延迟 80ms,能接受。但索引重建要 40 分钟,期间写入被锁。最后拆成两套:热数据留在 pgvector,冷数据同步一份到专用向量库,重建在那边做。选型的答案往往不是二选一,是分层。你们的向量量级到多少之后开始拆分?
展开
1