Skip to content
🔗 分享本题
查看我的学习进度 →

RAG 数据库选型动漫知识图:语义检索、精确过滤、图关系和原始文件分别选择合适存储,并通过混合检索融合

记忆点:按检索信号选索引,生产系统通常组合多种检索。

💡 高分回答

核心区别:检索方式不同

数据库类型检索方式适用场景
传统数据库精确匹配(=、LIKE)关键词搜索
向量数据库语义匹配(相似度)语义搜索

性能对比(10 万条数据):

数据库检索时间
MySQL(无索引)~5000ms
MySQL+pgvector~500ms
Elasticsearch~100ms
Milvus/Qdrant~10ms

为什么向量库快?

  • 内置 ANN 索引(HNSW/IVF)
  • 搜索复杂度 O(log N) vs O(N)
  • 专为向量检索优化

面试话术:

"向量库是专为'找相似'设计的跑车,传统库是家用轿车。10 万条数据检索差 100-500 倍。但小项目(<1 万条)用 pgvector 就够了。"