记忆点:按检索信号选索引,生产系统通常组合多种检索。
💡 高分回答
核心区别:检索方式不同
| 数据库类型 | 检索方式 | 适用场景 |
|---|---|---|
| 传统数据库 | 精确匹配(=、LIKE) | 关键词搜索 |
| 向量数据库 | 语义匹配(相似度) | 语义搜索 |
性能对比(10 万条数据):
| 数据库 | 检索时间 |
|---|---|
| MySQL(无索引) | ~5000ms |
| MySQL+pgvector | ~500ms |
| Elasticsearch | ~100ms |
| Milvus/Qdrant | ~10ms |
为什么向量库快?
- 内置 ANN 索引(HNSW/IVF)
- 搜索复杂度 O(log N) vs O(N)
- 专为向量检索优化
面试话术:
"向量库是专为'找相似'设计的跑车,传统库是家用轿车。10 万条数据检索差 100-500 倍。但小项目(<1 万条)用 pgvector 就够了。"
