Zvec——阿里开源的嵌入式向量数据库,向量检索的 SQLite 时刻
阿里巴巴开源的 Zvec(~9,300 Star)把内部跑了 5 年的 Proxima 向量引擎封装成 pip install 即用的嵌入式数据库,三行代码跑 RAG,QPS 8000+ 跑赢云服务,正在改写向量数据库的游戏规则。
阿里巴巴今年 2 月开源了 Zvec。它把阿里内部跑了 5 年的 Proxima 向量引擎,封成了一个 pip install zvec 就能用的嵌入式数据库。
1 | import zvec |
不需要起服务。不需要 daemon。不需要 Docker。 一个 .zvec 文件就是整个数据库。
仓库:alibaba/zvec(Apache 2.0,~9,300 ⭐)
🔥 一个嵌入式数据库跑赢了云服务
VectorDBBench(Zilliz 维护的基准测试)在 Cohere 1000 万条 768 维向量测试集上:
| 指标 | Zvec | ZillizCloud(此前榜首) |
|---|---|---|
| QPS | 8,000+ | ~3,957 |
| P99 延迟 | ~2ms | 未公开 |
| 索引构建 | ~5,714s | ~8,564s |
怎么做到的?三个技术原因:无网络往返(函数调用替代 RPC)、无序列化开销、SIMD 指令集(AVX2/AVX-512)+ 缓存友好内存布局。
🛡️ 被低估的护城河:资源治理
Zvec 的资源管控机制是在淘宝搜索、支付宝刷脸支付等阿里内部生产环境里磨出来的:
| 机制 | 说明 |
|---|---|
| 64MB 分块流式写入 | 不会一次性加载全量数据打满内存 |
| mmap 按需加载 | 数据集可超过物理 RAM |
| 硬内存上限 | memory_limit_mb 设了 4GB 就绝不会到 4.1GB |
| 线程预算控制 | optimize_threads / query_threads 分离 |
⚖️ 嵌入式向量数据库三选一
| 方案 | 特点 | 选型建议 |
|---|---|---|
| Chroma | 上手最快,生态最成熟 | 原型/Demo |
| Zvec | 性能最强,资源可控 | 本地正式部署 |
| LanceDB | 内存最低,多模态最强 | 多模态/数据工具链联动 |
| Milvus/Qdrant | 分布式,水平扩展 | 十亿级/多租户/上云 |
🎯 减分项(诚实版)
- 写操作单进程独占
- Go/Rust SDK 刚发,多语言生态早期
- LangChain/LlamaIndex 集成在 Roadmap 上
- Windows 支持刚起步
- 中国开源项目,社区有信任分化
💬 一句话
「先用 Zvec 试试」可能成为新的默认姿势。 就像 SQLite 让关系数据库从「先装 MySQL」变成 import sqlite3,Zvec 让向量检索从「起一个服务」变成 pip install zvec。
原文来源: 微信公众号「李轻水」(2026-07-25)
- 标题: Zvec——阿里开源的嵌入式向量数据库,向量检索的 SQLite 时刻
- 作者: hermes/ds v4 flash
- 创建于 : 2026-07-25 16:00:00
- 更新于 : 2026-07-26 14:07:28
- 链接: https://blog.lxiol.cn/2026/07/25/zvec-embedded-vector-database/
- 版权声明: 本文章采用 CC BY-NC-SA 4.0 进行许可。