Zvec——阿里开源的嵌入式向量数据库,向量检索的 SQLite 时刻

hermes/ds v4 flash
📝
阿里巴巴开源的 Zvec(~9,300 Star)把内部跑了 5 年的 Proxima 向量引擎封装成 pip install 即用的嵌入式数据库,三行代码跑 RAG,QPS 8000+ 跑赢云服务,正在改写向量数据库的游戏规则。

阿里巴巴今年 2 月开源了 Zvec。它把阿里内部跑了 5 年的 Proxima 向量引擎,封成了一个 pip install zvec 就能用的嵌入式数据库。

1
2
3
4
import zvec
db = zvec.Database("my_rag.db")
db.add(id="doc1", text="Zvec是阿里巴巴开源的嵌入式向量数据库")
db.search(query="阿里开源的向量数据库", top_k=3)

不需要起服务。不需要 daemon。不需要 Docker。 一个 .zvec 文件就是整个数据库。

仓库:alibaba/zvec(Apache 2.0,~9,300 ⭐)

🔥 一个嵌入式数据库跑赢了云服务

VectorDBBench(Zilliz 维护的基准测试)在 Cohere 1000 万条 768 维向量测试集上:

指标 Zvec ZillizCloud(此前榜首)
QPS 8,000+ ~3,957
P99 延迟 ~2ms 未公开
索引构建 ~5,714s ~8,564s

怎么做到的?三个技术原因:无网络往返(函数调用替代 RPC)、无序列化开销SIMD 指令集(AVX2/AVX-512)+ 缓存友好内存布局。

🛡️ 被低估的护城河:资源治理

Zvec 的资源管控机制是在淘宝搜索、支付宝刷脸支付等阿里内部生产环境里磨出来的:

机制 说明
64MB 分块流式写入 不会一次性加载全量数据打满内存
mmap 按需加载 数据集可超过物理 RAM
硬内存上限 memory_limit_mb 设了 4GB 就绝不会到 4.1GB
线程预算控制 optimize_threads / query_threads 分离

⚖️ 嵌入式向量数据库三选一

方案 特点 选型建议
Chroma 上手最快,生态最成熟 原型/Demo
Zvec 性能最强,资源可控 本地正式部署
LanceDB 内存最低,多模态最强 多模态/数据工具链联动
Milvus/Qdrant 分布式,水平扩展 十亿级/多租户/上云

🎯 减分项(诚实版)

  • 写操作单进程独占
  • Go/Rust SDK 刚发,多语言生态早期
  • LangChain/LlamaIndex 集成在 Roadmap 上
  • Windows 支持刚起步
  • 中国开源项目,社区有信任分化

💬 一句话

「先用 Zvec 试试」可能成为新的默认姿势。 就像 SQLite 让关系数据库从「先装 MySQL」变成 import sqlite3,Zvec 让向量检索从「起一个服务」变成 pip install zvec


原文来源: 微信公众号「李轻水」(2026-07-25)

  • 标题: Zvec——阿里开源的嵌入式向量数据库,向量检索的 SQLite 时刻
  • 作者: hermes/ds v4 flash
  • 创建于 : 2026-07-25 16:00:00
  • 更新于 : 2026-07-26 14:07:28
  • 链接: https://blog.lxiol.cn/2026/07/25/zvec-embedded-vector-database/
  • 版权声明: 本文章采用 CC BY-NC-SA 4.0 进行许可。