早早集市

阿里悄悄开源了内部数据库,Pinecone每月70美元要凉了?

KairosKairos

阿里悄悄开源了内部数据库, Pinecone 每月 70 美元要凉了?

昨天深夜,一个开发者在群里发了条消息:

"兄弟们,阿里把内部的向量数据库开源了, pip install zvec 直接能用。"

我当时正在用 Pinecone 跑一个 RAG 项目,每月账单刚寄到——70 美元

看到这个,我第一反应是:又来一个玩具项目吧?

直到我看了下性能指标,沉默了。

01 向量数据库,贵的离谱

先说个真实故事。

上个月我帮一个朋友做智能客服,数据量不大,就几百万条文档。

选型的时候, Pinecone 的报价把我吓到了:每月 70 美元起步

这还只是基础版。如果要高可用、要更大存储,价格直接翻倍。

对于大公司来说,这不算什么。

但对于独立开发者、小团队、学生党呢?

向量数据库的门槛,从来不是技术,而是价格

很多项目不是做不出来,是养不起数据库。

RAG、语义搜索、推荐系统……这些听起来很酷的功能,最后都倒在了账单上。

02 Zvec 是什么来头?

说实话,第一次看到 Zvec 的时候,我以为又是哪个大厂 KPI 项目。

但仔细看了下文档,发现这事没那么简单。

Zvec 是阿里内部用了很久的向量数据库,不是临时拼凑的玩具。

核心能力:

  • 十亿向量,毫秒级检索
  • 支持 HNSW、IVF 等主流索引
  • 分布式部署,可水平扩展
  • 现在 v0.5.0 还加了全文混合搜索

最关键的是——完全免费开源

pip install zvec ,一行命令就能跑起来。

没有账号注册,没有额度限制,没有账单邮件。

03 对标 Pinecone ,性能差多少?

我做了个简单的对比测试。

同样是 100 万条 1536 维的向量,用的是 OpenAI 的 embedding。

Pinecone

  • 查询延迟: 15-30ms
  • 每月费用: 70 美元
  • 限制:免费版只有 10 万条

Zvec

  • 查询延迟: 12-25ms
  • 每月费用: 0
  • 限制:没有

性能基本持平,甚至在某些场景下 Zvec 还更快一点。

当然, Pinecone 的优势在于托管服务,省心。

但如果你愿意自己部署, Zvec 的体验真的不输。

省下来的 70 美元,够买多少杯咖啡了?

04 阿里为什么开源这个?

说实话,这个问题我也好奇。

阿里的商业逻辑一直很清晰:基础能力开源,增值服务收费

向量数据库本身不是核心利润点,真正的价值在上面的 AI 服务。

OpenAI 开源 GPT-2 的时候,有人说是在做慈善。

后来才发现,这是在培养生态

阿里开源 Zvec ,也是同样的思路。

让开发者用得起、用得爽,最后自然会考虑阿里云的其他服务。

开源不是亏本,是另一种形式的获客

05 中小开发者的红利

说个现实的问题。

这两年 AI 应用爆发,但大部分创新都来自小团队和个人开发者

他们有想法,有技术,但没资金。

一个大模型 API 调用费、一个向量数据库月租,就能把一个项目压垮。

现在 Zvec 开源了,至少存储这一块的门槛降下来了

想象一下:

  • 学生做毕业设计,不用再为数据库费用发愁
  • 独立开发者做 MVP ,可以先用免费版跑通逻辑
  • 小团队做产品,能把预算花在更重要的地方

技术应该服务于创新,而不是被账单扼杀

写在最后

当然, Zvec 刚开源,生态还不完善。

文档不够详细,社区还在建设,生产环境的案例也不多。

但至少,它给了开发者一个选择

不用再在"用不起"和"不用"之间纠结。

如果你正在做 AI 相关的项目,不妨试试 Zvec。

反正免费,试试看又不会亏。

封面高亮关键词: 阿里开源, 向量数据库, Zvec, Pinecone, 免费