Dan Harrison(工程师)宣布 turbopuffer 正在将其存储架构升级为 turbopuffer v3。新引擎改变了文档和索引的布局、写入、压缩和查询方式,允许以更大的规模支持更多查询计划。turbopuffer 最初作为无服务器向量数据库推出,以对象存储为事实来源实现经济性,并通过分层 NVMe SSD/内存缓存实现性能。这一方案得到了早期客户(包括 Cursor 和 Notion)的验证。
随着时间的推移,turbopuffer 演变为一个通用的搜索数据库,支持属性过滤和全文搜索。查询引擎不断进化,但存储架构仍以 ANN 索引 作为主索引。现在,他们正在转向新的主索引,使 ANN 成为“另一个”二级索引。
在 v1 中,文档仅包含 ID 和向量,使用层次聚类索引。v2 通过倒排索引和全文搜索增加了属性过滤。团队将在过渡期间分享更新。“我们已经将主 ANN 索引推到了极限,但现在是时候继续前进了。”
来源: Hacker News · 由HeadlinesBriefing整理摘要