Dan Harrison (Инженер) объявил, что turbopuffer меняет свою архитектуру хранения с turbopuffer v3. Новый движок изменяет то, как документы и индексы размещаются, записываются, уплотняются и запрашиваются, позволяя выполнять гораздо больше планов запросов в гораздо большем масштабе. turbopuffer был запущен как бессерверная векторная база данных, с объектным хранилищем как источником истины для экономики и многоуровневыми кэшами NVMe SSD/памяти для производительности. Это было подтверждено ранними клиентами, включая Cursor и Notion.
Со временем turbopuffer превратился в обобщенную базу данных для поиска, поддерживающую фильтрацию атрибутов и полнотекстовый поиск. Движок запросов развивался, но архитектура хранения оставалась сосредоточенной на индексе ANN как основном индексе. Теперь они переходят к новому основному индексу, делая ANN "всего лишь" вторичным индексом.
В v1 документы состояли только из ID и вектора, используя иерархический индекс кластеризации. v2 добавил фильтрацию атрибутов через инвертированные индексы и полнотекстовый поиск. Команда будет делиться обновлениями по мере перехода. "Мы продвинули основной индекс ANN так далеко, как могли, но пришло время двигаться дальше."
Источник: Hacker News · Сводку подготовил HeadlinesBriefing