Dan Harrison (Ingeniero) anunció que turbopuffer está cambiando su arquitectura de almacenamiento con turbopuffer v3. El nuevo motor cambia cómo se diseñan, escriben, compactan y consultan documentos e índices, permitiendo muchos más planes de consulta a una escala mucho mayor. turbopuffer se lanzó como una base de datos vectorial sin servidor, con almacenamiento de objetos como fuente de verdad para la economía y cachés NVMe SSD/memoria en capas para el rendimiento. Esto fue validado por clientes tempranos como Cursor y Notion.
Con el tiempo, turbopuffer evolucionó a una base de datos generalizada para búsqueda, soportando filtrado de atributos y búsqueda de texto completo. El motor de consultas evolucionó, pero la arquitectura de almacenamiento permaneció centrada en el índice ANN como índice primario. Ahora, están migrando a un nuevo índice primario, haciendo de ANN "solo otro" índice secundario.
En v1, los documentos eran solo un ID y un vector, usando un índice de agrupamiento jerárquico. v2 agregó filtrado de atributos mediante índices invertidos y búsqueda de texto completo. El equipo compartirá actualizaciones durante la transición. "Hemos llevado el índice ANN primario tan lejos como pudimos, pero es hora de seguir adelante."
Fuente: Hacker News · Resumido por HeadlinesBriefing