ParqDB demonstriert Vektorensuche direkt im Browser unter Verwendung von Parquet-Dateien über HTTP-Range-Anfragen, wodurch ein Abfrage-Server entfällt. Das System indiziert 100.000 Wikipedia-Artikel mit MiniLM-Einbettungen, baut einen IVF-LVQ8-Index auf und veröffentlicht ihn als unveränderliche Parquet-Dateien im Objekt‑Speicher.
Wenn ein Benutzer eine Abfrage eingibt, wandelt der Browser sie in 384d-Vektoren über ONNX/WASM um, liest anschließend nur die benötigten Byte‑Bereiche aus dem Speicher. Der WASM‑Runtime verarbeitet die Index‑Routierung über globale LVQ8‑Zentroiden, schneidet mithilfe von Footern die Zeilengruppen aus, rangiert mit LVQ8‑Distanz plus begrenztem Top‑k und sucht doc_ids, um Wikipedia‑Zeilen zurückzugeben.
Die Architektur ersetzt den traditionellen Browser → Vektor‑DB → Objekt‑Speicher‑Fluss durch einen direkten Browser + WASM → HTTP‑Range → Objekt‑Speicher. Ein Live‑Profiler zeigt Speicher‑Bereichs‑Hits, übertragen Bytes, ausgewählte Kandidaten und Abfragezeit. Netzwerk‑Spuren zeigen geordnete Cache‑ und Netzwerkereignisse, die auf Range‑Anfragen warten.
Schlüssel‑Entitäten: Standorte: Objekt‑Speicher
Quelle: Hacker News · Zusammengefasst von HeadlinesBriefing