RyanCodrai/turbovec
github.com原文 ↗
turbovec 以 TurboQuant 做无训练量化,1,000 万文档的示例内存从 31 GB 降到 4 GB;在线摄入、增量 `sync` 和搜索时过滤让索引可以边增长边服务。手写 ARM NEON 与 x86 AVX-512 内核在 4-bit 平均比 FAISS IndexPQFastScan 快 3.4x,量化收益并非只体现在容量。
–浏览
github.com原文 ↗
评论 · Comments