跳到正文
原文
Databricks·· 1 小时前AI 评分56

Databricks Runtime 推出 NEAREST BY 批量向量搜索

NEAREST BY Join: Scaling Vector Search in Databricks Runtime

AI 导读

Databricks 在 Databricks Runtime 中推出 NEAREST BY,把批量向量搜索实现为原生 top-k 排序连接。查询和基础向量可分别扩展到数亿和数十亿,嵌入向量保留在 Delta 表中,Photon 提供 SIMD 距离函数、融合 GEMM 算子和 IVF 索引。官方称在至少 96% recall@K 下,100 万查询对 10 亿参考向量可在数分钟内完成。

来源:Databricks · databricks.com