百亿向量已经不是天花板。Google Cloud 把 AlloyDB 的 ScaNN 索引推进到了超过 100 亿向量的规模,靠的是一套全新的四层树架构(预览版)。这一架构最直接的变化,是把查询复杂度从 O(N^1/2) 降到 O(N^1/4)。别小看这个数学改进——索引规模越大,省下的时间越惊人。
内部测试里,这套方案在 100 亿向量规模下做到了 p95 延迟不超过 51 毫秒,召回率 95%。延迟低,结果还准。对依赖大规模向量检索的 RAG 应用来说,这等于改写了容量规划时的性能假设:以前要靠堆资源才能扛住的规模,现在可能换一种索引结构就解决了。
快速入门指南已经上线,新用户还能享受 30 天免费试用。问题的关键不是能不能用,而是你愿不愿意重新算一遍自己的向量规模账。Google 给出的答案是:复杂度不应该随着数据增长而失控。

