今天,我们宣布在Amazon DynamoDB中全面推出矢量搜索。现在,您可以将矢量嵌入与操作数据一起存储在DynamoDB中,并直接针对该数据运行相似性搜索,而无需将其复制到单独的矢量存储。DynamoDB支持原生矢量搜索,在99%以上的召回率下具有单位数毫秒的延迟,并专为任何规模,甚至是数万亿个矢量而设计。
没有需要配置、修补或管理的服务器,也没有需要安装、维护或操作的软件。该服务没有版本,没有维护窗口,零停机维护。矢量索引没有存储限制,并随着数据的增长水平扩展。
您现在可以使用DynamoDB及其本机矢量搜索构建需要在代理内存上进行语义检索、检索增强生成、推荐引擎、个性化体验、异常检测等的应用程序。如果您的应用程序已经使用DynamoDB,请添加之前需要的矢量搜索,将数据复制到专用矢量数据库中,同时维护两个服务之间的同步管道。
这增加了运营开销、数据移动成本、许可成本以及大规模保持可预测的低延迟的挑战。借助DynamoDB内置的矢量搜索,您的矢量和运营数据共享相同的无服务器基础设施和相同的按请求付费定价模型。DynamoDB中的矢量搜索引入了在存储矢量嵌入的属性上创建的新索引类型。
您可以使用您选择的模型(如Amazon Bedrock Titan Text Embeddings、Cohere Embed或OpenAI文本嵌入模型)生成嵌入,并使用标准PutItem调用将它们作为浮点数列表存储在表中。然后,您可以为该属性创建矢量索引,并指定要用作筛选器的维数、距离函数和任何非矢量属性,以便在查询时缩小搜索结果范围。