最新下载
热门教程
- 1
- 2
- 3
- 4
- 5
- 6
- 7
- 8
- 9
- 10
使用阿里云向量检索服务DashVector实现关键词感知的向量检索
时间:2026-08-19 10:50:52 编辑:袖梨 来源:一聚教程网
使用阿里云向量检索服务DashVector实现关键词感知的向量检索并不只看表面做法,关键还要理解相关条件、限制和后续影响。
一.概述
本文以我个人搭建的房源检索服务为例,详细叙述了如何使用阿里云的 DashVector 产品实现“带有关键词感知的向量检索”。关于“关键词感知的向量检索”具体说明可以参见阿里云官方文档,这里仅对文档中没有详细叙述的实际操作过程进行补充。
二.操作过程
2.1 DashVector API-KEY 申请
登录 阿里云向量检索服务 DashVector 控制台 点击创建 api-key申请。注意:关闭后不可复制

2.2 创建 Cluster
创建集群(可以类比成关系型数据库里的一个数据库),阿里云会给一定的免费额度供练习使用。

2.3 创建collection
可以类比成关系型数据库的一个表



所以我们创建完成的 collection 的一条数据的结构如下:
我们在向 collection 中注入数据的时候,也需要按这种形式组织数据,先用 embeding 模型生成 vector ,再用对应的稀疏向量生成工具 DashText 生成稀疏向量,在拼接上我们自定义的 fields 存储到 collection.
检索时,我们将 关键词同样处理成,稠密和稀疏向量,进行匹配召回就可以了。召回的信息中,会附带我们自己的 fields.这样就召回了我们提前预定的关键信息。
2.4 生成及插入向量数据
我的原始数据格式 house_vectors.json 这里我希望通过描述信息,召回对应房源 id 即可,所以 schema 中仅定义了一个 id.上传成功后,我们在平台的 collection 中可以看到导入的数据,至此我们的向量数据处理全部完成。可以看到存储的是向量信息。

2.5 向量检索
三.注意事项及总结
文中使用的阿里云百炼平台的 api-key和 api 地址,需要去 百炼平台 提前申请。检索及存储向量时,要使用相同的向量处理模型和工具,注意向量维度也要保持一致。稠密向量维度要与 collection 中定义的保持一致。参考资料:https://help.aliyun.com/document_detail/2586282.html?spm=a2c4g.11174283.0.0.71af582bNPgka4
相关文章
- 编程入门:如何选择最适合学习编程的笔记本电脑 08-19
- W3C是什么?带你了解Web的超级英雄! 08-19
- 学编程对孩子有什么好处?要不要让孩子学编程? 08-19
- W3C官网:引领你的Web开发之路! 08-19
- 如何设置小米路由器4开发版(小米路由器4开发版的设置步骤和注意事项是什么) 08-19
- 1024程序员节,教你用各种语言的输出炫技! 08-19