当前位置:首页 > 文章列表 > 数据库 > Redis > Redis Vector Set 怎么保存并检索相似向量

Redis Vector Set 怎么保存并检索相似向量

来源:17golang原创 2026-10-04 21:04:27 0浏览 收藏

Redis Vector Set 保存相似向量的最短路径是:用 VADD 把“元素标识 + 定长向量”写入一个 key,再用 VSIM 传入查询向量,或引用集合中的已有元素完成相似度检索。它从 Redis Open Source 8.0 起提供,底层面向高维向量建立 HNSW 结构,适合语义搜索、推荐候选和相似内容召回。

官方地址:https://redis.io/docs/latest/develop/data-types/vector-sets/

先选对三个维度
  • 输入格式:调试和跨平台优先 VALUES,批量二进制传输可选小端序 FP32。
  • 量化方式:默认 Q8 通常最均衡,NOQUANT 更占内存,BIN 更快更省但会牺牲召回。
  • 查询入口:临时向量用 VALUES/FP32,集合内“以物找物”用 ELE。

先确认版本、维度和向量来源

我第一次把向量接进 Redis 时,最容易忽略的不是命令语法,而是数据契约。一个 Vector Set 里的向量必须来自一致的语义空间:同一个嵌入模型、相同维度、相同预处理方式。否则命令即使能执行,相似度也没有可比性。

# 确认服务端版本,并检查两个核心命令是否存在
redis-cli INFO server | grep redis_version
redis-cli COMMAND INFO VADD VSIM

# 新建集合后可用 VDIM 查看固定维度
redis-cli VDIM product:vectors

如果 COMMAND INFO 查不到 VADD 或 VSIM,先处理 Redis 版本或部署兼容性,不要把普通 Set、Sorted Set 和 Vector Set 混为一类。Vector Set 的元素仍是字符串标识,但每个元素额外关联一个向量,并可附带顶层 JSON 属性。

保存前先比较 VALUES、FP32 和量化方式

选择优势代价适合场景
VALUES可读、易调试、与机器字节序无关文本体积较大命令行验证、小批量写入
FP32二进制紧凑,适合客户端批量传输必须按小端序编码生产客户端已正确打包 float32
Q8默认方案,内存与精度较均衡向量值会被量化多数近似召回任务
NOQUANT保留 FP32 精度占用更多内存精度优先且规模可控
BIN更快、更省内存召回质量下降粗召回或资源严格受限

量化模式在集合第一次写入时确定,后续元素需要保持一致。调试阶段我通常先用 VALUES 搭配默认 Q8,确认业务链路后再由客户端改为 FP32;如果使用 FP32 blob,必须确保字节序为 little-endian。

Redis Vector Set 中元素标识、向量、属性和 HNSW 索引关系说明图
图1:Vector Set 的元素标识、量化向量、JSON 属性与 HNSW 结构静态关系说明图,不是运行截图。

用 VADD 保存向量和属性

下面用三维向量演示商品语义。真实嵌入通常有数百维,命令形状不变,只要维度数量和数值个数一致即可。

# 第一次写入会创建 Vector Set;Q8 是默认量化方式
redis-cli VADD product:vectors VALUES 3 0.82 0.12 0.44 item:coffee   SETATTR '{"category":"drink","price":29.9}'

# 继续写入同维度元素,并附带可筛选的顶层属性
redis-cli VADD product:vectors VALUES 3 0.79 0.18 0.40 item:tea   SETATTR '{"category":"drink","price":19.9}'

# 写入另一个语义方向,便于观察相似度排序
redis-cli VADD product:vectors VALUES 3 0.10 0.91 0.22 item:keyboard   SETATTR '{"category":"device","price":199}'

VADD 对已存在的元素会更新其向量。属性既可以随 SETATTR 一起写入,也可以之后用 VSETATTR 修改。完成写入后,用只读命令检查基本状态:

# 检查元素数量、固定维度和集合内部信息
redis-cli VCARD product:vectors
redis-cli VDIM product:vectors
redis-cli VINFO product:vectors

# 查看元素向量和属性;量化后 VEMB 数值可能与输入不完全相同
redis-cli VEMB product:vectors item:coffee
redis-cli VGETATTR product:vectors item:coffee

用查询向量或已有元素做 VSIM 检索

如果请求侧刚生成了一个新向量,就直接传给 VSIM;如果要做“看了咖啡,再找相似商品”,可以用 ELE 引用集合中的元素。两种方式共享同一个索引,但调用方准备数据的成本不同。

# 传入临时查询向量,返回前三个元素及相似度分数
redis-cli VSIM product:vectors VALUES 3 0.80 0.15 0.42   WITHSCORES COUNT 3

# 直接以已保存元素作为查询向量,并一并返回 JSON 属性
redis-cli VSIM product:vectors ELE item:coffee   WITHSCORES WITHATTRIBS COUNT 3
VSIM 查询向量、已有元素、属性过滤和候选结果关系说明图
图2:VSIM 的查询入口、HNSW 候选、属性过滤和 Top-K 结果静态关系说明图,不是运行截图。

结果分数越接近 1,通常表示余弦相似度越高。Vector Set 是近似检索结构,所以线上结果还受到量化和搜索探索范围影响;如果只是验证功能,先看排序是否符合预期,再进入参数调优。

需要业务条件时再加 FILTER

向量相似并不等于业务可用。若只希望返回饮品且价格低于 30,可以让 VSIM 同时读取元素属性:

# FILTER 只访问顶层 JSON 字段;缺失或类型不匹配的元素会被跳过
redis-cli VSIM product:vectors VALUES 3 0.80 0.15 0.42   COUNT 3 WITHSCORES WITHATTRIBS   FILTER '.category == "drink" and .price 

过滤表达式支持比较、算术、逻辑运算和 in,但只支持顶层字段。过滤结果突然为空时,先用 VGETATTR 检查字段名、JSON 合法性和数值类型,不要立刻把问题归因于向量质量。

召回、延迟和内存怎么取舍

现象优先动作代价
预期结果没有进入 Top-K提高 EF,并与 TRUTH 对照查询耗时增加
内存增长过快保留默认 Q8,压缩属性,谨慎增加 M需要接受量化误差
极度重视精度新集合使用 NOQUANT内存占用更高
只要快速粗召回新集合使用 BIN召回质量下降
过滤后结果不足增加 FILTER-EF 或简化过滤条件检查更多候选
# 增加搜索探索范围,用更多计算换取更好的近似召回
redis-cli VSIM product:vectors VALUES 3 0.80 0.15 0.42   COUNT 3 WITHSCORES EF 500

# 用精确线性扫描做小规模基准对照,不建议直接替代线上近似检索
redis-cli VSIM product:vectors VALUES 3 0.80 0.15 0.42   COUNT 3 WITHSCORES TRUTH

选择标准可以压缩成一句话:先用 VALUES + Q8 + 默认 EF 跑通,再用真实查询集比较召回与延迟;只有指标证明需要时,才切换 FP32、NOQUANT、BIN 或更高 EF。

哪些情况不适合直接用一个 Vector Set

  • 不同模型或不同维度混存:应拆成不同 key,避免语义空间不可比较。
  • 需要复杂文档检索与多字段索引:Vector Set 的属性过滤适合轻量条件,复杂搜索要评估 Redis Search 等方案。
  • 数据规模需要跨实例分片:写入可以分散到多个 key,但全局检索要并发查询各分片并在客户端合并分数。
  • 要求逐项精确距离:近似 HNSW 与量化更适合召回,严格精确计算应另设核验或重排阶段。

相关问题

问:VEMB 返回的向量为什么和写入值略有不同?
默认 Q8 会量化向量,VEMB 返回的是近似值;需要更高精度时应在新集合首次写入时选择 NOQUANT。

问:查询向量必须先写入 Redis 吗?
不必。VSIM 可以直接接收 VALUES 或 FP32 查询向量;只有需要以集合内某个元素作为参照时才使用 ELE。

问:可以在一个集合里更换向量维度吗?
不可以。集合维度由首次写入确定,后续 VADD 必须提供相同维度。

问:如何判断低召回来自量化还是搜索范围?
先用 TRUTH 做小规模对照,再分别提高 EF、检查 Q8/BIN 模式;一次只改一个变量,才能看清影响。

版本声明
本文转载于:17golang原创 如有侵犯,请联系study_golang@163.com删除
爱玩机工具箱为什么会后台自启?小部件、状态栏磁贴与唤醒排查爱玩机工具箱为什么会后台自启?小部件、状态栏磁贴与唤醒排查
上一篇
爱玩机工具箱为什么会后台自启?小部件、状态栏磁贴与唤醒排查
Go io.SectionReader.Size 与当前偏移为什么无关
下一篇
Go io.SectionReader.Size 与当前偏移为什么无关
查看更多
最新文章
查看更多
课程推荐
  • 前端进阶之JavaScript设计模式
    前端进阶之JavaScript设计模式
    设计模式是开发人员在软件开发过程中面临一般问题时的解决方案,代表了最佳的实践。本课程的主打内容包括JS常见设计模式以及具体应用场景,打造一站式知识长龙服务,适合有JS基础的同学学习。
    543次学习
  • GO语言核心编程课程
    GO语言核心编程课程
    本课程采用真实案例,全面具体可落地,从理论到实践,一步一步将GO核心编程技术、编程思想、底层实现融会贯通,使学习者贴近时代脉搏,做IT互联网时代的弄潮儿。
    516次学习
  • 简单聊聊mysql8与网络通信
    简单聊聊mysql8与网络通信
    如有问题加微信:Le-studyg;在课程中,我们将首先介绍MySQL8的新特性,包括性能优化、安全增强、新数据类型等,帮助学生快速熟悉MySQL8的最新功能。接着,我们将深入解析MySQL的网络通信机制,包括协议、连接管理、数据传输等,让
    500次学习
  • JavaScript正则表达式基础与实战
    JavaScript正则表达式基础与实战
    在任何一门编程语言中,正则表达式,都是一项重要的知识,它提供了高效的字符串匹配与捕获机制,可以极大的简化程序设计。
    487次学习
  • 从零制作响应式网站—Grid布局
    从零制作响应式网站—Grid布局
    本系列教程将展示从零制作一个假想的网络科技公司官网,分为导航,轮播,关于我们,成功案例,服务流程,团队介绍,数据部分,公司动态,底部信息等内容区块。网站整体采用CSSGrid布局,支持响应式,有流畅过渡和展现动画。
    485次学习
查看更多
AI推荐
  • PubMedQA数据集详解:生物医学问答基准、功能与应用指南
    PubMedQA
    深入了解PubMedQA生物医学问答数据集,涵盖其核心功能、使用方法及在临床决策、药物研发等场景的应用,助力提升NLP模型性能。
    329次使用
  • H2O EvalGPT:开源LLM大模型评估与排行榜工具
    H2O EvalGPT
    H2O EvalGPT是H2O.ai推出的开源LLM评估平台,提供详细的大模型性能排行榜、行业特定基准测试及A/B测试功能,助您快速选择最适合项目的高性能大语言模型。
    386次使用
  • LMArena是什么?伯克利AI模型评估平台使用指南与功能解析
    LMArena
    LMArena是加州大学伯克利分校推出的AI模型匿名评测平台。通过盲测投票机制,用户可对比不同大模型回答并生成实时排行榜,助力开发者优化模型及用户选择最佳AI工具。
    379次使用
  • 斯坦福HELM:大语言模型Holistic Evaluation整体评估框架详解
    HELM
    深入了解斯坦福推出的HELM(Holistic Evaluation of Language Models)大模型评测体系。本文解析其核心功能、安装配置步骤及应用场景,涵盖准确性、公平性、鲁棒性等多维度指标,助力开发者全面优化语言模型性能。
    348次使用
  • MMBench详解:多模态大模型基准测试、功能特点与使用指南
    MMBench
    MMBench是由上海人工智能实验室等机构联合推出的多模态基准测试平台,提供细粒度能力评估、大规模数据集及VLMEvalKit工具。本文详细介绍其核心功能、安装使用方法及应用场景,助力开发者全面评估多模态模型性能。
    172次使用
微信登录更方便
  • 密码登录
  • 注册账号
登录即同意 用户协议 和 隐私政策
返回登录
  • 重置密码