Redis 向量缓存协作先划清键、版本与失效责任Redis Vector Search 加上多级缓存后检索、缓存和业务团队都会碰同一份结果。若键和失效策略没有负责人命中率再高也可能返回旧答案。缓存键必须包含语义版本查询归一化方式、嵌入模型、过滤条件和租户边界都会影响结果。缓存键或元数据要能区分这些版本不能只用原始问题字符串。每一层说明一致性目标进程内缓存适合短时热点Redis 负责跨实例复用向量库仍是真实来源。内容更新后由数据变更事件触发失效TTL 只做兜底。缓存空结果要用更短策略。租户与权限过滤不能在命中后补。命中率和过期返回分别观测。失败时知道退到哪Redis 不可用时可以直接查向量库但要限流向量库不可用时是否允许返回已缓存内容应由业务时效要求决定。缓存是协作边界不是一层魔法。键里有版本、失效有人管、降级有条件才能放心加速检索。