您的问题有点简略,我先就常见语境解释两者的区别,如果不符合您的场景请补充说明~ ## 常见语境:搜索 / 推荐 / RAG 评估 **Score(得分/相似度分数)** - 针对**单条结果**:衡量某个文档/候选项与查询的匹配程度 - 例如:向量检索中的余弦相似度 0.87、BM25 分数 - 用途:**排序**、设置阈值过滤低质量结果 **Recall(召回率)** - 针对**整体系统