rerank模型原理

1. 什么是 Rerank?

Rerank(重排序) 是 RAG(检索增强生成)系统中的一种优化技术,用于提升检索精度。它采用两阶段检索架构:

第一阶段(粗排):使用向量检索快速获取大量候选文档(如 topK=200)

第二阶段(精排):使用专门的重排序模型对候选文档进行精确评分和重新排序

Rerank 的核心价值

✅ 提升检索精度:通过专业化模型更准确地评估文档相关性

✅ 解决语义漂移:深度理解查询和文档的完整上下文

✅ 优化排序质量:将最相关的文档排在前面

✅ 过滤低质量文档:通过分数阈值过滤不相关内容

2. 为什么需要Rerank?

为什么一个Embedding模型还不够,还需要再加一个Rerank模型?

下图为Embedding模型的缺点:

其中最主要的原因就是,查询与文档缺乏深度交互(Bi-Encoder 的先天局限)

Bi-Encoder是将查询的问题和文档分别编码,文档是提前已经编码好存储在向量库中,然后将问题进行编码,计算问题向量和文档片段向量之间的余弦相似度,最后返回相似度最高的TOP N个文档片段。

造成的结果:Embedding 无法判断"查询中的关键词是否在文档中被充分回答"。

如何解决Embedding模型带来的问题呢,以下是解决方案

其中rerank模型能够解决以下问题

3. rerank的原理

Rerank 是一个交叉编码器(Cross-Encoder) ,它同时接收查询和文档,进行深度交互后输出相关性分数。

查询和文档一起输入模型,在 Transformer 内部进行 token 级别的交叉注意力计算。

单独用 Embedding 的问题

  • 向量相似度是"浅层匹配",无法理解复杂的查询意图

  • 例如查询"苹果的价格",可能召回"苹果公司的股价"和"水果店苹果的价格",Embedding 难以区分

单独用 Rerank 的问题

  • 无法直接对海量文档逐一打分(计算量太大)

  • 必须有候选集才能工作

4. 其他优化策略

相关推荐
雨田哥3 小时前
我使用AFSIM助手写了一个想定场景脚本
ai·afsim·ai afsim·afsim助手·afsim智能助手·afsim智能编码·afsim智能问答
产品推荐官5 小时前
2026年AI应用开发服务商的选择逻辑:适配度比功能清单更重要
大数据·人工智能·ai·技术分享·开发经验
俊哥V5 小时前
每日 AI 研究简报 · 2026-07-27
人工智能·ai
一条泥憨鱼5 小时前
如何制作一个Token账本【附完整提示词】
人工智能·ai·agent·claude·token
ajassi20005 小时前
AI语音智能体开发日记(一)如何为“小智”服务器启用并调试 License 功能
笔记·ai·嵌入式·ai编程
神奇霸王龙5 小时前
AI 音乐作曲:LLM 歌词 + TTS 人声实战指南
人工智能·ai·prompt·aigc·音视频·ai音乐
丁劲犇6 小时前
AI辅助快速实现动态多载波PSK随机信号源
人工智能·qt·ai·sdr·多相滤波·动态生成
ofoxcoding6 小时前
Claude Opus 5 与 GPT-5.6 Sol 性能基准测试及实际使用成本对比分析
gpt·ai
程序员三明治7 小时前
【AI】RAG 生成阶段的最后一公里:Prompt 设计、幻觉抑制与引用对齐
java·人工智能·ai·大模型·llm·prompt·rag
清泓y8 小时前
AI_Agent工具调用知识点
人工智能·ai