FastGPT 源码:RRF、Rerank 相关代码

文章目录

    • [FastGPT 源码:RRF、Rerank 相关代码](#FastGPT 源码:RRF、Rerank 相关代码)
      • [1. RRF (Reciprocal Rank Fusion) 合并实现](#1. RRF (Reciprocal Rank Fusion) 合并实现)
      • [2. Rerank 二次排序实现](#2. Rerank 二次排序实现)
      • [3. 重排序的主要特点](#3. 重排序的主要特点)
      • [4. 整个搜索流程](#4. 整个搜索流程)
      • [5. 这种方式的优势](#5. 这种方式的优势)

FastGPT 源码:RRF、Rerank 相关代码

下边介绍 RRF 合并和 Rerank 二次排序的相关实现:

1. RRF (Reciprocal Rank Fusion) 合并实现

主要在 datasetSearchResultConcat 函数中实现(packages/global/core/dataset/search/utils.ts):

typescript 复制代码
// RRF公式实现
const score = 1 / (k + rank);  // k是一个常数(60),rank是搜索结果的排名

// 合并多个渠道的搜索结果
arr.forEach((item) => {
  const k = item.k;
  item.list.forEach((data, index) => {
    const rank = index + 1;
    const score = 1 / (k + rank);
    
    // 如果已存在相同ID的结果,合并score
    if (record) {
      map.set(data.id, {
        ...record,
        score: concatScore,
        rrfScore: record.rrfScore + score
      });
    } else {
      map.set(data.id, {
        ...data,
        rrfScore: score
      });
    }
  });
});

RRF 合并主要用在以下场景:

  • 合并向量检索和全文检索的结果
  • 合并多个查询的搜索结果
  • 合并重排序后的结果

2. Rerank 二次排序实现

重排序功能在 reRankRecall 函数中实现(packages/service/core/ai/rerank/index.ts):

typescript 复制代码
export function reRankRecall({
  query,
  documents
}: {
  query: string;
  documents: { id: string; text: string }[];
}) {
  // 调用重排序模型API
  return POST<PostReRankResponse>(
    model.requestUrl,
    {
      model: model.model,
      query,
      documents: documents.map((doc) => doc.text)
    }
  ).then((data) => {
    // 返回重排序后的结果和相关性分数
    return data?.results?.map((item) => ({
      id: documents[item.index].id,
      score: item.relevance_score  // 0-1之间的相关性分数
    }));
  });
}

3. 重排序的主要特点

  • 使用专门的重排序模型对搜索结果进行二次评分
  • 得到 0-1 之间的相关性分数,比向量相似度更精确
  • 可以根据重排分数进行过滤,提高精度
  • 重排结果会与其他搜索结果一起通过 RRF 合并

4. 整个搜索流程

  1. 同时进行向量检索和全文检索
  2. 对检索结果进行重排序评分
  3. 使用 RRF 合并三种结果(向量检索、全文检索、重排序)
  4. 根据相关度分数进行过滤
  5. 返回最终结果

5. 这种方式的优势

  • 综合多种检索方式的优势
  • 通过重排序提高精度
  • 使用 RRF 合理合并多个渠道的结果
相关推荐
waicsdn_haha6 分钟前
GIMP 2.10 开源图像编辑软件安装教程(Windows平台)
windows·开源·gimp·图层管理·平面设计·照片修复·色彩校正
广拓科技7 分钟前
中国视频生成 AI 开源潮:腾讯阿里掀技术普惠革命,重塑内容创作格局
人工智能·开源
阳光808816 分钟前
体验开源OpenHarmony+stratovirt模拟器
linux·ubuntu·rust·开源
亥时科技5 小时前
园区环境数字化管理系统(源码+文档+讲解+演示)
java·数据库·开源·源代码管理
说私域14 小时前
百货店的诞生与现代商业革命:结合开源AI智能客服、AI智能名片与S2B2C商城小程序的新视角
人工智能·小程序·开源
文慧的科技江湖16 小时前
Java停车平台高并发抢锁技术方案设计 - 慧停宝开源停车管理平台
java·开发语言·重构·开源·intellij-idea
hikktn18 小时前
【开源宝藏】Spring Trace 一种轻量级的日志追踪新方式
java·spring·开源
LaughingZhu21 小时前
PH热榜 | 2025-03-04
前端·人工智能·经验分享·开源·产品运营
customer081 天前
【开源免费】基于SpringBoot+Vue.JS旅游管理系统(JAVA毕业设计)
java·vue.js·spring boot·spring cloud·开源
每天回答3个问题1 天前
AI数字人| Fay开源项目、UE5数字人、本地大模型
人工智能·python·ue5·开源·游戏引擎