大模型长文生成中的幻觉与事实性:研究进展综述

上一篇笔记介绍了我们提出的KLCF框架:基于知识一致性验证的强化学习框架:提升大模型在长文生成中的事实性

这篇文章分享一个整理的有关大模型长文幻觉与事实性的仓库:Awesome Long-Form Factuality!

它系统整理了大模型长文生成事实性研究的最新进展,包括以下内容:

  • 从问题洞察到评测方法 全面梳理了"幻觉"问题的根源,以及如何量化评估生成文本的事实性。
  • 从提示工程到强化学习 收录了提升事实性的主流技术路径,包括:(1)Prompt工程:如何通过提示词引导模型;(2)微调技术:SFT与DPO等对齐方法;(3)强化学习:RLHF及其变体等多种RL框架;(4)主流评测基准与综述:汇总了该领域的关键评测数据集与权威综述文章

    这个仓库旨在为社区提供一份持续更新的研究路线图,欢迎Star🌟 & PR!
    GitHub链接: https://github.com/ki-ljl/Awesome-Long-Form-Factuality
相关推荐
fthux10 小时前
装闭 RenoPit 源码解析(04):装修图纸和合同文件上传处理流程
人工智能·ai·开源·github·open source·renopit
带娃的IT创业者13 小时前
Kimi-K3 开源背后:2.8 万亿参数的“暴力美学”与智能体的新拐点
人工智能·开源·大模型·智能体·开源模型·kimi-k3·moonshot ai
南巷羽13 小时前
用 TRAE Work 把 20 条 GitHub Issue 变成可复核的需求优先级清单
github·产品
众人皆醒我独醉14 小时前
Token:AI 世界的基本粒子——不是"字",是统计上最优的"字符组合"
后端·面试·llm
DigitalOcean14 小时前
AI 应用成本怎么算?从推理费用到完整 TCO 拆解
llm·agent
栩栩云生15 小时前
AI 最大的安全问题:它让”发送数据”看起来像”继续思考”
安全·github·agent
liulilittle15 小时前
MOE路由:路由(logits: top-k/8)
c++·人工智能·算法·机器学习·llm
m4Rk_16 小时前
【论文阅读】Agent 记忆机制(34):MemoryBank——用遗忘曲线管理可强化的长期对话记忆
论文阅读·人工智能·学习·开源·github
VIP_CQCRE16 小时前
用 Ace Data Cloud 快速接入 OpenAI Chat Completions API:兼容官方格式,更适合开发者落地
ai·大模型·openai·api·ace data cloud
一点一木17 小时前
Seed Evolving 深度测评:我用它造了一个 AI 出题工具
人工智能·python·github