CPQS-TUNING 论文引文阅读

文章目录

  • [一、引言 / 指令微调基础(必看 5 篇)](#一、引言 / 指令微调基础(必看 5 篇))
  • [二、相关工作:数据过滤 / 数据选择(核心对标 4 篇)](#二、相关工作:数据过滤 / 数据选择(核心对标 4 篇))
  • [三、方法动机:隐状态 / 模型内部信号(关键 3 篇)](#三、方法动机:隐状态 / 模型内部信号(关键 3 篇))
  • [四、实验与基准(打榜必引 4 篇)](#四、实验与基准(打榜必引 4 篇))
  • 五、模型与工程(可选但规范)

我直接按你这篇 CPQS‑Tuning 原文的章节逻辑,把参考文献里 最值得读、最经典、最能支撑你论文 的论文,按章节整理好, 标题+年份+一句话推荐理由 ,你写综述直接抄。


一、引言 / 指令微调基础(必看 5 篇)

  1. Training language models to follow instructions with human feedback (InstructGPT, 2022)
    推荐:指令微调 + RLHF 开山之作,所有对齐工作的源头,必须引。
  2. Stanford Alpaca: An instruction-following LLaMA model (Alpaca, 2023)
    推荐:开源指令微调范式鼻祖,你用的 Alpaca‑GPT4 就是它的延伸。
  3. Language models are few‑shot learners (GPT‑3, 2020)
    推荐:基座大模型预训练的里程碑,解释"基座模型为什么需要微调"。
  4. LIMA: Less is more for alignment (2023)
    推荐:高质量小数据胜过大数据,直接支撑你"数据过滤/精选"的动机。
  5. The Flan Collection: Designing data and methods for effective instruction tuning (2023)
    推荐:指令微调数据工程最系统工作,奠定数据质量重要性。

二、相关工作:数据过滤 / 数据选择(核心对标 4 篇)

  1. Alpagasus: Training a better alpaca with fewer data (ICLR 2024)
    推荐:用强 LLM 打分做数据过滤,你论文里直接对比的 SOTA。
  2. MoDS: Model‑oriented data selection for instruction tuning (2023)
    推荐:面向目标模型的数据选择,和你"模型自感知"思路最接近。
  3. Superfiltering: Weak‑to‑strong data filtering for fast instruction tuning (ACL 2024)
    推荐:小模型替大模型过滤,低成本数据筛选标杆,你必对比。
  4. What makes good data for alignment? (ICLR 2024)
    推荐:自动数据选择最全面综述类工作,适合写相关工作。

三、方法动机:隐状态 / 模型内部信号(关键 3 篇)

  1. I've got the "answer"! Interpretation of LLM hidden states in QA (2024)
    推荐:证明隐状态包含质量/正确性信号,直接支撑你 CPQS 核心假设。
  2. Latent space chain‑of‑embedding enables output‑free LLM self‑evaluation (2024)
    推荐:不用生成答案,用隐状态做自我评估,和你思路高度一致。
  3. HSF: Defending against jailbreak attacks with hidden state filtering (WWW 2025)
    推荐:用隐状态做过滤/筛选的实例,证明隐状态可用于数据判别。

四、实验与基准(打榜必引 4 篇)

  1. Measuring Massive Multitask Language Understanding (MMLU, 2021)
    推荐:大模型知识能力最通用基准,你论文必测。
  2. Training verifiers to solve math word problems (GSM8K, 2021)
    推荐:数学推理标准集,你下游任务核心基准。
  3. Evaluating large language models trained on code (HumanEval, 2021)
    推荐:代码生成权威基准,你代码实验必引。
  4. AlpacaEval: An automatic evaluator of instruction‑following models (2023)
    推荐:指令跟随能力自动评测标准,你对话类效果必用。

五、模型与工程(可选但规范)

  1. LLaMA 2: Open foundation and fine‑tuned chat models (2023)
    推荐:开源基座模型标杆,你实验用的 Llama2 来源。
  2. Qwen2.5 technical report (2024)
    推荐:你实验用到的强中文基座,必须标注来源。

极简总结(写论文直接用)

  • 想讲为什么要指令微调:读 InstructGPT、Alpaca、LIMA
  • 想讲为什么要数据过滤:读 Alpagasus、Superfiltering、MoDS
  • 想讲为什么能用隐状态:读隐状态解读 + 自评估那 3 篇
  • 想做评测打榜:读 MMLU、GSM8K、HumanEval、AlpacaEval

需要我把这些整理成可直接粘贴进论文的"Related Work"标准段落吗?

相关推荐
知几蜗牛2 分钟前
GPT-6 与 Intelligent UI:从回答到可审计操作的产品迁移
人工智能
蟕初的梦想3 分钟前
Claude Haiku 5.5 效能实测与场景应用指南
数据库·人工智能·大模型
liron718 分钟前
技术的诞生与演化--技术自举及其冷启动
人工智能·深度学习·神经网络·自然语言处理
知几蜗牛11 分钟前
Java 17 视觉识别结果的金额与字段门禁实现
人工智能
嘻嘻的AI日记12 分钟前
人工合规审查有盲区,智能合规如何补足文件风险识别短板
人工智能
UBIX泛联12 分钟前
机器人展风采,存储筑根基——泛联应邀参展电子科技大学70周年校庆展
人工智能·机器人·ai算力基础设施
知几蜗牛17 分钟前
Python + JSON Schema 实现工单结构化输出与本地复核
人工智能
Purple Coder27 分钟前
Jc的图像分析
人工智能
楚楚25129 分钟前
2026企业AI办公工具选型指南:从需求匹配到平台评估
大数据·人工智能
三小河30 分钟前
从 Markdown 到 Generative UI:AI 如何从“生成答案”进化到“生成界面”?
前端·人工智能·后端