论文阅读:Mixture-of-Agents Enhances Large Language Model Capabilities

一、简介

旨在利用多个 LLM 的专业知识增强自然语言理解和生成任务的能力。

提出了一种新方法,通过代理混合 (MoA) 方法利用多个 LLM 在不同专业方面的优势。即一个分层的 MoA 架构,其中每一层都包含多个 LLM 代理。每个代理都将上一层代理的所有输出作为生成其响应的辅助信息。MoAmodels 在 AlpacaEval 2.0、MT-Bench 和 FLASK 上实现了最先进的性能,超过了 GPT-4 Omni。

创新点

(1) 提出了一个 Mixture-of-Agents 框架,旨在利用多个 LLM 的优势,从而提高它们的推理和语言生成能力。

(2) 语言模型协作性的发现:即 LLM 之间的遗传协作性,其中模型在可以访问其他模型的输出时往往会产生更高质量的响应,即使这些输出的质量较低。

二、模型

为了从多个LLM中获得最佳结果,需要准确描述不同的模型在写作过程中的优点。可以将模型分为两个不同的角色

Proposer:生成有用的响应以供其他模型参考使用。作为proposer角色的模型不一定产生高分回答,但是必要条件是提供更多的上下文和观点,最终在被聚合器使用时有助于更好的最终回答。

Aggregator:将其他模型的响应合成到单一、高质量输出的模型。

聚合器获得的模型输出和prompt

三、实验

**benchmark:**主要评估 AlpacaEval 2.0上的模型,此外,还在 MT-Bench 上进行了评估

**model:**Qwen1.5-110B-Chat、Qwen1.572B-Chat、WizardLM-8x22B、LLaMA-3-70B-Instruct、Mixtral-8x22B-v0.1、dbrx-instruct。构建了 3 个 MoA 层,并在每个 MoA 层中使用相同的模型集。使用 Qwen1.5-110BChat 作为最后一层的聚合器。

另外开发了一个名为 MoA w/ GPT-4o 的变体,它通过使用 GPT-4o 作为最终 MoA 层中的聚合器,以优先考虑高质量输出。

另一个变体 MoA-Lite 强调成本效益。它使用与 proposer 相同的模型集,但仅包含 2 个 MoA 层,使用 Qwen1.5-72B-Chat 作为聚合器。

所有推理都通过 Together Inference Endpoint 运行。

相关推荐
测不准1 小时前
终端日志还在手抄 ANSI 颜色码么?这个 VS Code 插件让你像选主题一样配颜色
人工智能
kuinnebula1 小时前
知识图谱skill
人工智能·知识图谱
DS随心转小程序2 小时前
实测评测 AI 导出鸭转化效能,全方位优化 DeepSeek 输出 word 文档落地使用效率
人工智能·aigc·word·豆包·deepseek·ai导出鸭
哈尔ai2 小时前
别让模型接口成为参数黑洞:Spring MVC 请求绑定、校验与错误契约实战
人工智能
ONEYAC唯样2 小时前
唯样-AI时代,MLCC迎来第二个黄金十年
人工智能
szxinmai主板定制专家2 小时前
基于Zynq MPSoC的多路GMSL相机同步采集与低延迟图像预处理系统|车载视觉高速解决方案
人工智能·zynq·gmsl·rk3588+fpga·rk3576+fpga
王莎莎2 小时前
科研 Agent 先别急着搜:为什么 schema discovery 才是工作流的第一步
人工智能
zhulin10282 小时前
用 TRAE Work 3 小时的工作量,压缩到 20 分钟
人工智能
不加辣椒2 小时前
第10章:上下文工程系统架构设计
人工智能
Bigger2 小时前
把中式美学塞进工具站,到底怎样才不土?我拿烟火食间试了一遍
人工智能·设计·视觉设计