论文阅读:Mixture-of-Agents Enhances Large Language Model Capabilities

一、简介

旨在利用多个 LLM 的专业知识增强自然语言理解和生成任务的能力。

提出了一种新方法,通过代理混合 (MoA) 方法利用多个 LLM 在不同专业方面的优势。即一个分层的 MoA 架构,其中每一层都包含多个 LLM 代理。每个代理都将上一层代理的所有输出作为生成其响应的辅助信息。MoAmodels 在 AlpacaEval 2.0、MT-Bench 和 FLASK 上实现了最先进的性能,超过了 GPT-4 Omni。

创新点

(1) 提出了一个 Mixture-of-Agents 框架,旨在利用多个 LLM 的优势,从而提高它们的推理和语言生成能力。

(2) 语言模型协作性的发现:即 LLM 之间的遗传协作性,其中模型在可以访问其他模型的输出时往往会产生更高质量的响应,即使这些输出的质量较低。

二、模型

为了从多个LLM中获得最佳结果,需要准确描述不同的模型在写作过程中的优点。可以将模型分为两个不同的角色

Proposer:生成有用的响应以供其他模型参考使用。作为proposer角色的模型不一定产生高分回答,但是必要条件是提供更多的上下文和观点,最终在被聚合器使用时有助于更好的最终回答。

Aggregator:将其他模型的响应合成到单一、高质量输出的模型。

聚合器获得的模型输出和prompt

三、实验

**benchmark:**主要评估 AlpacaEval 2.0上的模型,此外,还在 MT-Bench 上进行了评估

**model:**Qwen1.5-110B-Chat、Qwen1.572B-Chat、WizardLM-8x22B、LLaMA-3-70B-Instruct、Mixtral-8x22B-v0.1、dbrx-instruct。构建了 3 个 MoA 层,并在每个 MoA 层中使用相同的模型集。使用 Qwen1.5-110BChat 作为最后一层的聚合器。

另外开发了一个名为 MoA w/ GPT-4o 的变体,它通过使用 GPT-4o 作为最终 MoA 层中的聚合器,以优先考虑高质量输出。

另一个变体 MoA-Lite 强调成本效益。它使用与 proposer 相同的模型集,但仅包含 2 个 MoA 层,使用 Qwen1.5-72B-Chat 作为聚合器。

所有推理都通过 Together Inference Endpoint 运行。

相关推荐
Alice-YUE17 小时前
ai对话平台中的functioncalling+mcp
前端·笔记·学习·语言模型
东方隐侠安全团队-千里17 小时前
AI Coding Agent 执行依赖安装前的安全检查清单:从 Composer 漏洞看到命令执行
人工智能·安全·php·composer
xcbrand17 小时前
工业制造品牌全案公司哪家专业
大数据·人工智能·python·制造
L-影17 小时前
下篇:核函数、软间隔和它的“江湖地位”——SVM的三种形态
人工智能·机器学习·支持向量机
reset202117 小时前
支持向量机(SVM)原理与应用
人工智能·机器学习·支持向量机
懂AI的老郑17 小时前
解锁边缘智能:多模态模型边缘化部署的机遇与挑战
人工智能
henry_201617 小时前
让 AI 编程助手拥有“记忆“:Mem0 OpenMemory MCP 部署到 K8s 全记录(踩坑 + 解决方案)
人工智能·ai·容器·kubernetes·kiro
翼龙云_cloud17 小时前
腾讯云代理商:云上 OpenClaw5 分钟接入 Slack 指南 AI 助手一键部署实战
服务器·人工智能·云计算·腾讯云·openclaw
AI医影跨模态组学17 小时前
Eur Radiol(IF=4.7)山西医科大学第一医院核磁影像科王效春等团队:基于Transformer增强型卷积神经网络的多中心MRI评估膀胱癌肌层浸润
人工智能·深度学习·论文·transformer·医学·医学影像
YuanDaima204817 小时前
大语言模型生命周期全链路解析:从架构基石到高效推理
开发语言·人工智能·python·语言模型·架构·transformer