LLM之Agent(三):HuggingGPT根据用户需求自动调用Huggingface合适的模型

​ 浙大和微软亚洲研究院开源的HuggingGPT,又名JARVIS,它可以根据用户的自然语言描述的需求就可以自动分析需要哪些AI模型,然后去Huggingface上直接调用对应的模型,最终给出用户的解决方案。

一、HuggingGPT的工作流程

它的工作流程包括四个阶段:

  • **任务规划:**ChatGPT将用户的需求解析为任务列表,并确定任务之间的执行顺序和资源依赖关系;

  • **模型选择:**ChatGPT根据HuggingFace上托管的各专家模型的描述,为任务分配合适的模型;

  • **任务执行:**混合端点(包括本地推理和HuggingFace推理)上被选定的专家模型根据任务顺序和依赖关系执行分配的任务,并将执行信息和结果给到ChatGPT;

  • **响应生成:**最后,由ChatGPT总结各模型的执行过程日志和推理结果,给出最终的输出。

下表展示了HuggingGPT的具体细节:

不同任务的任务规划评估,如下表所示:

任务规划的格式是: [{"task": task, "id", task_id, "dep": dependency_task_ids, "args": {"text": text, "image": URL, "audio": URL, "video": URL}}],参数的详细解释,如下表所示:

二、HuggingGPT的示例

假设我们有如下请求,来看一下HuggingGPT的完整流程:

请求:请生成一个女孩正在看书的图片,她的姿势与example.jpg中的男孩相同。然后请用你的声音描述新图片。

可以看到HuggingGPT是如何将它拆解为6个子任务,并分别选定模型执行得到最终结果的。

、**** HuggingGPT不同任务的实验效果

参考文献:

1\] https://github.com/microsoft/JARVIS \[2\] https://huggingface.co/spaces/microsoft/HuggingGPT \[3\] https://arxiv.org/abs/2303.17580 \[4\] https://twitter.com/DrJimFan/status/1642563455298473986

相关推荐
陈敬雷-充电了么-CEO兼CTO5 小时前
具身智能多模态感知与场景理解:融合语言模型的多模态大模型
人工智能·python·gpt·语言模型·自然语言处理·chatgpt·多模态
一杯敬朝阳 一杯敬月光15 小时前
记录下chatgpt的openai 开发过程
python·chatgpt·flask
小杨互联网15 小时前
如何确保 ChatGPT 不会让你变“傻”?——四个防止认知萎缩的习惯
人工智能·chatgpt
AMiner:AI科研助手15 小时前
警惕!你和ChatGPT的对话,可能正在制造分布式妄想
人工智能·分布式·算法·chatgpt·deepseek
今天也要学习吖1 天前
OpenAI开放ChatGPT Projects功能,免费用户也能用了!
人工智能·chatgpt·aigc·openai·chatgptprojects
美人鱼战士爱学习1 天前
2023 arXiv MapperGPT: Large Language Models for Linking and Mapping Entities
chatgpt
GEO_JYB1 天前
大语言模型的“思考”逻辑:从Token生成到上下文理解的内部流程
人工智能·chatgpt
陈敬雷-充电了么-CEO兼CTO2 天前
66具身智能让人形机器人 “活” 起来:懂语言、能感知、会行动,智能进化再提速
人工智能·gpt·机器学习·chatgpt·机器人·机器翻译·具身智能
Virgil1392 天前
如何正确使用ChatGPT做数学建模比赛——数学建模AI使用技巧
人工智能·数学建模·chatgpt
迪娜学姐3 天前
顶级科学家的AI使用指南:从工具到合作伙伴
论文阅读·人工智能·chatgpt·prompt·论文笔记