Windows10本地部署Dify+Xinference

目录

前言

一、安装必要项

1.安装Docker和AnaConda

2.安装Xinference

3.通过Xinference部署本地glm4-chat-1m

4.验证glm4-chat-1m是否部署完成

5.安装Dify

三、Dify中配置大模型

1.浏览器输入http://localhost:80启动Dify页面

2.随便注册账户登录

3.配置Xinference

四、运行Dify

1.设置系统推理模型

2.对话窗口验证

总结


前言

本文档在基于Windows10的本地电脑上部署使用Dify,其中必要用到的Xinference大模型管理框架,使用的大模型为GLM4-Chat-1m。

前置条件:确保已安装Anaconda、Python、Cuda。

一、安装必要项

1.安装Docker和AnaConda

Docker: Accelerated Container Application Developmenthttps://www.docker.com/

下载 Anaconda Distribution |蟒蛇https://www.anaconda.com/download

2.安装Xinference

打开Anaconda命令行页面

输入命令:

  • conda create --name xinference python==3.12
  • conda activate xinference
  • pip install xinference[transformers]
  • pip install xinference[vllm],有问题,只装transformers也行
  • xinference-local --host 本机IPV4地址 --prot 9997(ps:查询本机IP:[cmd]输入ipconfig)

浏览器输入本机IP:9997后如下图:

3.通过Xinference部署本地glm4-chat-1m

4.验证glm4-chat-1m是否部署完成

5.安装Dify

官网下载源码https://github.com/langgenius/dify,例如下载到D:\dify

打开cmd,执行以下代码

  • cd D:\dify\docker
  • docker compose up -d

Docker中查看是否部署成功,启动即可

三、Dify中配置大模型

1.浏览器输入http://localhost:80启动Dify页面

2.随便注册账户登录

3.配置Xinference

前置条件:Xinference正常运行中

点击右上角头像---设置---模型供应商---XorbitsInference---添加模型

  • 模型类型选择LLM
  • 模型名称随便填,自己看的
  • 服务器URL填写Xinference的IPV4地址+端口:http://192.168.0.167:9997
  • 模型UID填写Xinference中的模型ID:glm4-chat-1m
  • 选择保存

四、运行Dify

1.设置系统推理模型

2.对话窗口验证


总结

以上就是在Windows 10环境下部署本地的Dify和Xinference,因为笔者是玩Unity出身,当前只是业余时间研究,有问题欢迎指正和探讨~

相关推荐
MJ绘画中文版2 小时前
灵动AI:艺术与科技的融合
人工智能·ai·ai视频
健忘的派大星9 小时前
什么是RAG,有哪些RAG引擎?看完这一篇你就知道了!!
人工智能·ai·语言模型·langchain·llm·agi·rag
AI原吾11 小时前
构建灵活、高效的HTTP/1.1应用:探索h11库
网络·python·网络协议·http·ai·h11
小城哇哇12 小时前
【AI多模态大模型】基于AI的多模态数据痴呆病因鉴别诊断
人工智能·ai·语言模型·llm·agi·多模态·rag
Roc_z716 小时前
探讨Facebook的AI研究:未来社交平台的技术前瞻
ai·facebook·社交媒体·隐私保护
MJ绘画中文版16 小时前
灵动AI:科技改变未来
人工智能·ai·ai视频
大模型算法和部署16 小时前
构建生产级的 RAG 系统
人工智能·机器学习·ai
moseyaya1 天前
我用Replicate训练了个纹身Flux AI LORA模型,分享下经验
ai
洋洋科创星球1 天前
新王Claude 3.5的6大应用场景
人工智能·ai·产品经理·ai编程
努力的光头强1 天前
人工智能大模型赋能医疗健康产业白皮书(2023年)|附88页PDF文件下载
人工智能·算法·ai·pdf·产品经理·llama