Windows10本地部署Dify+Xinference

目录

前言

一、安装必要项

1.安装Docker和AnaConda

2.安装Xinference

3.通过Xinference部署本地glm4-chat-1m

4.验证glm4-chat-1m是否部署完成

5.安装Dify

三、Dify中配置大模型

1.浏览器输入http://localhost:80启动Dify页面

2.随便注册账户登录

3.配置Xinference

四、运行Dify

1.设置系统推理模型

2.对话窗口验证

总结


前言

本文档在基于Windows10的本地电脑上部署使用Dify,其中必要用到的Xinference大模型管理框架,使用的大模型为GLM4-Chat-1m。

前置条件:确保已安装Anaconda、Python、Cuda。

一、安装必要项

1.安装Docker和AnaConda

Docker: Accelerated Container Application Developmenthttps://www.docker.com/

下载 Anaconda Distribution |蟒蛇https://www.anaconda.com/download

2.安装Xinference

打开Anaconda命令行页面

输入命令:

  • conda create --name xinference python==3.12
  • conda activate xinference
  • pip install xinference[transformers]
  • pip install xinference[vllm],有问题,只装transformers也行
  • xinference-local --host 本机IPV4地址 --prot 9997(ps:查询本机IP:[cmd]输入ipconfig)

浏览器输入本机IP:9997后如下图:

3.通过Xinference部署本地glm4-chat-1m

4.验证glm4-chat-1m是否部署完成

5.安装Dify

官网下载源码https://github.com/langgenius/dify,例如下载到D:\dify

打开cmd,执行以下代码

  • cd D:\dify\docker
  • docker compose up -d

Docker中查看是否部署成功,启动即可

三、Dify中配置大模型

1.浏览器输入http://localhost:80启动Dify页面

2.随便注册账户登录

3.配置Xinference

前置条件:Xinference正常运行中

点击右上角头像---设置---模型供应商---XorbitsInference---添加模型

  • 模型类型选择LLM
  • 模型名称随便填,自己看的
  • 服务器URL填写Xinference的IPV4地址+端口:http://192.168.0.167:9997
  • 模型UID填写Xinference中的模型ID:glm4-chat-1m
  • 选择保存

四、运行Dify

1.设置系统推理模型

2.对话窗口验证


总结

以上就是在Windows 10环境下部署本地的Dify和Xinference,因为笔者是玩Unity出身,当前只是业余时间研究,有问题欢迎指正和探讨~

相关推荐
Baihai IDP1 小时前
AI 系统架构的演进:LLM → RAG → AI Workflow → AI Agent
人工智能·ai·系统架构·llm·agent·rag·白海科技
Apipost的同学们2 小时前
AI时代的接口自动化优化实践:如何突破Postman的局限性
后端·ai·架构·postman·自定义函数·apipost·api+ai
AI360labs_atyun3 小时前
Java在AI时代的演进与应用:一个务实的视角
java·开发语言·人工智能·科技·学习·ai
哈__6 小时前
学弟让我帮忙写一个学生管理系统的后端,我直接上科技
人工智能·ai
我爱一条柴ya8 小时前
【AI大模型】RAG系统组件:向量数据库(ChromaDB)
数据库·人工智能·pytorch·python·ai·ai编程
jonssonyan8 小时前
新作品:吃啥好呢 - 个性化美食推荐
ai·美食
Ai财富密码1 天前
使用Dify打造视频生成工作流:从提示词到视频的完整指南
工作流·dify·ai视频工作流·dify视频工作流
哈__1 天前
文心一言4.5开源部署指南及文学领域测评
人工智能·ai·文心一言·paddlepaddle
小阿鑫1 天前
AI领域又新增协议: AG-UI
ai·agent·mcp·a2a·ag-ui