在本地windows电脑使用Docker搭建xinference环境

在本地windows电脑使用Docker搭建xinference环境

  • [1. 整体描述](#1. 整体描述)
  • [2. 前期准备](#2. 前期准备)
    • [2.1 Docker安装](#2.1 Docker安装)
    • [2.2 Xinference网站](#2.2 Xinference网站)
  • [3. Xinference安装](#3. Xinference安装)
    • [3.1 选择类型](#3.1 选择类型)
    • [3.2 具体安装](#3.2 具体安装)
    • [3.3 启动页面](#3.3 启动页面)
  • 总结

1. 整体描述

Xorbits Inference (Xinference) 是一个开源平台,用于简化各种 AI 模型的运行和集成。借助 Xinference,您可以使用任何开源 LLM、嵌入模型和多模态模型在云端或本地环境中运行推理,并创建强大的 AI 应用。

2. 前期准备

2.1 Docker安装

在本地安装Docker Desktop,可以参考这个文章:在本地windows电脑搭建Dify环境

2.2 Xinference网站

这里把Xinference相关网站附上,以便查询相关资料

github地址:github地址

官方文档地址:官方文档地址

3. Xinference安装

3.1 选择类型

安装分为GPU加速版本和CPU版本,根据自己电脑选择,我这电脑没有GPU,就选择CPU版本。

3.2 具体安装

执行如下cmd命令:

bash 复制代码
docker run -e XINFERENCE_MODEL_SRC=modelscope -p 9998:9997 xprobe/xinference:latest-cpu xinference-local -H 0.0.0.0 --log-level debug

执行之后,会自动进入下载,等待...

等待安装完成,在Docker Desktop上会有:

3.3 启动页面

点击启动按钮,运行容器,然后访问页面:http://localhost:9998/

会进入xinference的页面。

总结

至此,xinference就安装完成了,和Ollama相比,xinference多模态全覆盖:支持文本生成(LLM)、Embedding(如BGE、E5)、Rerank、语音合成(TTS)、语音识别(STT)等任务,Ollama基本都是LLM语言模型。

相关推荐
虎头金猫3 天前
4K 视频总卡在公网带宽?用 N1 + OpenList 把网盘播放链路重新理顺
运维·服务器·网络·python·容器·beautifulsoup·pandas
分布式存储与RustFS3 天前
MinIO 官方 Docker 镜像被移除:依赖它的项目该怎么办
docker·云原生·devops·对象存储·minio·分布式存储
奇思妙想聪明勤奋的小羊3 天前
DeepAgents第5章:子Agent 与上下文隔离—让 Agent学会委派
人工智能·python·学习·语言模型
IZero073 天前
Jev 与 Laya
python·语言模型
玉&心3 天前
通过Arthas在线诊断K8S中的内存及JVM等使用情况
docker·k8s·arthas
xing-xing3 天前
Docker容器中Nginx站点根目录网页配置访问
nginx·docker
赵文宇(温玉)3 天前
CoreDNS的hosts插件的缺行配置导致k8s集群异常
容器·kubernetes·rancher
guo_wen_qiang3 天前
上传本地镜像到harbor中
docker·容器·持续部署
羑悻的小杀马特3 天前
Dockerfile 全景指南:从入门编写dockerfile到生产环境镜像优化实战,一步步带你从啃透制作指令到镜像制作落地!
docker·dockerfile·镜像制作
BianHuanShiZhe3 天前
docker常见命令
docker