GPUStack × CherryStudio:为企业用户构建安全可靠的本地私有化 AI 助手(中)

步骤二:部署模型

**1.**打开 GPUStack 网页端「模型库」页面

**2.**选择要运行的模型(如 Qwen3)

**3.**点击「保存」,转到「部署」页面,等待状态变为 Running

模型可用后,可在 GPUStack 的「Playground - Chat」直接测试:

亦可按需部署更多模型(如下仅为演示):

更多部署细节见 GPUStack 项目与文档:

项目地址:https://github.com/gpustack/gpustack

官方文档:https://docs.gpustack.ai/

显存不足或需添加多节点,请参考下图:

步骤三:连接 CherryStudio

如尚未安装 CherryStudio,请先访问官网安装:https://www.cherry-ai.com/

**1.**打开 CherryStudio,进入「设置」→「模型服务」,搜索 "GPUStack"

**2.**选择「GPUStack」,并启用(未启用将无法使用)

**3.**配置参数:

Base URL:http://your_server_ip/v1-openai/(注意:末尾斜杠必需)

API Key:在 GPUStack 的「API Keys」页面新建并复制

**4.**管理模型

**5.**测试连接

配置正确后,会显示"连接成功"。

6.(可选)设置默认模型

至此,CherryStudio 即可调用 GPUStack 上部署的模型,获得与 OpenAI 一致的使用体验,同时实现对数据与算力的完全掌控。

相关推荐
漂流瓶jz2 小时前
【AI】大模型本地部署与量化:Ollama、transformers、llama.cpp实践
人工智能·llm·ai编程
飞哥数智坊4 小时前
AI时代,我们到底该学什么、用什么,为什么还没提效?
人工智能
飞哥数智坊4 小时前
GPT 做架构,国内模型写代码:这条 AI 开发路线能跑通吗?
人工智能·ai编程
AI_AGENT_DEV_AI4 小时前
AI 智能体的开发与上线
人工智能
VL——MOESR4 小时前
【具身智能】VLA论文阅读随笔
论文阅读·人工智能·机器学习·具身智能·vla
OCR_133716212755 小时前
从模板匹配到AI泛化识别:文本抽取如何重构护照阅读器落地生态
人工智能·重构
大唐荣华5 小时前
从OpenAI关停Sora看世界模型、AI视频与国内具身智能赛道路线分化
人工智能·openai·sora·内容生成
DevOps老兵5 小时前
AI Infra实战02:GPU监控实战,用DCGM+Prometheus+Grafana看清每一张卡
人工智能·grafana·prometheus·ai infra·gpu监控·dcgm
旧日之血_Hayter5 小时前
Antigravity 工作流的实践记录
人工智能
dozenyaoyida5 小时前
AI与大模型新闻日报 | 2026-09-01
人工智能·ai·大模型·新闻