Windows系统本地知识库构建:Cherry Studio+Ollama

本文较长,建议点赞收藏。更多AI大模型应用开发学习视频及资料,在智泊AI

  • 数据安全:数据不出本地,无泄露风险。
  • 零成本运行:核心组件(Ollama, Cherry Studio, 开源模型)免费。
  • 控制权:可自由选择和更换本地模型。

本地部署对硬件有一定要求。建议至少拥有16GB内存和一块支持CUDA(NVIDIA)或Metal(Apple Silicon)的显卡,以获得流畅的体验。CPU也可以运行,但速度会慢很多。

Ollama本地部署

Ollama是一个极简的本地大模型运行框架,能让您一键启动并管理本地模型。

下载 Ollama

官网:ollama.com/

LLM问答模型:

生成自然语言的答案。deepseek-r1:1.5b配置要求不高,但生成效果不怎么样,这里只是用来测试知识库。安装其它模型可以去ollama 官网看看。

复制代码
ollama pull deepseek-r1:1.5b

Embedding模型:

Embedding模型负责将文本转换为向量,构建知识库。

bash 复制代码
ollama pull shaw/dmeta-embedding-zh:latest

启动 Ollama

ollama 也有 chat 窗口,如果只是问答的话可以用。

复制代码
ollama listollama ps

Cherry Studio

Cherry Studio 是一款集多模型对话、知识库管理、AI 绘画、翻译等功能于一体的全能 AI 助手平台。

下载安装

官网:www.cherry-ai.com/

配置模型服务:

点击右上角的设置图表,选择"模型服务"

arduino 复制代码
http://localhost:11434

找到 Ollama,在 API地址栏中(默认就行)

在 Ollama 开启的状态下,点击下面的管理,点一下需要用到的模型。

将刚刚拉取的 shaw/dmeta-embedding-zh:latestdeepseek-r1:1.5b 添加到模型列表中。

创建知识库

设置中,选择常规设置,打开知识库。

点击首页旁边的"+",选择知识库,然后点击"添加",输入知识库名称。

点击设置图标

选择嵌入模型shaw/dmeta-embedding-zh:latest

回到知识库的界面上传文件,也可以通过"笔记"自己输入内容,添加目录和网址等。Cherry Studio会自动在后台进行文本分块和向量化处理。处理完成后,文件会显示绿色对勾。

官方文档

docs.cherry-ai.com/

使用示例

在聊天窗口中选中添加的知识库

点击"@"图标,选择大模型

deepseek-r1:1.5b不太行。

此外,如果本地大模型带不动,可以考虑使用线上的大模型搭配本地的知识库。

学习资源推荐

如果你想更深入地学习大模型,以下是一些非常有价值的学习资源,这些资源将帮助你从不同角度学习大模型,提升你的实践能力。

本文较长,建议点赞收藏。更多AI大模型应用开发学习视频及资料,在智泊AI

相关推荐
Ticnix40 分钟前
42 天 71 次提交之后,我重新看了一遍自己的架构决策
python·agent·全栈
Ticnix1 小时前
我调了三个月 overlap=50,它其实一次都没生效
后端·python·agent
不好听6131 小时前
图数据库为什么查关系快:免索引邻接,以及怎么把小说抽成图——Graph RAG 系列之二
agent
李溪白1 小时前
篇五:RAG —— 让 Agent 拥有外挂知识库
agent
辉夜技术1 小时前
大模型的理解力,用户的解空间:Jev 如何填满一个空白象限
agent
小林ixn1 小时前
从 LangChain 到 LangGraph:用「网状工作流」解锁多 Agent 协作的正确姿势
langchain·llm·agent
武子康1 小时前
自己做一个 Mini Reviewer:让 AI 审到本次准备提交的代码
人工智能·llm·agent
BryceBorder2 小时前
Agent Memory 不只是聊天记录:手搓三大记忆系统
后端·agent·面经·codex·claude code·agent memory
Old Uncle Tom2 小时前
评测即生死:Agent 时代的可靠性重构
人工智能·软件工程·agent
CODER03042 小时前
ubuntu22.04部署完整deepseek局域网web服务全过程(RTX5090安装黑屏+web端多人并发)
pytorch·webui·ubuntu22.04·ollama·deepseek·rtx5090·自然语言模型