本地安装属于自己的ai(open webui+ollama)

目标:我是想本地跑股票分析

环境:本地是macbook 配置:

型号名称: MacBook Pro

处理器名称: 8-Core Intel Core i9

核总数: 8

内存: 32 GB

安装环境:vmware fusion window10

核总数: 6

内存: 16 GB

  1. Windows 虚拟机浏览器打开官网下载安装包: Download Ollama on Windows

  2. 双击 OllamaSetup.exe,一路下一步安装,自动后台启动服务

  3. 打开 Windows CMD(管理员)验证安装

    复制代码
    ollama -v

    输出版本号即成功。

    1. 下载模型(Intel‑CPU 虚拟机优先 7B,速度流畅)

      Agent全自动任务模型(对标Trae‑SOLO)

      ollama pull deepseek-r1:7b

      代码模型,调试通达信指标、Python爬虫

      ollama pull qwen2.5-coder:7b

Windows 虚拟机安装 Python(用来运行 Open‑WebUI + 财经爬虫脚本)

  1. 下载 Python3.11.x(不要 3.13,兼容性差) 官网地址:Python Releases for Windows | Python.org

  2. 安装务必勾选 Add Python to PATH

  3. CMD 验证

    python --version
    pip --version

第四步:Windows 虚拟机一键安装 Open‑WebUI

管理员身份打开 PowerShell / CMD 运行:

复制代码
pip install open-webui

启动服务(一定要带上 --host 0.0.0.0,允许 Mac 宿主机浏览器访问)

复制代码
open-webui serve --host 0.0.0.0

启动成功后地址:http://localhost:3000(Windows 虚拟机本机)

第五步:Mac 宿主机访问虚拟机里面的 Open‑WebUI 网页

  1. Windows 虚拟机打开 CMD 查询本机内网 IP

    ipconfig

找到 IPv4 地址,例如:192.168.x.x 2. 在 Mac 电脑自带浏览器打开:

复制代码
http://192.168.x.x:3000

C:\Windows\system32> netstat -ano | findstr ":3000"                                                                    TCP    0.0.0.0:3000           0.0.0.0:0              LISTENING       9736
TCP    192.168.205.128:3000   192.168.205.1:56421    TIME_WAIT       0
TCP    192.168.205.128:3000   192.168.205.1:56428    TIME_WAIT       0

你就可以在 Mac 屏幕操作这个私有 AI 工作台,而行情软件运行在 Windows 虚拟机窗口内。

现在操作步骤

1. Mac 浏览器打开

复制代码
http://192.168.205.128:3000

会出现 Open‑WebUI 注册页面,注册管理员账号。

2. 配置 Ollama(网页内操作)

进入【设置】→【模型】 Ollama API 基础 URL 填写:

复制代码
http://127.0.0.1:11434

点刷新,就可以读到你本地的 deepseek‑r1:7b / qwen2.5‑coder:7b。

3. 修复 RAG 知识库(消除向量模块报错)

虚拟机新开 CMD,拉取 ollama 向量模型

复制代码
ollama pull nomic-embed-text

网页【设置】→【检索 (RAG)】

  • 嵌入引擎:Ollama
  • 嵌入模型:nomic‑embed‑text

由于我的是v0.11.3,没有找到网页 UI 可视化的「检索 / RAG 嵌入引擎」设置页面 ,所以用环境变量启动命令强制指定嵌入引擎

  1. 切回 Windows 虚拟机那个运行 open‑webui serve 的 PowerShell 黑窗口

  2. 按下键盘快捷键:Ctrl + C,停止当前 Open‑WebUI 服务

  3. 完整复制下面全部代码,一次性粘贴进 PowerShell 回车运行

    env:WEBUI_SECRET_KEY="my-super-secret-key-ai-123456"; env:OLLAMA_BASE_URL="http://127.0.0.1:11434";
    env:EMBEDDING_ENGINE="ollama"; env:EMBEDDING_MODEL="nomic-embed-text:latest";
    open-webui serve --host 0.0.0.0 --port 3000

避坑清单(Intel Mac + Windows 虚拟机)

  1. Ollama 服务不要关闭,Windows 右下角羊驼图标保持运行
  2. Open‑WebUI 启动命令必须加 --host 0.0.0.0,否则 Mac 宿主机浏览器打不开页面
  3. 不要同时开启 Windows 虚拟机 + Ubuntu 虚拟机,资源会被严重耗尽;全部功能单台 Windows 虚拟机搞定
  4. Ollama 模型优先 7B,不要强行跑 14B,CPU 速度很差
  5. 不想使用整套 AI 环境的时候,直接关闭 Windows 虚拟机即可,Mac 本机不会留下任何垃圾文件,完美隔离。
相关推荐
阿里云大数据AI技术3 分钟前
云栖2026|从“找到答案”到“完成任务”:阿里云以 Agentic Search 重塑 AI 搜索
大数据·人工智能·elasticsearch
liaiyang6683 分钟前
Python 3.14 装 AI 记忆系统踩了 7 个坑,手搓空圈容错治理原型
人工智能
决策与优化3 分钟前
实测三个 Jev 决策模型(均开源):Kev-4B、SemIf、diffusiongemma
人工智能
vivo互联网技术3 分钟前
知识不是文件,也不是向量 | KDC 系列 02
人工智能·设计模式·架构
许泽宇3 分钟前
188 万行 Rust 对 84 万行 TypeScript:我把 Codex 和 ZCode 拆到了骨头,看见了 AI 编程助手的两种活法
人工智能
阿里云大数据AI技术4 分钟前
云栖2026|湖生万物,助力 AI — 面向 Agent 的全模态数据平台
大数据·人工智能·agent
武子康4 分钟前
Claude Code + Codex 怎么分工?别把“允许结束”当成“可以提交”
人工智能·llm·agent
一粒麦仔4 分钟前
llama.cpp / Ollama / LM Studio:本地 LLM 推理栈的硬核拆解
人工智能·后端·架构
得物技术4 分钟前
别再只卷向量检索了,得物交易搜索如何用“生成式”实现召回范式跃迁?
人工智能·算法·llm
吴佳浩4 分钟前
多智能体系统的通信风暴与死锁治理:生产级降级与容灾方案
人工智能·agent·ai编程