用自然语言控制你的电脑:Windows-MCP 项目实测

1. 什么是 Windows-MCP?

一句话总结:

Windows-MCP 是一个开源的 MCP 服务器,把大语言模型(LLM)和 Windows 桌面「打通」,让 AI 可以像人一样点击、输入、查文件、跑程序。

2. 核心能力

功能 一句话说明 典型场景
文件浏览 列出/打开任意目录 让 AI 帮你找日志、整理桌面
应用控制 启动、关闭、切换窗口 "打开 Excel 并新建表格"
UI 自动化 鼠标、键盘、截图 自动填写表单、批量改图
QA 测试 读取 UI 状态并断言 让 AI 替你跑回归测试
零视觉依赖 不靠截图,纯系统 API 速度更快、兼容高分屏

3. 真实体验数据

  • • 平均延迟:1.5--2.3 秒/次操作

  • • 系统占用:Python 单进程 < 50 MB 内存

  • • 首次配置:3 条命令,2 分钟完成(见下方教程)

4. 3 步上手(Windows 实测)

① 准备环境

go 复制代码
# 安装 Python 3.13+
winget install Python.Python.3.13
# 或官网下载安装包

② 一键启动

go 复制代码
git clone https://github.com/CursorTouch/Windows-MCP.git
cd Windows-MCP
uv sync          # 自动装依赖
uv run server    # 启动 MCP 服务器

③ 接入 Cursor / Claude Desktop

在项目根目录新建 .cursor/mcp.json

go 复制代码
{
  "mcpServers":{
    "windows":{
      "command":"uv",
      "args":["run","server"],
      "cwd":"<你的Windows-MCP路径>"
    }
}
}

重启 Cursor,看到 ✅ 即成功。

5. 与同类方案对比

方案 是否开源 依赖视觉 最低延迟 扩展难度
Windows-MCP 1.5 s 改 Python 脚本即可
传统 RPA 3--5 s 需要商业 IDE
纯浏览器插件 2--4 s 仅限 Web

6. 安全提示

  • • 默认只监听 127.0.0.1,不外露端口

  • • 所有操作需用户显式授权(Cursor 会弹窗)

  • • 代码 MIT 协议,可自审、可二开

7. 下一步

  • • GitHub 地址:github.com/CursorTouch/Windows-MCP

  • • 欢迎提 Issue、PR,或直接在 Discussion 分享你的自动化脚本!

相关推荐
美酒没故事°17 小时前
Open WebUI安装指南。搭建自己的自托管 AI 平台
人工智能·windows·ai
一个欠登儿程序员19 小时前
在国产服务器上通过 Docker 部署 Windows 虚拟机
服务器·windows·docker
爱宇阳20 小时前
WSL2 隔离 Windows PATH 实战指南
windows·环境变量
ALex_zry20 小时前
C++模板元编程实战技巧
网络·c++·windows
I疯子21 小时前
2026-04-08 打卡第 5 天
开发语言·windows·python
一个人旅程~21 小时前
旧笔记本电脑安装win10精简版LTSB&win10LTSC&linuxmint作为三系统的操作指导书(以DELL n4020为例)
linux·windows·经验分享·电脑
开开心心就好21 小时前
支持自定义名单的实用随机抽签工具
windows·计算机视觉·计算机外设·excel·散列表·启发式算法·csdn开发云
dyj0951 天前
OpenClaw小龙虾本地部署【Windows系统 + 接入飞书】
windows·飞书
CresCent_Charles1 天前
(已解决)踩坑记录:Windows 11安装pointops编译时报错
windows
skywalk81631 天前
Windows下安装编译安装Whisper-CPP:一个语音实现框架集和高性能推理模型
人工智能·windows·whisper