Agent之Tool:MoneyPrinterTurbo(一站式 AI 短视频生成工具)的简介、安装和使用方法、案例应用之详细攻略
目录
[方式一:Windows 一键启动](#方式一:Windows 一键启动)
[方式二:Docker 部署](#方式二:Docker 部署)
[方式三:使用 uv 手动部署](#方式三:使用 uv 手动部署)
[方式四:使用 venv + pip](#方式四:使用 venv + pip)
[使用 WebUI](#使用 WebUI)
[使用 API](#使用 API)
[使用 CLI](#使用 CLI)
[使用 AI Agent](#使用 AI Agent)
[案例三:生成横屏 16:9 视频](#案例三:生成横屏 16:9 视频)
[案例六:使用不同 TTS 与字幕模式生成视频](#案例六:使用不同 TTS 与字幕模式生成视频)
MoneyPrinterTurbo的简介
MoneyPrinterTurbo 是一个"一站式 AI 短视频生成工具"。根据项目 GitHub 首页的介绍,用户只需要提供视频主题或关键词,系统即可自动完成视频脚本生成、素材匹配、字幕生成和背景音乐配置,并最终合成高清视频。项目同时提供 AI Agent、WebUI、API 和 CLI 四种使用方式,代码按照控制器、服务和模型等职责进行分层。
在内容生成方面,项目支持 AI 自动生成视频脚本,也允许直接使用自定义脚本;支持 9:16 的 1080x1920 竖屏和 16:9 的 1920x1080 横屏,可以批量生成多个视频,并通过视频片段时长设置控制素材切换频率。同时,项目支持多语言视频脚本、多个语音合成 Provider、字幕样式调整、背景音乐以及本地和在线视频素材。
在运行方式方面,项目支持 Windows、macOS 和主流 Linux 发行版;本地部署需要 Python 3.11 或更高版本,项目推荐使用 uv 管理环境与依赖,也提供 Docker 部署方式。GPU 并非必需,但项目说明,如果使用本地转录、faster-whisper、批量生成或更重的本地处理链路,GPU 会明显提升处理速度。
Github地址 :https://github.com/harry0703/MoneyPrinterTurbo
1 、特点
|--------------|------------------------------------------------------------------------------------------------------------------------------------------------|
| 特点 | 详细说明 |
| 一站式短视频生成 | 从主题或关键词开始,自动完成脚本、素材、字幕和背景音乐处理,并合成高清视频。 |
| 四种使用入口 | 同时提供 AI Agent、WebUI、API 和 CLI 四种使用方式。 |
| AI 自动生成脚本 | 可以根据视频主题自动生成视频脚本,也支持用户直接输入自定义脚本。 |
| 多种视频尺寸 | 支持竖屏 9:16、1080x1920,以及横屏 16:9、1920x1080。 |
| 批量生成 | 可以一次生成多个视频,再从生成结果中选择满意的视频。 |
| 多语言 | 支持多语言视频脚本生成。 |
| 多种语音合成 | 支持 Edge TTS、Azure Speech、SiliconFlow、Google Gemini、小米 MiMo、ElevenLabs、Chatterbox 和 Fish Audio 等语音方案,并可以实时试听。 |
| 字幕可配置 | 支持字幕生成,并可调整字体、位置、颜色、大小、描边和背景样式。 |
| 两种字幕生成模式 | edge 使用 TTS 时间戳生成字幕,速度快且不需要 GPU;whisper 使用本地 faster-whisper 转写音频,用于需要更准确字幕时间轴的场景。 |
| 背景音乐 | 可以随机选择背景音乐或指定音乐文件,并调整背景音乐音量。 |
| 多种素材来源 | 支持使用本地素材,也可以从 Pexels、Pixabay 和 Coverr 获取高清素材。 |
| AI 生成素材 | 支持接入 WaveSpeed AI 的文生视频模型,根据脚本关键词直接生成新的画面。 |
| 多模型支持 | 支持 Kimi/Moonshot AI、OpenAI、Anthropic Claude、Google Gemini、DeepSeek、通义千问、Azure OpenAI、火山引擎方舟、xAI Grok、MiniMax、小米 MiMo 等,同时兼容多个统一网关、聚合平台和本地运行环境。 |
| 跨平台发布 | 生成完成后,可以自动上传到 TikTok、Instagram 和 YouTube Shorts。 |
| 配置预设 | 可以将生成设置导出、导入为预设文件,并在设置弹窗中备份和恢复 API Key。 |
| Docker 部署 | 项目提供 Docker Compose 部署方式,并提供预构建镜像配置。 |
| AI Agent 自动化 | 如果 Agent 支持读取 Skill 文档并操作本地终端,可以直接让 Agent 自动完成安装、配置和视频生成。 |
MoneyPrinterTurbo的安装和使用方法
1、安装
方式一:Windows 一键启动
项目提供 Windows 一键启动包。仓库说明,下载并解压后,路径不要包含中文、特殊字符或空格;下载后建议先运行 update.bat 更新代码,再运行 start.bat 启动。启动后会自动打开浏览器。
下载 Windows 一键启动包
↓
解压到合适路径
↓
双击 update.bat
↓
双击 start.bat
↓
自动打开浏览器
方式二:Docker 部署
项目提供预构建镜像的 Docker Compose 部署方式。首先进入项目目录:
cd MoneyPrinterTurbo
docker compose -f docker-compose.release.yml up
仓库说明,docker-compose.release.yml 默认直接使用 GitHub Container Registry 上的预构建镜像;首次启动前,需要准备 config.toml,供容器挂载使用。
启动之后:
WebUI:
http://127.0.0.1:8501
API 文档:
http://127.0.0.1:8080/docs
http://127.0.0.1:8080/redoc
方式三:使用 uv 手动部署
项目推荐使用 uv 管理 Python 环境和依赖,本地部署支持 Python 3.11 或更高版本。
git clone https://github.com/harry0703/MoneyPrinterTurbo.git
cd MoneyPrinterTurbo
uv python install 3.11
uv sync --frozen
仓库说明,pyproject.toml 是主依赖定义文件,uv.lock 用于锁定解析后的环境,因此默认推荐使用 uv sync --frozen。
方式四:使用 venv + pip
项目同时保留传统的 venv + pip 安装方式:
python3.11 -m venv .venv
source .venv/bin/activate
pip install -r requirements.txt
在这种方式下,requirements.txt 主要用于兼容旧的 pip 安装方式。
配置项目
项目提供 config.example.toml。当前 README 说明,首次启动时可以根据该文件自动创建 config.toml,大模型 Provider、素材来源及相应 API Key 可以直接通过 WebUI 的基础设置进行配置。
2、使用方法
使用 WebUI
完成本地安装后,可以在项目根目录启动 WebUI。
Windows:
.\webui.bat
macOS 或 Linux:
sh webui.sh
项目脚本会优先使用项目虚拟环境或一键包内置 Python;对于 macOS/Linux,也会自动使用项目虚拟环境或 uv,并选择可用端口。启动后会自动打开浏览器。
项目还支持通过环境变量让局域网其他设备访问 WebUI:
MPT_WEBUI_HOST=0.0.0.0 sh webui.sh
Windows 下可以先设置:
set MPT_WEBUI_HOST=0.0.0.0
再运行 webui.bat。
使用 API
API 服务通过以下命令启动:
uv run python main.py
如果已经手动激活虚拟环境,也可以直接执行:
python main.py
启动后的 API 文档地址为:
http://127.0.0.1:8080/docs
http://127.0.0.1:8080/redoc
使用 CLI
项目支持不打开浏览器、直接从命令行生成视频。README 给出的完整示例为:
uv run python cli.py --video-subject "人工智能如何改变日常生活"
查看完整命令、参数和用法:
uv run python cli.py --help
使用 AI Agent
项目提供 Skill 文档。当 AI Agent 能够读取 Skill 文档并操作本地终端时,可以直接发送项目 README 给出的请求:
使用这个 Skill:https://raw.githubusercontent.com/harry0703/MoneyPrinterTurbo/main/docs/skill/SKILL.md
帮我生成一个主题为"人工智能如何改变普通人的日常生活"的视频。
仓库说明,Agent 会自动完成安装、配置和视频生成,仅在缺少必要 API Key 时询问用户,完成后返回生成的视频文件路径;目前这一方式支持 macOS 和 Windows。
配置字幕
项目默认使用 edge 字幕模式,以 TTS 时间戳生成字幕,不需要 GPU;也可以切换到 whisper,利用本地 faster-whisper 生成字幕时间轴。
例如在 config.toml 中:
[app]
subtitle_provider = "whisper"
[whisper]
model_size = "large-v3-turbo"
项目说明,large-v3-turbo 模型目录需要放在:
MoneyPrinterTurbo/
└─ models/
└─ whisper-large-v3/
├─ config.json
├─ model.bin
├─ preprocessor_config.json
├─ tokenizer.json
└─ vocabulary.json
自动发布到短视频平台
项目 README 给出了通过 Upload-Post 自动发布到 TikTok、Instagram 和 YouTube Shorts 的配置方式:
[app]
upload_post_enabled = true
upload_post_api_key = "your-api-key"
upload_post_username = "your-username"
upload_post_platforms = ["tiktok", "instagram", "youtube"]
upload_post_auto_upload = true
upload_post_youtube_privacy_status = "public"
保存配置并重新启动项目后,视频生成完成即可自动发布到已配置的平台;YouTube 可见性可以设置为 public、unlisted 或 private。
MoneyPrinterTurbo的案例应用
案例一:根据主题自动生成完整短视频
项目 README 给出了 CLI 的完整生成示例,输入视频主题即可启动生成流程:
uv run python cli.py --video-subject "人工智能如何改变日常生活"
该项目的核心工作流会围绕主题生成视频内容,并结合脚本、素材、语音、字幕和背景音乐等能力形成最终视频。仓库同时将 AI Agent、WebUI、API 和 CLI 都作为正式使用入口。
案例二:生成中文竖屏短视频
项目支持 9:16 竖屏规格,分辨率为 1080x1920,并支持多语言视频脚本。README 的作品展示中包含"城市醒来的时刻""清洁能源的未来""为什么我们仍要探索太空""一粒种子的旅程"等中文竖屏视频示例。
因此,该案例可直接按照项目的竖屏规格,通过 WebUI、CLI 或 API 输入主题,由系统生成符合 9:16 尺寸的中文短视频。项目本身展示的这些作品均标注为由 MoneyPrinterTurbo 实际生成。
案例三:生成横屏 16:9 视频
项目同时支持 16:9 横屏、1920x1080 的视频尺寸。README 的作品展示中包含"深海里的微光""阅读如何塑造我们""一杯手冲咖啡的细节""春天适合出发"等中文横屏视频,也展示了英文横屏作品。
该案例使用项目的横屏输出规格,并通过同一套视频生成流程完成脚本、素材、配音、字幕和视频合成。
案例四:一次生成多个视频并进行选择
MoneyPrinterTurbo 的功能列表明确支持批量视频生成,可以一次生成多个视频,然后选择其中最满意的结果。
在批量生成场景中,项目同时提供 CPU/GPU 配置说明:GPU 并非使用前提,但 README 指出,如果使用批量生成或较重的本地处理链路,GPU 会明显提高速度。
案例五:使用自定义脚本配合本地或在线素材
项目并不要求所有内容都由 AI 自动生成。功能列表明确指出,除了 AI 自动生成视频脚本之外,也可以使用自定义脚本;素材方面则既支持用户自己的本地素材,也支持从 Pexels、Pixabay 和 Coverr 获取素材。
因此,可以先提供自定义脚本,再通过项目的素材能力完成视频片段匹配,并进一步加入语音、字幕和背景音乐,最终形成完整短视频。
案例六:使用不同 TTS 与字幕模式生成视频
项目支持多种 TTS Provider,包括 Edge TTS、Azure TTS、SiliconFlow、Google Gemini、小米 MiMo、ElevenLabs、Chatterbox 和 Fish Audio;同时支持 edge 和 whisper 两种字幕生成方式。
其中,默认的 edge 模式直接利用 TTS 时间戳生成字幕,不要求 GPU;whisper 模式使用本地 faster-whisper 转写音频,适用于需要更准确字幕时间轴的场景。
案例七:视频生成完成后自动发布
项目支持一键跨平台发布。配置 Upload-Post 后,可以将生成结果自动上传至 TikTok、Instagram 和 YouTube Shorts。README 给出的配置包括 API Key、用户名、目标平台、自动上传开关以及 YouTube 隐私状态。
例如:
[app]
upload_post_enabled = true
upload_post_api_key = "your-api-key"
upload_post_username = "your-username"
upload_post_platforms = ["tiktok", "instagram", "youtube"]
upload_post_auto_upload = true
保存后重新启动项目,视频生成完成即可按照配置自动发布;YouTube 的可见性支持 public、unlisted 和 private。