小白也能学会:AI分离人声 + FFmpeg替换音轨全流程

准备工作(你需要的工具)

本教程只用两样东西:vocal-separate(本地分离人声/伴奏)和FFmpeg(把伴奏替换回视频)。 vocal-separate是本地网页操作:Windows解压后双击start.exe即可自动打开浏览器页面上传文件分离。

第一步:用vocal-separate分离伴奏

  1. 下载并解压vocal-separate到任意目录(例如E:/vocal-separate),然后双击start.exe启动。
  2. 浏览器页面打开后,把视频文件直接拖拽到上传区域,或点击上传区域选择文件,然后点"立即分离"。
  3. 选择模型时,小白优先用2stems(更简单:输出vocal和accompaniment两条音轨),等待处理完成后在页面底部下载accompaniment.wav(伴奏)。

第二步:安装FFmpeg(以Windows为例)

Windows最常见的做法是下载已编译的FFmpeg二进制包(例如gyan.dev提供的build),解压后把bin目录加入系统PATH,这样在命令行可直接运行ffmpeg。 安装完成后,打开"命令提示符/PowerShell"输入ffmpeg -version验证是否安装成功(能显示版本信息就对了)。

第三步:替换视频音轨(核心命令)

把"原视频的画面"保留,同时把"音频"换成刚刚导出的伴奏,推荐用这一条命令(把文件名按你自己的改掉): ffmpeg -i input_video.mp4 -i accompaniment.wav -map 0:v:0 -map 1:a:0 -c:v copy -c:a aac -shortest output_no_vocals.mp4

几个参数怎么理解:

  • -map 0:v:0选第1个输入(原视频)的第1条视频流,-map 1:a:0选第2个输入(伴奏)的第1条音频流。
  • -c:v copy表示视频不重新编码,速度快且画质不变;-shortest让输出时长按较短的一路对齐,避免"黑屏但还在放音频"等情况。

如果新音频和视频时长不一致,可以先裁剪音频到视频时长再替换,例如:
ffmpeg -i accompaniment.wav -t 00:01:30 trimmed.wav,再用trimmed.wav去替换。

相关推荐
zzqssliu5 小时前
煤炉自动代拍系统的队列设计与超时控制机制
git·github
fthux8 小时前
“装闭”,让装修套路“装”不下去
人工智能·ai·开源·github·open source
用户849137175471611 小时前
想做护眼工具却脑子一片空白?我用 OpenSpec 把模糊想法聊成了 v0.1
github·vibecoding
wangruofeng11 小时前
git-filter-repo 把 .git 从 112MB 砍到 1.4MB,但漏推 tag 让 clone 又胖回来
github·devops
峰向AI12 小时前
Block 放出大招!Buzz:一个中继统一代码、聊天、CI 全流程
github
dong_junshuai12 小时前
每天一个开源项目#47 4.4K Stars 的 LikeC4:让架构图随代码进化
github
独立开阀者_FwtCoder15 小时前
最近做了一个健身小程序:智形健身助手,健身的佬们来提点意见
前端·javascript·github
夕夕木各19 小时前
从第一个 PR 到 Vite 官方中文文档维护者
github·vite
隔窗听雨眠20 小时前
GitHub Actions自动化运维实战:从零构建一体化CI/CD流水线
运维·自动化·github
dong_junshuai2 天前
每天一个开源项目#46 World Monitor:6.6万星、56层地图的全球情报中枢
github