一段音频/视频分离成人声与伴奏,Windows + Anaconda 快速跑通 Spleeter(离线可用)

✅ 目标:把一段音频/视频分离成人声伴奏

🧩 环境:Windows 10/11 + Anaconda(Python 3.8)

🚫 无 GPU 也能跑(cudart 提示可忽略)

https://github.com/Deezer/spleeter

准备一个测试音频:https://github.com/deezer/spleeter/raw/master/audio_example.mp3

放置到你想放置的文件夹位置: cmd cd到你放置文件的位置,例如:

cd /d "文件夹路径"


1) 🧪 创建独立环境

bash 复制代码
conda create -n spleeter38 python=3.8 -y
conda activate spleeter38

2) 🎵 安装音频依赖(必须)

bash 复制代码
conda install -c conda-forge ffmpeg libsndfile -y

3) 📦 安装 Spleeter(在线最省心)

bash 复制代码
pip install -i https://pypi.mirrors.ustc.edu.cn/simple spleeter==2.1.0
pip install -i https://pypi.mirrors.ustc.edu.cn/simple tensorflow==2.3.0 pandas==1.1.2 protobuf==3.20.3 tensorflow-estimator==2.3.0

💡 说明

  • TF 2.3.0 需 protobuf ≤ 3.20.x(否则会 "Descriptors cannot be created directly")

  • 看到 cudart64_101.dll not found无 GPU 可忽略

4) ⬇️ 下载官方模型并放到正确目录

解压两次后,放到之前建的"文件夹路径"(注意目录层级):

%APPDATA%\spleeter\models\pretrained_models\2stems\

目录内应直接包含 5 个文件:

复制代码
checkpoint;model.data-00000-of-00001;model.index;model.meta;model.json

5) 📍 固定模型根目录(一次设置)

例如:

bash 复制代码
setx SPLEETER_MODEL_PATH "C:\Users\Lenovo\AppData\Roaming\spleeter\models\pretrained_models\2stems\"

关掉当前命令窗 → 重新打开 → conda activate spleeter38

快速自检:

bash 复制代码
python -c "import os;print('SPLEETER_MODEL_PATH=',os.getenv('SPLEETER_MODEL_PATH'));p=r'C:\Users\Lenovo\AppData\Roaming\spleeter\models\pretrained_models\2stems\checkpoint';print('checkpoint_exists=',os.path.exists(p))"

应看到 checkpoint_exists= True

6) ▶️ 开始分离(支持 mp3/wav/mp4)

运行分离:

bash 复制代码
spleeter separate -p spleeter:2stems -o output audio_example.mp3

输出:

output\audio_example\ ├─ vocals.wav (人声) └─ accompaniment.wav (伴奏)

看到这里你要不点个赞,那就是纯渣男渣女了🤜🤜🤜

欢迎点赞、收藏+转发,有问题随时评论区或私信交流, 感谢支持

++To be better!!!++

相关推荐
2601_955662468 小时前
AI 配音工具 7 款实测:短视频、影视解说、小说推文音质横向对比
人工智能·音视频·语音识别·视频
阿童木写作9 小时前
跨境电商图片翻译工具,批量翻译视频字幕一键抠图
人工智能·python·音视频
天真小巫14 小时前
2026.8.30总结
职场和发展
搜词研究员14 小时前
# 德立教育和达德教育哪个好?学历提升选哪家?
考研·职场和发展·学习方法·高考
深圳市宝华视联15 小时前
医院内网部署手术示教系统注意事项
嵌入式硬件·实时互动·音视频·实时音视频·视频编解码·嵌入式实时数据库
小柯南敲键盘15 小时前
跨境电商图片翻译工具,批量处理视频字幕与抠图
人工智能·python·音视频
weixin_4334176716 小时前
阿里视频大模型wan2.7‑t2v,可以生成视频
人工智能·python·音视频
郝学胜-神的一滴16 小时前
C++11 工程级应用 06:自己造一个类似Python的Range迭代器
开发语言·c++·windows·python·程序人生·microsoft
superstarsupers17 小时前
从广西到西藏,黄晓明2026年多次驰援灾区:二十余载公益坚守,持续传递温暖
娱乐
Fxkj88817 小时前
企业新媒体IP陪跑真实价值解析:合作体验与效果评判标准
大数据·人工智能·tcp/ip·媒体