有声书实现

强烈忠告,如果你的电脑运行内存太小,磁盘空间太小这个东西就别玩了,玩不转

想玩最好运行内存32GB的游戏本或者16g的也能玩,盘符选个200GB的空盘符来玩

电脑内存太低不建议搞,太吃cpu和内存了,我这个是8g的内存,盘符空间用的50GB,玩着太慢了,转了两三个音频后盘符直接撑爆了。

前提是有装有docker

装好后设置docker 的镜像源

javascript 复制代码
{
  "builder": {
    "gc": {
      "defaultKeepStorage": "20GB",
      "enabled": true
    }
  },
  "experimental": false,
  "registry-mirrors": [
    "https://docker.1ms.run",
    "https://docker.xuanyuan.me",
    "https://docker.m.daocloud.io"
  ]
}

装有声书镜像

用管理员权限打开powrshell 执行下面命令,下面这个过程会比较漫长大概有7个g左右

docker run --pull always --rm -p 7860:7860 dockerproxy.com/athomasson2/ebook2audiobook

语音模型连不上

docker run -d -p 7860:7860 --env HF_ENDPOINT=https://hf-mirror.com --restart unless-stopped athomasson2/ebook2audiobook

还有报错说是内存不够,下面方法尝试一下(亲测有用)

报错信息

Info

Using CPU

Free Memory available: 3GB

Free Memory 3 is lower than VRAM/RAM 4GB required!

It will probably crash the conversion!

一、先完全退出所有相关程序

  1. 先停掉终端里的 Docker 容器 打开你之前运行命令的 PowerShell 窗口,按 Ctrl + C,看到命令行回到 PS C:\WINDOWS\system32> 就说明停好了。

  2. 彻底退出 Docker Desktop 点击 Docker 窗口右上角的叉号,然后右键任务栏右下角的鲸鱼图标,选择 Quit Docker Desktop,确保完全退出。

  3. 关闭所有其他占内存的软件把浏览器、微信、QQ、视频软件、游戏这些都关掉,先给系统腾出足够的内存。


二、修改配置,给 WSL2 分配更多内存(关键步骤)

  1. 打开记事本,新建一个文件,复制下面这段内容:

    ini

    复制代码
    [wsl2]
    memory=6GB
    processors=4
    swap=2GB
  2. 把文件保存为 .wslconfig(文件名前面一定要有个点!保存类型选 "所有文件"),放到这个路径:C:\Users\你的用户名\.wslconfig(把 "你的用户名" 换成你电脑的用户名,比如 pudding

  3. 以管理员身份打开 PowerShell,执行命令让配置生效:

    powershell

    复制代码
    wsl --shutdown

三、重新启动 Docker 和工具

  1. 打开 Docker Desktop,等它完全启动(右下角鲸鱼图标不再转圈)。

  2. 打开 PowerShell,用下面这条命令重新启动工具(带国内镜像,解决模型下载问题): powershell

    复制代码
    docker run --pull always --rm -p 7860:7860 --env HF_ENDPOINT=https://hf-mirror.com athomasson2/ebook2audiobook
  3. 等它启动完成,再去浏览器打开 http://127.0.0.1:7860 试试。


✅ 这样操作后,WSL2 能用到 6GB 内存,你的 8GB 电脑完全够跑,不会再报内存不足的错误了。

中文语音包

这个网站找

https://hf-mirror.com/coqui/XTTS-v2

  • 搜索结果里点第一个 coqui/XTTS-v2,进入模型主页。
  • 往下滑,找到 Files and versions 标签页,点进去。
  • 找到 samples 文件夹,点进去就能看到:
    • zh-cn_female_01.wav
    • zh-cn_male_01.wav
  • 点文件右边的「下载」按钮,就能直接保存了。

第一步:点进文件列表

  1. 点击页面上方的 Files and versions(我帮你框出来了),进入文件目录。
  2. 你会看到所有文件和文件夹,找到名为 samples 的文件夹,点进去。

第二步:找到中文音色文件

进入 samples 文件夹后,就能看到两个关键文件:

  • zh-cn_female_01.wav:标准中文女声
  • zh-cn_male_01.wav:标准中文男声

第三步:下载文件

  1. 把鼠标移到你想下载的文件上,右边会出现一个「下载」图标(↓)。
  2. 点击这个图标,文件就会直接保存到你的电脑里。
  3. 如果还是提示未授权,先点右上角的「Log In」,用手机号注册一个免费账号登录后,再点击下载即可。

下载完成后,回到你的 ebook2audiobook 里:

  1. TTS 引擎选 xtts
  2. 点击「Upload Voice」,选择刚下载的 .wav 文件
  3. 语言选 Chinese,就能合成标准普通话了。

电子书格式转换网站:https://ebook.proton1.cn/txt2epub.html

注意:你的盘符空间至少在装完镜像之后要保留50GB的空间,不然很快你会发现,你的docker在运行容器转音频的时候,会不断撑大你的盘符,直到没有内存后docker进程再也无法进行

这个时候你要做的就是删除那个虚拟的盘,

删除的后果就是

Docker 会变成全新的空环境 ebook2audiobook 镜像会消失 你的 E 盘瞬间多出 44GB 空间 Docker 本身不会坏,不会报错,不会崩溃 下次打开 Docker,它会自动新建一个小的空白虚拟磁盘

相关推荐
咖啡八杯1 小时前
GoF设计模式——解释器模式
java·后端·spring·设计模式
优橙教育2 小时前
5G网优培训 vs Java开发:转行选哪个?
java·开发语言·5g
糖果店的幽灵2 小时前
【DeepAgents 从入门到精通】Context Management 上下文管理
java·人工智能·后端·spring·中间件·langgraph·deepagents
腻害兔3 小时前
【若依项目-产品经理视角】RuoYi-Vue-Pro 源码拆解:字典、短信、邮件、通知——后台系统的“基础设施四件套“!
java·前端·vue.js·产品经理·ai编程
SeaTunnel4 小时前
从 Python Script 地狱到标准化数据集成框架
大数据·开发语言·python·程序员·代码·seatunnel
碎光拾影4 小时前
ARM交叉工具链各工具作用及IMX6ULL平台LED+蜂鸣器裸机程序实现
java·开发语言·数据库
Marst Code4 小时前
(python)2026Plotly 库评估:交互式可视化到底值不值得引入?
开发语言·python
Miao121315 小时前
微服务 API 测试实践:海外某民宿平台如何构建模式驱动测试基础设施
java·开发语言
腻害兔5 小时前
【若依项目-产品经理视角】RuoYi-Vue-Pro 源码拆解:支付模块 yudao-module-pay,一个让产品经理都看懂的支付中台设计
java·前端·vue.js·产品经理·ai编程
CRMEB系统商城6 小时前
开源自建还是SaaS订阅?算一笔3年经济账
java·大数据·开发语言·开源