whisper.cpp编译

一、开始常规编译

# 1. 进入 whisper.cpp 源代码目录

cd path\to\whisper.cpp

# 2. 创建一个专门的构建目录,并进入

mkdir build && cd build

# 3. 使用 CMake 配置项目,生成 MSVC 解决方案文件

cmake .. -A x64

# 4. 开始编译,生成库文件和示例程序(例如 whisper-cli.exe)

cmake --build . --config Release

二、编译带SDL2支持的whisper.cpp

地址下载SDL2,版本要是:2.30.8-VC

https://github.com/libsdl-org/SDL/tree/release-3.4.10

复制代码
cd E:\digitalHuman\libs\whisper.cpp\build
# 清理之前的缓存(重要!)
Remove-Item * -Recurse -Force

# 关键:使用 -DSDL2_DIR 指向包含 sdl2-config.cmake 的目录
cmake .. -A x64 -DWHISPER_SDL2=ON -DSDL2_DIR=E:\digitalHuman\libs\SDL2-devel-2.30.8-VC\SDL2-2.30.8\cmake

编译成功后,所有生成的文件(包括静态库whisper.libggml.lib)都会位于 build\bin\Releasebuild\src\Release目录下

三、下载模型:

先到路径:whisper.cpp\models

复制代码
./download-ggml-model.cmd base
复制代码
cd E:\digitalHuman\libs\whisper.cpp
.\models\download-ggml-model.cmd small   # 约 488 MB
# 或
.\models\download-ggml-model.cmd medium  # 约 1.5 GB

四、在PowerShell中执行指令

.\whisper-stream.exe -m E:\digitalHuman\libs\whisper.cpp\models\ggml-base.bin -t 4 --step 300 --length 6000 -l zh -vth 0.6

增加 -vth 参数,让模型只在语音能量较高时识别:

复制代码
--length 5000 --step 500 更长的窗口(5 秒)可以提供更多上下文,帮助模型纠正错误。

.\whisper-stream.exe -m E:\digitalHuman\libs\whisper.cpp\models\ggml-medium.bin -t 4 --step 500 --length 3000 -l zh

.\whisper-stream.exe -m E:\digitalHuman\libs\whisper.cpp\models\ggml-base.bin -t 4 --step 500 --length 3000 -l zh

五、在 PowerShell 中设置输出编码

复制代码
先执行[Console]::OutputEncoding = [System.Text.Encoding]::UTF8

再执行指令

复制代码
相关推荐
顶点多余13 分钟前
9.18 面试题总结 --- 绿盟
linux·面试
^Rocky17 分钟前
IT 疑难杂症诊疗室:复杂技术问题解决实录
运维·bug
Ivanqhz24 分钟前
Slope One 算法详解:与矩阵分解、共现矩阵的异同
java·服务器·网络·人工智能·深度学习
挖掘狂人39 分钟前
当生产环境"变慢",我用这套 perf + strace 30 分钟定位瓶颈
linux·运维·性能优化
Wang's Blog1 小时前
Java 项目实战: 外卖平台-数据库环境搭建与十一张表结构解析
java·服务器·redis
王六米。1 小时前
RAG知识库建设 文档解析 切分与索引如何衔接
服务器·前端·网络·企业数字化转型·智钳智能盒子
wuyk5552 小时前
【Socket 进阶之路】第 7 章 IO 多路复用 select & poll 完整实战|多 fd 监听、超时等待、优缺点横向对比
服务器·开发语言·网络·数据库·物联网
傲世仙尊2 小时前
IO流起步-从fopen到文件描述符fd
linux
Rabitebla2 小时前
【Linux系统编程】 指令(二):一条路径是怎么定位到文件的
linux·c++·笔记·学习·算法
人工智能培训2 小时前
大语言模型:从语言理解到通用智能的跃迁
linux·服务器·前端·人工智能