完全免费的离线运行的本地音视频转字幕工具,支持一键音视频提取文字,可以导出多种格式!

软件下载

软件介绍

这是一个离线运行的本地语音识别转文字工具,基于 fast-whipser 开源模型,可将视频/音频中的人类声音识别并转为文字,可输出json格式、srt字幕带时间戳格式、纯文字格式。

fast-whisper 开源模型有 tiny/base/small/medium/large-v3, 内置 tiny 模型,tiny->large-v3识别效果越来越好,但所需计算机资源也更多,根据需要可自行下载后解压到 models 目录下即可。

软件特点

  • **支持离线运行:**不联网即可使用
  • **支持导出多种格式****:**支持导出 JSON、SRT 字幕(带时间戳)、TXT 纯文本三种格式。
  • **内置开源大模型:**置 tiny 模型,同时支持下载 base/small/medium/large-v3 等模型替换,平衡识别精度与硬件性能。
  • **支持硬件加速:**支持 CPU 运行,若配置 CUDA 环境可修改为 GPU 加速,提升识别速度。
  • **操作简单:**解压运行即可使用

软件使用

软件解压

软件下载解压即可,解压路径尽可能设置为非中文路径下

软件运行

双击 start.exe ,等待自动打开浏览器窗口即可**(若未能自动打开,请手动打开网址 http://127.0.0.1:9977)**

上传之后就可以识别了

支持导出三个格式

使用GPU

如果机器拥有英伟达GPU,并正确配置了CUDA环境,将自动使用CUDA加速注意:默认使用 cpu 运算,如果确定使用英伟达显卡,并且配置好了cuda 环境,请修改 set.ini 中 devtype=cpudevtype=cuda,并重新启动,可使用cuda加速

相关推荐
linux_cfan4 小时前
videojs v10 源代码系列解读:14 · 谓词守卫:在运行时安全地调用能力
前端·javascript·音视频
赛博仓鼠5 小时前
秋叶ComfyUI 3.2整合包实测:Python 3.13+Torch 2.13全栈升级,一键跑通MiniMax H3(附完整部署)
ai·ai作画·aigc·音视频
乐橙开放平台7 小时前
从「多套客户端」到一套开放能力:乐橙视频监控能力复盘
笔记·物联网·自动化·音视频·智能家居
linux_cfan12 小时前
videojs v10 源代码系列解读:13 · 能力型媒体契约:`Media` 的组合接口
前端·javascript·音视频
勤劳X码农13 小时前
2026年TTS工具技术测评:7款方案实测,从免费额度到API集成全解析
人工智能·音视频·实时音视频
m0_6145235514 小时前
Log视频导入发灰,先查颜色链
音视频·视频编辑
linux_cfan1 天前
17 · 引擎适配器全景:HLS/DASH/Vimeo/Mux/Cast
前端·javascript·音视频
音视频牛哥1 天前
视频编码的终局不是“更省码率”:从 H.266、AV2 到 AI 编解码的下一场竞争
音视频·h.266·rtsp h.266·h.266编解码·rtp h.266·rtp vvc·ai编解码
程序员老陆1 天前
WHIP 与 WHEP:WebRTC 直播的标准化入口与出口
ffmpeg·音视频·webrtc·whip·whep
linux_cfan1 天前
16 · `custom-media-element`:属性拦截与转发
前端·javascript·音视频