本地视频转文字|video2text

说明

一直想找下视频转文字的工具,都有很多限制,于是自己写了个自用的小工具.反正一般平常工作的时候独立显卡用的也不多,让它跑视频正好.

复制代码
- Video2Text 是一款功能视频转文本工具,集成了 faster_whisper 语音转写引擎和 Ollama + Qwen2.5 智能总结模型。
- 本项目支持多种视频格式(MP4、AVI、MOV、MKV等),可高质量地将视频内容转换为文本,并提供智能总结功能。
- 支持多种输出格式(TXT、SRT、VTT、JSON),具备 GPU 加速和多语言支持能力。
- 项目提供命令行和图形界面两种使用方式,并打包了 Windows 绿色版,无需安装即可使用。
- 使用的语音识别模型large-v3和总结文本模型Qwen2.5可以自己配置切换

源代码已上传github:

https://github.com/fuyouling/video2text

GUI界面

Windows 安装教程

Windows 系统上安装打包好的 video2text 程序的完整步骤。mac和linux的话就自己去拉下源码编译运行

包含的文件

安装包体积较大,已上传至 123 云盘,内含以下组件:

  • Ollama 安装包及模型文件
  • ffmpeg 安装包
  • video2text 绿色版 exe 程序包 video2text_portable_windows_日期.zip
  • large‑v3 模型文件

请使用支持保留目录结构的解压工具(如 7‑Zip)解压压缩包,确保文件夹结构完整。

连接:

复制代码
『来自123云盘用户喵王龙的分享』video2text
链接:https://1840674647.share.123pan.cn/123pan/7CfNTd-SE7j3?pwd=viWa#
提取码:viWa

安装步骤

  1. 安装 Ollama

    • 运行 Ollama 的 exe 安装程序。
    • models.zip 解压到 C:\Users\%USERNAME%\.ollama 目录下。
    • 开启Ollama,直接打开安装好的程序就行
  2. 安装 ffmpeg

    • 直接运行 ffmpeg 安装程序。
    • 完成后将 ffmpeg 所在目录添加到系统 PATH 环境变量,以便在命令行中直接调用。
    • 运行 ffmpeg -version 检查是否成功显示版本信息。
  3. 部署 video2text

    • 解压 video2text 绿色版 exe 程序包。
    • large‑v3 模型文件解压到 video2text.exe 所在目录下的 models 子文件夹中。

完成以上步骤后,即可在 Windows 环境下运行 video2text,并使用 large‑v3 模型进行视频转文本。

相关推荐
Promising_GEO3 小时前
新电脑科研环境配置指南:Miniforge + PyCharm + GitHub 从安装到可用
ide·python·pycharm·github·地理
tech讯息3 小时前
商业化内容生产适用企业级视频生成模型云平台推荐|从模型生成至审核分发全链路 AWS 选型方案
人工智能·音视频·aws
Patrick在香港3 小时前
Claude API 成本直降90%:Prompt Caching 提示词缓存 Python 实战
python·缓存·prompt
郝学胜-神的一滴4 小时前
并查集深度入门:从玄学抽象到 QuickFind & QuickUnion 源码实战
数据结构·c++·python·程序人生·算法·软件开发
她说可以呀4 小时前
Spring AI 常用 Advisor
人工智能·python·spring
小玮看世界4 小时前
[Python] str() 和 join() 的区别与实战避坑指南
前端·javascript·python
卷无止境4 小时前
FastAPI 的 WebSocket 装了些什么
后端·python·fastapi
码云骑士4 小时前
108-vLLM推理引擎-PagedAttention-连续批处理-吞吐提升10倍
python·vllm
DeepVisionary4 小时前
从微软砍掉Copilot的AI播客、Deep Research看AI产品“做减法“:个人版与企业版合并,超级应用呼之欲出
python·自动化
IT·侯老师4 小时前
qq-auto-reply
python