openai-whisper

openai-whisper

      • [0. 参数说明](#0. 参数说明)
      • [1. 视频语音转文字](#1. 视频语音转文字)
  • demo
      • [1. 提取b站视频中的音频,增加到自己的视频里,并且显示字幕](#1. 提取b站视频中的音频,增加到自己的视频里,并且显示字幕)
        • [1. 下载b站视频到电脑](#1. 下载b站视频到电脑)
        • [2. 提取视频中的音频](#2. 提取视频中的音频)
        • [3. 音频转文字](#3. 音频转文字)
        • [4. 自己的视频去掉音频,增加新的音频和字幕](#4. 自己的视频去掉音频,增加新的音频和字幕)

0. 参数说明

语音识别模型whisper的参数说明

1. 视频语音转文字

复制代码
export CUDA_VISIBLE_DEVICES=3
whisper 手把手教你从一无所有到财务自由_7.mp3 --model large-v2 --model_dir . --output_dir 7 --language Chinese

demo

1. 提取b站视频中的音频,增加到自己的视频里,并且显示字幕

1. 下载b站视频到电脑

1 如何将b站上的视频下载到本地

2 download b zhan videos

2. 提取视频中的音频
复制代码
ffmpeg  -i 手把手教你从一无所有到财务自由_8.mp4  -vn 手把手教你从一无所有到财务自由_8.mp3
3. 音频转文字
复制代码
export CUDA_VISIBLE_DEVICES=3

whisper 手把手教你从一无所有到财务自由_5.mp3 --model large-v2 --model_dir . --output_dir 5 --language Chinese

get 5 file
手把手教你从一无所有到财务自由_5.json
手把手教你从一无所有到财务自由_5.srt
手把手教你从一无所有到财务自由_5.tsv
手把手教你从一无所有到财务自由_5.txt
手把手教你从一无所有到财务自由_5.vtt

  • 字幕格式转换

    ffmpeg -i 手把手教你从一无所有到财务自由_5.srt 手把手教你从一无所有到财务自由_5.ass

  • ass字幕文件添加特效

复制代码
4. 自己的视频去掉音频,增加新的音频和字幕
  • a 视频添加硬字幕

    ffmpeg -i 手把手教你从一无所有到财务自由_5_music.mp4 -vf ass=手把手教你从一无所有到财务自由_5.ass 手把手教你从一无所有到财务自由_5_result.mp4

相关推荐
不解不惑3 天前
OpenAI whisper 语音识别服务器搭建
服务器·whisper·语音识别
许泽宇的技术分享4 天前
用 OpenAI Whisper + pyannote.audio 打造“谁在说什么”的全栈语音理解系统
macos·whisper·xcode
这儿有一堆花14 天前
使用 Whisper 转写语音的完整教学
人工智能·ai·whisper
数据饕餮1 个月前
Faster-Whisper命令和意图识别程序设计调优:上下文感知和领域词汇增强
whisper
落淼喵_G1 个月前
ubuntu部署whisper+speaker_large+qwen【一】
ubuntu·whisper
兔兔爱学习兔兔爱学习1 个月前
浏览器端实时语音采集 + WebSocket 传输 + 后端 Whisper + GPT 翻译 + 实时字幕返回
gpt·websocket·whisper
兔兔爱学习兔兔爱学习1 个月前
一个可本地运行的实时字幕翻译 Demo(Whisper + GPT + Streamlit),可以边说边出中英文字幕
gpt·whisper
数据饕餮1 个月前
Faster-Whisper唤醒词检测程序设计实战1
whisper
说话的鲸鱼1 个月前
‌Whisper模型在RTranslator中的实时语音识别优化:动态资源分配与负载均衡
whisper·负载均衡·语音识别
猫头虎1 个月前
DeepSeek刚刚开源了一个3B的 OCR模型:什么是DeepSeek-OCR?单张A100-40G每天可以处理20万+页文档
人工智能·开源·whisper·prompt·aigc·ocr·gpu算力