技术栈
【Whisper】WhisperX: Time-Accurate Speech Transcription of Long-Form Audio
Dovake
2024-07-17 21:07
Abstract
Whisper 的跨语言语音识别取得了很好的结果,但是对应的时间戳往往不准确,而且单词级别的时间戳也不能做到开箱即用(out-of-the-box). 此外,他们在处理长音频时通过缓冲转录
whisper
上一篇:
<Rust>egui部件学习:如何在egui窗口中添加按钮button以及标签label部件?
下一篇:
ExcelToDB2:批量导入Excel到IBM DB2数据库的自动化工具
相关推荐
luoyayun361
18 小时前
PySide6调用OpenAI的Whisper模型进行语音ASR转写
whisper
·
pyside6
·
asr
学习是生活的调味剂
19 小时前
PEFT实战LoRA微调OpenAI Whisper 中文语音识别
人工智能
·
whisper
·
语音识别
qq742234984
6 天前
语音识别:PyAudio、SoundDevice、Vosk、openai-whisper、Argos-Translate、FunASR(Python)
python
·
whisper
·
语音识别
AI_Gump
6 天前
WhisperLiveKit上手及主观评测
人工智能
·
whisper
biubiubiu0706
6 天前
faster-whisper + FastAPI安装
whisper
cwll2009
6 天前
使用ffmpeg8.0的whisper模块语音识别
人工智能
·
whisper
·
语音识别
小小ken
6 天前
whisper-large-v3部署详细步骤,包括cpu和gpu方式,跟着做一次成功
ffmpeg
·
whisper
·
语音识别
蓝纹绿茶
23 天前
音转文模型对比FunASR与Faster_whisper
whisper
SmartJavaAI
23 天前
Java调用Whisper和Vosk语音识别(ASR)模型,实现高效实时语音识别(附源码)
java
·
人工智能
·
whisper
·
语音识别
菜鸟的日志
1 个月前
【音频字幕】构建一个离线视频字幕生成系统:使用 WhisperX 和 Faster-Whisper 的 Python 实现
python
·
whisper
·
音视频
热门推荐
01
KGG转MP3工具|非KGM文件|解密音频
02
UV安装并设置国内源
03
HarmonyOS NEXT开发进阶(十四):HarmonyOS应用开发者基础认证试题集汇总及答案解析
04
GitHub 镜像站点
05
最新b站加密关键字段的逆向(视频和评论爬取)
06
jdk21下载、安装(Windows、Linux、macOS)
07
46个Nano-banana 精选提示词,持续更新中
08
Linux下V2Ray安装配置指南
09
OpenSpeedy简介
10
MIUI显示/隐藏5G开关的方法,信号弱时开启手机Wifi通话方法