【Whisper】WhisperX: Time-Accurate Speech Transcription of Long-Form Audio

Abstract

Whisper 的跨语言语音识别取得了很好的结果,但是对应的时间戳往往不准确,而且单词级别的时间戳也不能做到开箱即用(out-of-the-box). 此外,他们在处理长音频时通过缓冲转录

相关推荐
不喝可乐_2 天前
在win11 中 whisper-large-v3-turbo 的简单使用
whisper
毛毛的毛毛6 天前
如何使用OPENAI的Whisper功能进行音频字母提取功能
whisper
Secede.9 天前
Whisper+T5-translate实现python实时语音翻译
开发语言·python·whisper
烤鸭的世界我们不懂9 天前
Python + WhisperX:解锁语音识别的高效新姿势
python·whisper·语音识别
落杉丶25 天前
[ASR]faster-whisper报错Could not locate cudnn_ops64_9.dll
python·whisper
drebander1 个月前
Whisper-Medium 模型:音频转文本的原理、实践与硬件推荐
whisper·音视频
drebander1 个月前
Whisper-Tiny 模型:音频转文本的原理与实践
whisper·音视频
大模型之路1 个月前
OpenAI Whisper:语音识别技术的革新者—深入架构与参数
人工智能·whisper·语音识别
南棱笑笑生1 个月前
20250109使用M6000显卡在Ubuntu20.04.6下跑whisper来识别中英文字幕
whisper
飘逸高铁侠2 个月前
使用 whisper和ffmpeg 烧录视频的中英文双语字幕
ffmpeg·whisper·音视频