【Whisper】WhisperX: Time-Accurate Speech Transcription of Long-Form Audio

Abstract

Whisper 的跨语言语音识别取得了很好的结果,但是对应的时间戳往往不准确,而且单词级别的时间戳也不能做到开箱即用(out-of-the-box). 此外,他们在处理长音频时通过缓冲转录

相关推荐
Micheal_Dad15 天前
【尝试】基于openai-whisper进行语音转文字windows版本
whisper
Micheal_Dad15 天前
【尝试】本地部署openai-whisper,通过 http请求识别
whisper
andyguo18 天前
语音识别的速度革命:从 Whisper 到 Whisper-CTranslate2,我经历了什么?
人工智能·学习·ai·whisper·语音识别·xcode·ai测评
番茄老夫子19 天前
OpenAI推出的语音识别系统Whisper简析
人工智能·whisper·语音识别
A-刘晨阳21 天前
语音转文字「本地化」新解!Whisper Web+cpolar实现零服务器部署与远程操作
服务器·前端·whisper
云空1 个月前
《Whisper模型版本及下载链接》
whisper
苗杨1 个月前
【Faster-Whisper】离线识别本地视频并生成字幕
python·whisper·音视频
云空1 个月前
《Whisper:OpenAI的先进语音识别模型》
人工智能·whisper·语音识别
企鹅侠客1 个月前
19|Whisper+ChatGPT:请AI代你听播客
人工智能·ai·chatgpt·whisper
落沐萧萧2 个月前
本地多语言 AI 字幕组:Whisper 实战教程
人工智能·whisper