技术栈
【Whisper】WhisperX: Time-Accurate Speech Transcription of Long-Form Audio
Dovake
2024-07-17 21:07
Abstract
Whisper 的跨语言语音识别取得了很好的结果,但是对应的时间戳往往不准确,而且单词级别的时间戳也不能做到开箱即用(out-of-the-box). 此外,他们在处理长音频时通过缓冲转录
whisper
上一篇:
<Rust>egui部件学习:如何在egui窗口中添加按钮button以及标签label部件?
下一篇:
ExcelToDB2:批量导入Excel到IBM DB2数据库的自动化工具
相关推荐
云空
14 天前
《Whisper模型版本及下载链接》
whisper
苗杨
17 天前
【Faster-Whisper】离线识别本地视频并生成字幕
python
·
whisper
·
音视频
云空
20 天前
《Whisper:OpenAI的先进语音识别模型》
人工智能
·
whisper
·
语音识别
企鹅侠客
21 天前
19|Whisper+ChatGPT:请AI代你听播客
人工智能
·
ai
·
chatgpt
·
whisper
落沐萧萧
1 个月前
本地多语言 AI 字幕组:Whisper 实战教程
人工智能
·
whisper
码码哈哈爱分享
1 个月前
[特殊字符] Whisper 模型介绍(OpenAI 语音识别系统)
人工智能
·
whisper
·
语音识别
Swift社区
1 个月前
用 Whisper 打破沉默:AI 语音技术如何重塑无障碍沟通方式?
人工智能
·
whisper
dgiij
1 个月前
openai-whisper-asr-webservice接入dify
docker
·
ai
·
node.js
·
whisper
allnlei
1 个月前
whisper相关的开源项目 (asr)
whisper
·
asr
phper8
2 个月前
开源音视频转文字工具:基于 Vosk 和 Whisper 的多语言语音识别项目
whisper
·
音视频
·
语音识别
热门推荐
01
Java学习第十五部分——MyBatis
02
集群聊天服务器---MySQL数据库的建立
03
Coze扣子平台完整体验和实践(附国内和国际版对比)
04
基于odoo17的设计模式详解---装饰模式
05
使用Ruby接入实时行情API教程
06
扣子(coze)实战|我用扣子搭建了一个自动分析小红薯笔记内容的AI应用|详细步骤拆解
07
Everything文件检索工具 几秒检索几百G的文件
08
基于odoo17的设计模式详解---单例模式
09
DeepSeek各版本说明与优缺点分析
10
【无标题】