技术栈
【Whisper】WhisperX: Time-Accurate Speech Transcription of Long-Form Audio
Dovake
2024-07-17 21:07
Abstract
Whisper 的跨语言语音识别取得了很好的结果,但是对应的时间戳往往不准确,而且单词级别的时间戳也不能做到开箱即用(out-of-the-box). 此外,他们在处理长音频时通过缓冲转录
whisper
上一篇:
<Rust>egui部件学习:如何在egui窗口中添加按钮button以及标签label部件?
下一篇:
ExcelToDB2:批量导入Excel到IBM DB2数据库的自动化工具
相关推荐
Swift社区
3 天前
用 Whisper 打破沉默:AI 语音技术如何重塑无障碍沟通方式?
人工智能
·
whisper
dgiij
13 天前
openai-whisper-asr-webservice接入dify
docker
·
ai
·
node.js
·
whisper
allnlei
14 天前
whisper相关的开源项目 (asr)
whisper
·
asr
phper8
19 天前
开源音视频转文字工具:基于 Vosk 和 Whisper 的多语言语音识别项目
whisper
·
音视频
·
语音识别
AI360labs_atyun
19 天前
使用 Whisper 生成视频字幕:从提取音频到批量处理
人工智能
·
科技
·
ai
·
whisper
·
音视频
·
教育
waterHBO
1 个月前
python + whisper 读取蓝牙耳机, 转为文字
python
·
whisper
代码骑士
1 个月前
基于whisper和ffmpeg语音转文本小程序
whisper
Luke Ewin
2 个月前
一个基于OpenAI Whisper开发的音视频字幕文件生成工具
人工智能
·
whisper
·
音视频
·
语音识别
·
asr
·
语音转写
·
视频字幕生成
Encarta1993
2 个月前
【语音识别】vLLM 部署 Whisper 语音识别模型指南
人工智能
·
whisper
·
语音识别
JHC000000
2 个月前
ubuntu 下调用系统麦克风,以及faster-whisper-medium 处理音频转写文本
ubuntu
·
whisper
·
音视频
热门推荐
01
海康Visionmaster-常见问题排查方法-启动阶段
02
KGG转MP3工具|非KGM文件|解密音频
03
YOLOv8入门 | 重要性能衡量指标、训练结果评价及分析及影响mAP的因素【发论文关注的指标】
04
Coze扣子平台完整体验和实践(附国内和国际版对比)
05
从零安装 LLaMA-Factory 微调 Qwen 大模型成功及所有的坑
06
【SpeedAI科研小助手】2分钟极速解决知网维普重复率、AIGC率过高,一键全文降!文件格式不变,公式都保留的!
07
R-tree详解
08
DeepSeek各版本说明与优缺点分析
09
VMware虚拟机安装Win7专业版保姆级教程(附镜像包)
10
CCF CSP 认证考试历年真题满分题解(所有前四题)