技术栈
【Whisper】WhisperX: Time-Accurate Speech Transcription of Long-Form Audio
Dovake
2024-07-17 21:07
Abstract
Whisper 的跨语言语音识别取得了很好的结果,但是对应的时间戳往往不准确,而且单词级别的时间戳也不能做到开箱即用(out-of-the-box). 此外,他们在处理长音频时通过缓冲转录
whisper
上一篇:
<Rust>egui部件学习:如何在egui窗口中添加按钮button以及标签label部件?
下一篇:
ExcelToDB2:批量导入Excel到IBM DB2数据库的自动化工具
相关推荐
Luke Ewin
10 天前
一个基于OpenAI Whisper开发的音视频字幕文件生成工具
人工智能
·
whisper
·
音视频
·
语音识别
·
asr
·
语音转写
·
视频字幕生成
Encarta1993
16 天前
【语音识别】vLLM 部署 Whisper 语音识别模型指南
人工智能
·
whisper
·
语音识别
JHC000000
16 天前
ubuntu 下调用系统麦克风,以及faster-whisper-medium 处理音频转写文本
ubuntu
·
whisper
·
音视频
西西弗Sisyphus
18 天前
whisper 语音识别
whisper
·
语音识别
JHC000000
18 天前
docker 中跑faster-whisper 教程(1050显卡)
docker
·
容器
·
whisper
·
语音识别
engchina
1 个月前
vLLM 部署 openai whisper 模型实现语音转文字
人工智能
·
python
·
whisper
gs80140
1 个月前
Faster-Whisper —— 为语音识别加速的利器
人工智能
·
whisper
·
语音识别
charles_vaez
1 个月前
开源模型应用落地-语音转文本-whisper模型-AIGC应用探索(五)
深度学习
·
whisper
·
aigc
Mark White
1 个月前
开箱即用的whisper-service服务
whisper
Python数据分析与机器学习
2 个月前
基于fast-whisper模型的语音识别工具的设计与实现
大数据
·
人工智能
·
python
·
搜索引擎
·
whisper
·
语音识别
·
课程设计
热门推荐
01
KGG转MP3工具|非KGM文件|解密音频
02
从零安装 LLaMA-Factory 微调 Qwen 大模型成功及所有的坑
03
我决定放弃搞 Java 了
04
YOLOv5改进 | 添加CA注意力机制 + 增加预测层 + 更换损失函数之GIoU
05
YOLOv8入门 | 重要性能衡量指标、训练结果评价及分析及影响mAP的因素【发论文关注的指标】
06
DeepSeek各版本说明与优缺点分析
07
西电B测-计算机网络综合实验(含验收问题)
08
yolov8,yolo11,yolo12 服务器训练到部署全流程 笔记
09
苍穹外卖面试总结
10
最新 Kubernetes 集群部署 + flannel 网络插件(保姆级教程,最新 K8S 版本)