技术栈
【Whisper】WhisperX: Time-Accurate Speech Transcription of Long-Form Audio
Dovake
2024-07-17 21:07
Abstract
Whisper 的跨语言语音识别取得了很好的结果,但是对应的时间戳往往不准确,而且单词级别的时间戳也不能做到开箱即用(out-of-the-box). 此外,他们在处理长音频时通过缓冲转录
whisper
上一篇:
<Rust>egui部件学习:如何在egui窗口中添加按钮button以及标签label部件?
下一篇:
ExcelToDB2:批量导入Excel到IBM DB2数据库的自动化工具
相关推荐
昨日之日2006
7 小时前
Moonshine - 新型开源ASR(语音识别)模型,体积小,速度快,比OpenAI Whisper快五倍 本地一键整合包下载
人工智能
·
whisper
·
语音识别
新缸中之脑
10 天前
基于Distil-Whisper的实时ASR【自动语音识别】
人工智能
·
whisper
·
语音识别
敢敢のwings
15 天前
如何在Windows平台下基于Whisper来训练自己的数据
windows
·
whisper
·
1024程序员节
z千鑫
15 天前
【OpenAI】第六节(语音生成与语音识别技术)从 ChatGPT 到 Whisper 的全方位指南
人工智能
·
chatgpt
·
whisper
·
gpt-3
·
openai
·
语音识别
·
codemoss能用ai
bug智造
18 天前
Whisper 音视频转写
whisper
·
音视频
客院载论
20 天前
论文学习——基于Whisper迁移学习的阿尔兹海默症检测方法——音频特征和语义特征的结合
学习
·
whisper
·
迁移学习
htsitr
22 天前
实时语音转文字(基于NAudio+Whisper+VOSP+Websocket)
whisper
盼海
23 天前
安装openai-whisper 失败
python
·
whisper
aiAIman
23 天前
主流显卡和 CPU 进行 Whisper 转录性能 RTF 转录时间估算
人工智能
·
python
·
语言模型
·
whisper
碳治郎AI
25 天前
【AIGC】OpenAI 宣布推出Whisper large-v3-turbo 语音转录模型 速度提高了8倍
人工智能
·
whisper
·
aigc
热门推荐
01
【HarmonyOS】HUAWEI DevEco Studio 下载地址汇总
02
(欧拉)openEuler系统添加网卡文件配置流程、(欧拉)openEuler系统手动配置ipv6地址流程、(欧拉)openEuler系统网络管理说明
03
组基轨迹建模 GBTM的介绍与实现(Stata 或 R)
04
【AIGC】重塑未来的科技巨轮
05
全面解析:构建基于深度学习的安全帽检测系统(UI界面+YOLO代码+数据集)
06
【经验分享】Ubuntu22.04安装微信(linux官方版)
07
基于YOLOv10深度学习的CT扫描图像肾结石智能检测系统【python源码+Pyqt5界面+数据集+训练代码】深度学习实战、目标检测
08
Ubuntu 20.04使用Livox mid 360 测试 FAST_LIO
09
RAG 实践- Ollama+RagFlow 部署本地知识库
10
红米手机使用google play