技术栈
【Whisper】WhisperX: Time-Accurate Speech Transcription of Long-Form Audio
Dovake
2024-07-17 21:07
Abstract
Whisper 的跨语言语音识别取得了很好的结果,但是对应的时间戳往往不准确,而且单词级别的时间戳也不能做到开箱即用(out-of-the-box). 此外,他们在处理长音频时通过缓冲转录
whisper
上一篇:
<Rust>egui部件学习:如何在egui窗口中添加按钮button以及标签label部件?
下一篇:
ExcelToDB2:批量导入Excel到IBM DB2数据库的自动化工具
相关推荐
数据饕餮
6 天前
Faster-Whisper命令和意图识别程序设计调优:上下文感知和领域词汇增强
whisper
落淼喵_G
7 天前
ubuntu部署whisper+speaker_large+qwen【一】
ubuntu
·
whisper
兔兔爱学习兔兔爱学习
8 天前
浏览器端实时语音采集 + WebSocket 传输 + 后端 Whisper + GPT 翻译 + 实时字幕返回
gpt
·
websocket
·
whisper
兔兔爱学习兔兔爱学习
8 天前
一个可本地运行的实时字幕翻译 Demo(Whisper + GPT + Streamlit),可以边说边出中英文字幕
gpt
·
whisper
数据饕餮
9 天前
Faster-Whisper唤醒词检测程序设计实战1
whisper
说话的鲸鱼
9 天前
Whisper模型在RTranslator中的实时语音识别优化:动态资源分配与负载均衡
whisper
·
负载均衡
·
语音识别
猫头虎
17 天前
DeepSeek刚刚开源了一个3B的 OCR模型:什么是DeepSeek-OCR?单张A100-40G每天可以处理20万+页文档
人工智能
·
开源
·
whisper
·
prompt
·
aigc
·
ocr
·
gpu算力
星野云联AIoT技术洞察
25 天前
2025年语音识别(ASR)与语音合成(TTS)技术趋势分析对比
whisper
·
语音识别
·
模型部署
·
tts
·
asr
·
嵌入式ai
·
naturalspeech3
共绩算力
1 个月前
OpenAI Whisper 语音识别模型:技术与应用全面分析
人工智能
·
whisper
·
语音识别
·
共绩算力
人工智能技术派
1 个月前
Whisper推理源码解读
人工智能
·
语言模型
·
whisper
·
语音识别
热门推荐
01
GitHub 镜像站点
02
UV安装并设置国内源
03
综合整理:pdf预览显示:你尝试预览的文件可能对你的计算机有害。如果你信任此文件以及其来源,请打开此文件以看其内容,如何解决以正常预览文件
04
Linux下V2Ray安装配置指南
05
BongoCat - 跨平台键盘猫动画工具
06
安娜的档案(Anna’s Archive) 镜像网站/国内最新可访问入口(持续更新)
07
npm使用国内淘宝镜像的方法
08
jdk21下载、安装(Windows、Linux、macOS)
09
《大数据技术原理与应用》实验报告三 熟悉HBase常用操作
10
PyCharm 社区版全平台安装指南