技术栈
【Whisper】WhisperX: Time-Accurate Speech Transcription of Long-Form Audio
Dovake
2024-07-17 21:07
Abstract
Whisper 的跨语言语音识别取得了很好的结果,但是对应的时间戳往往不准确,而且单词级别的时间戳也不能做到开箱即用(out-of-the-box). 此外,他们在处理长音频时通过缓冲转录
whisper
上一篇:
<Rust>egui部件学习:如何在egui窗口中添加按钮button以及标签label部件?
下一篇:
ExcelToDB2:批量导入Excel到IBM DB2数据库的自动化工具
相关推荐
带电的小王
7 小时前
WhisperKit: Android 端测试 Whisper -- Android手机(Qualcomm GPU)部署音频大模型
android
·
智能手机
·
whisper
·
qualcomm
带电的小王
2 天前
whisper.cpp: Android端测试 -- Android端手机部署音频大模型
android
·
智能手机
·
llm
·
whisper
·
音频大模型
·
whisper.cpp
带电的小王
2 天前
whisper.cpp: PC端测试 -- 电脑端部署音频大模型
llm
·
whisper
·
音视频
·
音频大模型
AI慧聚堂
4 天前
记录本地部署 Whisper 模型的过程
whisper
学习中的程序媛~
4 天前
whisper实时语音转文字
python
·
whisper
·
语音识别
曦云沐
4 天前
深入解析:选择最适合你的Whisper语音识别模型
人工智能
·
whisper
·
语音识别
ZVAyIVqt0UFji
4 天前
如何使用whisper+ollama+ffmpeg为视频添加中文字幕
ffmpeg
·
whisper
·
音视频
m0_74825656
10 天前
Web 端语音对话 AI 示例:使用 Whisper 和 llama.cpp 构建语音聊天机器人
前端
·
人工智能
·
whisper
GPUStack
15 天前
GPUStack v0.4:文生图模型、语音模型、推理引擎版本管理、离线支持和部署本地模型
stable diffusion
·
llm
·
whisper
·
speech-to-text
·
text-to-speech
飘逸高铁侠
20 天前
使用Python和OpenAI Whisper为视频生成字幕
python
·
whisper
·
音视频
·
字幕
热门推荐
01
〔AI 绘画〕Stable Diffusion 之 解决绘制多人或面部很小的人物时面部崩坏问题 篇
02
ARM学习(31)编译器对overlay方式的支持
03
玄机平台应急响应—webshell查杀
04
DisplayPort AltMode On Type-c协议_Ver2.0(学习笔记)
05
校验 GPT-4 真实性的三个经典问题:快速区分 GPT-3.5 与 GPT-4,并提供免费测试网站
06
Docker 夺命连环 15 问
07
6个主流的工业3D管道设计软件
08
基于大语言模型(LLM)的合成数据生成、策展和评估的综述
09
(欧拉)openEuler系统添加网卡文件配置流程、(欧拉)openEuler系统手动配置ipv6地址流程、(欧拉)openEuler系统网络管理说明
10
树莓派 5 AI 套件(Hailo-8L)使用教程