ASR工业化语音模型总结

1、wenet模型:WeNet语音识别实战-CSDN博客

git地址:GitHub - wenet-e2e/wenet: Production First and Production Ready End-to-End Speech Recognition Toolkit

生产应用方式为:使用pytorch训练,使用c++部署。

相关推荐
iwgh2 天前
OddASR 更新:新增Qwen3-ASR三大模型、架构重构、性能飞跃
asr·stt·oddasr·qwen3-asr
verbaWP7 天前
如何提升中文语音识别准确率?Speech Seaco Paraformer热词设置详细步骤
语音识别·asr·星图gpu·中文语音转写
iwgh15 天前
OddASR v2.5.5 版本更新:支持指定最大说话人分离数量、优化时延
语音识别·asr·语音转写·stt·oddasr
没刮胡子1 个月前
AI完全离线的ASR语音识别+TTS语音合成+大模型对话
人工智能·ai·语音识别·tts·asr
iwgh1 个月前
小奥录音更新速递:v0.1.6 发布,音字对齐、转录体验大升级!
asr·语音转写·oddasr·oddminutes·小奥录音
zhuweisky2 个月前
视频会议是如何实现AI会议纪要功能的?
asr·视频会议·语音转文字·会议纪要
水龙吟啸2 个月前
机器学习安全:图像多分类任务的测试时对抗样本转移攻击实战(一)
机器学习·图像分类·安全性测试·asr·混淆矩阵·auc·转移攻击
云山雾村3 个月前
零基础也能用!科哥版Paraformer语音识别WebUI保姆级教程
语音识别·asr·星图gpu·中文语音转文字
瓷tun3 个月前
小白也能懂:Qwen3-ASR-0.6B语音识别入门教程
语音识别·asr·qwen3·星图gpu
Luke Ewin3 个月前
Fun-ASR-Nano实时语音识别并区分说话人 | FunASR | 开源实时语音识别模型
人工智能·语音识别·asr·fun-asr