批量音频转文本 ASR 目前中文识别效果最好的qwen3 模型

把这个音频转成文字的软件更新了一个版本,用上了目前中文语音识别效果最好的qwen3 模型

作为一个业余的软件开发爱好者,我又捣鼓了一个有意思的小东西 ,使用完全免费哈

使用了目前已有的音频识别的深度学习网络,然后封装成了一个单独的模块,使用的方法就是下载软件,然后打开音频或者TXT文本所在的文件夹就行了,会自动扫描wav, mp3,m4a,aac 等音频后缀结尾的文件并执行转换。

软件的缺点就是比较大,一个G多点,因为把转换的模型都放在了本地,所以也不需要再去联网调用各家大厂公司的模型接口了,但是如果你的电脑运行速度比较慢的话,可能需要慢慢等待转换。

下载地址仍然是老地点:

链接:https://pan.baidu.com/s/1WQQ8kaDilaagjoK5IrYZzA

提取码:1111

相关推荐
昨日之日20061 小时前
LTX-2.5:更清晰、更可控、同步音画、多镜头连贯的AI视频神器
人工智能·音视频
小柯南敲键盘6 小时前
跨马翻译:跨境电商批量图片翻译与视频字幕一站式工具
人工智能·python·音视频
weixin_446260858 小时前
AVA-Encoder:面向智能体原生视频表征学习框架
学习·音视频
cdprinter8 小时前
信刻——留置谈话音视频数据集中自动刻录归档解决方案
自动化·音视频
美狐美颜sdk10 小时前
直播APP开发技术架构解析:从音视频流到第三方美颜SDK接入的完整方案
大数据·人工智能·音视频·美颜sdk·美颜api
阿童木写作11 小时前
跨境电商图片翻译工具推荐:跨马翻译批量处理视频字幕与抠图
python·音视频
奈斯先生Vector12 小时前
AI 视频不是会动的图片:用 Shot Contract、时间码与音画质检构建可交付流水线
人工智能·重构·架构·prompt·aigc·音视频
ai产品老杨12 小时前
AI视频分析并发优化参数配置说明
人工智能·音视频
怪奇云呼军12 小时前
G.711、Opus 和重采样会拖慢识别吗?闪电智能VoiceAgent 的音频入口怎么选
java·人工智能·python·算法·云计算·音视频