‌FunASR‌阿里开源的语音识别工具

FunASR‌是一个由阿里云智能团队开源的语音识别工具。它旨在通过发布工业级语音识别模型的训练和微调,促进学术研究和工业应用之间的交流,推动语音识别生态的发展‌。

今天来试着搭建下。

1、先贴上github地址。

复制代码
https://github.com/modelscope/FunASR

2、创建环境

复制代码
conda create -n funasr python==3.10

后台回复"conda"可拿到Ubuntu conda安装包

3、安装

安装方式我看着有三种,一种docker安装。一种源码安装。一种直接安装

咱们先来体验下直接安装的方式

复制代码
pip install -U funasr

4、安装比较顺利,直接安装成功。试着运行下。

复制代码
funasr ++model=paraformer-zh ++vad_model="fsmn-vad" ++punc_model="ct-punc" ++input=asr_example_zh.wav

5、运行后会先下载模型

这个模型比较小,下载得很快。

接着再试下。报错了,看着是参数不对。

5、代码执行下试试

复制代码
from funasr import AutoModel# paraformer-zh is a multi-functional asr model# use vad, punc, spk or not as you needmodel = AutoModel(model="paraformer-zh",  vad_model="fsmn-vad",  punc_model="ct-punc",                   # spk_model="cam++",                   )res = model.generate(input=f"{model.model_path}/example/asr_example.wav",                      batch_size_s=300,                      hotword='魔搭')print(res)

OK,完美运行。

搜到一个funasr的网站,不知道是不是官网,上面提供安装包https://funasr.com/#/

这就是简单的复现方法,如果大家在搭建的过程中有什么问题的话,欢迎留言,大家一起讨论学习。

相关推荐
之歆2 分钟前
Python-封装和解构-set及操作-字典及操作-解析式生成器-内建函数迭代器-学习笔记
笔记·python·学习
天天爱吃肉82181 小时前
ZigBee通信技术全解析:从协议栈到底层实现,全方位解读物联网核心无线技术
python·嵌入式硬件·物联网·servlet
Allen_LVyingbo1 小时前
Python常用医疗AI库以及案例解析(2025年版、上)
开发语言·人工智能·python·学习·健康医疗
智能砖头2 小时前
LangChain 与 LlamaIndex 深度对比与选型指南
人工智能·python
ResponsibilityAmbiti2 小时前
AI 发展 && MCP
人工智能·llm·aigc
AI大模型2 小时前
LangGraph官方文档笔记(6)——时间旅行
程序员·langchain·llm
正在走向自律3 小时前
第二章-AIGC入门-开启AIGC音频探索之旅:从入门到实践(6/36)
人工智能·aigc·音视频·语音识别·ai音乐·ai 音频·智能语音助手
风逸hhh3 小时前
python打卡day58@浙大疏锦行
开发语言·python
烛阴4 小时前
一文搞懂 Python 闭包:让你的代码瞬间“高级”起来!
前端·python
JosieBook4 小时前
【Java编程动手学】Java中的数组与集合
java·开发语言·python