Fun-ASR-Nano实时语音识别并区分说话人 | FunASR | 开源实时语音识别模型

1. 实时语音识别

Fun-ASR-Nano是很好的开源的实时语音识别模型,可以使用FunASR运行,同时支持多种方言和国际语言,根据官方文档,支持客家话,吴语,赣语,四川话,河南话,天津话,北京话,东北话等,同时还支持英语,日语等国际语言。

2. 流式区分说话人

Fun-ASR-Nano可以做到流式识别说话人,也就是通过麦克风实时转写的同时可以区分说话人,还会返回时间戳,通过打上SPK标识区分不同的人讲的话。可以应用在会议实时纪要项目中。

3. 实际效果演示

实际的效果可以看我发布的视频,在浏览器中打开下面的地址,观看演示视频。

shell 复制代码
https://www.bilibili.com/video/BV1YiVF6REJa

更多内容欢迎关注我。

相关推荐
TMT星球3 分钟前
萤石亮相IFA 2026,多款AI创新产品集中展示,全球化智能生活体验引关注
大数据·人工智能·生活
知了一笑3 分钟前
Token消费不为结果买单
人工智能·aigc·token
deepdata_cn3 分钟前
机器学习≠逻辑推理!分清统计AI与符号AI
人工智能·机器学习
大鹏的NLP博客5 分钟前
拆解 Agent Memory:从认知心理学映射到工业级工程落地
人工智能·agent·memory
蓝速科技6 分钟前
固定涉外场景台式翻译机选型与落地指南
网络·人工智能·自然语言处理·语音识别·技术分享
棣廷8 分钟前
初识OpenCV——特征匹配与综合实战
人工智能·opencv·计算机视觉
aneasystone本尊8 分钟前
学习大模型推理的两个阶段:Prefill 与 Decode
人工智能
Tiansan66669 分钟前
郑州AI问答推广:精准获客背后的3大关键
人工智能·郑州ai问答推广精准
独码侠11 分钟前
FunASR语音识别生产部署实战:511MB音频47秒转写,离线落地 8 步、7 坑一次说清
人工智能·音视频·语音识别·funasr·说话人分离·会议纪要·内网离线部署
在所不辞兄13 分钟前
【零基础学智能仿真-11】CatBoost——让材料类型和边界条件参与力学预测
人工智能·python·深度学习·神经网络·机器学习·工程技术