Fun-ASR-Nano实时语音识别并区分说话人 | FunASR | 开源实时语音识别模型

1. 实时语音识别

Fun-ASR-Nano是很好的开源的实时语音识别模型,可以使用FunASR运行,同时支持多种方言和国际语言,根据官方文档,支持客家话,吴语,赣语,四川话,河南话,天津话,北京话,东北话等,同时还支持英语,日语等国际语言。

2. 流式区分说话人

Fun-ASR-Nano可以做到流式识别说话人,也就是通过麦克风实时转写的同时可以区分说话人,还会返回时间戳,通过打上SPK标识区分不同的人讲的话。可以应用在会议实时纪要项目中。

3. 实际效果演示

实际的效果可以看我发布的视频,在浏览器中打开下面的地址,观看演示视频。

shell 复制代码
https://www.bilibili.com/video/BV1YiVF6REJa

更多内容欢迎关注我。

相关推荐
baopixiaoz8 小时前
AI量化策略师|Web3 量化交易研究员
大数据·人工智能·python·区块链
大模型码小白9 小时前
思维树提示:让AI探索多条推理路径
人工智能
程序员cxuan9 小时前
本地跑一个 Qwen 3.8,你将拥有一个 Opus 4.6
人工智能·后端·程序员
jike_20269 小时前
iPhone日历查看会议纪要APP推荐:按日期查找历史录音更方便
ios·语音识别·iphone
aidesignplus9 小时前
Anthropic 最新发布《2026 Agentic Coding Trends Report》粗浅解析
人工智能
能源革命9 小时前
AI日报 2026-08-15
人工智能
Uncommon.9 小时前
使用Pytorch自动计算梯度
人工智能·pytorch·python
安逸sgr9 小时前
循环神经网络 RNN、LSTM、GRU 是什么?为什么能处理序列?
人工智能·ai·大模型·agent·智能体
猿小猴子9 小时前
主流 AGENT 实战教程「OpenCodex」与「ChatGPT Work」与「Codex Record & Replay」介绍
人工智能·ai·chatgpt·codex·minimax·deepseek·opencodex
shdwak....sad9 小时前
版本管理&迁移kali-vmware&知识库
人工智能·网络安全