Fun-ASR-Nano实时语音识别并区分说话人 | FunASR | 开源实时语音识别模型

1. 实时语音识别

Fun-ASR-Nano是很好的开源的实时语音识别模型,可以使用FunASR运行,同时支持多种方言和国际语言,根据官方文档,支持客家话,吴语,赣语,四川话,河南话,天津话,北京话,东北话等,同时还支持英语,日语等国际语言。

2. 流式区分说话人

Fun-ASR-Nano可以做到流式识别说话人,也就是通过麦克风实时转写的同时可以区分说话人,还会返回时间戳,通过打上SPK标识区分不同的人讲的话。可以应用在会议实时纪要项目中。

3. 实际效果演示

实际的效果可以看我发布的视频,在浏览器中打开下面的地址,观看演示视频。

shell 复制代码
https://www.bilibili.com/video/BV1YiVF6REJa

更多内容欢迎关注我。

相关推荐
Infedium17 分钟前
英特物理AI仿真赋能制造!打破传统有限元瓶颈,研发提效降本翻倍
人工智能·制造
天国梦28 分钟前
2026英语教学系统选型实战:AI如何让备课效率提升42%?天学网技术落地全解析
人工智能·学习
hqyjzsb1 小时前
AI证书和传统证书有什么区别?
人工智能·金融·数据挖掘·数据分析·aigc·创业创新·学习方法
阿里云大数据AI技术1 小时前
阿里云 Elasticsearch 9.4 Agent Builder 实战
人工智能·elasticsearch·agent
用户7783366132111 小时前
serpbase + Cloudflare R2 边缘持久化实战
前端·人工智能
东方小月1 小时前
从零开发一个 Coding Agent(三):EventStream 事件流通道设计与实现
前端·人工智能·后端
中微极客1 小时前
降维算法75倍加速:从PCA到稀疏字典学习的工程实践
人工智能·学习·算法
代码青铜1 小时前
三步给 Codex 接上一个真正的后端:无需写代码,让 AI 自动搭建完整应用
人工智能
文心快码BaiduComate2 小时前
从“提示词工程”到“技能工程”:Comate 创建Agent Skills 实战
人工智能
星栈2 小时前
MCP 从 stdio 迁到 SSE,踩了 5 个传输层坑
人工智能·后端·架构