人工智能应用-机器听觉: 05.基于模式匹配的语音识别

早期的语音识别技术就是基于"不同发音的共振峰不同"这一原理,通过分析语音的共振峰来区分不同的发音。1952 年,AT&T 公司的科学家首次利用语音的第一和第二共振峰实现了对十个英文数字的识别。如图 所示,每个小图对应一个数字,横轴表示第一共振峰F1,纵轴表示第二共振峰F2。图中的曲线展示了发音时共振峰的变化轨迹。可以看到,不同数字在 F1-F2 平面上形成了独特的轨迹。AT&T 的研究者正是利用这些轨迹上的差异,实现了对不同数字的有效区分

AT&T 的数字识别方法。图片来源:Davis et al., 1952.

相关推荐
IvanCodes7 小时前
RAG 实战教程(一):RAG 工作原理与完整流程——分片、索引、召回、重排和生成
人工智能·后端·agent
今天AI了吗7 小时前
合规场景下的 AI 推理可解释性:Attention 可视化与推理路径追踪的工程实践
人工智能
周末程序猿8 小时前
浅析大模型推理十二篇之KV Cache
人工智能
鱼樱前端8 小时前
用 AI 做内容变收入
前端·人工智能·ai编程
Dawson Zhu8 小时前
基于Palantir Foundry构建半导体制造AI友好型数据中台:从良率分析场景谈起
人工智能·语言模型·架构·制造·agi
fthux9 小时前
装闭 RenoPit 源码解析(04):装修图纸和合同文件上传处理流程
人工智能·ai·开源·github·open source·renopit
weixin_4462608510 小时前
从被动镜像到主动智能体:面向网络物理人工智能的整体论数字孪生(HDT-Net)
网络·人工智能
秋枫要学习10 小时前
你的鼠标,正在被 AI 抢走
人工智能·计算机外设
满怀冰雪11 小时前
19-图像数据处理:PaddleVision Transform 实战
人工智能·深度学习·计算机视觉·paddle