音频筑基:入门50问

音频筑基:入门50问

只问不答,意在启发。

通用类

  1. 为什么音频信号分析要从时域到频域?
  2. 频域变换中,为啥要做TDAC时域混叠消除?
  3. 人耳听觉频域敏感区是哪部分,为什么?
  4. 人声发声频域重要区域是哪部分及为什么?
  5. 乐声、人声常见频率段为?
  6. 人耳听觉频段高频、中频、低频通常范围是指?
  7. 什么是窗函数,为什么要加窗函数?
  8. 为什么要用傅里叶变换?
  9. 为什么会从DFT到FFT?
  10. 为什么频域编解码多用DCT或MDCT?
  11. 梅尔谱和梅尔倒谱系数MFCC啥关系?
  12. 梅尔谱系数(MFCC)和巴克谱系数(BFCC)的区别是?
  13. 音频技术中,单词voice和speech有何分别?
  14. 语音序列中通常含有哪些信息?提示:情绪、病理、说话人特征
  15. 音频里的3A和图像里的3A分别是指?
  16. PCM量化中,ulaw和alaw的区别是?
  17. 音频中bit位深大于24位以上,意义是啥?
  18. 什么是互调失真IMD?
  19. 音频信号中过零率有啥物理含义表征?有啥主观感受,如何感性理解?
  20. 听音评测中,羊耳和亚耳有啥区别?
  21. 信噪比计算公式是?
  22. 上采样下采样是啥?
  23. 上混下混是啥?
  24. 什么是总谐波失真+噪声(THD+N)?

编解码类

  1. 英文codec单词的来历是?
  2. 编解码分类有哪些?
  3. 常见语音编解码架构是什么?
  4. 编解码核心技术模块有哪些?为什么?
  5. 如果你入手,第一个想研究什么?
  6. 你对当前项目的认识有哪些?从进展、难点、重点多方面分析
  7. 频域编解码的核心问题是什么?
  8. 当前编解码的问题在哪儿?
  9. 哪种范数适用于音频编解码里的损失评估?
  10. 为啥编解码器中通常只标准化解码器,不标准化编码器?
  11. 语音编解码和音乐编解码的本质区别有哪些?
  12. 什么是预回声?
  13. 预加重滤波的目的是啥?
  14. 斜滤波器处理原因为何?

部分问题参考:

  1. 什么是窗函数?为啥要加窗函数?https://zhuanlan.zhihu.com/p/24318554
相关推荐
Likeadust8 小时前
视频直播点播平台EasyDSS助力阳光政务直播体系建设
音视频·政务
xcLeigh12 小时前
HTML5实现好看的视频播放器(三种风格,附源码)
前端·音视频·html5
骄傲的心别枯萎15 小时前
RV1126 NO.57:ROCKX+RV1126人脸识别推流项目之读取人脸图片并把特征值保存到sqlite3数据库
数据库·opencv·计算机视觉·sqlite·音视频·rv1126
好游科技15 小时前
IM即时通讯系统:安全可控、功能全面的社交解决方案全解析
安全·音视频·webrtc·im即时通讯·私有化部署im即时通讯·社交app
EasyDSS16 小时前
视频直播点播平台EasyDSS构建高并发、低延迟的远程教学直播新模式
音视频
GIOTTO情16 小时前
多模态舆情监测技术深度解析:Infoseek 如何实现 AI 造假与短视频舆情的精准捕捉?
人工智能·音视频
音视频牛哥16 小时前
C# 开发工业级 RTSP/RTMP 播放器实战:基于 SmartMediakit 的低延迟与高可靠性设计
音视频·rtsp播放器·rtmp播放器·windows rtsp播放器·windows rtmp播放器·c# rtsp播放器·c# rtmp播放器
JellyDDD16 小时前
【悬赏】Android WebRTC 数字人项目回声问题排查(AEC / AudioMode)
音视频·webrtc
于是我说17 小时前
如何判断一个视频到底是真实 MP4 直链,还是流媒体M3U8
网络·音视频
gf132111118 小时前
剪映草稿位置坐标换算
音视频