音频采样数据格式

音频信号在模拟到数字转换时,会涉及到多个关键参数,如采样率、位深度、通道数等。下面是常见的音频采样数据格式及其相关概念:

1. 采样率 (Sample Rate)

采样率指的是每秒钟对音频信号进行采样的次数,单位为赫兹 (Hz)。常见的值如下:

  • 44.1 kHz:常用于音频CD和大多数音乐文件格式(如WAV、MP3)。
  • 48 kHz:常用于专业音频录制、电影和视频音频处理。
  • 96 kHz、192 kHz:常用于高保真音频(Hi-Fi)或专业录音应用。

为了能够准确地重现模拟音频信号中的所有频率,采样率必须遵循 奈奎斯特定理(Nyquist Theorem),即采样率必须至少是信号中最高频率的两倍。这是因为我们只能重建出采样频率以下的信号,超过采样频率一半的信号(即奈奎斯特频率)会出现混叠现象,导致音频失真。

44.1 kH采样率的由来

早期的数码录音就是一个PCM编码器加录像机,所以,数据音频信号是在录像机(录像带)中存储的。PAL制式的录像机每帧有625条扫描线,但实际可用的扫描线为588条,由于隔行扫描,扫描线减半,就成了294条。每条扫描线可以存储3个采样点的信息,场频为50Hz,因而采样点数量为294×50×3 = 44 100。

2. 位深度 (Bit Depth)

位深度指的是每个采样点的数值精度,即每个采样值所用的比特数。常见的值如下:

  • 16位:用于CD音质(动态范围为96 dB)。
  • 24位:用于高质量录音和制作,通常用于专业音频处理。
  • 32位浮动:用于数字音频处理软件中的浮动点格式,提供极高的动态范围。

3. 通道数 (Channels)

指的音频信号中的声道数。如下图,当我们坐在中间时,不同声道的声音让我们感觉它们来自不同的方向。

相关推荐
YYDataV数据可视化2 小时前
音视频呼叫完整时序图
音视频
mseaspring4 小时前
35.7k Star的开源项目,用Claude Code 调用Remotion 以编程的方式自动生成视频
音视频
BryanGG5 小时前
[教程]通用稳定器运镜技巧
音视频·稳定器·运镜
YYDataV数据可视化6 小时前
【音视频通话系统】架构详解
音视频·webrtc·实时音视频
linux_cfan7 小时前
打造智慧校园视听新基建:高校与在线教育平台 Web 视频播放器选型指南 (2026版)
前端·学习·音视频·教育电商
YZ0991 天前
Sora2 AI视频去水印接口
人工智能·音视频·api·ai编程
硅谷秋水1 天前
mimic-video:机器人控制的可泛化视频-动作模型,超越VLA模型
人工智能·机器学习·计算机视觉·机器人·音视频
源代码•宸1 天前
简版抖音项目——项目需求、项目整体设计、Gin 框架使用、视频模块方案设计、用户与鉴权模块方案设计、JWT
经验分享·后端·golang·音视频·gin·jwt·gorm
REDcker1 天前
RTP、RTCP 与 SRTP 协议详解
网络·音视频·webrtc·实时音视频·rtp·rtcp
雪碧聊技术1 天前
什么是Seedance 2.0?字节自研多模态AI视频生成引擎全解析
人工智能·音视频·seedance2.0