ffmpeg使用amix混合多个音频时音量变小或音量不一致问题

背景

最近工作中遇到一个音频混合后,导出文件播放音量不一致问题。

问题描述

例如,7个音频混合起来,发现第一个音频的音量变得很小,第2个稍大一点,直到第7个最大(等于原音频)。

bash 复制代码
ffmpeg -i 24281_1.mp3 -i 24281_2.mp3 -i 24281_3.mp3 -i 24281_4.mp3 \
	-i 24281_5.mp3 -i 24281_6.mp3 -i 24281_7.mp3 \
	-filter_complex "[0:a][1:a][2:a][3:a][4:a][5:a][6:a]amix=inputs=7:duration=longest[Audio]"  \
	-map "[Audio]" -acodec mp3 -y amix.mp3

结果amix.mp3的音量是一开始最小,逐渐变大,直到最后一段变成和源文件一样大。

原因分析

尝试了多种方法无法解决。最终发现stackover关于该问题有一个讨论:stackoverflow

知乎也有人讨论过:如何解决FFmpeg合并多个音频并解决声音变小的问题? - JJ Chan的回答 - 知乎

这个是因为ffmpeg叠加音频的机制导致的。使用amix的时候每个引入的视频会以1/n的音量播放,其中n是活动的inputs的数量。例如一共18个音频的话,这时候处理第一个音频的时候就是一共有18个活动的inputs,音频会以1/18的音量播放。处理第二个的时候,第一个音频已经不活动了, 就剩17个inputs,音频会以1/17的音量播放。所以导致越到后面的声音越大。

解决方法

方法1

知道了原因,可以把amix 缩小的声音给放大回来,修改上面的命令:

bash 复制代码
ffmpeg -i 24281_1.mp3 -i 24281_2.mp3 -i 24281_3.mp3 -i 24281_4.mp3 \
	-i 24281_5.mp3 -i 24281_6.mp3 -i 24281_7.mp3 \
	-filter_complex "\
		[0:a]volume=7[a0];\
		[1:a]volume=6[a1];\
		[2:a]volume=5[a2];\
		[3:a]volume=4[a3];\
		[4:a]volume=3[a4];\
		[5:a]volume=2[a5];\
		[6:a]volume=1[a6];\
		[a0][a1][a2][a3][a4][a5][a6]amix=inputs=7:duration=longest[Audio]"  \
	-map "[Audio]" -acodec mp3 -y amix.mp3

方法2

据stackoverflow讨论,新版本FFmpeg支持在amix时指定normalize=0以取消默认的音量缩小行为。

经过尝试,该参数在FFmpeg v4.3上不存在,FFmpeg v6.0上可用。

bash 复制代码
ffmpeg -i 24281_1.mp3 -i 24281_2.mp3 -i 24281_3.mp3 -i 24281_4.mp3 \
	-i 24281_5.mp3 -i 24281_6.mp3 -i 24281_7.mp3 \
	-filter_complex "[0:a][1:a][2:a][3:a][4:a][5:a][6:a]amix=inputs=7:duration=longest:normalize=0[Audio]"  \
	-map "[Audio]" -acodec mp3 -y amix.mp3

总结

FFmpeg使用amix进行音频混合时,默认行为是缩减每个音频,这容易让人忽略掉。虽然最新版本FFmpeg提供了参数normalize=0来屏蔽掉这个默认行为,但老版本FFmpeg还是只能手动调整音量。

相关推荐
REDcker6 天前
WebCodecs VideoDecoder 的 hardwareAcceleration 使用
前端·音视频·实时音视频·直播·webcodecs·videodecoder
gihigo19986 天前
基于TCP协议实现视频采集与通信
网络协议·tcp/ip·音视频
山河君6 天前
四麦克风声源定位实战:基于 GCC-PHAT + 最小二乘法实现 DOA
算法·音视频·语音识别·信号处理·最小二乘法·tdoa
音视频牛哥6 天前
Android平台RTMP/RTSP超低延迟直播播放器开发详解——基于SmartMediaKit深度实践
android·人工智能·计算机视觉·音视频·rtmp播放器·安卓rtmp播放器·rtmp直播播放器
qq_416276426 天前
通用音频表征的对比学习
学习·音视频
美狐美颜sdk6 天前
Android全局美颜sdk实现方案详解
人工智能·音视频·美颜sdk·视频美颜sdk·美狐美颜sdk
EasyDSS6 天前
私有化部署EasyDSS视频点播能力:全链路视频技术赋能,打造企业级视听新体验
音视频·hls·m3u8·点播技术·智能转码
qq_416276426 天前
DeLoRes——一种通用的音频表征学习新方法(DeLoRes(基于 Barlow Twins 的冗余最小化方法)
学习·音视频
Q_4582838686 天前
从定位到视频:808 + 1078 在各行业的落地实践
音视频
山顶望月川6 天前
实测MiniMax-Hailuo-02:当“开工大吉“变成“无字天书“,国产AI视频模型的能与之不能
人工智能·音视频