视频中有无声音的检测

最近遇到一个烦心的事,晚上车停在路边车窗被砸了,行车记录仪正好没安装好,没有拍到,需要对视频声音进行分析确定被砸时间,但我的行车记录仪是每一分钟拍一个视频,一晚上的视频非常多,听起来非常浪费时间,废话不多说,开干。这里提供一个视频中有无声音的检测用例:

python 复制代码
import os
import subprocess
import librosa
import numpy as np

def extract_audio_from_video(video_file_path, output_audio_file_path):
    # 使用ffmpeg提取音频
    try:
        subprocess.run(['ffmpeg', '-i', video_file_path, '-vn', '-acodec', 'pcm_s16le', '-ar', '44100', '-ac', '2', output_audio_file_path], check=True)
    except subprocess.CalledProcessError as e:
        print(f"提取音频时出现错误: {e}")

def main():
    # 视频文件路径
    video_file_path = r"D:\Viidure\2024_03_11_201220_00.MP4"

    # 临时音频文件路径
    temp_audio_file_path = r"D:\Viidure\temp_audio.wav"

    # 提取音频
    extract_audio_from_video(video_file_path, temp_audio_file_path)

    # 加载音频文件
    try:
        y, sr = librosa.load(temp_audio_file_path, sr=None)  # sr=None 表示使用音频文件的原始采样率
    except Exception as e:
        print(f"加载音频文件时出现错误: {e}")
        return

    # 计算梅尔频谱图
    S = librosa.feature.melspectrogram(y=y, sr=sr, n_mels=128)

    # 计算音频频谱的分贝值
    loudness = librosa.power_to_db(S, ref=np.max(S))

    # 获取频率轴
    frequencies = librosa.core.fft_frequencies(sr=sr)

    # 检查每个频率的声音强度是否在人耳的听觉范围内
    for f, dB in zip(frequencies, loudness):
        # print(type(f))
        # print(type(dB))

        if 2000 <= f <= 20000:
            if np.any(dB > -40):  # -40 dB作为听觉阈值的一个参考
                # print("------------------------------------------------------")
                print(f"频率 {f} Hz ,人耳能够听见。")
            # else:
            #     print("------------------------------------------------------")
            #     print(f"频率 {f} Hz 的声音强度为 {dB} dB,低于听觉阈值。")

    # print("------------------------------------------------------")

    # 删除临时音频文件
    try:
        os.remove(temp_audio_file_path)
    except Exception as e:
        print(f"删除临时音频文件时出现错误: {e}")

if __name__ == "__main__":
    main()
相关推荐
烟雨江南78513 小时前
200路并发语音识别系统实践:CPU、GPU与国产昇腾三种部署方案怎么选?
人工智能·websocket·音视频·语音识别·ai客服
视频技术分享14 小时前
视频会议系统技术全解:底层架构、选型标准与实战优化
架构·音视频
林墨聊AIGC15 小时前
AI视频怎么做跳舞的动作效果:从入门到精通的舞蹈动画制作指南
大数据·人工智能·自动化·aigc·音视频
小鱼爱吃草灬灬19 小时前
实时面试辅助排查清单:音频来源、问题输入与上下文
面试·职场和发展·音视频
可乐鸡翅yeah_19 小时前
HLS 自动化拨测与手动调试分工,流媒体线上监控体系建设实践
运维·自动化·测试用例·音视频·媒体·m3u8·音视频在线播放
欧特克_Glodon20 小时前
OpenCV计算机视觉开发入门与实践<三十五>:开发视频播放器
c++·opencv·计算机视觉·音视频
2301_768103491 天前
AI视频创作Agent实战05:Wan场景融合与VideoRetalk口型驱动
人工智能·音视频
淼澄研学1 天前
Sonos空间音频技术解析与Python本地API控制实操
开发语言·python·音视频
可乐鸡翅yeah_1 天前
M3U8测试流使用指南,流媒体开发自测与环境校验标准化方案
网络·ffmpeg·音视频·m3u8·m3u8在线·音视频在线播放
TechVoyager_82461 天前
不止是HDMI发射器:IT6622的eARC音频回传功能详解
音视频·片载 mcu·earc 音频回传·hdmi 发射器·影音芯片·hdmi1.4 发射·it6622