视频制作流程MP4旁白语音生成裁剪视频压缩python处理ppt转视频M4a格式

视频制作流程:

1 准备PPT和旁白(每页一一对应)

2 使用workbuddy上传旁白,让他转为m4a语音文件并保存至当前目录

(由于要收费,所以直接用python处理吧。安装语音依赖库 pip install edge-tts)

3 手动打开PPT将所有音频逐个插入到每页中。(选择自动播放、与上一动画同时播放)

4 PPT->文件-》另存-》创建视频(会自动生成播放视频)

5 使用ffmpeg裁剪视频

6 完成。

代码旁白转语音

复制代码
import asyncio
import edge_tts

# 格式:[标题前缀, 描述文本]
voice_texts = [
    [
        "Organization Chart",
        "Visualizes group hierarchies and departments with multi-dimensional browse/search. A foundation for onboarding and cross-team collaboration."
    ],
    [
        "Monthly Report Consolidation",
        "Unified submission channel for HR/operational metrics. Enables auto-consolidation of global data for HQ analysis."
    ]
]

# 美式商务女声
VOICE = "en-US-JennyNeural"

async def run_tts():
    for index, (title, desc) in enumerate(voice_texts, start=1):
        # 完整朗读内容:标题 + 冒号 + 描述
        full_speech = f"{title}: {desc}"
        # 带序号文件名
        save_path = f"{index}_{title}.m4a"
        tts = edge_tts.Communicate(full_speech, VOICE)
        await tts.save(save_path)
        print(f"✅ {index}/10 已生成:{save_path}")

if __name__ == "__main__":
    asyncio.run(run_tts())

E:\lumeng\soft\ffmpeg-master-latest-win64-gpl-shared\bin\ffmpeg.exe -ss 00:00:04 -i 1-13.mp4 -to 00:09:02 -c copy 1-13x-1.mp4

E:\lumeng\soft\ffmpeg-master-latest-win64-gpl-shared\bin\ffmpeg.exe -i 2026-1.mp4 -c:v libx264 -crf 35 -preset medium -c:a aac -b:a 128k 2026-1-small35.mp4

这条命令的含义是把视频压缩成常见的 H.264 格式,并对音频也进行了处理:

-c:v libx264:指定使用 H.264 视频编码器。这是目前兼容性最好、压缩效率也很高的编码格式,适用于绝大多数场景。

-crf 23:这是质量控制的核心参数。CRF 值范围为 0-51,值越大,压缩率越高,文件越小,但画质损失也越多;反之亦然。

18:视觉上接近无损,文件会比较大。

23:默认值,在文件大小和画质之间取得了很好的平衡。

28:文件会小很多,画质有一定损失,适合对清晰度要求不高的场景。

-preset medium:编码预设,影响压缩速度和效率。可选值从 ultrafast(最快,文件大)到 veryslow(最慢,文件小)。medium 是默认值,速度适中。

-c:a aac -b:a 128k:将音频编码为常见的 AAC 格式,并将音频码率设为 128 kbps,在音质和文件大小之间取得平衡。

压缩视频变小

E:\lumeng\soft\ffmpeg-master-latest-win64-gpl-shared\bin\ffmpeg.exe -i PPT-VIDEO.mp4 -c:v libx264 -crf 23 -preset medium -c:a aac -b:a 128k PPT-VIDEOsmall.mp4

裁剪视频从11秒到20秒

E:\lumeng\soft\ffmpeg-master-latest-win64-gpl-shared\bin\ffmpeg.exe -ss 11 -to 20 -i training.mp4 -c copy training-11.mp4

相关推荐
linux_cfan9 小时前
videojs v10 源代码系列解读:14 · 谓词守卫:在运行时安全地调用能力
前端·javascript·音视频
赛博仓鼠10 小时前
秋叶ComfyUI 3.2整合包实测:Python 3.13+Torch 2.13全栈升级,一键跑通MiniMax H3(附完整部署)
ai·ai作画·aigc·音视频
乐橙开放平台12 小时前
从「多套客户端」到一套开放能力:乐橙视频监控能力复盘
笔记·物联网·自动化·音视频·智能家居
linux_cfan17 小时前
videojs v10 源代码系列解读:13 · 能力型媒体契约:`Media` 的组合接口
前端·javascript·音视频
勤劳X码农18 小时前
2026年TTS工具技术测评:7款方案实测,从免费额度到API集成全解析
人工智能·音视频·实时音视频
m0_6145235519 小时前
Log视频导入发灰,先查颜色链
音视频·视频编辑
linux_cfan1 天前
17 · 引擎适配器全景:HLS/DASH/Vimeo/Mux/Cast
前端·javascript·音视频
音视频牛哥1 天前
视频编码的终局不是“更省码率”:从 H.266、AV2 到 AI 编解码的下一场竞争
音视频·h.266·rtsp h.266·h.266编解码·rtp h.266·rtp vvc·ai编解码
程序员老陆2 天前
WHIP 与 WHEP:WebRTC 直播的标准化入口与出口
ffmpeg·音视频·webrtc·whip·whep
linux_cfan2 天前
16 · `custom-media-element`:属性拦截与转发
前端·javascript·音视频