视频制作流程MP4旁白语音生成裁剪视频压缩python处理ppt转视频M4a格式

视频制作流程:

1 准备PPT和旁白(每页一一对应)

2 使用workbuddy上传旁白,让他转为m4a语音文件并保存至当前目录

(由于要收费,所以直接用python处理吧。安装语音依赖库 pip install edge-tts)

3 手动打开PPT将所有音频逐个插入到每页中。(选择自动播放、与上一动画同时播放)

4 PPT->文件-》另存-》创建视频(会自动生成播放视频)

5 使用ffmpeg裁剪视频

6 完成。

代码旁白转语音

复制代码
import asyncio
import edge_tts

# 格式:[标题前缀, 描述文本]
voice_texts = [
    [
        "Organization Chart",
        "Visualizes group hierarchies and departments with multi-dimensional browse/search. A foundation for onboarding and cross-team collaboration."
    ],
    [
        "Monthly Report Consolidation",
        "Unified submission channel for HR/operational metrics. Enables auto-consolidation of global data for HQ analysis."
    ]
]

# 美式商务女声
VOICE = "en-US-JennyNeural"

async def run_tts():
    for index, (title, desc) in enumerate(voice_texts, start=1):
        # 完整朗读内容:标题 + 冒号 + 描述
        full_speech = f"{title}: {desc}"
        # 带序号文件名
        save_path = f"{index}_{title}.m4a"
        tts = edge_tts.Communicate(full_speech, VOICE)
        await tts.save(save_path)
        print(f"✅ {index}/10 已生成:{save_path}")

if __name__ == "__main__":
    asyncio.run(run_tts())

E:\lumeng\soft\ffmpeg-master-latest-win64-gpl-shared\bin\ffmpeg.exe -ss 00:00:04 -i 1-13.mp4 -to 00:09:02 -c copy 1-13x-1.mp4

E:\lumeng\soft\ffmpeg-master-latest-win64-gpl-shared\bin\ffmpeg.exe -i 2026-1.mp4 -c:v libx264 -crf 35 -preset medium -c:a aac -b:a 128k 2026-1-small35.mp4

这条命令的含义是把视频压缩成常见的 H.264 格式,并对音频也进行了处理:

-c:v libx264:指定使用 H.264 视频编码器。这是目前兼容性最好、压缩效率也很高的编码格式,适用于绝大多数场景。

-crf 23:这是质量控制的核心参数。CRF 值范围为 0-51,值越大,压缩率越高,文件越小,但画质损失也越多;反之亦然。

18:视觉上接近无损,文件会比较大。

23:默认值,在文件大小和画质之间取得了很好的平衡。

28:文件会小很多,画质有一定损失,适合对清晰度要求不高的场景。

-preset medium:编码预设,影响压缩速度和效率。可选值从 ultrafast(最快,文件大)到 veryslow(最慢,文件小)。medium 是默认值,速度适中。

-c:a aac -b:a 128k:将音频编码为常见的 AAC 格式,并将音频码率设为 128 kbps,在音质和文件大小之间取得平衡。

压缩视频变小

E:\lumeng\soft\ffmpeg-master-latest-win64-gpl-shared\bin\ffmpeg.exe -i PPT-VIDEO.mp4 -c:v libx264 -crf 23 -preset medium -c:a aac -b:a 128k PPT-VIDEOsmall.mp4

裁剪视频从11秒到20秒

E:\lumeng\soft\ffmpeg-master-latest-win64-gpl-shared\bin\ffmpeg.exe -ss 11 -to 20 -i training.mp4 -c copy training-11.mp4

相关推荐
jike_202621 小时前
iPhone采访录音同时拍现场照片的APP:图片音频同步记录实测
笔记·智能手机·音视频·语音识别
小猴子爱上树1 天前
跨境电商翻译工具推荐:批量图片翻译、视频字幕翻译、智能抠图一站式搞定
人工智能·python·音视频
林澈在路上1 天前
AI翻唱软件哪个好 2026国产AI写歌工具对比推荐
大数据·人工智能·深度学习·github·aigc·音视频·音频
阿童木写作1 天前
跨马翻译:AI批量图片翻译与视频字幕翻译工具推荐
人工智能·python·音视频
Dovis(誓平步青云)1 天前
折叠屏悬停看视频,上半屏和下半屏应该各做什么
android·java·服务器·开发语言·安全·音视频
敢敢のwings1 天前
Wan2.2 模型系统解读:从视频扩散到 WAM 世界模型模块
音视频
小猴子爱上树1 天前
跨境电商AI批量图片翻译工具,视频字幕翻译免费试用
人工智能·python·音视频
AI服务老曹1 天前
车牌识别算法接入AI视频分析平台的流程和误报优化
人工智能·算法·音视频
深念Y1 天前
视频平台架构重构:从微服务到可插拔基础设施
后端·微服务·云原生·架构·rabbitmq·音视频·rocketmq
深念Y1 天前
06-移动端三技术栈优劣对比-理论推演
服务器·云原生·架构·音视频·短视频