视频制作流程:
1 准备PPT和旁白(每页一一对应)
2 使用workbuddy上传旁白,让他转为m4a语音文件并保存至当前目录
(由于要收费,所以直接用python处理吧。安装语音依赖库 pip install edge-tts)
3 手动打开PPT将所有音频逐个插入到每页中。(选择自动播放、与上一动画同时播放)
4 PPT->文件-》另存-》创建视频(会自动生成播放视频)
5 使用ffmpeg裁剪视频
6 完成。
代码旁白转语音
import asyncio
import edge_tts
# 格式:[标题前缀, 描述文本]
voice_texts = [
[
"Organization Chart",
"Visualizes group hierarchies and departments with multi-dimensional browse/search. A foundation for onboarding and cross-team collaboration."
],
[
"Monthly Report Consolidation",
"Unified submission channel for HR/operational metrics. Enables auto-consolidation of global data for HQ analysis."
]
]
# 美式商务女声
VOICE = "en-US-JennyNeural"
async def run_tts():
for index, (title, desc) in enumerate(voice_texts, start=1):
# 完整朗读内容:标题 + 冒号 + 描述
full_speech = f"{title}: {desc}"
# 带序号文件名
save_path = f"{index}_{title}.m4a"
tts = edge_tts.Communicate(full_speech, VOICE)
await tts.save(save_path)
print(f"✅ {index}/10 已生成:{save_path}")
if __name__ == "__main__":
asyncio.run(run_tts())
E:\lumeng\soft\ffmpeg-master-latest-win64-gpl-shared\bin\ffmpeg.exe -ss 00:00:04 -i 1-13.mp4 -to 00:09:02 -c copy 1-13x-1.mp4
E:\lumeng\soft\ffmpeg-master-latest-win64-gpl-shared\bin\ffmpeg.exe -i 2026-1.mp4 -c:v libx264 -crf 35 -preset medium -c:a aac -b:a 128k 2026-1-small35.mp4
这条命令的含义是把视频压缩成常见的 H.264 格式,并对音频也进行了处理:
-c:v libx264:指定使用 H.264 视频编码器。这是目前兼容性最好、压缩效率也很高的编码格式,适用于绝大多数场景。
-crf 23:这是质量控制的核心参数。CRF 值范围为 0-51,值越大,压缩率越高,文件越小,但画质损失也越多;反之亦然。
18:视觉上接近无损,文件会比较大。
23:默认值,在文件大小和画质之间取得了很好的平衡。
28:文件会小很多,画质有一定损失,适合对清晰度要求不高的场景。
-preset medium:编码预设,影响压缩速度和效率。可选值从 ultrafast(最快,文件大)到 veryslow(最慢,文件小)。medium 是默认值,速度适中。
-c:a aac -b:a 128k:将音频编码为常见的 AAC 格式,并将音频码率设为 128 kbps,在音质和文件大小之间取得平衡。
压缩视频变小
E:\lumeng\soft\ffmpeg-master-latest-win64-gpl-shared\bin\ffmpeg.exe -i PPT-VIDEO.mp4 -c:v libx264 -crf 23 -preset medium -c:a aac -b:a 128k PPT-VIDEOsmall.mp4
裁剪视频从11秒到20秒
E:\lumeng\soft\ffmpeg-master-latest-win64-gpl-shared\bin\ffmpeg.exe -ss 11 -to 20 -i training.mp4 -c copy training-11.mp4