视频制作流程MP4旁白语音生成裁剪视频压缩python处理ppt转视频M4a格式

视频制作流程:

1 准备PPT和旁白(每页一一对应)

2 使用workbuddy上传旁白,让他转为m4a语音文件并保存至当前目录

(由于要收费,所以直接用python处理吧。安装语音依赖库 pip install edge-tts)

3 手动打开PPT将所有音频逐个插入到每页中。(选择自动播放、与上一动画同时播放)

4 PPT->文件-》另存-》创建视频(会自动生成播放视频)

5 使用ffmpeg裁剪视频

6 完成。

代码旁白转语音

复制代码
import asyncio
import edge_tts

# 格式:[标题前缀, 描述文本]
voice_texts = [
    [
        "Organization Chart",
        "Visualizes group hierarchies and departments with multi-dimensional browse/search. A foundation for onboarding and cross-team collaboration."
    ],
    [
        "Monthly Report Consolidation",
        "Unified submission channel for HR/operational metrics. Enables auto-consolidation of global data for HQ analysis."
    ]
]

# 美式商务女声
VOICE = "en-US-JennyNeural"

async def run_tts():
    for index, (title, desc) in enumerate(voice_texts, start=1):
        # 完整朗读内容:标题 + 冒号 + 描述
        full_speech = f"{title}: {desc}"
        # 带序号文件名
        save_path = f"{index}_{title}.m4a"
        tts = edge_tts.Communicate(full_speech, VOICE)
        await tts.save(save_path)
        print(f"✅ {index}/10 已生成:{save_path}")

if __name__ == "__main__":
    asyncio.run(run_tts())

E:\lumeng\soft\ffmpeg-master-latest-win64-gpl-shared\bin\ffmpeg.exe -ss 00:00:04 -i 1-13.mp4 -to 00:09:02 -c copy 1-13x-1.mp4

E:\lumeng\soft\ffmpeg-master-latest-win64-gpl-shared\bin\ffmpeg.exe -i 2026-1.mp4 -c:v libx264 -crf 35 -preset medium -c:a aac -b:a 128k 2026-1-small35.mp4

这条命令的含义是把视频压缩成常见的 H.264 格式,并对音频也进行了处理:

-c:v libx264:指定使用 H.264 视频编码器。这是目前兼容性最好、压缩效率也很高的编码格式,适用于绝大多数场景。

-crf 23:这是质量控制的核心参数。CRF 值范围为 0-51,值越大,压缩率越高,文件越小,但画质损失也越多;反之亦然。

18:视觉上接近无损,文件会比较大。

23:默认值,在文件大小和画质之间取得了很好的平衡。

28:文件会小很多,画质有一定损失,适合对清晰度要求不高的场景。

-preset medium:编码预设,影响压缩速度和效率。可选值从 ultrafast(最快,文件大)到 veryslow(最慢,文件小)。medium 是默认值,速度适中。

-c:a aac -b:a 128k:将音频编码为常见的 AAC 格式,并将音频码率设为 128 kbps,在音质和文件大小之间取得平衡。

压缩视频变小

E:\lumeng\soft\ffmpeg-master-latest-win64-gpl-shared\bin\ffmpeg.exe -i PPT-VIDEO.mp4 -c:v libx264 -crf 23 -preset medium -c:a aac -b:a 128k PPT-VIDEOsmall.mp4

裁剪视频从11秒到20秒

E:\lumeng\soft\ffmpeg-master-latest-win64-gpl-shared\bin\ffmpeg.exe -ss 11 -to 20 -i training.mp4 -c copy training-11.mp4

相关推荐
音视频牛哥10 小时前
AI浪潮下,实时音视频SDK正在经历怎样的价值重构?
人工智能·音视频·实时音视频·rtmp推流·低延迟rtsp播放器·低延迟rtmp播放器·rtsp转rtmp推流
乐橙开放平台10 小时前
明厨亮灶笔记:乐橙轻应用 H5 + 小程序插件,一套 BFF 出两张播放凭证
人工智能·笔记·物联网·小程序·音视频·notepad++
ofoxcoding11 小时前
Seedance 2.0 与 Wan 2026 视频生成 API 成本效率深度对比分析
网络·人工智能·ai·音视频
xingyuzhisuan11 小时前
星宇智算 AI 视频生成工具九维度全测评与行业对标分析
人工智能·音视频
豌豆学姐12 小时前
likeadmin-api 视频生成工作流实战:Seedance 2.0 接口从素材到任务查询
aigc·音视频·api·视频生成·likeadmin-api
乐橙开放平台12 小时前
养殖 SaaS 笔记:乐橙 IoT 物模型管环境,视频 OpenAPI 管回看
数据库·笔记·物联网·mysql·音视频
山顶夕景1 天前
【MAE】音频自监督训练Masked Autoencoders that Listen
音视频·ssl·多模态·自监督·mae
小码哥0681 天前
短视频后台系统架构设计与行业应用深度分析-源码-技术支持
系统架构·音视频·短视频后台·短剧后台·微剧后台
小猴子爱上树1 天前
TikTok Shop视频自动翻译工具实战教程
人工智能·python·音视频·机器翻译