【教学类-160-05】20260412 AI视频培训-练习5“豆包AI视频《幼儿园之父:福禄贝尔(英声中字)》+豆包图片风格:伦勃朗(古典油画)竖版”

20260412万相AI视频6《福禄贝尔》风格:伦勃朗

背景需求

尝试伦勃朗黑白明暗人像,看看是否豆包能生成

10秒旁白,豆包就给了10个字,感觉太少了,

查询后是30-40字

图片生成:伦勃朗

选有技法的关键词

一个镜头生成2张

每一套关键词,选择并下载一张图片,

我想做首尾帧动图,不过先测试豆包能否做出伦勃朗人像

只有一个模型

不能生成油画人物,只能通义万相慢慢生成

只能通义万相做首尾帧视频,3*5=15小时

全部生成完成,做GIF

放慢后,音频不够,选一段

选了1分钟的音频

制作旁白

感觉中文的旁白有点短,没有凑满10秒

换成英文的旁白

中文字幕对应英文音频轨道,一一对应

手动把段落文字的空格变成换行的点

并没有多段,实际生成9段

所以人工对位,把中文字幕与英文音频波段对位

保存导出

20260412万相AI视频6《福禄贝尔》风格:伦勃朗

感悟:

1、油画人物也不能豆包生成AI视频,通义万相确定是3小时1段5秒。

2、Python调用# 播音员音色VOICE = "zh-CN-YunyangNeural" # 男播音,生成英文旁白

3、剪映字幕,需要人工分段,所以AI视频不能超过2分钟。

相关推荐
杀生丸学AI15 小时前
【稀疏重建】StructSplat:基于非校准稀疏视图的可泛化3DGS
深度学习·3d·音视频·transformer·三维重建·空间智能
小柯南敲键盘15 小时前
跨境电商图片翻译工具推荐:批量AI翻译+视频字幕+智能抠图
人工智能·python·音视频
DogDaoDao18 小时前
【H266/VVC提案解读】ITU-T H.274 (V4) 规范深度解读 — 视频编码 SEI 消息的全面演进
音视频·实时音视频·视频编解码·流媒体·h266·vvc·视频编解码标准
程序员老陆19 小时前
FFmpeg RTSP 解复用器(rtsp demuxer)完全解析:从「能播」到「稳播」的参数圣经
ffmpeg·音视频·拉流·rtsp
hhzz20 小时前
Tiger AI 平台「手势识别」功能全解析:从数字手势 0–9,到中国手语字母,再到本地视频批量识别——一条链路,三种输入,双模型可同开;双手比划,机器秒懂
人工智能·python·深度学习·aigc·音视频
martindelophy21 小时前
DeepSeek Harness 插件开发实战:用自然语言检查、修改并渲染 Timeline Studio 视频工程
音视频
平原20181 天前
LTX-2.5 22B 本地部署:ModelScope 下载、8 步推理与图生视频命令
音视频
淡淡的香烟1 天前
Android视频直播播放器简单封装
android·物联网·音视频
AI创界者1 天前
MiniMax-H3 AI 视频整合包:音频驱动/文图生视频/全能参考,免环境解压即用
人工智能·aigc·音视频
show4331 天前
2026视频处理小程序技术选型指南:链接解析+OCR+ASR+AI配音多引擎对比
小程序·ocr·音视频