用开源的Toonflow和MiniMax H3一步步复刻万妖

最近我在折腾一个叫 Toonflow 的东西。

简单说,它是一个本地跑的 AI 媒体生成工作台 ------ 你可以把各种图片、视频、音频模型接进来,像搭积木一样拼自己的创作流水线。

问题是,Toonflow 自带的模型列表里没有我最想用的那个:MiniMax H3。

为什么非要 H3

如果你关注 AI 视频生成,应该听过 "海螺" 这个名字。MiniMax 出的视频模型,在人物一致性、动作自然度和电影质感这块,目前确实是第一梯队。

我之前一直在用 RunningHub 上的云端 ComfyUI 工作流跑 H3------ 打开网页、上传参考图、粘贴提示词、点提交、等两分钟、下载视频。能用,但就是每次都得手动操作。

我就想:能不能把这套流程直接接进 Toonflow,让它变成画布上的一个节点?拖一张图进来,写段提示词,点生成,完事。

首先把RunningHub api调用和toonflow模板给智能体,先进行导入。

我用的是同时支持首帧和全能参考的MiniMax H3工作流。但是记得要勾选这些。

python 复制代码
AI应用:Minimax H3二采优化速度-self lift-多参考 
体验地址:https://www.runninghub.cn/ai-detail/2100129733211148290?inviteCode=oga1ahgc
  1. 在 Toonflow 设置里填入 RunningHub API Key

  2. 把章节的剧本给toonflow助手,自动生成资产图(第一次需要),后续可以直接复用

剧本可以拆成这样的格式,toonflow可以一部到位参考。

!在这里插入图片描述(https://i-blog.csdnimg.cn/direct/1f62d68a2![在这里插入图片描述](https://i-blog.csdnimg.cn/direct/6d9f3973f8f74af881cf3ebe413b9c44.png)

b404f43a6f0953f20faa867.png)

  1. 写提示词 ------ 按 subject_definitions → summary → retention_analysis → detailed_description 四段结构(先把minimaxh3 提示词技能安装一下)

  2. 弹窗对话框,选时长(5 秒)、选画幅(竖屏 9:16 或横屏 16:9)

  3. 点生成,等 5-6 分钟,视频直接出现在画布上

toonflow还很贴心,把15~30s也放在标题,这样方便后续查阅。

提示词结构是关键。不是随便写一句话就行,要像写分镜脚本一样:

复制代码
subject_definitions:
<Picture 1> 妖物群像:蓝光大狼、金纹黑熊妖、泛白龙、破帽棕袍白猿妖。蓝狼泛蓝光并从卷轴跃出;黑熊妖穿佛冠、挂佛珠、周身金色火焰;白龙泛白光、从黑雾中探头嘶吼;白猿妖穿破帽棕袍、长白胡须、手持古卷轴、周身蓝色寒气。全片不得漂移。
<Picture 2> 金光小人与仙山构图:左侧金色光团化成的长裙发光小人,暖金粒子光;右侧云海、尖峰仙山、浮空古建岛屿,远处黑袍人影剪影。该图只锁金光小人与空间构图,不锁死后续人物身份。
<Picture 3> 百妖图卷轴:左右展开的鎏金铜轴古卷轴,龙纹云纹,黑色墨流漩涡,中心金色光团;左侧可见"百妖图"三字。全片保留卷轴材质、墨流与文字风格。

summary:
东方玄幻超写实 15 秒:百妖图古卷展开,金光小人沿墨流飞升,妖物从卷中显现,修士闭目盘坐,群妖俯首围卷,整体压迫、神秘、古卷显灵。

retention_analysis:
<Picture 1>(妖物锚点):完全保留蓝狼蓝光、黑熊佛冠佛珠金纹火焰、白龙白光、白猿破帽棕袍白须与寒气的身份特征;不新增妖物,不改变数量。
<Picture 2>(构图锚点):完全保留金光小人的暖金光体、云海仙山浮空古建的纵深感;后续可释放成飞行与墨流道路,不锁死静态摆拍。
<Picture 3>(道具/文字锚点):完全保留鎏金卷轴、铜轴、墨流漩涡、中心金色光团;左侧"百妖图"三字稳定可读,古篆/古隶风格,不出现现代字体、UI、水印。

详细描述:
写实电影风格,东方玄幻,胶片颗粒,暗金、墨黑、云海蓝紫、妖物冷光的色调。15 秒内完成 4 个动作节点,全程以特写、近景、中景为主,起势即动,不做静态摆拍。

0--1s:特写,左右展开的鎏金铜轴古卷轴占据画面,左侧卷轴上"百妖图"三字清晰可见;黑色墨流在卷轴间旋转成漩涡,漩涡中心一点金色光团亮起。
1--3s:镜头顺墨流推入全景,金色光团化成长裙发光小人;小人上方黑色墨流迅速扩大为长条巨幅黑影,墨流旋成高速漩涡,带起金粒子。
3--5s:镜头切远景跟拍,黑影铺成向前延伸的墨色道路;金光小人裹着金光沿道路高速飞行,前方是云海中的尖峰仙山与浮空古建岛屿,镜头保持快速前冲但不失稳定。
5--9s:镜头推近金色龙纹光轮,光轮顶部出现金色仙宫造型;数道黑色墨流从四周刺向光轮中心的小人,同时金光爆发闪过人物眼部特写;随后切近景移镜,蓝光巨狼从卷轴跃出,黑熊妖自卷面显现,周身金色火焰升腾。
9--13s:切近景,白龙从黑雾中探出头嘶吼,紧接着白猿妖手持古卷轴显现,蓝色寒气外扩;再切中景,黑红古风长袍修士闭目盘坐于地面,身后浮现持火金巨妖、黑熊妖、蓝狼妖虚影,金色卷轴碎片从修士肩头缓缓飘过。
13--15s:镜头拉成全景,修士周身环绕蓝虎、赤火虎、白龙、白狼、黑熊、红狮等群妖,所有妖物围着中心小卷轴俯身;墨流回落为暗金纹路,画面停在群妖俯首、卷轴悬空的压迫静帧。

声音规则:BGM 按画面强度生成;0--3s 低频风雷与古卷墨流声推进,3--7s 金光飞行加入弦乐上扬,7--11s 妖物嘶吼与火焰/寒气声增强,11--15s 群妖俯首时保留低频鼓点与卷面纸纹摩擦。人物对话音频仅用于对白/人声,不加入额外台词。

文字规则:必须包含左侧卷轴上的"百妖图"三字,古篆/古隶风格,稳定清晰;不生成其他字幕、标题、UI、水印、说明卡;不出现现代字体;文字不遮挡金光小人、墨流漩涡、妖物双眼与锁链。

负面约束:绝对禁止额外字幕、画面文字、LOGO、水印、多余手指、畸形手部、多肢体、穿模;禁止角色变脸、换装、瞬移;禁止慢动作长镜头;禁止无来源新增妖物或改变妖物数量。

retention_analysis 这段特别重要 ------ 它告诉模型 "什么必须保留不变",否则生成出来的人物脸会漂。

其实这些都能复用

RunningHub 的 API 不复杂:提交任务拿 taskId,然后轮询查询接口等结果。

如果你也在用 RunningHub + Toonflow,或者想把其他 ComfyUI 工作流接进来,核心就三件事:

  1. 搞清楚每个节点接受什么格式------LoadImage 只要文件名,文本节点随便传

  2. 异步任务要轮询------ 提交后别只返回 taskId,要在方法内部等到 SUCCESS 再返回结果

  3. Bun 环境没有 atob/btoa------ 用 Buffer 代替

现在想复刻爆款视频,不用再开浏览器跑网页了。画布上拖拖图、写两句话,视频就出来了。


你有没有用过 Toonflow 或者类似的 AI 创作工作台?接模型的时候踩过什么坑?评论区聊聊。

相关推荐
智能RPA1 小时前
农业与矿业行业智能体自动化平台对比评测(计量与巡检场景)
运维·人工智能·python·自动化·agent·rpa
byte轻骑兵1 小时前
VCP核心缩写概览
人工智能·音视频·le audio·低功耗蓝牙音频
茶杯6751 小时前
AI重构电商视觉生产 极睿科技AGI Ecpro助力行业数字化升级
人工智能·ai重构电商·极睿科技·agi ecpro·极睿科技—agi ecpro
liferecords1 小时前
笔记本硬跑 744B 大模型:GitHub 上的『蜂鸟』把 SSD 当显存用
人工智能·开源·大模型·推理优化
工业设备方案笔记1 小时前
I3568开发板 vs X3576开发板:RK3568与RK3576到底怎么选?
人工智能
ting94520001 小时前
深度拆解|Dif.Sh 开源特性开关(Feature Flags)技术架构与工程落地全解析
人工智能·架构·开源
2601_962380761 小时前
历史解说与民俗科普视频的AI自动配素材实现教程
人工智能·音视频
TomEval1 小时前
【测AI】第05篇:Python 爬虫进阶 —— 动态页面爬取与 Scrapy 框架
人工智能·爬虫·python·scrapy·自动化
凡泰极客科技1 小时前
从数据质检到运行审计:金融AI智能体如何安全且合规落地?
人工智能·安全·金融