降维打击~使用视频大模型去除路人工作流

旅游照片去除路人(保留主体人物)AI修图工作流

一、工作流核心目标

没想到吧?minimaxH3作为视频生成大模型,用来做图片编辑简直是降维打击,实测人物一致性超强,本文介绍它在修图中的应用。

针对旅游实拍人像照片,通过图像编辑提示词,无痕清除画面内所有路人、游人、无关遮挡人物,100%保留画面主体人物的样貌、姿态、穿搭、气质,同时还原真实、连贯、无破绽的景区背景,消除旅游照杂乱路人问题,提升画面干净度与高级感,全程不改动原图构图、光影、色调、场景氛围。

适配AI绘图统一规则:仅单锚点 Picture 1 锁定全画面基础信息,无多图参照、无画面漂移、无换脸变形。

二、核心规则(固定锚点)

1. 锚点定义

Picture 1:严格锁定整张原图所有基础信息,包含:画面主体人物(脸型、五官、发型、服装、姿态、表情、位置、气质)、整张画面构图、机位、景别、景区背景、道具、植被、建筑、光影方向、色温、色调、景深、照片质感。全程禁止画面漂移、主体变形、氛围改动。

2. 保留原则

  • 主体全保留:不修改、不优化、不替换画面主要人物,五官、脸型、发型、体态、神情完全和原图一致,保留个人独有辨识度。

  • 场景全保留:景区建筑、路面、天空、花草、栏杆、台阶等所有背景元素结构不变,仅修补被路人遮挡区域。

  • 光影质感全保留:原图自然光、阴影、色温、胶片质感、明暗对比完全继承,不重新渲染画面。

3. 修改原则(仅唯一改动)

精准识别并删除画面中所有游人、路人、游客、无关行人、多余人影,对空白遮挡区域进行智能无痕补图,匹配原图透视、纹理、光影、细节。

三、标准化AI提示词(可直接复制使用)

适配所有AI修图/生图平台,单Picture1极简标准版,零出错、高还原:

Plain 复制代码
subject_definitions:
<Picture 1> 严格负责画面主体人物、构图、机位、景区环境、光影和色调,全程不得漂移。

summary:
精准去除画面内所有游人、路人、无关多余人物,完整保留原图主体人物、景区场景与原有光影色调,无痕修复被遮挡背景。

retention_analysis:
<Picture 1>(画面锚点):完全保留 - 主体人物脸型、五官、发型、服装、姿态表情、站位不变;原图构图、机位、景区建筑、植被、地面、天空、光源方向、色温、景深全部继承,仅移除无关路人并智能补全背景。

detailed_description:
真实旅游照片原生质感,保留画面所有实景纹理。
[Shot 1] 完全沿用Picture 1的人物站位、肢体动作、镜头景别、环境光影。精准清除画面全部游客、路人、多余人影,根据原图场景透视与纹理,无缝补全被遮挡的地面、建筑、植被、天空等背景区域,修复位置光影衔接自然,无断层、无违和。主体人物完整清晰,边缘干净无残留虚影,样貌和气质完全不变。

全程保持:主体人物面部辨识度不变,不换脸、不变形、不微调五官;无字幕、无水印、无logo、无畸形细节、无修图涂抹痕迹、无重复纹理。

四、完整操作步骤(落地工作流应用)

python 复制代码
工作流地址,可以单张上传图片,也可api调用
MiniMax-H3单图编辑 (用来修图美化图片自动去路人) 
ai应用地址:https://www.runninghub.cn/ai-detail/2086369052158676993?inviteCode=oga1ahgc

步骤1:导入原图

上传需要处理的旅游人像照片,保证主体人物清晰、画面完整,无需预处理。

步骤2:粘贴标准提示词

清空原有指令,复制上方全套单Picture1提示词,直接填入AI指令框。

步骤3:执行生成

一键生成,AI自动识别多余路人、精准删除、智能补全背景,全程保留原图人物与场景质感。

步骤4:微调校验(可选)

若存在细微瑕疵,可再次生成,优先保证:背景透视正确、无残影、主体人物零改动。

五、成品效果标准

  • 画面干净整洁,无任何路人、多余人影、遮挡杂物;

  • 主角人物100%还原原图样貌、穿搭、神态,无任何改动;

  • 修补背景与原图融为一体,无涂抹感、无AI假纹理、无透视错误;

  • 整体光影、色调、氛围和原片完全一致,真实自然不生硬。

六、拓展适配(可选叠加)

如需同时美化人物,可在此工作流基础上,叠加精细美容优化(空气刘海、皮肤质感、淡妆氛围感)的提示词,实现「去路人+精致人像修图」一站式处理。

相关推荐
企业数字化笔记1 小时前
视频视觉任务怎样选择媒体处理技术?FFmpeg、OpenCV、GStreamer 的职责与适用场景
ffmpeg·音视频·媒体
码上观世界14 小时前
一张图 + 一段音频,生成口型同步、有表情的数字人
音视频
鲲穹AI种草17 小时前
自媒体矩阵批量剪辑怎么选?鲲剪短视频批量处理工具横向评测
人工智能·音视频·媒体
可乐鸡翅yeah_17 小时前
网页端 M3U8 播放器性能监控,怎么看播放卡顿指标
javascript·ffmpeg·音视频·safari·m3u8
可乐鸡翅yeah_17 小时前
M3U8 防盗链 URL‑Token 签名,新手开发实操避坑
开发语言·javascript·ios·音视频·safari
昨日之日200618 小时前
yovoice:本地配音工具箱,支持音色克隆与情绪控制,专为旁白、有声书和视频配音打造
人工智能·音视频
狗凯之家源码网18 小时前
2026 版短视频与视频号去水印源码深度评测
音视频
深圳市青牛科技实业有限公司20 小时前
GC1843|24bit 立体声差分输入 ADC,超小封装音频采集芯片
音视频
W_chuanqi21 小时前
使用EV录屏视频噪声很大
音视频·ev录屏