5-29 有趣的指令Pix2Pix(P2P)

前言:

上一节我们介绍了ControlNet中使用IP-Adapter能力

本节主要介绍ControlNet中的指令P2P。

全称Pix2Pix,顾名思义是针对Pixel像素级别的操作和影响。实际上通俗的理解,我们可以认为,编写一个指令,去影响这个最终图片。

有点和Reference类似,不同的是一个通过图片,一个是通过文字,或者说指令。但最终形成的都是RA/SD处理过程中参考对象的内容或者数据。所以原理是一样的。

知识点:

  1. 指令P2P

基础官方知识:

使用 Instruct Pix2Pix 控制稳定的扩散。

模型文件:control_v11e_sd15_ip2p.pth

配置文件:control_v11e_sd15_ip2p.yaml

这是一个在Instruct Pix2Pix 数据集上训练的控制网络。

与官方的 Instruct Pix2Pix 不同,该模型是用 50% 指令提示和 50% 描述提示进行训练的。例如,"一个可爱的男孩"是描述提示,而"让男孩可爱"是指令提示。

因为这是一个 ControlNet,所以您无需为原始 IP2P 的双 cfg 调整而烦恼。并且,该模型可以应用于任何基本模型。

另外,"将其变成 X"之类的指令似乎比"将 Y 变成 X"效果更好。

使用随机种子 12345 进行非精心挑选的批次测试("使其着火"):

实战

这次我们学习用ControlNet中的 InstructP2P 类型。

关键字这里给它指令 【让它着火】 或 对等英文 set it on fire,

选择一个建筑物的原图, ControlNet配置类型

结果出来的图片, 真的着火了。。。。。可以看到,大火的结构样子还是和这个建筑物有点关系的。 。

这样看来,你给的指令可以有很多。比如让2个人打架。。。。

作为对比, 如果没有ControlNet的参考图控制, 则出来的结果啥也不是

RA/SD 衍生者AI训练营

相关推荐
理想是做个英雄3 分钟前
基于AC6366C做AI语音鼠标
人工智能·计算机外设·杰理ble,mcu以及音频蓝牙
Cosmoshhhyyy3 分钟前
MCP:cursor、claude code接入chrome-devtools-mcp。
ai·mcp
stbomei18 分钟前
2025 AI 消费端变革:从生活助手到体验重构的全民浪潮
人工智能·重构·生活
琥珀食酒社26 分钟前
马云归来,“新零售”不死
人工智能·零售
IT_陈寒31 分钟前
JavaScript性能优化:7个90%开发者不知道的V8引擎黑科技
前端·人工智能·后端
tirvideo31 分钟前
RK3588芯片与板卡全面解析:旗舰级AIoT与边缘计算的核心
人工智能·嵌入式硬件·深度学习·目标检测·机器学习·计算机视觉·边缘计算
倾云鹤38 分钟前
flutter实现Function Call
flutter·llm·function call
努力也学不会java41 分钟前
【Java并发】揭秘Lock体系 -- 深入理解ReentrantLock
java·开发语言·人工智能·python·机器学习·reentrantlock
DatGuy1 小时前
Week 18: 深度学习补遗:Stacking和量子运算Deutsch算法
人工智能·深度学习·算法
红苕稀饭6662 小时前
RISE论文阅读
论文阅读·人工智能·计算机视觉