5-29 有趣的指令Pix2Pix(P2P)

前言:

上一节我们介绍了ControlNet中使用IP-Adapter能力

本节主要介绍ControlNet中的指令P2P。

全称Pix2Pix,顾名思义是针对Pixel像素级别的操作和影响。实际上通俗的理解,我们可以认为,编写一个指令,去影响这个最终图片。

有点和Reference类似,不同的是一个通过图片,一个是通过文字,或者说指令。但最终形成的都是RA/SD处理过程中参考对象的内容或者数据。所以原理是一样的。

知识点:

  1. 指令P2P

基础官方知识:

使用 Instruct Pix2Pix 控制稳定的扩散。

模型文件:control_v11e_sd15_ip2p.pth

配置文件:control_v11e_sd15_ip2p.yaml

这是一个在Instruct Pix2Pix 数据集上训练的控制网络。

与官方的 Instruct Pix2Pix 不同,该模型是用 50% 指令提示和 50% 描述提示进行训练的。例如,"一个可爱的男孩"是描述提示,而"让男孩可爱"是指令提示。

因为这是一个 ControlNet,所以您无需为原始 IP2P 的双 cfg 调整而烦恼。并且,该模型可以应用于任何基本模型。

另外,"将其变成 X"之类的指令似乎比"将 Y 变成 X"效果更好。

使用随机种子 12345 进行非精心挑选的批次测试("使其着火"):

实战

这次我们学习用ControlNet中的 InstructP2P 类型。

关键字这里给它指令 【让它着火】 或 对等英文 set it on fire,

选择一个建筑物的原图, ControlNet配置类型

结果出来的图片, 真的着火了。。。。。可以看到,大火的结构样子还是和这个建筑物有点关系的。 。

这样看来,你给的指令可以有很多。比如让2个人打架。。。。

作为对比, 如果没有ControlNet的参考图控制, 则出来的结果啥也不是

RA/SD 衍生者AI训练营

相关推荐
zl_vslam8 小时前
SLAM中的非线性优-3D图优化之轴角在Opencv-PNP中的应用(一)
前端·人工智能·算法·计算机视觉·slam se2 非线性优化
koo3648 小时前
李宏毅机器学习笔记43
人工智能·笔记·机器学习
lzjava20248 小时前
Spring AI使用知识库增强对话功能
人工智能·python·spring
Francek Chen8 小时前
【自然语言处理】预训练05:全局向量的词嵌入(GloVe)
人工智能·pytorch·深度学习·自然语言处理·glove
这张生成的图像能检测吗9 小时前
(论文速读)LyT-Net:基于YUV变压器的轻量级微光图像增强网络
图像处理·人工智能·计算机视觉·低照度
许泽宇的技术分享9 小时前
AI黑客来袭:Strix如何用大模型重新定义渗透测试游戏规则
人工智能
Oxo Security9 小时前
【AI安全】检索增强生成(RAG)
人工智能·安全·网络安全·ai
少林码僧9 小时前
2.3 Transformer 变体与扩展:BERT、GPT 与多模态模型
人工智能·gpt·ai·大模型·bert·transformer·1024程序员节
Kratos开源社区9 小时前
跟 Blades 学 Agent 设计 - 01 用“提示词链”让你的 AI 助手变身超级特工
llm·go·agent
shayudiandian9 小时前
如何使用 DeepSeek 帮助自己的工作
人工智能