Midjourney发布新特性风格参考

1. 引言

最近,Midjourney 推出了Style Reference V2.0 即功能更加强大的风格参考工具,该工具可以让大家参考其他图像的风格,生成与参考图像风格保持一致,与文本提示词语义内容保持一致的图像。它与图像提示类似,但是只关注参考图像的风格样式。

关于其更新的功能描述,我们在下文一一进行展开!

2. 新增功能

本次Midjourney更新所带来的新功能总结如下:

  • 更加准确地理解风格元素
  • 更好地避免非风格元素渗入图像
  • 改进了权重参数的功能,使得控制更加精细

3. 效果初探

直接前往 Discord上的Midjourney Bot, 上传大家的参考图像即可。我们先来选择一张参考图像,如下:

右键点击图像,并选择 "复制图像地址 "选项。

现在,使用以下提示词和上述参考图像的风格,来生成一组新的图像

Prompt: three bears under a big tree --- sref https://s.mj.run/CEx04TrK2ek --- ar 4:3 --- sw 1000
提示: 大树下的三只熊 --- sref https://s.mj.run/CEx04TrK2ek --- ar 4:3 --- sw 1000

就可以得到结果如下所示:

4. 参数分析

仔细观察上述生成的图像,它捕捉到了参考图像的精髓,这真是令人难以置信。捕捉到的细节,甚至是皱巴巴的纸张纹理,都令人叹为观止。我们不妨来分析一下上述提示词中的参数:

  • 参数--sref表示其后跟上参考图片的URL地址
  • 参数--sw表示更新样式的权重,取值范围为0-1000,如果需要减弱样式的影响,可将权重设置为 --sw 0,而使用--sw 1000生成的图像会更加贴近参考图像
  • 参数 --aspect或者--ar可以控制生成图像的宽高比

这里,不妨让我们尝试使用强度--sw 500来试试另一个例子,参考图像如下所示:

​提示词如下所示:

Prompt: an image of a cute pug wearing fashionable clothes --- sref https://s.mj.run/HolvSW18Z54 --- sw 500
提示:可爱的哈巴狗穿着时尚服装的形象 --- sref https://s.mj.run/HolvSW18Z54 ---sw 500

得到的生成图像如下所示:

5. 其他例子

为了更直观地显示使用和不使用样式参考参数的输出结果之间的差异,我们来看下面的例子,所选择的参考图像如下:

​提示词如下:

Prompt: an image of a girl sitting on a couch. 1980s, Retro illustration, Riso print, Vintage paint

提示:一个女孩坐在沙发上的图像。20 世纪 80 年代, 复古插画, Riso 印刷, 复古风格

这里我们来比较使用 --sref参数和不使用该参数的差异,得到对比结果如下:

我们也可以在任何文本提示中通过参数--sref来使用上述风格图像。请看下面这个例子,将上面的复古风格用在了一只狗身上,结果如下:

6. 使用多个参考

更一般的来说,我们也可以通过包含多个 URL 来使用多个参考图片。只需要大家在文本提示后输入 --sref,然后输入一个或多个样式参考图像的 URL,如下所示:--sref urlA urlB urlC

这里我们选择以下三张图像作为我们的参考图像:


我们所选用的文本提示如下:

prompt: A { violin, bird, piano} surrounded by flowers, --sref urlA urlB urlC
提示:一个 { 小提琴、小鸟、钢琴} 周围环绕着鲜花,--sref urlA urlB urlC

得到结果如下:


这是根据上述三张参考图片生成的图像。它完美地结合了上述参考图像中的美感。

7. 总结

总之,Midjourney再次证明,他们是风格转换方面的最佳工具。现在,用户对生成图像的风格和美感的控制水平和精确度是无与伦比的。作为人工智能艺术爱好者,我非常期待看到AI绘画的下一次变化。也许在不久会有更多全新的功能涌现?让我们拭目以待!

注: 相关素材来自互联网,供学习交流使用,侵权删!

相关推荐
山间小僧2 小时前
「AI学习笔记」Agent Memory(二)跨会话记忆:从聊天记录到可演化的长期记忆
aigc·agent·vibecoding
Goboy5 小时前
多模态大模型已经能识别和描述视频,为什么仍然缺乏可靠的时序感知能力?
aigc·ai编程
开心就多写,一点就开心5 小时前
导演视听语言与分镜系统笔记(一):景别系统、机位视点与时空连贯性设计
笔记·aigc·镜头·电影
Rocky Ding*16 小时前
【三年面试五年模拟】2026-09-08 DeepSeek AI Agent开发岗社招一面:20道问题与系统设计题全解析
论文阅读·人工智能·深度学习·机器学习·aigc·ai-native·deepseek
宝桥南山16 小时前
DeepSeek - 尝试安装和使用一下DeepSeek Harness
人工智能·ai·aigc·ai编程
Coffeeee17 小时前
claude-video 一个让你的Agent拥有看视频能力的Skill
android·人工智能·aigc
狠活科技18 小时前
GPT Image 2.5 发布:AI 生图又进化了
人工智能·gpt·ai作画·aigc·image2.5
刘广睿19 小时前
给素材库加语音转写:Whisper 本地部署与批量字幕生成实践
人工智能·aigc·音视频·语音识别·效率工具
全栈弄潮儿19 小时前
周复盘:这一周最值得保存的 7 条 AI 编程原则
aigc·openai·ai编程
知了一笑19 小时前
产品先上线再开发
人工智能·互联网·aigc