diffusion model: prompt-to-prompt 深度剖析

参考:diffusion model(十四): prompt-to-prompt 深度剖析-CSDN博客

P2P提出的Motivation

目前大火的文生图技术(text to image),给定一段文本(prompt)和随机种子,文生图模型会基于这两者生成一张图片。生成图片的不同由两个变量决定

随机种子:随机种子决定初始的噪声
prompt:prompt是通过文本编码器(如CLIP的text encoder)转为语义向量再送入到diffusion model的cross-attention层中与图片信息交互。

相关推荐
AI分享猿5 小时前
UI设计Prompt系列(十二):设计系统入门——把视觉语言沉淀为可复用规范
ui·prompt
tachibana29 小时前
文件上传分布式限流如何做?
人工智能·ai·大模型·llm·prompt
AI分享猿10 小时前
UI设计Prompt系列(十四):前端Agent协作——把UI设计意图转化为清晰执行上下文
前端·prompt
小白说大模型10 小时前
OpenClaw 测试策略实战:AI Agent 自动化测试体系搭建与落地
人工智能·重构·开源·prompt·embedding
AI分享猿1 天前
UI设计Prompt系列(六):原型验证提速——用设计Prompt跳过反复改稿
ui·prompt
AI分享猿1 天前
App原型构思指南:如何用设计Prompt梳理移动端页面
prompt
邀星月为媒1 天前
高阶加餐 08|Prompt 故障定位与可观测性:模型突然变差时,别再靠“重新写一遍 Prompt”解决
服务器·数据库·prompt
邀星月为媒1 天前
高阶加餐 07|跨模型迁移:一套 Prompt 如何兼容 DeepSeek、Qwen、GLM、Kimi 等模型
linux·网络·prompt
小当家.1052 天前
Prompt工程与上下文管理实战:从模板到Agent Loop的演进
prompt·agent·上下文·loop agent