Talk|香港科技大学刘智立:Geom-Erasing - 图像生成模型中的隐式概念删除

本期为TechBeat人工智能社区 第 569 期线上Talk。

北京时间2月1日(周 四)20:00, 香港科技大学博士生 --- 刘智立的Talk已准时在TechBeat人工智能社区开播!

他与大家分享的主题是: " Geom-Erasing - 图像生成模型中的隐式概念删除 ",系统地介绍了他的团队提出的基于几何位置信息的概念去除算法Geom-Erasing,以及Geom-Erasing如何有效地抑制隐含概念的产生等相关工作所做的研究。

Talk·信息

▼

主题:Geom-Erasing-图像生成模型中的隐式概念删除

嘉宾:香港科技大学博士生 刘智立

时间:北京时间2 月1日(周四)20:00

地点:TechBeat人工智能社区

点击下方链接,即可观看视频!

TechBeatTechBeat是荟聚全球华人AI精英的成长社区,每周上新来自顶尖大厂、明星创业公司、国际顶级高校相关专业在读博士的最新研究工作。我们希望为AI人才打造更专业的服务和体验,加速并陪伴其成长。https://www.techbeat.net/talk-info?id=847

Talk·介绍

▼

文本到图像 (T2I) 扩散模型经常会无意中生成不需要的概念,例如水印和有害的图片。这些概念我们称为"隐式概念",是扩散模型在预训练期间无意中学到,然后在推理过程中无法控制地产生。这些类似概念模型的一个个bug,用现有的概念删除方法难以消除。

对此,我们提出Geom-Erasing,一种基于几何位置信息的概念去除算法。此外,我们创建了隐式概念数据集(ICD),包含三种典型的隐式概念(即 QR 码、水印和文本),这些概念很容易在现实生活中被注入。 Geom-Erasing 能有效地抑制隐含概念的产生。

Talk大纲

1、背景 - 图像生成模型水印和安全问题

2、现有方案不足 - 基于re-training和概念删除的方法

3、解决方案 - Geom-erasing算法:隐士概念定位 + 位置编码 + 损失函数改进

4、实验结果 - 2种setting下,Geom-Erasing生成干净安全图片

5、总结

Talk·预习资料

▼

论文链接:https://arxiv.org/abs/2310.05873

Talk·提问交流

▼

在Talk界面下的**【交流区】**参与互动!留下你的打call🤟和问题🙋,和更多小伙伴们共同讨论,被讲者直接翻牌解答!

你的每一次贡献,我们都会给予你相应的i豆积分,还会有惊喜奖励哦!

Talk·嘉宾介绍

▼

刘智立

香港科技大学·博士生

刘智立目前是香港科技大学计算机系博四的学生,导师是James Kwok教授。博士期间主要的研究方向是自监督算法、多专家模型、扩散模型。 在多个会议发表过多篇论文, 包括ICLR,CVPR,ICCV,AAAI等,曾在MSRA,华为诺亚方舟实验室等实习。

个人主页: https://www.techbeat.net/grzytrkj?id=37287


关于TechBeat人工智能社区

▼

TechBeat(www.techbeat.net)隶属于将门创投,是一个荟聚全球华人AI精英的成长社区。

我们希望为AI人才打造更专业的服务和体验,加速并陪伴其学习成长。

期待这里可以成为你学习AI前沿知识的高地,分享自己最新工作的沃土,在AI进阶之路上的升级打怪的根据地!

更多详细介绍>>TechBeat,一个荟聚全球华人AI精英的学习成长社区

相关推荐
这张生成的图像能检测吗5 小时前
(论文速读)FE-CLIP:把频域信息注入 CLIP,做零样本异常检测与分割
人工智能·opencv·目标检测·计算机视觉·缺陷检测·异常检测
指针向南6 小时前
MP4索引怎样影响边下边播
图像处理·人工智能·计算机视觉
YOLO数据集集合6 小时前
桥梁损伤实例分割数据集 | 桥梁损伤 实例分割 裂缝检测 钢筋外露 混凝土剥落9160期
人工智能·目标检测·计算机视觉·桥梁·桥梁损害·桥梁数据集
小蒋观天下9 小时前
端侧大模型在安防摄像头部署实操(下篇)|模型量化、推理加速、视频接入与量产调优
大数据·人工智能·算法·安全·机器学习·计算机视觉·ai大模型
这张生成的图像能检测吗20 小时前
(论文速读)LogSAD:无需训练的结构异常与逻辑异常统一检测
人工智能·机器学习·计算机视觉·大模型·多模态·异常检测
hhzz1 天前
【YOLO 入门到精通 04】理解任务与模型家族:7 大 CV 任务与 YOLO26 选型指南
人工智能·python·深度学习·yolo·计算机视觉
Rocky Ding*1 天前
深入浅出完整解析FLUX.2、Seedream(即梦)、Z-image、Qwen-Image、GLM-Image核心基础知识
论文阅读·人工智能·深度学习·机器学习·aigc·扩散模型·ai-native
一木 之林1 天前
RAG开发学习总结:从 LangChain 入门到检索增强生成链路的全栈实战-4/6
人工智能·学习·计算机视觉·langchain
山顶夕景1 天前
【VLA】Qwen-VLA:VLM+DiT统一多模态理解与连续机器人动作生成
机器人·多模态·扩散模型·具身智能·vla·dit·vlm
黑妹天下第一乖1 天前
第 05 讲:阿加犀 AidCV 图像处理加速与 OpenCV 一致开发实战
开发语言·图像处理·人工智能·嵌入式硬件·数码相机·opencv·计算机视觉