在线教程丨字节开源 InfiniteYou 图像生成框架,实现高保真面部特征迁移

InfiniteYou(简称 InfU)是由字节跳动智能创作团队 (ByteDance Intelligent Creation) 近期推出的一款基于 Diffusion Transformers 的身份保持 (identity-preserved) 图像生成框架。它通过先进的技术,能够在生成图像的同时保持人物身份的一致性,即在生成不同场景的图片时能够精准保留面部特征

作为该领域最早利用扩散 Transformer (DiTs) 的框架之一,InfU 系统性地解决了现有方法的 3 大核心问题:身份相似度不足、图文对齐偏差以及生成质量与美学表现欠佳。其核心创新 InfuseNet 通过残差连接将身份特征注入 DiT 基础模型,在保持生成能力的同时显著提升身份保真度。采用包含预训练和合成单人多样本 (SPMS) 数据监督微调 (SFT) 的多阶段训练策略,进一步优化了图文对齐性,改善生成质量并有效缓解人脸复制效应。大量实验表明,InfU 实现了 SOTA 级别的性能表现,全面超越现有基线方法

目前「InfiniteYou 高保真图像生成 Demo」教程已上线至 HyperAI超神经官网教程板块, 感兴趣的小伙伴快来亲自上手试一试吧 !

教程地址

go.hyper.ai/xQnpS

Demo 运行

  1. 登录 hyper.ai,在「教程」页面,选择「InfiniteYou 高保真图像生成 Demo」,点击「在线运行此教程」。
  1. 页面跳转后,点击右上角「克隆」,将该教程克隆至自己的容器中。
  1. 选择「NVIDIA RTX A6000」以及「PyTorch」镜像,OpenBayes 平台提供了 4 种计费方式,大家可以按照需求选择「按量付费」或「包日/周/月」,点击「继续执行」。新用户使用下方邀请链接注册,可获得 4 小时 RTX 4090 + 5 小时 CPU 的免费时长!

HyperAI超神经总专属邀请链接(直接复制到浏览器打开):

openbayes.com/console/sig...

  1. 等待分配资源,首次克隆需等待 2 分钟左右的时间。当状态变为「运行中」后,点击「API 地址」旁边的跳转箭头,即可跳转至 Demo 页面。请注意,用户需在实名认证后才能使用 API 地址访问功能。

效果展示

  1. 进入 Demo 页面后,首先在「Identity Image」处上传包含人脸的照片,然后输入 Prompt,并在「Model Version」处选择模型版本,这里默认使用「aes_stage2」以获得更好的图文对齐和生成效果,如需更高的 ID 相似度,请尝试「sim_stage1」。「Control Image[Optional]」处可上传人脸的控制图片,模型会提取 5 个面部关键点来控制生成,非必要项。最后点击「Generate」生成图像。
  1. 此处上传了一张 Yann Lecun 的照片,可以看到生成效果还是不错的。

*prompt:A sophisticated gentleman exuding confidence. He is dressed in a 1990s brown plaid jacket with a high collar, paired with a dark grey turtleneck. His trousers are tailored and charcoal in color, complemented by a sleek leather belt. The background showcases an elegant library with bookshelves, a marble fireplace, and warm lighting, creating a refined and cozy atmosphere. His relaxed posture and casual hand-in-pocket stance add to his composed and stylish demeanor

以上就是 HyperAI超神经本期为大家推荐的教程,快来上手亲自体验吧!

教程地址go.hyper.ai/xQnpS

相关推荐
哥布林学者1 小时前
高光谱成像(二)光谱角映射 SAM
机器学习·高光谱成像
中杯可乐多加冰1 小时前
OpenClaw到底能做什么?有什么用?先装这几个实用的Skills
人工智能
千寻girling1 小时前
一份不可多得的 《 Python 》语言教程
人工智能·后端·python
aircrushin3 小时前
从春晚看分布式实时协同算法与灵巧手工程实现
人工智能·机器人
恋猫de小郭3 小时前
Apple 的 ANE 被挖掘,AI 硬件公开,宣传的 38 TOPS 居然是"数字游戏"?
前端·人工智能·ios
银河系搭车客指南4 小时前
AI Agent 的失忆症:我是怎么给它装上"第二个大脑"的
人工智能
张拭心4 小时前
春节后,有些公司明确要求 AI 经验了
android·前端·人工智能
我的username4 小时前
极致简单的openclaw安装教程
人工智能
小锋java12344 小时前
【技术专题】嵌入模型与Chroma向量数据库 - Chroma 集合操作
人工智能
七月丶4 小时前
别再手动凑 PR 了:这个 AI Skill 会按仓库习惯自动建分支、拆提交、提 PR
人工智能·设计模式·程序员