在线教程丨字节开源 InfiniteYou 图像生成框架,实现高保真面部特征迁移

InfiniteYou(简称 InfU)是由字节跳动智能创作团队 (ByteDance Intelligent Creation) 近期推出的一款基于 Diffusion Transformers 的身份保持 (identity-preserved) 图像生成框架。它通过先进的技术,能够在生成图像的同时保持人物身份的一致性,即在生成不同场景的图片时能够精准保留面部特征

作为该领域最早利用扩散 Transformer (DiTs) 的框架之一,InfU 系统性地解决了现有方法的 3 大核心问题:身份相似度不足、图文对齐偏差以及生成质量与美学表现欠佳。其核心创新 InfuseNet 通过残差连接将身份特征注入 DiT 基础模型,在保持生成能力的同时显著提升身份保真度。采用包含预训练和合成单人多样本 (SPMS) 数据监督微调 (SFT) 的多阶段训练策略,进一步优化了图文对齐性,改善生成质量并有效缓解人脸复制效应。大量实验表明,InfU 实现了 SOTA 级别的性能表现,全面超越现有基线方法

目前「InfiniteYou 高保真图像生成 Demo」教程已上线至 HyperAI超神经官网教程板块, 感兴趣的小伙伴快来亲自上手试一试吧 !

教程地址

go.hyper.ai/xQnpS

Demo 运行

  1. 登录 hyper.ai,在「教程」页面,选择「InfiniteYou 高保真图像生成 Demo」,点击「在线运行此教程」。
  1. 页面跳转后,点击右上角「克隆」,将该教程克隆至自己的容器中。
  1. 选择「NVIDIA RTX A6000」以及「PyTorch」镜像,OpenBayes 平台提供了 4 种计费方式,大家可以按照需求选择「按量付费」或「包日/周/月」,点击「继续执行」。新用户使用下方邀请链接注册,可获得 4 小时 RTX 4090 + 5 小时 CPU 的免费时长!

HyperAI超神经总专属邀请链接(直接复制到浏览器打开):

openbayes.com/console/sig...

  1. 等待分配资源,首次克隆需等待 2 分钟左右的时间。当状态变为「运行中」后,点击「API 地址」旁边的跳转箭头,即可跳转至 Demo 页面。请注意,用户需在实名认证后才能使用 API 地址访问功能。

效果展示

  1. 进入 Demo 页面后,首先在「Identity Image」处上传包含人脸的照片,然后输入 Prompt,并在「Model Version」处选择模型版本,这里默认使用「aes_stage2」以获得更好的图文对齐和生成效果,如需更高的 ID 相似度,请尝试「sim_stage1」。「Control ImageOptional」处可上传人脸的控制图片,模型会提取 5 个面部关键点来控制生成,非必要项。最后点击「Generate」生成图像。
  1. 此处上传了一张 Yann Lecun 的照片,可以看到生成效果还是不错的。

*prompt:A sophisticated gentleman exuding confidence. He is dressed in a 1990s brown plaid jacket with a high collar, paired with a dark grey turtleneck. His trousers are tailored and charcoal in color, complemented by a sleek leather belt. The background showcases an elegant library with bookshelves, a marble fireplace, and warm lighting, creating a refined and cozy atmosphere. His relaxed posture and casual hand-in-pocket stance add to his composed and stylish demeanor

以上就是 HyperAI超神经本期为大家推荐的教程,快来上手亲自体验吧!

教程地址go.hyper.ai/xQnpS

相关推荐
若丶相见9 分钟前
AI 大模型零基础知识扫盲
人工智能
猿人谷1 小时前
不只是 CPU 阈值:STAR 如何用 GAT + Transformer 做容器级自动扩缩容?
人工智能·算法
说了很好2 小时前
PyTorch从零搭建DDPM:时间嵌入+UNet网络+扩散调度完整复现
人工智能
Bigfish_coding2 小时前
前端转agent-【python】-06 长期记忆(向量数据库 + 嵌入)
人工智能
小林ixn2 小时前
别再手写Prompt了!用AI Loop实现自动化自我迭代,效率提升10倍
人工智能·自动化运维
说了很好2 小时前
逐行注释DDPM源码:正向加噪、逆向去噪、MSE损失全流程复现
人工智能
Dilee3 小时前
Spring AI 1.1.7 接入 MCP:Filesystem Server 最小 Demo
人工智能·后端
Token炼金师3 小时前
大模型推理超参数原理详解
人工智能
Token炼金师3 小时前
大模型训练超参数:从Loss曲面到收敛策略的底层逻辑
人工智能
后端小肥肠3 小时前
Skill 囤了一堆却用不起来?我用 Codex 写了个整理神器
人工智能·agent