3D 生成重建008-zero123让扩散模型了解空间信息zero-shot 单图生3d

3D 生成重建008-zero123让扩散模型了解空间信息zero-shot 单图生3d


文章目录

    • 0
    • [0 论文工作](#0 论文工作)
    • [1 论文方法](#1 论文方法)
      • [1.1 条件生成微调](#1.1 条件生成微调)
      • [1.2 维护3d表示](#1.2 维护3d表示)
    • [2 效果](#2 效果)

0

0 论文工作

之前分享的工作主要尝试是从一个pre-trained 文生图的diffusion模型中去蒸馏知识,从而去维护一个3d的表示形式。这种方法固然能够进行一个文生3d的任务,但是一个比较重要的问题就是细节确实,细节问题一方面和分辨率有关系,另外一个方面可能和通过蒸馏去强势维护一个3d表示有关,当视图之间一致性存在差异的时候,势必会造成通过均值的形式进行表达,maybe这也是细节模糊的一个因素。

zero-1-to-3,是一个单图生成3d的任务。核心的思想就是在一个大型的3d数据集objaverse上对一个扩散模型进行微调,从而将3d数据集中视角相关的信息注入到2d的扩散模型,让扩散模型能够生成不同视角的图像。相比2d数据集,这个3d数据集中的数据量已经很小了,但是这依然是一个很消耗资源的任务。

参考
zero123

1 论文方法

1.1 条件生成微调

如上图所示 ,论文的核心贡献是尝试优化了一个latent diffusion模型,将原图和视角信息作为输入进行训练。简单的理解可以拿congtrolnet做对比,controlnet允许轮廓,深度,法线等条件作为输入,不同的是zero123是用原图和相机信息联合起来作为输入。

1.2 维护3d表示

在这个地方他采用的SJC的那一套策略去优化nerfdreamfusion and SJC中提到扰动平均得分策略。

2 效果

相关推荐
cd_949217214 分钟前
哪些AI纹理生成工具适合专业3D角色制作?
人工智能·3d
Profile排查笔记4 分钟前
指纹浏览器怎么设置 IP?代理配置、检测与排错流程
前端·人工智能·后端·自动化
冬奇Lab6 分钟前
Code Agent 解剖(13):Harness 设计之三——工具执行管道
人工智能
动物园猫37 分钟前
行人细分目标检测数据集:3类别、4,000张图像 | 目标检测
人工智能·目标检测·计算机视觉
船厂电气自动化ai大模型1 小时前
AI大模型与数学·第57课 傅里叶全套工具链综合实战:串联级数/连续变换/DFT/FFT,图像、音频、扩散模型完整例题
数据结构·人工智能·深度学习·算法·机器学习
v:ychya20181 小时前
2026 外贸 GEO 实操:4 步让独立站被 ChatGPT 优先引用
人工智能·chatgpt
cd_949217211 小时前
角色模型用AI生成纹理靠谱吗,能直接用于游戏吗?
人工智能·游戏
YOLO数据集集合1 小时前
车牌目标检测数据集 | 车牌检测 智能交通 车辆识别 目标检测8003期
人工智能·目标检测·计算机视觉·车牌检测·非机动车车牌
IT_陈寒1 小时前
SpringBoot自动配置失效?你可能漏了这个小开关
前端·人工智能·后端
磁场转动100万匹1 小时前
OpenCV 答题卡识别判卷实战:从图像预处理到自动评分
人工智能·opencv·计算机视觉