Make-It-3D: High-Fidelity 3D Creation from A Single Image with Diffusion Prior - 专知论文

会员服务 ·

0

3D · 高保真 · 模型转换 · 辐射场 · 神经辐射场 ·

2023 年 3 月 24 日

Make-It-3D: High-Fidelity 3D Creation from A Single Image with Diffusion Prior

翻译：Make-It-3D：基于扩散先验的单张图像高保真三维创建

Junshu Tang,Tengfei Wang,Bo Zhang,Ting Zhang,Ran Yi,Lizhuang Ma,Dong Chen

from arxiv, Project page: https://make-it-3d.github.io/

In this work, we investigate the problem of creating high-fidelity 3D content from only a single image. This is inherently challenging: it essentially involves estimating the underlying 3D geometry while simultaneously hallucinating unseen textures. To address this challenge, we leverage prior knowledge from a well-trained 2D diffusion model to act as 3D-aware supervision for 3D creation. Our approach, Make-It-3D, employs a two-stage optimization pipeline: the first stage optimizes a neural radiance field by incorporating constraints from the reference image at the frontal view and diffusion prior at novel views; the second stage transforms the coarse model into textured point clouds and further elevates the realism with diffusion prior while leveraging the high-quality textures from the reference image. Extensive experiments demonstrate that our method outperforms prior works by a large margin, resulting in faithful reconstructions and impressive visual quality. Our method presents the first attempt to achieve high-quality 3D creation from a single image for general objects and enables various applications such as text-to-3D creation and texture editing.

翻译：本文研究仅从单张图像创建高保真三维内容的问题。该任务本质上具有挑战性：它需要同时估计底层三维几何结构并生成未见纹理。为应对这一挑战，我们利用预训练的二维扩散模型中的先验知识，将其作为三维感知监督用于三维创建。我们的方法Make-It-3D采用两阶段优化流程：第一阶段通过在正视图上约束参考图像、在新视图上利用扩散先验来优化神经辐射场；第二阶段将粗模型转化为带纹理的点云，并在利用参考图像高质量纹理的同时，借助扩散先验进一步提升真实感。大量实验表明，我们的方法在忠实重建和视觉质量方面显著优于现有方法。该方案首次实现了针对通用物体从单张图像进行高质量三维创建，并支持文本到三维生成、纹理编辑等多种应用。

0

相关内容

3D是英文“Three Dimensions”的简称，中文是指三维、三个维度、三个坐标，即有长、有宽、有高，换句话说，就是立体的，是相对于只有长和宽的平面（2D）而言。

CVPR 2023 | GFPose: 在梯度场中编码三维人体姿态先验

CVPR 2023 | GFPose: 在梯度场中编码三维人体姿态先验

专知会员服务

19+阅读 · 2023年3月25日

港科大陈启峰博士：AIGC的现状与展望

港科大陈启峰博士：AIGC的现状与展望

专知会员服务

78+阅读 · 2023年1月17日

用于分子Linker设计的等变3D条件扩散模型

用于分子Linker设计的等变3D条件扩散模型

专知会员服务

6+阅读 · 2022年10月24日

【CVPR 2022】未知损坏的一体化图像恢复,All-In-One Image Restoration for Unknown Corruption

【CVPR 2022】未知损坏的一体化图像恢复,All-In-One Image Restoration for Unknown Corruption

专知会员服务

17+阅读 · 2022年3月28日

【CVPR 2022】可控图像合成与编辑的合成生成先验学习，SemanticStyleGAN: Learning Compositonal Generative Priors for Controllable Image Synthesis and Editing

【CVPR 2022】可控图像合成与编辑的合成生成先验学习，SemanticStyleGAN: Learning Compositonal Generative Priors for Controllable Image Synthesis and Editing

专知会员服务

23+阅读 · 2022年3月3日

【CVPR2021】GAN人脸预训练模型

【CVPR2021】GAN人脸预训练模型

专知会员服务

24+阅读 · 2021年4月10日

【CVPR2020-英伟达】从图像集合中学习自监督视点，Self-Supervised Viewpoint Learning From Image Collections

【CVPR2020-英伟达】从图像集合中学习自监督视点，Self-Supervised Viewpoint Learning From Image Collections

专知会员服务

24+阅读 · 2020年4月4日

Google 发布图片配对基准及挑战：从系列图像重建三维物体和建筑物

Google 发布图片配对基准及挑战：从系列图像重建三维物体和建筑物

专知会员服务

40+阅读 · 2020年4月4日

【香港中文大学-CVPR2020】Rotate-and-Render: Unsupervised Photorealistic Face Rotation from Single-View Images

【香港中文大学-CVPR2020】Rotate-and-Render: Unsupervised Photorealistic Face Rotation from Single-View Images

专知会员服务

22+阅读 · 2020年3月18日

【ICIP 2019 Tutorials】图像到图像的转换（Image-to-Image Translation）,英伟达研究员Ming-Yu Liu

【ICIP 2019 Tutorials】图像到图像的转换（Image-to-Image Translation）,英伟达研究员Ming-Yu Liu

专知会员服务

27+阅读 · 2019年8月10日

7 Papers & Radios | IJCAI 2022杰出论文；苹果2D GAN转3D

7 Papers & Radios | IJCAI 2022杰出论文；苹果2D GAN转3D

机器之心

0+阅读 · 2022年7月31日

Transferring Knowledge across Learning Processes

Transferring Knowledge across Learning Processes

CreateAMind

29+阅读 · 2019年5月18日

人脸专集4 | 遮挡、光照等因素的人脸关键点检测

人脸专集4 | 遮挡、光照等因素的人脸关键点检测

计算机视觉战队

29+阅读 · 2019年4月11日

逆强化学习-学习人先验的动机

逆强化学习-学习人先验的动机

CreateAMind

16+阅读 · 2019年1月18日

强化学习的Unsupervised Meta-Learning

强化学习的Unsupervised Meta-Learning

CreateAMind

18+阅读 · 2019年1月7日

Unsupervised Learning via Meta-Learning

Unsupervised Learning via Meta-Learning

CreateAMind

44+阅读 · 2019年1月3日

【论文推荐】最新六篇对抗自编码器相关论文—多尺度网络节点表示、生成对抗自编码、逆映射、Wasserstein、条件对抗、去噪

【论文推荐】最新六篇对抗自编码器相关论文—多尺度网络节点表示、生成对抗自编码、逆映射、Wasserstein、条件对抗、去噪

专知

20+阅读 · 2018年4月7日

【论文推荐】最新6篇生成式对抗网络（GAN）相关论文—半监督对抗学习、行人再识别、代表性特征、高分辨率深度卷积、自监督、超分辨

【论文推荐】最新6篇生成式对抗网络（GAN）相关论文—半监督对抗学习、行人再识别、代表性特征、高分辨率深度卷积、自监督、超分辨

专知

10+阅读 · 2018年2月1日

最新5篇生成对抗网络相关论文推荐—FusedGAN、DeblurGAN、AdvGAN、CipherGAN、MMD GANS

最新5篇生成对抗网络相关论文推荐—FusedGAN、DeblurGAN、AdvGAN、CipherGAN、MMD GANS

专知

23+阅读 · 2018年1月18日

MoCoGAN 分解运动和内容的视频生成

MoCoGAN 分解运动和内容的视频生成

CreateAMind

18+阅读 · 2017年10月21日

基于深度学习的多尺度本质图像提取方法

国家自然科学基金

5+阅读 · 2015年12月31日

肝癌相关巨噬细胞外泌体中lncRNA的研究

国家自然科学基金

0+阅读 · 2015年12月31日

miR-125b靶向调节HK2在骨肉瘤细胞糖酵解、增殖与转移中的作用及机制研究

国家自然科学基金

0+阅读 · 2015年12月31日

具有3D空间辨识力的视觉显著计算模型研究

国家自然科学基金

2+阅读 · 2014年12月31日

生物医学图像重建中的数学模型与计算方法研究

国家自然科学基金

1+阅读 · 2013年12月31日

基于全脸统计学模型和回归器的对遮挡鲁棒的三维人脸特征点定位方法研究

国家自然科学基金

0+阅读 · 2013年12月31日

基于正交图像矩的不完全投影数据CT图像重建研究

国家自然科学基金

0+阅读 · 2012年12月31日

面向服务机器人的3D场景理解方法研究

国家自然科学基金

1+阅读 · 2012年12月31日

基于众源影像的三维街景模型增强

国家自然科学基金

0+阅读 · 2012年12月31日

基于非局部平均方法的图像复原研究

国家自然科学基金

0+阅读 · 2011年12月31日

Make-An-Animation: Large-Scale Text-conditional 3D Human Motion Generation

Make-An-Animation: Large-Scale Text-conditional 3D Human Motion Generation

Arxiv

0+阅读 · 2023年5月16日

FitMe: Deep Photorealistic 3D Morphable Model Avatars

Arxiv

0+阅读 · 2023年5月16日

DualGenerator: Information Interaction-based Generative Network for Point Cloud Completion

Arxiv

0+阅读 · 2023年5月16日

Bridging the Domain Gap: Self-Supervised 3D Scene Understanding with Foundation Models

Arxiv

0+阅读 · 2023年5月15日

Understanding and Bridging the Modality Gap for Speech Translation

Arxiv

0+阅读 · 2023年5月15日

Neural Face Rigging for Animating and Retargeting Facial Meshes in the Wild

Arxiv

0+阅读 · 2023年5月15日

NeuralField-LDM: Scene Generation with Hierarchical Latent Diffusion Models

Arxiv

43+阅读 · 2023年4月19日

NeuroFluid: Fluid Dynamics Grounding with Particle-Driven Neural Radiance Fields

Arxiv

15+阅读 · 2022年3月3日

3D Hand Shape and Pose Estimation from a Single RGB Image

3D Hand Shape and Pose Estimation from a Single RGB Image

Arxiv

17+阅读 · 2019年3月3日

Learning Implicit Fields for Generative Shape Modeling

Learning Implicit Fields for Generative Shape Modeling

Arxiv

11+阅读 · 2018年12月6日

VIP会员

文章信息

相关主题

神经辐射场

最新内容

ICML 2026 | 多任务贝叶斯上下文学习：让 Transformer 在测试时显式适应新先验

ICML 2026 | 多任务贝叶斯上下文学习：让 Transformer 在测试时显式适应新先验

专知会员服务

3+阅读 · 6月19日

ACL 2026综述 | 大规模手语数据集：资源、基准与标注标准

ACL 2026综述 | 大规模手语数据集：资源、基准与标注标准

专知会员服务

5+阅读 · 6月19日

ICML 2026 Spotlight | SmoothSMoE：解析稀疏 MoE 路由不连续

ICML 2026 Spotlight | SmoothSMoE：解析稀疏 MoE 路由不连续

专知会员服务

6+阅读 · 6月18日

综述 | 周期表视角下的大模型推理：范式、方法与失败模式

综述 | 周期表视角下的大模型推理：范式、方法与失败模式

专知会员服务

7+阅读 · 6月18日

《廉价自杀式无人机战争的军事战略影响：乌克兰和伊朗案例研究》

《廉价自杀式无人机战争的军事战略影响：乌克兰和伊朗案例研究》

专知会员服务

11+阅读 · 6月18日

《面向反无人机作战的联邦式可解释射频–光电/红外情报融合：边缘人工智能优化、电子战韧性及分布式监视验证》

《面向反无人机作战的联邦式可解释射频–光电/红外情报融合：边缘人工智能优化、电子战韧性及分布式监视验证》

专知会员服务

10+阅读 · 6月18日

ICML 2026 | FR3D：解耦自车运动的未来动态三维重建世界模型

ICML 2026 | FR3D：解耦自车运动的未来动态三维重建世界模型

专知会员服务

7+阅读 · 6月17日

【伯克利博士论文】迈向可扩展与自我演进的大语言模型智能体

【伯克利博士论文】迈向可扩展与自我演进的大语言模型智能体

专知会员服务

11+阅读 · 6月17日

学习数据的几何：形状空间分析数学综述

学习数据的几何：形状空间分析数学综述

专知会员服务

7+阅读 · 6月17日

《现代防空系统综述：架构、传感器、拦截器及新兴威胁环境对基础设施受限防御环境的影响》2026最新长综述

《现代防空系统综述：架构、传感器、拦截器及新兴威胁环境对基础设施受限防御环境的影响》2026最新长综述

专知会员服务

15+阅读 · 6月17日

定向能反无人机系统最新发展动态

定向能反无人机系统最新发展动态

专知会员服务

8+阅读 · 6月17日

从燃煤战舰到算法战争：水面指挥的永恒要求

从燃煤战舰到算法战争：水面指挥的永恒要求

专知会员服务

6+阅读 · 6月17日

《短程弹道再入飞行器拦截时间中的一项异常现象》

《短程弹道再入飞行器拦截时间中的一项异常现象》

专知会员服务

8+阅读 · 6月17日

《基于回归方法与任务上下文的对抗环境动态战术网络报文优先级排序》

《基于回归方法与任务上下文的对抗环境动态战术网络报文优先级排序》

专知会员服务

8+阅读 · 6月17日

美智库《战术级指挥控制的迫切要求：构建弹性机动式指挥控制网络》报告

美智库《战术级指挥控制的迫切要求：构建弹性机动式指挥控制网络》报告

专知会员服务

10+阅读 · 6月17日

相关VIP内容

CVPR 2023 | GFPose: 在梯度场中编码三维人体姿态先验

CVPR 2023 | GFPose: 在梯度场中编码三维人体姿态先验

专知会员服务

19+阅读 · 2023年3月25日

港科大陈启峰博士：AIGC的现状与展望

港科大陈启峰博士：AIGC的现状与展望

专知会员服务

78+阅读 · 2023年1月17日

用于分子Linker设计的等变3D条件扩散模型

用于分子Linker设计的等变3D条件扩散模型

专知会员服务

6+阅读 · 2022年10月24日

【CVPR 2022】未知损坏的一体化图像恢复,All-In-One Image Restoration for Unknown Corruption

【CVPR 2022】未知损坏的一体化图像恢复,All-In-One Image Restoration for Unknown Corruption

专知会员服务

17+阅读 · 2022年3月28日

【CVPR 2022】可控图像合成与编辑的合成生成先验学习，SemanticStyleGAN: Learning Compositonal Generative Priors for Controllable Image Synthesis and Editing

【CVPR 2022】可控图像合成与编辑的合成生成先验学习，SemanticStyleGAN: Learning Compositonal Generative Priors for Controllable Image Synthesis and Editing

专知会员服务

23+阅读 · 2022年3月3日

【CVPR2021】GAN人脸预训练模型

【CVPR2021】GAN人脸预训练模型

专知会员服务

24+阅读 · 2021年4月10日

【CVPR2020-英伟达】从图像集合中学习自监督视点，Self-Supervised Viewpoint Learning From Image Collections

【CVPR2020-英伟达】从图像集合中学习自监督视点，Self-Supervised Viewpoint Learning From Image Collections

专知会员服务

24+阅读 · 2020年4月4日

Google 发布图片配对基准及挑战：从系列图像重建三维物体和建筑物

Google 发布图片配对基准及挑战：从系列图像重建三维物体和建筑物

专知会员服务

40+阅读 · 2020年4月4日

【香港中文大学-CVPR2020】Rotate-and-Render: Unsupervised Photorealistic Face Rotation from Single-View Images

【香港中文大学-CVPR2020】Rotate-and-Render: Unsupervised Photorealistic Face Rotation from Single-View Images

专知会员服务

22+阅读 · 2020年3月18日

【ICIP 2019 Tutorials】图像到图像的转换（Image-to-Image Translation）,英伟达研究员Ming-Yu Liu

【ICIP 2019 Tutorials】图像到图像的转换（Image-to-Image Translation）,英伟达研究员Ming-Yu Liu

专知会员服务

27+阅读 · 2019年8月10日

热门VIP内容

开通专知VIP会员享更多权益服务

ACL 2026综述 | 大规模手语数据集：资源、基准与标注标准

综述 | 周期表视角下的大模型推理：范式、方法与失败模式

ICML 2026 | 多任务贝叶斯上下文学习：让 Transformer 在测试时显式适应新先验

ICML 2026 Spotlight | SmoothSMoE：解析稀疏 MoE 路由不连续

相关资讯

7 Papers & Radios | IJCAI 2022杰出论文；苹果2D GAN转3D

7 Papers & Radios | IJCAI 2022杰出论文；苹果2D GAN转3D

机器之心

0+阅读 · 2022年7月31日

Transferring Knowledge across Learning Processes

Transferring Knowledge across Learning Processes

CreateAMind

29+阅读 · 2019年5月18日

人脸专集4 | 遮挡、光照等因素的人脸关键点检测

人脸专集4 | 遮挡、光照等因素的人脸关键点检测

计算机视觉战队

29+阅读 · 2019年4月11日

逆强化学习-学习人先验的动机

逆强化学习-学习人先验的动机

CreateAMind

16+阅读 · 2019年1月18日

强化学习的Unsupervised Meta-Learning

强化学习的Unsupervised Meta-Learning

CreateAMind

18+阅读 · 2019年1月7日

Unsupervised Learning via Meta-Learning

Unsupervised Learning via Meta-Learning

CreateAMind

44+阅读 · 2019年1月3日

【论文推荐】最新六篇对抗自编码器相关论文—多尺度网络节点表示、生成对抗自编码、逆映射、Wasserstein、条件对抗、去噪

【论文推荐】最新六篇对抗自编码器相关论文—多尺度网络节点表示、生成对抗自编码、逆映射、Wasserstein、条件对抗、去噪

专知

20+阅读 · 2018年4月7日

【论文推荐】最新6篇生成式对抗网络（GAN）相关论文—半监督对抗学习、行人再识别、代表性特征、高分辨率深度卷积、自监督、超分辨

【论文推荐】最新6篇生成式对抗网络（GAN）相关论文—半监督对抗学习、行人再识别、代表性特征、高分辨率深度卷积、自监督、超分辨

专知

10+阅读 · 2018年2月1日

最新5篇生成对抗网络相关论文推荐—FusedGAN、DeblurGAN、AdvGAN、CipherGAN、MMD GANS

最新5篇生成对抗网络相关论文推荐—FusedGAN、DeblurGAN、AdvGAN、CipherGAN、MMD GANS

专知

23+阅读 · 2018年1月18日

MoCoGAN 分解运动和内容的视频生成

MoCoGAN 分解运动和内容的视频生成

CreateAMind

18+阅读 · 2017年10月21日

相关论文

Make-An-Animation: Large-Scale Text-conditional 3D Human Motion Generation

Make-An-Animation: Large-Scale Text-conditional 3D Human Motion Generation

Arxiv

0+阅读 · 2023年5月16日

FitMe: Deep Photorealistic 3D Morphable Model Avatars

Arxiv

0+阅读 · 2023年5月16日

DualGenerator: Information Interaction-based Generative Network for Point Cloud Completion

Arxiv

0+阅读 · 2023年5月16日

Bridging the Domain Gap: Self-Supervised 3D Scene Understanding with Foundation Models

Arxiv

0+阅读 · 2023年5月15日

Understanding and Bridging the Modality Gap for Speech Translation

Arxiv

0+阅读 · 2023年5月15日

Neural Face Rigging for Animating and Retargeting Facial Meshes in the Wild

Arxiv

0+阅读 · 2023年5月15日

NeuralField-LDM: Scene Generation with Hierarchical Latent Diffusion Models

Arxiv

43+阅读 · 2023年4月19日

NeuroFluid: Fluid Dynamics Grounding with Particle-Driven Neural Radiance Fields

Arxiv

15+阅读 · 2022年3月3日

3D Hand Shape and Pose Estimation from a Single RGB Image

3D Hand Shape and Pose Estimation from a Single RGB Image

Arxiv

17+阅读 · 2019年3月3日

Learning Implicit Fields for Generative Shape Modeling

Learning Implicit Fields for Generative Shape Modeling

Arxiv

11+阅读 · 2018年12月6日

相关基金

基于深度学习的多尺度本质图像提取方法

国家自然科学基金

5+阅读 · 2015年12月31日

肝癌相关巨噬细胞外泌体中lncRNA的研究

国家自然科学基金

0+阅读 · 2015年12月31日

miR-125b靶向调节HK2在骨肉瘤细胞糖酵解、增殖与转移中的作用及机制研究

国家自然科学基金

0+阅读 · 2015年12月31日

具有3D空间辨识力的视觉显著计算模型研究

国家自然科学基金

2+阅读 · 2014年12月31日

生物医学图像重建中的数学模型与计算方法研究

国家自然科学基金

1+阅读 · 2013年12月31日

基于全脸统计学模型和回归器的对遮挡鲁棒的三维人脸特征点定位方法研究

国家自然科学基金

0+阅读 · 2013年12月31日

基于正交图像矩的不完全投影数据CT图像重建研究

国家自然科学基金

0+阅读 · 2012年12月31日

面向服务机器人的3D场景理解方法研究

国家自然科学基金

1+阅读 · 2012年12月31日

基于众源影像的三维街景模型增强

国家自然科学基金

0+阅读 · 2012年12月31日

基于非局部平均方法的图像复原研究

国家自然科学基金

0+阅读 · 2011年12月31日

微信扫码咨询专知VIP会员