A growing curation of Text-to-3D, Diffusion-to-3D works.
TeX
603
446 commits
updated Sep 23, 2026
The first curated list of Text-to-3D and Diffusion-to-3D research, heavily inspired by awesome-NeRF.
This README is intended to work as a fast research index:
citation points to BibTeX, site points to the project page, code points to the implementation when publicVoxelTTO: Voxel-Aligned Feed-Forward 3D Gaussian Splatting with Test-Time Optimization, Yibin Zhao et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
PhGS: Post-Hoc Pruning and Refinement of Single-View Feed-Forward 3D Gaussian Reconstructions, Rinto Yagawa et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
IRIS: Implicit Rendering Matters for Pose-Free Novel View Synthesis, Wenyu Li et al., ACM MM 2026 | citation | site | code | ▲ citation count: 0
3D Point Splatting for mmWave Radar Novel View Synthesis, Adnan Armouti et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
ReconPlusGen: Injecting Reconstruction Prior into Multi-view 3D Generation through Noise Inversion and Modulation, Jiarui Liu et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
StreetDiff: Multi-view Street Scenes Generation via Cross-view Consistent Multi-view Stable Diffusion with Structure Prompts, Qi Zhang et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
View-Structured Conformal Prediction for 3D Gaussian Splatting, Junzheng Chu et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
AnimalLift: Reconstructing Animatable 3D Animals from a Single Image by Learning Canonical Shape, Texture, and Fur Maps, Chunyi Sun et al., SIGGRAPH Asia 2026 | citation | site | code | ▲ citation count: 0
FIRE3D: Feed-forward Interactive 3D Scene Reconstruction Within A Minute, Hongchi Xia et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
AVSplat: Dense-View Feed-Forward 3D Gaussian Splatting with Assist-View Preconditioning, Muyu Xu et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
Reflection-aware Generative Novel View Synthesis, GeonU Kim et al., ECCV 2026 | citation | site | code | ▲ citation count: 0
Compact Neural Appearance Models for Efficient Gaussian Splatting, Florian Hahlbohm et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
Zero-Shot Novel Depth Synthesis Using 3D Foundation Models Scene Representations, Denis M. Akola et al., ECCV 2026 | citation | site | code | ▲ citation count: 0
DualDiff3D: Dual Structure-Appearance Diffusion Priors for Reliability-Enhanced 3D Gaussian Splatting, Qian Wang et al., ECCV 2026 | citation | site | code | ▲ citation count: 0
GridFlow: Structured Latent Flow for Seamless City-Scale 3D Point Cloud Generation, Xinyu Wang et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
Dynamic-Robust Photometric-Semantic Reconstruction for Open-Vocabulary 3D Scene Understanding, Boyu Cai et al., ECCV 2026 | citation | site | code | ▲ citation count: 0
LightFuse: Relightable Interactive Gaussian Scene Reconstruction via Multi-Scan Fusion and 2D Gaussian Ray Tracing, Haonan Zhou et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
ReconSplat: Generalizable 3D Scene Reconstruction Beyond Observed Views, Giuseppe Stracquadanio et al., ECCV 2026 | citation | site | code | ▲ citation count: 0
Cross-Platform Benchmark of Neural 3D Reconstruction for Autonomous Laboratory Robots, Yongho Kim et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
Luce: Relightable Gaussians for 3D Asset Generation, Mayank Singh et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
SceneReGen: Generative Reconstruction of 3D Scenes from a Single Image, Zefan Tian et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
NeoWorld-Pro: Programming Interactive Scenes from Monocular Images for Embodied Simulation, Yumeng He et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
ExMesh++: From Multi-View Images to Relightable UV-PBR Mesh Assets via Topology-Adaptive Reconstruction and Decomposition, Chuanjin Fan et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
FixAnything: 3D-Consistent Rendering Refinement via Video Generative Priors, Khiem Vuong et al., ECCV 2026 | citation | site | code | ▲ citation count: 0
TopoSurfel: Closing the Loop between Gaussian Surfels and Meshes for Surface Reconstruction, Chuanjin Fan et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
Block3D: Efficient Text-to-3D Generation via Block-Wise Diffusion, Bowen Cui et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
MultiCube: Compositional 3D Generation With Part-Level Semantic and Spatial Control, Ava Pun et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
View-Adaptive Renderer for View-Consistent 2D-to-3D Generation, U-Chae Jun et al., Multimedia Systems 2026 | citation | site | code | ▲ citation count: 0
FlexSplat: Flexible Feed-Forward 3D Gaussian Splatting without Point Cloud Correspondence, Amir Sabbaghziarani et al., BMVC 2026 | citation | site | code | ▲ citation count: 0
Qwen-3D: A Generalist 3D Vision-Language Model for Spatial Understanding, Lucy Lin et al., ECCV 2026 | citation | site | code | ▲ citation count: 0
Hunyuan3D-Buffalo 1.0: A Unified Multimodal Model for Scalable 3D Generation, Understanding, and Editing, Junliang Ye et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
Meshy T2: Fast Native Mesh Generation with Flow Matching, Jiale Xu et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
Single Image to Textured 3D Object Generation in Frequency Domain: From Theory to Pipeline, Qisen Wang et al., IJCV 2026 | citation | site | code | ▲ citation count: 0
Event3R: Asynchronous-to-Global 3D Reconstruction from Event Camera via Spatial-Temporal Feature Aggregation, Jian Huang et al., IROS 2026 | citation | site | code | ▲ citation count: 0
G$^2$SR: Geometric Methods for Fast and Memory-Efficient Gaussian-based Surface Reconstruction, Dasong Gao et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
Immediate 3D Gaussian Splat Reconstruction of Unordered Input with Global Consistency, Andreas Meuleman et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
MAGiSt3R: Multi-Agent Feed-forward 3D Reconstruction from Monocular RGB Videos, Ziren Gong et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
DiffGI: Differentiable Geometry Images for High-Fidelity Thin-Shell 3D Generation, Eungjune Shim et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
TreeSRNF: Square-Root Normal Fields for Generative Modelling of the Geometric and Structural Variability in Tree-like 3D Objects, Tahmina Khanam et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
ThinkBLOX: 3D Indoor Scene Generation with Progressive Reasoning, Yuan Xiao et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
UniPhysGen: Unified Physical Grounding for Simulation-Ready 3D Assets, Xian Li et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
Glob3R: Global Structure-from-Motion with 3D Foundation Models, Junyuan Deng et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
StereoSplat+: Feed-Forward Stereo Gaussian Splatting with Diffusion-Assisted Progressive Inference, Zihua Liu et al., IROS 2026 | citation | site | code | ▲ citation count: 0
Nexus: Native Mesh Generation with Diffusion, Hanxiao Wang et al., Arxiv 2026 | citation | site | code | ▲ citation count: 1
PixGS: Pixel-Space Diffusion for Direct 3D Gaussian Splat Generation, Duy Cao et al., ECCV 2026 | citation | site | code | ▲ citation count: 0
Printing the Underdetermined: Materializing Multi-solutionness in Figurative Paintings, Yutao Ming et al., PACMCGIT 2026 | citation | site | code | ▲ citation count: 0
UnfoldArt: Zero-Shot Recovery of Full Articulated 3D Objects from Text or Image, Mohamed El Amine Boudjoghra et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
Scenes as Objects, Not Primitives: Instance-Structured 3D Tokenization from Unposed Views, Mijin Yoo et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
Home3D 1.0: A High-Fidelity Image-to-3D Asset Generation System for Interior Design, Yiyun Fei et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
PRISM: Feed-Forward Single-Image 3D Reconstruction via Geometric Warp-Residual Modeling, Zhijie Zheng et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
Thinking in Blender: Staged Executable Inverse Graphics with Vision-Language Models, Guangzhao He et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
VolFill: Single-View Amodal 3D Scene Reconstruction with Volumetric Flow Matching, Tuan Duc Ngo et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
S2MDF: A Plug-And-Play Layer for Intersection-Free Multi-Object Signed Distance Fields, Deniz Sayin Mercadier et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
REST3D: Reconstructing Physically Stable 3D Scenes from a Single Image, Xiaoxuan Ma et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
GenRecon: Bridging Generative Priors for Multi-View 3D Scene Reconstruction, Katharina Schmid et al., Arxiv 2026 | citation | site | code | ▲ citation count: 1
ROAR-3D: Routing Arbitrary Views for High-Fidelity 3D Generation, Hanxiao Sun et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
PhysX-Omni: Unified Simulation-Ready Physical 3D Generation for Rigid, Deformable, and Articulated Objects, Ziang Cao et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
Articraft: An Agentic System for Scalable Articulated 3D Asset Generation, Matt Zhou et al., Arxiv 2026 | citation | site | code | ▲ citation count: 3
DecoRec: Decomposed 3D Scene Reconstruction from Single-View Images via Object-Level Diffusion, Yuhan Ping et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
MV-SAM3D: Adaptive Multi-View Fusion for Layout-Aware 3D Generation, Baicheng Li et al., Arxiv 2026 | citation | site | code | ▲ citation count: 2
RelaxFlow: Text-Driven Amodal 3D Generation, Jiayin Zhu et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
SceneReVis: A Self-Reflective Vision-Grounded Framework for 3D Indoor Scene Synthesis via Multi-turn RL, Yang Zhao et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
RoamScene3D: Immersive Text-to-3D Scene Generation via Adaptive Object-aware Roaming, Jisheng Chu et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
GeoDiff3D: Self-Supervised 3D Scene Generation with Geometry-Constrained 2D Diffusion Guidance, Haozhi Zhu et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
AnchoredDream: Zero-Shot 360{\deg} Indoor Scene Generation from a Single View via Geometric Grounding, Runmao Yao et al., Arxiv 2026 | citation | site | code | ▲ citation count: 1
Vision-as-Inverse-Graphics Agent via Interleaved Multimodal Reasoning, Shaofeng Yin et al., Arxiv 2026 | citation | site | code | ▲ citation count: 5
UltraShape 1.0: High-Fidelity 3D Shape Generation via Scalable Geometric Refinement, Tanghui Jia et al., Arxiv 2025 | citation | site | code | ▲ citation count: 0
Native and Compact Structured Latents for 3D Generation, Jianfeng Xiang et al., Arxiv 2025 | citation | site | code | ▲ citation count: 23
Are We Ready for RL in Text-to-3D Generation? A Progressive Investigation, Yiwen Tang et al., Arxiv 2025 | citation | site | code | ▲ citation count: 2
MeshRipple: Structured Autoregressive Generation of Artist-Meshes, Junkai Lin et al., Arxiv 2025 | citation | site | code | ▲ citation count: 1
SAM 3D: 3Dfy Anything in Images, SAM 3D Team et al., Arxiv 2025 | citation | site | code | ▲ citation count: 15
FreeArt3D: Training-Free Articulated Object Generation using 3D Diffusion, Chuhao Chen et al., Arxiv 2025 | citation | site | code | ▲ citation count: 5
Seed3D 1.0: From Images to High-Fidelity Simulation-Ready 3D Assets, Jiashi Feng et al., Arxiv 2025 | citation | site | code | ▲ citation count: 2
Blended Point Cloud Diffusion for Localized Text-guided Shape Editing}, Etai Sella et al., Arxiv 2025 | citation | site | code | ▲ citation count: 0
FlashWorld: High-quality 3D Scene Generation within Seconds, Jinyang Li et al., Arxiv 2025 | citation | site | code | ▲ citation count: 3
Wonder3D++: Cross-Domain Diffusion for High-Fidelity 3D Generation From a Single Image, Yang, Yuxiao et al., Arxiv 2025 | citation | site | code | ▲ citation count: 0
Lyra: Generative 3D Scene Reconstruction via Video Diffusion Model Self-Distillation, Sherwin Bahmani et al., Arxiv 2025 | citation | site | code | ▲ citation count: 4
Dream3DAvatar: Text-Controlled 3D Avatar Reconstruction from a Single Image, Gaofeng Liu et al., Arxiv 2025 | citation | site | code | ▲ citation count: 0
Hunyuan3D Studio: End-to-End AI Pipeline for Game-Ready 3D Asset Generation, Biwen Lei et al., Arxiv 2025 | citation | site | code | ▲ citation count: 4
MeshCoder: LLM-Powered Structured Mesh Code Generation from Point Clouds, Bingquan Dai et al., Arxiv 2025 | citation | site | code | ▲ citation count: 2
LL3M: Large Language 3D Modelers, Sining Lu et al., Arxiv 2025 | citation | site | code | ▲ citation count: 2
BrepDiff: Single-stage B-rep Diffusion Model, Mingi Lee et al., Arxiv 2025 | citation | site | code | ▲ citation count: 0
PhysX-3D: Physical-Grounded 3D Asset Generation, Giang Cao et al., Arxiv 2025 | citation | site | code | ▲ citation count: 7
LangSplatV2: High-dimensional 3D Language Gaussian Splatting with 450+ FPS, Wanhua Li et al., Arxiv 2025 | citation | site | code | ▲ citation count: 1
LangScene-X: Reconstruct Generalizable 3D Language-Embedded Scenes with TriMap Video Diffusion, Fangfu Liu et al., Arxiv 2025 | citation | site | code | ▲ citation count: 0
Shape-for-Motion: Precise and Consistent Video Editing with 3D Proxy, Yuhao Liu et al., Arxiv 2025 | citation | site | code | ▲ citation count: 0
DeOcc-1-to-3: 3D De-Occlusion from a Single Image via Self-Supervised Multi-View Diffusion, Yansong Qu et al., Arxiv 2025 | citation | site | code | ▲ citation count: 3
Consistent Zero-shot 3D Texture Synthesis Using Geometry-aware Diffusion and Temporal Video Models, Donggoo Kang et al., Arxiv 2025 | citation | site | code | ▲ citation count: 0
EmbodiedGen: Towards a Generative 3D World Engine for Embodied Intelligence, Xinjie Wang et al., Arxiv 2025 | citation | site | code | ▲ citation count: 3
Convolutional Neural Shading for High-Quality 3D Reconstruction from Multi-View Images, Juheon Hwang et al., Multimedia Systems 2025 | citation | site | code | ▲ citation count: 0
ShapeLLM-Omni: A Native Multimodal LLM for 3D Generation and Understanding, Junliang Ye et al., Arxiv 2023 | citation | site | code | ▲ citation count: 7
Direct3D-S2: Gigascale 3D Generation Made Easy with Spatial Sparse Attention, Shuang Wu et al., Arxiv 2025 | citation | site | code | ▲ citation count: 15
Constructing a 3D Town from a Single Image, Kaizhi Zheng et al., Arxiv 2025 | citation | site | code | ▲ citation count: 0
NeuSEditor: From Multi-View Images to Text-Guided Neural Surface Edits, Nail Ibrahimli et al., Arxiv 2025 | citation | site | code | ▲ citation count: 0
Step1X-3D: Towards High-Fidelity and Controllable Generation of Textured 3D Assets, Weiyu Li et al., Arxiv 2025 | citation | site | code | ▲ citation count: 9
Bridging Geometry-Coherent Text-to-3D Generation with Multi-View Diffusion Priors and Gaussian Splatting, Feng Yang et al., Arxiv 2025 | citation | site | code | ▲ citation count: 1
Eye2Eye: A Simple Approach for Monocular-to-Stereo Video Synthesis, Michal Geyer et al., Arxiv 2025 | citation | site | code | ▲ citation count: 0
HoloTime: Taming Video Diffusion Models for Panoramic 4D Scene Generation, Michal Geyer et al., Arxiv 2025 | citation | site | code | ▲ citation count: 0
TesserAct: Learning 4D Embodied World Models, Haoyu Zhen et al., Arxiv 2025 | citation | site | code | ▲ citation count: 0
Art3D: Training-Free 3D Generation from Flat-Colored Illustration, Xiaoyan Cong et al., Arxiv 2025 | citation | site | code | ▲ citation count: 0
Generating 360° Video is What You Need For a 3D Scene, Zhaoyang Zhang et al., SIGGRAPH Asia 2025 | citation | site | code | ▲ citation count: 0
ExScene: Free-View 3D Scene Reconstruction with Gaussian Splatting from a Single Image, Tianyi Gong et al., Arxiv 2025 | citation | site | code | ▲ citation count: 0
MeshCraft: Exploring Efficient and Controllable Mesh Generation with Flow-based DiTs, Xianglong He et al., Arxiv 2025 | citation | site | code | ▲ citation count: 2
Progressive Rendering Distillation: Adapting Stable Diffusion for Instant Text-to-Mesh Generation without 3D Data, Zhiyuan Ma et al., Arxiv 2025 | citation | site | code | ▲ citation count: 0
Stable Virtual Camera: Generative View Synthesis with Diffusion Models, Jensen Zhou et al., Arxiv 2025 | citation | site | code | ▲ citation count: 10
Bolt3D: Generating 3D Scenes in Seconds, Stanislaw Szymanowicz et al., Arxiv 2025 | citation | site | code | ▲ citation count: 10
Amodal3R: Amodal 3D Reconstruction from Occluded 2D Images, Tianhao Wu et al., Arxiv 2025 | citation | site | code | ▲ citation count: 7
PBR3DGen: A VLM-guided Mesh Generation with High-quality PBR Texture, Xiaokang Wei et al., Arxiv 2025 | citation | site | code | ▲ citation count: 0
GaussianIP: Identity-Preserving Realistic 3D Human Generation via Human-Centric Diffusion Prior, Zichen Tang et al., Arxiv 2025 | citation | site | code | ▲ citation count: 0
I2V3D: Controllable image-to-video generation with 3D guidance, Zhiyuan Zhang et al., Arxiv 2025 | citation | site | code | ▲ citation count: 0
Kiss3DGen: Repurposing Image Diffusion Models for 3D Asset Generation, Jiantao Lin et al., Arxiv 2024 | citation | site | code | ▲ citation count: 0
Geometry-Aware Diffusion Models for Multiview Scene Inpainting, Ahmad Salimi et al., Arxiv 2024 | citation | site | code | ▲ citation count: 0
CAST: Component-Aligned 3D Scene Reconstruction from an RGB Image, Zilong Wang et al., Arxiv 2024 | citation | site | code | ▲ citation count: 8
TripoSG: High-Fidelity 3D Shape Synthesis using Large-Scale Rectified Flow Models, Yangguang Li et al., Arxiv 2024 | citation | site | code | ▲ citation count: 29
Joint Reconstruction of Spatially-Coherent and Realistic Clothed Humans and Objects from a Single Image, Ayushi Dutta et al., Arxiv 2024 | citation | site | code | ▲ citation count: 0
ConsistentDreamer: View-Consistent Meshes Through Balanced Multi-View Gaussian Optimization, Onat Şahin et al., Arxiv 2024 | citation | site | code | ▲ citation count: 0
Consistent Flow Distillation for Text-to-3D Generation, Runjie Yan et al., Arxiv 2024 | citation | site | code | ▲ citation count: 1
SPAR3D: Stable Point-Aware Reconstruction of 3D Objects from Single Images, Zixuan Huang et al., Arxiv 2024 | citation | site | code | ▲ citation count: 4
Wonderland: Navigating 3D Scenes from a Single Image, Hanwen Liang Yu et al., Arxiv 2024 | citation | site | code | ▲ citation count: 12
Turbo3D: Ultra-fast Text-to-3D Generation, Hanzhe Hu et al., Arxiv 2024 | citation | site | code | ▲ citation count: 1
Direct and Explicit 3D Generation from a Single Image, Haoyu Wu et al., Arxiv 2024 | citation | site | code | ▲ citation count: 0
Edify 3D: Scalable High-Quality 3D Asset Generation, NVIDIA et al., Arxiv 2024 | citation | site | code | ▲ citation count: 0
DimensionX: Create Any 3D and 4D Scenes from a Single Image with Controllable Video Diffusion, Wenqiang Sun et al., Arxiv 2024 | citation | site | code | ▲ citation count: 15
GaussianAnything: Interactive Point Cloud Latent Diffusion for 3D Generation, Yushi Lan et al., Arxiv 2024 | citation | site | code | ▲ citation count: 4
DreamCraft3D++: Efficient Hierarchical 3D Generation with Multi-Plane Reconstruction Model, Jingxiang Sun et al., Arxiv 2024 | citation | site | code | ▲ citation count: 0
Tex4D: Zero-shot 4D Scene Texturing with Video Diffusion Models, Jiangzhi Bao et al., Arxiv 2024 | citation | site | code | ▲ citation count: 0
SceneCraft: Layout-Guided 3D Scene Generation, Xiuyu Yang et al., Arxiv 2024 | citation | site | code | ▲ citation count: 5
LLaVA-3D: A Simple yet Effective Pathway to Empowering LMMs with 3D-awareness, Chenming Zhu et al., Arxiv 2024 | citation | site | code | ▲ citation count: 0
3DTopia-XL: Scaling High-quality 3D Asset Generation via Primitive Diffusion, Zhaoxi Chen et al., Arxiv 2024 | citation | site | code | ▲ citation count: 20
Phidias: A Generative Model for Creating 3D Content from Text, Image, and 3D Conditions with Reference-Augmented Diffusion, Zhenwei Wang et al., Arxiv 2024 | citation | site | code | ▲ citation count: 6
Hi3D: Pursuing High-Resolution Image-to-3D Generation with Video Diffusion Models, Haibo Yang et al., Arxiv 2024 | citation | site | code | ▲ citation count: 1
MVGaussian: High-Fidelity text-to-3D Content Generation with Multi-View Guidance and Surface Densification, Phu Pham et al., Arxiv 2024 | citation | site | code | ▲ citation count: 0
Geometry Image Diffusion: Fast and Data-Efficient Text-to-3D with Image-Based Surface Representation, Slava Elizarov et al., Arxiv 2024 | citation | site | code | ▲ citation count: 2
MeshFormer: High-Quality Mesh Generation with 3D-Guided Reconstruction Model, Minghua Liu et al., Arxiv 2024 | citation | site | code | ▲ citation count: 5
DreamCouple: Exploring High Quality Text-to-3D Generation Via Rectified Flow, Hangyu Li et al., Arxiv 2024 | citation | site | code | ▲ citation count: 1
DreamInit: A General Framework to Boost 3D GS Initialization for Text-to-3D Generation by Lexical Richness, Lutao Jiang et al., Arxiv 2024 | citation | site | code | ▲ citation count: 2
TexGen: Text-Guided 3D Texture Generation with Multi-view Sampling and Resampling, Dong Huo et al., Arxiv 2024 | citation | site | code | ▲ citation count: 7
Cycle3D: High-quality and Consistent Image-to-3D Generation via Generation-Reconstruction Cycle, Zhenyu Tang et al., Arxiv 2024 | citation | site | code | ▲ citation count: 2
HoloDreamer: Holistic 3D Panoramic World Generation from Text Descriptions, Haiyang Zhou et al., Arxiv 2024 | citation | site | code | ▲ citation count: 1
PlacidDreamer: Advancing Harmony in Text-to-3D Generation, Shuo Huang et al., Arxiv 2024 | citation | site | code | ▲ citation count: 2
RodinHD: High-Fidelity 3D Avatar Generation with Diffusion Models, Bowen Zhang et al., Arxiv 2024 | citation | site | code | ▲ citation count: 2
Meta 3D Gen, Raphael Bensadoun et al., Arxiv 2024 | citation | site | code | ▲ citation count: 0
ScaleDreamer: Scalable Text-to-3D Synthesis with Asynchronous Score Distillation, Zhiyuan Ma et al., ECCV 2024 | citation | site | code | ▲ citation count: 3
HouseCrafter: Lifting Floorplans to 3D Scenes with 2D Diffusion Model, Hieu T. Nguyen et al., Arxiv 2024 | citation | site | code | ▲ citation count: 1
YouDream: Generating Anatomically Controllable Consistent Text-to-3D Animals, Sandeep Mishra et al., Arxiv 2024 | citation | site | code | ▲ citation count: 0
L4GM: Large 4D Gaussian Reconstruction Model, Jiawei Ren et al., Arxiv 2024 | citation | site | code | ▲ citation count: 8
WonderWorld: Interactive 3D Scene Generation from a Single Image, Hong-Xing Yu et al., Arxiv 2024 | citation | site | code | ▲ citation count: 18
Ouroboros3D: Image-to-3D Generation via 3D-aware Recursive Diffusion, Hao Wen et al., Arxiv 2024 | citation | site | code | ▲ citation count: 3
Tetrahedron Splatting for 3D Generation, Chun Gu et al., Arxiv 2024 | citation | site | code | ▲ citation count: 0
CraftsMan: High-fidelity Mesh Generation with 3D Native Generation and Interactive Geometry Refiner, Weiyu Li et al., Arxiv 2024 | citation | site | code | ▲ citation count: 15
LDM: Large Tensorial SDF Model for Textured Mesh Generation, Rengan Xie et al., Arxiv 2024 | citation | site | code | ▲ citation count: 2
Era3D: High-Resolution Multiview Diffusion using Efficient Row-wise Attention, Peng Li et al., Arxiv 2024 | citation | site | code | ▲ citation count: 12
Dreamer XL: Towards High-Resolution Text-to-3D Generation via Trajectory Score Matching, Xingyu Miao et al., Arxiv 2024 | citation | site | code | ▲ citation count: 1
CAT3D: Create Anything in 3D with Multi-View Diffusion Models, Ruiqi Gao et al., Arxiv 2024 | citation | site | code | ▲ citation count: 38
CLIP-GS: CLIP-Informed Gaussian Splatting for Real-time and View-consistent 3D Semantic Understanding, Guibiao Liao et al., Arxiv 2024 | citation | site | code | ▲ citation count: 0
Portrait3D: Text-Guided High-Quality 3D Portrait Generation Using Pyramid Representation and GANs Prior, Yiqian Wu et al., Arxiv 2024 | citation | site | code | ▲ citation count: 2
RealmDreamer: Text-Driven 3D Scene Generation with Inpainting and Depth Diffusion, Jaidev Shriram et al., Arxiv 2024 | citation | site | code | ▲ citation count: 14
InstantMesh: Efficient 3D Mesh Generation from a Single Image with Sparse-view Large Reconstruction Models, Jiale Xu et al., Arxiv 2024 | citation | site | code | ▲ citation count: 49
ComPC: Completing a 3D Point Cloud with 2D Diffusion Priors, Tianxin Huang et al., ICLR 2025 | citation | site | code | ▲ citation count: 0
ComPC: Completing a 3D Point Cloud with 2D Diffusion Priors, Tianxin Huang et al., ICLR 2025 | citation | site | code | ▲ citation count: 0
Hash3D: Training-free Acceleration for 3D Generation, Xingyi Yang et al., Arxiv 2024 | citation | site | code | ▲ citation count: 3
PointInfinity: Resolution-Invariant Point Diffusion Models, Zixuan Huang et al., Arxiv 2024 | citation | site | code | ▲ citation count: 3
The More You See in 2D, the More You Perceive in 3D, Xinyang Han et al., Arxiv 2024 | citation | site | code | ▲ citation count: 0
DreamScene: 3D Gaussian-based Text-to-3D Scene Generation via Formation Pattern Sampling, Haoran Li et al., Arxiv 2025 | citation | site | code | ▲ citation count: 4
GaussianCube: A Structured and Explicit Radiance Representation for 3D Generative Modeling, Bowen Zhang et al., Arxiv 2024 | citation | site | code | ▲ citation count: 3
Gamba: Marry Gaussian Splatting with Mamba for single view 3D reconstruction, Taoran Yi et al., Arxiv 2024 | citation | site | code | ▲ citation count: 2
TC4D: Trajectory-Conditioned Text-to-4D Generation, Sherwin Bahmani et al., Arxiv 2024 | citation | site | code | ▲ citation count: 5
VP3D: Unleashing 2D Visual Prompt for Text-to-3D Generation, Yang Chen et al., Arxiv 2024 | citation | site | code | ▲ citation count: 3
DreamPolisher: Towards High-Quality Text-to-3D Generation via Geometric Diffusion, Yuanze Lin et al., Arxiv 2024 | citation | site | code | ▲ citation count: 3
LATTE3D: Large-scale Amortized Text-To-Enhanced3D Synthesis, Kevin Xie et al., Arxiv 2024 | citation | site | code | ▲ citation count: 11
GRM: Large Gaussian Reconstruction Model for Efficient 3D Reconstruction and Generation, Yinghao Xu et al., Arxiv 2024 | citation | site | code | ▲ citation count: 34
DreamReward: Text-to-3D Generation with Human Preference, Junliang Ye et al., ECCV 2024 | citation | site | code | ▲ citation count: 10
GVGEN: Text-to-3D Generation with Volumetric Representation, Xianglong He et al., Arxiv 2024 | citation | site | code | ▲ citation count: 10
SV3D: Novel Multi-view Synthesis and 3D Generation from a Single Image using Latent Video Diffusion, Vikram Volet et al., Arxiv 2024 | citation | site | code | ▲ citation count: 41
Generic 3D Diffusion Adapter Using Controlled Multi-View Editing, Hansheng Chen et al., Arxiv 2024 | citation | site | code | ▲ citation count: 9
BrightDreamer: Generic 3D Gaussian Generative Framework for Fast Text-to-3D Synthesis, Lutao Jiang et al., Arxiv 2024 | citation | site | code | ▲ citation count: 5
Isotropic3D: Image-to-3D Generation Based on a Single CLIP Embedding, Pengkun Liu et al., Arxiv 2024 | citation | site | code | ▲ citation count: 4
Make-Your-3D: Fast and Consistent Subject-Driven 3D Content Generation Fangfu Liu et al., Arxiv 2024 | citation | site | code | ▲ citation count: 3
Make-Your-3D: Fast and Consistent Subject-Driven 3D Content Generation, Fangfu Liu et al., Arxiv 2024 | citation | site | code | ▲ citation count: 3
V3D: Video Diffusion Models are Effective 3D Generators Zilong Chen et al., Arxiv 2024 | citation | site | code | ▲ citation count: 11
CRM: Single Image to 3D Textured Mesh with Convolutional Reconstruction Model Zhengyi Wang et al., Arxiv 2024 | citation | site | code | ▲ citation count: 40
TripoSR: Fast 3D Object Reconstruction from a Single Image Dmitry Tochilkin et al., Arxiv 2024 | citation | site | code | ▲ citation count: 27
MVD2: Efficient Multiview 3D Reconstruction for Multiview Diffusion, Xin-Yang Zheng et al., Arxiv 2024 | citation | site | code | ▲ citation count: 5
Pushing Auto-regressive Models for 3D Shape Generation at Capacity and Scalability, Xuelin Qian et al., Arxiv 2024 | citation | site | code | ▲ citation count: 0
L3GO: Language Agents with Chain-of-3D-Thoughts for Generating Unconventional Objects, Yutaro Yamada et al., Arxiv 2024 | citation | site | code | ▲ citation count: 1
IM-3D: : Iterative Multiview Diffusion and Reconstruction for High-Quality 3D Generation, Luke Melas-Kyriazi et al., Arxiv 2024 | citation | site | code | ▲ citation count: 13
LGM: Large Multi-View Gaussian Model for High-Resolution 3D Content Creation, Jiaxiang Tang et al., Arxiv 2024 | citation | site | code | ▲ citation count: 83
AToM: Amortized Text-to-Mesh using 2D Diffusion, Guocheng Qian et al., Arxiv 2024 | citation | ▲ citation count: 7
Topology-Aware Latent Diffusion for 3D Shape Generation, Jiangbei Hu et al., Arxiv 2024 | citation | site | code | ▲ citation count: 0
AGG: Amortized Generative 3D Gaussians for Single Image to 3D, Dejia Xu et al., Arxiv 2024 | citation | site | code | ▲ citation count: 10
SteinDreamer: Variance Reduction for Text-to-3D Score Distillation via Stein Identity, Peihao Wang et al., Arxiv 2024 | citation | site | code | ▲ citation count: 5
HarmonyView: Harmonizing Consistency and Diversity in One-Image-to-3D, Sangmin Woo et al., Arxv 2023 | citation | site | code | ▲ citation count: 3
Hyper-VolTran: Fast and Generalizable One-Shot Image to 3D Object Structure via HyperNetworks, Christian Simon et al., Arxv 2023 | citation | site | code | ▲ citation count: 0
Text2Immersion: Generative Immersive Scene with 3D Gaussians, Hao Ouyang et al., Arxiv 2023 | citation | site | code | ▲ citation count: 8
Stable Score Distillation for High-Quality 3D Generation, Boshi Tang et al., Arxiv 2023 | citation | site | code | ▲ citation count: 5
SceneWiz3D: Towards Text-guided 3D Scene Composition, Qihang Zhang et al., CVPR 2024 | citation | site | code | ▲ citation count: 11
CAD: Photorealistic 3D Generation via Adversarial Distillation, Ziyu Wan et al., Arxiv 2023 | citation | site | code | ▲ citation count: 4
EpiDiff: Enhancing Multi-View Synthesis via Localized Epipolar-Constrained Diffusion, Zehuan Huang et al., CVPR 2024 | citation | site | code | ▲ citation count: 7
Text-to-3D Generation with Bidirectional Diffusion using both 2D and 3D priors, Lihe Ding et al., Arxiv 2023 | citation | site | code | ▲ citation count: 5
Inpaint3D: 3D Scene Content Generation using 2D Inpainting Diffusion, Kira Prabhu et al., Arxiv 2023 | citation | site | code | ▲ citation count: 1
StableDreamer: Taming Noisy Score Distillation Sampling for Text-to-3D, Pengsheng Guo et al., Arxiv 2023 | citation | site | code | ▲ citation count: 1
X-Dreamer: Creating High-quality 3D Content by Bridging the Domain Gap Between Text-to-2D and Text-to-3D Generation, Yiwei Ma et al., Arxiv 2023 | citation | site | code | ▲ citation count: 2
Adversarial Diffusion Distillation, Axel Sauer et al., Arxiv 2023 | citation | site | code | ▲ citation count: 4
DreamPropeller: Supercharge Text-to-3D Generation with Parallel Sampling, Linqi Zhou et al., Arxiv 2023| citation | site | code | ▲ citation count: 3
RichDreamer: A Generalizable Normal-Depth Diffusion Model for Detail Richness in Text-to-3D, Lingteng Qiu et al., Arxiv 2023 | citation | site | code | ▲ citation count: 25
MeshGPT: Generating Triangle Meshes with Decoder-Only Transformers, Yawar Siddiqui et al., Arxiv 2023| citation | site | code | ▲ citation count: 21
LucidDreamer: Towards High-Fidelity Text-to-3D Generation via Interval Score Matching, Yixun Liang et al., Arxiv 2023 | citation | site | code | ▲ citation count: 41
MetaDreamer: Efficient Text-to-3D Creation With Disentangling Geometry and Texture, Lincong Feng et al., Arxiv 2023 | citation | site | code | ▲ citation count: 0
One-2-3-45++: Fast Single Image to 3D Objects with Consistent Multi-View Generation and 3D Diffusion, Minghua Liu et al., Arxiv 2023 | citation | site | code | ▲ citation count: 38
LRM: Large Reconstruction Model for Single Image to 3D, Yicong Hong et al., Arxiv 2023 | citation | site | code | ▲ citation count: 91
Text-to-3D with classifier score distillation, Xin Yu et al., Arxiv 2023 | citation | site | code | ▲ citation count: 23
HyperFields: Towards Zero-Shot Generation of NeRFs from Text, Sudarshan Babu et al., Arxiv 2023 | citation | site | code | ▲ citation count: 3
Noise-Free Score Distillation, Oren Katzir et al., Arxiv 2023 | citation | site | code | ▲ citation count: 20
DreamCraft3D: Hierarchical 3D Generation with Bootstrapped Diffusion Prior, Jingxiang Sun et al., Arxiv 2023 | citation | site | code | ▲ citation count: 33
Zero123++: a Single Image to Consistent Multi-view Diffusion Base Model, Ruoxi Shi et al., Arxiv 2023 | citation | site | code | ▲ citation count: 62
Enhancing High-Resolution 3D Generation through Pixel-wise Gradient Clipping, Zijie Pan et al., Arxiv 2023 | citation | site | code | ▲ citation count: 3
SweetDreamer: Aligning Geometric Priors in 2D Diffusion for Consistent Text-to-3D, Weiyu Li et al., Arxiv 2023 | citation | site | code | ▲ citation count: 32
GaussianDreamer: Fast Generation from Text to 3D Gaussian Splatting with Point Cloud Priors,Taoran Yi et al., Arxiv 2023 | citation | site | code | ▲ citation count: 35
Consistent123: One Image to Highly Consistent 3D Asset Using Case-Aware Diffusion Priors, Yukang Lin et al., Arxiv 2023 | citation | site | code | ▲ citation count: 13
DreamGaussian: Generative Gaussian Splatting for Efficient 3D Content Creation, Jiaxiang Tang et al., Arxiv 2023 | citation | site | code | ▲ citation count: 91
Text-to-3D using Gaussian Splatting, Zilong Chen et al., Arxiv 2023 | citation | site | code | ▲ citation count: 40
Progressive Text-to-3D Generation for Automatic 3D Prototyping, Han Yi et al., Arxiv 2023 | citation | site | code | ▲ citation count: 2
Large-Vocabulary 3D Diffusion Model with Transformer, Ziang Cao et al., Arxiv 2023 | citation | site | code | ▲ citation count: 10
SyncDreamer: Generating Multiview-consistent Images from a Single-view Image, Yuan Liu et al., Arxiv 2023 | citation | site | code | ▲ citation count: 81
MVDream: Multi-view Diffusion for 3D Generation, Yichun Shi et al., Arxiv 2023 | citation | site | code | ▲ citation count: 128
PointLLM: Empowering Large Language Models to Understand Point Clouds, Xu Runsen et al., Arxiv 2023 | citation | site | code | ▲ citation count: 3
IT3D: Improved Text-to-3D Generation with Explicit View Synthesis, Yiwen Chen et al., Arxiv 2023 | citation | site | code | ▲ citation count: 16
RGB-D-Fusion: Image Conditioned Depth Diffusion of Humanoid Subjects, Sascha Kirch et al., Arxiv 2023 | citation | site | code | ▲ citation count: 0
Points-to-3D: Bridging the Gap between Sparse Points and Shape-Controllable Text-to-3D Generation, Chaohui Yu et al., Arxiv 2023 | citation | site | code | ▲ citation count: 9
Sketch-A-Shape: Zero-Shot Sketch-to-3D Shape Generation, Aditya Sanghi et al., Arxiv 2023 | citation | site | code | ▲ citation count: 1
AutoDecoding Latent 3D Diffusion Models, Evangelos Ntavelis et al., NeurIPS 2023 | citation | site | code | ▲ citation count: 19
MVDiffusion: Enabling Holistic Multi-view Image Generation with Correspondence-Aware Diffusion, Shitao Tang et al., Arxiv 2023 | citation | site | code | ▲ citation count: 29
3D-LLM: Injecting the 3D World into Large Language Models, Yining Hong et al., Arxiv 2023 | citation | site | code | ▲ citation count: 7
Magic123: One Image to High-Quality 3D Object Generation Using Both 2D and 3D Diffusion Priors, Guocheng Qian et al., Arxiv 2023 | citation | site | code | ▲ citation count: 79
Conditional 3D Shape Generation based on Shape-Image-Text Aligned Latent Representation, Zibo Zhao et al., Arxiv 2023 | citation | site | code | ▲ citation count: 25
One-2-3-45: Any Single Image to 3D Mesh in 45 Seconds without Per-Shape Optimization, Minghua Liu et al., Arxiv 2023 | citation | site | code | ▲ citation count: 89
Cap3D: Scalable 3D Captioning with Pretrained Models, Tiange Luo et al., Arxiv 2023 | citation | site | code | ▲ citation count: 19
InstructP2P: Learning to Edit 3D Point Clouds with Text Instructions, Jiale Xu et al., Arxiv 2023 | citation | site | code | ▲ citation count: 1
ATT3D: Amortized Text-to-3D Object Synthesis, Jonathan Lorraine et al., ICCV 2023 | citation | site | code | ▲ citation count: 28
DreamSparse: Escaping from Plato's Cave with 2D Frozen Diffusion Model Given Sparse Views, Paul Yoo et al., Arxiv 2023 | citation | site | code | ▲ citation count: 10
HiFA: High-fidelity Text-to-3D with Advanced Diffusion Guidance, Junzhe Zhu et al., Arxiv 2023 | citation | site | code | ▲ citation count: 17
ProlificDreamer: High-Fidelity and Diverse Text-to-3D Generation with Variational Score Distillation, Zhengyi Wang et al., Arxiv 2023 | citation | site | code | ▲ citation count: 165
Prompt-Free Diffusion: Taking "Text" out of Text-to-Image Diffusion Models, Xingqian Xu et al., Arxiv 2023 | citation | site | code | ▲ citation count: 0
Text2NeRF: Text-Driven 3D Scene Generation with Neural Radiance Fields, Jingbo Zhang et al., Arxiv 2023 | citation | site | code | ▲ citation count: 21
High-fidelity 3D Face Generation from Natural Language Descriptions, Menghua Wu et al., CVPR 2023 | citation | site | code | ▲ citation count: 3
Shap-E: Generating Conditional 3D Implicit Functions, Heewoo Jun et al., Arxiv 2023 | citation | site | code | ▲ citation count: 68
TextMesh: Generation of Realistic 3D Meshes From Text Prompts, Christina Tsalicoglou Liu et al., Arxiv 2023 | citation | site | code | ▲ citation count: 27
Single-Stage Diffusion NeRF: A Unified Approach to 3D Generation and Reconstruction, Hansheng Chen et al., Arxiv 2023 | citation | site | code | ▲ citation count: 28
Re-imagine the Negative Prompt Algorithm: Transform 2D Diffusion into 3D, alleviate Janus problem and Beyond, Mohammadreza Armandpour et al., Arxiv 2023 | citation | site | code | ▲ citation count: 27
Generative Novel View Synthesis with 3D-Aware Diffusion Models, Eric R. Chan et al., Arxiv 2023 | citation | site | code | ▲ citation count: 38
PODIA-3D: Domain Adaptation of 3D Generative Model Across Large Domain Gap Using Pose-Preserved Text-to-Image Diffusion, Gwanghyun Kim et al., ICCV 2023 | citation | site | code | ▲ citation count: 0
3D-aware Image Generation using 2D Diffusion Models, Jianfeng Xiang et al., Arxiv 2023 | citation | site | code | ▲ citation count: 12
Make-It-3D: High-Fidelity 3D Creation from A Single Image with Diffusion Prior, Junshu Tang et al., ICCV 2023 | citation | site | code | ▲ citation count: 75
DreamBooth3D: Subject-Driven Text-to-3D Generation, Amit Raj et al., ICCV 2023 | citation | site | code | ▲ citation count: 39
Text2Room: Extracting Textured 3D Meshes from 2D Text-to-Image Models, Lukas Höllein et al., Arxiv 2023 | citation | site | code | ▲ citation count: 32
Zero-1-to-3: Zero-shot One Image to 3D Object, Ruoshi Liu et al., Arxiv 2023 | citation | site | code | ▲ citation count: 170
3DQD: Generalized Deep 3D Shape Prior via Part-Discretized Diffusion Process, Yuhan Li et al., CVPR 2023 | citation | site | code | ▲ citation count: 3
LERF: Language Embedded Radiance Fields, Justin Kerr et al., Arxiv 2023 | citation | site | code | ▲ citation count: 8
3DFuse: Let 2D Diffusion Model Know 3D-Consistency for Robust Text-to-3D Generation, Junyoung Seo et al., Arxiv 2023 | citation | site | code | ▲ citation count: 32
GECCO: Geometrically-Conditioned Point Diffusion Models, Michał J. Tyszkiewicz et al., ICCV 2023 | citation | site | code | ▲ citation count: 5
Monocular Depth Estimation using Diffusion Models, Saurabh Saxena et al., Arxiv 2023 | citation | site | code | ▲ citation count: 2
DiffusioNeRF: Regularizing Neural Radiance Fields with Denoising Diffusion Models, Jamie Wynn et al., CVPR 2023 | citation | site | code | ▲ citation count: 1
RealFusion: 360° Reconstruction of Any Object from a Single Image, Luke Melas-Kyriazi et al., CVPR 2023 | citation | site | code | ▲ citation count: 54
NerfDiff: Single-image View Synthesis with NeRF-guided Distillation from 3D-aware Diffusion, Jiatao Gu et al., ICML 2023 | citation | site | code | ▲ citation count: 32
TEXTure: Text-Guided Texturing of 3D Shapes, Elad Richardson Chen et al., SIGGRAPH 2023 | citation | site | code | ▲ citation count: 58
SceneScape: Text-Driven Consistent Scene Generation, Rafail Fridman et al., Arxiv 2023 | citation | site | code | ▲ citation count: 20
Dream3D: Zero-Shot Text-to-3D Synthesis Using 3D Shape Prior and Text-to-Image Diffusion Models, Jiale Xu et al., Arxiv 2022 | citation | site | code | ▲ citation count: 27
Point-E: A System for Generating 3D Point Clouds from Complex Prompts, Alex Nichol et al., Arxiv 2022 | citation | site | code | ▲ citation count: 114
SDFusion: Multimodal 3D Shape Completion, Reconstruction, and Generation, Yen-Chi Cheng et al., CVPR 2023 | citation | site | code | ▲ citation count: 46
NeRDi: Single-View NeRF Synthesis with Language-Guided Diffusion as General Image Priors, Congyue Deng et al., CVPR 2023 | citation | site | code | ▲ citation count: 33
SparseFusion: Distilling View-conditioned Diffusion for 3D Reconstruction, Zhizhuo Zho et al., CVPR 2023 | citation | site | code | ▲ citation count: 29
Score Jacobian Chaining: Lifting Pretrained 2D Diffusion Models for 3D Generation, Haochen Wang et al., CVPR 2023 | citation | site | code | ▲ citation count: 122
NeuralLift-360: Lifting An In-the-wild 2D Photo to A 3D Object with 360° Views, Dejia Xu et al., Arxiv 2022 | citation | site | code | ▲ citation count: 30
DATID-3D: Diversity-Preserved Domain Adaptation Using Text-to-Image Diffusion for 3D Generative Model, Gwanghyun Kim et al., CVPR 2023 | citation | site | code | ▲ citation count: 2
Diffusion-SDF: Conditional Generative Modeling of Signed Distance Functions, Gene Chou et al., Arxiv 2023 | citation | site | code | ▲ citation count: 11
Magic3D: High-Resolution Text-to-3D Content Creation, Chen-Hsuan Linet et al., CVPR 2023 | citation | site | code | ▲ citation count: 200
Latent-NeRF for Shape-Guided Generation of 3D Shapes and Textures, Gal Metzer et al., Arxiv 2023 | citation | site | code | ▲ citation count: 99
Novel View Synthesis with Diffusion Models, Daniel Watson et al., Arxiv 2022 | citation | site | code | ▲ citation count: 49
Novel View Synthesis with Diffusion Models, Daniel Watson et al., ICLR 2023 | citation | site | code | ▲ citation count: 49
PureCLIPNERF: Understanding Pure CLIP Guidance for Voxel Grid NeRF Models, Han-Hung Lee et al., Arxiv 2022 | citation | site | code | ▲ citation count: 15
DreamFusion: Text-to-3D using 2D Diffusion, Ben Poole et al., ICLR 2023 | citation | site | code | ▲ citation count: 293
CLIP-Mesh: Generating textured meshes from text using pretrained image-text models, Nasir Khalid et al., Arxiv 2023 | citation | site | code | ▲ citation count: 72
Zero-Shot Text-Guided Object Generation with Dream Fields, Ajay Jain et al., CVPR 2022 | citation | site | code | ▲ citation count: 126
CLIP-Forge: Towards Zero-Shot Text-to-Shape Generation, Aditya Sanghi et al., Arxiv 2021 | citation | site | code | ▲ citation count: 59
LiteTex-GS: Fast and Lightweight Texturing for Gaussian Splatting, Zhiwei Li et al., Pacific Graphics 2026 (Computer Graphics Forum) | citation | site | code | ▲ citation count: 0
Physically Based Rendering in the Latent Space, Vuk Radovanovic et al., Pacific Graphics 2026 (Computer Graphics Forum) | citation | site | code | ▲ citation count: 0
GS-PI: An Optimization-Decoupled Appearance Decomposition Approach for Generating PBR Gaussian Assets, Jieting Xu et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
RelightFormer: Feed-forward Generative Transformer for Multiview Object Relighting, Hejun Wang et al., SIGGRAPH Asia 2026 | citation | site | code | ▲ citation count: 0
PointGT: Simultaneous Geometry and Texture Editing for Point-Based Representations, Yanshu Zhang et al., ECCV 2026 | citation | site | code | ▲ citation count: 0
PoseAdapter: Dual-Stream 2.5D Controllable Image Generation for Complex Multi-Object Scenes, Yufeng Chi et al., ACM MM 2026 | citation | site | code | ▲ citation count: 0
GeoCache: Training-Free Acceleration of Multi-View Texture Diffusion via Geometric Delta Transport, Haotang Li et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
TanGO: Training-Free 3D Editing via Tangent-Space Guidance and Optimization, Siwoo Lim et al., Arxiv 2026 | citation | site | code | ▲ citation count: 1
Dynamic Inverse Rendering for Enhanced Material-Lighting Decomposition, Raza Yunus et al.,
Truncated — view the full README on GitHub.
TeX
87.6%
JavaScript
12.4%
A growing curation of Text-to-3D, Diffusion-to-3D works.
TeX
603
446 commits
updated Sep 23, 2026
The first curated list of Text-to-3D and Diffusion-to-3D research, heavily inspired by awesome-NeRF.
This README is intended to work as a fast research index:
citation points to BibTeX, site points to the project page, code points to the implementation when publicVoxelTTO: Voxel-Aligned Feed-Forward 3D Gaussian Splatting with Test-Time Optimization, Yibin Zhao et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
PhGS: Post-Hoc Pruning and Refinement of Single-View Feed-Forward 3D Gaussian Reconstructions, Rinto Yagawa et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
IRIS: Implicit Rendering Matters for Pose-Free Novel View Synthesis, Wenyu Li et al., ACM MM 2026 | citation | site | code | ▲ citation count: 0
3D Point Splatting for mmWave Radar Novel View Synthesis, Adnan Armouti et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
ReconPlusGen: Injecting Reconstruction Prior into Multi-view 3D Generation through Noise Inversion and Modulation, Jiarui Liu et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
StreetDiff: Multi-view Street Scenes Generation via Cross-view Consistent Multi-view Stable Diffusion with Structure Prompts, Qi Zhang et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
View-Structured Conformal Prediction for 3D Gaussian Splatting, Junzheng Chu et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
AnimalLift: Reconstructing Animatable 3D Animals from a Single Image by Learning Canonical Shape, Texture, and Fur Maps, Chunyi Sun et al., SIGGRAPH Asia 2026 | citation | site | code | ▲ citation count: 0
FIRE3D: Feed-forward Interactive 3D Scene Reconstruction Within A Minute, Hongchi Xia et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
AVSplat: Dense-View Feed-Forward 3D Gaussian Splatting with Assist-View Preconditioning, Muyu Xu et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
Reflection-aware Generative Novel View Synthesis, GeonU Kim et al., ECCV 2026 | citation | site | code | ▲ citation count: 0
Compact Neural Appearance Models for Efficient Gaussian Splatting, Florian Hahlbohm et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
Zero-Shot Novel Depth Synthesis Using 3D Foundation Models Scene Representations, Denis M. Akola et al., ECCV 2026 | citation | site | code | ▲ citation count: 0
DualDiff3D: Dual Structure-Appearance Diffusion Priors for Reliability-Enhanced 3D Gaussian Splatting, Qian Wang et al., ECCV 2026 | citation | site | code | ▲ citation count: 0
GridFlow: Structured Latent Flow for Seamless City-Scale 3D Point Cloud Generation, Xinyu Wang et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
Dynamic-Robust Photometric-Semantic Reconstruction for Open-Vocabulary 3D Scene Understanding, Boyu Cai et al., ECCV 2026 | citation | site | code | ▲ citation count: 0
LightFuse: Relightable Interactive Gaussian Scene Reconstruction via Multi-Scan Fusion and 2D Gaussian Ray Tracing, Haonan Zhou et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
ReconSplat: Generalizable 3D Scene Reconstruction Beyond Observed Views, Giuseppe Stracquadanio et al., ECCV 2026 | citation | site | code | ▲ citation count: 0
Cross-Platform Benchmark of Neural 3D Reconstruction for Autonomous Laboratory Robots, Yongho Kim et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
Luce: Relightable Gaussians for 3D Asset Generation, Mayank Singh et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
SceneReGen: Generative Reconstruction of 3D Scenes from a Single Image, Zefan Tian et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
NeoWorld-Pro: Programming Interactive Scenes from Monocular Images for Embodied Simulation, Yumeng He et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
ExMesh++: From Multi-View Images to Relightable UV-PBR Mesh Assets via Topology-Adaptive Reconstruction and Decomposition, Chuanjin Fan et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
FixAnything: 3D-Consistent Rendering Refinement via Video Generative Priors, Khiem Vuong et al., ECCV 2026 | citation | site | code | ▲ citation count: 0
TopoSurfel: Closing the Loop between Gaussian Surfels and Meshes for Surface Reconstruction, Chuanjin Fan et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
Block3D: Efficient Text-to-3D Generation via Block-Wise Diffusion, Bowen Cui et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
MultiCube: Compositional 3D Generation With Part-Level Semantic and Spatial Control, Ava Pun et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
View-Adaptive Renderer for View-Consistent 2D-to-3D Generation, U-Chae Jun et al., Multimedia Systems 2026 | citation | site | code | ▲ citation count: 0
FlexSplat: Flexible Feed-Forward 3D Gaussian Splatting without Point Cloud Correspondence, Amir Sabbaghziarani et al., BMVC 2026 | citation | site | code | ▲ citation count: 0
Qwen-3D: A Generalist 3D Vision-Language Model for Spatial Understanding, Lucy Lin et al., ECCV 2026 | citation | site | code | ▲ citation count: 0
Hunyuan3D-Buffalo 1.0: A Unified Multimodal Model for Scalable 3D Generation, Understanding, and Editing, Junliang Ye et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
Meshy T2: Fast Native Mesh Generation with Flow Matching, Jiale Xu et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
Single Image to Textured 3D Object Generation in Frequency Domain: From Theory to Pipeline, Qisen Wang et al., IJCV 2026 | citation | site | code | ▲ citation count: 0
Event3R: Asynchronous-to-Global 3D Reconstruction from Event Camera via Spatial-Temporal Feature Aggregation, Jian Huang et al., IROS 2026 | citation | site | code | ▲ citation count: 0
G$^2$SR: Geometric Methods for Fast and Memory-Efficient Gaussian-based Surface Reconstruction, Dasong Gao et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
Immediate 3D Gaussian Splat Reconstruction of Unordered Input with Global Consistency, Andreas Meuleman et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
MAGiSt3R: Multi-Agent Feed-forward 3D Reconstruction from Monocular RGB Videos, Ziren Gong et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
DiffGI: Differentiable Geometry Images for High-Fidelity Thin-Shell 3D Generation, Eungjune Shim et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
TreeSRNF: Square-Root Normal Fields for Generative Modelling of the Geometric and Structural Variability in Tree-like 3D Objects, Tahmina Khanam et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
ThinkBLOX: 3D Indoor Scene Generation with Progressive Reasoning, Yuan Xiao et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
UniPhysGen: Unified Physical Grounding for Simulation-Ready 3D Assets, Xian Li et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
Glob3R: Global Structure-from-Motion with 3D Foundation Models, Junyuan Deng et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
StereoSplat+: Feed-Forward Stereo Gaussian Splatting with Diffusion-Assisted Progressive Inference, Zihua Liu et al., IROS 2026 | citation | site | code | ▲ citation count: 0
Nexus: Native Mesh Generation with Diffusion, Hanxiao Wang et al., Arxiv 2026 | citation | site | code | ▲ citation count: 1
PixGS: Pixel-Space Diffusion for Direct 3D Gaussian Splat Generation, Duy Cao et al., ECCV 2026 | citation | site | code | ▲ citation count: 0
Printing the Underdetermined: Materializing Multi-solutionness in Figurative Paintings, Yutao Ming et al., PACMCGIT 2026 | citation | site | code | ▲ citation count: 0
UnfoldArt: Zero-Shot Recovery of Full Articulated 3D Objects from Text or Image, Mohamed El Amine Boudjoghra et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
Scenes as Objects, Not Primitives: Instance-Structured 3D Tokenization from Unposed Views, Mijin Yoo et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
Home3D 1.0: A High-Fidelity Image-to-3D Asset Generation System for Interior Design, Yiyun Fei et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
PRISM: Feed-Forward Single-Image 3D Reconstruction via Geometric Warp-Residual Modeling, Zhijie Zheng et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
Thinking in Blender: Staged Executable Inverse Graphics with Vision-Language Models, Guangzhao He et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
VolFill: Single-View Amodal 3D Scene Reconstruction with Volumetric Flow Matching, Tuan Duc Ngo et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
S2MDF: A Plug-And-Play Layer for Intersection-Free Multi-Object Signed Distance Fields, Deniz Sayin Mercadier et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
REST3D: Reconstructing Physically Stable 3D Scenes from a Single Image, Xiaoxuan Ma et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
GenRecon: Bridging Generative Priors for Multi-View 3D Scene Reconstruction, Katharina Schmid et al., Arxiv 2026 | citation | site | code | ▲ citation count: 1
ROAR-3D: Routing Arbitrary Views for High-Fidelity 3D Generation, Hanxiao Sun et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
PhysX-Omni: Unified Simulation-Ready Physical 3D Generation for Rigid, Deformable, and Articulated Objects, Ziang Cao et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
Articraft: An Agentic System for Scalable Articulated 3D Asset Generation, Matt Zhou et al., Arxiv 2026 | citation | site | code | ▲ citation count: 3
DecoRec: Decomposed 3D Scene Reconstruction from Single-View Images via Object-Level Diffusion, Yuhan Ping et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
MV-SAM3D: Adaptive Multi-View Fusion for Layout-Aware 3D Generation, Baicheng Li et al., Arxiv 2026 | citation | site | code | ▲ citation count: 2
RelaxFlow: Text-Driven Amodal 3D Generation, Jiayin Zhu et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
SceneReVis: A Self-Reflective Vision-Grounded Framework for 3D Indoor Scene Synthesis via Multi-turn RL, Yang Zhao et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
RoamScene3D: Immersive Text-to-3D Scene Generation via Adaptive Object-aware Roaming, Jisheng Chu et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
GeoDiff3D: Self-Supervised 3D Scene Generation with Geometry-Constrained 2D Diffusion Guidance, Haozhi Zhu et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
AnchoredDream: Zero-Shot 360{\deg} Indoor Scene Generation from a Single View via Geometric Grounding, Runmao Yao et al., Arxiv 2026 | citation | site | code | ▲ citation count: 1
Vision-as-Inverse-Graphics Agent via Interleaved Multimodal Reasoning, Shaofeng Yin et al., Arxiv 2026 | citation | site | code | ▲ citation count: 5
UltraShape 1.0: High-Fidelity 3D Shape Generation via Scalable Geometric Refinement, Tanghui Jia et al., Arxiv 2025 | citation | site | code | ▲ citation count: 0
Native and Compact Structured Latents for 3D Generation, Jianfeng Xiang et al., Arxiv 2025 | citation | site | code | ▲ citation count: 23
Are We Ready for RL in Text-to-3D Generation? A Progressive Investigation, Yiwen Tang et al., Arxiv 2025 | citation | site | code | ▲ citation count: 2
MeshRipple: Structured Autoregressive Generation of Artist-Meshes, Junkai Lin et al., Arxiv 2025 | citation | site | code | ▲ citation count: 1
SAM 3D: 3Dfy Anything in Images, SAM 3D Team et al., Arxiv 2025 | citation | site | code | ▲ citation count: 15
FreeArt3D: Training-Free Articulated Object Generation using 3D Diffusion, Chuhao Chen et al., Arxiv 2025 | citation | site | code | ▲ citation count: 5
Seed3D 1.0: From Images to High-Fidelity Simulation-Ready 3D Assets, Jiashi Feng et al., Arxiv 2025 | citation | site | code | ▲ citation count: 2
Blended Point Cloud Diffusion for Localized Text-guided Shape Editing}, Etai Sella et al., Arxiv 2025 | citation | site | code | ▲ citation count: 0
FlashWorld: High-quality 3D Scene Generation within Seconds, Jinyang Li et al., Arxiv 2025 | citation | site | code | ▲ citation count: 3
Wonder3D++: Cross-Domain Diffusion for High-Fidelity 3D Generation From a Single Image, Yang, Yuxiao et al., Arxiv 2025 | citation | site | code | ▲ citation count: 0
Lyra: Generative 3D Scene Reconstruction via Video Diffusion Model Self-Distillation, Sherwin Bahmani et al., Arxiv 2025 | citation | site | code | ▲ citation count: 4
Dream3DAvatar: Text-Controlled 3D Avatar Reconstruction from a Single Image, Gaofeng Liu et al., Arxiv 2025 | citation | site | code | ▲ citation count: 0
Hunyuan3D Studio: End-to-End AI Pipeline for Game-Ready 3D Asset Generation, Biwen Lei et al., Arxiv 2025 | citation | site | code | ▲ citation count: 4
MeshCoder: LLM-Powered Structured Mesh Code Generation from Point Clouds, Bingquan Dai et al., Arxiv 2025 | citation | site | code | ▲ citation count: 2
LL3M: Large Language 3D Modelers, Sining Lu et al., Arxiv 2025 | citation | site | code | ▲ citation count: 2
BrepDiff: Single-stage B-rep Diffusion Model, Mingi Lee et al., Arxiv 2025 | citation | site | code | ▲ citation count: 0
PhysX-3D: Physical-Grounded 3D Asset Generation, Giang Cao et al., Arxiv 2025 | citation | site | code | ▲ citation count: 7
LangSplatV2: High-dimensional 3D Language Gaussian Splatting with 450+ FPS, Wanhua Li et al., Arxiv 2025 | citation | site | code | ▲ citation count: 1
LangScene-X: Reconstruct Generalizable 3D Language-Embedded Scenes with TriMap Video Diffusion, Fangfu Liu et al., Arxiv 2025 | citation | site | code | ▲ citation count: 0
Shape-for-Motion: Precise and Consistent Video Editing with 3D Proxy, Yuhao Liu et al., Arxiv 2025 | citation | site | code | ▲ citation count: 0
DeOcc-1-to-3: 3D De-Occlusion from a Single Image via Self-Supervised Multi-View Diffusion, Yansong Qu et al., Arxiv 2025 | citation | site | code | ▲ citation count: 3
Consistent Zero-shot 3D Texture Synthesis Using Geometry-aware Diffusion and Temporal Video Models, Donggoo Kang et al., Arxiv 2025 | citation | site | code | ▲ citation count: 0
EmbodiedGen: Towards a Generative 3D World Engine for Embodied Intelligence, Xinjie Wang et al., Arxiv 2025 | citation | site | code | ▲ citation count: 3
Convolutional Neural Shading for High-Quality 3D Reconstruction from Multi-View Images, Juheon Hwang et al., Multimedia Systems 2025 | citation | site | code | ▲ citation count: 0
ShapeLLM-Omni: A Native Multimodal LLM for 3D Generation and Understanding, Junliang Ye et al., Arxiv 2023 | citation | site | code | ▲ citation count: 7
Direct3D-S2: Gigascale 3D Generation Made Easy with Spatial Sparse Attention, Shuang Wu et al., Arxiv 2025 | citation | site | code | ▲ citation count: 15
Constructing a 3D Town from a Single Image, Kaizhi Zheng et al., Arxiv 2025 | citation | site | code | ▲ citation count: 0
NeuSEditor: From Multi-View Images to Text-Guided Neural Surface Edits, Nail Ibrahimli et al., Arxiv 2025 | citation | site | code | ▲ citation count: 0
Step1X-3D: Towards High-Fidelity and Controllable Generation of Textured 3D Assets, Weiyu Li et al., Arxiv 2025 | citation | site | code | ▲ citation count: 9
Bridging Geometry-Coherent Text-to-3D Generation with Multi-View Diffusion Priors and Gaussian Splatting, Feng Yang et al., Arxiv 2025 | citation | site | code | ▲ citation count: 1
Eye2Eye: A Simple Approach for Monocular-to-Stereo Video Synthesis, Michal Geyer et al., Arxiv 2025 | citation | site | code | ▲ citation count: 0
HoloTime: Taming Video Diffusion Models for Panoramic 4D Scene Generation, Michal Geyer et al., Arxiv 2025 | citation | site | code | ▲ citation count: 0
TesserAct: Learning 4D Embodied World Models, Haoyu Zhen et al., Arxiv 2025 | citation | site | code | ▲ citation count: 0
Art3D: Training-Free 3D Generation from Flat-Colored Illustration, Xiaoyan Cong et al., Arxiv 2025 | citation | site | code | ▲ citation count: 0
Generating 360° Video is What You Need For a 3D Scene, Zhaoyang Zhang et al., SIGGRAPH Asia 2025 | citation | site | code | ▲ citation count: 0
ExScene: Free-View 3D Scene Reconstruction with Gaussian Splatting from a Single Image, Tianyi Gong et al., Arxiv 2025 | citation | site | code | ▲ citation count: 0
MeshCraft: Exploring Efficient and Controllable Mesh Generation with Flow-based DiTs, Xianglong He et al., Arxiv 2025 | citation | site | code | ▲ citation count: 2
Progressive Rendering Distillation: Adapting Stable Diffusion for Instant Text-to-Mesh Generation without 3D Data, Zhiyuan Ma et al., Arxiv 2025 | citation | site | code | ▲ citation count: 0
Stable Virtual Camera: Generative View Synthesis with Diffusion Models, Jensen Zhou et al., Arxiv 2025 | citation | site | code | ▲ citation count: 10
Bolt3D: Generating 3D Scenes in Seconds, Stanislaw Szymanowicz et al., Arxiv 2025 | citation | site | code | ▲ citation count: 10
Amodal3R: Amodal 3D Reconstruction from Occluded 2D Images, Tianhao Wu et al., Arxiv 2025 | citation | site | code | ▲ citation count: 7
PBR3DGen: A VLM-guided Mesh Generation with High-quality PBR Texture, Xiaokang Wei et al., Arxiv 2025 | citation | site | code | ▲ citation count: 0
GaussianIP: Identity-Preserving Realistic 3D Human Generation via Human-Centric Diffusion Prior, Zichen Tang et al., Arxiv 2025 | citation | site | code | ▲ citation count: 0
I2V3D: Controllable image-to-video generation with 3D guidance, Zhiyuan Zhang et al., Arxiv 2025 | citation | site | code | ▲ citation count: 0
Kiss3DGen: Repurposing Image Diffusion Models for 3D Asset Generation, Jiantao Lin et al., Arxiv 2024 | citation | site | code | ▲ citation count: 0
Geometry-Aware Diffusion Models for Multiview Scene Inpainting, Ahmad Salimi et al., Arxiv 2024 | citation | site | code | ▲ citation count: 0
CAST: Component-Aligned 3D Scene Reconstruction from an RGB Image, Zilong Wang et al., Arxiv 2024 | citation | site | code | ▲ citation count: 8
TripoSG: High-Fidelity 3D Shape Synthesis using Large-Scale Rectified Flow Models, Yangguang Li et al., Arxiv 2024 | citation | site | code | ▲ citation count: 29
Joint Reconstruction of Spatially-Coherent and Realistic Clothed Humans and Objects from a Single Image, Ayushi Dutta et al., Arxiv 2024 | citation | site | code | ▲ citation count: 0
ConsistentDreamer: View-Consistent Meshes Through Balanced Multi-View Gaussian Optimization, Onat Şahin et al., Arxiv 2024 | citation | site | code | ▲ citation count: 0
Consistent Flow Distillation for Text-to-3D Generation, Runjie Yan et al., Arxiv 2024 | citation | site | code | ▲ citation count: 1
SPAR3D: Stable Point-Aware Reconstruction of 3D Objects from Single Images, Zixuan Huang et al., Arxiv 2024 | citation | site | code | ▲ citation count: 4
Wonderland: Navigating 3D Scenes from a Single Image, Hanwen Liang Yu et al., Arxiv 2024 | citation | site | code | ▲ citation count: 12
Turbo3D: Ultra-fast Text-to-3D Generation, Hanzhe Hu et al., Arxiv 2024 | citation | site | code | ▲ citation count: 1
Direct and Explicit 3D Generation from a Single Image, Haoyu Wu et al., Arxiv 2024 | citation | site | code | ▲ citation count: 0
Edify 3D: Scalable High-Quality 3D Asset Generation, NVIDIA et al., Arxiv 2024 | citation | site | code | ▲ citation count: 0
DimensionX: Create Any 3D and 4D Scenes from a Single Image with Controllable Video Diffusion, Wenqiang Sun et al., Arxiv 2024 | citation | site | code | ▲ citation count: 15
GaussianAnything: Interactive Point Cloud Latent Diffusion for 3D Generation, Yushi Lan et al., Arxiv 2024 | citation | site | code | ▲ citation count: 4
DreamCraft3D++: Efficient Hierarchical 3D Generation with Multi-Plane Reconstruction Model, Jingxiang Sun et al., Arxiv 2024 | citation | site | code | ▲ citation count: 0
Tex4D: Zero-shot 4D Scene Texturing with Video Diffusion Models, Jiangzhi Bao et al., Arxiv 2024 | citation | site | code | ▲ citation count: 0
SceneCraft: Layout-Guided 3D Scene Generation, Xiuyu Yang et al., Arxiv 2024 | citation | site | code | ▲ citation count: 5
LLaVA-3D: A Simple yet Effective Pathway to Empowering LMMs with 3D-awareness, Chenming Zhu et al., Arxiv 2024 | citation | site | code | ▲ citation count: 0
3DTopia-XL: Scaling High-quality 3D Asset Generation via Primitive Diffusion, Zhaoxi Chen et al., Arxiv 2024 | citation | site | code | ▲ citation count: 20
Phidias: A Generative Model for Creating 3D Content from Text, Image, and 3D Conditions with Reference-Augmented Diffusion, Zhenwei Wang et al., Arxiv 2024 | citation | site | code | ▲ citation count: 6
Hi3D: Pursuing High-Resolution Image-to-3D Generation with Video Diffusion Models, Haibo Yang et al., Arxiv 2024 | citation | site | code | ▲ citation count: 1
MVGaussian: High-Fidelity text-to-3D Content Generation with Multi-View Guidance and Surface Densification, Phu Pham et al., Arxiv 2024 | citation | site | code | ▲ citation count: 0
Geometry Image Diffusion: Fast and Data-Efficient Text-to-3D with Image-Based Surface Representation, Slava Elizarov et al., Arxiv 2024 | citation | site | code | ▲ citation count: 2
MeshFormer: High-Quality Mesh Generation with 3D-Guided Reconstruction Model, Minghua Liu et al., Arxiv 2024 | citation | site | code | ▲ citation count: 5
DreamCouple: Exploring High Quality Text-to-3D Generation Via Rectified Flow, Hangyu Li et al., Arxiv 2024 | citation | site | code | ▲ citation count: 1
DreamInit: A General Framework to Boost 3D GS Initialization for Text-to-3D Generation by Lexical Richness, Lutao Jiang et al., Arxiv 2024 | citation | site | code | ▲ citation count: 2
TexGen: Text-Guided 3D Texture Generation with Multi-view Sampling and Resampling, Dong Huo et al., Arxiv 2024 | citation | site | code | ▲ citation count: 7
Cycle3D: High-quality and Consistent Image-to-3D Generation via Generation-Reconstruction Cycle, Zhenyu Tang et al., Arxiv 2024 | citation | site | code | ▲ citation count: 2
HoloDreamer: Holistic 3D Panoramic World Generation from Text Descriptions, Haiyang Zhou et al., Arxiv 2024 | citation | site | code | ▲ citation count: 1
PlacidDreamer: Advancing Harmony in Text-to-3D Generation, Shuo Huang et al., Arxiv 2024 | citation | site | code | ▲ citation count: 2
RodinHD: High-Fidelity 3D Avatar Generation with Diffusion Models, Bowen Zhang et al., Arxiv 2024 | citation | site | code | ▲ citation count: 2
Meta 3D Gen, Raphael Bensadoun et al., Arxiv 2024 | citation | site | code | ▲ citation count: 0
ScaleDreamer: Scalable Text-to-3D Synthesis with Asynchronous Score Distillation, Zhiyuan Ma et al., ECCV 2024 | citation | site | code | ▲ citation count: 3
HouseCrafter: Lifting Floorplans to 3D Scenes with 2D Diffusion Model, Hieu T. Nguyen et al., Arxiv 2024 | citation | site | code | ▲ citation count: 1
YouDream: Generating Anatomically Controllable Consistent Text-to-3D Animals, Sandeep Mishra et al., Arxiv 2024 | citation | site | code | ▲ citation count: 0
L4GM: Large 4D Gaussian Reconstruction Model, Jiawei Ren et al., Arxiv 2024 | citation | site | code | ▲ citation count: 8
WonderWorld: Interactive 3D Scene Generation from a Single Image, Hong-Xing Yu et al., Arxiv 2024 | citation | site | code | ▲ citation count: 18
Ouroboros3D: Image-to-3D Generation via 3D-aware Recursive Diffusion, Hao Wen et al., Arxiv 2024 | citation | site | code | ▲ citation count: 3
Tetrahedron Splatting for 3D Generation, Chun Gu et al., Arxiv 2024 | citation | site | code | ▲ citation count: 0
CraftsMan: High-fidelity Mesh Generation with 3D Native Generation and Interactive Geometry Refiner, Weiyu Li et al., Arxiv 2024 | citation | site | code | ▲ citation count: 15
LDM: Large Tensorial SDF Model for Textured Mesh Generation, Rengan Xie et al., Arxiv 2024 | citation | site | code | ▲ citation count: 2
Era3D: High-Resolution Multiview Diffusion using Efficient Row-wise Attention, Peng Li et al., Arxiv 2024 | citation | site | code | ▲ citation count: 12
Dreamer XL: Towards High-Resolution Text-to-3D Generation via Trajectory Score Matching, Xingyu Miao et al., Arxiv 2024 | citation | site | code | ▲ citation count: 1
CAT3D: Create Anything in 3D with Multi-View Diffusion Models, Ruiqi Gao et al., Arxiv 2024 | citation | site | code | ▲ citation count: 38
CLIP-GS: CLIP-Informed Gaussian Splatting for Real-time and View-consistent 3D Semantic Understanding, Guibiao Liao et al., Arxiv 2024 | citation | site | code | ▲ citation count: 0
Portrait3D: Text-Guided High-Quality 3D Portrait Generation Using Pyramid Representation and GANs Prior, Yiqian Wu et al., Arxiv 2024 | citation | site | code | ▲ citation count: 2
RealmDreamer: Text-Driven 3D Scene Generation with Inpainting and Depth Diffusion, Jaidev Shriram et al., Arxiv 2024 | citation | site | code | ▲ citation count: 14
InstantMesh: Efficient 3D Mesh Generation from a Single Image with Sparse-view Large Reconstruction Models, Jiale Xu et al., Arxiv 2024 | citation | site | code | ▲ citation count: 49
ComPC: Completing a 3D Point Cloud with 2D Diffusion Priors, Tianxin Huang et al., ICLR 2025 | citation | site | code | ▲ citation count: 0
ComPC: Completing a 3D Point Cloud with 2D Diffusion Priors, Tianxin Huang et al., ICLR 2025 | citation | site | code | ▲ citation count: 0
Hash3D: Training-free Acceleration for 3D Generation, Xingyi Yang et al., Arxiv 2024 | citation | site | code | ▲ citation count: 3
PointInfinity: Resolution-Invariant Point Diffusion Models, Zixuan Huang et al., Arxiv 2024 | citation | site | code | ▲ citation count: 3
The More You See in 2D, the More You Perceive in 3D, Xinyang Han et al., Arxiv 2024 | citation | site | code | ▲ citation count: 0
DreamScene: 3D Gaussian-based Text-to-3D Scene Generation via Formation Pattern Sampling, Haoran Li et al., Arxiv 2025 | citation | site | code | ▲ citation count: 4
GaussianCube: A Structured and Explicit Radiance Representation for 3D Generative Modeling, Bowen Zhang et al., Arxiv 2024 | citation | site | code | ▲ citation count: 3
Gamba: Marry Gaussian Splatting with Mamba for single view 3D reconstruction, Taoran Yi et al., Arxiv 2024 | citation | site | code | ▲ citation count: 2
TC4D: Trajectory-Conditioned Text-to-4D Generation, Sherwin Bahmani et al., Arxiv 2024 | citation | site | code | ▲ citation count: 5
VP3D: Unleashing 2D Visual Prompt for Text-to-3D Generation, Yang Chen et al., Arxiv 2024 | citation | site | code | ▲ citation count: 3
DreamPolisher: Towards High-Quality Text-to-3D Generation via Geometric Diffusion, Yuanze Lin et al., Arxiv 2024 | citation | site | code | ▲ citation count: 3
LATTE3D: Large-scale Amortized Text-To-Enhanced3D Synthesis, Kevin Xie et al., Arxiv 2024 | citation | site | code | ▲ citation count: 11
GRM: Large Gaussian Reconstruction Model for Efficient 3D Reconstruction and Generation, Yinghao Xu et al., Arxiv 2024 | citation | site | code | ▲ citation count: 34
DreamReward: Text-to-3D Generation with Human Preference, Junliang Ye et al., ECCV 2024 | citation | site | code | ▲ citation count: 10
GVGEN: Text-to-3D Generation with Volumetric Representation, Xianglong He et al., Arxiv 2024 | citation | site | code | ▲ citation count: 10
SV3D: Novel Multi-view Synthesis and 3D Generation from a Single Image using Latent Video Diffusion, Vikram Volet et al., Arxiv 2024 | citation | site | code | ▲ citation count: 41
Generic 3D Diffusion Adapter Using Controlled Multi-View Editing, Hansheng Chen et al., Arxiv 2024 | citation | site | code | ▲ citation count: 9
BrightDreamer: Generic 3D Gaussian Generative Framework for Fast Text-to-3D Synthesis, Lutao Jiang et al., Arxiv 2024 | citation | site | code | ▲ citation count: 5
Isotropic3D: Image-to-3D Generation Based on a Single CLIP Embedding, Pengkun Liu et al., Arxiv 2024 | citation | site | code | ▲ citation count: 4
Make-Your-3D: Fast and Consistent Subject-Driven 3D Content Generation Fangfu Liu et al., Arxiv 2024 | citation | site | code | ▲ citation count: 3
Make-Your-3D: Fast and Consistent Subject-Driven 3D Content Generation, Fangfu Liu et al., Arxiv 2024 | citation | site | code | ▲ citation count: 3
V3D: Video Diffusion Models are Effective 3D Generators Zilong Chen et al., Arxiv 2024 | citation | site | code | ▲ citation count: 11
CRM: Single Image to 3D Textured Mesh with Convolutional Reconstruction Model Zhengyi Wang et al., Arxiv 2024 | citation | site | code | ▲ citation count: 40
TripoSR: Fast 3D Object Reconstruction from a Single Image Dmitry Tochilkin et al., Arxiv 2024 | citation | site | code | ▲ citation count: 27
MVD2: Efficient Multiview 3D Reconstruction for Multiview Diffusion, Xin-Yang Zheng et al., Arxiv 2024 | citation | site | code | ▲ citation count: 5
Pushing Auto-regressive Models for 3D Shape Generation at Capacity and Scalability, Xuelin Qian et al., Arxiv 2024 | citation | site | code | ▲ citation count: 0
L3GO: Language Agents with Chain-of-3D-Thoughts for Generating Unconventional Objects, Yutaro Yamada et al., Arxiv 2024 | citation | site | code | ▲ citation count: 1
IM-3D: : Iterative Multiview Diffusion and Reconstruction for High-Quality 3D Generation, Luke Melas-Kyriazi et al., Arxiv 2024 | citation | site | code | ▲ citation count: 13
LGM: Large Multi-View Gaussian Model for High-Resolution 3D Content Creation, Jiaxiang Tang et al., Arxiv 2024 | citation | site | code | ▲ citation count: 83
AToM: Amortized Text-to-Mesh using 2D Diffusion, Guocheng Qian et al., Arxiv 2024 | citation | ▲ citation count: 7
Topology-Aware Latent Diffusion for 3D Shape Generation, Jiangbei Hu et al., Arxiv 2024 | citation | site | code | ▲ citation count: 0
AGG: Amortized Generative 3D Gaussians for Single Image to 3D, Dejia Xu et al., Arxiv 2024 | citation | site | code | ▲ citation count: 10
SteinDreamer: Variance Reduction for Text-to-3D Score Distillation via Stein Identity, Peihao Wang et al., Arxiv 2024 | citation | site | code | ▲ citation count: 5
HarmonyView: Harmonizing Consistency and Diversity in One-Image-to-3D, Sangmin Woo et al., Arxv 2023 | citation | site | code | ▲ citation count: 3
Hyper-VolTran: Fast and Generalizable One-Shot Image to 3D Object Structure via HyperNetworks, Christian Simon et al., Arxv 2023 | citation | site | code | ▲ citation count: 0
Text2Immersion: Generative Immersive Scene with 3D Gaussians, Hao Ouyang et al., Arxiv 2023 | citation | site | code | ▲ citation count: 8
Stable Score Distillation for High-Quality 3D Generation, Boshi Tang et al., Arxiv 2023 | citation | site | code | ▲ citation count: 5
SceneWiz3D: Towards Text-guided 3D Scene Composition, Qihang Zhang et al., CVPR 2024 | citation | site | code | ▲ citation count: 11
CAD: Photorealistic 3D Generation via Adversarial Distillation, Ziyu Wan et al., Arxiv 2023 | citation | site | code | ▲ citation count: 4
EpiDiff: Enhancing Multi-View Synthesis via Localized Epipolar-Constrained Diffusion, Zehuan Huang et al., CVPR 2024 | citation | site | code | ▲ citation count: 7
Text-to-3D Generation with Bidirectional Diffusion using both 2D and 3D priors, Lihe Ding et al., Arxiv 2023 | citation | site | code | ▲ citation count: 5
Inpaint3D: 3D Scene Content Generation using 2D Inpainting Diffusion, Kira Prabhu et al., Arxiv 2023 | citation | site | code | ▲ citation count: 1
StableDreamer: Taming Noisy Score Distillation Sampling for Text-to-3D, Pengsheng Guo et al., Arxiv 2023 | citation | site | code | ▲ citation count: 1
X-Dreamer: Creating High-quality 3D Content by Bridging the Domain Gap Between Text-to-2D and Text-to-3D Generation, Yiwei Ma et al., Arxiv 2023 | citation | site | code | ▲ citation count: 2
Adversarial Diffusion Distillation, Axel Sauer et al., Arxiv 2023 | citation | site | code | ▲ citation count: 4
DreamPropeller: Supercharge Text-to-3D Generation with Parallel Sampling, Linqi Zhou et al., Arxiv 2023| citation | site | code | ▲ citation count: 3
RichDreamer: A Generalizable Normal-Depth Diffusion Model for Detail Richness in Text-to-3D, Lingteng Qiu et al., Arxiv 2023 | citation | site | code | ▲ citation count: 25
MeshGPT: Generating Triangle Meshes with Decoder-Only Transformers, Yawar Siddiqui et al., Arxiv 2023| citation | site | code | ▲ citation count: 21
LucidDreamer: Towards High-Fidelity Text-to-3D Generation via Interval Score Matching, Yixun Liang et al., Arxiv 2023 | citation | site | code | ▲ citation count: 41
MetaDreamer: Efficient Text-to-3D Creation With Disentangling Geometry and Texture, Lincong Feng et al., Arxiv 2023 | citation | site | code | ▲ citation count: 0
One-2-3-45++: Fast Single Image to 3D Objects with Consistent Multi-View Generation and 3D Diffusion, Minghua Liu et al., Arxiv 2023 | citation | site | code | ▲ citation count: 38
LRM: Large Reconstruction Model for Single Image to 3D, Yicong Hong et al., Arxiv 2023 | citation | site | code | ▲ citation count: 91
Text-to-3D with classifier score distillation, Xin Yu et al., Arxiv 2023 | citation | site | code | ▲ citation count: 23
HyperFields: Towards Zero-Shot Generation of NeRFs from Text, Sudarshan Babu et al., Arxiv 2023 | citation | site | code | ▲ citation count: 3
Noise-Free Score Distillation, Oren Katzir et al., Arxiv 2023 | citation | site | code | ▲ citation count: 20
DreamCraft3D: Hierarchical 3D Generation with Bootstrapped Diffusion Prior, Jingxiang Sun et al., Arxiv 2023 | citation | site | code | ▲ citation count: 33
Zero123++: a Single Image to Consistent Multi-view Diffusion Base Model, Ruoxi Shi et al., Arxiv 2023 | citation | site | code | ▲ citation count: 62
Enhancing High-Resolution 3D Generation through Pixel-wise Gradient Clipping, Zijie Pan et al., Arxiv 2023 | citation | site | code | ▲ citation count: 3
SweetDreamer: Aligning Geometric Priors in 2D Diffusion for Consistent Text-to-3D, Weiyu Li et al., Arxiv 2023 | citation | site | code | ▲ citation count: 32
GaussianDreamer: Fast Generation from Text to 3D Gaussian Splatting with Point Cloud Priors,Taoran Yi et al., Arxiv 2023 | citation | site | code | ▲ citation count: 35
Consistent123: One Image to Highly Consistent 3D Asset Using Case-Aware Diffusion Priors, Yukang Lin et al., Arxiv 2023 | citation | site | code | ▲ citation count: 13
DreamGaussian: Generative Gaussian Splatting for Efficient 3D Content Creation, Jiaxiang Tang et al., Arxiv 2023 | citation | site | code | ▲ citation count: 91
Text-to-3D using Gaussian Splatting, Zilong Chen et al., Arxiv 2023 | citation | site | code | ▲ citation count: 40
Progressive Text-to-3D Generation for Automatic 3D Prototyping, Han Yi et al., Arxiv 2023 | citation | site | code | ▲ citation count: 2
Large-Vocabulary 3D Diffusion Model with Transformer, Ziang Cao et al., Arxiv 2023 | citation | site | code | ▲ citation count: 10
SyncDreamer: Generating Multiview-consistent Images from a Single-view Image, Yuan Liu et al., Arxiv 2023 | citation | site | code | ▲ citation count: 81
MVDream: Multi-view Diffusion for 3D Generation, Yichun Shi et al., Arxiv 2023 | citation | site | code | ▲ citation count: 128
PointLLM: Empowering Large Language Models to Understand Point Clouds, Xu Runsen et al., Arxiv 2023 | citation | site | code | ▲ citation count: 3
IT3D: Improved Text-to-3D Generation with Explicit View Synthesis, Yiwen Chen et al., Arxiv 2023 | citation | site | code | ▲ citation count: 16
RGB-D-Fusion: Image Conditioned Depth Diffusion of Humanoid Subjects, Sascha Kirch et al., Arxiv 2023 | citation | site | code | ▲ citation count: 0
Points-to-3D: Bridging the Gap between Sparse Points and Shape-Controllable Text-to-3D Generation, Chaohui Yu et al., Arxiv 2023 | citation | site | code | ▲ citation count: 9
Sketch-A-Shape: Zero-Shot Sketch-to-3D Shape Generation, Aditya Sanghi et al., Arxiv 2023 | citation | site | code | ▲ citation count: 1
AutoDecoding Latent 3D Diffusion Models, Evangelos Ntavelis et al., NeurIPS 2023 | citation | site | code | ▲ citation count: 19
MVDiffusion: Enabling Holistic Multi-view Image Generation with Correspondence-Aware Diffusion, Shitao Tang et al., Arxiv 2023 | citation | site | code | ▲ citation count: 29
3D-LLM: Injecting the 3D World into Large Language Models, Yining Hong et al., Arxiv 2023 | citation | site | code | ▲ citation count: 7
Magic123: One Image to High-Quality 3D Object Generation Using Both 2D and 3D Diffusion Priors, Guocheng Qian et al., Arxiv 2023 | citation | site | code | ▲ citation count: 79
Conditional 3D Shape Generation based on Shape-Image-Text Aligned Latent Representation, Zibo Zhao et al., Arxiv 2023 | citation | site | code | ▲ citation count: 25
One-2-3-45: Any Single Image to 3D Mesh in 45 Seconds without Per-Shape Optimization, Minghua Liu et al., Arxiv 2023 | citation | site | code | ▲ citation count: 89
Cap3D: Scalable 3D Captioning with Pretrained Models, Tiange Luo et al., Arxiv 2023 | citation | site | code | ▲ citation count: 19
InstructP2P: Learning to Edit 3D Point Clouds with Text Instructions, Jiale Xu et al., Arxiv 2023 | citation | site | code | ▲ citation count: 1
ATT3D: Amortized Text-to-3D Object Synthesis, Jonathan Lorraine et al., ICCV 2023 | citation | site | code | ▲ citation count: 28
DreamSparse: Escaping from Plato's Cave with 2D Frozen Diffusion Model Given Sparse Views, Paul Yoo et al., Arxiv 2023 | citation | site | code | ▲ citation count: 10
HiFA: High-fidelity Text-to-3D with Advanced Diffusion Guidance, Junzhe Zhu et al., Arxiv 2023 | citation | site | code | ▲ citation count: 17
ProlificDreamer: High-Fidelity and Diverse Text-to-3D Generation with Variational Score Distillation, Zhengyi Wang et al., Arxiv 2023 | citation | site | code | ▲ citation count: 165
Prompt-Free Diffusion: Taking "Text" out of Text-to-Image Diffusion Models, Xingqian Xu et al., Arxiv 2023 | citation | site | code | ▲ citation count: 0
Text2NeRF: Text-Driven 3D Scene Generation with Neural Radiance Fields, Jingbo Zhang et al., Arxiv 2023 | citation | site | code | ▲ citation count: 21
High-fidelity 3D Face Generation from Natural Language Descriptions, Menghua Wu et al., CVPR 2023 | citation | site | code | ▲ citation count: 3
Shap-E: Generating Conditional 3D Implicit Functions, Heewoo Jun et al., Arxiv 2023 | citation | site | code | ▲ citation count: 68
TextMesh: Generation of Realistic 3D Meshes From Text Prompts, Christina Tsalicoglou Liu et al., Arxiv 2023 | citation | site | code | ▲ citation count: 27
Single-Stage Diffusion NeRF: A Unified Approach to 3D Generation and Reconstruction, Hansheng Chen et al., Arxiv 2023 | citation | site | code | ▲ citation count: 28
Re-imagine the Negative Prompt Algorithm: Transform 2D Diffusion into 3D, alleviate Janus problem and Beyond, Mohammadreza Armandpour et al., Arxiv 2023 | citation | site | code | ▲ citation count: 27
Generative Novel View Synthesis with 3D-Aware Diffusion Models, Eric R. Chan et al., Arxiv 2023 | citation | site | code | ▲ citation count: 38
PODIA-3D: Domain Adaptation of 3D Generative Model Across Large Domain Gap Using Pose-Preserved Text-to-Image Diffusion, Gwanghyun Kim et al., ICCV 2023 | citation | site | code | ▲ citation count: 0
3D-aware Image Generation using 2D Diffusion Models, Jianfeng Xiang et al., Arxiv 2023 | citation | site | code | ▲ citation count: 12
Make-It-3D: High-Fidelity 3D Creation from A Single Image with Diffusion Prior, Junshu Tang et al., ICCV 2023 | citation | site | code | ▲ citation count: 75
DreamBooth3D: Subject-Driven Text-to-3D Generation, Amit Raj et al., ICCV 2023 | citation | site | code | ▲ citation count: 39
Text2Room: Extracting Textured 3D Meshes from 2D Text-to-Image Models, Lukas Höllein et al., Arxiv 2023 | citation | site | code | ▲ citation count: 32
Zero-1-to-3: Zero-shot One Image to 3D Object, Ruoshi Liu et al., Arxiv 2023 | citation | site | code | ▲ citation count: 170
3DQD: Generalized Deep 3D Shape Prior via Part-Discretized Diffusion Process, Yuhan Li et al., CVPR 2023 | citation | site | code | ▲ citation count: 3
LERF: Language Embedded Radiance Fields, Justin Kerr et al., Arxiv 2023 | citation | site | code | ▲ citation count: 8
3DFuse: Let 2D Diffusion Model Know 3D-Consistency for Robust Text-to-3D Generation, Junyoung Seo et al., Arxiv 2023 | citation | site | code | ▲ citation count: 32
GECCO: Geometrically-Conditioned Point Diffusion Models, Michał J. Tyszkiewicz et al., ICCV 2023 | citation | site | code | ▲ citation count: 5
Monocular Depth Estimation using Diffusion Models, Saurabh Saxena et al., Arxiv 2023 | citation | site | code | ▲ citation count: 2
DiffusioNeRF: Regularizing Neural Radiance Fields with Denoising Diffusion Models, Jamie Wynn et al., CVPR 2023 | citation | site | code | ▲ citation count: 1
RealFusion: 360° Reconstruction of Any Object from a Single Image, Luke Melas-Kyriazi et al., CVPR 2023 | citation | site | code | ▲ citation count: 54
NerfDiff: Single-image View Synthesis with NeRF-guided Distillation from 3D-aware Diffusion, Jiatao Gu et al., ICML 2023 | citation | site | code | ▲ citation count: 32
TEXTure: Text-Guided Texturing of 3D Shapes, Elad Richardson Chen et al., SIGGRAPH 2023 | citation | site | code | ▲ citation count: 58
SceneScape: Text-Driven Consistent Scene Generation, Rafail Fridman et al., Arxiv 2023 | citation | site | code | ▲ citation count: 20
Dream3D: Zero-Shot Text-to-3D Synthesis Using 3D Shape Prior and Text-to-Image Diffusion Models, Jiale Xu et al., Arxiv 2022 | citation | site | code | ▲ citation count: 27
Point-E: A System for Generating 3D Point Clouds from Complex Prompts, Alex Nichol et al., Arxiv 2022 | citation | site | code | ▲ citation count: 114
SDFusion: Multimodal 3D Shape Completion, Reconstruction, and Generation, Yen-Chi Cheng et al., CVPR 2023 | citation | site | code | ▲ citation count: 46
NeRDi: Single-View NeRF Synthesis with Language-Guided Diffusion as General Image Priors, Congyue Deng et al., CVPR 2023 | citation | site | code | ▲ citation count: 33
SparseFusion: Distilling View-conditioned Diffusion for 3D Reconstruction, Zhizhuo Zho et al., CVPR 2023 | citation | site | code | ▲ citation count: 29
Score Jacobian Chaining: Lifting Pretrained 2D Diffusion Models for 3D Generation, Haochen Wang et al., CVPR 2023 | citation | site | code | ▲ citation count: 122
NeuralLift-360: Lifting An In-the-wild 2D Photo to A 3D Object with 360° Views, Dejia Xu et al., Arxiv 2022 | citation | site | code | ▲ citation count: 30
DATID-3D: Diversity-Preserved Domain Adaptation Using Text-to-Image Diffusion for 3D Generative Model, Gwanghyun Kim et al., CVPR 2023 | citation | site | code | ▲ citation count: 2
Diffusion-SDF: Conditional Generative Modeling of Signed Distance Functions, Gene Chou et al., Arxiv 2023 | citation | site | code | ▲ citation count: 11
Magic3D: High-Resolution Text-to-3D Content Creation, Chen-Hsuan Linet et al., CVPR 2023 | citation | site | code | ▲ citation count: 200
Latent-NeRF for Shape-Guided Generation of 3D Shapes and Textures, Gal Metzer et al., Arxiv 2023 | citation | site | code | ▲ citation count: 99
Novel View Synthesis with Diffusion Models, Daniel Watson et al., Arxiv 2022 | citation | site | code | ▲ citation count: 49
Novel View Synthesis with Diffusion Models, Daniel Watson et al., ICLR 2023 | citation | site | code | ▲ citation count: 49
PureCLIPNERF: Understanding Pure CLIP Guidance for Voxel Grid NeRF Models, Han-Hung Lee et al., Arxiv 2022 | citation | site | code | ▲ citation count: 15
DreamFusion: Text-to-3D using 2D Diffusion, Ben Poole et al., ICLR 2023 | citation | site | code | ▲ citation count: 293
CLIP-Mesh: Generating textured meshes from text using pretrained image-text models, Nasir Khalid et al., Arxiv 2023 | citation | site | code | ▲ citation count: 72
Zero-Shot Text-Guided Object Generation with Dream Fields, Ajay Jain et al., CVPR 2022 | citation | site | code | ▲ citation count: 126
CLIP-Forge: Towards Zero-Shot Text-to-Shape Generation, Aditya Sanghi et al., Arxiv 2021 | citation | site | code | ▲ citation count: 59
LiteTex-GS: Fast and Lightweight Texturing for Gaussian Splatting, Zhiwei Li et al., Pacific Graphics 2026 (Computer Graphics Forum) | citation | site | code | ▲ citation count: 0
Physically Based Rendering in the Latent Space, Vuk Radovanovic et al., Pacific Graphics 2026 (Computer Graphics Forum) | citation | site | code | ▲ citation count: 0
GS-PI: An Optimization-Decoupled Appearance Decomposition Approach for Generating PBR Gaussian Assets, Jieting Xu et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
RelightFormer: Feed-forward Generative Transformer for Multiview Object Relighting, Hejun Wang et al., SIGGRAPH Asia 2026 | citation | site | code | ▲ citation count: 0
PointGT: Simultaneous Geometry and Texture Editing for Point-Based Representations, Yanshu Zhang et al., ECCV 2026 | citation | site | code | ▲ citation count: 0
PoseAdapter: Dual-Stream 2.5D Controllable Image Generation for Complex Multi-Object Scenes, Yufeng Chi et al., ACM MM 2026 | citation | site | code | ▲ citation count: 0
GeoCache: Training-Free Acceleration of Multi-View Texture Diffusion via Geometric Delta Transport, Haotang Li et al., Arxiv 2026 | citation | site | code | ▲ citation count: 0
TanGO: Training-Free 3D Editing via Tangent-Space Guidance and Optimization, Siwoo Lim et al., Arxiv 2026 | citation | site | code | ▲ citation count: 1
Dynamic Inverse Rendering for Enhanced Material-Lighting Decomposition, Raza Yunus et al.,
Truncated — view the full README on GitHub.
TeX
87.6%
JavaScript
12.4%