Multi-view Image Prompted Multi-view Diffusion for Improved 3D Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kim, Seungwook, Shi, Yichun, Li, Kejie, Cho, Minsu, Wang, Peng |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
RapidMV: Leveraging Spatio-Angular Representations for Efficient and Consistent Text-to-Multi-View Synthesis
par: Kim, Seungwook, et autres
Publié: (2025)
par: Kim, Seungwook, et autres
Publié: (2025)
MVDream: Multi-view Diffusion for 3D Generation
par: Shi, Yichun, et autres
Publié: (2023)
par: Shi, Yichun, et autres
Publié: (2023)
CorrespondentDream: Enhancing 3D Fidelity of Text-to-3D using Cross-View Correspondences
par: Kim, Seungwook, et autres
Publié: (2024)
par: Kim, Seungwook, et autres
Publié: (2024)
Improving Text-to-Image Generation with Intrinsic Self-Confidence Rewards
par: Kim, Seungwook, et autres
Publié: (2026)
par: Kim, Seungwook, et autres
Publié: (2026)
MVLight: Relightable Text-to-3D Generation via Light-conditioned Multi-View Diffusion
par: Shim, Dongseok, et autres
Publié: (2024)
par: Shim, Dongseok, et autres
Publié: (2024)
Harnessing the Power of Training-Free Techniques in Text-to-2D Generation for Text-to-3D Generation via Score Distillation Sampling
par: Lee, Junhong, et autres
Publié: (2025)
par: Lee, Junhong, et autres
Publié: (2025)
Similarity-Aware Selective State-Space Modeling for Semantic Correspondence
par: Kim, Seungwook, et autres
Publié: (2025)
par: Kim, Seungwook, et autres
Publié: (2025)
Consistent-1-to-3: Consistent Image to 3D View Synthesis via Geometry-aware Diffusion Models
par: Ye, Jianglong, et autres
Publié: (2023)
par: Ye, Jianglong, et autres
Publié: (2023)
FreeAction: Training-Free Techniques for Enhanced Fidelity of Trajectory-to-Video Generation
par: Kim, Seungwook, et autres
Publié: (2025)
par: Kim, Seungwook, et autres
Publié: (2025)
Learning SO(3)-Invariant Semantic Correspondence via Local Shape Transform
par: Park, Chunghyun, et autres
Publié: (2024)
par: Park, Chunghyun, et autres
Publié: (2024)
MV-SAM: Multi-view Promptable Segmentation using Pointmap Guidance
par: Jeong, Yoonwoo, et autres
Publié: (2026)
par: Jeong, Yoonwoo, et autres
Publié: (2026)
4Diffusion: Multi-view Video Diffusion Model for 4D Generation
par: Zhang, Haiyu, et autres
Publié: (2024)
par: Zhang, Haiyu, et autres
Publié: (2024)
Distilling Multi-view Diffusion Models into 3D Generators
par: Qin, Hao, et autres
Publié: (2025)
par: Qin, Hao, et autres
Publié: (2025)
Sharp-It: A Multi-view to Multi-view Diffusion Model for 3D Synthesis and Manipulation
par: Edelstein, Yiftach, et autres
Publié: (2024)
par: Edelstein, Yiftach, et autres
Publié: (2024)
Muskie: Multi-view Masked Image Modeling for 3D Vision Pre-training
par: Li, Wenyu, et autres
Publié: (2025)
par: Li, Wenyu, et autres
Publié: (2025)
Geometry-Aware Representation Denoising for Robust Multi-view 3D Reconstruction
par: Kim, Jin Hyeon, et autres
Publié: (2026)
par: Kim, Jin Hyeon, et autres
Publié: (2026)
Autoregressive Image Generation with Vision Full-view Prompt
par: Cai, Miaomiao, et autres
Publié: (2025)
par: Cai, Miaomiao, et autres
Publié: (2025)
MVD-Fusion: Single-view 3D via Depth-consistent Multi-view Generation
par: Hu, Hanzhe, et autres
Publié: (2024)
par: Hu, Hanzhe, et autres
Publié: (2024)
TexGen: Text-Guided 3D Texture Generation with Multi-view Sampling and Resampling
par: Huo, Dong, et autres
Publié: (2024)
par: Huo, Dong, et autres
Publié: (2024)
Incomplete Multi-view Clustering via Diffusion Contrastive Generation
par: Zhang, Yuanyang, et autres
Publié: (2025)
par: Zhang, Yuanyang, et autres
Publié: (2025)
Geometry-guided Cross-view Diffusion for One-to-many Cross-view Image Synthesis
par: Lin, Tao Jun, et autres
Publié: (2024)
par: Lin, Tao Jun, et autres
Publié: (2024)
Multi-view Consistent 3D Gaussian Head Avatars 'without' Multi-view Generation
par: Chharia, Aviral, et autres
Publié: (2026)
par: Chharia, Aviral, et autres
Publié: (2026)
PanoFree: Tuning-Free Holistic Multi-view Image Generation with Cross-view Self-Guidance
par: Liu, Aoming, et autres
Publié: (2024)
par: Liu, Aoming, et autres
Publié: (2024)
MAIR++: Improving Multi-view Attention Inverse Rendering with Implicit Lighting Representation
par: Choi, JunYong, et autres
Publié: (2024)
par: Choi, JunYong, et autres
Publié: (2024)
Animate3D: Animating Any 3D Model with Multi-view Video Diffusion
par: Jiang, Yanqin, et autres
Publié: (2024)
par: Jiang, Yanqin, et autres
Publié: (2024)
MVDiffusion++: A Dense High-resolution Multi-view Diffusion Model for Single or Sparse-view 3D Object Reconstruction
par: Tang, Shitao, et autres
Publié: (2024)
par: Tang, Shitao, et autres
Publié: (2024)
Diffusion$^2$: Dynamic 3D Content Generation via Score Composition of Video and Multi-view Diffusion Models
par: Yang, Zeyu, et autres
Publié: (2024)
par: Yang, Zeyu, et autres
Publié: (2024)
Repurposing Geometric Foundation Models for Multi-view Diffusion
par: Jang, Wooseok, et autres
Publié: (2026)
par: Jang, Wooseok, et autres
Publié: (2026)
Dual3D: Efficient and Consistent Text-to-3D Generation with Dual-mode Multi-view Latent Diffusion
par: Li, Xinyang, et autres
Publié: (2024)
par: Li, Xinyang, et autres
Publié: (2024)
Carve3D: Improving Multi-view Reconstruction Consistency for Diffusion Models with RL Finetuning
par: Xie, Desai, et autres
Publié: (2023)
par: Xie, Desai, et autres
Publié: (2023)
Multi-view Image Diffusion via Coordinate Noise and Fourier Attention
par: Theiss, Justin, et autres
Publié: (2024)
par: Theiss, Justin, et autres
Publié: (2024)
Category-Aware 3D Object Composition with Disentangled Texture and Shape Multi-view Diffusion
par: Xiong, Zeren, et autres
Publié: (2025)
par: Xiong, Zeren, et autres
Publié: (2025)
VSFormer: Mining Correlations in Flexible View Set for Multi-view 3D Shape Understanding
par: Sun, Hongyu, et autres
Publié: (2024)
par: Sun, Hongyu, et autres
Publié: (2024)
SV3D: Novel Multi-view Synthesis and 3D Generation from a Single Image using Latent Video Diffusion
par: Voleti, Vikram, et autres
Publié: (2024)
par: Voleti, Vikram, et autres
Publié: (2024)
Direct2.5: Diverse Text-to-3D Generation via Multi-view 2.5D Diffusion
par: Lu, Yuanxun, et autres
Publié: (2023)
par: Lu, Yuanxun, et autres
Publié: (2023)
Fast Multi-view Consistent 3D Editing with Video Priors
par: Chen, Liyi, et autres
Publié: (2025)
par: Chen, Liyi, et autres
Publié: (2025)
3D Geometric Shape Assembly via Efficient Point Cloud Matching
par: Lee, Nahyuk, et autres
Publié: (2024)
par: Lee, Nahyuk, et autres
Publié: (2024)
Style3D: Attention-guided Multi-view Style Transfer for 3D Object Generation
par: Song, Bingjie, et autres
Publié: (2024)
par: Song, Bingjie, et autres
Publié: (2024)
MV-Adapter: Multi-view Consistent Image Generation Made Easy
par: Huang, Zehuan, et autres
Publié: (2024)
par: Huang, Zehuan, et autres
Publié: (2024)
LoopGaussian: Creating 3D Cinemagraph with Multi-view Images via Eulerian Motion Field
par: Li, Jiyang, et autres
Publié: (2024)
par: Li, Jiyang, et autres
Publié: (2024)
Documents similaires
-
RapidMV: Leveraging Spatio-Angular Representations for Efficient and Consistent Text-to-Multi-View Synthesis
par: Kim, Seungwook, et autres
Publié: (2025) -
MVDream: Multi-view Diffusion for 3D Generation
par: Shi, Yichun, et autres
Publié: (2023) -
CorrespondentDream: Enhancing 3D Fidelity of Text-to-3D using Cross-View Correspondences
par: Kim, Seungwook, et autres
Publié: (2024) -
Improving Text-to-Image Generation with Intrinsic Self-Confidence Rewards
par: Kim, Seungwook, et autres
Publié: (2026) -
MVLight: Relightable Text-to-3D Generation via Light-conditioned Multi-View Diffusion
par: Shim, Dongseok, et autres
Publié: (2024)