Envision3D: One Image to 3D with Anchor Views Interpolation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Pang, Yatian, Jia, Tanghui, Shi, Yujun, Tang, Zhenyu, Zhang, Junwu, Cheng, Xinhua, Zhou, Xing, Tay, Francis E. H., Yuan, Li |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Cycle3D: High-quality and Consistent Image-to-3D Generation via Generation-Reconstruction Cycle
par: Tang, Zhenyu, et autres
Publié: (2024)
par: Tang, Zhenyu, et autres
Publié: (2024)
DreamDance: Animating Human Images by Enriching 3D Geometry Cues from 2D Poses
par: Pang, Yatian, et autres
Publié: (2024)
par: Pang, Yatian, et autres
Publié: (2024)
NeuralGS: Bridging Neural Fields and 3D Gaussian Splatting for Compact 3D Representations
par: Tang, Zhenyu, et autres
Publié: (2025)
par: Tang, Zhenyu, et autres
Publié: (2025)
ViPOcc: Leveraging Visual Priors from Vision Foundation Models for Single-View 3D Occupancy Prediction
par: Feng, Yi, et autres
Publié: (2024)
par: Feng, Yi, et autres
Publié: (2024)
Open-Sora Plan: Open-Source Large Video Generation Model
par: Lin, Bin, et autres
Publié: (2024)
par: Lin, Bin, et autres
Publié: (2024)
AE-NeRF: Augmenting Event-Based Neural Radiance Fields for Non-ideal Conditions and Larger Scene
par: Feng, Chaoran, et autres
Publié: (2025)
par: Feng, Chaoran, et autres
Publié: (2025)
AnchorSplat: Feed-Forward 3D Gaussian Splatting with 3D Geometric Priors
par: Zhang, Xiaoxue, et autres
Publié: (2026)
par: Zhang, Xiaoxue, et autres
Publié: (2026)
3D-LMVIC: Learning-based Multi-View Image Coding with 3D Gaussian Geometric Priors
par: Huang, Yujun, et autres
Publié: (2024)
par: Huang, Yujun, et autres
Publié: (2024)
MoE-LLaVA: Mixture of Experts for Large Vision-Language Models
par: Lin, Bin, et autres
Publié: (2024)
par: Lin, Bin, et autres
Publié: (2024)
Next Patch Prediction for Autoregressive Visual Generation
par: Pang, Yatian, et autres
Publié: (2024)
par: Pang, Yatian, et autres
Publié: (2024)
HoloDreamer: Holistic 3D Panoramic World Generation from Text Descriptions
par: Zhou, Haiyang, et autres
Publié: (2024)
par: Zhou, Haiyang, et autres
Publié: (2024)
Zero-P-to-3: Zero-Shot Partial-View Images to 3D Object
par: Lin, Yuxuan, et autres
Publié: (2025)
par: Lin, Yuxuan, et autres
Publié: (2025)
3D-UIR: 3D Gaussian for Underwater 3D Scene Reconstruction via Physics Based Appearance-Medium Decoupling
par: Yuan, Jieyu, et autres
Publié: (2025)
par: Yuan, Jieyu, et autres
Publié: (2025)
DanceCamera3D: 3D Camera Movement Synthesis with Music and Dance
par: Wang, Zixuan, et autres
Publié: (2024)
par: Wang, Zixuan, et autres
Publié: (2024)
Anchor3DLane++: 3D Lane Detection via Sample-Adaptive Sparse 3D Anchor Regression
par: Huang, Shaofei, et autres
Publié: (2024)
par: Huang, Shaofei, et autres
Publié: (2024)
Enhancing 3D Object Detection with 2D Detection-Guided Query Anchors
par: Ji, Haoxuanye, et autres
Publié: (2024)
par: Ji, Haoxuanye, et autres
Publié: (2024)
Progressive3D: Progressively Local Editing for Text-to-3D Content Creation with Complex Semantic Prompts
par: Cheng, Xinhua, et autres
Publié: (2023)
par: Cheng, Xinhua, et autres
Publié: (2023)
AnchorFlow: Training-Free 3D Editing via Latent Anchor-Aligned Flows
par: Zhou, Zhenglin, et autres
Publié: (2025)
par: Zhou, Zhenglin, et autres
Publié: (2025)
SwapAnyone: Consistent and Realistic Video Synthesis for Swapping Any Person into Any Video
par: Zhao, Chengshu, et autres
Publié: (2025)
par: Zhao, Chengshu, et autres
Publié: (2025)
E-4DGS: High-Fidelity Dynamic Reconstruction from the Multi-view Event Cameras
par: Feng, Chaoran, et autres
Publié: (2025)
par: Feng, Chaoran, et autres
Publié: (2025)
CDI3D: Cross-guided Dense-view Interpolation for 3D Reconstruction
par: Wu, Zhiyuan, et autres
Publié: (2025)
par: Wu, Zhiyuan, et autres
Publié: (2025)
MDHA: Multi-Scale Deformable Transformer with Hybrid Anchors for Multi-View 3D Object Detection
par: Adeline, Michelle, et autres
Publié: (2024)
par: Adeline, Michelle, et autres
Publié: (2024)
68‐5: Integral Imaging 3D Display with Large Viewing Angle
par: Lin-Bo Zhang, et autres
Publié: (2025)
par: Lin-Bo Zhang, et autres
Publié: (2025)
Generalizable Sparse-View 3D Reconstruction from Unconstrained Images
par: Gupta, Vinayak, et autres
Publié: (2026)
par: Gupta, Vinayak, et autres
Publié: (2026)
CanoVerse: 3D Object Scalable Canonicalization and Dataset for Generation and Pose
par: Jin, Li, et autres
Publié: (2026)
par: Jin, Li, et autres
Publié: (2026)
AR-1-to-3: Single Image to Consistent 3D Object Generation via Next-View Prediction
par: Zhang, Xuying, et autres
Publié: (2025)
par: Zhang, Xuying, et autres
Publié: (2025)
DecoRec: Decomposed 3D Scene Reconstruction from Single-View Images via Object-Level Diffusion
par: Ping, Yuhan, et autres
Publié: (2026)
par: Ping, Yuhan, et autres
Publié: (2026)
GaussianPrediction: Dynamic 3D Gaussian Prediction for Motion Extrapolation and Free View Synthesis
par: Zhao, Boming, et autres
Publié: (2024)
par: Zhao, Boming, et autres
Publié: (2024)
ViewCraft3D: High-Fidelity and View-Consistent 3D Vector Graphics Synthesis
par: Wang, Chuang, et autres
Publié: (2025)
par: Wang, Chuang, et autres
Publié: (2025)
PandaPose: 3D Human Pose Lifting from a Single Image via Propagating 2D Pose Prior to 3D Anchor Space
par: Zheng, Jinghong, et autres
Publié: (2026)
par: Zheng, Jinghong, et autres
Publié: (2026)
One View, Many Worlds: Single-Image to 3D Object Meets Generative Domain Randomization for One-Shot 6D Pose Estimation
par: Geng, Zheng, et autres
Publié: (2025)
par: Geng, Zheng, et autres
Publié: (2025)
OneTo3D: One Image to Re-editable Dynamic 3D Model and Video Generation
par: Lin, Jinwei
Publié: (2024)
par: Lin, Jinwei
Publié: (2024)
Hitem3D 2.0: Multi-View Guided Native 3D Texture Generation
par: He, Huiang, et autres
Publié: (2026)
par: He, Huiang, et autres
Publié: (2026)
Cascade-Zero123: One Image to Highly Consistent 3D with Self-Prompted Nearby Views
par: Chen, Yabo, et autres
Publié: (2023)
par: Chen, Yabo, et autres
Publié: (2023)
Multimodal Sense-Informed Prediction of 3D Human Motions
par: Lou, Zhenyu, et autres
Publié: (2024)
par: Lou, Zhenyu, et autres
Publié: (2024)
UniGS: Modeling Unitary 3D Gaussians for Novel View Synthesis from Sparse-view Images
par: Wu, Jiamin, et autres
Publié: (2024)
par: Wu, Jiamin, et autres
Publié: (2024)
A Pixel Is Worth More Than One 3D Gaussians in Single-View 3D Reconstruction
par: Shen, Jianghao, et autres
Publié: (2024)
par: Shen, Jianghao, et autres
Publié: (2024)
ManiVID-3D: Generalizable View-Invariant Reinforcement Learning for Robotic Manipulation via Disentangled 3D Representations
par: Li, Zheng, et autres
Publié: (2025)
par: Li, Zheng, et autres
Publié: (2025)
Envisioning the Future, One Step at a Time
par: Baumann, Stefan Andreas, et autres
Publié: (2026)
par: Baumann, Stefan Andreas, et autres
Publié: (2026)
Dehallu3D: Hallucination-Mitigated 3D Generation from Single Image via Cyclic View Consistency Refinement
par: Wang, Xiwen, et autres
Publié: (2026)
par: Wang, Xiwen, et autres
Publié: (2026)
Documents similaires
-
Cycle3D: High-quality and Consistent Image-to-3D Generation via Generation-Reconstruction Cycle
par: Tang, Zhenyu, et autres
Publié: (2024) -
DreamDance: Animating Human Images by Enriching 3D Geometry Cues from 2D Poses
par: Pang, Yatian, et autres
Publié: (2024) -
NeuralGS: Bridging Neural Fields and 3D Gaussian Splatting for Compact 3D Representations
par: Tang, Zhenyu, et autres
Publié: (2025) -
ViPOcc: Leveraging Visual Priors from Vision Foundation Models for Single-View 3D Occupancy Prediction
par: Feng, Yi, et autres
Publié: (2024) -
Open-Sora Plan: Open-Source Large Video Generation Model
par: Lin, Bin, et autres
Publié: (2024)