MAR-3D: Progressive Masked Auto-regressor for High-Resolution 3D Generation
Fuente:
arXiv
Salvato in:
| Autori principali: | Chen, Jinnan, Zhu, Lingting, Hu, Zeyu, Qian, Shengju, Chen, Yugang, Wang, Xin, Lee, Gim Hee |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
MuMA: 3D PBR Texturing via Multi-Channel Multi-View Generation and Agentic Post-Processing
di: Zhu, Lingting, et al.
Pubblicazione: (2025)
di: Zhu, Lingting, et al.
Pubblicazione: (2025)
Generalizable Human Gaussians from Single-View Image
di: Chen, Jinnan, et al.
Pubblicazione: (2024)
di: Chen, Jinnan, et al.
Pubblicazione: (2024)
DiHuR: Diffusion-Guided Generalizable Human Reconstruction
di: Chen, Jinnan, et al.
Pubblicazione: (2024)
di: Chen, Jinnan, et al.
Pubblicazione: (2024)
GarmentX: Autoregressive Parametric Representations for High-Fidelity 3D Garment Generation
di: Guo, Jingfeng, et al.
Pubblicazione: (2025)
di: Guo, Jingfeng, et al.
Pubblicazione: (2025)
AssetFormer: Modular 3D Assets Generation with Autoregressive Transformer
di: Zhu, Lingting, et al.
Pubblicazione: (2026)
di: Zhu, Lingting, et al.
Pubblicazione: (2026)
DOGS: Distributed-Oriented Gaussian Splatting for Large-Scale 3D Reconstruction Via Gaussian Consensus
di: Chen, Yu, et al.
Pubblicazione: (2024)
di: Chen, Yu, et al.
Pubblicazione: (2024)
Motion4D: Learning 3D-Consistent Motion and Semantics for 4D Scene Understanding
di: Zhou, Haoran, et al.
Pubblicazione: (2025)
di: Zhou, Haoran, et al.
Pubblicazione: (2025)
ChatSplat: 3D Conversational Gaussian Splatting
di: Chen, Hanlin, et al.
Pubblicazione: (2024)
di: Chen, Hanlin, et al.
Pubblicazione: (2024)
X-Ray: A Sequential 3D Representation For Generation
di: Hu, Tao, et al.
Pubblicazione: (2024)
di: Hu, Tao, et al.
Pubblicazione: (2024)
g3D-LF: Generalizable 3D-Language Feature Fields for Embodied Tasks
di: Wang, Zihan, et al.
Pubblicazione: (2024)
di: Wang, Zihan, et al.
Pubblicazione: (2024)
IAAO: Interactive Affordance Learning for Articulated Objects in 3D Environments
di: Zhang, Can, et al.
Pubblicazione: (2025)
di: Zhang, Can, et al.
Pubblicazione: (2025)
Dynam3D: Dynamic Layered 3D Tokens Empower VLM for Vision-and-Language Navigation
di: Wang, Zihan, et al.
Pubblicazione: (2025)
di: Wang, Zihan, et al.
Pubblicazione: (2025)
MVSDet: Multi-View Indoor 3D Object Detection via Efficient Plane Sweeps
di: Xu, Yating, et al.
Pubblicazione: (2024)
di: Xu, Yating, et al.
Pubblicazione: (2024)
Uni4D-LLM: A Unified SpatioTemporal-Aware VLM for 4D Understanding and Generation
di: Zhou, Hanyu, et al.
Pubblicazione: (2025)
di: Zhou, Hanyu, et al.
Pubblicazione: (2025)
econSG: Efficient and Multi-view Consistent Open-Vocabulary 3D Semantic Gaussians
di: Zhang, Can, et al.
Pubblicazione: (2025)
di: Zhang, Can, et al.
Pubblicazione: (2025)
NeuSG: Neural Implicit Surface Reconstruction with 3D Gaussian Splatting Guidance
di: Chen, Hanlin, et al.
Pubblicazione: (2023)
di: Chen, Hanlin, et al.
Pubblicazione: (2023)
CaliTex: Geometry-Calibrated Attention for View-Coherent 3D Texture Generation
di: Liu, Chenyu, et al.
Pubblicazione: (2025)
di: Liu, Chenyu, et al.
Pubblicazione: (2025)
SCAPO: Self-Supervised Category-Level Articulated Pose Estimation from a Single 3D Observation
di: Zhang, Can, et al.
Pubblicazione: (2026)
di: Zhang, Can, et al.
Pubblicazione: (2026)
D3D-VLP: Dynamic 3D Vision-Language-Planning Model for Embodied Grounding and Navigation
di: Wang, Zihan, et al.
Pubblicazione: (2025)
di: Wang, Zihan, et al.
Pubblicazione: (2025)
Segment Any 3D Object with Language
di: Lee, Seungjun, et al.
Pubblicazione: (2024)
di: Lee, Seungjun, et al.
Pubblicazione: (2024)
HandMCM: Multi-modal Point Cloud-based Correspondence State Space Model for 3D Hand Pose Estimation
di: Cheng, Wencan, et al.
Pubblicazione: (2026)
di: Cheng, Wencan, et al.
Pubblicazione: (2026)
CoSMo3D: Open-World Promptable 3D Semantic Part Segmentation through LLM-Guided Canonical Spatial Modeling
di: Jin, Li, et al.
Pubblicazione: (2026)
di: Jin, Li, et al.
Pubblicazione: (2026)
Large Material Gaussian Model for Relightable 3D Generation
di: Ye, Jingrui, et al.
Pubblicazione: (2025)
di: Ye, Jingrui, et al.
Pubblicazione: (2025)
FreeSplat++: Generalizable 3D Gaussian Splatting for Efficient Indoor Scene Reconstruction
di: Wang, Yunsong, et al.
Pubblicazione: (2025)
di: Wang, Yunsong, et al.
Pubblicazione: (2025)
Large Images are Gaussians: High-Quality Large Image Representation with Levels of 2D Gaussian Splatting
di: Zhu, Lingting, et al.
Pubblicazione: (2025)
di: Zhu, Lingting, et al.
Pubblicazione: (2025)
DiET-GS: Diffusion Prior and Event Stream-Assisted Motion Deblurring 3D Gaussian Splatting
di: Lee, Seungjun, et al.
Pubblicazione: (2025)
di: Lee, Seungjun, et al.
Pubblicazione: (2025)
Multi-Scale 3D Gaussian Splatting for Anti-Aliased Rendering
di: Yan, Zhiwen, et al.
Pubblicazione: (2023)
di: Yan, Zhiwen, et al.
Pubblicazione: (2023)
LLaVA-4D: Embedding SpatioTemporal Prompt into LMMs for 4D Scene Understanding
di: Zhou, Hanyu, et al.
Pubblicazione: (2025)
di: Zhou, Hanyu, et al.
Pubblicazione: (2025)
Syn-to-Real Unsupervised Domain Adaptation for Indoor 3D Object Detection
di: Wang, Yunsong, et al.
Pubblicazione: (2024)
di: Wang, Yunsong, et al.
Pubblicazione: (2024)
Enhancing Generalizability of Representation Learning for Data-Efficient 3D Scene Understanding
di: Wang, Yunsong, et al.
Pubblicazione: (2024)
di: Wang, Yunsong, et al.
Pubblicazione: (2024)
FreeSplat: Generalizable 3D Gaussian Splatting Towards Free-View Synthesis of Indoor Scenes
di: Wang, Yunsong, et al.
Pubblicazione: (2024)
di: Wang, Yunsong, et al.
Pubblicazione: (2024)
ComPC: Completing a 3D Point Cloud with 2D Diffusion Priors
di: Huang, Tianxin, et al.
Pubblicazione: (2024)
di: Huang, Tianxin, et al.
Pubblicazione: (2024)
EmbodiedSplat: Online Feed-Forward Semantic 3DGS for Open-Vocabulary 3D Scene Understanding
di: Lee, Seungjun, et al.
Pubblicazione: (2026)
di: Lee, Seungjun, et al.
Pubblicazione: (2026)
DiSR-NeRF: Diffusion-Guided View-Consistent Super-Resolution NeRF
di: Lee, Jie Long, et al.
Pubblicazione: (2024)
di: Lee, Jie Long, et al.
Pubblicazione: (2024)
ReVSeg: Incentivizing the Reasoning Chain for Video Segmentation with Reinforcement Learning
di: Li, Yifan, et al.
Pubblicazione: (2025)
di: Li, Yifan, et al.
Pubblicazione: (2025)
Learning to Decouple the Lights for 3D Face Texture Modeling
di: Huang, Tianxin, et al.
Pubblicazione: (2024)
di: Huang, Tianxin, et al.
Pubblicazione: (2024)
Flow4DGS-SLAM: Optical Flow-Guided 4D Gaussian Splatting SLAM
di: Wang, Yunsong, et al.
Pubblicazione: (2026)
di: Wang, Yunsong, et al.
Pubblicazione: (2026)
MotionScale: Reconstructing Appearance, Geometry, and Motion of Dynamic Scenes with Scalable 4D Gaussian Splatting
di: Zhou, Haoran, et al.
Pubblicazione: (2026)
di: Zhou, Haoran, et al.
Pubblicazione: (2026)
GEAL: Generalizable 3D Affordance Learning with Cross-Modal Consistency
di: Lu, Dongyue, et al.
Pubblicazione: (2024)
di: Lu, Dongyue, et al.
Pubblicazione: (2024)
Statistical Confidence Rescoring for Robust 3D Scene Graph Generation from Multi-View Images
di: Yeo, Qi Xun, et al.
Pubblicazione: (2025)
di: Yeo, Qi Xun, et al.
Pubblicazione: (2025)
Documenti analoghi
-
MuMA: 3D PBR Texturing via Multi-Channel Multi-View Generation and Agentic Post-Processing
di: Zhu, Lingting, et al.
Pubblicazione: (2025) -
Generalizable Human Gaussians from Single-View Image
di: Chen, Jinnan, et al.
Pubblicazione: (2024) -
DiHuR: Diffusion-Guided Generalizable Human Reconstruction
di: Chen, Jinnan, et al.
Pubblicazione: (2024) -
GarmentX: Autoregressive Parametric Representations for High-Fidelity 3D Garment Generation
di: Guo, Jingfeng, et al.
Pubblicazione: (2025) -
AssetFormer: Modular 3D Assets Generation with Autoregressive Transformer
di: Zhu, Lingting, et al.
Pubblicazione: (2026)