Swin3D++: Effective Multi-Source Pretraining for 3D Indoor Scene Understanding
Fuente:
arXiv
Guardado en:
| Autores principales: | Yang, Yu-Qi, Guo, Yu-Xiao, Liu, Yang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
LPA3D: 3D Room-Level Scene Generation from In-the-Wild Images
por: Yang, Ming-Jia, et al.
Publicado: (2025)
por: Yang, Ming-Jia, et al.
Publicado: (2025)
Chorus: Multi-Teacher Pretraining for Holistic 3D Gaussian Scene Encoding
por: Li, Yue, et al.
Publicado: (2025)
por: Li, Yue, et al.
Publicado: (2025)
3D Question Answering for City Scene Understanding
por: Sun, Penglei, et al.
Publicado: (2024)
por: Sun, Penglei, et al.
Publicado: (2024)
UnScene3D: Unsupervised 3D Instance Segmentation for Indoor Scenes
por: Rozenberszki, David, et al.
Publicado: (2023)
por: Rozenberszki, David, et al.
Publicado: (2023)
GaussianGraph: 3D Gaussian-based Scene Graph Generation for Open-world Scene Understanding
por: Wang, Xihan, et al.
Publicado: (2025)
por: Wang, Xihan, et al.
Publicado: (2025)
Rein3D: Reinforced 3D Indoor Scene Generation with Panoramic Video Diffusion Models
por: Wang, Dehui, et al.
Publicado: (2026)
por: Wang, Dehui, et al.
Publicado: (2026)
Adaptive Multi-Scale Channel-Spatial Attention Aggregation Framework for 3D Indoor Semantic Scene Completion Toward Assisting Visually Impaired
por: He, Qi, et al.
Publicado: (2026)
por: He, Qi, et al.
Publicado: (2026)
LLplace: The 3D Indoor Scene Layout Generation and Editing via Large Language Model
por: Yang, Yixuan, et al.
Publicado: (2024)
por: Yang, Yixuan, et al.
Publicado: (2024)
CineScene: Implicit 3D as Effective Scene Representation for Cinematic Video Generation
por: Huang, Kaiyi, et al.
Publicado: (2026)
por: Huang, Kaiyi, et al.
Publicado: (2026)
MVRoom: Controllable 3D Indoor Scene Generation with Multi-View Diffusion Models
por: Fang, Shaoheng, et al.
Publicado: (2025)
por: Fang, Shaoheng, et al.
Publicado: (2025)
SceneReVis: A Self-Reflective Vision-Grounded Framework for 3D Indoor Scene Synthesis via Multi-turn RL
por: Zhao, Yang, et al.
Publicado: (2026)
por: Zhao, Yang, et al.
Publicado: (2026)
Inst3D-LMM: Instance-Aware 3D Scene Understanding with Multi-modal Instruction Tuning
por: Yu, Hanxun, et al.
Publicado: (2025)
por: Yu, Hanxun, et al.
Publicado: (2025)
Mixed Diffusion for 3D Indoor Scene Synthesis
por: Hu, Siyi, et al.
Publicado: (2024)
por: Hu, Siyi, et al.
Publicado: (2024)
SPATIALGEN: Layout-guided 3D Indoor Scene Generation
por: Fang, Chuan, et al.
Publicado: (2025)
por: Fang, Chuan, et al.
Publicado: (2025)
DC-Scene: Data-Centric Learning for 3D Scene Understanding
por: Huang, Ting, et al.
Publicado: (2025)
por: Huang, Ting, et al.
Publicado: (2025)
Global-Local Tree Search in VLMs for 3D Indoor Scene Generation
por: Deng, Wei, et al.
Publicado: (2025)
por: Deng, Wei, et al.
Publicado: (2025)
SAI3D: Segment Any Instance in 3D Scenes
por: Yin, Yingda, et al.
Publicado: (2023)
por: Yin, Yingda, et al.
Publicado: (2023)
CommonScenes: Generating Commonsense 3D Indoor Scenes with Scene Graph Diffusion
por: Zhai, Guangyao, et al.
Publicado: (2023)
por: Zhai, Guangyao, et al.
Publicado: (2023)
Articulate3D: Holistic Understanding of 3D Scenes as Universal Scene Description
por: Halacheva, Anna-Maria, et al.
Publicado: (2024)
por: Halacheva, Anna-Maria, et al.
Publicado: (2024)
Behind the Veil: Enhanced Indoor 3D Scene Reconstruction with Occluded Surfaces Completion
por: Sun, Su, et al.
Publicado: (2024)
por: Sun, Su, et al.
Publicado: (2024)
Reg3D: Reconstructive Geometry Instruction Tuning for 3D Scene Understanding
por: Zheng, Hongpei, et al.
Publicado: (2025)
por: Zheng, Hongpei, et al.
Publicado: (2025)
SceneCraft: Layout-Guided 3D Scene Generation
por: Yang, Xiuyu, et al.
Publicado: (2024)
por: Yang, Xiuyu, et al.
Publicado: (2024)
Fast3D: Accelerating 3D Multi-modal Large Language Models for Efficient 3D Scene Understanding
por: Huang, Wencan, et al.
Publicado: (2025)
por: Huang, Wencan, et al.
Publicado: (2025)
Jointly Understand Your Command and Intention:Reciprocal Co-Evolution between Scene-Aware 3D Human Motion Synthesis and Analysis
por: Gao, Xuehao, et al.
Publicado: (2025)
por: Gao, Xuehao, et al.
Publicado: (2025)
SURPRISE3D: A Dataset for Spatial Understanding and Reasoning in Complex 3D Scenes
por: Huang, Jiaxin, et al.
Publicado: (2025)
por: Huang, Jiaxin, et al.
Publicado: (2025)
CSS: Overcoming Pose and Scene Challenges in Crowd-Sourced 3D Gaussian Splatting
por: Chen, Runze, et al.
Publicado: (2024)
por: Chen, Runze, et al.
Publicado: (2024)
3D-RE-GEN: 3D Reconstruction of Indoor Scenes with a Generative Framework
por: Sautter, Tobias, et al.
Publicado: (2025)
por: Sautter, Tobias, et al.
Publicado: (2025)
Embodied Intelligence for 3D Understanding: A Survey on 3D Scene Question Answering
por: Li, Zechuan, et al.
Publicado: (2025)
por: Li, Zechuan, et al.
Publicado: (2025)
IL3D: A Large-Scale Indoor Layout Dataset for LLM-Driven 3D Scene Generation
por: Zhou, Wenxu, et al.
Publicado: (2025)
por: Zhou, Wenxu, et al.
Publicado: (2025)
Contrastive Language-Colored Pointmap Pretraining for Unified 3D Scene Understanding
por: Mao, Ye, et al.
Publicado: (2026)
por: Mao, Ye, et al.
Publicado: (2026)
Function2Scene: 3D Indoor Scene Layout from Functional Specifications
por: Wang, Ruiqi, et al.
Publicado: (2026)
por: Wang, Ruiqi, et al.
Publicado: (2026)
Domain Aware Multi-Task Pretraining of 3D Swin Transformer for T1-weighted Brain MRI
por: Kim, Jonghun, et al.
Publicado: (2024)
por: Kim, Jonghun, et al.
Publicado: (2024)
Indoor 3D Reconstruction with an Unknown Camera-Projector Pair
por: Qi, Zhaoshuai, et al.
Publicado: (2024)
por: Qi, Zhaoshuai, et al.
Publicado: (2024)
SceneCritic: A Symbolic Evaluator for 3D Indoor Scene Synthesis
por: Sengupta, Kathakoli, et al.
Publicado: (2026)
por: Sengupta, Kathakoli, et al.
Publicado: (2026)
ReScene4D: Temporally Consistent Semantic Instance Segmentation of Evolving Indoor 3D Scenes
por: Steiner, Emily, et al.
Publicado: (2026)
por: Steiner, Emily, et al.
Publicado: (2026)
ARKit LabelMaker: A New Scale for Indoor 3D Scene Understanding
por: Ji, Guangda, et al.
Publicado: (2024)
por: Ji, Guangda, et al.
Publicado: (2024)
M3DLayout: A Multi-Source Dataset of 3D Indoor Layouts and Structured Descriptions for 3D Generation
por: Zhang, Yiheng, et al.
Publicado: (2025)
por: Zhang, Yiheng, et al.
Publicado: (2025)
Style-Consistent 3D Indoor Scene Synthesis with Decoupled Objects
por: Zhang, Yunfan, et al.
Publicado: (2024)
por: Zhang, Yunfan, et al.
Publicado: (2024)
Predicting 3D representations for Dynamic Scenes
por: Qi, Di, et al.
Publicado: (2025)
por: Qi, Di, et al.
Publicado: (2025)
GaussianDWM: 3D Gaussian Driving World Model for Unified Scene Understanding and Multi-Modal Generation
por: Deng, Tianchen, et al.
Publicado: (2025)
por: Deng, Tianchen, et al.
Publicado: (2025)
Ejemplares similares
-
LPA3D: 3D Room-Level Scene Generation from In-the-Wild Images
por: Yang, Ming-Jia, et al.
Publicado: (2025) -
Chorus: Multi-Teacher Pretraining for Holistic 3D Gaussian Scene Encoding
por: Li, Yue, et al.
Publicado: (2025) -
3D Question Answering for City Scene Understanding
por: Sun, Penglei, et al.
Publicado: (2024) -
UnScene3D: Unsupervised 3D Instance Segmentation for Indoor Scenes
por: Rozenberszki, David, et al.
Publicado: (2023) -
GaussianGraph: 3D Gaussian-based Scene Graph Generation for Open-world Scene Understanding
por: Wang, Xihan, et al.
Publicado: (2025)