Shape2Scene: 3D Scene Representation Learning Through Pre-training on Shape Data
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Feng, Tuo, Wang, Wenguan, Quan, Ruijie, Yang, Yi |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Moving Beyond Diffusion: Hierarchy-to-Hierarchy Autoregression for fMRI-to-Image Reconstruction
par: Zhang, Xu, et autres
Publié: (2025)
par: Zhang, Xu, et autres
Publié: (2025)
Mutual Learning for Acoustic Matching and Dereverberation via Visual Scene-driven Diffusion
par: Ma, Jian, et autres
Publié: (2024)
par: Ma, Jian, et autres
Publié: (2024)
General and Task-Oriented Video Segmentation
par: Chen, Mu, et autres
Publié: (2024)
par: Chen, Mu, et autres
Publié: (2024)
3D-SceneDreamer: Text-Driven 3D-Consistent Scene Generation
par: Zhang, Frank, et autres
Publié: (2024)
par: Zhang, Frank, et autres
Publié: (2024)
Text-Scene: A Scene-to-Language Parsing Framework for 3D Scene Understanding
par: Li, Haoyuan, et autres
Publié: (2025)
par: Li, Haoyuan, et autres
Publié: (2025)
BetterScene: 3D Scene Synthesis with Representation-Aligned Generative Model
par: Han, Yuci, et autres
Publié: (2026)
par: Han, Yuci, et autres
Publié: (2026)
CLIP4STR: A Simple Baseline for Scene Text Recognition with Pre-trained Vision-Language Model
par: Zhao, Shuai, et autres
Publié: (2023)
par: Zhao, Shuai, et autres
Publié: (2023)
ArtiScene: Language-Driven Artistic 3D Scene Generation Through Image Intermediary
par: Gu, Zeqi, et autres
Publié: (2025)
par: Gu, Zeqi, et autres
Publié: (2025)
LT3SD: Latent Trees for 3D Scene Diffusion
par: Meng, Quan, et autres
Publié: (2024)
par: Meng, Quan, et autres
Publié: (2024)
HexPlane Representation for 3D Semantic Scene Understanding
par: Chen, Zeren, et autres
Publié: (2025)
par: Chen, Zeren, et autres
Publié: (2025)
From Easy to Hard: Learning Curricular Shape-aware Features for Robust Panoptic Scene Graph Generation
par: Shi, Hanrong, et autres
Publié: (2024)
par: Shi, Hanrong, et autres
Publié: (2024)
DNTextSpotter: Arbitrary-Shaped Scene Text Spotting via Improved Denoising Training
par: Xie, Yu, et autres
Publié: (2024)
par: Xie, Yu, et autres
Publié: (2024)
PaSCo: Urban 3D Panoptic Scene Completion with Uncertainty Awareness
par: Cao, Anh-Quan, et autres
Publié: (2023)
par: Cao, Anh-Quan, et autres
Publié: (2023)
ReFlow: Self-correction Motion Learning for Dynamic Scene Reconstruction
par: Liang, Yanzhe, et autres
Publié: (2026)
par: Liang, Yanzhe, et autres
Publié: (2026)
Lifting Unlabeled Internet-level Data for 3D Scene Understanding
par: Chen, Yixin, et autres
Publié: (2026)
par: Chen, Yixin, et autres
Publié: (2026)
LSK3DNet: Towards Effective and Efficient 3D Perception with Large Sparse Kernels
par: Feng, Tuo, et autres
Publié: (2024)
par: Feng, Tuo, et autres
Publié: (2024)
Towards Data-and Knowledge-Driven Artificial Intelligence: A Survey on Neuro-Symbolic Computing
par: Wang, Wenguan, et autres
Publié: (2022)
par: Wang, Wenguan, et autres
Publié: (2022)
SceneCOT: Eliciting Grounded Chain-of-Thought Reasoning in 3D Scenes
par: Linghu, Xiongkun, et autres
Publié: (2025)
par: Linghu, Xiongkun, et autres
Publié: (2025)
FurniScene: A Large-scale 3D Room Dataset with Intricate Furnishing Scenes
par: Zhang, Genghao, et autres
Publié: (2024)
par: Zhang, Genghao, et autres
Publié: (2024)
Masked Scene Modeling: Narrowing the Gap Between Supervised and Self-Supervised Learning in 3D Scene Understanding
par: Hermosilla, Pedro, et autres
Publié: (2025)
par: Hermosilla, Pedro, et autres
Publié: (2025)
DreamScene360: Unconstrained Text-to-3D Scene Generation with Panoramic Gaussian Splatting
par: Zhou, Shijie, et autres
Publié: (2024)
par: Zhou, Shijie, et autres
Publié: (2024)
A Survey on 3D Gaussian Splatting
par: Chen, Guikun, et autres
Publié: (2024)
par: Chen, Guikun, et autres
Publié: (2024)
GenXD: Generating Any 3D and 4D Scenes
par: Zhao, Yuyang, et autres
Publié: (2024)
par: Zhao, Yuyang, et autres
Publié: (2024)
Multi-modal Relation Distillation for Unified 3D Representation Learning
par: Wang, Huiqun, et autres
Publié: (2024)
par: Wang, Huiqun, et autres
Publié: (2024)
SceneGen: Single-Image 3D Scene Generation in One Feedforward Pass
par: Meng, Yanxu, et autres
Publié: (2025)
par: Meng, Yanxu, et autres
Publié: (2025)
TractShapeNet: Efficient Multi-Shape Learning with 3D Tractography Point Clouds
par: Lo, Yui, et autres
Publié: (2024)
par: Lo, Yui, et autres
Publié: (2024)
PaintScene4D: Consistent 4D Scene Generation from Text Prompts
par: Gupta, Vinayak, et autres
Publié: (2024)
par: Gupta, Vinayak, et autres
Publié: (2024)
DenseScan: Advancing 3D Scene Understanding with 2D Dense Annotation
par: Wang, Zirui, et autres
Publié: (2025)
par: Wang, Zirui, et autres
Publié: (2025)
Grounding 3D Scene Affordance From Egocentric Interactions
par: Liu, Cuiyu, et autres
Publié: (2024)
par: Liu, Cuiyu, et autres
Publié: (2024)
MetaFind: Scene-Aware 3D Asset Retrieval for Coherent Metaverse Scene Generation
par: Pan, Zhenyu, et autres
Publié: (2025)
par: Pan, Zhenyu, et autres
Publié: (2025)
SceneMaker: Open-set 3D Scene Generation with Decoupled De-occlusion and Pose Estimation Model
par: Shi, Yukai, et autres
Publié: (2025)
par: Shi, Yukai, et autres
Publié: (2025)
Constructing a 3D Scene from a Single Image
par: Zheng, Kaizhi, et autres
Publié: (2025)
par: Zheng, Kaizhi, et autres
Publié: (2025)
RegionPLC: Regional Point-Language Contrastive Learning for Open-World 3D Scene Understanding
par: Yang, Jihan, et autres
Publié: (2023)
par: Yang, Jihan, et autres
Publié: (2023)
OptiScene: LLM-driven Indoor Scene Layout Generation via Scaled Human-aligned Data Synthesis and Multi-Stage Preference Optimization
par: Yang, Yixuan, et autres
Publié: (2025)
par: Yang, Yixuan, et autres
Publié: (2025)
Unified Editing of Panorama, 3D Scenes, and Videos Through Disentangled Self-Attention Injection
par: Kwon, Gihyun, et autres
Publié: (2024)
par: Kwon, Gihyun, et autres
Publié: (2024)
NavCrafter: Exploring 3D Scenes from a Single Image
par: Duan, Hongbo, et autres
Publié: (2026)
par: Duan, Hongbo, et autres
Publié: (2026)
Open-Vocabulary Functional 3D Human-Scene Interaction Generation
par: Liu, Jie, et autres
Publié: (2026)
par: Liu, Jie, et autres
Publié: (2026)
Scene Splatter: Momentum 3D Scene Generation from Single Image with Video Diffusion Model
par: Zhang, Shengjun, et autres
Publié: (2025)
par: Zhang, Shengjun, et autres
Publié: (2025)
OpenGS-SLAM: Open-Set Dense Semantic SLAM with 3D Gaussian Splatting for Object-Level Scene Understanding
par: Yang, Dianyi, et autres
Publié: (2025)
par: Yang, Dianyi, et autres
Publié: (2025)
Nonverbal Interaction Detection
par: Wei, Jianan, et autres
Publié: (2024)
par: Wei, Jianan, et autres
Publié: (2024)
Documents similaires
-
Moving Beyond Diffusion: Hierarchy-to-Hierarchy Autoregression for fMRI-to-Image Reconstruction
par: Zhang, Xu, et autres
Publié: (2025) -
Mutual Learning for Acoustic Matching and Dereverberation via Visual Scene-driven Diffusion
par: Ma, Jian, et autres
Publié: (2024) -
General and Task-Oriented Video Segmentation
par: Chen, Mu, et autres
Publié: (2024) -
3D-SceneDreamer: Text-Driven 3D-Consistent Scene Generation
par: Zhang, Frank, et autres
Publié: (2024) -
Text-Scene: A Scene-to-Language Parsing Framework for 3D Scene Understanding
par: Li, Haoyuan, et autres
Publié: (2025)