Any 3D Scene is Worth 1K Tokens: 3D-Grounded Representation for Scene Generation at Scale
Fuente:
arXiv
Saved in:
| Main Authors: | Wei, Dongxu, Xu, Qi, Li, Zhiqi, Zhou, Hangning, Qiu, Cong, Qin, Hailong, Yang, Mu, Cui, Zhaopeng, Liu, Peidong |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Omni-Scene: Omni-Gaussian Representation for Ego-Centric Sparse-View Scene Reconstruction
by: Wei, Dongxu, et al.
Published: (2024)
by: Wei, Dongxu, et al.
Published: (2024)
Fusing in 3D: Free-Viewpoint Fusion Rendering with a 3D Infrared-Visible Scene Representation
by: Yang, Chao, et al.
Published: (2026)
by: Yang, Chao, et al.
Published: (2026)
SIU3R: Simultaneous Scene Understanding and 3D Reconstruction Beyond Feature Alignment
by: Xu, Qi, et al.
Published: (2025)
by: Xu, Qi, et al.
Published: (2025)
Sat2Scene: 3D Urban Scene Generation from Satellite Images with Diffusion
by: Li, Zuoyue, et al.
Published: (2024)
by: Li, Zuoyue, et al.
Published: (2024)
Navigation-Guided Sparse Scene Representation for End-to-End Autonomous Driving
by: Li, Peidong, et al.
Published: (2024)
by: Li, Peidong, et al.
Published: (2024)
InstaScene: Towards Complete 3D Instance Decomposition and Reconstruction from Cluttered Scenes
by: Yang, Zesong, et al.
Published: (2025)
by: Yang, Zesong, et al.
Published: (2025)
HiScene: Creating Hierarchical 3D Scenes with Isometric View Generation
by: Dong, Wenqi, et al.
Published: (2025)
by: Dong, Wenqi, et al.
Published: (2025)
SceneVerse: Scaling 3D Vision-Language Learning for Grounded Scene Understanding
by: Jia, Baoxiong, et al.
Published: (2024)
by: Jia, Baoxiong, et al.
Published: (2024)
Styl3R: Instant 3D Stylized Reconstruction for Arbitrary Scenes and Styles
by: Wang, Peng, et al.
Published: (2025)
by: Wang, Peng, et al.
Published: (2025)
SAI3D: Segment Any Instance in 3D Scenes
by: Yin, Yingda, et al.
Published: (2023)
by: Yin, Yingda, et al.
Published: (2023)
gDist: Efficient Distance Computation between 3D Meshes on GPU
by: Fang, Peng, et al.
Published: (2024)
by: Fang, Peng, et al.
Published: (2024)
DreamMesh4D: Video-to-4D Generation with Sparse-Controlled Gaussian-Mesh Hybrid Representation
by: Li, Zhiqi, et al.
Published: (2024)
by: Li, Zhiqi, et al.
Published: (2024)
Learning to Efficiently Adapt Foundation Models for Self-Supervised Endoscopic 3D Scene Reconstruction from Any Cameras
by: Cui, Beilei, et al.
Published: (2025)
by: Cui, Beilei, et al.
Published: (2025)
MASH: Masked Anchored SpHerical Distances for 3D Shape Representation and Generation
by: Li, Changhao, et al.
Published: (2025)
by: Li, Changhao, et al.
Published: (2025)
DerainNeRF: 3D Scene Estimation with Adhesive Waterdrop Removal
by: Li, Yunhao, et al.
Published: (2024)
by: Li, Yunhao, et al.
Published: (2024)
Scene-R1: Video-Grounded Large Language Models for 3D Scene Reasoning without 3D Annotations
by: Yuan, Zhihao, et al.
Published: (2025)
by: Yuan, Zhihao, et al.
Published: (2025)
A New Geometric Representation for 3D Bijective Mappings and Applications
by: Chen, Qiguang, et al.
Published: (2023)
by: Chen, Qiguang, et al.
Published: (2023)
GenXD: Generating Any 3D and 4D Scenes
by: Zhao, Yuyang, et al.
Published: (2024)
by: Zhao, Yuyang, et al.
Published: (2024)
SAS: Segment Any 3D Scene with Integrated 2D Priors
by: Li, Zhuoyuan, et al.
Published: (2025)
by: Li, Zhuoyuan, et al.
Published: (2025)
3D Space Trajectories and beyond: Abstract Art Creation with 3D Printing
by: Dana-Picard, Thierry, et al.
Published: (2024)
by: Dana-Picard, Thierry, et al.
Published: (2024)
InstructScene: Instruction-Driven 3D Indoor Scene Synthesis with Semantic Graph Prior
by: Lin, Chenguo, et al.
Published: (2024)
by: Lin, Chenguo, et al.
Published: (2024)
Grounding by Remembering: Cross-Scene and In-Scene Memory for 3D Functional Affordances
by: Wang, Qirui, et al.
Published: (2026)
by: Wang, Qirui, et al.
Published: (2026)
SceneTeract: Agentic Functional Affordances and VLM Grounding in 3D Scenes
by: Maillard, Léopold, et al.
Published: (2026)
by: Maillard, Léopold, et al.
Published: (2026)
Gaussian Difference: Find Any Change Instance in 3D Scenes
by: Jiang, Binbin, et al.
Published: (2025)
by: Jiang, Binbin, et al.
Published: (2025)
ChangingGrounding: 3D Visual Grounding in Changing Scenes
by: Hu, Miao, et al.
Published: (2025)
by: Hu, Miao, et al.
Published: (2025)
LSD-3D: Large-Scale 3D Driving Scene Generation with Geometry Grounding
by: Ost, Julian, et al.
Published: (2025)
by: Ost, Julian, et al.
Published: (2025)
Carving Polytopes with Saws in 3D
by: Robson, Eliot W., et al.
Published: (2024)
by: Robson, Eliot W., et al.
Published: (2024)
SceneCOT: Eliciting Grounded Chain-of-Thought Reasoning in 3D Scenes
by: Linghu, Xiongkun, et al.
Published: (2025)
by: Linghu, Xiongkun, et al.
Published: (2025)
Perceptual Crack Detection for Rendered 3D Textured Meshes
by: Sarvestani, Armin Shafiee, et al.
Published: (2024)
by: Sarvestani, Armin Shafiee, et al.
Published: (2024)
PhyScene3D: Physically Consistent Interactive 3D Tabletop Scene Generation
by: Chen, Weixing, et al.
Published: (2026)
by: Chen, Weixing, et al.
Published: (2026)
SceneTok: A Compressed, Diffusable Token Space for 3D Scenes
by: Asim, Mohammad, et al.
Published: (2026)
by: Asim, Mohammad, et al.
Published: (2026)
Convexity Helps Iterated Search in 3D
by: Afshani, Peyman, et al.
Published: (2025)
by: Afshani, Peyman, et al.
Published: (2025)
PanoGrounder: Bridging 2D and 3D with Panoramic Scene Representations for VLM-based 3D Visual Grounding
by: Jung, Seongmin, et al.
Published: (2025)
by: Jung, Seongmin, et al.
Published: (2025)
Segment Any 3D-Part in a Scene from a Sentence
by: Wu, Hongyu, et al.
Published: (2025)
by: Wu, Hongyu, et al.
Published: (2025)
SceMoS: Scene-Aware 3D Human Motion Synthesis by Planning with Geometry-Grounded Tokens
by: Ghosh, Anindita, et al.
Published: (2026)
by: Ghosh, Anindita, et al.
Published: (2026)
Neural Slicer for Multi-Axis 3D Printing
by: Liu, Tao, et al.
Published: (2024)
by: Liu, Tao, et al.
Published: (2024)
Dynamic 3D Convex Hulls Revisited and Applications
by: Wang, Haitao
Published: (2026)
by: Wang, Haitao
Published: (2026)
Grounded String Representations of Series-Parallel Graphs without Transitive Edges
by: Cornelsen, Sabine, et al.
Published: (2026)
by: Cornelsen, Sabine, et al.
Published: (2026)
Scenes as Tokens: Multi-Scale Normal Distributions Transform Tokenizer for General 3D Vision-Language Understanding
by: Tang, Yutao, et al.
Published: (2025)
by: Tang, Yutao, et al.
Published: (2025)
MagicDrive3D: Controllable 3D Generation for Any-View Rendering in Street Scenes
by: Gao, Ruiyuan, et al.
Published: (2024)
by: Gao, Ruiyuan, et al.
Published: (2024)
Similar Items
-
Omni-Scene: Omni-Gaussian Representation for Ego-Centric Sparse-View Scene Reconstruction
by: Wei, Dongxu, et al.
Published: (2024) -
Fusing in 3D: Free-Viewpoint Fusion Rendering with a 3D Infrared-Visible Scene Representation
by: Yang, Chao, et al.
Published: (2026) -
SIU3R: Simultaneous Scene Understanding and 3D Reconstruction Beyond Feature Alignment
by: Xu, Qi, et al.
Published: (2025) -
Sat2Scene: 3D Urban Scene Generation from Satellite Images with Diffusion
by: Li, Zuoyue, et al.
Published: (2024) -
Navigation-Guided Sparse Scene Representation for End-to-End Autonomous Driving
by: Li, Peidong, et al.
Published: (2024)