Pointmap Association and Piecewise-Plane Constraint for Consistent and Compact 3D Gaussian Segmentation Field
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Hu, Wenhao, Chai, Wenhao, Hao, Shengyu, Cui, Xiaotong, Wen, Xuexiang, Hwang, Jenq-Neng, Wang, Gaoang |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
DSG-World: Learning a 3D Gaussian World Model from Dual State Videos
von: Hu, Wenhao, et al.
Veröffentlicht: (2025)
von: Hu, Wenhao, et al.
Veröffentlicht: (2025)
CityGen: Infinite and Controllable City Layout Generation
von: Deng, Jie, et al.
Veröffentlicht: (2023)
von: Deng, Jie, et al.
Veröffentlicht: (2023)
MPM: A Unified 2D-3D Human Pose Representation via Masked Pose Modeling
von: Zhang, Zhenyu, et al.
Veröffentlicht: (2023)
von: Zhang, Zhenyu, et al.
Veröffentlicht: (2023)
CityCraft: A Real Crafter for 3D City Generation
von: Deng, Jie, et al.
Veröffentlicht: (2024)
von: Deng, Jie, et al.
Veröffentlicht: (2024)
MovieChat+: Question-aware Sparse Memory for Long Video Question Answering
von: Song, Enxin, et al.
Veröffentlicht: (2024)
von: Song, Enxin, et al.
Veröffentlicht: (2024)
Recent Advances in Embedding Methods for Multi-Object Tracking: A Survey
von: Wang, Gaoang, et al.
Veröffentlicht: (2022)
von: Wang, Gaoang, et al.
Veröffentlicht: (2022)
IGFuse: Interactive 3D Gaussian Scene Reconstruction via Multi-Scans Fusion
von: Hu, Wenhao, et al.
Veröffentlicht: (2025)
von: Hu, Wenhao, et al.
Veröffentlicht: (2025)
AuroraLong: Bringing RNNs Back to Efficient Open-Ended Video Understanding
von: Xu, Weili, et al.
Veröffentlicht: (2025)
von: Xu, Weili, et al.
Veröffentlicht: (2025)
SAMURAI: Adapting Segment Anything Model for Zero-Shot Visual Tracking with Motion-Aware Memory
von: Yang, Cheng-Yen, et al.
Veröffentlicht: (2024)
von: Yang, Cheng-Yen, et al.
Veröffentlicht: (2024)
Reasoning Matters for 3D Visual Grounding
von: Huang, Hsiang-Wei, et al.
Veröffentlicht: (2026)
von: Huang, Hsiang-Wei, et al.
Veröffentlicht: (2026)
Outdoor Monocular SLAM with Global Scale-Consistent 3D Gaussian Pointmaps
von: Cheng, Chong, et al.
Veröffentlicht: (2025)
von: Cheng, Chong, et al.
Veröffentlicht: (2025)
MambaMOT: State-Space Model as Motion Predictor for Multi-Object Tracking
von: Huang, Hsiang-Wei, et al.
Veröffentlicht: (2024)
von: Huang, Hsiang-Wei, et al.
Veröffentlicht: (2024)
VersaT2I: Improving Text-to-Image Models with Versatile Reward
von: Guo, Jianshu, et al.
Veröffentlicht: (2024)
von: Guo, Jianshu, et al.
Veröffentlicht: (2024)
ToSA: Token Merging with Spatial Awareness
von: Huang, Hsiang-Wei, et al.
Veröffentlicht: (2025)
von: Huang, Hsiang-Wei, et al.
Veröffentlicht: (2025)
UniHPR: Unified Human Pose Representation via Singular Value Contrastive Learning
von: Jiang, Zhongyu, et al.
Veröffentlicht: (2025)
von: Jiang, Zhongyu, et al.
Veröffentlicht: (2025)
Hand3R: Online 4D Hand-Scene Reconstruction in the Wild
von: Hu, Wendi, et al.
Veröffentlicht: (2026)
von: Hu, Wendi, et al.
Veröffentlicht: (2026)
RT-Pose: A 4D Radar Tensor-based 3D Human Pose Estimation and Localization Benchmark
von: Ho, Yuan-Hao, et al.
Veröffentlicht: (2024)
von: Ho, Yuan-Hao, et al.
Veröffentlicht: (2024)
Blind Inpainting with Object-aware Discrimination for Artificial Marker Removal
von: Guo, Xuechen, et al.
Veröffentlicht: (2023)
von: Guo, Xuechen, et al.
Veröffentlicht: (2023)
PackDiT: Joint Human Motion and Text Generation via Mutual Prompting
von: Jiang, Zhongyu, et al.
Veröffentlicht: (2025)
von: Jiang, Zhongyu, et al.
Veröffentlicht: (2025)
Ego3DT: Tracking Every 3D Object in Ego-centric Videos
von: Hao, Shengyu, et al.
Veröffentlicht: (2024)
von: Hao, Shengyu, et al.
Veröffentlicht: (2024)
Verifier-Free RL for LLMs via Intrinsic Gradient-Norm Reward
von: Wen, Xuexiang, et al.
Veröffentlicht: (2026)
von: Wen, Xuexiang, et al.
Veröffentlicht: (2026)
Attention Consistency for LLMs Explanation
von: Lan, Tian, et al.
Veröffentlicht: (2025)
von: Lan, Tian, et al.
Veröffentlicht: (2025)
ScalingGaussian: Enhancing 3D Content Creation with Generative Gaussian Splatting
von: Chen, Shen, et al.
Veröffentlicht: (2024)
von: Chen, Shen, et al.
Veröffentlicht: (2024)
See and Think: Embodied Agent in Virtual Environment
von: Zhao, Zhonghan, et al.
Veröffentlicht: (2023)
von: Zhao, Zhonghan, et al.
Veröffentlicht: (2023)
Boosting Online 3D Multi-Object Tracking through Camera-Radar Cross Check
von: Kuan, Sheng-Yao, et al.
Veröffentlicht: (2024)
von: Kuan, Sheng-Yao, et al.
Veröffentlicht: (2024)
LLaVA-Ultra: Large Chinese Language and Vision Assistant for Ultrasound
von: Guo, Xuechen, et al.
Veröffentlicht: (2024)
von: Guo, Xuechen, et al.
Veröffentlicht: (2024)
Smoothing Spline Semi‐Parametric Non‐Gaussian Structural Vector Autoregressive Models
von: Wenhao Cui
Veröffentlicht: (2025)
von: Wenhao Cui
Veröffentlicht: (2025)
MovieChat: From Dense Token to Sparse Memory for Long Video Understanding
von: Song, Enxin, et al.
Veröffentlicht: (2023)
von: Song, Enxin, et al.
Veröffentlicht: (2023)
MonoTAKD: Teaching Assistant Knowledge Distillation for Monocular 3D Object Detection
von: Liu, Hou-I, et al.
Veröffentlicht: (2024)
von: Liu, Hou-I, et al.
Veröffentlicht: (2024)
User-Aware Prefix-Tuning is a Good Learner for Personalized Image Captioning
von: Wang, Xuan, et al.
Veröffentlicht: (2023)
von: Wang, Xuan, et al.
Veröffentlicht: (2023)
Pointmap-Conditioned Diffusion for Consistent Novel View Synthesis
von: Nguyen, Thang-Anh-Quan, et al.
Veröffentlicht: (2025)
von: Nguyen, Thang-Anh-Quan, et al.
Veröffentlicht: (2025)
Understanding Dynamic Scenes in Ego Centric 4D Point Clouds
von: Huang, Junsheng, et al.
Veröffentlicht: (2025)
von: Huang, Junsheng, et al.
Veröffentlicht: (2025)
3DSceneEditor: Controllable 3D Scene Editing with Gaussian Splatting
von: Yan, Ziyang, et al.
Veröffentlicht: (2024)
von: Yan, Ziyang, et al.
Veröffentlicht: (2024)
Learning to Learn Weight Generation via Local Consistency Diffusion
von: Guan, Yunchuan, et al.
Veröffentlicht: (2025)
von: Guan, Yunchuan, et al.
Veröffentlicht: (2025)
Understanding Identity Continuity in Thermal Video through Scene-Level Consistency
von: Sun, Wei-Chieh, et al.
Veröffentlicht: (2026)
von: Sun, Wei-Chieh, et al.
Veröffentlicht: (2026)
AuroraCap: Efficient, Performant Video Detailed Captioning and a New Benchmark
von: Chai, Wenhao, et al.
Veröffentlicht: (2024)
von: Chai, Wenhao, et al.
Veröffentlicht: (2024)
Video-MMLU: A Massive Multi-Discipline Lecture Understanding Benchmark
von: Song, Enxin, et al.
Veröffentlicht: (2025)
von: Song, Enxin, et al.
Veröffentlicht: (2025)
Causal Reasoning Elicits Controllable 3D Scene Generation
von: Chen, Shen, et al.
Veröffentlicht: (2025)
von: Chen, Shen, et al.
Veröffentlicht: (2025)
RecurGS: Interactive Scene Modeling via Discrete-State Recurrent Gaussian Fusion
von: Hu, Wenhao, et al.
Veröffentlicht: (2025)
von: Hu, Wenhao, et al.
Veröffentlicht: (2025)
POMATO: Marrying Pointmap Matching with Temporal Motion for Dynamic 3D Reconstruction
von: Zhang, Songyan, et al.
Veröffentlicht: (2025)
von: Zhang, Songyan, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
DSG-World: Learning a 3D Gaussian World Model from Dual State Videos
von: Hu, Wenhao, et al.
Veröffentlicht: (2025) -
CityGen: Infinite and Controllable City Layout Generation
von: Deng, Jie, et al.
Veröffentlicht: (2023) -
MPM: A Unified 2D-3D Human Pose Representation via Masked Pose Modeling
von: Zhang, Zhenyu, et al.
Veröffentlicht: (2023) -
CityCraft: A Real Crafter for 3D City Generation
von: Deng, Jie, et al.
Veröffentlicht: (2024) -
MovieChat+: Question-aware Sparse Memory for Long Video Question Answering
von: Song, Enxin, et al.
Veröffentlicht: (2024)