GroundFlow: A Plug-in Module for Temporal Reasoning on 3D Point Cloud Sequential Grounding
Fuente:
arXiv
Guardado en:
| Autores principales: | Lin, Zijun, He, Shuting, Tan, Cheston, Wen, Bihan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
RSGround-R1: Rethinking Remote Sensing Visual Grounding through Spatial Reasoning
por: Huang, Shiqi, et al.
Publicado: (2026)
por: Huang, Shiqi, et al.
Publicado: (2026)
SegPoint: Segment Any Point Cloud via Large Language Model
por: He, Shuting, et al.
Publicado: (2024)
por: He, Shuting, et al.
Publicado: (2024)
STUPD: A Synthetic Dataset for Spatial and Temporal Relation Reasoning
por: Agrawal, Palaash, et al.
Publicado: (2023)
por: Agrawal, Palaash, et al.
Publicado: (2023)
Human-like compositional learning of visually-grounded concepts using synthetic environments
por: Lin, Zijun, et al.
Publicado: (2025)
por: Lin, Zijun, et al.
Publicado: (2025)
ZoRI: Towards Discriminative Zero-Shot Remote Sensing Instance Segmentation
por: Huang, Shiqi, et al.
Publicado: (2024)
por: Huang, Shiqi, et al.
Publicado: (2024)
SCORE: Scene Context Matters in Open-Vocabulary Remote Sensing Instance Segmentation
por: Huang, Shiqi, et al.
Publicado: (2025)
por: Huang, Shiqi, et al.
Publicado: (2025)
WBCAtt+: Fine-Grained Pixel-Level Morphological Annotations for White Blood Cell Images
por: Tsutsui, Satoshi, et al.
Publicado: (2026)
por: Tsutsui, Satoshi, et al.
Publicado: (2026)
Plug-and-Play Grounding of Reasoning in Multimodal Large Language Models
por: Chen, Jiaxing, et al.
Publicado: (2024)
por: Chen, Jiaxing, et al.
Publicado: (2024)
FugSeg: Fast Uncertainty-aware Ground Segmentation for 3D Point Cloud
por: Li, Yu, et al.
Publicado: (2026)
por: Li, Yu, et al.
Publicado: (2026)
Foresee-to-Ground: From Predictive Temporal Perception to Evidence-Driven Reasoning for Video Temporal Grounding
por: Zheng, Zelin, et al.
Publicado: (2026)
por: Zheng, Zelin, et al.
Publicado: (2026)
ProxyTransformation: Preshaping Point Cloud Manifold With Proxy Attention For 3D Visual Grounding
por: Peng, Qihang, et al.
Publicado: (2025)
por: Peng, Qihang, et al.
Publicado: (2025)
GroundGrid:LiDAR Point Cloud Ground Segmentation and Terrain Estimation
por: Steinke, Nicolai, et al.
Publicado: (2024)
por: Steinke, Nicolai, et al.
Publicado: (2024)
Task-oriented Sequential Grounding and Navigation in 3D Scenes
por: Zhang, Zhuofan, et al.
Publicado: (2024)
por: Zhang, Zhuofan, et al.
Publicado: (2024)
Point-RFT: Improving Multimodal Reasoning with Visually Grounded Reinforcement Finetuning
por: Ni, Minheng, et al.
Publicado: (2025)
por: Ni, Minheng, et al.
Publicado: (2025)
VideoMolmo: Spatio-Temporal Grounding Meets Pointing
por: Ahmad, Ghazi Shazan, et al.
Publicado: (2025)
por: Ahmad, Ghazi Shazan, et al.
Publicado: (2025)
UniFunc3D: Unified Active Spatial-Temporal Grounding for 3D Functionality Segmentation
por: Lin, Jiaying, et al.
Publicado: (2026)
por: Lin, Jiaying, et al.
Publicado: (2026)
MBPU: A Plug-and-Play State Space Model for Point Cloud Upsamping with Fast Point Rendering
por: Song, Jiayi, et al.
Publicado: (2024)
por: Song, Jiayi, et al.
Publicado: (2024)
Inferring Past Human Actions in Homes with Abductive Reasoning
por: Tan, Clement, et al.
Publicado: (2022)
por: Tan, Clement, et al.
Publicado: (2022)
VideoMind: A Chain-of-LoRA Agent for Temporal-Grounded Video Reasoning
por: Liu, Ye, et al.
Publicado: (2025)
por: Liu, Ye, et al.
Publicado: (2025)
VGent: Visual Grounding via Modular Design for Disentangling Reasoning and Prediction
por: Kang, Weitai, et al.
Publicado: (2025)
por: Kang, Weitai, et al.
Publicado: (2025)
ChangingGrounding: 3D Visual Grounding in Changing Scenes
por: Hu, Miao, et al.
Publicado: (2025)
por: Hu, Miao, et al.
Publicado: (2025)
Seq2Time: Sequential Knowledge Transfer for Video LLM Temporal Grounding
por: Deng, Andong, et al.
Publicado: (2024)
por: Deng, Andong, et al.
Publicado: (2024)
Ground Awareness in Deep Learning for Large Outdoor Point Cloud Segmentation
por: Qiu, Kevin, et al.
Publicado: (2025)
por: Qiu, Kevin, et al.
Publicado: (2025)
E.M.Ground: A Temporal Grounding Vid-LLM with Holistic Event Perception and Matching
por: Nie, Jiahao, et al.
Publicado: (2026)
por: Nie, Jiahao, et al.
Publicado: (2026)
PointSt3R: Point Tracking through 3D Grounded Correspondence
por: Guerrier, Rhodri, et al.
Publicado: (2025)
por: Guerrier, Rhodri, et al.
Publicado: (2025)
CLIPoint3D: Language-Grounded Few-Shot Unsupervised 3D Point Cloud Domain Adaptation
por: Singha, Mainak, et al.
Publicado: (2026)
por: Singha, Mainak, et al.
Publicado: (2026)
CheXTemporal: A Dataset for Temporally-Grounded Reasoning in Chest Radiography
por: Prakash, Eva, et al.
Publicado: (2026)
por: Prakash, Eva, et al.
Publicado: (2026)
VTimeCoT: Thinking by Drawing for Video Temporal Grounding and Reasoning
por: Zhang, Jinglei, et al.
Publicado: (2025)
por: Zhang, Jinglei, et al.
Publicado: (2025)
A Survey on Video Temporal Grounding with Multimodal Large Language Model
por: Wu, Jianlong, et al.
Publicado: (2025)
por: Wu, Jianlong, et al.
Publicado: (2025)
R2G: Reasoning to Ground in 3D Scenes
por: Li, Yixuan, et al.
Publicado: (2024)
por: Li, Yixuan, et al.
Publicado: (2024)
RefMask3D: Language-Guided Transformer for 3D Referring Segmentation
por: He, Shuting, et al.
Publicado: (2024)
por: He, Shuting, et al.
Publicado: (2024)
T2SGrid: Temporal-to-Spatial Gridification for Video Temporal Grounding
por: Guo, Chaohong, et al.
Publicado: (2026)
por: Guo, Chaohong, et al.
Publicado: (2026)
Flow AM: Generating Point Cloud Global Explanations by Latent Alignment
por: Tan, Hanxiao
Publicado: (2024)
por: Tan, Hanxiao
Publicado: (2024)
SymmCompletion: High-Fidelity and High-Consistency Point Cloud Completion with Symmetry Guidance
por: Yan, Hongyu, et al.
Publicado: (2025)
por: Yan, Hongyu, et al.
Publicado: (2025)
Reasoning Matters for 3D Visual Grounding
por: Huang, Hsiang-Wei, et al.
Publicado: (2026)
por: Huang, Hsiang-Wei, et al.
Publicado: (2026)
Hierarchical Alignment-enhanced Adaptive Grounding Network for Generalized Referring Expression Comprehension
por: Wang, Yaxian, et al.
Publicado: (2025)
por: Wang, Yaxian, et al.
Publicado: (2025)
GS-Net: Generalizable Plug-and-Play 3D Gaussian Splatting Module
por: Zhang, Yichen, et al.
Publicado: (2024)
por: Zhang, Yichen, et al.
Publicado: (2024)
Talk2PC: Enhancing 3D Visual Grounding through LiDAR and Radar Point Clouds Fusion for Autonomous Driving
por: Guan, Runwei, et al.
Publicado: (2025)
por: Guan, Runwei, et al.
Publicado: (2025)
EvoGround: Self-Evolving Video Agents for Video Temporal Grounding
por: Jung, Minjoon, et al.
Publicado: (2026)
por: Jung, Minjoon, et al.
Publicado: (2026)
Agentic Spatio-Temporal Grounding via Collaborative Reasoning
por: Zhao, Heng, et al.
Publicado: (2026)
por: Zhao, Heng, et al.
Publicado: (2026)
Ejemplares similares
-
RSGround-R1: Rethinking Remote Sensing Visual Grounding through Spatial Reasoning
por: Huang, Shiqi, et al.
Publicado: (2026) -
SegPoint: Segment Any Point Cloud via Large Language Model
por: He, Shuting, et al.
Publicado: (2024) -
STUPD: A Synthetic Dataset for Spatial and Temporal Relation Reasoning
por: Agrawal, Palaash, et al.
Publicado: (2023) -
Human-like compositional learning of visually-grounded concepts using synthetic environments
por: Lin, Zijun, et al.
Publicado: (2025) -
ZoRI: Towards Discriminative Zero-Shot Remote Sensing Instance Segmentation
por: Huang, Shiqi, et al.
Publicado: (2024)