DyGEnc: Encoding a Sequence of Textual Scene Graphs to Reason and Answer Questions in Dynamic Scenes
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Linok, Sergey, Semenov, Vadim, Trunova, Anastasia, Bulichev, Oleg, Yudin, Dmitry |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Open-Vocabulary Indoor Object Grounding with 3D Hierarchical Scene Graph
par: Linok, Sergey, et autres
Publié: (2025)
par: Linok, Sergey, et autres
Publié: (2025)
Beyond Bare Queries: Open-Vocabulary Object Grounding with 3D Scene Graph
par: Linok, Sergey, et autres
Publié: (2024)
par: Linok, Sergey, et autres
Publié: (2024)
SceneGraphVLM: Dynamic Scene Graph Generation from Video with Vision-Language Models
par: Makarov, Vladislav, et autres
Publié: (2026)
par: Makarov, Vladislav, et autres
Publié: (2026)
3DGraphLLM: Combining Semantic Graphs and Large Language Models for 3D Scene Understanding
par: Zemskova, Tatiana, et autres
Publié: (2024)
par: Zemskova, Tatiana, et autres
Publié: (2024)
PRISM-Loc: a Lightweight Long-range LiDAR Localization in Urban Environments with Topological Maps
par: Muravyev, Kirill, et autres
Publié: (2025)
par: Muravyev, Kirill, et autres
Publié: (2025)
M3DMap: Object-aware Multimodal 3D Mapping for Dynamic Environments
par: Yudin, Dmitry
Publié: (2025)
par: Yudin, Dmitry
Publié: (2025)
Salient Temporal Encoding for Dynamic Scene Graph Generation
par: Zhu, Zhihao
Publié: (2025)
par: Zhu, Zhihao
Publié: (2025)
S-DyRF: Reference-Based Stylized Radiance Fields for Dynamic Scenes
par: Li, Xingyi, et autres
Publié: (2024)
par: Li, Xingyi, et autres
Publié: (2024)
TextPSG: Panoptic Scene Graph Generation from Textual Descriptions
par: Zhao, Chengyang, et autres
Publié: (2023)
par: Zhao, Chengyang, et autres
Publié: (2023)
SceneLinker: Compositional 3D Scene Generation via Semantic Scene Graph from RGB Sequences
par: Kim, Seok-Young, et autres
Publié: (2026)
par: Kim, Seok-Young, et autres
Publié: (2026)
SceneLLM: Implicit Language Reasoning in LLM for Dynamic Scene Graph Generation
par: Zhang, Hang, et autres
Publié: (2024)
par: Zhang, Hang, et autres
Publié: (2024)
FocusGraph: Graph-Structured Frame Selection for Embodied Long Video Question Answering
par: Zemskova, Tatiana, et autres
Publié: (2026)
par: Zemskova, Tatiana, et autres
Publié: (2026)
FDSG: Forecasting Dynamic Scene Graphs
par: Yang, Yi, et autres
Publié: (2025)
par: Yang, Yi, et autres
Publié: (2025)
VIZOR: Viewpoint-Invariant Zero-Shot Scene Graph Generation for 3D Scene Reasoning
par: Madhavaram, Vivek, et autres
Publié: (2026)
par: Madhavaram, Vivek, et autres
Publié: (2026)
RCDINO: Enhancing Radar-Camera 3D Object Detection with DINOv2 Semantic Features
par: Matykina, Olga, et autres
Publié: (2025)
par: Matykina, Olga, et autres
Publié: (2025)
SceneAlign: Aligning Multimodal Reasoning to Scene Graphs in Complex Visual Scenes
par: Wang, Chuhan, et autres
Publié: (2026)
par: Wang, Chuhan, et autres
Publié: (2026)
Free-DyGS: Camera-Pose-Free Scene Reconstruction for Dynamic Surgical Videos with Gaussian Splatting
par: Li, Qian, et autres
Publié: (2024)
par: Li, Qian, et autres
Publié: (2024)
ProDyG: Progressive Dynamic Scene Reconstruction via Gaussian Splatting from Monocular Videos
par: Chen, Shi, et autres
Publié: (2025)
par: Chen, Shi, et autres
Publié: (2025)
CommonScenes: Generating Commonsense 3D Indoor Scenes with Scene Graph Diffusion
par: Zhai, Guangyao, et autres
Publié: (2023)
par: Zhai, Guangyao, et autres
Publié: (2023)
Multiview Scene Graph
par: Zhang, Juexiao, et autres
Publié: (2024)
par: Zhang, Juexiao, et autres
Publié: (2024)
Vision-Free Retrieval: Rethinking Multimodal Search with Textual Scene Descriptions
par: Ntinou, Ioanna, et autres
Publié: (2025)
par: Ntinou, Ioanna, et autres
Publié: (2025)
STRIDE-QA: Visual Question Answering Dataset for Spatiotemporal Reasoning in Urban Driving Scenes
par: Ishihara, Keishi, et autres
Publié: (2025)
par: Ishihara, Keishi, et autres
Publié: (2025)
DDS: Decoupled Dynamic Scene-Graph Generation Network
par: Iftekhar, A S M, et autres
Publié: (2023)
par: Iftekhar, A S M, et autres
Publié: (2023)
GeoSceneGraph: Geometric Scene Graph Diffusion Model for Text-guided 3D Indoor Scene Synthesis
par: Ruiz, Antonio, et autres
Publié: (2025)
par: Ruiz, Antonio, et autres
Publié: (2025)
Adaptive Visual Scene Understanding: Incremental Scene Graph Generation
par: Khandelwal, Naitik, et autres
Publié: (2023)
par: Khandelwal, Naitik, et autres
Publié: (2023)
LocalDyGS: Multi-view Global Dynamic Scene Modeling via Adaptive Local Implicit Feature Decoupling
par: Wu, Jiahao, et autres
Publié: (2025)
par: Wu, Jiahao, et autres
Publié: (2025)
Estimating Commonsense Scene Composition on Belief Scene Graphs
par: Saucedo, Mario A. V., et autres
Publié: (2025)
par: Saucedo, Mario A. V., et autres
Publié: (2025)
Edge-Centric Relational Reasoning for 3D Scene Graph Prediction
par: Ma, Yanni, et autres
Publié: (2025)
par: Ma, Yanni, et autres
Publié: (2025)
Frequency-guided Multi-level Reasoning for Scene Graph Generation in Video
par: Li, Chenxing, et autres
Publié: (2026)
par: Li, Chenxing, et autres
Publié: (2026)
ProSGNeRF: Progressive Dynamic Neural Scene Graph with Frequency Modulated Foundation Model in Urban Scenes
par: Deng, Tianchen, et autres
Publié: (2023)
par: Deng, Tianchen, et autres
Publié: (2023)
Controllable 3D Outdoor Scene Generation via Scene Graphs
par: Liu, Yuheng, et autres
Publié: (2025)
par: Liu, Yuheng, et autres
Publié: (2025)
TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition
par: Yang, Xiahan, et autres
Publié: (2025)
par: Yang, Xiahan, et autres
Publié: (2025)
Color-Encoded Illumination for High-Speed Volumetric Scene Reconstruction
par: Novikov, David, et autres
Publié: (2026)
par: Novikov, David, et autres
Publié: (2026)
Multi-Level Neural Scene Graphs for Dynamic Urban Environments
par: Fischer, Tobias, et autres
Publié: (2024)
par: Fischer, Tobias, et autres
Publié: (2024)
Beyond Scanpaths: Graph-Based Gaze Simulation in Dynamic Scenes
par: Palmer, Luke, et autres
Publié: (2026)
par: Palmer, Luke, et autres
Publié: (2026)
Universal Scene Graph Generation
par: Wu, Shengqiong, et autres
Publié: (2025)
par: Wu, Shengqiong, et autres
Publié: (2025)
HSG: Hyperbolic Scene Graph
par: Wang, Liyang, et autres
Publié: (2026)
par: Wang, Liyang, et autres
Publié: (2026)
SceneGraphLoc: Cross-Modal Coarse Visual Localization on 3D Scene Graphs
par: Miao, Yang, et autres
Publié: (2024)
par: Miao, Yang, et autres
Publié: (2024)
3D Question Answering for City Scene Understanding
par: Sun, Penglei, et autres
Publié: (2024)
par: Sun, Penglei, et autres
Publié: (2024)
DGSG-Mind: Dynamic 3D Gaussian Scene Graphs for Long-Term Scene Understanding and Grounding
par: Ge, Luzhou, et autres
Publié: (2026)
par: Ge, Luzhou, et autres
Publié: (2026)
Documents similaires
-
Open-Vocabulary Indoor Object Grounding with 3D Hierarchical Scene Graph
par: Linok, Sergey, et autres
Publié: (2025) -
Beyond Bare Queries: Open-Vocabulary Object Grounding with 3D Scene Graph
par: Linok, Sergey, et autres
Publié: (2024) -
SceneGraphVLM: Dynamic Scene Graph Generation from Video with Vision-Language Models
par: Makarov, Vladislav, et autres
Publié: (2026) -
3DGraphLLM: Combining Semantic Graphs and Large Language Models for 3D Scene Understanding
par: Zemskova, Tatiana, et autres
Publié: (2024) -
PRISM-Loc: a Lightweight Long-range LiDAR Localization in Urban Environments with Topological Maps
par: Muravyev, Kirill, et autres
Publié: (2025)