HIG: Hierarchical Interlacement Graph Approach to Scene Graph Generation in Video Understanding
Fuente:
arXiv
Guardado en:
| Autores principales: | Nguyen, Trong-Thuan, Nguyen, Pha, Luu, Khoa |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
HyperGLM: HyperGraph for Video Scene Graph Generation and Anticipation
por: Nguyen, Trong-Thuan, et al.
Publicado: (2024)
por: Nguyen, Trong-Thuan, et al.
Publicado: (2024)
THYME: Temporal Hierarchical-Cyclic Interactivity Modeling for Video Scene Graphs in Aerial Footage
por: Nguyen, Trong-Thuan, et al.
Publicado: (2025)
por: Nguyen, Trong-Thuan, et al.
Publicado: (2025)
CYCLO: Cyclic Graph Transformer Approach to Multi-Object Relationship Modeling in Aerial Videos
por: Nguyen, Trong-Thuan, et al.
Publicado: (2024)
por: Nguyen, Trong-Thuan, et al.
Publicado: (2024)
HAtt-Flow: Hierarchical Attention-Flow Mechanism for Group Activity Scene Graph Generation in Videos
por: Chappa, Naga VS Raviteja, et al.
Publicado: (2023)
por: Chappa, Naga VS Raviteja, et al.
Publicado: (2023)
SATURN: Autoregressive Image Generation Guided by Scene Graphs
por: Vo, Thanh-Nhan, et al.
Publicado: (2025)
por: Vo, Thanh-Nhan, et al.
Publicado: (2025)
SimGraph: A Unified Framework for Scene Graph-Based Image Generation and Editing
por: Vo, Thanh-Nhan, et al.
Publicado: (2026)
por: Vo, Thanh-Nhan, et al.
Publicado: (2026)
VENUS: Visual Editing with Noise Inversion Using Scene Graphs
por: Vo, Thanh-Nhan, et al.
Publicado: (2026)
por: Vo, Thanh-Nhan, et al.
Publicado: (2026)
DINTR: Tracking via Diffusion-based Interpolation
por: Nguyen, Pha, et al.
Publicado: (2024)
por: Nguyen, Pha, et al.
Publicado: (2024)
REACT: Recognize Every Action Everywhere All At Once
por: Chappa, Naga VS Raviteja, et al.
Publicado: (2023)
por: Chappa, Naga VS Raviteja, et al.
Publicado: (2023)
Hierarchical Quantum Control Gates for Functional MRI Understanding
por: Nguyen, Xuan-Bac, et al.
Publicado: (2024)
por: Nguyen, Xuan-Bac, et al.
Publicado: (2024)
Motion-aware Contrastive Learning for Temporal Panoptic Scene Graph Generation
por: Nguyen, Thong Thanh, et al.
Publicado: (2024)
por: Nguyen, Thong Thanh, et al.
Publicado: (2024)
Z-GMOT: Zero-shot Generic Multiple Object Tracking
por: Tran, Kim Hoang, et al.
Publicado: (2023)
por: Tran, Kim Hoang, et al.
Publicado: (2023)
BRAIN: Bias-Mitigation Continual Learning Approach to Vision-Brain Understanding
por: Nguyen, Xuan-Bac, et al.
Publicado: (2025)
por: Nguyen, Xuan-Bac, et al.
Publicado: (2025)
Linguistically Informed Multimodal Fusion for Vietnamese Scene-Text Image Captioning: Dataset, Graph Framework, and Phonological Attention
por: Nguyen, Nhi Ngoc-Yen, et al.
Publicado: (2026)
por: Nguyen, Nhi Ngoc-Yen, et al.
Publicado: (2026)
FALCON: Fairness Learning via Contrastive Attention Approach to Continual Semantic Scene Understanding
por: Truong, Thanh-Dat, et al.
Publicado: (2023)
por: Truong, Thanh-Dat, et al.
Publicado: (2023)
QLAM: A Quantum Long-Attention Memory Approach to Long-Sequence Token Modeling
por: Nguyen, Hoang-Quan, et al.
Publicado: (2026)
por: Nguyen, Hoang-Quan, et al.
Publicado: (2026)
Quantum-Brain: Quantum-Inspired Neural Network Approach to Vision-Brain Understanding
por: Nguyen, Hoang-Quan, et al.
Publicado: (2024)
por: Nguyen, Hoang-Quan, et al.
Publicado: (2024)
COBRA: A Continual Learning Approach to Vision-Brain Understanding
por: Nguyen, Xuan-Bac, et al.
Publicado: (2024)
por: Nguyen, Xuan-Bac, et al.
Publicado: (2024)
SoGAR: Self-supervised Spatiotemporal Attention-based Social Group Activity Recognition
por: Chappa, Naga VS Raviteja, et al.
Publicado: (2023)
por: Chappa, Naga VS Raviteja, et al.
Publicado: (2023)
A Novel Dataset for Video-Based Neurodivergent Classification Leveraging Extra-Stimulatory Behavior
por: Serna-Aguilera, Manuel, et al.
Publicado: (2024)
por: Serna-Aguilera, Manuel, et al.
Publicado: (2024)
Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding
por: Truong, Thanh-Dat, et al.
Publicado: (2025)
por: Truong, Thanh-Dat, et al.
Publicado: (2025)
Cross-view Action Recognition Understanding From Exocentric to Egocentric Perspective
por: Truong, Thanh-Dat, et al.
Publicado: (2023)
por: Truong, Thanh-Dat, et al.
Publicado: (2023)
Insect-Foundation: A Foundation Model and Large-scale 1M Dataset for Visual Insect Understanding
por: Nguyen, Hoang-Quan, et al.
Publicado: (2023)
por: Nguyen, Hoang-Quan, et al.
Publicado: (2023)
Multi-view Action Recognition via Directed Gromov-Wasserstein Discrepancy
por: Nguyen, Hoang-Quan, et al.
Publicado: (2024)
por: Nguyen, Hoang-Quan, et al.
Publicado: (2024)
GazeQwen: Lightweight Gaze-Conditioned LLM Modulation for Streaming Video Understanding
por: Pham, Trong Thang, et al.
Publicado: (2026)
por: Pham, Trong Thang, et al.
Publicado: (2026)
Adaptive Visual Scene Understanding: Incremental Scene Graph Generation
por: Khandelwal, Naitik, et al.
Publicado: (2023)
por: Khandelwal, Naitik, et al.
Publicado: (2023)
Training-Free Hierarchical Scene Understanding for Gaussian Splatting with Superpoint Graphs
por: Dai, Shaohui, et al.
Publicado: (2025)
por: Dai, Shaohui, et al.
Publicado: (2025)
QuPAINT: Physics-Aware Instruction Tuning Approach to Quantum Material Discovery
por: Nguyen, Xuan-Bac, et al.
Publicado: (2026)
por: Nguyen, Xuan-Bac, et al.
Publicado: (2026)
SceneGraphVLM: Dynamic Scene Graph Generation from Video with Vision-Language Models
por: Makarov, Vladislav, et al.
Publicado: (2026)
por: Makarov, Vladislav, et al.
Publicado: (2026)
LiGAR: LiDAR-Guided Hierarchical Transformer for Multi-Modal Group Activity Recognition
por: Chappa, Naga Venkata Sai Raviteja, et al.
Publicado: (2024)
por: Chappa, Naga Venkata Sai Raviteja, et al.
Publicado: (2024)
Temporal-Oriented Recipe for Transferring Large Vision-Language Model to Video Understanding
por: Nguyen, Thong, et al.
Publicado: (2025)
por: Nguyen, Thong, et al.
Publicado: (2025)
GaussianGraph: 3D Gaussian-based Scene Graph Generation for Open-world Scene Understanding
por: Wang, Xihan, et al.
Publicado: (2025)
por: Wang, Xihan, et al.
Publicado: (2025)
NICO-RAG: Multimodal Hypergraph Retrieval-Augmented Generation for Understanding the Nicotine Public Health Crisis
por: Serna-Aguilera, Manuel, et al.
Publicado: (2026)
por: Serna-Aguilera, Manuel, et al.
Publicado: (2026)
BRACTIVE: A Brain Activation Approach to Human Visual Brain Learning
por: Nguyen, Xuan-Bac, et al.
Publicado: (2024)
por: Nguyen, Xuan-Bac, et al.
Publicado: (2024)
ESGNN: Towards Equivariant Scene Graph Neural Network for 3D Scene Understanding
por: Pham, Quang P. M., et al.
Publicado: (2024)
por: Pham, Quang P. M., et al.
Publicado: (2024)
SwiftBrush: One-Step Text-to-Image Diffusion Model with Variational Score Distillation
por: Nguyen, Thuan Hoang, et al.
Publicado: (2023)
por: Nguyen, Thuan Hoang, et al.
Publicado: (2023)
FrameDiT: Diffusion Transformer with Matrix Attention for Efficient Video Generation
por: Le, Minh Khoa, et al.
Publicado: (2026)
por: Le, Minh Khoa, et al.
Publicado: (2026)
SGTA: Scene-Graph Based Multi-Modal Traffic Agent for Video Understanding
por: Zhou, Xingcheng, et al.
Publicado: (2026)
por: Zhou, Xingcheng, et al.
Publicado: (2026)
DIFFVSGG: Diffusion-Driven Online Video Scene Graph Generation
por: Chen, Mu, et al.
Publicado: (2025)
por: Chen, Mu, et al.
Publicado: (2025)
SAMJAM: Zero-Shot Video Scene Graph Generation for Egocentric Kitchen Videos
por: Li, Joshua, et al.
Publicado: (2025)
por: Li, Joshua, et al.
Publicado: (2025)
Ejemplares similares
-
HyperGLM: HyperGraph for Video Scene Graph Generation and Anticipation
por: Nguyen, Trong-Thuan, et al.
Publicado: (2024) -
THYME: Temporal Hierarchical-Cyclic Interactivity Modeling for Video Scene Graphs in Aerial Footage
por: Nguyen, Trong-Thuan, et al.
Publicado: (2025) -
CYCLO: Cyclic Graph Transformer Approach to Multi-Object Relationship Modeling in Aerial Videos
por: Nguyen, Trong-Thuan, et al.
Publicado: (2024) -
HAtt-Flow: Hierarchical Attention-Flow Mechanism for Group Activity Scene Graph Generation in Videos
por: Chappa, Naga VS Raviteja, et al.
Publicado: (2023) -
SATURN: Autoregressive Image Generation Guided by Scene Graphs
por: Vo, Thanh-Nhan, et al.
Publicado: (2025)