MultiSensor-Home: A Wide-area Multi-modal Multi-view Dataset for Action Recognition and Transformer-based Sensor Fusion
Fuente:
arXiv
Salvato in:
| Autori principali: | Nguyen, Trung Thanh, Kawanishi, Yasutomo, John, Vijay, Komamizu, Takahiro, Ide, Ichiro |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
MultiTSF: Transformer-based Sensor Fusion for Human-Centric Multi-view and Multi-modal Action Recognition
di: Nguyen, Trung Thanh, et al.
Pubblicazione: (2025)
di: Nguyen, Trung Thanh, et al.
Pubblicazione: (2025)
View-aware Cross-modal Distillation for Multi-view Action Recognition
di: Nguyen, Trung Thanh, et al.
Pubblicazione: (2025)
di: Nguyen, Trung Thanh, et al.
Pubblicazione: (2025)
Action Selection Learning for Multi-label Multi-view Action Recognition
di: Nguyen, Trung Thanh, et al.
Pubblicazione: (2024)
di: Nguyen, Trung Thanh, et al.
Pubblicazione: (2024)
One-Stage Open-Vocabulary Temporal Action Detection Leveraging Temporal Multi-scale and Action Label Features
di: Nguyen, Trung Thanh, et al.
Pubblicazione: (2024)
di: Nguyen, Trung Thanh, et al.
Pubblicazione: (2024)
Tracking Small Birds by Detection Candidate Region Filtering and Detection History-aware Association
di: Liu, Tingwei, et al.
Pubblicazione: (2024)
di: Liu, Tingwei, et al.
Pubblicazione: (2024)
ForestMamba: Sparse Mamba with Geometry-guided Queries for 3D Forest Point Cloud Segmentation
di: Nguyen, Trung Thanh, et al.
Pubblicazione: (2026)
di: Nguyen, Trung Thanh, et al.
Pubblicazione: (2026)
Q-Adapter: Visual Query Adapter for Extracting Textually-related Features in Video Captioning
di: Chen, Junan, et al.
Pubblicazione: (2025)
di: Chen, Junan, et al.
Pubblicazione: (2025)
Multi-View Video-Based Learning: Leveraging Weak Labels for Frame-Level Perception
di: John, Vijay, et al.
Pubblicazione: (2024)
di: John, Vijay, et al.
Pubblicazione: (2024)
Small Object Detection for Birds with Swin Transformer
di: Huo, Da, et al.
Pubblicazione: (2025)
di: Huo, Da, et al.
Pubblicazione: (2025)
Multi-proposal Collaboration and Multi-task Training for Weakly-supervised Video Moment Retrieval
di: Zhang, Bolin, et al.
Pubblicazione: (2026)
di: Zhang, Bolin, et al.
Pubblicazione: (2026)
Facet-Level Persona Control by Trait-Activated Routing with Contrastive SAE for Role-Playing LLMs
di: Tang, Wenqiu, et al.
Pubblicazione: (2026)
di: Tang, Wenqiu, et al.
Pubblicazione: (2026)
Multi-view Action Recognition via Directed Gromov-Wasserstein Discrepancy
di: Nguyen, Hoang-Quan, et al.
Pubblicazione: (2024)
di: Nguyen, Hoang-Quan, et al.
Pubblicazione: (2024)
Multi-view Distillation based on Multi-modal Fusion for Few-shot Action Recognition(CLIP-$\mathrm{M^2}$DF)
di: Guo, Fei, et al.
Pubblicazione: (2024)
di: Guo, Fei, et al.
Pubblicazione: (2024)
Investigating Conceptual Blending of a Diffusion Model for Improving Nonword-to-Image Generation
di: Matsuhira, Chihaya, et al.
Pubblicazione: (2024)
di: Matsuhira, Chihaya, et al.
Pubblicazione: (2024)
Multi-modal Sensor Fusion for Auto Driving Perception: A Survey
di: Huang, Keli, et al.
Pubblicazione: (2022)
di: Huang, Keli, et al.
Pubblicazione: (2022)
Multi-IMU Sensor Fusion for Legged Robots
di: Yang, Shuo, et al.
Pubblicazione: (2025)
di: Yang, Shuo, et al.
Pubblicazione: (2025)
Actor-agnostic Multi-label Action Recognition with Multi-modal Query
di: Mondal, Anindya, et al.
Pubblicazione: (2023)
di: Mondal, Anindya, et al.
Pubblicazione: (2023)
Human Activity Recognition using RGB-Event based Sensors: A Multi-modal Heat Conduction Model and A Benchmark Dataset
di: Wang, Shiao, et al.
Pubblicazione: (2025)
di: Wang, Shiao, et al.
Pubblicazione: (2025)
Balancing Multi-modal Sensor Learning via Multi-objective Optimization
di: Fernando, Heshan, et al.
Pubblicazione: (2025)
di: Fernando, Heshan, et al.
Pubblicazione: (2025)
Simultaneous Long-tailed Recognition and Multi-modal Fusion for Highly Imbalanced Multi-modal Data
di: Yoon, Heegeon, et al.
Pubblicazione: (2026)
di: Yoon, Heegeon, et al.
Pubblicazione: (2026)
Trunk-branch Contrastive Network with Multi-view Deformable Aggregation for Multi-view Action Recognition
di: Yang, Yingyuan, et al.
Pubblicazione: (2025)
di: Yang, Yingyuan, et al.
Pubblicazione: (2025)
MultiFuser: Multimodal Fusion Transformer for Enhanced Driver Action Recognition
di: Wang, Ruoyu, et al.
Pubblicazione: (2024)
di: Wang, Ruoyu, et al.
Pubblicazione: (2024)
Skarimva: Skeleton-based Action Recognition is a Multi-view Application
di: Bermuth, Daniel, et al.
Pubblicazione: (2026)
di: Bermuth, Daniel, et al.
Pubblicazione: (2026)
A Multi-annotated and Multi-modal Dataset for Wide-angle Video Quality Assessment
di: Hu, Bo, et al.
Pubblicazione: (2025)
di: Hu, Bo, et al.
Pubblicazione: (2025)
Multi-Sensor Fusion-Based Mobile Manipulator Remote Control for Intelligent Smart Home Assistance
di: Jin, Xiao, et al.
Pubblicazione: (2025)
di: Jin, Xiao, et al.
Pubblicazione: (2025)
A Gaze-grounded Visual Question Answering Dataset for Clarifying Ambiguous Japanese Questions
di: Inadumi, Shun, et al.
Pubblicazione: (2024)
di: Inadumi, Shun, et al.
Pubblicazione: (2024)
MPTF-Net: Multi-view Pyramid Transformer Fusion Network for LiDAR-based Place Recognition
di: Li, Shuyuan, et al.
Pubblicazione: (2026)
di: Li, Shuyuan, et al.
Pubblicazione: (2026)
A Survey on Dynamic Neural Networks: from Computer Vision to Multi-modal Sensor Fusion
di: Montello, Fabio, et al.
Pubblicazione: (2025)
di: Montello, Fabio, et al.
Pubblicazione: (2025)
LM-MCVT: A Lightweight Multi-modal Multi-view Convolutional-Vision Transformer Approach for 3D Object Recognition
di: Xiong, Songsong, et al.
Pubblicazione: (2025)
di: Xiong, Songsong, et al.
Pubblicazione: (2025)
Static and Dynamic Graph Alignment Network for Temporal Video Grounding
di: Hu, Zhanjie, et al.
Pubblicazione: (2026)
di: Hu, Zhanjie, et al.
Pubblicazione: (2026)
VHAKG: A Multi-modal Knowledge Graph Based on Synchronized Multi-view Videos of Daily Activities
di: Egami, Shusaku, et al.
Pubblicazione: (2024)
di: Egami, Shusaku, et al.
Pubblicazione: (2024)
Resilient Sensor Fusion under Adverse Sensor Failures via Multi-Modal Expert Fusion
di: Park, Konyul, et al.
Pubblicazione: (2025)
di: Park, Konyul, et al.
Pubblicazione: (2025)
Action Motifs: Self-Supervised Hierarchical Representation of Human Body Movements
di: Kinoshita, Genki, et al.
Pubblicazione: (2026)
di: Kinoshita, Genki, et al.
Pubblicazione: (2026)
Virtual Fusion with Contrastive Learning for Single Sensor-based Activity Recognition
di: Nguyen, Duc-Anh, et al.
Pubblicazione: (2023)
di: Nguyen, Duc-Anh, et al.
Pubblicazione: (2023)
Multi-modal Data Spectrum: Multi-modal Datasets are Multi-dimensional
di: Madaan, Divyam, et al.
Pubblicazione: (2025)
di: Madaan, Divyam, et al.
Pubblicazione: (2025)
Multi-Dialect Vietnamese: Task, Dataset, Baseline Models and Challenges
di: Van Dinh, Nguyen, et al.
Pubblicazione: (2024)
di: Van Dinh, Nguyen, et al.
Pubblicazione: (2024)
TEMPO-VINE: A Multi-Temporal Sensor Fusion Dataset for Localization and Mapping in Vineyards
di: Martini, Mauro, et al.
Pubblicazione: (2025)
di: Martini, Mauro, et al.
Pubblicazione: (2025)
SmartPNT-MSF: A Multi-Sensor Fusion Dataset for Positioning and Navigation Research
di: Zhu, Feng, et al.
Pubblicazione: (2025)
di: Zhu, Feng, et al.
Pubblicazione: (2025)
Physical-aware Cross-modal Adversarial Network for Wearable Sensor-based Human Action Recognition
di: Ni, Jianyuan, et al.
Pubblicazione: (2023)
di: Ni, Jianyuan, et al.
Pubblicazione: (2023)
Multi-level and Multi-modal Action Anticipation
di: Kim, Seulgi, et al.
Pubblicazione: (2025)
di: Kim, Seulgi, et al.
Pubblicazione: (2025)
Documenti analoghi
-
MultiTSF: Transformer-based Sensor Fusion for Human-Centric Multi-view and Multi-modal Action Recognition
di: Nguyen, Trung Thanh, et al.
Pubblicazione: (2025) -
View-aware Cross-modal Distillation for Multi-view Action Recognition
di: Nguyen, Trung Thanh, et al.
Pubblicazione: (2025) -
Action Selection Learning for Multi-label Multi-view Action Recognition
di: Nguyen, Trung Thanh, et al.
Pubblicazione: (2024) -
One-Stage Open-Vocabulary Temporal Action Detection Leveraging Temporal Multi-scale and Action Label Features
di: Nguyen, Trung Thanh, et al.
Pubblicazione: (2024) -
Tracking Small Birds by Detection Candidate Region Filtering and Detection History-aware Association
di: Liu, Tingwei, et al.
Pubblicazione: (2024)