Cross-Modal Dual-Causal Learning for Long-Term Action Recognition
Fuente:
arXiv
Saved in:
| Main Authors: | Shaowu, Xu, Xibin, Jia, Junyu, Gao, Qianmei, Sun, Jing, Chang, Chao, Fan |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
A Two-Stage Dual-Modality Model for Facial Emotional Expression Recognition
by: Sun, Jiajun, et al.
Published: (2026)
by: Sun, Jiajun, et al.
Published: (2026)
DSFormer: A Dual-Scale Cross-Learning Transformer for Visual Place Recognition
by: Jiang, Haiyang, et al.
Published: (2025)
by: Jiang, Haiyang, et al.
Published: (2025)
CaFlow: Enhancing Long-Term Action Quality Assessment with Causal Counterfactual Flow
by: Han, Ruisheng, et al.
Published: (2025)
by: Han, Ruisheng, et al.
Published: (2025)
MoCrop: Training Free Motion Guided Cropping for Efficient Video Action Recognition
by: Huang, Binhua, et al.
Published: (2025)
by: Huang, Binhua, et al.
Published: (2025)
Spatial-Temporal Perception with Causal Inference for Naturalistic Driving Action Recognition
by: Chang, Qing, et al.
Published: (2025)
by: Chang, Qing, et al.
Published: (2025)
Balanced Representation Learning for Long-tailed Skeleton-based Action Recognition
by: Liu, Hongda, et al.
Published: (2023)
by: Liu, Hongda, et al.
Published: (2023)
BST: Badminton Stroke-type Transformer for Skeleton-based Action Recognition in Racket Sports
by: Chang, Jing-Yuan
Published: (2025)
by: Chang, Jing-Yuan
Published: (2025)
Cross-Modal Consistency Learning for Sign Language Recognition
by: Wu, Kepeng, et al.
Published: (2025)
by: Wu, Kepeng, et al.
Published: (2025)
Adversarial Robustness in RGB-Skeleton Action Recognition: Leveraging Attention Modality Reweighter
by: Liu, Chao, et al.
Published: (2024)
by: Liu, Chao, et al.
Published: (2024)
CM2-Net: Continual Cross-Modal Mapping Network for Driver Action Recognition
by: Wang, Ruoyu, et al.
Published: (2024)
by: Wang, Ruoyu, et al.
Published: (2024)
Multi-Modality Co-Learning for Efficient Skeleton-based Action Recognition
by: Liu, Jinfu, et al.
Published: (2024)
by: Liu, Jinfu, et al.
Published: (2024)
Explore Human Parsing Modality for Action Recognition
by: Liu, Jinfu, et al.
Published: (2024)
by: Liu, Jinfu, et al.
Published: (2024)
DL-KDD: Dual-Light Knowledge Distillation for Action Recognition in the Dark
by: Chang, Chi-Jui, et al.
Published: (2024)
by: Chang, Chi-Jui, et al.
Published: (2024)
Body-Hand Modality Expertized Networks with Cross-attention for Fine-grained Skeleton Action Recognition
by: Cho, Seungyeon, et al.
Published: (2025)
by: Cho, Seungyeon, et al.
Published: (2025)
Cross-Model Cross-Stream Learning for Self-Supervised Human Action Recognition
by: Liu, Mengyuan, et al.
Published: (2023)
by: Liu, Mengyuan, et al.
Published: (2023)
Causality-based Cross-Modal Representation Learning for Vision-and-Language Navigation
by: Wang, Liuyi, et al.
Published: (2024)
by: Wang, Liuyi, et al.
Published: (2024)
Causal Disentanglement and Cross-Modal Alignment for Enhanced Few-Shot Learning
by: Jiang, Tianjiao, et al.
Published: (2025)
by: Jiang, Tianjiao, et al.
Published: (2025)
SkeFi: Cross-Modal Knowledge Transfer for Wireless Skeleton-Based Action Recognition
by: Huang, Shunyu, et al.
Published: (2026)
by: Huang, Shunyu, et al.
Published: (2026)
DMSD-CDFSAR: Distillation from Mixed-Source Domain for Cross-Domain Few-shot Action Recognition
by: Guo, Fei, et al.
Published: (2024)
by: Guo, Fei, et al.
Published: (2024)
Learning Causal Domain-Invariant Temporal Dynamics for Few-Shot Action Recognition
by: Li, Yuke, et al.
Published: (2024)
by: Li, Yuke, et al.
Published: (2024)
VT-LVLM-AR: A Video-Temporal Large Vision-Language Model Adapter for Fine-Grained Action Recognition in Long-Term Videos
by: Li, Kaining, et al.
Published: (2025)
by: Li, Kaining, et al.
Published: (2025)
BCE3S: Binary Cross-Entropy Based Tripartite Synergistic Learning for Long-tailed Recognition
by: Fan, Weijia, et al.
Published: (2025)
by: Fan, Weijia, et al.
Published: (2025)
Recovering Complete Actions for Cross-dataset Skeleton Action Recognition
by: Liu, Hanchao, et al.
Published: (2024)
by: Liu, Hanchao, et al.
Published: (2024)
PhysioSync: Temporal and Cross-Modal Contrastive Learning Inspired by Physiological Synchronization for EEG-Based Emotion Recognition
by: Cui, Kai, et al.
Published: (2025)
by: Cui, Kai, et al.
Published: (2025)
DEYOLO: Dual-Feature-Enhancement YOLO for Cross-Modality Object Detection
by: Chen, Yishuo, et al.
Published: (2024)
by: Chen, Yishuo, et al.
Published: (2024)
Range and Bird's Eye View Fused Cross-Modal Visual Place Recognition
by: Peng, Jianyi, et al.
Published: (2025)
by: Peng, Jianyi, et al.
Published: (2025)
Multimodal Cross-Domain Few-Shot Learning for Egocentric Action Recognition
by: Hatano, Masashi, et al.
Published: (2024)
by: Hatano, Masashi, et al.
Published: (2024)
Asymmetric Cross-Modal Knowledge Distillation: Bridging Modalities with Weak Semantic Consistency
by: Wei, Riling, et al.
Published: (2025)
by: Wei, Riling, et al.
Published: (2025)
Cross-Modal Causal Intervention for Medical Report Generation
by: Chen, Weixing, et al.
Published: (2023)
by: Chen, Weixing, et al.
Published: (2023)
Causal Intervention for Subject-Deconfounded Facial Action Unit Recognition
by: Chen, Yingjie, et al.
Published: (2022)
by: Chen, Yingjie, et al.
Published: (2022)
Towards Stable Cross-Domain Depression Recognition under Missing Modalities
by: Chen, Jiuyi, et al.
Published: (2025)
by: Chen, Jiuyi, et al.
Published: (2025)
Dual-Level Cross-Modal Contrastive Clustering
by: Zhang, Haixin, et al.
Published: (2024)
by: Zhang, Haixin, et al.
Published: (2024)
An Information Compensation Framework for Zero-Shot Skeleton-based Action Recognition
by: Xu, Haojun, et al.
Published: (2024)
by: Xu, Haojun, et al.
Published: (2024)
Towards Weakly Supervised End-to-end Learning for Long-video Action Recognition
by: Zhou, Jiaming, et al.
Published: (2023)
by: Zhou, Jiaming, et al.
Published: (2023)
MA-FSAR: Multimodal Adaptation of CLIP for Few-Shot Action Recognition
by: Xing, Jiazheng, et al.
Published: (2023)
by: Xing, Jiazheng, et al.
Published: (2023)
Multimodal Cancer Survival Analysis via Hypergraph Learning with Cross-Modality Rebalance
by: Qu, Mingcheng, et al.
Published: (2025)
by: Qu, Mingcheng, et al.
Published: (2025)
Multimodal Knowledge Distillation for Egocentric Action Recognition Robust to Missing Modalities
by: Santos-Villafranca, Maria, et al.
Published: (2025)
by: Santos-Villafranca, Maria, et al.
Published: (2025)
Intention-Conditioned Long-Term Human Egocentric Action Forecasting
by: Mascaro, Esteve Valls, et al.
Published: (2022)
by: Mascaro, Esteve Valls, et al.
Published: (2022)
OccludeNet: A Causal Journey into Mixed-View Actor-Centric Video Action Recognition under Occlusions
by: Zhou, Guanyu, et al.
Published: (2024)
by: Zhou, Guanyu, et al.
Published: (2024)
TAMT: Temporal-Aware Model Tuning for Cross-Domain Few-Shot Action Recognition
by: Wang, Yilong, et al.
Published: (2024)
by: Wang, Yilong, et al.
Published: (2024)
Similar Items
-
A Two-Stage Dual-Modality Model for Facial Emotional Expression Recognition
by: Sun, Jiajun, et al.
Published: (2026) -
DSFormer: A Dual-Scale Cross-Learning Transformer for Visual Place Recognition
by: Jiang, Haiyang, et al.
Published: (2025) -
CaFlow: Enhancing Long-Term Action Quality Assessment with Causal Counterfactual Flow
by: Han, Ruisheng, et al.
Published: (2025) -
MoCrop: Training Free Motion Guided Cropping for Efficient Video Action Recognition
by: Huang, Binhua, et al.
Published: (2025) -
Spatial-Temporal Perception with Causal Inference for Naturalistic Driving Action Recognition
by: Chang, Qing, et al.
Published: (2025)