Action Recognition with Multi-stream Motion Modeling and Mutual Information Maximization
Fuente:
arXiv
Salvato in:
| Autori principali: | Yang, Yuheng, Chen, Haipeng, Liu, Zhenguang, Lyu, Yingda, Zhang, Beibei, Wu, Shuang, Wang, Zhibo, Ren, Kui |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Joint-Motion Mutual Learning for Pose Estimation in Videos
di: Wu, Sifan, et al.
Pubblicazione: (2024)
di: Wu, Sifan, et al.
Pubblicazione: (2024)
Causal-Inspired Multitask Learning for Video-Based Human Pose Estimation
di: Chen, Haipeng, et al.
Pubblicazione: (2025)
di: Chen, Haipeng, et al.
Pubblicazione: (2025)
Do As I Do: Pose Guided Human Motion Copy
di: Wu, Sifan, et al.
Pubblicazione: (2024)
di: Wu, Sifan, et al.
Pubblicazione: (2024)
HVIS: A Human-like Vision and Inference System for Human Motion Prediction
di: Lyu, Kedi, et al.
Pubblicazione: (2025)
di: Lyu, Kedi, et al.
Pubblicazione: (2025)
EgoPrompt: Prompt Learning for Egocentric Action Recognition
di: Lyu, Huaihai, et al.
Pubblicazione: (2025)
di: Lyu, Huaihai, et al.
Pubblicazione: (2025)
Revisiting Mutual Information Maximization for Generalized Category Discovery
di: Tan, Zhaorui, et al.
Pubblicazione: (2024)
di: Tan, Zhaorui, et al.
Pubblicazione: (2024)
Skeleton-based Action Recognition with Non-linear Dependency Modeling and Hilbert-Schmidt Independence Criterion
di: Yang, Yuheng
Pubblicazione: (2024)
di: Yang, Yuheng
Pubblicazione: (2024)
Multi-threshold Deep Metric Learning for Facial Expression Recognition
di: Yang, Wenwu, et al.
Pubblicazione: (2024)
di: Yang, Wenwu, et al.
Pubblicazione: (2024)
Exposing the Deception: Uncovering More Forgery Clues for Deepfake Detection
di: Ba, Zhongjie, et al.
Pubblicazione: (2024)
di: Ba, Zhongjie, et al.
Pubblicazione: (2024)
FSFM: A Generalizable Face Security Foundation Model via Self-Supervised Facial Representation Learning
di: Wang, Gaojian, et al.
Pubblicazione: (2024)
di: Wang, Gaojian, et al.
Pubblicazione: (2024)
A Renaissance of Explicit Motion Information Mining from Transformers for Action Recognition
di: Zhuang, Peiqin, et al.
Pubblicazione: (2025)
di: Zhuang, Peiqin, et al.
Pubblicazione: (2025)
What Makes Good Collaborative Views? Contrastive Mutual Information Maximization for Multi-Agent Perception
di: Su, Wanfang, et al.
Pubblicazione: (2024)
di: Su, Wanfang, et al.
Pubblicazione: (2024)
Harnessing Frequency Spectrum Insights for Image Copyright Protection Against Diffusion Models
di: Liu, Zhenguang, et al.
Pubblicazione: (2025)
di: Liu, Zhenguang, et al.
Pubblicazione: (2025)
General Covariant Action Modeling: Constructing Generalized Manifolds via Spatio-Temporal Decoupling
di: Lyu, Huaihai, et al.
Pubblicazione: (2026)
di: Lyu, Huaihai, et al.
Pubblicazione: (2026)
Motion Matters: Motion-guided Modulation Network for Skeleton-based Micro-Action Recognition
di: Gu, Jihao, et al.
Pubblicazione: (2025)
di: Gu, Jihao, et al.
Pubblicazione: (2025)
Pose-Aware Multi-Level Motion Parsing for Action Quality Assessment
di: Zhu, Shuaikang, et al.
Pubblicazione: (2025)
di: Zhu, Shuaikang, et al.
Pubblicazione: (2025)
Explicit Mutual Information Maximization for Self-Supervised Learning
di: Chang, Lele, et al.
Pubblicazione: (2024)
di: Chang, Lele, et al.
Pubblicazione: (2024)
VISTA: Enhancing Vision-Text Alignment in MLLMs via Cross-Modal Mutual Information Maximization
di: Li, Mingxiao, et al.
Pubblicazione: (2025)
di: Li, Mingxiao, et al.
Pubblicazione: (2025)
Morphology-optimized Multi-Scale Fusion: Combining Local Artifacts and Mesoscopic Semantics for Deepfake Detection and Localization
di: Shuai, Chao, et al.
Pubblicazione: (2025)
di: Shuai, Chao, et al.
Pubblicazione: (2025)
Trunk-branch Contrastive Network with Multi-view Deformable Aggregation for Multi-view Action Recognition
di: Yang, Yingyuan, et al.
Pubblicazione: (2025)
di: Yang, Yingyuan, et al.
Pubblicazione: (2025)
CMax-SLAM: Event-based Rotational-Motion Bundle Adjustment and SLAM System using Contrast Maximization
di: Guo, Shuang, et al.
Pubblicazione: (2024)
di: Guo, Shuang, et al.
Pubblicazione: (2024)
Towards Robust Probabilistic Modeling on SO(3) via Rotation Laplace Distribution
di: Yin, Yingda, et al.
Pubblicazione: (2023)
di: Yin, Yingda, et al.
Pubblicazione: (2023)
Marrying Text-to-Motion Generation with Skeleton-Based Action Recognition
di: Kuang, Jidong, et al.
Pubblicazione: (2026)
di: Kuang, Jidong, et al.
Pubblicazione: (2026)
SOAP: Enhancing Spatio-Temporal Relation and Motion Information Capturing for Few-Shot Action Recognition
di: Huang, Wenbo, et al.
Pubblicazione: (2024)
di: Huang, Wenbo, et al.
Pubblicazione: (2024)
Estimating 2D Camera Motion with Hybrid Motion Basis
di: Li, Haipeng, et al.
Pubblicazione: (2025)
di: Li, Haipeng, et al.
Pubblicazione: (2025)
Towards Unified Facial Action Unit Recognition Framework by Large Language Models
di: Hu, Guohong, et al.
Pubblicazione: (2024)
di: Hu, Guohong, et al.
Pubblicazione: (2024)
An Effective End-to-End Solution for Multimodal Action Recognition
di: Wang, Songping, et al.
Pubblicazione: (2025)
di: Wang, Songping, et al.
Pubblicazione: (2025)
SMART: Scalable Multi-agent Real-time Motion Generation via Next-token Prediction
di: Wu, Wei, et al.
Pubblicazione: (2024)
di: Wu, Wei, et al.
Pubblicazione: (2024)
Motion-Adapter: A Diffusion Model Adapter for Text-to-Motion Generation of Compound Actions
di: Jiang, Yue, et al.
Pubblicazione: (2026)
di: Jiang, Yue, et al.
Pubblicazione: (2026)
Action Selection Learning for Multi-label Multi-view Action Recognition
di: Nguyen, Trung Thanh, et al.
Pubblicazione: (2024)
di: Nguyen, Trung Thanh, et al.
Pubblicazione: (2024)
MoCrop: Training Free Motion Guided Cropping for Efficient Video Action Recognition
di: Huang, Binhua, et al.
Pubblicazione: (2025)
di: Huang, Binhua, et al.
Pubblicazione: (2025)
SUGAR: Learning Skeleton Representation with Visual-Motion Knowledge for Action Recognition
di: Ye, Qilang, et al.
Pubblicazione: (2025)
di: Ye, Qilang, et al.
Pubblicazione: (2025)
Multi-Modality Co-Learning for Efficient Skeleton-based Action Recognition
di: Liu, Jinfu, et al.
Pubblicazione: (2024)
di: Liu, Jinfu, et al.
Pubblicazione: (2024)
When Detectors Forget Forensics: Blocking Semantic Shortcuts for Generalizable AI-Generated Image Detection
di: Shuai, Chao, et al.
Pubblicazione: (2026)
di: Shuai, Chao, et al.
Pubblicazione: (2026)
Local Action-Guided Motion Diffusion Model for Text-to-Motion Generation
di: Jin, Peng, et al.
Pubblicazione: (2024)
di: Jin, Peng, et al.
Pubblicazione: (2024)
Multi-Grained Feature Pruning for Video-Based Human Pose Estimation
di: Wang, Zhigang, et al.
Pubblicazione: (2025)
di: Wang, Zhigang, et al.
Pubblicazione: (2025)
ARN-LSTM: A Multi-Stream Fusion Model for Skeleton-based Action Recognition
di: Wang, Chuanchuan, et al.
Pubblicazione: (2024)
di: Wang, Chuanchuan, et al.
Pubblicazione: (2024)
Learning Mutual Excitation for Hand-to-Hand and Human-to-Human Interaction Recognition
di: Liu, Mengyuan, et al.
Pubblicazione: (2024)
di: Liu, Mengyuan, et al.
Pubblicazione: (2024)
MV-GMN: State Space Model for Multi-View Action Recognition
di: Lin, Yuhui, et al.
Pubblicazione: (2025)
di: Lin, Yuhui, et al.
Pubblicazione: (2025)
CVVNet: A Cross-Vertical-View Network for Gait Recognition
di: Li, Xiangru, et al.
Pubblicazione: (2025)
di: Li, Xiangru, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Joint-Motion Mutual Learning for Pose Estimation in Videos
di: Wu, Sifan, et al.
Pubblicazione: (2024) -
Causal-Inspired Multitask Learning for Video-Based Human Pose Estimation
di: Chen, Haipeng, et al.
Pubblicazione: (2025) -
Do As I Do: Pose Guided Human Motion Copy
di: Wu, Sifan, et al.
Pubblicazione: (2024) -
HVIS: A Human-like Vision and Inference System for Human Motion Prediction
di: Lyu, Kedi, et al.
Pubblicazione: (2025) -
EgoPrompt: Prompt Learning for Egocentric Action Recognition
di: Lyu, Huaihai, et al.
Pubblicazione: (2025)