Multi-view Distillation based on Multi-modal Fusion for Few-shot Action Recognition(CLIP-$\mathrm{M^2}$DF)
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Guo, Fei, Wang, YiKang, Qi, Han, Jin, WenPing, Zhu, Li |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
DMSD-CDFSAR: Distillation from Mixed-Source Domain for Cross-Domain Few-shot Action Recognition
par: Guo, Fei, et autres
Publié: (2024)
par: Guo, Fei, et autres
Publié: (2024)
Active Multimodal Distillation for Few-shot Action Recognition
par: Feng, Weijia, et autres
Publié: (2025)
par: Feng, Weijia, et autres
Publié: (2025)
EV-CLIP: Efficient Visual Prompt Adaptation for CLIP in Few-shot Action Recognition under Visual Challenges
par: Jon, Hyo Jin, et autres
Publié: (2026)
par: Jon, Hyo Jin, et autres
Publié: (2026)
Building a Multi-modal Spatiotemporal Expert for Zero-shot Action Recognition with CLIP
par: Yu, Yating, et autres
Publié: (2024)
par: Yu, Yating, et autres
Publié: (2024)
View-aware Cross-modal Distillation for Multi-view Action Recognition
par: Nguyen, Trung Thanh, et autres
Publié: (2025)
par: Nguyen, Trung Thanh, et autres
Publié: (2025)
CLIP-guided Prototype Modulating for Few-shot Action Recognition
par: Wang, Xiang, et autres
Publié: (2023)
par: Wang, Xiang, et autres
Publié: (2023)
MultiTSF: Transformer-based Sensor Fusion for Human-Centric Multi-view and Multi-modal Action Recognition
par: Nguyen, Trung Thanh, et autres
Publié: (2025)
par: Nguyen, Trung Thanh, et autres
Publié: (2025)
Representation Space Constrained Learning with Modality Decoupling for Multimodal Object Detection
par: Shao, YiKang, et autres
Publié: (2025)
par: Shao, YiKang, et autres
Publié: (2025)
MultiSensor-Home: A Wide-area Multi-modal Multi-view Dataset for Action Recognition and Transformer-based Sensor Fusion
par: Nguyen, Trung Thanh, et autres
Publié: (2025)
par: Nguyen, Trung Thanh, et autres
Publié: (2025)
Hierarchical Compositional Representations for Few-shot Action Recognition
par: Li, Changzhen, et autres
Publié: (2022)
par: Li, Changzhen, et autres
Publié: (2022)
Selective Vision-Language Subspace Projection for Few-shot CLIP
par: Zhu, Xingyu, et autres
Publié: (2024)
par: Zhu, Xingyu, et autres
Publié: (2024)
DistilCLIP-EEG: Enhancing Epileptic Seizure Detection Through Multi-modal Learning and Knowledge Distillation
par: Wang, Zexin, et autres
Publié: (2025)
par: Wang, Zexin, et autres
Publié: (2025)
Adaptive Prototype Model for Attribute-based Multi-label Few-shot Action Recognition
par: Xiao, Juefeng, et autres
Publié: (2025)
par: Xiao, Juefeng, et autres
Publié: (2025)
FACE: Few-shot Adapter with Cross-view Fusion for Cross-subject EEG Emotion Recognition
par: Liu, Haiqi, et autres
Publié: (2025)
par: Liu, Haiqi, et autres
Publié: (2025)
MV-CLIP: Multi-View CLIP for Zero-shot 3D Shape Recognition
par: Song, Dan, et autres
Publié: (2023)
par: Song, Dan, et autres
Publié: (2023)
Actor-agnostic Multi-label Action Recognition with Multi-modal Query
par: Mondal, Anindya, et autres
Publié: (2023)
par: Mondal, Anindya, et autres
Publié: (2023)
Action Selection Learning for Multi-label Multi-view Action Recognition
par: Nguyen, Trung Thanh, et autres
Publié: (2024)
par: Nguyen, Trung Thanh, et autres
Publié: (2024)
Modeling Multi-modal Cross-interaction for Multi-label Few-shot Image Classification Based on Local Feature Selection
par: Yan, Kun, et autres
Publié: (2024)
par: Yan, Kun, et autres
Publié: (2024)
Few-shot Adaptation of Multi-modal Foundation Models: A Survey
par: Liu, Fan, et autres
Publié: (2024)
par: Liu, Fan, et autres
Publié: (2024)
A Comprehensive Review of Few-shot Action Recognition
par: Wanyan, Yuyang, et autres
Publié: (2024)
par: Wanyan, Yuyang, et autres
Publié: (2024)
CT-CLIP: A Multi-modal Fusion Framework for Robust Apple Leaf Disease Recognition in Complex Environments
par: Liu, Lemin, et autres
Publié: (2025)
par: Liu, Lemin, et autres
Publié: (2025)
Cross-modal Prompting for Balanced Incomplete Multi-modal Emotion Recognition
par: He, Wen-Jue, et autres
Publié: (2025)
par: He, Wen-Jue, et autres
Publié: (2025)
MadCLIP: Few-shot Medical Anomaly Detection with CLIP
par: Shiri, Mahshid, et autres
Publié: (2025)
par: Shiri, Mahshid, et autres
Publié: (2025)
CardiacCLIP: Video-based CLIP Adaptation for LVEF Prediction in a Few-shot Manner
par: Du, Yao, et autres
Publié: (2025)
par: Du, Yao, et autres
Publié: (2025)
CLIP Multi-modal Hashing for Multimedia Retrieval
par: Zhu, Jian, et autres
Publié: (2024)
par: Zhu, Jian, et autres
Publié: (2024)
Cross-domain Few-shot Object Detection with Multi-modal Textual Enrichment
par: Shangguan, Zeyu, et autres
Publié: (2025)
par: Shangguan, Zeyu, et autres
Publié: (2025)
MA-FSAR: Multimodal Adaptation of CLIP for Few-Shot Action Recognition
par: Xing, Jiazheng, et autres
Publié: (2023)
par: Xing, Jiazheng, et autres
Publié: (2023)
Multi-modal Anchor Gated Transformer with Knowledge Distillation for Emotion Recognition in Conversation
par: Li, Jie, et autres
Publié: (2025)
par: Li, Jie, et autres
Publié: (2025)
Simultaneous Long-tailed Recognition and Multi-modal Fusion for Highly Imbalanced Multi-modal Data
par: Yoon, Heegeon, et autres
Publié: (2026)
par: Yoon, Heegeon, et autres
Publié: (2026)
Trunk-branch Contrastive Network with Multi-view Deformable Aggregation for Multi-view Action Recognition
par: Yang, Yingyuan, et autres
Publié: (2025)
par: Yang, Yingyuan, et autres
Publié: (2025)
GaitMA: Pose-guided Multi-modal Feature Fusion for Gait Recognition
par: Min, Fanxu, et autres
Publié: (2024)
par: Min, Fanxu, et autres
Publié: (2024)
M2-CLIP: A Multimodal, Multi-task Adapting Framework for Video Action Recognition
par: Wang, Mengmeng, et autres
Publié: (2024)
par: Wang, Mengmeng, et autres
Publié: (2024)
PE-MVCNet: Multi-view and Cross-modal Fusion Network for Pulmonary Embolism Prediction
par: Guo, Zhaoxin, et autres
Publié: (2024)
par: Guo, Zhaoxin, et autres
Publié: (2024)
MEDiC: Multi-objective Exploration of Distillation from CLIP
par: Georgiou, Konstantinos, et autres
Publié: (2026)
par: Georgiou, Konstantinos, et autres
Publié: (2026)
Cross-domain Multi-modal Few-shot Object Detection via Rich Text
par: Shangguan, Zeyu, et autres
Publié: (2024)
par: Shangguan, Zeyu, et autres
Publié: (2024)
From Unsupervised to Few-shot Graph Anomaly Detection: A Multi-scale Contrastive Learning Approach
par: Zheng, Yu, et autres
Publié: (2022)
par: Zheng, Yu, et autres
Publié: (2022)
Beyond Label Semantics: Language-Guided Action Anatomy for Few-shot Action Recognition
par: Qian, Zefeng, et autres
Publié: (2025)
par: Qian, Zefeng, et autres
Publié: (2025)
Temporal Alignment-Free Video Matching for Few-shot Action Recognition
par: Lee, SuBeen, et autres
Publié: (2025)
par: Lee, SuBeen, et autres
Publié: (2025)
Trajectory-aligned Space-time Tokens for Few-shot Action Recognition
par: Kumar, Pulkit, et autres
Publié: (2024)
par: Kumar, Pulkit, et autres
Publié: (2024)
MediCLIP: Adapting CLIP for Few-shot Medical Image Anomaly Detection
par: Zhang, Ximiao, et autres
Publié: (2024)
par: Zhang, Ximiao, et autres
Publié: (2024)
Documents similaires
-
DMSD-CDFSAR: Distillation from Mixed-Source Domain for Cross-Domain Few-shot Action Recognition
par: Guo, Fei, et autres
Publié: (2024) -
Active Multimodal Distillation for Few-shot Action Recognition
par: Feng, Weijia, et autres
Publié: (2025) -
EV-CLIP: Efficient Visual Prompt Adaptation for CLIP in Few-shot Action Recognition under Visual Challenges
par: Jon, Hyo Jin, et autres
Publié: (2026) -
Building a Multi-modal Spatiotemporal Expert for Zero-shot Action Recognition with CLIP
par: Yu, Yating, et autres
Publié: (2024) -
View-aware Cross-modal Distillation for Multi-view Action Recognition
par: Nguyen, Trung Thanh, et autres
Publié: (2025)