MA-FSAR: Multimodal Adaptation of CLIP for Few-Shot Action Recognition
Fuente:
arXiv
Guardado en:
| Autores principales: | Xing, Jiazheng, Xu, Chao, Wang, Mengmeng, Dai, Guang, Sun, Baigui, Liu, Yong, Wang, Jingdong, Zhao, Jian |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
M2-CLIP: A Multimodal, Multi-task Adapting Framework for Video Action Recognition
por: Wang, Mengmeng, et al.
Publicado: (2024)
por: Wang, Mengmeng, et al.
Publicado: (2024)
TryOn-Adapter: Efficient Fine-Grained Clothing Identity Adaptation for High-Fidelity Virtual Try-On
por: Xing, Jiazheng, et al.
Publicado: (2024)
por: Xing, Jiazheng, et al.
Publicado: (2024)
Knowledge is Power: Advancing Few-shot Action Recognition with Multimodal Semantics from MLLMs
por: Xing, Jiazheng, et al.
Publicado: (2026)
por: Xing, Jiazheng, et al.
Publicado: (2026)
TriCLIP-3D: A Unified Parameter-Efficient Framework for Tri-Modal 3D Visual Grounding based on CLIP
por: Li, Fan, et al.
Publicado: (2025)
por: Li, Fan, et al.
Publicado: (2025)
Visual Object Tracking across Diverse Data Modalities: A Review
por: Wang, Mengmeng, et al.
Publicado: (2024)
por: Wang, Mengmeng, et al.
Publicado: (2024)
CLIP-guided Prototype Modulating for Few-shot Action Recognition
por: Wang, Xiang, et al.
Publicado: (2023)
por: Wang, Xiang, et al.
Publicado: (2023)
Multimodal Prototype-Enhanced Network for Few-Shot Action Recognition
por: Ni, Xinzhe, et al.
Publicado: (2022)
por: Ni, Xinzhe, et al.
Publicado: (2022)
EV-CLIP: Efficient Visual Prompt Adaptation for CLIP in Few-shot Action Recognition under Visual Challenges
por: Jon, Hyo Jin, et al.
Publicado: (2026)
por: Jon, Hyo Jin, et al.
Publicado: (2026)
Multimodal Cross-Domain Few-Shot Learning for Egocentric Action Recognition
por: Hatano, Masashi, et al.
Publicado: (2024)
por: Hatano, Masashi, et al.
Publicado: (2024)
Manta: Enhancing Mamba for Few-Shot Action Recognition of Long Sub-Sequence
por: Huang, Wenbo, et al.
Publicado: (2024)
por: Huang, Wenbo, et al.
Publicado: (2024)
Rethinking Prior Information Generation with CLIP for Few-Shot Segmentation
por: Wang, Jin, et al.
Publicado: (2024)
por: Wang, Jin, et al.
Publicado: (2024)
Learning to Adapt Frozen CLIP for Few-Shot Test-Time Domain Adaptation
por: Chi, Zhixiang, et al.
Publicado: (2025)
por: Chi, Zhixiang, et al.
Publicado: (2025)
Multimodal CLIP Inference for Meta-Few-Shot Image Classification
por: Ferragu, Constance, et al.
Publicado: (2024)
por: Ferragu, Constance, et al.
Publicado: (2024)
STAR: Semantic-Temporal Adaptive Representation Learning for Few-Shot Action Recognition
por: Liu, Hongli, et al.
Publicado: (2026)
por: Liu, Hongli, et al.
Publicado: (2026)
Logits DeConfusion with CLIP for Few-Shot Learning
por: Li, Shuo, et al.
Publicado: (2025)
por: Li, Shuo, et al.
Publicado: (2025)
UltraAD: Fine-Grained Ultrasound Anomaly Classification via Few-Shot CLIP Adaptation
por: Zhou, Yue, et al.
Publicado: (2025)
por: Zhou, Yue, et al.
Publicado: (2025)
Spatio-temporal Decoupled Knowledge Compensator for Few-Shot Action Recognition
por: Qu, Hongyu, et al.
Publicado: (2026)
por: Qu, Hongyu, et al.
Publicado: (2026)
Active Multimodal Distillation for Few-shot Action Recognition
por: Feng, Weijia, et al.
Publicado: (2025)
por: Feng, Weijia, et al.
Publicado: (2025)
TAMT: Temporal-Aware Model Tuning for Cross-Domain Few-Shot Action Recognition
por: Wang, Yilong, et al.
Publicado: (2024)
por: Wang, Yilong, et al.
Publicado: (2024)
Transductive Zero-Shot and Few-Shot CLIP
por: Martin, Ségolène, et al.
Publicado: (2024)
por: Martin, Ségolène, et al.
Publicado: (2024)
Rethinking Visual Content Refinement in Low-Shot CLIP Adaptation
por: Lu, Jinda, et al.
Publicado: (2024)
por: Lu, Jinda, et al.
Publicado: (2024)
Otter: Mitigating Background Distractions of Wide-Angle Few-Shot Action Recognition with Enhanced RWKV
por: Huang, Wenbo, et al.
Publicado: (2025)
por: Huang, Wenbo, et al.
Publicado: (2025)
Complementary Subspace Low-Rank Adaptation of Vision-Language Models for Few-Shot Classification
por: Wang, Zhongqi, et al.
Publicado: (2025)
por: Wang, Zhongqi, et al.
Publicado: (2025)
DreamSalon: A Staged Diffusion Framework for Preserving Identity-Context in Editable Face Generation
por: Lin, Haonan, et al.
Publicado: (2024)
por: Lin, Haonan, et al.
Publicado: (2024)
VGAS: Value-Guided Action-Chunk Selection for Few-Shot Vision-Language-Action Adaptation
por: Xu, Changhua, et al.
Publicado: (2026)
por: Xu, Changhua, et al.
Publicado: (2026)
Video-to-Task Learning via Motion-Guided Attention for Few-Shot Action Recognition
por: Guo, Hanyu, et al.
Publicado: (2024)
por: Guo, Hanyu, et al.
Publicado: (2024)
MVP-Shot: Multi-Velocity Progressive-Alignment Framework for Few-Shot Action Recognition
por: Qu, Hongyu, et al.
Publicado: (2024)
por: Qu, Hongyu, et al.
Publicado: (2024)
Proto-CLIP: Vision-Language Prototypical Network for Few-Shot Learning
por: P, Jishnu Jaykumar, et al.
Publicado: (2023)
por: P, Jishnu Jaykumar, et al.
Publicado: (2023)
Knowledge Adaptation Network for Few-Shot Class-Incremental Learning
por: Wang, Ye, et al.
Publicado: (2024)
por: Wang, Ye, et al.
Publicado: (2024)
Frame Order Matters: A Temporal Sequence-Aware Model for Few-Shot Action Recognition
por: Li, Bozheng, et al.
Publicado: (2024)
por: Li, Bozheng, et al.
Publicado: (2024)
CLIP-FSAC++: Few-Shot Anomaly Classification with Anomaly Descriptor Based on CLIP
por: Zuo, Zuo, et al.
Publicado: (2024)
por: Zuo, Zuo, et al.
Publicado: (2024)
Task-Specific Distance Correlation Matching for Few-Shot Action Recognition
por: Long, Fei, et al.
Publicado: (2025)
por: Long, Fei, et al.
Publicado: (2025)
Improving CLIP Adaptation by Breaking Tail Alignment for Source-Free Cross-Domain Few-Shot Learning
por: Yi, Shuai, et al.
Publicado: (2026)
por: Yi, Shuai, et al.
Publicado: (2026)
Enabling Validation for Robust Few-Shot Recognition
por: Wang, Hanxin, et al.
Publicado: (2025)
por: Wang, Hanxin, et al.
Publicado: (2025)
Prototype-Driven Adaptation for Few-Shot Object Detection
por: Huang, Yushen, et al.
Publicado: (2025)
por: Huang, Yushen, et al.
Publicado: (2025)
Learning to Adapt Category Consistent Meta-Feature of CLIP for Few-Shot Classification
por: Shi, Jiaying, et al.
Publicado: (2024)
por: Shi, Jiaying, et al.
Publicado: (2024)
Schedule Your Edit: A Simple yet Effective Diffusion Noise Schedule for Image Editing
por: Lin, Haonan, et al.
Publicado: (2024)
por: Lin, Haonan, et al.
Publicado: (2024)
Topology-Aware CLIP Few-Shot Learning
por: Huang, Dazhi
Publicado: (2025)
por: Huang, Dazhi
Publicado: (2025)
GazeCLIP: Enhancing Gaze Estimation Through Text-Guided Multimodal Learning
por: Wang, Jun, et al.
Publicado: (2023)
por: Wang, Jun, et al.
Publicado: (2023)
Test-Time Adaptation with CLIP Reward for Zero-Shot Generalization in Vision-Language Models
por: Zhao, Shuai, et al.
Publicado: (2023)
por: Zhao, Shuai, et al.
Publicado: (2023)
Ejemplares similares
-
M2-CLIP: A Multimodal, Multi-task Adapting Framework for Video Action Recognition
por: Wang, Mengmeng, et al.
Publicado: (2024) -
TryOn-Adapter: Efficient Fine-Grained Clothing Identity Adaptation for High-Fidelity Virtual Try-On
por: Xing, Jiazheng, et al.
Publicado: (2024) -
Knowledge is Power: Advancing Few-shot Action Recognition with Multimodal Semantics from MLLMs
por: Xing, Jiazheng, et al.
Publicado: (2026) -
TriCLIP-3D: A Unified Parameter-Efficient Framework for Tri-Modal 3D Visual Grounding based on CLIP
por: Li, Fan, et al.
Publicado: (2025) -
Visual Object Tracking across Diverse Data Modalities: A Review
por: Wang, Mengmeng, et al.
Publicado: (2024)