Otter: Mitigating Background Distractions of Wide-Angle Few-Shot Action Recognition with Enhanced RWKV
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Huang, Wenbo, Zhang, Jinghui, Chen, Zhenghao, Li, Guang, Zhang, Lei, Cao, Yang, Dong, Fang, Ogawa, Takahiro, Haseyama, Miki |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Manta: Enhancing Mamba for Few-Shot Action Recognition of Long Sub-Sequence
par: Huang, Wenbo, et autres
Publié: (2024)
par: Huang, Wenbo, et autres
Publié: (2024)
Cross-domain Few-shot In-context Learning for Enhancing Traffic Sign Recognition
par: Gan, Yaozong, et autres
Publié: (2024)
par: Gan, Yaozong, et autres
Publié: (2024)
SOAP: Enhancing Spatio-Temporal Relation and Motion Information Capturing for Few-Shot Action Recognition
par: Huang, Wenbo, et autres
Publié: (2024)
par: Huang, Wenbo, et autres
Publié: (2024)
Few-shot Personalized Saliency Prediction Based on Interpersonal Gaze Patterns
par: Moroto, Yuya, et autres
Publié: (2023)
par: Moroto, Yuya, et autres
Publié: (2023)
Soft-Label Anonymous Gastric X-ray Image Distillation
par: Li, Guang, et autres
Publié: (2021)
par: Li, Guang, et autres
Publié: (2021)
Importance-Aware Adaptive Dataset Distillation
par: Li, Guang, et autres
Publié: (2024)
par: Li, Guang, et autres
Publié: (2024)
RGMIM: Region-Guided Masked Image Modeling for Learning Meaningful Representations from X-Ray Images
par: Li, Guang, et autres
Publié: (2022)
par: Li, Guang, et autres
Publié: (2022)
Cross-domain Multi-step Thinking: Zero-shot Fine-grained Traffic Sign Recognition in the Wild
par: Gan, Yaozong, et autres
Publié: (2024)
par: Gan, Yaozong, et autres
Publié: (2024)
L2R: Low-Rank and Lipschitz-Controlled Routing for Mixture-of-Experts
par: Yang, Minghao, et autres
Publié: (2026)
par: Yang, Minghao, et autres
Publié: (2026)
Adaptive Shared Experts with LoRA-Based Mixture of Experts for Multi-Task Learning
par: Yang, Minghao, et autres
Publié: (2025)
par: Yang, Minghao, et autres
Publié: (2025)
Predictive but Not Plannable: RC-aux for Latent World Models
par: Li, Wenyuan, et autres
Publié: (2026)
par: Li, Wenyuan, et autres
Publié: (2026)
Hyperbolic Dataset Distillation
par: Li, Wenyuan, et autres
Publié: (2025)
par: Li, Wenyuan, et autres
Publié: (2025)
Diversity-Driven Generative Dataset Distillation Based on Diffusion Model with Self-Adaptive Memory
par: Li, Mingzhuo, et autres
Publié: (2025)
par: Li, Mingzhuo, et autres
Publié: (2025)
Decoupled Audio-Visual Dataset Distillation
par: Li, Wenyuan, et autres
Publié: (2025)
par: Li, Wenyuan, et autres
Publié: (2025)
Closed-Form Linear-Probe Dataset Distillation for Pre-trained Vision Models
par: Peng, Bincheng, et autres
Publié: (2026)
par: Peng, Bincheng, et autres
Publié: (2026)
Video RWKV:Video Action Recognition Based RWKV
par: Yin, Zhuowen, et autres
Publié: (2024)
par: Yin, Zhuowen, et autres
Publié: (2024)
Discrete Prompt Tuning via Recursive Utilization of Black-box Multimodal Large Language Model for Personalized Visual Emotion Recognition
par: Takahashi, Ryo, et autres
Publié: (2025)
par: Takahashi, Ryo, et autres
Publié: (2025)
Which Client is Reliable?: A Reliable and Personalized Prompt-based Federated Learning for Medical Image Question Answering
par: Zhu, He, et autres
Publié: (2024)
par: Zhu, He, et autres
Publié: (2024)
Prompt-based Personalized Federated Learning for Medical Visual Question Answering
par: Zhu, He, et autres
Publié: (2024)
par: Zhu, He, et autres
Publié: (2024)
StarMAP: Global Neighbor Embedding for Faithful Data Visualization
par: Watanabe, Koshi, et autres
Publié: (2025)
par: Watanabe, Koshi, et autres
Publié: (2025)
Personalized Federated Learning for Egocentric Video Gaze Estimation with Comprehensive Parameter Frezzing
par: Feng, Yuhu, et autres
Publié: (2025)
par: Feng, Yuhu, et autres
Publié: (2025)
LLM is Knowledge Graph Reasoner: LLM's Intuition-aware Knowledge Graph Reasoning for Cold-start Sequential Recommendation
par: Sakurai, Keigo, et autres
Publié: (2024)
par: Sakurai, Keigo, et autres
Publié: (2024)
Hyperboloid GPLVM for Discovering Continuous Hierarchies via Nonparametric Estimation
par: Watanabe, Koshi, et autres
Publié: (2024)
par: Watanabe, Koshi, et autres
Publié: (2024)
Enhancing Generative Class Incremental Learning Performance with Model Forgetting Approach
par: Togo, Taro, et autres
Publié: (2024)
par: Togo, Taro, et autres
Publié: (2024)
Triplet Synthesis For Enhancing Composed Image Retrieval via Counterfactual Image Generation
par: Uesugi, Kenta, et autres
Publié: (2025)
par: Uesugi, Kenta, et autres
Publié: (2025)
Zero-shot Composed Image Retrieval Considering Query-target Relationship Leveraging Masked Image-text Pairs
par: Zhang, Huaying, et autres
Publié: (2024)
par: Zhang, Huaying, et autres
Publié: (2024)
Task-Specific Generative Dataset Distillation with Difficulty-Guided Sampling
par: Li, Mingzhuo, et autres
Publié: (2025)
par: Li, Mingzhuo, et autres
Publié: (2025)
Generative Dataset Distillation Based on Self-knowledge Distillation
par: Li, Longzhen, et autres
Publié: (2025)
par: Li, Longzhen, et autres
Publié: (2025)
Dual-Model Weight Selection and Self-Knowledge Distillation for Medical Image Classification
par: Tsutsumi, Ayaka, et autres
Publié: (2025)
par: Tsutsumi, Ayaka, et autres
Publié: (2025)
Generative Dataset Distillation: Balancing Global Structure and Local Details
par: Li, Longzhen, et autres
Publié: (2024)
par: Li, Longzhen, et autres
Publié: (2024)
Foreground-Aware Dataset Distillation via Dynamic Patch Selection
par: Li, Longzhen, et autres
Publié: (2026)
par: Li, Longzhen, et autres
Publié: (2026)
MMT-BERT: Chord-aware Symbolic Music Generation Based on Multitrack Music Transformer and MusicBERT
par: Zhu, Jinlong, et autres
Publié: (2024)
par: Zhu, Jinlong, et autres
Publié: (2024)
Objectness Similarity: Capturing Object-Level Fidelity in 3D Scene Evaluation
par: Uchida, Yuiko, et autres
Publié: (2025)
par: Uchida, Yuiko, et autres
Publié: (2025)
Reinforcing Pre-trained Models Using Counterfactual Images
par: Li, Xiang, et autres
Publié: (2024)
par: Li, Xiang, et autres
Publié: (2024)
Information-Guided Diffusion Sampling for Dataset Distillation
par: Ye, Linfeng, et autres
Publié: (2025)
par: Ye, Linfeng, et autres
Publié: (2025)
Generative Dataset Distillation Based on Diffusion Model
par: Su, Duo, et autres
Publié: (2024)
par: Su, Duo, et autres
Publié: (2024)
Difficulty-guided Sampling: Bridging the Target Gap between Dataset Distillation and Downstream Tasks
par: Li, Mingzhuo, et autres
Publié: (2026)
par: Li, Mingzhuo, et autres
Publié: (2026)
SAS: Semantic-aware Sampling for Generative Dataset Distillation
par: Li, Mingzhuo, et autres
Publié: (2026)
par: Li, Mingzhuo, et autres
Publié: (2026)
FD$^2$: A Dedicated Framework for Fine-Grained Dataset Distillation
par: Ma, Hongxu, et autres
Publié: (2026)
par: Ma, Hongxu, et autres
Publié: (2026)
Multimodal Prototype-Enhanced Network for Few-Shot Action Recognition
par: Ni, Xinzhe, et autres
Publié: (2022)
par: Ni, Xinzhe, et autres
Publié: (2022)
Documents similaires
-
Manta: Enhancing Mamba for Few-Shot Action Recognition of Long Sub-Sequence
par: Huang, Wenbo, et autres
Publié: (2024) -
Cross-domain Few-shot In-context Learning for Enhancing Traffic Sign Recognition
par: Gan, Yaozong, et autres
Publié: (2024) -
SOAP: Enhancing Spatio-Temporal Relation and Motion Information Capturing for Few-Shot Action Recognition
par: Huang, Wenbo, et autres
Publié: (2024) -
Few-shot Personalized Saliency Prediction Based on Interpersonal Gaze Patterns
par: Moroto, Yuya, et autres
Publié: (2023) -
Soft-Label Anonymous Gastric X-ray Image Distillation
par: Li, Guang, et autres
Publié: (2021)