Dyn-Adapter: Towards Disentangled Representation for Efficient Visual Recognition
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Yurong, Chen, Honghao, Zhang, Xinyu, Chu, Xiangxiang, Song, Li |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Revealing the Dark Secrets of Extremely Large Kernel ConvNets on Robustness
di: Chen, Honghao, et al.
Pubblicazione: (2024)
di: Chen, Honghao, et al.
Pubblicazione: (2024)
DynTok: Dynamic Compression of Visual Tokens for Efficient and Effective Video Understanding
di: Zhang, Hongzhi, et al.
Pubblicazione: (2025)
di: Zhang, Hongzhi, et al.
Pubblicazione: (2025)
PeLK: Parameter-efficient Large Kernel ConvNets with Peripheral Convolution
di: Chen, Honghao, et al.
Pubblicazione: (2024)
di: Chen, Honghao, et al.
Pubblicazione: (2024)
EVCtrl: Efficient Control Adapter for Visual Generation
di: Yang, Zixiang, et al.
Pubblicazione: (2025)
di: Yang, Zixiang, et al.
Pubblicazione: (2025)
ConceptWeaver: Weaving Disentangled Concepts with Flow
di: Chen, Jintao, et al.
Pubblicazione: (2026)
di: Chen, Jintao, et al.
Pubblicazione: (2026)
D$^2$ST-Adapter: Disentangled-and-Deformable Spatio-Temporal Adapter for Few-shot Action Recognition
di: Pei, Wenjie, et al.
Pubblicazione: (2023)
di: Pei, Wenjie, et al.
Pubblicazione: (2023)
AdaFedFR: Federated Face Recognition with Adaptive Inter-Class Representation Learning
di: Qiu, Di, et al.
Pubblicazione: (2024)
di: Qiu, Di, et al.
Pubblicazione: (2024)
Prompt-guided Disentangled Representation for Action Recognition
di: Wu, Tianci, et al.
Pubblicazione: (2025)
di: Wu, Tianci, et al.
Pubblicazione: (2025)
LLMs Meet Long Video: Advancing Long Video Question Answering with An Interactive Visual Adapter in LLMs
di: Li, Yunxin, et al.
Pubblicazione: (2024)
di: Li, Yunxin, et al.
Pubblicazione: (2024)
MoSA: Mixture of Sparse Adapters for Visual Efficient Tuning
di: Zhang, Qizhe, et al.
Pubblicazione: (2023)
di: Zhang, Qizhe, et al.
Pubblicazione: (2023)
RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers
di: Gong, Yan, et al.
Pubblicazione: (2025)
di: Gong, Yan, et al.
Pubblicazione: (2025)
DynImg: Key Frames with Visual Prompts are Good Representation for Multi-Modal Video Understanding
di: Bao, Xiaoyi, et al.
Pubblicazione: (2025)
di: Bao, Xiaoyi, et al.
Pubblicazione: (2025)
DEADiff: An Efficient Stylization Diffusion Model with Disentangled Representations
di: Qi, Tianhao, et al.
Pubblicazione: (2024)
di: Qi, Tianhao, et al.
Pubblicazione: (2024)
ProxyImg: Towards Highly-Controllable Image Representation via Hierarchical Disentangled Proxy Embedding
di: Chen, Ye, et al.
Pubblicazione: (2026)
di: Chen, Ye, et al.
Pubblicazione: (2026)
UPRE: Zero-Shot Domain Adaptation for Object Detection via Unified Prompt and Representation Enhancement
di: Zhang, Xiao, et al.
Pubblicazione: (2025)
di: Zhang, Xiao, et al.
Pubblicazione: (2025)
DivTrackee versus DynTracker: Promoting Diversity in Anti-Facial Recognition against Dynamic FR Strategy
di: Fan, Wenshu, et al.
Pubblicazione: (2025)
di: Fan, Wenshu, et al.
Pubblicazione: (2025)
Choose What You Need: Disentangled Representation Learning for Scene Text Recognition, Removal and Editing
di: Zhang, Boqiang, et al.
Pubblicazione: (2024)
di: Zhang, Boqiang, et al.
Pubblicazione: (2024)
Effective Adapter for Face Recognition in the Wild
di: Liu, Yunhao, et al.
Pubblicazione: (2023)
di: Liu, Yunhao, et al.
Pubblicazione: (2023)
DrFER: Learning Disentangled Representations for 3D Facial Expression Recognition
di: Li, Hebeizi, et al.
Pubblicazione: (2024)
di: Li, Hebeizi, et al.
Pubblicazione: (2024)
Test-time Distribution Learning Adapter for Cross-modal Visual Reasoning
di: Zhang, Yi, et al.
Pubblicazione: (2024)
di: Zhang, Yi, et al.
Pubblicazione: (2024)
Towards Robust Algorithms for Surgical Phase Recognition via Digital Twin Representation
di: Ding, Hao, et al.
Pubblicazione: (2024)
di: Ding, Hao, et al.
Pubblicazione: (2024)
Eevee: Towards Close-up High-resolution Video-based Virtual Try-on
di: Zeng, Jianhao, et al.
Pubblicazione: (2025)
di: Zeng, Jianhao, et al.
Pubblicazione: (2025)
SAGE: Spatial-visual Adaptive Graph Exploration for Efficient Visual Place Recognition
di: Chen, Shunpeng, et al.
Pubblicazione: (2025)
di: Chen, Shunpeng, et al.
Pubblicazione: (2025)
One Adapter for All: Towards Unified Representation in Step-Imbalanced Class-Incremental Learning
di: Zhang, Xiaoyan, et al.
Pubblicazione: (2026)
di: Zhang, Xiaoyan, et al.
Pubblicazione: (2026)
USP: Unified Self-Supervised Pretraining for Image Generation and Understanding
di: Chu, Xiangxiang, et al.
Pubblicazione: (2025)
di: Chu, Xiangxiang, et al.
Pubblicazione: (2025)
Mixture of Physical Priors Adapter for Parameter-Efficient Fine-Tuning
di: Wang, Zhaozhi, et al.
Pubblicazione: (2024)
di: Wang, Zhaozhi, et al.
Pubblicazione: (2024)
Towards Efficient and Effective Text-to-Video Retrieval with Coarse-to-Fine Visual Representation Learning
di: Tian, Kaibin, et al.
Pubblicazione: (2024)
di: Tian, Kaibin, et al.
Pubblicazione: (2024)
Q-Adapter: Visual Query Adapter for Extracting Textually-related Features in Video Captioning
di: Chen, Junan, et al.
Pubblicazione: (2025)
di: Chen, Junan, et al.
Pubblicazione: (2025)
RAP: Efficient Text-Video Retrieval with Sparse-and-Correlated Adapter
di: Cao, Meng, et al.
Pubblicazione: (2024)
di: Cao, Meng, et al.
Pubblicazione: (2024)
DynSUP: Dynamic Gaussian Splatting from An Unposed Image Pair
di: Li, Weihang, et al.
Pubblicazione: (2024)
di: Li, Weihang, et al.
Pubblicazione: (2024)
LadderMoE: Ladder-Side Mixture of Experts Adapters for Bronze Inscription Recognition
di: Zhou, Rixin, et al.
Pubblicazione: (2025)
di: Zhou, Rixin, et al.
Pubblicazione: (2025)
Hierarchical Disentanglement-Alignment Network for Robust SAR Vehicle Recognition
di: Li, Weijie, et al.
Pubblicazione: (2023)
di: Li, Weijie, et al.
Pubblicazione: (2023)
LAFR: Efficient Diffusion-based Blind Face Restoration via Latent Codebook Alignment Adapter
di: Li, Runyi, et al.
Pubblicazione: (2025)
di: Li, Runyi, et al.
Pubblicazione: (2025)
Memory Efficient Transformer Adapter for Dense Predictions
di: Zhang, Dong, et al.
Pubblicazione: (2025)
di: Zhang, Dong, et al.
Pubblicazione: (2025)
VisionLLaMA: A Unified LLaMA Backbone for Vision Tasks
di: Chu, Xiangxiang, et al.
Pubblicazione: (2024)
di: Chu, Xiangxiang, et al.
Pubblicazione: (2024)
Pear: Pruning and Sharing Adapters in Visual Parameter-Efficient Fine-Tuning
di: Zhong, Yibo, et al.
Pubblicazione: (2024)
di: Zhong, Yibo, et al.
Pubblicazione: (2024)
Lightweight Pixel Difference Networks for Efficient Visual Representation Learning
di: Su, Zhuo, et al.
Pubblicazione: (2024)
di: Su, Zhuo, et al.
Pubblicazione: (2024)
PMA: Towards Parameter-Efficient Point Cloud Understanding via Point Mamba Adapter
di: Zha, Yaohua, et al.
Pubblicazione: (2025)
di: Zha, Yaohua, et al.
Pubblicazione: (2025)
Task-Adapter: Task-specific Adaptation of Image Models for Few-shot Action Recognition
di: Cao, Congqi, et al.
Pubblicazione: (2024)
di: Cao, Congqi, et al.
Pubblicazione: (2024)
Efficient Visual Representation Learning with Heat Conduction Equation
di: Zhang, Zhemin, et al.
Pubblicazione: (2024)
di: Zhang, Zhemin, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Revealing the Dark Secrets of Extremely Large Kernel ConvNets on Robustness
di: Chen, Honghao, et al.
Pubblicazione: (2024) -
DynTok: Dynamic Compression of Visual Tokens for Efficient and Effective Video Understanding
di: Zhang, Hongzhi, et al.
Pubblicazione: (2025) -
PeLK: Parameter-efficient Large Kernel ConvNets with Peripheral Convolution
di: Chen, Honghao, et al.
Pubblicazione: (2024) -
EVCtrl: Efficient Control Adapter for Visual Generation
di: Yang, Zixiang, et al.
Pubblicazione: (2025) -
ConceptWeaver: Weaving Disentangled Concepts with Flow
di: Chen, Jintao, et al.
Pubblicazione: (2026)