1%>100%: High-Efficiency Visual Adapter with Complex Linear Projection Optimization
Fuente:
arXiv
Guardado en:
| Autores principales: | Yin, Dongshuo, Yang, Xue, Fan, Deng-Ping, Hu, Shi-Min |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
5%>100%: Breaking Performance Shackles of Full Fine-Tuning on Visual Recognition Tasks
por: Yin, Dongshuo, et al.
Publicado: (2024)
por: Yin, Dongshuo, et al.
Publicado: (2024)
Prompt-Aware Adapter: Towards Learning Adaptive Visual Tokens for Multimodal Large Language Models
por: Zhang, Yue, et al.
Publicado: (2024)
por: Zhang, Yue, et al.
Publicado: (2024)
Character-Adapter: Prompt-Guided Region Control for High-Fidelity Character Customization
por: Ma, Yuhang, et al.
Publicado: (2024)
por: Ma, Yuhang, et al.
Publicado: (2024)
Beyond Task-Specific Reasoning: A Unified Conditional Generative Framework for Abstract Visual Reasoning
por: Shi, Fan, et al.
Publicado: (2025)
por: Shi, Fan, et al.
Publicado: (2025)
DM-Adapter: Domain-Aware Mixture-of-Adapters for Text-Based Person Retrieval
por: Liu, Yating, et al.
Publicado: (2025)
por: Liu, Yating, et al.
Publicado: (2025)
FlowGuard: Towards Lightweight In-Generation Safety Detection for Diffusion Models via Linear Latent Decoding
por: Yang, Jinghan, et al.
Publicado: (2026)
por: Yang, Jinghan, et al.
Publicado: (2026)
CAT: Contrastive Adapter Training for Personalized Image Generation
por: Park, Jae Wan, et al.
Publicado: (2024)
por: Park, Jae Wan, et al.
Publicado: (2024)
A Simple Efficiency Incremental Learning Framework via Vision-Language Model with Nonlinear Multi-Adapters
por: Luo, Haihua, et al.
Publicado: (2026)
por: Luo, Haihua, et al.
Publicado: (2026)
HiCAST: Highly Customized Arbitrary Style Transfer with Adapter Enhanced Diffusion Models
por: Wang, Hanzhang, et al.
Publicado: (2024)
por: Wang, Hanzhang, et al.
Publicado: (2024)
From Holistic to Localized: Local Enhanced Adapters for Efficient Visual Instruction Fine-Tuning
por: Jiao, Pengkun, et al.
Publicado: (2024)
por: Jiao, Pengkun, et al.
Publicado: (2024)
3D-Adapter: Geometry-Consistent Multi-View Diffusion for High-Quality 3D Generation
por: Chen, Hansheng, et al.
Publicado: (2024)
por: Chen, Hansheng, et al.
Publicado: (2024)
Open-MAGVIT2: An Open-Source Project Toward Democratizing Auto-regressive Visual Generation
por: Luo, Zhuoyan, et al.
Publicado: (2024)
por: Luo, Zhuoyan, et al.
Publicado: (2024)
DMTrack: Spatio-Temporal Multimodal Tracking via Dual-Adapter
por: Li, Weihong, et al.
Publicado: (2025)
por: Li, Weihong, et al.
Publicado: (2025)
Autoregressive Image Generation with Linear Complexity: A Spatial-Aware Decay Perspective
por: Mao, Yuxin, et al.
Publicado: (2025)
por: Mao, Yuxin, et al.
Publicado: (2025)
VARGPT-v1.1: Improve Visual Autoregressive Large Unified Model via Iterative Instruction Tuning and Reinforcement Learning
por: Zhuang, Xianwei, et al.
Publicado: (2025)
por: Zhuang, Xianwei, et al.
Publicado: (2025)
Preventing Shortcuts in Adapter Training via Providing the Shortcuts
por: Goyal, Anujraaj Argo, et al.
Publicado: (2025)
por: Goyal, Anujraaj Argo, et al.
Publicado: (2025)
Stability Plasticity Decoupled Fine-tuning For Few-shot end-to-end Object Detection
por: Yin, Yuantao, et al.
Publicado: (2024)
por: Yin, Yuantao, et al.
Publicado: (2024)
Multi-Grained Compositional Visual Clue Learning for Image Intent Recognition
por: Tang, Yin, et al.
Publicado: (2025)
por: Tang, Yin, et al.
Publicado: (2025)
Conv-Adapter: Exploring Parameter Efficient Transfer Learning for ConvNets
por: Chen, Hao, et al.
Publicado: (2022)
por: Chen, Hao, et al.
Publicado: (2022)
EAD: An EEG Adapter for Automated Classification
por: Singh, Pushapdeep, et al.
Publicado: (2025)
por: Singh, Pushapdeep, et al.
Publicado: (2025)
ICAS: IP Adapter and ControlNet-based Attention Structure for Multi-Subject Style Transfer Optimization
por: Liu, Fuwei
Publicado: (2025)
por: Liu, Fuwei
Publicado: (2025)
CA-Edit: Causality-Aware Condition Adapter for High-Fidelity Local Facial Attribute Editing
por: Xian, Xiaole, et al.
Publicado: (2024)
por: Xian, Xiaole, et al.
Publicado: (2024)
DynaSplat: Dynamic-Static Gaussian Splatting with Hierarchical Motion Decomposition for Scene Reconstruction
por: Deng, Junli, et al.
Publicado: (2025)
por: Deng, Junli, et al.
Publicado: (2025)
Optimizing Dense Visual Predictions Through Multi-Task Coherence and Prioritization
por: Fontana, Maxime, et al.
Publicado: (2024)
por: Fontana, Maxime, et al.
Publicado: (2024)
Federated Cross-Modal Retrieval with Missing Modalities via Semantic Routing and Adapter Personalization
por: Zhou, Hefeng, et al.
Publicado: (2026)
por: Zhou, Hefeng, et al.
Publicado: (2026)
Generating Surface for Text-to-3D using 2D Gaussian Splatting
por: Dong, Huanning, et al.
Publicado: (2025)
por: Dong, Huanning, et al.
Publicado: (2025)
Complexity in Complexity: Understanding Visual Complexity Through Structure, Color, and Surprise
por: Sarıtaş, Karahan, et al.
Publicado: (2025)
por: Sarıtaş, Karahan, et al.
Publicado: (2025)
Optimized Vectorizing of Building Structures with Switch: High-Efficiency Convolutional Channel-Switch Hybridization Strategy
por: Lin, Moule, et al.
Publicado: (2023)
por: Lin, Moule, et al.
Publicado: (2023)
VS-LLM: Visual-Semantic Depression Assessment based on LLM for Drawing Projection Test
por: Wu, Meiqi, et al.
Publicado: (2025)
por: Wu, Meiqi, et al.
Publicado: (2025)
Variational Adapter for Cross-modal Similarity Representation
por: Wei, WenZhang, et al.
Publicado: (2026)
por: Wei, WenZhang, et al.
Publicado: (2026)
ViG: Linear-complexity Visual Sequence Learning with Gated Linear Attention
por: Liao, Bencheng, et al.
Publicado: (2024)
por: Liao, Bencheng, et al.
Publicado: (2024)
Semantic Similarity Score for Measuring Visual Similarity at Semantic Level
por: Fan, Senran, et al.
Publicado: (2024)
por: Fan, Senran, et al.
Publicado: (2024)
StyleCrafter: Enhancing Stylized Text-to-Video Generation with Style Adapter
por: Liu, Gongye, et al.
Publicado: (2023)
por: Liu, Gongye, et al.
Publicado: (2023)
FMNet: Frequency-Assisted Mamba-Like Linear Attention Network for Camouflaged Object Detection
por: Deng, Ming, et al.
Publicado: (2025)
por: Deng, Ming, et al.
Publicado: (2025)
AdaIR: Exploiting Underlying Similarities of Image Restoration Tasks with Adapters
por: Chen, Hao-Wei, et al.
Publicado: (2024)
por: Chen, Hao-Wei, et al.
Publicado: (2024)
HumanEval-V: Benchmarking High-Level Visual Reasoning with Complex Diagrams in Coding Tasks
por: Zhang, Fengji, et al.
Publicado: (2024)
por: Zhang, Fengji, et al.
Publicado: (2024)
Reversible Unfolding Network for Concealed Visual Perception with Generative Refinement
por: He, Chunming, et al.
Publicado: (2025)
por: He, Chunming, et al.
Publicado: (2025)
FaceChain-FACT: Face Adapter with Decoupled Training for Identity-preserved Personalization
por: Yu, Cheng, et al.
Publicado: (2024)
por: Yu, Cheng, et al.
Publicado: (2024)
Att-Adapter: A Robust and Precise Domain-Specific Multi-Attributes T2I Diffusion Adapter via Conditional Variational Autoencoder
por: Cho, Wonwoong, et al.
Publicado: (2025)
por: Cho, Wonwoong, et al.
Publicado: (2025)
Decoupled Prompt-Adapter Tuning for Continual Activity Recognition
por: Fu, Di, et al.
Publicado: (2024)
por: Fu, Di, et al.
Publicado: (2024)
Ejemplares similares
-
5%>100%: Breaking Performance Shackles of Full Fine-Tuning on Visual Recognition Tasks
por: Yin, Dongshuo, et al.
Publicado: (2024) -
Prompt-Aware Adapter: Towards Learning Adaptive Visual Tokens for Multimodal Large Language Models
por: Zhang, Yue, et al.
Publicado: (2024) -
Character-Adapter: Prompt-Guided Region Control for High-Fidelity Character Customization
por: Ma, Yuhang, et al.
Publicado: (2024) -
Beyond Task-Specific Reasoning: A Unified Conditional Generative Framework for Abstract Visual Reasoning
por: Shi, Fan, et al.
Publicado: (2025) -
DM-Adapter: Domain-Aware Mixture-of-Adapters for Text-Based Person Retrieval
por: Liu, Yating, et al.
Publicado: (2025)