HeBA: Heterogeneous Bottleneck Adapters for Robust Vision-Language Models
Fuente:
arXiv
Salvato in:
| Autore principale: | Islam, Md Jahidul |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
ReHARK: Refined Hybrid Adaptive RBF Kernels for Robust One-Shot Vision-Language Adaptation
di: Islam, Md Jahidul
Pubblicazione: (2026)
di: Islam, Md Jahidul
Pubblicazione: (2026)
HeGraphAdapter: Tuning Multi-Modal Vision-Language Models with Heterogeneous Graph Adapter
di: Zhao, Yumiao, et al.
Pubblicazione: (2024)
di: Zhao, Yumiao, et al.
Pubblicazione: (2024)
W-DUALMINE: Reliability-Weighted Dual-Expert Fusion With Residual Correlation Preservation for Medical Image Fusion
di: Islam, Md. Jahidul
Pubblicazione: (2026)
di: Islam, Md. Jahidul
Pubblicazione: (2026)
HiRQA: Hierarchical Ranking and Quality Alignment for Opinion-Unaware Image Quality Assessment
di: Ramesh, Vaishnav, et al.
Pubblicazione: (2025)
di: Ramesh, Vaishnav, et al.
Pubblicazione: (2025)
Robust Calibration of Large Vision-Language Adapters
di: Murugesan, Balamurali, et al.
Pubblicazione: (2024)
di: Murugesan, Balamurali, et al.
Pubblicazione: (2024)
DGIQA: Depth-guided Feature Attention and Refinement for Generalizable Image Quality Assessment
di: Ramesh, Vaishnav, et al.
Pubblicazione: (2025)
di: Ramesh, Vaishnav, et al.
Pubblicazione: (2025)
CLIP-Adapter: Better Vision-Language Models with Feature Adapters
di: Gao, Peng, et al.
Pubblicazione: (2021)
di: Gao, Peng, et al.
Pubblicazione: (2021)
AquaFuse: Waterbody Fusion for Physics Guided View Synthesis of Underwater Scenes
di: Siddique, Md Abu Bakr, et al.
Pubblicazione: (2024)
di: Siddique, Md Abu Bakr, et al.
Pubblicazione: (2024)
Test-time Alignment-Enhanced Adapter for Vision-Language Models
di: Tong, Baoshun, et al.
Pubblicazione: (2024)
di: Tong, Baoshun, et al.
Pubblicazione: (2024)
T-Gated Adapter: A Lightweight Temporal Adapter for Vision-Language Medical Segmentation
di: Khadka, Pranjal
Pubblicazione: (2026)
di: Khadka, Pranjal
Pubblicazione: (2026)
Improving Concept Alignment in Vision-Language Concept Bottleneck Models
di: Selvaraj, Nithish Muthuchamy, et al.
Pubblicazione: (2024)
di: Selvaraj, Nithish Muthuchamy, et al.
Pubblicazione: (2024)
Meta-Adapter: An Online Few-shot Learner for Vision-Language Model
di: Cheng, Cheng, et al.
Pubblicazione: (2023)
di: Cheng, Cheng, et al.
Pubblicazione: (2023)
IKIWISI: An Interactive Visual Pattern Generator for Evaluating the Reliability of Vision-Language Models Without Ground Truth
di: Islam, Md Touhidul, et al.
Pubblicazione: (2025)
di: Islam, Md Touhidul, et al.
Pubblicazione: (2025)
Vision-Language Models for Automated Chest X-ray Interpretation: Leveraging ViT and GPT-2
di: Islam, Md. Rakibul, et al.
Pubblicazione: (2025)
di: Islam, Md. Rakibul, et al.
Pubblicazione: (2025)
Boosting Continual Learning of Vision-Language Models via Mixture-of-Experts Adapters
di: Yu, Jiazuo, et al.
Pubblicazione: (2024)
di: Yu, Jiazuo, et al.
Pubblicazione: (2024)
Isolated Bangla Handwritten Character Classification using Transfer Learning
di: Karim, Abdul, et al.
Pubblicazione: (2025)
di: Karim, Abdul, et al.
Pubblicazione: (2025)
Mema: Memory-Augmented Adapter for Enhanced Vision-Language Understanding
di: Liu, Ying, et al.
Pubblicazione: (2026)
di: Liu, Ying, et al.
Pubblicazione: (2026)
ReVisionLLM: Recursive Vision-Language Model for Temporal Grounding in Hour-Long Videos
di: Hannan, Tanveer, et al.
Pubblicazione: (2024)
di: Hannan, Tanveer, et al.
Pubblicazione: (2024)
DIMoE-Adapters: Dynamic Expert Evolution for Continual Learning in Vision-Language Models
di: Qin, Mengxin, et al.
Pubblicazione: (2026)
di: Qin, Mengxin, et al.
Pubblicazione: (2026)
Skip Tuning: Pre-trained Vision-Language Models are Effective and Efficient Adapters Themselves
di: Wu, Shihan, et al.
Pubblicazione: (2024)
di: Wu, Shihan, et al.
Pubblicazione: (2024)
A Robust Deep Learning Framework for Bangla License Plate Recognition Using YOLO and Vision-Language OCR
di: Hasin, Nayeb, et al.
Pubblicazione: (2026)
di: Hasin, Nayeb, et al.
Pubblicazione: (2026)
Few-Shot-Based Modular Image-to-Video Adapter for Diffusion Models
di: Li, Zhenhao, et al.
Pubblicazione: (2025)
di: Li, Zhenhao, et al.
Pubblicazione: (2025)
TAB: Transformer Attention Bottlenecks enable User Intervention and Debugging in Vision-Language Models
di: Rahmanzadehgervi, Pooyan, et al.
Pubblicazione: (2024)
di: Rahmanzadehgervi, Pooyan, et al.
Pubblicazione: (2024)
QueryAdapter: Rapid Adaptation of Vision-Language Models in Response to Natural Language Queries
di: Chapman, Nicolas Harvey, et al.
Pubblicazione: (2025)
di: Chapman, Nicolas Harvey, et al.
Pubblicazione: (2025)
Single-Step Latent Diffusion for Underwater Image Restoration
di: Wu, Jiayi, et al.
Pubblicazione: (2025)
di: Wu, Jiayi, et al.
Pubblicazione: (2025)
An Explainable Vision-Language Model Framework with Adaptive PID-Tversky Loss for Lumbar Spinal Stenosis Diagnosis
di: Sk., Md. Sajeebul Islam, et al.
Pubblicazione: (2026)
di: Sk., Md. Sajeebul Islam, et al.
Pubblicazione: (2026)
UStyle: Waterbody Style Transfer of Underwater Scenes by Depth-Guided Feature Synthesis
di: Siddique, Md Abu Bakr, et al.
Pubblicazione: (2025)
di: Siddique, Md Abu Bakr, et al.
Pubblicazione: (2025)
Multi-Modal Adapter for Vision-Language Models
di: Seputis, Dominykas, et al.
Pubblicazione: (2024)
di: Seputis, Dominykas, et al.
Pubblicazione: (2024)
Unveiling the Visual Counting Bottleneck in Vision-Language Models
di: Pang, Xingzhou, et al.
Pubblicazione: (2026)
di: Pang, Xingzhou, et al.
Pubblicazione: (2026)
Noise-Tolerant Few-Shot Unsupervised Adapter for Vision-Language Models
di: Ali, Eman, et al.
Pubblicazione: (2023)
di: Ali, Eman, et al.
Pubblicazione: (2023)
Attn-Adapter: Attention Is All You Need for Online Few-shot Learner of Vision-Language Model
di: Bui, Phuoc-Nguyen, et al.
Pubblicazione: (2025)
di: Bui, Phuoc-Nguyen, et al.
Pubblicazione: (2025)
Beyond CLIP Generalization: Against Forward&Backward Forgetting Adapter for Continual Learning of Vision-Language Models
di: Dong, Songlin, et al.
Pubblicazione: (2025)
di: Dong, Songlin, et al.
Pubblicazione: (2025)
NODE-Adapter: Neural Ordinary Differential Equations for Better Vision-Language Reasoning
di: Zhang, Yi, et al.
Pubblicazione: (2024)
di: Zhang, Yi, et al.
Pubblicazione: (2024)
A Two-Stage Multitask Vision-Language Framework for Explainable Crop Disease Visual Question Answering
di: Hossain, Md. Zahid, et al.
Pubblicazione: (2026)
di: Hossain, Md. Zahid, et al.
Pubblicazione: (2026)
Diagnosing Bottlenecks in Data Visualization Understanding by Vision-Language Models
di: Tartaglini, Alexa R., et al.
Pubblicazione: (2025)
di: Tartaglini, Alexa R., et al.
Pubblicazione: (2025)
Rethinking Bottlenecks in Safety Fine-Tuning of Vision Language Models
di: Ding, Yi, et al.
Pubblicazione: (2025)
di: Ding, Yi, et al.
Pubblicazione: (2025)
Quality Text, Robust Vision: The Role of Language in Enhancing Visual Robustness of Vision-Language Models
di: Waseda, Futa, et al.
Pubblicazione: (2025)
di: Waseda, Futa, et al.
Pubblicazione: (2025)
VLG-CBM: Training Concept Bottleneck Models with Vision-Language Guidance
di: Srivastava, Divyansh, et al.
Pubblicazione: (2024)
di: Srivastava, Divyansh, et al.
Pubblicazione: (2024)
Cross-Modal Adapter for Vision-Language Retrieval
di: Jiang, Haojun, et al.
Pubblicazione: (2022)
di: Jiang, Haojun, et al.
Pubblicazione: (2022)
Exploring Training on Heterogeneous Data with Mixture of Low-rank Adapters
di: Zhou, Yuhang, et al.
Pubblicazione: (2024)
di: Zhou, Yuhang, et al.
Pubblicazione: (2024)
Documenti analoghi
-
ReHARK: Refined Hybrid Adaptive RBF Kernels for Robust One-Shot Vision-Language Adaptation
di: Islam, Md Jahidul
Pubblicazione: (2026) -
HeGraphAdapter: Tuning Multi-Modal Vision-Language Models with Heterogeneous Graph Adapter
di: Zhao, Yumiao, et al.
Pubblicazione: (2024) -
W-DUALMINE: Reliability-Weighted Dual-Expert Fusion With Residual Correlation Preservation for Medical Image Fusion
di: Islam, Md. Jahidul
Pubblicazione: (2026) -
HiRQA: Hierarchical Ranking and Quality Alignment for Opinion-Unaware Image Quality Assessment
di: Ramesh, Vaishnav, et al.
Pubblicazione: (2025) -
Robust Calibration of Large Vision-Language Adapters
di: Murugesan, Balamurali, et al.
Pubblicazione: (2024)