Improvise, Adapt, Overcome -- Telescopic Adapters for Efficient Fine-tuning of Vision Language Models in Medical Imaging
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Mishra, Ujjwal, Shukla, Vinita, Hambarde, Praful, Shukla, Amit |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
GRAD-Former: Gated Robust Attention-based Differential Transformer for Change Detection
von: Ameta, Durgesh, et al.
Veröffentlicht: (2026)
von: Ameta, Durgesh, et al.
Veröffentlicht: (2026)
Clear Roads, Clear Vision: Advancements in Multi-Weather Restoration for Smart Transportation
von: Galshetwar, Vijay M., et al.
Veröffentlicht: (2025)
von: Galshetwar, Vijay M., et al.
Veröffentlicht: (2025)
Fine-tuning Vision Language Models with Graph-based Knowledge for Explainable Medical Image Analysis
von: Li, Chenjun, et al.
Veröffentlicht: (2025)
von: Li, Chenjun, et al.
Veröffentlicht: (2025)
BID-LoRA: A Parameter-Efficient Framework for Continual Learning and Unlearning
von: Rachapudi, Jagadeesh, et al.
Veröffentlicht: (2026)
von: Rachapudi, Jagadeesh, et al.
Veröffentlicht: (2026)
Efficient Medical Vision-Language Alignment Through Adapting Masked Vision Models
von: Lian, Chenyu, et al.
Veröffentlicht: (2025)
von: Lian, Chenyu, et al.
Veröffentlicht: (2025)
Can GPT-4o mini and Gemini 2.0 Flash Predict Fine-Grained Fashion Product Attributes? A Zero-Shot Analysis
von: Shukla, Shubham, et al.
Veröffentlicht: (2025)
von: Shukla, Shubham, et al.
Veröffentlicht: (2025)
Difference Vector Equalization for Robust Fine-tuning of Vision-Language Models
von: Suzuki, Satoshi, et al.
Veröffentlicht: (2025)
von: Suzuki, Satoshi, et al.
Veröffentlicht: (2025)
PatentLMM: Large Multimodal Model for Generating Descriptions for Patent Figures
von: Shukla, Shreya, et al.
Veröffentlicht: (2025)
von: Shukla, Shreya, et al.
Veröffentlicht: (2025)
LLaMA-Adapter: Efficient Fine-tuning of Language Models with Zero-init Attention
von: Zhang, Renrui, et al.
Veröffentlicht: (2023)
von: Zhang, Renrui, et al.
Veröffentlicht: (2023)
A Simple and Effective Reinforcement Learning Method for Text-to-Image Diffusion Fine-tuning
von: Gupta, Shashank, et al.
Veröffentlicht: (2025)
von: Gupta, Shashank, et al.
Veröffentlicht: (2025)
DiffExp: Efficient Exploration in Reward Fine-tuning for Text-to-Image Diffusion Models
von: Chae, Daewon, et al.
Veröffentlicht: (2025)
von: Chae, Daewon, et al.
Veröffentlicht: (2025)
Fine-tuning Pre-trained Vision-Language Models in a Human-Annotation-Free Manner
von: Wang, Qian-Wei, et al.
Veröffentlicht: (2026)
von: Wang, Qian-Wei, et al.
Veröffentlicht: (2026)
Probing the Efficacy of Federated Parameter-Efficient Fine-Tuning of Vision Transformers for Medical Image Classification
von: Alkhunaizi, Naif, et al.
Veröffentlicht: (2024)
von: Alkhunaizi, Naif, et al.
Veröffentlicht: (2024)
Overcoming the Pitfalls of Vision-Language Model Finetuning for OOD Generalization
von: Zang, Yuhang, et al.
Veröffentlicht: (2024)
von: Zang, Yuhang, et al.
Veröffentlicht: (2024)
Parameter-Efficient Fine-Tuning Medical Multimodal Large Language Models for Medical Visual Grounding
von: He, Jinlong, et al.
Veröffentlicht: (2024)
von: He, Jinlong, et al.
Veröffentlicht: (2024)
Parameter-Free Fine-tuning via Redundancy Elimination for Vision Foundation Models
von: Long, Jiahuan, et al.
Veröffentlicht: (2025)
von: Long, Jiahuan, et al.
Veröffentlicht: (2025)
Multi-Modal Adapter for Vision-Language Models
von: Seputis, Dominykas, et al.
Veröffentlicht: (2024)
von: Seputis, Dominykas, et al.
Veröffentlicht: (2024)
Connecting the Dots: Collaborative Fine-tuning for Black-Box Vision-Language Models
von: Wang, Zhengbo, et al.
Veröffentlicht: (2024)
von: Wang, Zhengbo, et al.
Veröffentlicht: (2024)
RePAIR: Interactive Machine Unlearning through Prompt-Aware Model Repair
von: Rachapudi, Jagadeesh, et al.
Veröffentlicht: (2026)
von: Rachapudi, Jagadeesh, et al.
Veröffentlicht: (2026)
Is There Knowledge Left to Extract? Evidence of Fragility in Medically Fine-Tuned Vision-Language Models
von: McLaughlin, Oliver, et al.
Veröffentlicht: (2026)
von: McLaughlin, Oliver, et al.
Veröffentlicht: (2026)
Ctrl-Adapter: An Efficient and Versatile Framework for Adapting Diverse Controls to Any Diffusion Model
von: Lin, Han, et al.
Veröffentlicht: (2024)
von: Lin, Han, et al.
Veröffentlicht: (2024)
Adapting Vision-Language Models for E-commerce Understanding at Scale
von: Nulli, Matteo, et al.
Veröffentlicht: (2026)
von: Nulli, Matteo, et al.
Veröffentlicht: (2026)
MedBLIP: Fine-tuning BLIP for Medical Image Captioning
von: Limbu, Manshi, et al.
Veröffentlicht: (2025)
von: Limbu, Manshi, et al.
Veröffentlicht: (2025)
Benchmarking Foundation Models and Parameter-Efficient Fine-Tuning for Prognosis Prediction in Medical Imaging
von: Ruffini, Filippo, et al.
Veröffentlicht: (2025)
von: Ruffini, Filippo, et al.
Veröffentlicht: (2025)
Intersectional Fairness in Vision-Language Models for Medical Image Disease Classification
von: Zhang, Yupeng, et al.
Veröffentlicht: (2025)
von: Zhang, Yupeng, et al.
Veröffentlicht: (2025)
Medical Large Vision Language Models with Multi-Image Visual Ability
von: Yang, Xikai, et al.
Veröffentlicht: (2025)
von: Yang, Xikai, et al.
Veröffentlicht: (2025)
AdaptGCD: Multi-Expert Adapter Tuning for Generalized Category Discovery
von: Qu, Yuxun, et al.
Veröffentlicht: (2024)
von: Qu, Yuxun, et al.
Veröffentlicht: (2024)
Parameter-Efficient Fine-Tuning for Medical Image Analysis: The Missed Opportunity
von: Dutt, Raman, et al.
Veröffentlicht: (2023)
von: Dutt, Raman, et al.
Veröffentlicht: (2023)
A Tiered GAN Approach for Monet-Style Image Generation
von: Neha, FNU, et al.
Veröffentlicht: (2024)
von: Neha, FNU, et al.
Veröffentlicht: (2024)
Adapting Lightweight Vision Language Models for Radiological Visual Question Answering
von: Shourya, Aditya, et al.
Veröffentlicht: (2025)
von: Shourya, Aditya, et al.
Veröffentlicht: (2025)
CheXmix: Unified Generative Pretraining for Vision Language Models in Medical Imaging
von: Kumar, Ashwin, et al.
Veröffentlicht: (2026)
von: Kumar, Ashwin, et al.
Veröffentlicht: (2026)
From Holistic to Localized: Local Enhanced Adapters for Efficient Visual Instruction Fine-Tuning
von: Jiao, Pengkun, et al.
Veröffentlicht: (2024)
von: Jiao, Pengkun, et al.
Veröffentlicht: (2024)
Dual-Signal Adaptive KV-Cache Optimization for Long-Form Video Understanding in Vision-Language Models
von: Sai, Vishnu, et al.
Veröffentlicht: (2026)
von: Sai, Vishnu, et al.
Veröffentlicht: (2026)
Efficient Prompt Tuning of Large Vision-Language Model for Fine-Grained Ship Classification
von: Lan, Long, et al.
Veröffentlicht: (2024)
von: Lan, Long, et al.
Veröffentlicht: (2024)
MedFILIP: Medical Fine-grained Language-Image Pre-training
von: Liang, Xinjie, et al.
Veröffentlicht: (2025)
von: Liang, Xinjie, et al.
Veröffentlicht: (2025)
FILA: Fine-Grained Vision Language Models
von: Zhu, Shiding, et al.
Veröffentlicht: (2024)
von: Zhu, Shiding, et al.
Veröffentlicht: (2024)
DFQ-ViT: Data-Free Quantization for Vision Transformers without Fine-tuning
von: Tong, Yujia, et al.
Veröffentlicht: (2025)
von: Tong, Yujia, et al.
Veröffentlicht: (2025)
MedPruner: Training-Free Hierarchical Token Pruning for Efficient 3D Medical Image Understanding in Vision-Language Models
von: Liu, Shengyuan, et al.
Veröffentlicht: (2026)
von: Liu, Shengyuan, et al.
Veröffentlicht: (2026)
Adapting Vision-Language Models for Evaluating World Models
von: Hendriksen, Mariya, et al.
Veröffentlicht: (2025)
von: Hendriksen, Mariya, et al.
Veröffentlicht: (2025)
Seeing Justice Clearly: Handwritten Legal Document Translation with OCR and Vision-Language Models
von: Nigam, Shubham Kumar, et al.
Veröffentlicht: (2025)
von: Nigam, Shubham Kumar, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
GRAD-Former: Gated Robust Attention-based Differential Transformer for Change Detection
von: Ameta, Durgesh, et al.
Veröffentlicht: (2026) -
Clear Roads, Clear Vision: Advancements in Multi-Weather Restoration for Smart Transportation
von: Galshetwar, Vijay M., et al.
Veröffentlicht: (2025) -
Fine-tuning Vision Language Models with Graph-based Knowledge for Explainable Medical Image Analysis
von: Li, Chenjun, et al.
Veröffentlicht: (2025) -
BID-LoRA: A Parameter-Efficient Framework for Continual Learning and Unlearning
von: Rachapudi, Jagadeesh, et al.
Veröffentlicht: (2026) -
Efficient Medical Vision-Language Alignment Through Adapting Masked Vision Models
von: Lian, Chenyu, et al.
Veröffentlicht: (2025)