Towards Calibrating Prompt Tuning of Vision-Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Sharifdeen, Ashshak, Shamshad, Fahad, Munir, Muhammad Akhtar, Basu, Abhishek, Ismithdeen, Mohamed Insaf, Jeyamohan, Jeyapriyan, Silva, Chathurika Sewwandi, Nandakumar, Karthik, Khan, Muhammad Haris |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Calibration-Aware Prompt Learning for Medical Vision-Language Models
di: Basu, Abhishek, et al.
Pubblicazione: (2025)
di: Basu, Abhishek, et al.
Pubblicazione: (2025)
O-TPT: Orthogonality Constraints for Calibrating Test-time Prompt Tuning in Vision-Language Models
di: Sharifdeen, Ashshak, et al.
Pubblicazione: (2025)
di: Sharifdeen, Ashshak, et al.
Pubblicazione: (2025)
Promptception: How Sensitive Are Large Multimodal Models to Prompts?
di: Ismithdeen, Mohamed Insaf, et al.
Pubblicazione: (2025)
di: Ismithdeen, Mohamed Insaf, et al.
Pubblicazione: (2025)
PromptSmooth: Certifying Robustness of Medical Vision-Language Models via Prompt Learning
di: Hussein, Noor, et al.
Pubblicazione: (2024)
di: Hussein, Noor, et al.
Pubblicazione: (2024)
BAPLe: Backdoor Attacks on Medical Foundational Models using Prompt Learning
di: Hanif, Asif, et al.
Pubblicazione: (2024)
di: Hanif, Asif, et al.
Pubblicazione: (2024)
Makeup-Guided Facial Privacy Protection via Untrained Neural Network Priors
di: Shamshad, Fahad, et al.
Pubblicazione: (2024)
di: Shamshad, Fahad, et al.
Pubblicazione: (2024)
RAVEN: Erasing Invisible Watermarks via Novel View Synthesis
di: Shamshad, Fahad, et al.
Pubblicazione: (2026)
di: Shamshad, Fahad, et al.
Pubblicazione: (2026)
SafeDiffusion-R1: Online Reward Steering for Safe Diffusion Post-Training
di: Kumar, Komal, et al.
Pubblicazione: (2026)
di: Kumar, Komal, et al.
Pubblicazione: (2026)
Towards Evaluating the Robustness of Visual State Space Models
di: Malik, Hashmat Shadab, et al.
Pubblicazione: (2024)
di: Malik, Hashmat Shadab, et al.
Pubblicazione: (2024)
Efficient Localized Adaptation of Neural Weather Forecasting: A Case Study in the MENA Region
di: Munir, Muhammad Akhtar, et al.
Pubblicazione: (2024)
di: Munir, Muhammad Akhtar, et al.
Pubblicazione: (2024)
Robust-LLaVA: On the Effectiveness of Large-Scale Robust Image Encoders for Multi-modal Large Language Models
di: Malik, Hashmat Shadab, et al.
Pubblicazione: (2025)
di: Malik, Hashmat Shadab, et al.
Pubblicazione: (2025)
FaceAnonyMixer: Cancelable Faces via Identity Consistent Latent Space Mixing
di: Alam, Mohammed Talha, et al.
Pubblicazione: (2025)
di: Alam, Mohammed Talha, et al.
Pubblicazione: (2025)
Agentic AI for Remote Sensing: Technical Challenges and Research Directions
di: Munir, Muhammad Akhtar, et al.
Pubblicazione: (2026)
di: Munir, Muhammad Akhtar, et al.
Pubblicazione: (2026)
A-TPT: Angular Diversity Calibration Properties for Test-Time Prompt Tuning of Vision-Language Models
di: Ahamed, Shihab Aaqil, et al.
Pubblicazione: (2025)
di: Ahamed, Shihab Aaqil, et al.
Pubblicazione: (2025)
TerraFM: A Scalable Foundation Model for Unified Multisensor Earth Observation
di: Danish, Muhammad Sohail, et al.
Pubblicazione: (2025)
di: Danish, Muhammad Sohail, et al.
Pubblicazione: (2025)
Improving Single Domain-Generalized Object Detection: A Focus on Diversification and Alignment
di: Danish, Muhammad Sohail, et al.
Pubblicazione: (2024)
di: Danish, Muhammad Sohail, et al.
Pubblicazione: (2024)
STEREO: A Two-Stage Framework for Adversarially Robust Concept Erasing from Text-to-Image Diffusion Models
di: Srivatsan, Koushik, et al.
Pubblicazione: (2024)
di: Srivatsan, Koushik, et al.
Pubblicazione: (2024)
Key-Conditioned Orthonormal Transform Gating (K-OTG): Multi-Key Access Control with Hidden-State Scrambling for LoRA-Tuned Models
di: Khan, Muhammad Haris
Pubblicazione: (2025)
di: Khan, Muhammad Haris
Pubblicazione: (2025)
ThinkGeo: Evaluating Tool-Augmented Agents for Remote Sensing Tasks
di: Shabbir, Akashah, et al.
Pubblicazione: (2025)
di: Shabbir, Akashah, et al.
Pubblicazione: (2025)
VFace: A Training-Free Approach for Diffusion-Based Video Face Swapping
di: Baliah, Sanoojan, et al.
Pubblicazione: (2026)
di: Baliah, Sanoojan, et al.
Pubblicazione: (2026)
First-Place Solution to NeurIPS 2024 Invisible Watermark Removal Challenge
di: Shamshad, Fahad, et al.
Pubblicazione: (2025)
di: Shamshad, Fahad, et al.
Pubblicazione: (2025)
GEOBench-VLM: Benchmarking Vision-Language Models for Geospatial Tasks
di: Danish, Muhammad Sohail, et al.
Pubblicazione: (2024)
di: Danish, Muhammad Sohail, et al.
Pubblicazione: (2024)
OpenEarthAgent: A Unified Framework for Tool-Augmented Geospatial Agents
di: Shabbir, Akashah, et al.
Pubblicazione: (2026)
di: Shabbir, Akashah, et al.
Pubblicazione: (2026)
Noise-Tolerant Few-Shot Unsupervised Adapter for Vision-Language Models
di: Ali, Eman, et al.
Pubblicazione: (2023)
di: Ali, Eman, et al.
Pubblicazione: (2023)
Is Monotonic Sampling Necessary in Diffusion Models?
di: Khan, Muhammad Haris
Pubblicazione: (2026)
di: Khan, Muhammad Haris
Pubblicazione: (2026)
SafeBench-Seq: A Homology-Clustered, CPU-Only Baseline for Protein Hazard Screening with Physicochemical/Composition Features and Cluster-Aware Confidence Intervals
di: Khan, Muhammad Haris
Pubblicazione: (2025)
di: Khan, Muhammad Haris
Pubblicazione: (2025)
GCA Framework: A GCC Countries-Grounded Dataset and Agentic Pipeline for Climate Decision Support
di: Sheikh, Muhammad Umer, et al.
Pubblicazione: (2026)
di: Sheikh, Muhammad Umer, et al.
Pubblicazione: (2026)
Video-ChatGPT: Towards Detailed Video Understanding via Large Vision and Language Models
di: Maaz, Muhammad, et al.
Pubblicazione: (2023)
di: Maaz, Muhammad, et al.
Pubblicazione: (2023)
Synergistic Neural Forecasting of Air Pollution with Stochastic Sampling
di: Abeysinghe, Yohan, et al.
Pubblicazione: (2025)
di: Abeysinghe, Yohan, et al.
Pubblicazione: (2025)
SPQR: A Standardized Benchmark for Modern Safety Alignment Methods in Text-to-Image Diffusion Models
di: Alam, Mohammed Talha, et al.
Pubblicazione: (2025)
di: Alam, Mohammed Talha, et al.
Pubblicazione: (2025)
GenMix: Effective Data Augmentation with Generative Diffusion Model Image Editing
di: Islam, Khawar, et al.
Pubblicazione: (2024)
di: Islam, Khawar, et al.
Pubblicazione: (2024)
Test-Time Low Rank Adaptation via Confidence Maximization for Zero-Shot Generalization of Vision-Language Models
di: Imam, Raza, et al.
Pubblicazione: (2024)
di: Imam, Raza, et al.
Pubblicazione: (2024)
From Diamagnetism to Weak Ferromagnetism: Magnetic Evolution in FeCr Codoped ZnO Nanoparticles
di: Muhammad Sadiq Hameed Khan, et al.
Pubblicazione: (2025)
di: Muhammad Sadiq Hameed Khan, et al.
Pubblicazione: (2025)
Attention Based Simple Primitives for Open World Compositional Zero-Shot Learning
di: Munir, Ans, et al.
Pubblicazione: (2024)
di: Munir, Ans, et al.
Pubblicazione: (2024)
TLAC: Two-stage LMM Augmented CLIP for Zero-Shot Classification
di: Munir, Ans, et al.
Pubblicazione: (2025)
di: Munir, Ans, et al.
Pubblicazione: (2025)
Compositional Zero-Shot Learning: A Survey
di: Munir, Ans, et al.
Pubblicazione: (2025)
di: Munir, Ans, et al.
Pubblicazione: (2025)
Robust and Label-Efficient Deep Waste Detection
di: Abid, Hassan, et al.
Pubblicazione: (2025)
di: Abid, Hassan, et al.
Pubblicazione: (2025)
DPA: Dual Prototypes Alignment for Unsupervised Adaptation of Vision-Language Models
di: Ali, Eman, et al.
Pubblicazione: (2024)
di: Ali, Eman, et al.
Pubblicazione: (2024)
CountZES: Counting via Zero-Shot Exemplar Selection
di: Siddiqui, Muhammad Ibraheem, et al.
Pubblicazione: (2025)
di: Siddiqui, Muhammad Ibraheem, et al.
Pubblicazione: (2025)
Chameleon: Images Are What You Need For Multimodal Learning Robust To Missing Modalities
di: Liaqat, Muhammad Irzam, et al.
Pubblicazione: (2024)
di: Liaqat, Muhammad Irzam, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Calibration-Aware Prompt Learning for Medical Vision-Language Models
di: Basu, Abhishek, et al.
Pubblicazione: (2025) -
O-TPT: Orthogonality Constraints for Calibrating Test-time Prompt Tuning in Vision-Language Models
di: Sharifdeen, Ashshak, et al.
Pubblicazione: (2025) -
Promptception: How Sensitive Are Large Multimodal Models to Prompts?
di: Ismithdeen, Mohamed Insaf, et al.
Pubblicazione: (2025) -
PromptSmooth: Certifying Robustness of Medical Vision-Language Models via Prompt Learning
di: Hussein, Noor, et al.
Pubblicazione: (2024) -
BAPLe: Backdoor Attacks on Medical Foundational Models using Prompt Learning
di: Hanif, Asif, et al.
Pubblicazione: (2024)