BiPrompt: Bilateral Prompt Optimization for Visual and Textual Debiasing in Vision-Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Gupta, Sunny, Das, Shounak, Sethi, Amit |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
IDAL: Improved Domain Adaptive Learning for Natural Images Dataset
par: Gupta, Ravi Kant, et autres
Publié: (2025)
par: Gupta, Ravi Kant, et autres
Publié: (2025)
Scalable Whole Slide Image Representation Using K-Mean Clustering and Fisher Vector Aggregation
par: Gupta, Ravi Kant, et autres
Publié: (2025)
par: Gupta, Ravi Kant, et autres
Publié: (2025)
Doubly Debiased Test-Time Prompt Tuning for Vision-Language Models
par: Song, Fei, et autres
Publié: (2025)
par: Song, Fei, et autres
Publié: (2025)
BiPrompt-SAM: Enhancing Image Segmentation via Explicit Selection between Point and Text Prompts
par: Xu, Suzhe, et autres
Publié: (2025)
par: Xu, Suzhe, et autres
Publié: (2025)
Evaluating Hallucination in Large Vision-Language Models based on Context-Aware Object Similarities
par: Datta, Shounak, et autres
Publié: (2025)
par: Datta, Shounak, et autres
Publié: (2025)
Visual Modality Prompt for Adapting Vision-Language Object Detectors
par: Medeiros, Heitor R., et autres
Publié: (2024)
par: Medeiros, Heitor R., et autres
Publié: (2024)
Clustered Patch Embeddings for Permutation-Invariant Classification of Whole Slide Images
par: Gupta, Ravi Kant, et autres
Publié: (2024)
par: Gupta, Ravi Kant, et autres
Publié: (2024)
Tree of Attributes Prompt Learning for Vision-Language Models
par: Ding, Tong, et autres
Publié: (2024)
par: Ding, Tong, et autres
Publié: (2024)
Decoupling Augmentation Bias in Prompt Learning for Vision-Language Models
par: Kim, Gahyeon, et autres
Publié: (2025)
par: Kim, Gahyeon, et autres
Publié: (2025)
AAPL: Adding Attributes to Prompt Learning for Vision-Language Models
par: Kim, Gahyeon, et autres
Publié: (2024)
par: Kim, Gahyeon, et autres
Publié: (2024)
Exploring the Transferability of Visual Prompting for Multimodal Large Language Models
par: Zhang, Yichi, et autres
Publié: (2024)
par: Zhang, Yichi, et autres
Publié: (2024)
Differentiable Prompt Learning for Vision Language Models
par: Huang, Zhenhan, et autres
Publié: (2024)
par: Huang, Zhenhan, et autres
Publié: (2024)
Prompting Medical Large Vision-Language Models to Diagnose Pathologies by Visual Question Answering
par: Guo, Danfeng, et autres
Publié: (2024)
par: Guo, Danfeng, et autres
Publié: (2024)
Candidate Pseudolabel Learning: Enhancing Vision-Language Models by Prompt Tuning with Unlabeled Data
par: Zhang, Jiahan, et autres
Publié: (2024)
par: Zhang, Jiahan, et autres
Publié: (2024)
LAPT: Label-driven Automated Prompt Tuning for OOD Detection with Vision-Language Models
par: Zhang, Yabin, et autres
Publié: (2024)
par: Zhang, Yabin, et autres
Publié: (2024)
SEM: Sparse Embedding Modulation for Post-Hoc Debiasing of Vision-Language Models
par: Guimard, Quentin, et autres
Publié: (2026)
par: Guimard, Quentin, et autres
Publié: (2026)
FedHypeVAE: Federated Learning with Hypernetwork Generated Conditional VAEs for Differentially Private Embedding Sharing
par: Gupta, Sunny, et autres
Publié: (2026)
par: Gupta, Sunny, et autres
Publié: (2026)
MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering
par: Li, Xu, et autres
Publié: (2025)
par: Li, Xu, et autres
Publié: (2025)
Meta-Adaptive Prompt Distillation for Few-Shot Visual Question Answering
par: Gupta, Akash, et autres
Publié: (2025)
par: Gupta, Akash, et autres
Publié: (2025)
One Prompt Word is Enough to Boost Adversarial Robustness for Pre-trained Vision-Language Models
par: Li, Lin, et autres
Publié: (2024)
par: Li, Lin, et autres
Publié: (2024)
Rethinking Visual Prompting for Multimodal Large Language Models with External Knowledge
par: Lin, Yuanze, et autres
Publié: (2024)
par: Lin, Yuanze, et autres
Publié: (2024)
Vision-DeepResearch Benchmark: Rethinking Visual and Textual Search for Multimodal Large Language Models
par: Zeng, Yu, et autres
Publié: (2026)
par: Zeng, Yu, et autres
Publié: (2026)
TP-Blend: Textual-Prompt Attention Pairing for Precise Object-Style Blending in Diffusion Models
par: Jin, Xin, et autres
Publié: (2026)
par: Jin, Xin, et autres
Publié: (2026)
When Prompts Override Vision: Prompt-Induced Hallucinations in LVLMs
par: Khayatan, Pegah, et autres
Publié: (2026)
par: Khayatan, Pegah, et autres
Publié: (2026)
ADAPT to Robustify Prompt Tuning Vision Transformers
par: Eskandar, Masih, et autres
Publié: (2024)
par: Eskandar, Masih, et autres
Publié: (2024)
Towards Adversarially Robust Vision-Language Models: Insights from Design Choices and Prompt Formatting Techniques
par: Bhagwatkar, Rishika, et autres
Publié: (2024)
par: Bhagwatkar, Rishika, et autres
Publié: (2024)
PromptSplit: Revealing Prompt-Level Disagreement in Generative Models
par: Lotfian, Mehdi, et autres
Publié: (2026)
par: Lotfian, Mehdi, et autres
Publié: (2026)
Robust Prompt Optimization for Defending Language Models Against Jailbreaking Attacks
par: Zhou, Andy, et autres
Publié: (2024)
par: Zhou, Andy, et autres
Publié: (2024)
Adaptive Prompt Tuning: Vision Guided Prompt Tuning with Cross-Attention for Fine-Grained Few-Shot Learning
par: Brouwer, Eric, et autres
Publié: (2024)
par: Brouwer, Eric, et autres
Publié: (2024)
Prompt Optimizer of Text-to-Image Diffusion Models for Abstract Concept Understanding
par: Fan, Zezhong, et autres
Publié: (2024)
par: Fan, Zezhong, et autres
Publié: (2024)
Transferring Textual Preferences to Vision-Language Understanding through Model Merging
par: Li, Chen-An, et autres
Publié: (2025)
par: Li, Chen-An, et autres
Publié: (2025)
Meta-Prompting for Automating Zero-shot Visual Recognition with LLMs
par: Mirza, M. Jehanzeb, et autres
Publié: (2024)
par: Mirza, M. Jehanzeb, et autres
Publié: (2024)
By My Eyes: Grounding Multimodal Large Language Models with Sensor Data via Visual Prompting
par: Yoon, Hyungjun, et autres
Publié: (2024)
par: Yoon, Hyungjun, et autres
Publié: (2024)
X-Prompt: Towards Universal In-Context Image Generation in Auto-Regressive Vision Language Foundation Models
par: Sun, Zeyi, et autres
Publié: (2024)
par: Sun, Zeyi, et autres
Publié: (2024)
PromptLoop: Plug-and-Play Prompt Refinement via Latent Feedback for Diffusion Model Alignment
par: Lee, Suhyeon, et autres
Publié: (2025)
par: Lee, Suhyeon, et autres
Publié: (2025)
DetoxAI: a Python Toolkit for Debiasing Deep Learning Models in Computer Vision
par: Stępka, Ignacy, et autres
Publié: (2025)
par: Stępka, Ignacy, et autres
Publié: (2025)
LSPT: Long-term Spatial Prompt Tuning for Visual Representation Learning
par: Mo, Shentong, et autres
Publié: (2024)
par: Mo, Shentong, et autres
Publié: (2024)
DebiasPI: Inference-time Debiasing by Prompt Iteration of a Text-to-Image Generative Model
par: Bonna, Sarah, et autres
Publié: (2025)
par: Bonna, Sarah, et autres
Publié: (2025)
Fairness-aware Vision Transformer via Debiased Self-Attention
par: Qiang, Yao, et autres
Publié: (2023)
par: Qiang, Yao, et autres
Publié: (2023)
RainbowPrompt: Diversity-Enhanced Prompt-Evolving for Continual Learning
par: Hong, Kiseong, et autres
Publié: (2025)
par: Hong, Kiseong, et autres
Publié: (2025)
Documents similaires
-
IDAL: Improved Domain Adaptive Learning for Natural Images Dataset
par: Gupta, Ravi Kant, et autres
Publié: (2025) -
Scalable Whole Slide Image Representation Using K-Mean Clustering and Fisher Vector Aggregation
par: Gupta, Ravi Kant, et autres
Publié: (2025) -
Doubly Debiased Test-Time Prompt Tuning for Vision-Language Models
par: Song, Fei, et autres
Publié: (2025) -
BiPrompt-SAM: Enhancing Image Segmentation via Explicit Selection between Point and Text Prompts
par: Xu, Suzhe, et autres
Publié: (2025) -
Evaluating Hallucination in Large Vision-Language Models based on Context-Aware Object Similarities
par: Datta, Shounak, et autres
Publié: (2025)