Look Closer! An Adversarial Parametric Editing Framework for Hallucination Mitigation in VLMs
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Hu, Jiayu, Li, Beibei, Xia, Jiangwei, Qin, Yanjun, Ji, Bing, He, Zhongshi |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Interpreting and Editing Vision-Language Representations to Mitigate Hallucinations
par: Jiang, Nick, et autres
Publié: (2024)
par: Jiang, Nick, et autres
Publié: (2024)
VGS-Decoding: Visual Grounding Score Guided Decoding for Hallucination Mitigation in Medical VLMs
par: Kolli, Govinda, et autres
Publié: (2026)
par: Kolli, Govinda, et autres
Publié: (2026)
TopoFR: A Closer Look at Topology Alignment on Face Recognition
par: Dan, Jun, et autres
Publié: (2024)
par: Dan, Jun, et autres
Publié: (2024)
A Closer Look at Multimodal Representation Collapse
par: Chaudhuri, Abhra, et autres
Publié: (2025)
par: Chaudhuri, Abhra, et autres
Publié: (2025)
A Closer Look at the Robustness of Contrastive Language-Image Pre-Training (CLIP)
par: Tu, Weijie, et autres
Publié: (2024)
par: Tu, Weijie, et autres
Publié: (2024)
Finding Closure: A Closer Look at the Gestalt Law of Closure in Convolutional Neural Networks
par: Zhang, Yuyan, et autres
Publié: (2024)
par: Zhang, Yuyan, et autres
Publié: (2024)
AdvAD: Exploring Non-Parametric Diffusion for Imperceptible Adversarial Attacks
par: Li, Jin, et autres
Publié: (2025)
par: Li, Jin, et autres
Publié: (2025)
Leveraging NTPs for Efficient Hallucination Detection in VLMs
par: Azachi, Ofir, et autres
Publié: (2025)
par: Azachi, Ofir, et autres
Publié: (2025)
DASH: Detection and Assessment of Systematic Hallucinations of VLMs
par: Augustin, Maximilian, et autres
Publié: (2025)
par: Augustin, Maximilian, et autres
Publié: (2025)
A Closer Look at In-Distribution vs. Out-of-Distribution Accuracy for Open-Set Test-time Adaptation
par: Li, Zefeng, et autres
Publié: (2026)
par: Li, Zefeng, et autres
Publié: (2026)
Overconfidence and Calibration in Medical VQA: Empirical Findings and Hallucination-Aware Mitigation
par: Byun, Ji Young, et autres
Publié: (2026)
par: Byun, Ji Young, et autres
Publié: (2026)
Selecting Fine-Tuning Examples by Quizzing VLMs
par: Ji, Tenghao, et autres
Publié: (2025)
par: Ji, Tenghao, et autres
Publié: (2025)
VideoHallu: Evaluating and Mitigating Multi-modal Hallucinations on Synthetic Video Understanding
par: Li, Zongxia, et autres
Publié: (2025)
par: Li, Zongxia, et autres
Publié: (2025)
Mitigating Diffusion Model Hallucinations with Dynamic Guidance
par: Triaridis, Kostas, et autres
Publié: (2025)
par: Triaridis, Kostas, et autres
Publié: (2025)
A Closer Look at Spatial-Slice Features Learning for COVID-19 Detection
par: Hsu, Chih-Chung, et autres
Publié: (2024)
par: Hsu, Chih-Chung, et autres
Publié: (2024)
Seeing Far and Clearly: Mitigating Hallucinations in MLLMs with Attention Causal Decoding
par: Tang, Feilong, et autres
Publié: (2025)
par: Tang, Feilong, et autres
Publié: (2025)
Hallucinatory Image Tokens: A Training-free EAZY Approach on Detecting and Mitigating Object Hallucinations in LVLMs
par: Che, Liwei, et autres
Publié: (2025)
par: Che, Liwei, et autres
Publié: (2025)
Benchmarking Transferable Adversarial Attacks
par: Jin, Zhibo, et autres
Publié: (2024)
par: Jin, Zhibo, et autres
Publié: (2024)
CoDeGAN: Contrastive Disentanglement for Generative Adversarial Network
par: Zhao, Jiangwei, et autres
Publié: (2021)
par: Zhao, Jiangwei, et autres
Publié: (2021)
Improving Generalization of Universal Adversarial Perturbation via Dynamic Maximin Optimization
par: Zhang, Yechao, et autres
Publié: (2025)
par: Zhang, Yechao, et autres
Publié: (2025)
Toward Inherently Robust VLMs Against Visual Perception Attacks
par: MohajerAnsari, Pedram, et autres
Publié: (2025)
par: MohajerAnsari, Pedram, et autres
Publié: (2025)
Locate-then-Sparsify: Attribution Guided Sparse Strategy for Visual Hallucination Mitigation
par: Dang, Tiantian, et autres
Publié: (2026)
par: Dang, Tiantian, et autres
Publié: (2026)
A Closer Look at Data Augmentation Strategies for Finetuning-Based Low/Few-Shot Object Detection
par: Li, Vladislav, et autres
Publié: (2024)
par: Li, Vladislav, et autres
Publié: (2024)
Mitigating Hallucinations in Vision-Language Models through Image-Guided Head Suppression
par: Sarkar, Sreetama, et autres
Publié: (2025)
par: Sarkar, Sreetama, et autres
Publié: (2025)
HaloProbe: Bayesian Detection and Mitigation of Object Hallucinations in Vision-Language Models
par: Zohrabi, Reihaneh, et autres
Publié: (2026)
par: Zohrabi, Reihaneh, et autres
Publié: (2026)
AngularFuse: A Closer Look at Angle-based Perception for Spatial-Sensitive Multi-Modality Image Fusion
par: Liu, Xiaopeng, et autres
Publié: (2025)
par: Liu, Xiaopeng, et autres
Publié: (2025)
T3: Test-Time Model Merging in VLMs for Zero-Shot Medical Imaging Analysis
par: Imam, Raza, et autres
Publié: (2025)
par: Imam, Raza, et autres
Publié: (2025)
Probing Visual Language Priors in VLMs
par: Luo, Tiange, et autres
Publié: (2024)
par: Luo, Tiange, et autres
Publié: (2024)
ConVis: Contrastive Decoding with Hallucination Visualization for Mitigating Hallucinations in Multimodal Large Language Models
par: Park, Yeji, et autres
Publié: (2024)
par: Park, Yeji, et autres
Publié: (2024)
Laplacian Score Sharpening for Mitigating Hallucination in Diffusion Models
par: C, Barath Chandran., et autres
Publié: (2025)
par: C, Barath Chandran., et autres
Publié: (2025)
Closer to Reality: Practical Semi-Supervised Federated Learning for Foundation Model Adaptation
par: Sun, Guangyu, et autres
Publié: (2025)
par: Sun, Guangyu, et autres
Publié: (2025)
Uniform Attention Maps: Boosting Image Fidelity in Reconstruction and Editing
par: Mo, Wenyi, et autres
Publié: (2024)
par: Mo, Wenyi, et autres
Publié: (2024)
Steering LVLMs via Sparse Autoencoder for Hallucination Mitigation
par: Hua, Zhenglin, et autres
Publié: (2025)
par: Hua, Zhenglin, et autres
Publié: (2025)
Exploration of VLMs for Driver Monitoring Systems Applications
par: Cañas, Paola Natalia, et autres
Publié: (2025)
par: Cañas, Paola Natalia, et autres
Publié: (2025)
Generalizing from SIMPLE to HARD Visual Reasoning: Can We Mitigate Modality Imbalance in VLMs?
par: Park, Simon, et autres
Publié: (2025)
par: Park, Simon, et autres
Publié: (2025)
Reefknot: A Comprehensive Benchmark for Relation Hallucination Evaluation, Analysis and Mitigation in Multimodal Large Language Models
par: Zheng, Kening, et autres
Publié: (2024)
par: Zheng, Kening, et autres
Publié: (2024)
Attention-space Contrastive Guidance for Efficient Hallucination Mitigation in LVLMs
par: Jo, Yujin, et autres
Publié: (2026)
par: Jo, Yujin, et autres
Publié: (2026)
Analyzing and Mitigating Object Hallucination in Large Vision-Language Models
par: Zhou, Yiyang, et autres
Publié: (2023)
par: Zhou, Yiyang, et autres
Publié: (2023)
Creative Portraiture: Exploring Creative Adversarial Networks and Conditional Creative Adversarial Networks
par: Hereu, Sebastian, et autres
Publié: (2024)
par: Hereu, Sebastian, et autres
Publié: (2024)
Efficient High-Resolution Image Editing with Hallucination-Aware Loss and Adaptive Tiling
par: Kwon, Young D., et autres
Publié: (2025)
par: Kwon, Young D., et autres
Publié: (2025)
Documents similaires
-
Interpreting and Editing Vision-Language Representations to Mitigate Hallucinations
par: Jiang, Nick, et autres
Publié: (2024) -
VGS-Decoding: Visual Grounding Score Guided Decoding for Hallucination Mitigation in Medical VLMs
par: Kolli, Govinda, et autres
Publié: (2026) -
TopoFR: A Closer Look at Topology Alignment on Face Recognition
par: Dan, Jun, et autres
Publié: (2024) -
A Closer Look at Multimodal Representation Collapse
par: Chaudhuri, Abhra, et autres
Publié: (2025) -
A Closer Look at the Robustness of Contrastive Language-Image Pre-Training (CLIP)
par: Tu, Weijie, et autres
Publié: (2024)