ESREAL: Exploiting Semantic Reconstruction to Mitigate Hallucinations in Vision-Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kim, Minchan, Kim, Minyeong, Bae, Junik, Choi, Suhwan, Kim, Sungkyung, Chang, Buru |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
HalLoc: Token-level Localization of Hallucinations for Vision Language Models
par: Park, Eunkyu, et autres
Publié: (2025)
par: Park, Eunkyu, et autres
Publié: (2025)
D2E: Scaling Vision-Action Pretraining on Desktop Data for Transfer to Embodied AI
par: Choi, Suhwan, et autres
Publié: (2025)
par: Choi, Suhwan, et autres
Publié: (2025)
NOAH: Benchmarking Narrative Prior driven Hallucination and Omission in Video Large Language Models
par: Lee, Kyuho, et autres
Publié: (2025)
par: Lee, Kyuho, et autres
Publié: (2025)
A Unified Hallucination Mitigation Framework for Large Vision-Language Models
par: Chang, Yue, et autres
Publié: (2024)
par: Chang, Yue, et autres
Publié: (2024)
Mitigating Hallucinations in Large Vision-Language Models via Summary-Guided Decoding
par: Min, Kyungmin, et autres
Publié: (2024)
par: Min, Kyungmin, et autres
Publié: (2024)
Mitigating Hallucinations in Large Vision-Language Models by Self-Injecting Hallucinations
par: Lu, Yifan, et autres
Publié: (2025)
par: Lu, Yifan, et autres
Publié: (2025)
ReCo: Reminder Composition Mitigates Hallucinations in Vision-Language Models
par: Chytas, Sotirios Panagiotis, et autres
Publié: (2025)
par: Chytas, Sotirios Panagiotis, et autres
Publié: (2025)
ConVis: Contrastive Decoding with Hallucination Visualization for Mitigating Hallucinations in Multimodal Large Language Models
par: Park, Yeji, et autres
Publié: (2024)
par: Park, Yeji, et autres
Publié: (2024)
How Does Vision-Language Adaptation Impact the Safety of Vision Language Models?
par: Lee, Seongyun, et autres
Publié: (2024)
par: Lee, Seongyun, et autres
Publié: (2024)
What if...?: Thinking Counterfactual Keywords Helps to Mitigate Hallucination in Large Multi-modal Models
par: Kim, Junho, et autres
Publié: (2024)
par: Kim, Junho, et autres
Publié: (2024)
Focus Matters: Phase-Aware Suppression for Hallucination in Vision-Language Models
par: Kim, Sohyeon, et autres
Publié: (2026)
par: Kim, Sohyeon, et autres
Publié: (2026)
Diving into Mitigating Hallucinations from a Vision Perspective for Large Vision-Language Models
par: Wang, Weihang, et autres
Publié: (2025)
par: Wang, Weihang, et autres
Publié: (2025)
SECOND: Mitigating Perceptual Hallucination in Vision-Language Models via Selective and Contrastive Decoding
par: Park, Woohyeon, et autres
Publié: (2025)
par: Park, Woohyeon, et autres
Publié: (2025)
Towards Mitigating Hallucinations in Large Vision-Language Models by Refining Textual Embeddings
par: Agrawal, Aakriti, et autres
Publié: (2025)
par: Agrawal, Aakriti, et autres
Publié: (2025)
Instruction-Aligned Visual Attention for Mitigating Hallucinations in Large Vision-Language Models
par: Li, Bin, et autres
Publié: (2025)
par: Li, Bin, et autres
Publié: (2025)
Mitigating Multilingual Hallucination in Large Vision-Language Models
par: Qu, Xiaoye, et autres
Publié: (2024)
par: Qu, Xiaoye, et autres
Publié: (2024)
PAINT: Paying Attention to INformed Tokens to Mitigate Hallucination in Large Vision-Language Model
par: Arif, Kazi Hasan Ibn, et autres
Publié: (2025)
par: Arif, Kazi Hasan Ibn, et autres
Publié: (2025)
Mitigating Hallucinations in Large Vision-Language Models with Internal Fact-based Contrastive Decoding
par: Wang, Chao, et autres
Publié: (2025)
par: Wang, Chao, et autres
Publié: (2025)
Self-Correcting Decoding with Generative Feedback for Mitigating Hallucinations in Large Vision-Language Models
par: Zhang, Ce, et autres
Publié: (2025)
par: Zhang, Ce, et autres
Publié: (2025)
Watch Closely: Mitigating Object Hallucinations in Large Vision-Language Models with Disentangled Decoding
par: Ma, Ruiqi, et autres
Publié: (2025)
par: Ma, Ruiqi, et autres
Publié: (2025)
ONLY: One-Layer Intervention Sufficiently Mitigates Hallucinations in Large Vision-Language Models
par: Wan, Zifu, et autres
Publié: (2025)
par: Wan, Zifu, et autres
Publié: (2025)
ChartCap: Mitigating Hallucination of Dense Chart Captioning
par: Lim, Junyoung, et autres
Publié: (2025)
par: Lim, Junyoung, et autres
Publié: (2025)
VARCO-VISION: Expanding Frontiers in Korean Vision-Language Models
par: Ju, Jeongho, et autres
Publié: (2024)
par: Ju, Jeongho, et autres
Publié: (2024)
Analyzing and Mitigating Object Hallucination in Large Vision-Language Models
par: Zhou, Yiyang, et autres
Publié: (2023)
par: Zhou, Yiyang, et autres
Publié: (2023)
Leveraging the Power of MLLMs for Gloss-Free Sign Language Translation
par: Kim, Jungeun, et autres
Publié: (2024)
par: Kim, Jungeun, et autres
Publié: (2024)
VEGAS: Mitigating Hallucinations in Large Vision-Language Models via Vision-Encoder Attention Guided Adaptive Steering
par: Wang, Zihu, et autres
Publié: (2025)
par: Wang, Zihu, et autres
Publié: (2025)
Intriguing Properties of Large Language and Vision Models
par: Lee, Young-Jun, et autres
Publié: (2024)
par: Lee, Young-Jun, et autres
Publié: (2024)
Mitigating Hallucination in Large Vision-Language Models via Adaptive Attention Calibration
par: Fazli, Mehrdad, et autres
Publié: (2025)
par: Fazli, Mehrdad, et autres
Publié: (2025)
Investigating and Mitigating the Multimodal Hallucination Snowballing in Large Vision-Language Models
par: Zhong, Weihong, et autres
Publié: (2024)
par: Zhong, Weihong, et autres
Publié: (2024)
Finer: Investigating and Enhancing Fine-Grained Visual Concept Recognition in Large Vision Language Models
par: Kim, Jeonghwan, et autres
Publié: (2024)
par: Kim, Jeonghwan, et autres
Publié: (2024)
ICT: Image-Object Cross-Level Trusted Intervention for Mitigating Object Hallucination in Large Vision-Language Models
par: Chen, Junzhe, et autres
Publié: (2024)
par: Chen, Junzhe, et autres
Publié: (2024)
Delve into Visual Contrastive Decoding for Hallucination Mitigation of Large Vision-Language Models
par: Lee, Yi-Lun, et autres
Publié: (2024)
par: Lee, Yi-Lun, et autres
Publié: (2024)
Benchmarking Direct Preference Optimization for Medical Large Vision-Language Models
par: Kim, Dain, et autres
Publié: (2026)
par: Kim, Dain, et autres
Publié: (2026)
Doubly-Universal Adversarial Perturbations: Deceiving Vision-Language Models Across Both Images and Text with a Single Perturbation
par: Kim, Hee-Seon, et autres
Publié: (2024)
par: Kim, Hee-Seon, et autres
Publié: (2024)
Mitigating Hallucinations in Large Vision-Language Models with Instruction Contrastive Decoding
par: Wang, Xintong, et autres
Publié: (2024)
par: Wang, Xintong, et autres
Publié: (2024)
Mitigating Hallucinations in Large Vision-Language Models (LVLMs) via Language-Contrastive Decoding (LCD)
par: Manevich, Avshalom, et autres
Publié: (2024)
par: Manevich, Avshalom, et autres
Publié: (2024)
Bridging the Missing-Modality Gap: Improving Text-Only Calibration of Vision Language Models
par: Kim, Mingyeong, et autres
Publié: (2026)
par: Kim, Mingyeong, et autres
Publié: (2026)
GlyphPattern: An Abstract Pattern Recognition Benchmark for Vision-Language Models
par: Wu, Zixuan, et autres
Publié: (2024)
par: Wu, Zixuan, et autres
Publié: (2024)
On Efficient Language and Vision Assistants for Visually-Situated Natural Language Understanding: What Matters in Reading and Reasoning
par: Kim, Geewook, et autres
Publié: (2024)
par: Kim, Geewook, et autres
Publié: (2024)
Mitigating Object Hallucinations in Large Vision-Language Models with Assembly of Global and Local Attention
par: An, Wenbin, et autres
Publié: (2024)
par: An, Wenbin, et autres
Publié: (2024)
Documents similaires
-
HalLoc: Token-level Localization of Hallucinations for Vision Language Models
par: Park, Eunkyu, et autres
Publié: (2025) -
D2E: Scaling Vision-Action Pretraining on Desktop Data for Transfer to Embodied AI
par: Choi, Suhwan, et autres
Publié: (2025) -
NOAH: Benchmarking Narrative Prior driven Hallucination and Omission in Video Large Language Models
par: Lee, Kyuho, et autres
Publié: (2025) -
A Unified Hallucination Mitigation Framework for Large Vision-Language Models
par: Chang, Yue, et autres
Publié: (2024) -
Mitigating Hallucinations in Large Vision-Language Models via Summary-Guided Decoding
par: Min, Kyungmin, et autres
Publié: (2024)