Text-Guided Layer Fusion Mitigates Hallucination in Multimodal LLMs
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Lin, Chenchen, Su, Sanbao, Luo, Rachel, Chen, Yuxiao, Wang, Yan, Pavone, Marco, Miao, Fei |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
$α$-OCC: Uncertainty-Aware Camera-based 3D Semantic Occupancy Prediction
par: Su, Sanbao, et autres
Publié: (2024)
par: Su, Sanbao, et autres
Publié: (2024)
Mitigating Hallucination in Multimodal LLMs with Layer Contrastive Decoding
par: Tong, Bingkui, et autres
Publié: (2025)
par: Tong, Bingkui, et autres
Publié: (2025)
PerturboLLaVA: Reducing Multimodal Hallucinations with Perturbative Visual Training
par: Chen, Cong, et autres
Publié: (2025)
par: Chen, Cong, et autres
Publié: (2025)
Tracing and Mitigating Hallucinations in Multimodal LLMs via Dynamic Attention Localization
par: Yang, Tiancheng, et autres
Publié: (2025)
par: Yang, Tiancheng, et autres
Publié: (2025)
Mitigating Hallucinations in Multimodal LLMs via Object-aware Preference Optimization
par: Compagnoni, Alberto, et autres
Publié: (2025)
par: Compagnoni, Alberto, et autres
Publié: (2025)
Dynamic Multimodal Activation Steering for Hallucination Mitigation in Large Vision-Language Models
par: Yin, Jianghao, et autres
Publié: (2026)
par: Yin, Jianghao, et autres
Publié: (2026)
MRFD: Multi-Region Fusion Decoding with Self-Consistency for Mitigating Hallucinations in LVLMs
par: Ge, Haonan, et autres
Publié: (2025)
par: Ge, Haonan, et autres
Publié: (2025)
Do You Keep an Eye on What I Ask? Mitigating Multimodal Hallucination via Attention-Guided Ensemble Decoding
par: Cho, Yeongjae, et autres
Publié: (2025)
par: Cho, Yeongjae, et autres
Publié: (2025)
TextSplat: Text-Guided Semantic Fusion for Generalizable Gaussian Splatting
par: Wu, Zhicong, et autres
Publié: (2025)
par: Wu, Zhicong, et autres
Publié: (2025)
Thinking Before Looking: Improving Multimodal LLM Reasoning via Mitigating Visual Hallucination
par: Zheng, Haojie, et autres
Publié: (2024)
par: Zheng, Haojie, et autres
Publié: (2024)
Collaborative Multi-Object Tracking with Conformal Uncertainty Propagation
par: Su, Sanbao, et autres
Publié: (2023)
par: Su, Sanbao, et autres
Publié: (2023)
When Semantics Mislead Vision: Mitigating Large Multimodal Models Hallucinations in Scene Text Spotting and Understanding
par: Shu, Yan, et autres
Publié: (2025)
par: Shu, Yan, et autres
Publié: (2025)
Multi-Layer Visual Feature Fusion in Multimodal LLMs: Methods, Analysis, and Best Practices
par: Lin, Junyan, et autres
Publié: (2025)
par: Lin, Junyan, et autres
Publié: (2025)
ChainMPQ: Interleaved Text-Image Reasoning Chains for Mitigating Relation Hallucinations
par: Wu, Yike, et autres
Publié: (2025)
par: Wu, Yike, et autres
Publié: (2025)
Temporal Insight Enhancement: Mitigating Temporal Hallucination in Multimodal Large Language Models
par: Sun, Li, et autres
Publié: (2024)
par: Sun, Li, et autres
Publié: (2024)
When Text Hijacks Vision: Benchmarking and Mitigating Text Overlay-Induced Hallucination in Vision Language Models
par: Yakun, Cui, et autres
Publié: (2026)
par: Yakun, Cui, et autres
Publié: (2026)
V-ITI: Mitigating Hallucinations in Multimodal Large Language Models via Visual Inference-Time Intervention
par: Sun, Nan, et autres
Publié: (2025)
par: Sun, Nan, et autres
Publié: (2025)
Cross-Modal Attention Calibration for LVLM Hallucination Mitigation
par: Li, Jiaming, et autres
Publié: (2025)
par: Li, Jiaming, et autres
Publié: (2025)
Enhancing Perception Capabilities of Multimodal LLMs with Training-Free Fusion
par: Chen, Zhuokun, et autres
Publié: (2024)
par: Chen, Zhuokun, et autres
Publié: (2024)
Mitigating Object and Action Hallucinations in Multimodal LLMs via Self-Augmented Contrastive Alignment
par: Chang, Kai-Po, et autres
Publié: (2025)
par: Chang, Kai-Po, et autres
Publié: (2025)
Thinking in Uncertainty: Mitigating Hallucinations in MLRMs with Latent Entropy-Aware Decoding
par: Xu, Zhongxing, et autres
Publié: (2026)
par: Xu, Zhongxing, et autres
Publié: (2026)
Seeing It or Not? Interpretable Vision-aware Latent Steering to Mitigate Object Hallucinations
par: Chen, Boxu, et autres
Publié: (2025)
par: Chen, Boxu, et autres
Publié: (2025)
ConVis: Contrastive Decoding with Hallucination Visualization for Mitigating Hallucinations in Multimodal Large Language Models
par: Park, Yeji, et autres
Publié: (2024)
par: Park, Yeji, et autres
Publié: (2024)
MM-ISTS: Cooperating Irregularly Sampled Time Series Forecasting with Multimodal Vision-Text LLMs
par: Lei, Zhi, et autres
Publié: (2026)
par: Lei, Zhi, et autres
Publié: (2026)
ViBe: A Text-to-Video Benchmark for Evaluating Hallucination in Large Multimodal Models
par: Rawte, Vipula, et autres
Publié: (2024)
par: Rawte, Vipula, et autres
Publié: (2024)
RSHallu: Dual-Mode Hallucination Evaluation for Remote-Sensing Multimodal Large Language Models with Domain-Tailored Mitigation
par: Zhou, Zihui, et autres
Publié: (2026)
par: Zhou, Zihui, et autres
Publié: (2026)
Hallucination Behavior in Multimodal LLMs Across Agricultural Image Interpretation and Generation Tasks
par: Ghose, Partho, et autres
Publié: (2026)
par: Ghose, Partho, et autres
Publié: (2026)
Extracting Visual Facts from Intermediate Layers for Mitigating Hallucinations in Multimodal Large Language Models
par: Zhou, Haoran, et autres
Publié: (2025)
par: Zhou, Haoran, et autres
Publié: (2025)
Optimizing LVLMs with On-Policy Data for Effective Hallucination Mitigation
par: Yu, Chengzhi, et autres
Publié: (2025)
par: Yu, Chengzhi, et autres
Publié: (2025)
BudgetFusion: Perceptually-Guided Adaptive Diffusion Models
par: Li, Qinchan, et autres
Publié: (2024)
par: Li, Qinchan, et autres
Publié: (2024)
Training-Free Mitigation of Language Reasoning Degradation After Multimodal Instruction Tuning
par: Ratzlaff, Neale, et autres
Publié: (2024)
par: Ratzlaff, Neale, et autres
Publié: (2024)
ClearSight: Visual Signal Enhancement for Object Hallucination Mitigation in Multimodal Large language Models
par: Yin, Hao, et autres
Publié: (2025)
par: Yin, Hao, et autres
Publié: (2025)
GHOST: Hallucination-Inducing Image Generation for Multimodal LLMs
par: Parast, Aryan Yazdan, et autres
Publié: (2025)
par: Parast, Aryan Yazdan, et autres
Publié: (2025)
Mitigating Open-Vocabulary Caption Hallucinations
par: Ben-Kish, Assaf, et autres
Publié: (2023)
par: Ben-Kish, Assaf, et autres
Publié: (2023)
Vision-Language Introspection: Mitigating Overconfident Hallucinations in MLLMs via Interpretable Bi-Causal Steering
par: Liu, Shuliang, et autres
Publié: (2026)
par: Liu, Shuliang, et autres
Publié: (2026)
Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images
par: You, Liangliang, et autres
Publié: (2025)
par: You, Liangliang, et autres
Publié: (2025)
Investigating and Mitigating the Multimodal Hallucination Snowballing in Large Vision-Language Models
par: Zhong, Weihong, et autres
Publié: (2024)
par: Zhong, Weihong, et autres
Publié: (2024)
Mitigating Hallucinations in Multimodal Spatial Relations through Constraint-Aware Prompting
par: Wu, Jiarui, et autres
Publié: (2025)
par: Wu, Jiarui, et autres
Publié: (2025)
Mitigating Hallucinations in Large Vision-Language Models via Entity-Centric Multimodal Preference Optimization
par: Wu, Jiulong, et autres
Publié: (2025)
par: Wu, Jiulong, et autres
Publié: (2025)
Mitigating Visual Hallucinations via Semantic Curriculum Preference Optimization in MLLMs
par: Li, Yuanshuai, et autres
Publié: (2025)
par: Li, Yuanshuai, et autres
Publié: (2025)
Documents similaires
-
$α$-OCC: Uncertainty-Aware Camera-based 3D Semantic Occupancy Prediction
par: Su, Sanbao, et autres
Publié: (2024) -
Mitigating Hallucination in Multimodal LLMs with Layer Contrastive Decoding
par: Tong, Bingkui, et autres
Publié: (2025) -
PerturboLLaVA: Reducing Multimodal Hallucinations with Perturbative Visual Training
par: Chen, Cong, et autres
Publié: (2025) -
Tracing and Mitigating Hallucinations in Multimodal LLMs via Dynamic Attention Localization
par: Yang, Tiancheng, et autres
Publié: (2025) -
Mitigating Hallucinations in Multimodal LLMs via Object-aware Preference Optimization
par: Compagnoni, Alberto, et autres
Publié: (2025)