Mitigating Hallucinations in Video Large Language Models via Spatiotemporal-Semantic Contrastive Decoding
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Gao, Yuansheng, Zhao, Jinman, Zhang, Tong, Xu, Xingguo, Bao, Han, Wang, Zonghui, Chen, Wenzhi |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Mitigating Hallucination in Multimodal LLMs with Layer Contrastive Decoding
par: Tong, Bingkui, et autres
Publié: (2025)
par: Tong, Bingkui, et autres
Publié: (2025)
Mitigating Hallucination in Visual-Language Models via Re-Balancing Contrastive Decoding
par: Liang, Xiaoyu, et autres
Publié: (2024)
par: Liang, Xiaoyu, et autres
Publié: (2024)
VaLiD: Mitigating the Hallucination of Large Vision Language Models by Visual Layer Fusion Contrastive Decoding
par: Wang, Jiaqi, et autres
Publié: (2024)
par: Wang, Jiaqi, et autres
Publié: (2024)
AVCD: Mitigating Hallucinations in Audio-Visual Large Language Models through Contrastive Decoding
par: Jung, Chaeyoung, et autres
Publié: (2025)
par: Jung, Chaeyoung, et autres
Publié: (2025)
SECOND: Mitigating Perceptual Hallucination in Vision-Language Models via Selective and Contrastive Decoding
par: Park, Woohyeon, et autres
Publié: (2025)
par: Park, Woohyeon, et autres
Publié: (2025)
SEASON: Mitigating Temporal Hallucination in Video Large Language Models via Self-Diagnostic Contrastive Decoding
par: Wu, Chang-Hsun, et autres
Publié: (2025)
par: Wu, Chang-Hsun, et autres
Publié: (2025)
Mitigating Hallucinations in Large Vision-Language Models (LVLMs) via Language-Contrastive Decoding (LCD)
par: Manevich, Avshalom, et autres
Publié: (2024)
par: Manevich, Avshalom, et autres
Publié: (2024)
SAKED: Mitigating Hallucination in Large Vision-Language Models via Stability-Aware Knowledge Enhanced Decoding
par: Li, Zhaoxu, et autres
Publié: (2026)
par: Li, Zhaoxu, et autres
Publié: (2026)
SDCD: Structure-Disrupted Contrastive Decoding for Mitigating Hallucinations in Large Vision-Language Models
par: Xia, Yuxuan, et autres
Publié: (2026)
par: Xia, Yuxuan, et autres
Publié: (2026)
Mitigating Hallucinations in Large Vision-Language Models with Internal Fact-based Contrastive Decoding
par: Wang, Chao, et autres
Publié: (2025)
par: Wang, Chao, et autres
Publié: (2025)
Med-VCD: Mitigating Hallucination for Medical Large Vision Language Models through Visual Contrastive Decoding
par: Mahdavi, Zahra, et autres
Publié: (2025)
par: Mahdavi, Zahra, et autres
Publié: (2025)
Mitigating Hallucinations in Large Vision-Language Models with Instruction Contrastive Decoding
par: Wang, Xintong, et autres
Publié: (2024)
par: Wang, Xintong, et autres
Publié: (2024)
STEAR: Layer-Aware Spatiotemporal Evidence Intervention for Hallucination Mitigation in Video Large Language Models
par: Fan, Linfeng, et autres
Publié: (2026)
par: Fan, Linfeng, et autres
Publié: (2026)
ConVis: Contrastive Decoding with Hallucination Visualization for Mitigating Hallucinations in Multimodal Large Language Models
par: Park, Yeji, et autres
Publié: (2024)
par: Park, Yeji, et autres
Publié: (2024)
Delve into Visual Contrastive Decoding for Hallucination Mitigation of Large Vision-Language Models
par: Lee, Yi-Lun, et autres
Publié: (2024)
par: Lee, Yi-Lun, et autres
Publié: (2024)
Retrieval Visual Contrastive Decoding to Mitigate Object Hallucinations in Large Vision-Language Models
par: Lee, Jihoon, et autres
Publié: (2025)
par: Lee, Jihoon, et autres
Publié: (2025)
Efficient Contrastive Decoding with Probabilistic Hallucination Detection - Mitigating Hallucinations in Large Vision Language Models -
par: Fieback, Laura, et autres
Publié: (2025)
par: Fieback, Laura, et autres
Publié: (2025)
Mitigating Hallucinations in Large Vision-Language Models via DPO: On-Policy Data Hold the Key
par: Yang, Zhihe, et autres
Publié: (2025)
par: Yang, Zhihe, et autres
Publié: (2025)
Mitigating Hallucinations in Large Vision-Language Models via Summary-Guided Decoding
par: Min, Kyungmin, et autres
Publié: (2024)
par: Min, Kyungmin, et autres
Publié: (2024)
Residual Decoding: Mitigating Hallucinations in Large Vision-Language Models via History-Aware Residual Guidance
par: Chen, Xinrong, et autres
Publié: (2026)
par: Chen, Xinrong, et autres
Publié: (2026)
Mask What Matters: Mitigating Object Hallucinations in Multimodal Large Language Models with Object-Aligned Visual Contrastive Decoding
par: Chen, Boqi, et autres
Publié: (2026)
par: Chen, Boqi, et autres
Publié: (2026)
Mitigating Dialogue Hallucination for Large Vision Language Models via Adversarial Instruction Tuning
par: Park, Dongmin, et autres
Publié: (2024)
par: Park, Dongmin, et autres
Publié: (2024)
Relaxing Anchor-Frame Dominance for Mitigating Hallucinations in Video Large Language Models
par: Liu, Zijian, et autres
Publié: (2026)
par: Liu, Zijian, et autres
Publié: (2026)
YARD: Y-Architecture Register Decoding for Efficient Hallucination Mitigation in Large Vision-Language Models
par: Chen, Ting, et autres
Publié: (2026)
par: Chen, Ting, et autres
Publié: (2026)
IBD: Alleviating Hallucinations in Large Vision-Language Models via Image-Biased Decoding
par: Zhu, Lanyun, et autres
Publié: (2024)
par: Zhu, Lanyun, et autres
Publié: (2024)
Mitigating Hallucinations in Large Vision-Language Models by Self-Injecting Hallucinations
par: Lu, Yifan, et autres
Publié: (2025)
par: Lu, Yifan, et autres
Publié: (2025)
Exploring Hallucination of Large Multimodal Models in Video Understanding: Benchmark, Analysis and Mitigation
par: Gao, Hongcheng, et autres
Publié: (2025)
par: Gao, Hongcheng, et autres
Publié: (2025)
CATCH: Complementary Adaptive Token-level Contrastive Decoding to Mitigate Hallucinations in LVLMs
par: Kan, Zhehan, et autres
Publié: (2024)
par: Kan, Zhehan, et autres
Publié: (2024)
Hallucination Augmented Contrastive Learning for Multimodal Large Language Model
par: Jiang, Chaoya, et autres
Publié: (2023)
par: Jiang, Chaoya, et autres
Publié: (2023)
Self-Correcting Decoding with Generative Feedback for Mitigating Hallucinations in Large Vision-Language Models
par: Zhang, Ce, et autres
Publié: (2025)
par: Zhang, Ce, et autres
Publié: (2025)
Watch Closely: Mitigating Object Hallucinations in Large Vision-Language Models with Disentangled Decoding
par: Ma, Ruiqi, et autres
Publié: (2025)
par: Ma, Ruiqi, et autres
Publié: (2025)
Self-Introspective Decoding: Alleviating Hallucinations for Large Vision-Language Models
par: Huo, Fushuo, et autres
Publié: (2024)
par: Huo, Fushuo, et autres
Publié: (2024)
Nullu: Mitigating Object Hallucinations in Large Vision-Language Models via HalluSpace Projection
par: Yang, Le, et autres
Publié: (2024)
par: Yang, Le, et autres
Publié: (2024)
Mitigating Object Hallucinations in Large Vision-Language Models via Attention Calibration
par: Zhu, Younan, et autres
Publié: (2025)
par: Zhu, Younan, et autres
Publié: (2025)
Learning to Decode Against Compositional Hallucination in Video Multimodal Large Language Models
par: Xing, Wenbin, et autres
Publié: (2026)
par: Xing, Wenbin, et autres
Publié: (2026)
Mitigating Hallucinations in Large Vision-Language Models via Causal Route Gating
par: Cheng, Zhe, et autres
Publié: (2026)
par: Cheng, Zhe, et autres
Publié: (2026)
Seeing is Believing? Mitigating OCR Hallucinations in Multimodal Large Language Models
par: He, Zhentao, et autres
Publié: (2025)
par: He, Zhentao, et autres
Publié: (2025)
VideoHallucer: Evaluating Intrinsic and Extrinsic Hallucinations in Large Video-Language Models
par: Wang, Yuxuan, et autres
Publié: (2024)
par: Wang, Yuxuan, et autres
Publié: (2024)
VERHallu: Evaluating and Mitigating Event Relation Hallucination in Video Large Language Models
par: Zhang, Zefan, et autres
Publié: (2026)
par: Zhang, Zefan, et autres
Publié: (2026)
Towards Interpretable Hallucination Analysis and Mitigation in LVLMs via Contrastive Neuron Steering
par: Lyu, Guangtao, et autres
Publié: (2026)
par: Lyu, Guangtao, et autres
Publié: (2026)
Documents similaires
-
Mitigating Hallucination in Multimodal LLMs with Layer Contrastive Decoding
par: Tong, Bingkui, et autres
Publié: (2025) -
Mitigating Hallucination in Visual-Language Models via Re-Balancing Contrastive Decoding
par: Liang, Xiaoyu, et autres
Publié: (2024) -
VaLiD: Mitigating the Hallucination of Large Vision Language Models by Visual Layer Fusion Contrastive Decoding
par: Wang, Jiaqi, et autres
Publié: (2024) -
AVCD: Mitigating Hallucinations in Audio-Visual Large Language Models through Contrastive Decoding
par: Jung, Chaeyoung, et autres
Publié: (2025) -
SECOND: Mitigating Perceptual Hallucination in Vision-Language Models via Selective and Contrastive Decoding
par: Park, Woohyeon, et autres
Publié: (2025)