Residual Decoding: Mitigating Hallucinations in Large Vision-Language Models via History-Aware Residual Guidance
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Chen, Xinrong, Chu, Xu, Qiu, Yingmin, Zhang, Hengyuan, Xiong, Jing, Tang, Shiyu, Liu, Shuai, Yang, Shaokang, Yang, Cheng, So, Hayden Kwok-Hay, Wong, Ngai |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
GuiLoMo: Allocating Expert Number and Rank for LoRA-MoE via Bilevel Optimization with GuidedSelection Vectors
par: Zhang, Hengyuan, et autres
Publié: (2025)
par: Zhang, Hengyuan, et autres
Publié: (2025)
Beyond Outliers: A Data-Free Layer-wise Mixed-Precision Quantization Approach Driven by Numerical and Structural Dual-Sensitivity
par: Zhang, Hengyuan, et autres
Publié: (2026)
par: Zhang, Hengyuan, et autres
Publié: (2026)
Find Your Optimal Teacher: Personalized Data Synthesis via Router-Guided Multi-Teacher Distillation
par: Zhang, Hengyuan, et autres
Publié: (2025)
par: Zhang, Hengyuan, et autres
Publié: (2025)
TreeReview: A Dynamic Tree of Questions Framework for Deep and Efficient LLM-based Scientific Peer Review
par: Chang, Yuan, et autres
Publié: (2025)
par: Chang, Yuan, et autres
Publié: (2025)
A Composable Dynamic Sparse Dataflow Architecture for Efficient Event-based Vision Processing on FPGA
par: Gao, Yizhao, et autres
Publié: (2024)
par: Gao, Yizhao, et autres
Publié: (2024)
Co-designing a Sub-millisecond Latency Event-based Eye Tracking System with Submanifold Sparse CNN
par: Zhang, Baoheng, et autres
Publié: (2024)
par: Zhang, Baoheng, et autres
Publié: (2024)
Incremental Residual Concept Bottleneck Models
par: Shang, Chenming, et autres
Publié: (2024)
par: Shang, Chenming, et autres
Publié: (2024)
Adaptive Residual-Update Steering for Low-Overhead Hallucination Mitigation in Large Vision Language Models
par: Zou, Zhengtao, et autres
Publié: (2025)
par: Zou, Zhengtao, et autres
Publié: (2025)
INTER: Mitigating Hallucination in Large Vision-Language Models by Interaction Guidance Sampling
par: Dong, Xin, et autres
Publié: (2025)
par: Dong, Xin, et autres
Publié: (2025)
SpikeMOT: Event-based Multi-Object Tracking with Sparse Motion Features
par: Wang, Song, et autres
Publié: (2023)
par: Wang, Song, et autres
Publié: (2023)
DyBit: Dynamic Bit-Precision Numbers for Efficient Quantized Neural Network Inference
par: Zhou, Jiajun, et autres
Publié: (2023)
par: Zhou, Jiajun, et autres
Publié: (2023)
Mitigating Hallucinations in Large Vision-Language Models with Internal Fact-based Contrastive Decoding
par: Wang, Chao, et autres
Publié: (2025)
par: Wang, Chao, et autres
Publié: (2025)
Lifecycle Cost-Effectiveness Modeling for Redundancy-Enhanced Multi-Chiplet Architectures
par: Liu, Zizhen, et autres
Publié: (2026)
par: Liu, Zizhen, et autres
Publié: (2026)
SAVER: Mitigating Hallucinations in Large Vision-Language Models via Style-Aware Visual Early Revision
par: Li, Zhaoxu, et autres
Publié: (2025)
par: Li, Zhaoxu, et autres
Publié: (2025)
SAGE: Sink-Aware Grounded Decoding for Multimodal Hallucination Mitigation
par: Shukla, Tripti, et autres
Publié: (2026)
par: Shukla, Tripti, et autres
Publié: (2026)
TATAA: Programmable Mixed-Precision Transformer Acceleration with a Transformable Arithmetic Architecture
par: Wu, Jiajun, et autres
Publié: (2024)
par: Wu, Jiajun, et autres
Publié: (2024)
SAKED: Mitigating Hallucination in Large Vision-Language Models via Stability-Aware Knowledge Enhanced Decoding
par: Li, Zhaoxu, et autres
Publié: (2026)
par: Li, Zhaoxu, et autres
Publié: (2026)
Efficient Contrastive Decoding with Probabilistic Hallucination Detection - Mitigating Hallucinations in Large Vision Language Models -
par: Fieback, Laura, et autres
Publié: (2025)
par: Fieback, Laura, et autres
Publié: (2025)
Mitigating Hallucinations in Large Vision-Language Models with Instruction Contrastive Decoding
par: Wang, Xintong, et autres
Publié: (2024)
par: Wang, Xintong, et autres
Publié: (2024)
Thinking in Uncertainty: Mitigating Hallucinations in MLRMs with Latent Entropy-Aware Decoding
par: Xu, Zhongxing, et autres
Publié: (2026)
par: Xu, Zhongxing, et autres
Publié: (2026)
First Logit Boosting: Visual Grounding Method to Mitigate Object Hallucination in Large Vision-Language Models
par: Ha, Jiwoo, et autres
Publié: (2026)
par: Ha, Jiwoo, et autres
Publié: (2026)
Mitigating Diffusion Model Hallucinations with Dynamic Guidance
par: Triaridis, Kostas, et autres
Publié: (2025)
par: Triaridis, Kostas, et autres
Publié: (2025)
MaskCD: Mitigating LVLM Hallucinations by Image Head Masked Contrastive Decoding
par: Deng, Jingyuan, et autres
Publié: (2025)
par: Deng, Jingyuan, et autres
Publié: (2025)
CodeComp: Structural KV Cache Compression for Agentic Coding
par: Chen, Qiujiang, et autres
Publié: (2026)
par: Chen, Qiujiang, et autres
Publié: (2026)
Mitigating Object Hallucination in Large Vision-Language Models via Image-Grounded Guidance
par: Zhao, Linxi, et autres
Publié: (2024)
par: Zhao, Linxi, et autres
Publié: (2024)
Mitigating Object Hallucinations in Vision-Language Models through Region-Aware Attention Recalibration
par: Xu, Yuanzhi, et autres
Publié: (2026)
par: Xu, Yuanzhi, et autres
Publié: (2026)
Mitigating Hallucinations in Large Vision-Language Models via Summary-Guided Decoding
par: Min, Kyungmin, et autres
Publié: (2024)
par: Min, Kyungmin, et autres
Publié: (2024)
Delve into Visual Contrastive Decoding for Hallucination Mitigation of Large Vision-Language Models
par: Lee, Yi-Lun, et autres
Publié: (2024)
par: Lee, Yi-Lun, et autres
Publié: (2024)
Residual-Mass Accounting for Partial-KV Decoding
par: Hoshi, Yasuto, et autres
Publié: (2026)
par: Hoshi, Yasuto, et autres
Publié: (2026)
Mixture of Decoding: An Attention-Inspired Adaptive Decoding Strategy to Mitigate Hallucinations in Large Vision-Language Models
par: Chen, Xinlong, et autres
Publié: (2025)
par: Chen, Xinlong, et autres
Publié: (2025)
D-QRELO: Training- and Data-Free Delta Compression for Large Language Models via Quantization and Residual Low-Rank Approximation
par: Li, Junlin, et autres
Publié: (2026)
par: Li, Junlin, et autres
Publié: (2026)
Cooperative Advisory Residual Policies for Congestion Mitigation
par: Hasan, Aamir, et autres
Publié: (2024)
par: Hasan, Aamir, et autres
Publié: (2024)
MINT: Mitigating Hallucinations in Large Vision-Language Models via Token Reduction
par: Wang, Chao, et autres
Publié: (2025)
par: Wang, Chao, et autres
Publié: (2025)
Decoding by Perturbation: Mitigating MLLM Hallucinations via Dynamic Textual Perturbation
par: Jia, Sihang, et autres
Publié: (2026)
par: Jia, Sihang, et autres
Publié: (2026)
SDCD: Structure-Disrupted Contrastive Decoding for Mitigating Hallucinations in Large Vision-Language Models
par: Xia, Yuxuan, et autres
Publié: (2026)
par: Xia, Yuxuan, et autres
Publié: (2026)
SECOND: Mitigating Perceptual Hallucination in Vision-Language Models via Selective and Contrastive Decoding
par: Park, Woohyeon, et autres
Publié: (2025)
par: Park, Woohyeon, et autres
Publié: (2025)
Self-Correcting Decoding with Generative Feedback for Mitigating Hallucinations in Large Vision-Language Models
par: Zhang, Ce, et autres
Publié: (2025)
par: Zhang, Ce, et autres
Publié: (2025)
Watch Closely: Mitigating Object Hallucinations in Large Vision-Language Models with Disentangled Decoding
par: Ma, Ruiqi, et autres
Publié: (2025)
par: Ma, Ruiqi, et autres
Publié: (2025)
HELPD: Mitigating Hallucination of LVLMs by Hierarchical Feedback Learning with Vision-enhanced Penalty Decoding
par: Yuan, Fan, et autres
Publié: (2024)
par: Yuan, Fan, et autres
Publié: (2024)
Retrieval Visual Contrastive Decoding to Mitigate Object Hallucinations in Large Vision-Language Models
par: Lee, Jihoon, et autres
Publié: (2025)
par: Lee, Jihoon, et autres
Publié: (2025)
Documents similaires
-
GuiLoMo: Allocating Expert Number and Rank for LoRA-MoE via Bilevel Optimization with GuidedSelection Vectors
par: Zhang, Hengyuan, et autres
Publié: (2025) -
Beyond Outliers: A Data-Free Layer-wise Mixed-Precision Quantization Approach Driven by Numerical and Structural Dual-Sensitivity
par: Zhang, Hengyuan, et autres
Publié: (2026) -
Find Your Optimal Teacher: Personalized Data Synthesis via Router-Guided Multi-Teacher Distillation
par: Zhang, Hengyuan, et autres
Publié: (2025) -
TreeReview: A Dynamic Tree of Questions Framework for Deep and Efficient LLM-based Scientific Peer Review
par: Chang, Yuan, et autres
Publié: (2025) -
A Composable Dynamic Sparse Dataflow Architecture for Efficient Event-based Vision Processing on FPGA
par: Gao, Yizhao, et autres
Publié: (2024)