Pensieve: Retrospect-then-Compare Mitigates Visual Hallucination
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yang, Dingchen, Cao, Bowen, Chen, Guang, Jiang, Changjun |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Beyond Intermediate States: Explaining Visual Redundancy through Language
par: Yang, Dingchen, et autres
Publié: (2025)
par: Yang, Dingchen, et autres
Publié: (2025)
Global Context or Local Detail? Adaptive Visual Grounding for Hallucination Mitigation
par: Jiang, Yubo, et autres
Publié: (2026)
par: Jiang, Yubo, et autres
Publié: (2026)
Visual Attention Drifts,but Anchors Hold:Mitigating Hallucination in Multimodal Large Language Models via Cross-Layer Visual Anchors
par: Yang, Chengxu, et autres
Publié: (2026)
par: Yang, Chengxu, et autres
Publié: (2026)
Token Preference Optimization with Self-Calibrated Visual-Anchored Rewards for Hallucination Mitigation
par: Gu, Jihao, et autres
Publié: (2024)
par: Gu, Jihao, et autres
Publié: (2024)
Recollection from Pensieve: Novel View Synthesis via Learning from Uncalibrated Videos
par: Wang, Ruoyu, et autres
Publié: (2025)
par: Wang, Ruoyu, et autres
Publié: (2025)
Mitigating Hallucination in Visual-Language Models via Re-Balancing Contrastive Decoding
par: Liang, Xiaoyu, et autres
Publié: (2024)
par: Liang, Xiaoyu, et autres
Publié: (2024)
Mitigating Low-Level Visual Hallucinations Requires Self-Awareness: Database, Model and Training Strategy
par: Sun, Yinan, et autres
Publié: (2025)
par: Sun, Yinan, et autres
Publié: (2025)
LiDAR4D: Dynamic Neural Fields for Novel Space-time View LiDAR Synthesis
par: Zheng, Zehan, et autres
Publié: (2024)
par: Zheng, Zehan, et autres
Publié: (2024)
Mitigating Object Hallucinations via Sentence-Level Early Intervention
par: Peng, Shangpin, et autres
Publié: (2025)
par: Peng, Shangpin, et autres
Publié: (2025)
VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models
par: Neo, Dexter, et autres
Publié: (2024)
par: Neo, Dexter, et autres
Publié: (2024)
Poison as Cure: Visual Noise for Mitigating Object Hallucinations in LVMs
par: Zhang, Kejia, et autres
Publié: (2025)
par: Zhang, Kejia, et autres
Publié: (2025)
Visual Multi-Agent System: Mitigating Hallucination Snowballing via Visual Flow
par: Yu, Xinlei, et autres
Publié: (2025)
par: Yu, Xinlei, et autres
Publié: (2025)
SAVER: Mitigating Hallucinations in Large Vision-Language Models via Style-Aware Visual Early Revision
par: Li, Zhaoxu, et autres
Publié: (2025)
par: Li, Zhaoxu, et autres
Publié: (2025)
VASparse: Towards Efficient Visual Hallucination Mitigation via Visual-Aware Token Sparsification
par: Zhuang, Xianwei, et autres
Publié: (2025)
par: Zhuang, Xianwei, et autres
Publié: (2025)
See Different, Think Better: Visual Variations Mitigating Hallucinations in LVLMs
par: Dai, Ziyun, et autres
Publié: (2025)
par: Dai, Ziyun, et autres
Publié: (2025)
Extracting Visual Facts from Intermediate Layers for Mitigating Hallucinations in Multimodal Large Language Models
par: Zhou, Haoran, et autres
Publié: (2025)
par: Zhou, Haoran, et autres
Publié: (2025)
Instruction-Aligned Visual Attention for Mitigating Hallucinations in Large Vision-Language Models
par: Li, Bin, et autres
Publié: (2025)
par: Li, Bin, et autres
Publié: (2025)
CAST: Mitigating Object Hallucination in Large Vision-Language Models via Caption-Guided Visual Attention Steering
par: Li, Qiming, et autres
Publié: (2026)
par: Li, Qiming, et autres
Publié: (2026)
Revealing and Enhancing Core Visual Regions: Harnessing Internal Attention Dynamics for Hallucination Mitigation in LVLMs
par: Lyu, Guangtao, et autres
Publié: (2026)
par: Lyu, Guangtao, et autres
Publié: (2026)
Learning from Fine-Grained Visual Discrepancies: Mitigating Multimodal Hallucinations via In-Context Visual Contrastive Optimization
par: Deng, Haolin, et autres
Publié: (2026)
par: Deng, Haolin, et autres
Publié: (2026)
Mitigating Action-Relation Hallucinations in LVLMs via Relation-aware Visual Enhancement
par: Qin, Zhenxin, et autres
Publié: (2026)
par: Qin, Zhenxin, et autres
Publié: (2026)
RCDN: Towards Robust Camera-Insensitivity Collaborative Perception via Dynamic Feature-based 3D Neural Modeling
par: Wang, Tianhang, et autres
Publié: (2024)
par: Wang, Tianhang, et autres
Publié: (2024)
MM-Snowball: Evaluating and Mitigating Hallucination Snowballing in Multimodal Multi-Turn Dialogue
par: Jiang, Yue, et autres
Publié: (2026)
par: Jiang, Yue, et autres
Publié: (2026)
InEx: Hallucination Mitigation via Introspection and Cross-Modal Multi-Agent Collaboration
par: Yang, Zhongyu, et autres
Publié: (2025)
par: Yang, Zhongyu, et autres
Publié: (2025)
Look Twice Before You Answer: Memory-Space Visual Retracing for Hallucination Mitigation in Multimodal Large Language Models
par: Zou, Xin, et autres
Publié: (2024)
par: Zou, Xin, et autres
Publié: (2024)
Mitigating Hallucination in Large Vision-Language Models via Adaptive Attention Calibration
par: Fazli, Mehrdad, et autres
Publié: (2025)
par: Fazli, Mehrdad, et autres
Publié: (2025)
MIHBench: Benchmarking and Mitigating Multi-Image Hallucinations in Multimodal Large Language Models
par: Li, Jiale, et autres
Publié: (2025)
par: Li, Jiale, et autres
Publié: (2025)
Look Carefully: Adaptive Visual Reinforcements in Multimodal Large Language Models for Hallucination Mitigation
par: Zhu, Xingyu, et autres
Publié: (2026)
par: Zhu, Xingyu, et autres
Publié: (2026)
AVCD: Mitigating Hallucinations in Audio-Visual Large Language Models through Contrastive Decoding
par: Jung, Chaeyoung, et autres
Publié: (2025)
par: Jung, Chaeyoung, et autres
Publié: (2025)
SAVAA: Mitigating Hallucinations in LVLMs via Step-wise Adaptive Visual Attention Amplification
par: Zhang, Jiacheng, et autres
Publié: (2026)
par: Zhang, Jiacheng, et autres
Publié: (2026)
KVSmooth: Mitigating Hallucination in Multi-modal Large Language Models through Key-Value Smoothing
par: Jiang, Siyu, et autres
Publié: (2026)
par: Jiang, Siyu, et autres
Publié: (2026)
Urban Architect: Steerable 3D Urban Scene Generation with Layout Prior
par: Lu, Fan, et autres
Publié: (2024)
par: Lu, Fan, et autres
Publié: (2024)
Hallucination Score: Towards Mitigating Hallucinations in Generative Image Super-Resolution
par: Ren, Weiming, et autres
Publié: (2025)
par: Ren, Weiming, et autres
Publié: (2025)
One-shot Optimized Steering Vector for Hallucination Mitigation for VLMs
par: Shi, Youxu, et autres
Publié: (2026)
par: Shi, Youxu, et autres
Publié: (2026)
Devils in Middle Layers of Large Vision-Language Models: Interpreting, Detecting and Mitigating Object Hallucinations via Attention Lens
par: Jiang, Zhangqi, et autres
Publié: (2024)
par: Jiang, Zhangqi, et autres
Publié: (2024)
Mitigating Multimodal Hallucination via Phase-wise Self-reward
par: Zhang, Yu, et autres
Publié: (2026)
par: Zhang, Yu, et autres
Publié: (2026)
GeoNLF: Geometry guided Pose-Free Neural LiDAR Fields
par: Xue, Weiyi, et autres
Publié: (2024)
par: Xue, Weiyi, et autres
Publié: (2024)
HGL: Hierarchical Geometry Learning for Test-time Adaptation in 3D Point Cloud Segmentation
par: Zou, Tianpei, et autres
Publié: (2024)
par: Zou, Tianpei, et autres
Publié: (2024)
HIME: Mitigating Object Hallucinations in LVLMs via Hallucination Insensitivity Model Editing
par: Akl, Ahmed, et autres
Publié: (2026)
par: Akl, Ahmed, et autres
Publié: (2026)
When Images Speak Louder: Mitigating Language Bias-induced Hallucinations in VLMs through Cross-Modal Guidance
par: Cao, Jinjin, et autres
Publié: (2025)
par: Cao, Jinjin, et autres
Publié: (2025)
Documents similaires
-
Beyond Intermediate States: Explaining Visual Redundancy through Language
par: Yang, Dingchen, et autres
Publié: (2025) -
Global Context or Local Detail? Adaptive Visual Grounding for Hallucination Mitigation
par: Jiang, Yubo, et autres
Publié: (2026) -
Visual Attention Drifts,but Anchors Hold:Mitigating Hallucination in Multimodal Large Language Models via Cross-Layer Visual Anchors
par: Yang, Chengxu, et autres
Publié: (2026) -
Token Preference Optimization with Self-Calibrated Visual-Anchored Rewards for Hallucination Mitigation
par: Gu, Jihao, et autres
Publié: (2024) -
Recollection from Pensieve: Novel View Synthesis via Learning from Uncalibrated Videos
par: Wang, Ruoyu, et autres
Publié: (2025)