Enregistré dans:
| Auteurs principaux: | Chen, Minghui, Yang, Chenxu, Zhu, Hengjie, Wu, Dayan, Lin, Zheng, Si, Qingyi |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2605.00323 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
EasyVideoR1: Easier RL for Video Understanding
par: Qin, Chuanyu, et autres
Publié: (2026)
par: Qin, Chuanyu, et autres
Publié: (2026)
Calibrated Self-Rewarding Vision Language Models
par: Zhou, Yiyang, et autres
Publié: (2024)
par: Zhou, Yiyang, et autres
Publié: (2024)
Self-Calibrated Tuning of Vision-Language Models for Out-of-Distribution Detection
par: Yu, Geng, et autres
Publié: (2024)
par: Yu, Geng, et autres
Publié: (2024)
Detecting and Preventing Hallucinations in Large Vision Language Models
par: Gunjal, Anisha, et autres
Publié: (2023)
par: Gunjal, Anisha, et autres
Publié: (2023)
A Survey on Hallucination in Large Vision-Language Models
par: Liu, Hanchao, et autres
Publié: (2024)
par: Liu, Hanchao, et autres
Publié: (2024)
Mitigating Object Hallucinations in Vision-Language Models through Region-Aware Attention Recalibration
par: Xu, Yuanzhi, et autres
Publié: (2026)
par: Xu, Yuanzhi, et autres
Publié: (2026)
BlueSuffix: Reinforced Blue Teaming for Vision-Language Models Against Jailbreak Attacks
par: Zhao, Yunhan, et autres
Publié: (2024)
par: Zhao, Yunhan, et autres
Publié: (2024)
Interpreting and Editing Vision-Language Representations to Mitigate Hallucinations
par: Jiang, Nick, et autres
Publié: (2024)
par: Jiang, Nick, et autres
Publié: (2024)
An Empirical Study Into What Matters for Calibrating Vision-Language Models
par: Tu, Weijie, et autres
Publié: (2024)
par: Tu, Weijie, et autres
Publié: (2024)
Mitigating Hallucinations in Vision-Language Models through Image-Guided Head Suppression
par: Sarkar, Sreetama, et autres
Publié: (2025)
par: Sarkar, Sreetama, et autres
Publié: (2025)
HaloProbe: Bayesian Detection and Mitigation of Object Hallucinations in Vision-Language Models
par: Zohrabi, Reihaneh, et autres
Publié: (2026)
par: Zohrabi, Reihaneh, et autres
Publié: (2026)
Unified Triplet-Level Hallucination Evaluation for Large Vision-Language Models
par: Wu, Junjie, et autres
Publié: (2024)
par: Wu, Junjie, et autres
Publié: (2024)
Hallucination-Aware Multimodal Benchmark for Gastrointestinal Image Analysis with Large Vision-Language Models
par: Khanal, Bidur, et autres
Publié: (2025)
par: Khanal, Bidur, et autres
Publié: (2025)
What Makes "Good" Distractors for Object Hallucination Evaluation in Large Vision-Language Models?
par: Xie, Ming-Kun, et autres
Publié: (2025)
par: Xie, Ming-Kun, et autres
Publié: (2025)
Improving Vision-Language-Action Model with Online Reinforcement Learning
par: Guo, Yanjiang, et autres
Publié: (2025)
par: Guo, Yanjiang, et autres
Publié: (2025)
Analyzing and Mitigating Object Hallucination in Large Vision-Language Models
par: Zhou, Yiyang, et autres
Publié: (2023)
par: Zhou, Yiyang, et autres
Publié: (2023)
Handling Imbalanced Pseudolabels for Vision-Language Models with Concept Alignment and Confusion-Aware Calibrated Margin
par: Wang, Yuchen, et autres
Publié: (2025)
par: Wang, Yuchen, et autres
Publié: (2025)
RadFlag: A Black-Box Hallucination Detection Method for Medical Vision Language Models
par: Zhang, Serena, et autres
Publié: (2024)
par: Zhang, Serena, et autres
Publié: (2024)
Who Brings the Frisbee: Probing Hidden Hallucination Factors in Large Vision-Language Model via Causality Analysis
par: Huang, Po-Hsuan, et autres
Publié: (2024)
par: Huang, Po-Hsuan, et autres
Publié: (2024)
Logical Closed Loop: Uncovering Object Hallucinations in Large Vision-Language Models
par: Wu, Junfei, et autres
Publié: (2024)
par: Wu, Junfei, et autres
Publié: (2024)
MM-Zero: Self-Evolving Multi-Model Vision Language Models From Zero Data
par: Li, Zongxia, et autres
Publié: (2026)
par: Li, Zongxia, et autres
Publié: (2026)
Overconfidence and Calibration in Medical VQA: Empirical Findings and Hallucination-Aware Mitigation
par: Byun, Ji Young, et autres
Publié: (2026)
par: Byun, Ji Young, et autres
Publié: (2026)
THRONE: An Object-based Hallucination Benchmark for the Free-form Generations of Large Vision-Language Models
par: Kaul, Prannay, et autres
Publié: (2024)
par: Kaul, Prannay, et autres
Publié: (2024)
Calibrated and Robust Foundation Models for Vision-Language and Medical Image Tasks Under Distribution Shift
par: Khan, Behraj, et autres
Publié: (2025)
par: Khan, Behraj, et autres
Publié: (2025)
Dynamic Against Dynamic: An Open-set Self-learning Framework
par: Yang, Haifeng, et autres
Publié: (2024)
par: Yang, Haifeng, et autres
Publié: (2024)
FedVLMBench: Benchmarking Federated Fine-Tuning of Vision-Language Models
par: Zheng, Weiying, et autres
Publié: (2025)
par: Zheng, Weiying, et autres
Publié: (2025)
Skip \n: A Simple Method to Reduce Hallucination in Large Vision-Language Models
par: Han, Zongbo, et autres
Publié: (2024)
par: Han, Zongbo, et autres
Publié: (2024)
Identify, Isolate, and Purge: Mitigating Hallucinations in LVLMs via Self-Evolving Distillation
par: Li, Wenhao, et autres
Publié: (2025)
par: Li, Wenhao, et autres
Publié: (2025)
Generative AI for Urban Planning: Synthesizing Satellite Imagery via Diffusion Models
par: Wang, Qingyi, et autres
Publié: (2025)
par: Wang, Qingyi, et autres
Publié: (2025)
EaqVLA: Encoding-aligned Quantization for Vision-Language-Action Models
par: Jiang, Feng, et autres
Publié: (2025)
par: Jiang, Feng, et autres
Publié: (2025)
Reducing Hallucinations in Vision-Language Models via Latent Space Steering
par: Liu, Sheng, et autres
Publié: (2024)
par: Liu, Sheng, et autres
Publié: (2024)
D-TPT: Dimensional Entropy Maximization for Calibrating Test-Time Prompt Tuning in Vision-Language Models
par: Han, Jisu, et autres
Publié: (2025)
par: Han, Jisu, et autres
Publié: (2025)
Efficient Contrastive Decoding with Probabilistic Hallucination Detection - Mitigating Hallucinations in Large Vision Language Models -
par: Fieback, Laura, et autres
Publié: (2025)
par: Fieback, Laura, et autres
Publié: (2025)
Mitigating Hallucinations via Inter-Layer Consistency Aggregation in Large Vision-Language Models
par: Tang, Kai, et autres
Publié: (2025)
par: Tang, Kai, et autres
Publié: (2025)
Evaluating Hallucination in Large Vision-Language Models based on Context-Aware Object Similarities
par: Datta, Shounak, et autres
Publié: (2025)
par: Datta, Shounak, et autres
Publié: (2025)
Retrieval Visual Contrastive Decoding to Mitigate Object Hallucinations in Large Vision-Language Models
par: Lee, Jihoon, et autres
Publié: (2025)
par: Lee, Jihoon, et autres
Publié: (2025)
The Hidden Life of Tokens: Reducing Hallucination of Large Vision-Language Models via Visual Information Steering
par: Li, Zhuowei, et autres
Publié: (2025)
par: Li, Zhuowei, et autres
Publié: (2025)
Exploring Transferability of Self-Supervised Learning by Task Conflict Calibration
par: Guo, Huijie, et autres
Publié: (2025)
par: Guo, Huijie, et autres
Publié: (2025)
Score-based Conditional Generation with Fewer Labeled Data by Self-calibrating Classifier Guidance
par: Huang, Paul Kuo-Ming, et autres
Publié: (2023)
par: Huang, Paul Kuo-Ming, et autres
Publié: (2023)
Post-training Quantization for Text-to-Image Diffusion Models with Progressive Calibration and Activation Relaxing
par: Tang, Siao, et autres
Publié: (2023)
par: Tang, Siao, et autres
Publié: (2023)
Documents similaires
-
EasyVideoR1: Easier RL for Video Understanding
par: Qin, Chuanyu, et autres
Publié: (2026) -
Calibrated Self-Rewarding Vision Language Models
par: Zhou, Yiyang, et autres
Publié: (2024) -
Self-Calibrated Tuning of Vision-Language Models for Out-of-Distribution Detection
par: Yu, Geng, et autres
Publié: (2024) -
Detecting and Preventing Hallucinations in Large Vision Language Models
par: Gunjal, Anisha, et autres
Publié: (2023) -
A Survey on Hallucination in Large Vision-Language Models
par: Liu, Hanchao, et autres
Publié: (2024)