VL-Calibration: Decoupled Confidence Calibration for Large Vision-Language Models Reasoning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Xiao, Wenyi, Xu, Xinchi, Gan, Leilei |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Fast-Slow Thinking GRPO for Large Vision-Language Model Reasoning
par: Xiao, Wenyi, et autres
Publié: (2025)
par: Xiao, Wenyi, et autres
Publié: (2025)
Detecting and Mitigating Hallucination in Large Vision Language Models via Fine-Grained AI Feedback
par: Xiao, Wenyi, et autres
Publié: (2024)
par: Xiao, Wenyi, et autres
Publié: (2024)
Prompt4Trust: A Reinforcement Learning Prompt Augmentation Framework for Clinically-Aligned Confidence Calibration in Multimodal Large Language Models
par: Kriz, Anita, et autres
Publié: (2025)
par: Kriz, Anita, et autres
Publié: (2025)
MathCoder-VL: Bridging Vision and Code for Enhanced Multimodal Mathematical Reasoning
par: Wang, Ke, et autres
Publié: (2025)
par: Wang, Ke, et autres
Publié: (2025)
Object-Level Verbalized Confidence Calibration in Vision-Language Models via Semantic Perturbation
par: Zhao, Yunpu, et autres
Publié: (2025)
par: Zhao, Yunpu, et autres
Publié: (2025)
Bridging the Missing-Modality Gap: Improving Text-Only Calibration of Vision Language Models
par: Kim, Mingyeong, et autres
Publié: (2026)
par: Kim, Mingyeong, et autres
Publié: (2026)
R1-ShareVL: Incentivizing Reasoning Capability of Multimodal Large Language Models via Share-GRPO
par: Yao, Huanjin, et autres
Publié: (2025)
par: Yao, Huanjin, et autres
Publié: (2025)
VL-Cogito: Progressive Curriculum Reinforcement Learning for Advanced Multimodal Reasoning
par: Yuan, Ruifeng, et autres
Publié: (2025)
par: Yuan, Ruifeng, et autres
Publié: (2025)
Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution
par: Wang, Peng, et autres
Publié: (2024)
par: Wang, Peng, et autres
Publié: (2024)
SPA-VL: A Comprehensive Safety Preference Alignment Dataset for Vision Language Model
par: Zhang, Yongting, et autres
Publié: (2024)
par: Zhang, Yongting, et autres
Publié: (2024)
DeepSeek-VL2: Mixture-of-Experts Vision-Language Models for Advanced Multimodal Understanding
par: Wu, Zhiyu, et autres
Publié: (2024)
par: Wu, Zhiyu, et autres
Publié: (2024)
Mitigating Object Hallucinations in Large Vision-Language Models via Attention Calibration
par: Zhu, Younan, et autres
Publié: (2025)
par: Zhu, Younan, et autres
Publié: (2025)
Crowdsource, Crawl, or Generate? Creating SEA-VL, a Multicultural Vision-Language Dataset for Southeast Asia
par: Cahyawijaya, Samuel, et autres
Publié: (2025)
par: Cahyawijaya, Samuel, et autres
Publié: (2025)
A-VL: Adaptive Attention for Large Vision-Language Models
par: Zhang, Junyang, et autres
Publié: (2024)
par: Zhang, Junyang, et autres
Publié: (2024)
Don't Miss the Forest for the Trees: Attentional Vision Calibration for Large Vision Language Models
par: Woo, Sangmin, et autres
Publié: (2024)
par: Woo, Sangmin, et autres
Publié: (2024)
Unveiling Uncertainty: A Deep Dive into Calibration and Performance of Multimodal Large Language Models
par: Chen, Zijun, et autres
Publié: (2024)
par: Chen, Zijun, et autres
Publié: (2024)
Rethinking Visual Attribution for Chest X-ray Reasoning in Large Vision Language Models
par: Xiong, Guangzhi, et autres
Publié: (2026)
par: Xiong, Guangzhi, et autres
Publié: (2026)
OMIBench: Benchmarking Olympiad-Level Multi-Image Reasoning in Large Vision-Language Model
par: Chen, Qiguang, et autres
Publié: (2026)
par: Chen, Qiguang, et autres
Publié: (2026)
A Cognitive Evaluation Benchmark of Image Reasoning and Description for Large Vision-Language Models
par: Song, Xiujie, et autres
Publié: (2024)
par: Song, Xiujie, et autres
Publié: (2024)
R1-VL: Learning to Reason with Multimodal Large Language Models via Step-wise Group Relative Policy Optimization
par: Zhang, Jingyi, et autres
Publié: (2025)
par: Zhang, Jingyi, et autres
Publié: (2025)
SpatialLadder: Progressive Training for Spatial Reasoning in Vision-Language Models
par: Li, Hongxing, et autres
Publié: (2025)
par: Li, Hongxing, et autres
Publié: (2025)
C-TPT: Calibrated Test-Time Prompt Tuning for Vision-Language Models via Text Feature Dispersion
par: Yoon, Hee Suk, et autres
Publié: (2024)
par: Yoon, Hee Suk, et autres
Publié: (2024)
On the Cultural Anachronism and Temporal Reasoning in Vision Language Models
par: Ranjan, Mukul, et autres
Publié: (2026)
par: Ranjan, Mukul, et autres
Publié: (2026)
Reward Design for Physical Reasoning in Vision-Language Models
par: Lilienthal, Derek, et autres
Publié: (2026)
par: Lilienthal, Derek, et autres
Publié: (2026)
Vision-R1: Incentivizing Reasoning Capability in Multimodal Large Language Models
par: Huang, Wenxuan, et autres
Publié: (2025)
par: Huang, Wenxuan, et autres
Publié: (2025)
ZipVL: Efficient Large Vision-Language Models with Dynamic Token Sparsification
par: He, Yefei, et autres
Publié: (2024)
par: He, Yefei, et autres
Publié: (2024)
Cross-Modal Safety Mechanism Transfer in Large Vision-Language Models
par: Xu, Shicheng, et autres
Publié: (2024)
par: Xu, Shicheng, et autres
Publié: (2024)
Correctable Landmark Discovery via Large Models for Vision-Language Navigation
par: Lin, Bingqian, et autres
Publié: (2024)
par: Lin, Bingqian, et autres
Publié: (2024)
Qianfan-VL: Domain-Enhanced Universal Vision-Language Models
par: Dong, Daxiang, et autres
Publié: (2025)
par: Dong, Daxiang, et autres
Publié: (2025)
R1-SyntheticVL: Is Synthetic Data from Generative Models Ready for Multimodal Large Language Model?
par: Zhang, Jingyi, et autres
Publié: (2026)
par: Zhang, Jingyi, et autres
Publié: (2026)
Towards Calibrated Robust Fine-Tuning of Vision-Language Models
par: Oh, Changdae, et autres
Publié: (2023)
par: Oh, Changdae, et autres
Publié: (2023)
Investigating and Mitigating the Multimodal Hallucination Snowballing in Large Vision-Language Models
par: Zhong, Weihong, et autres
Publié: (2024)
par: Zhong, Weihong, et autres
Publié: (2024)
NavGPT-2: Unleashing Navigational Reasoning Capability for Large Vision-Language Models
par: Zhou, Gengze, et autres
Publié: (2024)
par: Zhou, Gengze, et autres
Publié: (2024)
VL-Cache: Sparsity and Modality-Aware KV Cache Compression for Vision-Language Model Inference Acceleration
par: Tu, Dezhan, et autres
Publié: (2024)
par: Tu, Dezhan, et autres
Publié: (2024)
Florence-VL: Enhancing Vision-Language Models with Generative Vision Encoder and Depth-Breadth Fusion
par: Chen, Jiuhai, et autres
Publié: (2024)
par: Chen, Jiuhai, et autres
Publié: (2024)
Causal-SAM-LLM: Large Language Models as Causal Reasoners for Robust Medical Segmentation
par: Tang, Tao, et autres
Publié: (2025)
par: Tang, Tao, et autres
Publié: (2025)
Decoupling Perception and Calibration: Label-Efficient Image Quality Assessment Framework
par: Li, Xinyue, et autres
Publié: (2026)
par: Li, Xinyue, et autres
Publié: (2026)
Benchmarking Deflection and Hallucination in Large Vision-Language Models
par: Moratelli, Nicholas, et autres
Publié: (2026)
par: Moratelli, Nicholas, et autres
Publié: (2026)
An Examination of the Compositionality of Large Generative Vision-Language Models
par: Ma, Teli, et autres
Publié: (2023)
par: Ma, Teli, et autres
Publié: (2023)
Mitigating Multilingual Hallucination in Large Vision-Language Models
par: Qu, Xiaoye, et autres
Publié: (2024)
par: Qu, Xiaoye, et autres
Publié: (2024)
Documents similaires
-
Fast-Slow Thinking GRPO for Large Vision-Language Model Reasoning
par: Xiao, Wenyi, et autres
Publié: (2025) -
Detecting and Mitigating Hallucination in Large Vision Language Models via Fine-Grained AI Feedback
par: Xiao, Wenyi, et autres
Publié: (2024) -
Prompt4Trust: A Reinforcement Learning Prompt Augmentation Framework for Clinically-Aligned Confidence Calibration in Multimodal Large Language Models
par: Kriz, Anita, et autres
Publié: (2025) -
MathCoder-VL: Bridging Vision and Code for Enhanced Multimodal Mathematical Reasoning
par: Wang, Ke, et autres
Publié: (2025) -
Object-Level Verbalized Confidence Calibration in Vision-Language Models via Semantic Perturbation
par: Zhao, Yunpu, et autres
Publié: (2025)