To Agree or To Be Right? The Grounding-Sycophancy Tradeoff in Medical Vision-Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Aranya, OFM Riaz Rahman, Desai, Kevin |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
TRACE: Temporal Radiology with Anatomical Change Explanation for Grounded X-ray Report Generation
par: Aranya, OFM Riaz Rahman, et autres
Publié: (2026)
par: Aranya, OFM Riaz Rahman, et autres
Publié: (2026)
SRA-Seg: Synthetic to Real Alignment for Semi-Supervised Medical Image Segmentation
par: Aranya, OFM Riaz Rahman, et autres
Publié: (2026)
par: Aranya, OFM Riaz Rahman, et autres
Publié: (2026)
Toward Faithful Segmentation Attribution via Benchmarking and Dual-Evidence Fusion
par: Sakib, Abu Noman Md, et autres
Publié: (2026)
par: Sakib, Abu Noman Md, et autres
Publié: (2026)
Benchmarking and Mitigating Sycophancy in Medical Vision Language Models
par: Xu, Juangui, et autres
Publié: (2025)
par: Xu, Juangui, et autres
Publié: (2025)
EchoBench: Benchmarking Sycophancy in Medical Large Vision-Language Models
par: Yuan, Botai, et autres
Publié: (2025)
par: Yuan, Botai, et autres
Publié: (2025)
Beyond Dominant Patches: Spatial Credit Redistribution For Grounded Vision-Language Models
par: Samin, Niamul Hassan, et autres
Publié: (2026)
par: Samin, Niamul Hassan, et autres
Publié: (2026)
ThermalTap: Passive Application Fingerprinting in VR Headsets via Thermal Side Channels
par: Akram, Mahsin Bin, et autres
Publié: (2026)
par: Akram, Mahsin Bin, et autres
Publié: (2026)
3DReasonKnee: Advancing Grounded Reasoning in Medical Vision Language Models
par: Sambara, Sraavya, et autres
Publié: (2025)
par: Sambara, Sraavya, et autres
Publié: (2025)
Step-Level Visual Grounding Faithfulness Predicts Out-of-Distribution Generalization in Long-Horizon Vision-Language Models
par: Rahman, Md Ashikur, et autres
Publié: (2026)
par: Rahman, Md Ashikur, et autres
Publié: (2026)
SycoPhantasy: Quantifying Sycophancy and Hallucination in Small Open Weight VLMs for Vision-Language Scoring of Fantasy Characters
par: Shah, Arya, et autres
Publié: (2026)
par: Shah, Arya, et autres
Publié: (2026)
Grounded Knowledge-Enhanced Medical Vision-Language Pre-training for Chest X-Ray
par: Deng, Qiao, et autres
Publié: (2024)
par: Deng, Qiao, et autres
Publié: (2024)
MedGround: Bridging the Evidence Gap in Medical Vision-Language Models with Verified Grounding Data
par: Zhang, Mengmeng, et autres
Publié: (2026)
par: Zhang, Mengmeng, et autres
Publié: (2026)
Are Large Vision Language Models Truly Grounded in Medical Images? Evidence from Italian Clinical Visual Question Answering
par: Felizzi, Federico, et autres
Publié: (2025)
par: Felizzi, Federico, et autres
Publié: (2025)
Context-Aware Semantic Segmentation: Enhancing Pixel-Level Understanding with Large Language Models for Advanced Vision Applications
par: Rahman, Ben
Publié: (2025)
par: Rahman, Ben
Publié: (2025)
GroundCount: Grounding Vision-Language Models with Object Detection for Mitigating Counting Hallucinations
par: Chen, Boyuan, et autres
Publié: (2026)
par: Chen, Boyuan, et autres
Publié: (2026)
Parameter-Efficient Fine-Tuning Medical Multimodal Large Language Models for Medical Visual Grounding
par: He, Jinlong, et autres
Publié: (2024)
par: He, Jinlong, et autres
Publié: (2024)
Towards GUI Agents: Vision-Language Diffusion Models for GUI Grounding
par: Kumbhar, Shrinidhi, et autres
Publié: (2026)
par: Kumbhar, Shrinidhi, et autres
Publié: (2026)
Leveraging Vision-Language Models for Visual Grounding and Analysis of Automotive UI
par: Ernhofer, Benjamin Raphael, et autres
Publié: (2025)
par: Ernhofer, Benjamin Raphael, et autres
Publié: (2025)
Enhancing the Safety of Medical Vision-Language Models by Synthetic Demonstrations
par: Xue, Zhiyu, et autres
Publié: (2025)
par: Xue, Zhiyu, et autres
Publié: (2025)
Temporally-Grounded Language Generation: A Benchmark for Real-Time Vision-Language Models
par: Yu, Keunwoo Peter, et autres
Publié: (2025)
par: Yu, Keunwoo Peter, et autres
Publié: (2025)
To See or To Please: Uncovering Visual Sycophancy and Split Beliefs in VLMs
par: Hong, Rui, et autres
Publié: (2026)
par: Hong, Rui, et autres
Publié: (2026)
Physically Grounded Vision-Language Models for Robotic Manipulation
par: Gao, Jensen, et autres
Publié: (2023)
par: Gao, Jensen, et autres
Publié: (2023)
Intersectional Fairness in Vision-Language Models for Medical Image Disease Classification
par: Zhang, Yupeng, et autres
Publié: (2025)
par: Zhang, Yupeng, et autres
Publié: (2025)
Medical Large Vision Language Models with Multi-Image Visual Ability
par: Yang, Xikai, et autres
Publié: (2025)
par: Yang, Xikai, et autres
Publié: (2025)
Enhancing Medical Large Vision-Language Models via Alignment Distillation
par: Chang, Aofei, et autres
Publié: (2025)
par: Chang, Aofei, et autres
Publié: (2025)
Molmo2: Open Weights and Data for Vision-Language Models with Video Understanding and Grounding
par: Clark, Christopher, et autres
Publié: (2026)
par: Clark, Christopher, et autres
Publié: (2026)
Prescribing the Right Remedy: Mitigating Hallucinations in Large Vision-Language Models via Targeted Instruction Tuning
par: Hu, Rui, et autres
Publié: (2024)
par: Hu, Rui, et autres
Publié: (2024)
CheXmix: Unified Generative Pretraining for Vision Language Models in Medical Imaging
par: Kumar, Ashwin, et autres
Publié: (2026)
par: Kumar, Ashwin, et autres
Publié: (2026)
Meta-Entity Driven Triplet Mining for Aligning Medical Vision-Language Models
par: Ozturk, Saban, et autres
Publié: (2025)
par: Ozturk, Saban, et autres
Publié: (2025)
VSF-Med:A Vulnerability Scoring Framework for Medical Vision-Language Models
par: Sadanandan, Binesh, et autres
Publié: (2025)
par: Sadanandan, Binesh, et autres
Publié: (2025)
Referring Expressions as a Lens into Spatial Language Grounding in Vision-Language Models
par: Tumu, Akshar, et autres
Publié: (2025)
par: Tumu, Akshar, et autres
Publié: (2025)
Flattery in Motion: Benchmarking and Analyzing Sycophancy in Video-LLMs
par: Zhou, Wenrui, et autres
Publié: (2025)
par: Zhou, Wenrui, et autres
Publié: (2025)
Point-It-Out: Benchmarking Embodied Reasoning for Vision Language Models in Multi-Stage Visual Grounding
par: Xue, Haotian, et autres
Publié: (2025)
par: Xue, Haotian, et autres
Publié: (2025)
ClinCoT: Clinical-Aware Visual Chain-of-Thought for Medical Vision Language Models
par: Liu, Xiwei, et autres
Publié: (2026)
par: Liu, Xiwei, et autres
Publié: (2026)
Is There Knowledge Left to Extract? Evidence of Fragility in Medically Fine-Tuned Vision-Language Models
par: McLaughlin, Oliver, et autres
Publié: (2026)
par: McLaughlin, Oliver, et autres
Publié: (2026)
Improving Medical Diagnostics with Vision-Language Models: Convex Hull-Based Uncertainty Analysis
par: Catak, Ferhat Ozgur, et autres
Publié: (2024)
par: Catak, Ferhat Ozgur, et autres
Publié: (2024)
MedHEval: Benchmarking Hallucinations and Mitigation Strategies in Medical Large Vision-Language Models
par: Chang, Aofei, et autres
Publié: (2025)
par: Chang, Aofei, et autres
Publié: (2025)
Bootstrapping Action-Grounded Visual Dynamics in Unified Vision-Language Models
par: Qiu, Yifu, et autres
Publié: (2025)
par: Qiu, Yifu, et autres
Publié: (2025)
ViGoR: Improving Visual Grounding of Large Vision Language Models with Fine-Grained Reward Modeling
par: Yan, Siming, et autres
Publié: (2024)
par: Yan, Siming, et autres
Publié: (2024)
ZonUI-3B: A Lightweight Vision-Language Model for Cross-Resolution GUI Grounding
par: Hsieh, ZongHan, et autres
Publié: (2025)
par: Hsieh, ZongHan, et autres
Publié: (2025)
Documents similaires
-
TRACE: Temporal Radiology with Anatomical Change Explanation for Grounded X-ray Report Generation
par: Aranya, OFM Riaz Rahman, et autres
Publié: (2026) -
SRA-Seg: Synthetic to Real Alignment for Semi-Supervised Medical Image Segmentation
par: Aranya, OFM Riaz Rahman, et autres
Publié: (2026) -
Toward Faithful Segmentation Attribution via Benchmarking and Dual-Evidence Fusion
par: Sakib, Abu Noman Md, et autres
Publié: (2026) -
Benchmarking and Mitigating Sycophancy in Medical Vision Language Models
par: Xu, Juangui, et autres
Publié: (2025) -
EchoBench: Benchmarking Sycophancy in Medical Large Vision-Language Models
par: Yuan, Botai, et autres
Publié: (2025)