Tone Matters: The Impact of Linguistic Tone on Hallucination in VLMs
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Hong, Weihao, Jiang, Zhiyuan, Shen, Bingyu, Guan, Xinlei, Feng, Yangyi, Xu, Meng, Li, Boyang |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
LLM-as-Judge Framework for Evaluating Tone-Induced Hallucination in Vision-Language Models
par: Jiang, Zhiyuan, et autres
Publié: (2026)
par: Jiang, Zhiyuan, et autres
Publié: (2026)
Padding Tone: A Mechanistic Analysis of Padding Tokens in T2I Models
par: Toker, Michael, et autres
Publié: (2025)
par: Toker, Michael, et autres
Publié: (2025)
Preserving Multi-Modal Capabilities of Pre-trained VLMs for Improving Vision-Linguistic Compositionality
par: Oh, Youngtaek, et autres
Publié: (2024)
par: Oh, Youngtaek, et autres
Publié: (2024)
Modeling Image Tone Dichotomy with the Power Function
par: Martinez, Axel, et autres
Publié: (2024)
par: Martinez, Axel, et autres
Publié: (2024)
RoadTones: Tone Controllable Text Generation from Road Event Videos
par: Parikh, Chirag, et autres
Publié: (2026)
par: Parikh, Chirag, et autres
Publié: (2026)
NoLan: Mitigating Object Hallucinations in Large Vision-Language Models via Dynamic Suppression of Language Priors
par: Ren, Lingfeng, et autres
Publié: (2026)
par: Ren, Lingfeng, et autres
Publié: (2026)
True to Tone? Quantifying Skin Tone Fidelity and Bias in Photographic-to-Virtual Human Pipelines
par: Schneider, Gabriel Ferri, et autres
Publié: (2026)
par: Schneider, Gabriel Ferri, et autres
Publié: (2026)
On the Perception Bottleneck of VLMs for Chart Understanding
par: Liu, Junteng, et autres
Publié: (2025)
par: Liu, Junteng, et autres
Publié: (2025)
A Framework for Portrait Stylization with Skin-Tone Awareness and Nudity Identification
par: Kim, Seungkwon, et autres
Publié: (2024)
par: Kim, Seungkwon, et autres
Publié: (2024)
Focus Matters: Phase-Aware Suppression for Hallucination in Vision-Language Models
par: Kim, Sohyeon, et autres
Publié: (2026)
par: Kim, Sohyeon, et autres
Publié: (2026)
Camera-Based Remote Physiology Sensing for Hundreds of Subjects Across Skin Tones
par: Tang, Jiankai, et autres
Publié: (2024)
par: Tang, Jiankai, et autres
Publié: (2024)
Scaling Agentic Reinforcement Learning for Tool-Integrated Reasoning in VLMs
par: Lu, Meng, et autres
Publié: (2025)
par: Lu, Meng, et autres
Publié: (2025)
Towards In-Context Tone Style Transfer with A Large-Scale Triplet Dataset
par: Deng, Yuhai, et autres
Publié: (2026)
par: Deng, Yuhai, et autres
Publié: (2026)
Leveraging NTPs for Efficient Hallucination Detection in VLMs
par: Azachi, Ofir, et autres
Publié: (2025)
par: Azachi, Ofir, et autres
Publié: (2025)
Taming Object Hallucinations with Verified Atomic Confidence Estimation
par: Liu, Jiarui, et autres
Publié: (2025)
par: Liu, Jiarui, et autres
Publié: (2025)
Quality-guided Skin Tone Enhancement for Portrait Photography
par: Gao, Shiqi, et autres
Publié: (2024)
par: Gao, Shiqi, et autres
Publié: (2024)
When VLMs Meet Image Classification: Test Sets Renovation via Missing Label Identification
par: Pang, Zirui, et autres
Publié: (2025)
par: Pang, Zirui, et autres
Publié: (2025)
Skin Cancer Machine Learning Model Tone Bias
par: Pope, James, et autres
Publié: (2024)
par: Pope, James, et autres
Publié: (2024)
TrustSkin: A Fairness Pipeline for Trustworthy Facial Affect Analysis Across Skin Tone
par: Cabanas, Ana M., et autres
Publié: (2025)
par: Cabanas, Ana M., et autres
Publié: (2025)
Investigating and Mitigating the Multimodal Hallucination Snowballing in Large Vision-Language Models
par: Zhong, Weihong, et autres
Publié: (2024)
par: Zhong, Weihong, et autres
Publié: (2024)
Have the VLMs Lost Confidence? A Study of Sycophancy in VLMs
par: Li, Shuo, et autres
Publié: (2024)
par: Li, Shuo, et autres
Publié: (2024)
iVISPAR -- An Interactive Visual-Spatial Reasoning Benchmark for VLMs
par: Mayer, Julius, et autres
Publié: (2025)
par: Mayer, Julius, et autres
Publié: (2025)
VisionFoundry: Teaching VLMs Visual Perception with Synthetic Images
par: Zhou, Guanyu, et autres
Publié: (2026)
par: Zhou, Guanyu, et autres
Publié: (2026)
Can VLMs Recall Factual Associations From Visual References?
par: Ashok, Dhananjay, et autres
Publié: (2025)
par: Ashok, Dhananjay, et autres
Publié: (2025)
Autoregressive Semantic Visual Reconstruction Helps VLMs Understand Better
par: Wang, Dianyi, et autres
Publié: (2025)
par: Wang, Dianyi, et autres
Publié: (2025)
Black-Box Visual Prompt Engineering for Mitigating Object Hallucination in Large Vision Language Models
par: Woo, Sangmin, et autres
Publié: (2025)
par: Woo, Sangmin, et autres
Publié: (2025)
MindGYM: What Matters in Question Synthesis for Thinking-Centric Fine-Tuning?
par: Xu, Zhe, et autres
Publié: (2025)
par: Xu, Zhe, et autres
Publié: (2025)
Consensus and Subjectivity of Skin Tone Annotation for ML Fairness
par: Schumann, Candice, et autres
Publié: (2023)
par: Schumann, Candice, et autres
Publié: (2023)
Multi-Object Hallucination in Vision-Language Models
par: Chen, Xuweiyi, et autres
Publié: (2024)
par: Chen, Xuweiyi, et autres
Publié: (2024)
SPARC: Separating Perception And Reasoning Circuits for Test-time Scaling of VLMs
par: Avogaro, Niccolo, et autres
Publié: (2026)
par: Avogaro, Niccolo, et autres
Publié: (2026)
BabyVLM: Data-Efficient Pretraining of VLMs Inspired by Infant Learning
par: Wang, Shengao, et autres
Publié: (2025)
par: Wang, Shengao, et autres
Publié: (2025)
Beyond Hallucinations: Enhancing LVLMs through Hallucination-Aware Direct Preference Optimization
par: Zhao, Zhiyuan, et autres
Publié: (2023)
par: Zhao, Zhiyuan, et autres
Publié: (2023)
Semantic Aware Diffusion Inverse Tone Mapping
par: Goswami, Abhishek, et autres
Publié: (2024)
par: Goswami, Abhishek, et autres
Publié: (2024)
GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs
par: Nguyen, Duy, et autres
Publié: (2025)
par: Nguyen, Duy, et autres
Publié: (2025)
MedObvious: Exposing the Medical Moravec's Paradox in VLMs via Clinical Triage
par: Khan, Ufaq, et autres
Publié: (2026)
par: Khan, Ufaq, et autres
Publié: (2026)
Mitigating Object Hallucinations in MLLMs via Multi-Frequency Perturbations
par: Li, Shuo, et autres
Publié: (2025)
par: Li, Shuo, et autres
Publié: (2025)
Treble Counterfactual VLMs: A Causal Approach to Hallucination
par: Li, Shawn, et autres
Publié: (2025)
par: Li, Shawn, et autres
Publié: (2025)
CLAIM: Mitigating Multilingual Object Hallucination in Large Vision-Language Models with Cross-Lingual Attention Intervention
par: Ye, Zekai, et autres
Publié: (2025)
par: Ye, Zekai, et autres
Publié: (2025)
Seeing Isn't Knowing: Do VLMs Know When Not to Answer Spatial Questions (and Why)?
par: Zhang, Yue, et autres
Publié: (2026)
par: Zhang, Yue, et autres
Publié: (2026)
Through the Lens of Contrast: Self-Improving Visual Reasoning in VLMs
par: Pan, Zhiyu, et autres
Publié: (2026)
par: Pan, Zhiyu, et autres
Publié: (2026)
Documents similaires
-
LLM-as-Judge Framework for Evaluating Tone-Induced Hallucination in Vision-Language Models
par: Jiang, Zhiyuan, et autres
Publié: (2026) -
Padding Tone: A Mechanistic Analysis of Padding Tokens in T2I Models
par: Toker, Michael, et autres
Publié: (2025) -
Preserving Multi-Modal Capabilities of Pre-trained VLMs for Improving Vision-Linguistic Compositionality
par: Oh, Youngtaek, et autres
Publié: (2024) -
Modeling Image Tone Dichotomy with the Power Function
par: Martinez, Axel, et autres
Publié: (2024) -
RoadTones: Tone Controllable Text Generation from Road Event Videos
par: Parikh, Chirag, et autres
Publié: (2026)