PENDULUM: A Benchmark for Assessing Sycophancy in Multimodal Large Language Models
Fuente:
arXiv
Saved in:
| Main Authors: | Rahman, A. B. M. Ashikur, Anwar, Saeed, Usman, Muhammad, Ahmad, Irfan, Mian, Ajmal |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
DefAn: Definitive Answer Dataset for LLMs Hallucination Evaluation
by: Rahman, A B M Ashikur, et al.
Published: (2024)
by: Rahman, A B M Ashikur, et al.
Published: (2024)
Moral Sycophancy in Vision Language Models
by: Rabby, Shadman, et al.
Published: (2026)
by: Rabby, Shadman, et al.
Published: (2026)
Multistream Network for LiDAR and Camera-based 3D Object Detection in Outdoor Scenes
by: Ibrahim, Muhammad, et al.
Published: (2025)
by: Ibrahim, Muhammad, et al.
Published: (2025)
Visual Attention Methods in Deep Learning: An In-Depth Survey
by: Hassanin, Mohammed, et al.
Published: (2022)
by: Hassanin, Mohammed, et al.
Published: (2022)
Not Your Typical Sycophant: The Elusive Nature of Sycophancy in Large Language Models
by: Natan, Shahar Ben, et al.
Published: (2026)
by: Natan, Shahar Ben, et al.
Published: (2026)
EchoBench: Benchmarking Sycophancy in Medical Large Vision-Language Models
by: Yuan, Botai, et al.
Published: (2025)
by: Yuan, Botai, et al.
Published: (2025)
Image Colorization: A Survey and Dataset
by: Anwar, Saeed, et al.
Published: (2020)
by: Anwar, Saeed, et al.
Published: (2020)
Sycophancy in Large Language Models: Causes and Mitigations
by: Malmqvist, Lars
Published: (2024)
by: Malmqvist, Lars
Published: (2024)
Pressure, What Pressure? Sycophancy Disentanglement in Language Models via Reward Decomposition
by: Mohsin, Muhammad Ahmed, et al.
Published: (2026)
by: Mohsin, Muhammad Ahmed, et al.
Published: (2026)
When Helpfulness Becomes Sycophancy: Sycophancy is a Boundary Failure Between Social Alignment and Epistemic Integrity in Large Language Models
by: Li, Jiechen, et al.
Published: (2026)
by: Li, Jiechen, et al.
Published: (2026)
Benchmarking and Mitigating Sycophancy in Medical Vision Language Models
by: Xu, Juangui, et al.
Published: (2025)
by: Xu, Juangui, et al.
Published: (2025)
To Agree or To Be Right? The Grounding-Sycophancy Tradeoff in Medical Vision-Language Models
by: Aranya, OFM Riaz Rahman, et al.
Published: (2026)
by: Aranya, OFM Riaz Rahman, et al.
Published: (2026)
MSRNet: A Multi-Scale Recursive Network for Camouflaged Object Detection
by: Alghamdi, Leena, et al.
Published: (2025)
by: Alghamdi, Leena, et al.
Published: (2025)
A Backdoor-based Explainable AI Benchmark for High Fidelity Evaluation of Attributions
by: Yang, Peiyu, et al.
Published: (2024)
by: Yang, Peiyu, et al.
Published: (2024)
Deep Models for Multi-View 3D Object Recognition: A Review
by: Alzahrani, Mona, et al.
Published: (2024)
by: Alzahrani, Mona, et al.
Published: (2024)
Sycophancy to Subterfuge: Investigating Reward-Tampering in Large Language Models
by: Denison, Carson, et al.
Published: (2024)
by: Denison, Carson, et al.
Published: (2024)
Auto-Regressive Diffusion for Generating 3D Human-Object Interactions
by: Geng, Zichen, et al.
Published: (2025)
by: Geng, Zichen, et al.
Published: (2025)
Sycophancy is an Educational Safety Risk: Why LLM Tutors Need Sycophancy Benchmarks
by: Kasneci, Enkelejda, et al.
Published: (2026)
by: Kasneci, Enkelejda, et al.
Published: (2026)
FastBO: Fast HPO and NAS with Adaptive Fidelity Identification
by: Jiang, Jiantong, et al.
Published: (2024)
by: Jiang, Jiantong, et al.
Published: (2024)
ProToken: Token-Level Attribution for Federated Large Language Models
by: Gill, Waris, et al.
Published: (2026)
by: Gill, Waris, et al.
Published: (2026)
PsOCR: Benchmarking Large Multimodal Models for Optical Character Recognition in Low-resource Pashto Language
by: Haq, Ijazul, et al.
Published: (2025)
by: Haq, Ijazul, et al.
Published: (2025)
Attention Down-Sampling Transformer, Relative Ranking and Self-Consistency for Blind Image Quality Assessment
by: Alsaafin, Mohammed, et al.
Published: (2024)
by: Alsaafin, Mohammed, et al.
Published: (2024)
Bird Eye-View to Street-View: A Survey
by: Bajbaa, Khawlah, et al.
Published: (2024)
by: Bajbaa, Khawlah, et al.
Published: (2024)
Beacon: Single-Turn Diagnosis and Mitigation of Latent Sycophancy in Large Language Models
by: Pandey, Sanskar, et al.
Published: (2025)
by: Pandey, Sanskar, et al.
Published: (2025)
A Comprehensive Overview of Large Language Models
by: Naveed, Humza, et al.
Published: (2023)
by: Naveed, Humza, et al.
Published: (2023)
Peacock: A Family of Arabic Multimodal Large Language Models and Benchmarks
by: Alwajih, Fakhraddin, et al.
Published: (2024)
by: Alwajih, Fakhraddin, et al.
Published: (2024)
Regulating Model Reliance on Non-Robust Features by Smoothing Input Marginal Density
by: Yang, Peiyu, et al.
Published: (2024)
by: Yang, Peiyu, et al.
Published: (2024)
Islamic Chatbots in the Age of Large Language Models
by: Ahmad, Muhammad Aurangzeb
Published: (2025)
by: Ahmad, Muhammad Aurangzeb
Published: (2025)
Causal Reinforcement Learning for Complex Card Games: A Magic The Gathering Benchmark
by: Cunha, Cristiano da Costa, et al.
Published: (2026)
by: Cunha, Cristiano da Costa, et al.
Published: (2026)
Skip Mamba Diffusion for Monocular 3D Semantic Scene Completion
by: Liang, Li, et al.
Published: (2025)
by: Liang, Li, et al.
Published: (2025)
Benchmark for Assessing Olfactory Perception of Large Language Models
by: Makri, Eftychia, et al.
Published: (2026)
by: Makri, Eftychia, et al.
Published: (2026)
AgriChat: A Multimodal Large Language Model for Agriculture Image Understanding
by: Boudiaf, Abderrahmene, et al.
Published: (2026)
by: Boudiaf, Abderrahmene, et al.
Published: (2026)
Multilingual Hate Speech Detection in Social Media Using Translation-Based Approaches with Large Language Models
by: Usman, Muhammad, et al.
Published: (2025)
by: Usman, Muhammad, et al.
Published: (2025)
Manipulating and Mitigating Generative Model Biases without Retraining
by: Vice, Jordan, et al.
Published: (2024)
by: Vice, Jordan, et al.
Published: (2024)
Assessing Modality Bias in Video Question Answering Benchmarks with Multimodal Large Language Models
by: Park, Jean, et al.
Published: (2024)
by: Park, Jean, et al.
Published: (2024)
Exploring Bias in over 100 Text-to-Image Generative Models
by: Vice, Jordan, et al.
Published: (2025)
by: Vice, Jordan, et al.
Published: (2025)
Beyond Dominant Patches: Spatial Credit Redistribution For Grounded Vision-Language Models
by: Samin, Niamul Hassan, et al.
Published: (2026)
by: Samin, Niamul Hassan, et al.
Published: (2026)
Under Pressure: Emotional Framing Induces Measurable Behavioral Shifts and Structured Internal Geometry in Small Language Models
by: Usman, Rana Muhammad
Published: (2026)
by: Usman, Rana Muhammad
Published: (2026)
Accounting for Sycophancy in Language Model Uncertainty Estimation
by: Sicilia, Anthony, et al.
Published: (2024)
by: Sicilia, Anthony, et al.
Published: (2024)
Towards Understanding Sycophancy in Language Models
by: Sharma, Mrinank, et al.
Published: (2023)
by: Sharma, Mrinank, et al.
Published: (2023)
Similar Items
-
DefAn: Definitive Answer Dataset for LLMs Hallucination Evaluation
by: Rahman, A B M Ashikur, et al.
Published: (2024) -
Moral Sycophancy in Vision Language Models
by: Rabby, Shadman, et al.
Published: (2026) -
Multistream Network for LiDAR and Camera-based 3D Object Detection in Outdoor Scenes
by: Ibrahim, Muhammad, et al.
Published: (2025) -
Visual Attention Methods in Deep Learning: An In-Depth Survey
by: Hassanin, Mohammed, et al.
Published: (2022) -
Not Your Typical Sycophant: The Elusive Nature of Sycophancy in Large Language Models
by: Natan, Shahar Ben, et al.
Published: (2026)