Benchmarking Gaslighting Negation Attacks Against Multimodal Large Language Models
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Zhu, Bin, Gui, Yinxuan, Qi, Huiyan, Chen, Jingjing, Ngo, Chong-Wah, Lim, Ee-Peng |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Benchmarking Gaslighting Attacks Against Speech Large Language Models
von: Wu, Jinyang, et al.
Veröffentlicht: (2025)
von: Wu, Jinyang, et al.
Veröffentlicht: (2025)
Benchmarking Gaslighting Negation Attacks Against Reasoning Models
von: Zhu, Bin, et al.
Veröffentlicht: (2025)
von: Zhu, Bin, et al.
Veröffentlicht: (2025)
Advancing Food Nutrition Estimation via Visual-Ingredient Feature Fusion
von: Qi, Huiyan, et al.
Veröffentlicht: (2025)
von: Qi, Huiyan, et al.
Veröffentlicht: (2025)
Spatiotemporal Sycophancy: Negation-Based Gaslighting in Video Large Language Models
von: Tang, Ziyao, et al.
Veröffentlicht: (2026)
von: Tang, Ziyao, et al.
Veröffentlicht: (2026)
Don't Deceive Me: Mitigating Gaslighting through Attention Reallocation in LMMs
von: Jiao, Pengkun, et al.
Veröffentlicht: (2025)
von: Jiao, Pengkun, et al.
Veröffentlicht: (2025)
Efficient Prompt Tuning for Hierarchical Ingredient Recognition
von: Gui, Yinxuan, et al.
Veröffentlicht: (2025)
von: Gui, Yinxuan, et al.
Veröffentlicht: (2025)
FoodLMM: A Versatile Food Assistant using Large Multi-modal Model
von: Yin, Yuehao, et al.
Veröffentlicht: (2023)
von: Yin, Yuehao, et al.
Veröffentlicht: (2023)
Seeing Culture: A Benchmark for Visual Reasoning and Grounding
von: Satar, Burak, et al.
Veröffentlicht: (2025)
von: Satar, Burak, et al.
Veröffentlicht: (2025)
Navigating Weight Prediction with Diet Diary
von: Gui, Yinxuan, et al.
Veröffentlicht: (2024)
von: Gui, Yinxuan, et al.
Veröffentlicht: (2024)
Enhancing Action and Ingredient Modeling for Semantically Grounded Recipe Generation
von: Liu, Guoshan, et al.
Veröffentlicht: (2026)
von: Liu, Guoshan, et al.
Veröffentlicht: (2026)
Towards Unbiased Cross-Modal Representation Learning for Food Image-to-Recipe Retrieval
von: Wang, Qing, et al.
Veröffentlicht: (2025)
von: Wang, Qing, et al.
Veröffentlicht: (2025)
Benchmarking and Defending Against Indirect Prompt Injection Attacks on Large Language Models
von: Yi, Jingwei, et al.
Veröffentlicht: (2023)
von: Yi, Jingwei, et al.
Veröffentlicht: (2023)
LLMs-based Augmentation for Domain Adaptation in Long-tailed Food Datasets
von: Wang, Qing, et al.
Veröffentlicht: (2025)
von: Wang, Qing, et al.
Veröffentlicht: (2025)
Mitigating Cross-modal Representation Bias for Multicultural Image-to-Recipe Retrieval
von: Wang, Qing, et al.
Veröffentlicht: (2025)
von: Wang, Qing, et al.
Veröffentlicht: (2025)
OVFoodSeg: Elevating Open-Vocabulary Food Image Segmentation via Image-Informed Textual Representation
von: Wu, Xiongwei, et al.
Veröffentlicht: (2024)
von: Wu, Xiongwei, et al.
Veröffentlicht: (2024)
A Multi-Stage Framework with Taxonomy-Guided Reasoning for Occupation Classification Using Large Language Models
von: Achananuparp, Palakorn, et al.
Veröffentlicht: (2025)
von: Achananuparp, Palakorn, et al.
Veröffentlicht: (2025)
Robustness of Large Language Models Against Adversarial Attacks
von: Tao, Yiyi, et al.
Veröffentlicht: (2024)
von: Tao, Yiyi, et al.
Veröffentlicht: (2024)
MHSafeEval: Role-Aware Interaction-Level Evaluation of Mental Health Safety in Large Language Models
von: Lee, Suhyun, et al.
Veröffentlicht: (2026)
von: Lee, Suhyun, et al.
Veröffentlicht: (2026)
RoDE: Linear Rectified Mixture of Diverse Experts for Food Large Multi-Modal Models
von: Jiao, Pengkun, et al.
Veröffentlicht: (2024)
von: Jiao, Pengkun, et al.
Veröffentlicht: (2024)
TransportationGames: Benchmarking Transportation Knowledge of (Multimodal) Large Language Models
von: Zhang, Xue, et al.
Veröffentlicht: (2024)
von: Zhang, Xue, et al.
Veröffentlicht: (2024)
JailbreakLens: Visual Analysis of Jailbreak Attacks Against Large Language Models
von: Feng, Yingchaojie, et al.
Veröffentlicht: (2024)
von: Feng, Yingchaojie, et al.
Veröffentlicht: (2024)
The Impact of Negated Text on Hallucination with Large Language Models
von: Seo, Jaehyung, et al.
Veröffentlicht: (2025)
von: Seo, Jaehyung, et al.
Veröffentlicht: (2025)
Leveraging Large Language Models for Career Mobility Analysis: A Study of Gender, Race, and Job Change Using U.S. Online Resume Profiles
von: Achananuparp, Palakorn, et al.
Veröffentlicht: (2025)
von: Achananuparp, Palakorn, et al.
Veröffentlicht: (2025)
Making Language Models Robust Against Negation
von: Rezaei, MohammadHossein, et al.
Veröffentlicht: (2025)
von: Rezaei, MohammadHossein, et al.
Veröffentlicht: (2025)
Prompt Stealing Attacks Against Large Language Models
von: Sha, Zeyang, et al.
Veröffentlicht: (2024)
von: Sha, Zeyang, et al.
Veröffentlicht: (2024)
Keep Security! Benchmarking Security Policy Preservation in Large Language Model Contexts Against Indirect Attacks in Question Answering
von: Chang, Hwan, et al.
Veröffentlicht: (2025)
von: Chang, Hwan, et al.
Veröffentlicht: (2025)
AttackEval: How to Evaluate the Effectiveness of Jailbreak Attacking on Large Language Models
von: Shu, Dong, et al.
Veröffentlicht: (2024)
von: Shu, Dong, et al.
Veröffentlicht: (2024)
The Whole is Better than the Sum: Using Aggregated Demonstrations in In-Context Learning for Sequential Recommendation
von: Wang, Lei, et al.
Veröffentlicht: (2024)
von: Wang, Lei, et al.
Veröffentlicht: (2024)
Defending Large Language Models Against Jailbreaking Attacks Through Goal Prioritization
von: Zhang, Zhexin, et al.
Veröffentlicht: (2023)
von: Zhang, Zhexin, et al.
Veröffentlicht: (2023)
Composite Backdoor Attacks Against Large Language Models
von: Huang, Hai, et al.
Veröffentlicht: (2023)
von: Huang, Hai, et al.
Veröffentlicht: (2023)
Adversarial Confusion Attack: Disrupting Multimodal Large Language Models
von: Hoscilowicz, Jakub, et al.
Veröffentlicht: (2025)
von: Hoscilowicz, Jakub, et al.
Veröffentlicht: (2025)
CFBenchmark-MM: Chinese Financial Assistant Benchmark for Multimodal Large Language Model
von: Li, Jiangtong, et al.
Veröffentlicht: (2025)
von: Li, Jiangtong, et al.
Veröffentlicht: (2025)
Benchmarking the Thinking Mode of Multimodal Large Language Models in Clinical Tasks
von: Hong, Jindong, et al.
Veröffentlicht: (2025)
von: Hong, Jindong, et al.
Veröffentlicht: (2025)
Target-driven Attack for Large Language Models
von: Zhang, Chong, et al.
Veröffentlicht: (2024)
von: Zhang, Chong, et al.
Veröffentlicht: (2024)
Jailbreak Attacks and Defenses Against Large Language Models: A Survey
von: Yi, Sibo, et al.
Veröffentlicht: (2024)
von: Yi, Sibo, et al.
Veröffentlicht: (2024)
CLASP: Defending Hybrid Large Language Models Against Hidden State Poisoning Attacks
von: Mercier, Alexandre Le, et al.
Veröffentlicht: (2026)
von: Mercier, Alexandre Le, et al.
Veröffentlicht: (2026)
AGENTIF: Benchmarking Instruction Following of Large Language Models in Agentic Scenarios
von: Qi, Yunjia, et al.
Veröffentlicht: (2025)
von: Qi, Yunjia, et al.
Veröffentlicht: (2025)
OFFSIDE: Benchmarking Unlearning Misinformation in Multimodal Large Language Models
von: Zheng, Hao, et al.
Veröffentlicht: (2025)
von: Zheng, Hao, et al.
Veröffentlicht: (2025)
MMRC: A Large-Scale Benchmark for Understanding Multimodal Large Language Model in Real-World Conversation
von: Xue, Haochen, et al.
Veröffentlicht: (2025)
von: Xue, Haochen, et al.
Veröffentlicht: (2025)
DeFrame: Debiasing Large Language Models Against Framing Effects
von: Lim, Kahee, et al.
Veröffentlicht: (2026)
von: Lim, Kahee, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
Benchmarking Gaslighting Attacks Against Speech Large Language Models
von: Wu, Jinyang, et al.
Veröffentlicht: (2025) -
Benchmarking Gaslighting Negation Attacks Against Reasoning Models
von: Zhu, Bin, et al.
Veröffentlicht: (2025) -
Advancing Food Nutrition Estimation via Visual-Ingredient Feature Fusion
von: Qi, Huiyan, et al.
Veröffentlicht: (2025) -
Spatiotemporal Sycophancy: Negation-Based Gaslighting in Video Large Language Models
von: Tang, Ziyao, et al.
Veröffentlicht: (2026) -
Don't Deceive Me: Mitigating Gaslighting through Attention Reallocation in LMMs
von: Jiao, Pengkun, et al.
Veröffentlicht: (2025)