Benchmarking Gaslighting Negation Attacks Against Multimodal Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhu, Bin, Gui, Yinxuan, Qi, Huiyan, Chen, Jingjing, Ngo, Chong-Wah, Lim, Ee-Peng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Benchmarking Gaslighting Attacks Against Speech Large Language Models
di: Wu, Jinyang, et al.
Pubblicazione: (2025)
di: Wu, Jinyang, et al.
Pubblicazione: (2025)
Benchmarking Gaslighting Negation Attacks Against Reasoning Models
di: Zhu, Bin, et al.
Pubblicazione: (2025)
di: Zhu, Bin, et al.
Pubblicazione: (2025)
Advancing Food Nutrition Estimation via Visual-Ingredient Feature Fusion
di: Qi, Huiyan, et al.
Pubblicazione: (2025)
di: Qi, Huiyan, et al.
Pubblicazione: (2025)
Spatiotemporal Sycophancy: Negation-Based Gaslighting in Video Large Language Models
di: Tang, Ziyao, et al.
Pubblicazione: (2026)
di: Tang, Ziyao, et al.
Pubblicazione: (2026)
Don't Deceive Me: Mitigating Gaslighting through Attention Reallocation in LMMs
di: Jiao, Pengkun, et al.
Pubblicazione: (2025)
di: Jiao, Pengkun, et al.
Pubblicazione: (2025)
Efficient Prompt Tuning for Hierarchical Ingredient Recognition
di: Gui, Yinxuan, et al.
Pubblicazione: (2025)
di: Gui, Yinxuan, et al.
Pubblicazione: (2025)
FoodLMM: A Versatile Food Assistant using Large Multi-modal Model
di: Yin, Yuehao, et al.
Pubblicazione: (2023)
di: Yin, Yuehao, et al.
Pubblicazione: (2023)
Seeing Culture: A Benchmark for Visual Reasoning and Grounding
di: Satar, Burak, et al.
Pubblicazione: (2025)
di: Satar, Burak, et al.
Pubblicazione: (2025)
Navigating Weight Prediction with Diet Diary
di: Gui, Yinxuan, et al.
Pubblicazione: (2024)
di: Gui, Yinxuan, et al.
Pubblicazione: (2024)
Enhancing Action and Ingredient Modeling for Semantically Grounded Recipe Generation
di: Liu, Guoshan, et al.
Pubblicazione: (2026)
di: Liu, Guoshan, et al.
Pubblicazione: (2026)
Towards Unbiased Cross-Modal Representation Learning for Food Image-to-Recipe Retrieval
di: Wang, Qing, et al.
Pubblicazione: (2025)
di: Wang, Qing, et al.
Pubblicazione: (2025)
Benchmarking and Defending Against Indirect Prompt Injection Attacks on Large Language Models
di: Yi, Jingwei, et al.
Pubblicazione: (2023)
di: Yi, Jingwei, et al.
Pubblicazione: (2023)
LLMs-based Augmentation for Domain Adaptation in Long-tailed Food Datasets
di: Wang, Qing, et al.
Pubblicazione: (2025)
di: Wang, Qing, et al.
Pubblicazione: (2025)
Mitigating Cross-modal Representation Bias for Multicultural Image-to-Recipe Retrieval
di: Wang, Qing, et al.
Pubblicazione: (2025)
di: Wang, Qing, et al.
Pubblicazione: (2025)
OVFoodSeg: Elevating Open-Vocabulary Food Image Segmentation via Image-Informed Textual Representation
di: Wu, Xiongwei, et al.
Pubblicazione: (2024)
di: Wu, Xiongwei, et al.
Pubblicazione: (2024)
A Multi-Stage Framework with Taxonomy-Guided Reasoning for Occupation Classification Using Large Language Models
di: Achananuparp, Palakorn, et al.
Pubblicazione: (2025)
di: Achananuparp, Palakorn, et al.
Pubblicazione: (2025)
Robustness of Large Language Models Against Adversarial Attacks
di: Tao, Yiyi, et al.
Pubblicazione: (2024)
di: Tao, Yiyi, et al.
Pubblicazione: (2024)
MHSafeEval: Role-Aware Interaction-Level Evaluation of Mental Health Safety in Large Language Models
di: Lee, Suhyun, et al.
Pubblicazione: (2026)
di: Lee, Suhyun, et al.
Pubblicazione: (2026)
RoDE: Linear Rectified Mixture of Diverse Experts for Food Large Multi-Modal Models
di: Jiao, Pengkun, et al.
Pubblicazione: (2024)
di: Jiao, Pengkun, et al.
Pubblicazione: (2024)
TransportationGames: Benchmarking Transportation Knowledge of (Multimodal) Large Language Models
di: Zhang, Xue, et al.
Pubblicazione: (2024)
di: Zhang, Xue, et al.
Pubblicazione: (2024)
JailbreakLens: Visual Analysis of Jailbreak Attacks Against Large Language Models
di: Feng, Yingchaojie, et al.
Pubblicazione: (2024)
di: Feng, Yingchaojie, et al.
Pubblicazione: (2024)
The Impact of Negated Text on Hallucination with Large Language Models
di: Seo, Jaehyung, et al.
Pubblicazione: (2025)
di: Seo, Jaehyung, et al.
Pubblicazione: (2025)
Leveraging Large Language Models for Career Mobility Analysis: A Study of Gender, Race, and Job Change Using U.S. Online Resume Profiles
di: Achananuparp, Palakorn, et al.
Pubblicazione: (2025)
di: Achananuparp, Palakorn, et al.
Pubblicazione: (2025)
Making Language Models Robust Against Negation
di: Rezaei, MohammadHossein, et al.
Pubblicazione: (2025)
di: Rezaei, MohammadHossein, et al.
Pubblicazione: (2025)
Prompt Stealing Attacks Against Large Language Models
di: Sha, Zeyang, et al.
Pubblicazione: (2024)
di: Sha, Zeyang, et al.
Pubblicazione: (2024)
Keep Security! Benchmarking Security Policy Preservation in Large Language Model Contexts Against Indirect Attacks in Question Answering
di: Chang, Hwan, et al.
Pubblicazione: (2025)
di: Chang, Hwan, et al.
Pubblicazione: (2025)
AttackEval: How to Evaluate the Effectiveness of Jailbreak Attacking on Large Language Models
di: Shu, Dong, et al.
Pubblicazione: (2024)
di: Shu, Dong, et al.
Pubblicazione: (2024)
The Whole is Better than the Sum: Using Aggregated Demonstrations in In-Context Learning for Sequential Recommendation
di: Wang, Lei, et al.
Pubblicazione: (2024)
di: Wang, Lei, et al.
Pubblicazione: (2024)
Defending Large Language Models Against Jailbreaking Attacks Through Goal Prioritization
di: Zhang, Zhexin, et al.
Pubblicazione: (2023)
di: Zhang, Zhexin, et al.
Pubblicazione: (2023)
Composite Backdoor Attacks Against Large Language Models
di: Huang, Hai, et al.
Pubblicazione: (2023)
di: Huang, Hai, et al.
Pubblicazione: (2023)
Adversarial Confusion Attack: Disrupting Multimodal Large Language Models
di: Hoscilowicz, Jakub, et al.
Pubblicazione: (2025)
di: Hoscilowicz, Jakub, et al.
Pubblicazione: (2025)
CFBenchmark-MM: Chinese Financial Assistant Benchmark for Multimodal Large Language Model
di: Li, Jiangtong, et al.
Pubblicazione: (2025)
di: Li, Jiangtong, et al.
Pubblicazione: (2025)
Benchmarking the Thinking Mode of Multimodal Large Language Models in Clinical Tasks
di: Hong, Jindong, et al.
Pubblicazione: (2025)
di: Hong, Jindong, et al.
Pubblicazione: (2025)
Target-driven Attack for Large Language Models
di: Zhang, Chong, et al.
Pubblicazione: (2024)
di: Zhang, Chong, et al.
Pubblicazione: (2024)
Jailbreak Attacks and Defenses Against Large Language Models: A Survey
di: Yi, Sibo, et al.
Pubblicazione: (2024)
di: Yi, Sibo, et al.
Pubblicazione: (2024)
CLASP: Defending Hybrid Large Language Models Against Hidden State Poisoning Attacks
di: Mercier, Alexandre Le, et al.
Pubblicazione: (2026)
di: Mercier, Alexandre Le, et al.
Pubblicazione: (2026)
AGENTIF: Benchmarking Instruction Following of Large Language Models in Agentic Scenarios
di: Qi, Yunjia, et al.
Pubblicazione: (2025)
di: Qi, Yunjia, et al.
Pubblicazione: (2025)
OFFSIDE: Benchmarking Unlearning Misinformation in Multimodal Large Language Models
di: Zheng, Hao, et al.
Pubblicazione: (2025)
di: Zheng, Hao, et al.
Pubblicazione: (2025)
MMRC: A Large-Scale Benchmark for Understanding Multimodal Large Language Model in Real-World Conversation
di: Xue, Haochen, et al.
Pubblicazione: (2025)
di: Xue, Haochen, et al.
Pubblicazione: (2025)
DeFrame: Debiasing Large Language Models Against Framing Effects
di: Lim, Kahee, et al.
Pubblicazione: (2026)
di: Lim, Kahee, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Benchmarking Gaslighting Attacks Against Speech Large Language Models
di: Wu, Jinyang, et al.
Pubblicazione: (2025) -
Benchmarking Gaslighting Negation Attacks Against Reasoning Models
di: Zhu, Bin, et al.
Pubblicazione: (2025) -
Advancing Food Nutrition Estimation via Visual-Ingredient Feature Fusion
di: Qi, Huiyan, et al.
Pubblicazione: (2025) -
Spatiotemporal Sycophancy: Negation-Based Gaslighting in Video Large Language Models
di: Tang, Ziyao, et al.
Pubblicazione: (2026) -
Don't Deceive Me: Mitigating Gaslighting through Attention Reallocation in LMMs
di: Jiao, Pengkun, et al.
Pubblicazione: (2025)