MirageBackdoor: A Stealthy Attack that Induces Think-Well-Answer-Wrong Reasoning
Fuente:
arXiv
Salvato in:
| Autori principali: | Zeng, Yizhe, Zhang, Wei, Li, Yunpeng, Xiao, Juxin, Wang, Xiao, Liu, Yuling |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Stealthy Targeted Backdoor Attacks against Image Captioning
di: Fan, Wenshu, et al.
Pubblicazione: (2024)
di: Fan, Wenshu, et al.
Pubblicazione: (2024)
Stealthy Backdoor Attack via Confidence-driven Sampling
di: He, Pengfei, et al.
Pubblicazione: (2023)
di: He, Pengfei, et al.
Pubblicazione: (2023)
Stealthy Backdoor Attack to Real-world Models in Android Apps
di: Wei, Jiali, et al.
Pubblicazione: (2025)
di: Wei, Jiali, et al.
Pubblicazione: (2025)
ReasoningBomb: A Stealthy Denial-of-Service Attack by Inducing Pathologically Long Reasoning in Large Reasoning Models
di: Liu, Xiaogeng, et al.
Pubblicazione: (2026)
di: Liu, Xiaogeng, et al.
Pubblicazione: (2026)
Towards Stealthy and Effective Backdoor Attacks on Lane Detection: A Naturalistic Data Poisoning Approach
di: Liao, Yifan, et al.
Pubblicazione: (2025)
di: Liao, Yifan, et al.
Pubblicazione: (2025)
Large Language Models are Good Attackers: Efficient and Stealthy Textual Backdoor Attacks
di: Li, Ziqiang, et al.
Pubblicazione: (2024)
di: Li, Ziqiang, et al.
Pubblicazione: (2024)
SSD: A State-based Stealthy Backdoor Attack For Navigation System in UAV Route Planning
di: Wang, Zhaoxuan, et al.
Pubblicazione: (2025)
di: Wang, Zhaoxuan, et al.
Pubblicazione: (2025)
DSBA: Dynamic Stealthy Backdoor Attack with Collaborative Optimization in Self-Supervised Learning
di: Wang, Jiayao, et al.
Pubblicazione: (2026)
di: Wang, Jiayao, et al.
Pubblicazione: (2026)
Lurking in the shadows: Unveiling Stealthy Backdoor Attacks against Personalized Federated Learning
di: Lyu, Xiaoting, et al.
Pubblicazione: (2024)
di: Lyu, Xiaoting, et al.
Pubblicazione: (2024)
Exposing Vulnerabilities in RL: A Novel Stealthy Backdoor Attack through Reward Poisoning
di: Zhang, Bokang, et al.
Pubblicazione: (2025)
di: Zhang, Bokang, et al.
Pubblicazione: (2025)
Dullahan: Stealthy Backdoor Attack against Without-Label-Sharing Split Learning
di: Pu, Yuwen, et al.
Pubblicazione: (2024)
di: Pu, Yuwen, et al.
Pubblicazione: (2024)
Stealthy Backdoor Attacks against LLMs Based on Natural Style Triggers
di: Wei, Jiali, et al.
Pubblicazione: (2026)
di: Wei, Jiali, et al.
Pubblicazione: (2026)
Stealthy Yet Effective: Distribution-Preserving Backdoor Attacks on Graph Classification
di: Wang, Xiaobao, et al.
Pubblicazione: (2025)
di: Wang, Xiaobao, et al.
Pubblicazione: (2025)
Stealthy and Adjustable Text-Guided Backdoor Attacks on Multimodal Pretrained Models
di: Zhang, Yiyang, et al.
Pubblicazione: (2026)
di: Zhang, Yiyang, et al.
Pubblicazione: (2026)
SteganoBackdoor: Stealthy and Data-Efficient Backdoor Attacks on Language Models
di: Xue, Eric, et al.
Pubblicazione: (2025)
di: Xue, Eric, et al.
Pubblicazione: (2025)
ShadowCoT: Cognitive Hijacking for Stealthy Reasoning Backdoors in LLMs
di: Zhao, Gejian, et al.
Pubblicazione: (2025)
di: Zhao, Gejian, et al.
Pubblicazione: (2025)
Towards Effective, Stealthy, and Persistent Backdoor Attacks Targeting Graph Foundation Models
di: Luo, Jiayi, et al.
Pubblicazione: (2025)
di: Luo, Jiayi, et al.
Pubblicazione: (2025)
SNEAKDOOR: Stealthy Backdoor Attacks against Distribution Matching-based Dataset Condensation
di: Yang, He, et al.
Pubblicazione: (2026)
di: Yang, He, et al.
Pubblicazione: (2026)
DOPA: Stealthy and Generalizable Backdoor Attacks from a Single Client under Challenging Federated Constraints
di: Qin, Xuezheng, et al.
Pubblicazione: (2025)
di: Qin, Xuezheng, et al.
Pubblicazione: (2025)
Cuckoo Attack: Stealthy and Persistent Attacks Against AI-IDE
di: Liu, Xinpeng, et al.
Pubblicazione: (2025)
di: Liu, Xinpeng, et al.
Pubblicazione: (2025)
FlowMur: A Stealthy and Practical Audio Backdoor Attack with Limited Knowledge
di: Lan, Jiahe, et al.
Pubblicazione: (2023)
di: Lan, Jiahe, et al.
Pubblicazione: (2023)
Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation
di: Zhong, Zhiyuan, et al.
Pubblicazione: (2025)
di: Zhong, Zhiyuan, et al.
Pubblicazione: (2025)
When LLMs Copy to Think: Uncovering Copy-Guided Attacks in Reasoning LLMs
di: Li, Yue, et al.
Pubblicazione: (2025)
di: Li, Yue, et al.
Pubblicazione: (2025)
Stealthy Dual-Trigger Backdoors: Attacking Prompt Tuning in LM-Empowered Graph Foundation Models
di: Xue, Xiaoyu, et al.
Pubblicazione: (2025)
di: Xue, Xiaoyu, et al.
Pubblicazione: (2025)
PASTA: A Patch-Agnostic Twofold-Stealthy Backdoor Attack on Vision Transformers
di: Liu, Dazhuang, et al.
Pubblicazione: (2026)
di: Liu, Dazhuang, et al.
Pubblicazione: (2026)
Spa-VLM: Stealthy Poisoning Attacks on RAG-based VLM
di: Yu, Lei, et al.
Pubblicazione: (2025)
di: Yu, Lei, et al.
Pubblicazione: (2025)
SDBA: A Stealthy and Long-Lasting Durable Backdoor Attack in Federated Learning
di: Choe, Minyeong, et al.
Pubblicazione: (2024)
di: Choe, Minyeong, et al.
Pubblicazione: (2024)
A Spatiotemporal Stealthy Backdoor Attack against Cooperative Multi-Agent Deep Reinforcement Learning
di: Yu, Yinbo, et al.
Pubblicazione: (2024)
di: Yu, Yinbo, et al.
Pubblicazione: (2024)
Towards Backdoor Stealthiness in Model Parameter Space
di: Xu, Xiaoyun, et al.
Pubblicazione: (2025)
di: Xu, Xiaoyun, et al.
Pubblicazione: (2025)
State Backdoor: Towards Stealthy Real-world Poisoning Attack on Vision-Language-Action Model in State Space
di: Guo, Ji, et al.
Pubblicazione: (2026)
di: Guo, Ji, et al.
Pubblicazione: (2026)
UAV Resilience Against Stealthy Attacks
di: Amorim, Arthur, et al.
Pubblicazione: (2025)
di: Amorim, Arthur, et al.
Pubblicazione: (2025)
SilentDrift: Exploiting Action Chunking for Stealthy Backdoor Attacks on Vision-Language-Action Models
di: Xu, Bingxin, et al.
Pubblicazione: (2026)
di: Xu, Bingxin, et al.
Pubblicazione: (2026)
Invisibility Cloak: Disappearance under Human Pose Estimation via Backdoor Attacks
di: Zhang, Minxing, et al.
Pubblicazione: (2024)
di: Zhang, Minxing, et al.
Pubblicazione: (2024)
Activation Gradient based Poisoned Sample Detection Against Backdoor Attacks
di: Yuan, Danni, et al.
Pubblicazione: (2023)
di: Yuan, Danni, et al.
Pubblicazione: (2023)
Sensor Deprivation Attacks for Stealthy UAV Manipulation
di: Erba, Alessandro, et al.
Pubblicazione: (2024)
di: Erba, Alessandro, et al.
Pubblicazione: (2024)
A Stealthy Wrongdoer: Feature-Oriented Reconstruction Attack against Split Learning
di: Xu, Xiaoyang, et al.
Pubblicazione: (2024)
di: Xu, Xiaoyang, et al.
Pubblicazione: (2024)
Mirage: Defense against CrossPath Attacks in Software Defined Networks
di: Murtuza, Shariq, et al.
Pubblicazione: (2024)
di: Murtuza, Shariq, et al.
Pubblicazione: (2024)
Under-confidence Backdoors Are Resilient and Stealthy Backdoors
di: Peng, Minlong, et al.
Pubblicazione: (2022)
di: Peng, Minlong, et al.
Pubblicazione: (2022)
VIMU: Effective Physics-based Realtime Detection and Recovery against Stealthy Attacks on UAVs
di: Wang, Yunbo, et al.
Pubblicazione: (2025)
di: Wang, Yunbo, et al.
Pubblicazione: (2025)
Compiling Activation Steering into Weights via Null-Space Constraints for Stealthy Backdoors
di: Yin, Rui, et al.
Pubblicazione: (2026)
di: Yin, Rui, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Stealthy Targeted Backdoor Attacks against Image Captioning
di: Fan, Wenshu, et al.
Pubblicazione: (2024) -
Stealthy Backdoor Attack via Confidence-driven Sampling
di: He, Pengfei, et al.
Pubblicazione: (2023) -
Stealthy Backdoor Attack to Real-world Models in Android Apps
di: Wei, Jiali, et al.
Pubblicazione: (2025) -
ReasoningBomb: A Stealthy Denial-of-Service Attack by Inducing Pathologically Long Reasoning in Large Reasoning Models
di: Liu, Xiaogeng, et al.
Pubblicazione: (2026) -
Towards Stealthy and Effective Backdoor Attacks on Lane Detection: A Naturalistic Data Poisoning Approach
di: Liao, Yifan, et al.
Pubblicazione: (2025)