ReasoningBomb: A Stealthy Denial-of-Service Attack by Inducing Pathologically Long Reasoning in Large Reasoning Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Liu, Xiaogeng, Wang, Xinyan, Zhang, Yechao, Kariyappa, Sanjay, Xiang, Chong, Chen, Muhao, Suh, G. Edward, Xiao, Chaowei |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
AutoDAN-Reasoning: Enhancing Strategies Exploration based Jailbreak Attacks with Test-Time Scaling
di: Liu, Xiaogeng, et al.
Pubblicazione: (2025)
di: Liu, Xiaogeng, et al.
Pubblicazione: (2025)
Mitigating Indirect Prompt Injection via Instruction-Following Intent Analysis
di: Kang, Mintong, et al.
Pubblicazione: (2025)
di: Kang, Mintong, et al.
Pubblicazione: (2025)
Architecting Secure AI Agents: Perspectives on System-Level Defenses Against Indirect Prompt Injection Attacks
di: Xiang, Chong, et al.
Pubblicazione: (2026)
di: Xiang, Chong, et al.
Pubblicazione: (2026)
AdaShield: Safeguarding Multimodal Large Language Models from Structure-based Attack via Adaptive Shield Prompting
di: Wang, Yu, et al.
Pubblicazione: (2024)
di: Wang, Yu, et al.
Pubblicazione: (2024)
MirageBackdoor: A Stealthy Attack that Induces Think-Well-Answer-Wrong Reasoning
di: Zeng, Yizhe, et al.
Pubblicazione: (2026)
di: Zeng, Yizhe, et al.
Pubblicazione: (2026)
ReasAlign: Reasoning Enhanced Safety Alignment against Prompt Injection Attack
di: Li, Hao, et al.
Pubblicazione: (2026)
di: Li, Hao, et al.
Pubblicazione: (2026)
RePD: Defending Jailbreak Attack through a Retrieval-based Prompt Decomposition Process
di: Wang, Peiran, et al.
Pubblicazione: (2024)
di: Wang, Peiran, et al.
Pubblicazione: (2024)
PRISM: Robust VLM Alignment with Principled Reasoning for Integrated Safety in Multimodality
di: Li, Nanxi, et al.
Pubblicazione: (2025)
di: Li, Nanxi, et al.
Pubblicazione: (2025)
Doxing via the Lens: Revealing Location-related Privacy Leakage on Multi-modal Large Reasoning Models
di: Luo, Weidi, et al.
Pubblicazione: (2025)
di: Luo, Weidi, et al.
Pubblicazione: (2025)
OET: Optimization-based prompt injection Evaluation Toolkit
di: Pan, Jinsheng, et al.
Pubblicazione: (2025)
di: Pan, Jinsheng, et al.
Pubblicazione: (2025)
FATH: Authentication-based Test-time Defense against Indirect Prompt Injection Attacks
di: Wang, Jiongxiao, et al.
Pubblicazione: (2024)
di: Wang, Jiongxiao, et al.
Pubblicazione: (2024)
Practical Reasoning Interruption Attacks on Reasoning Large Language Models
di: Cui, Yu, et al.
Pubblicazione: (2025)
di: Cui, Yu, et al.
Pubblicazione: (2025)
Spa-VLM: Stealthy Poisoning Attacks on RAG-based VLM
di: Yu, Lei, et al.
Pubblicazione: (2025)
di: Yu, Lei, et al.
Pubblicazione: (2025)
JailBreakV: A Benchmark for Assessing the Robustness of MultiModal Large Language Models against Jailbreak Attacks
di: Luo, Weidi, et al.
Pubblicazione: (2024)
di: Luo, Weidi, et al.
Pubblicazione: (2024)
ARMOR: Aligning Secure and Safe Large Language Models via Meticulous Reasoning
di: Zhao, Zhengyue, et al.
Pubblicazione: (2025)
di: Zhao, Zhengyue, et al.
Pubblicazione: (2025)
LPG: Balancing Efficiency and Policy Reasoning in Latent Policy Guardrails
di: Li, Nanxi, et al.
Pubblicazione: (2026)
di: Li, Nanxi, et al.
Pubblicazione: (2026)
Denial-of-Service Poisoning Attacks against Large Language Models
di: Gao, Kuofeng, et al.
Pubblicazione: (2024)
di: Gao, Kuofeng, et al.
Pubblicazione: (2024)
Cyber Attack Mitigation Framework for Denial of Service (DoS) Attacks in Fog Computing
di: Khurshid, Fizza, et al.
Pubblicazione: (2025)
di: Khurshid, Fizza, et al.
Pubblicazione: (2025)
When Reasoning Leaks Membership: Membership Inference Attack on Black-box Large Reasoning Models
di: Hu, Ruihan, et al.
Pubblicazione: (2026)
di: Hu, Ruihan, et al.
Pubblicazione: (2026)
Excessive Reasoning Attack on Reasoning LLMs
di: Si, Wai Man, et al.
Pubblicazione: (2025)
di: Si, Wai Man, et al.
Pubblicazione: (2025)
Detection of Distributed Denial of Service Attacks based on Machine Learning Algorithms
di: Rahman, Md. Abdur
Pubblicazione: (2025)
di: Rahman, Md. Abdur
Pubblicazione: (2025)
Denial-of-Service Vulnerability of Hash-based Transaction Sharding: Attack and Countermeasure
di: Nguyen, Truc, et al.
Pubblicazione: (2020)
di: Nguyen, Truc, et al.
Pubblicazione: (2020)
Hoist with His Own Petard: Inducing Guardrails to Facilitate Denial-of-Service Attacks on Retrieval-Augmented Generation of LLMs
di: Suo, Pan, et al.
Pubblicazione: (2025)
di: Suo, Pan, et al.
Pubblicazione: (2025)
ShadowCoT: Cognitive Hijacking for Stealthy Reasoning Backdoors in LLMs
di: Zhao, Gejian, et al.
Pubblicazione: (2025)
di: Zhao, Gejian, et al.
Pubblicazione: (2025)
Don't Listen To Me: Understanding and Exploring Jailbreak Prompts of Large Language Models
di: Yu, Zhiyuan, et al.
Pubblicazione: (2024)
di: Yu, Zhiyuan, et al.
Pubblicazione: (2024)
Cooking Up Risks: Benchmarking and Reducing Food Safety Risks in Large Language Models
di: Luo, Weidi, et al.
Pubblicazione: (2026)
di: Luo, Weidi, et al.
Pubblicazione: (2026)
Topology-aware Detection and Localization of Distributed Denial-of-Service Attacks in Network-on-Chips
di: Weerasena, Hansika, et al.
Pubblicazione: (2025)
di: Weerasena, Hansika, et al.
Pubblicazione: (2025)
Efficient Denial of Service Attack Detection in IoT using Kolmogorov-Arnold Networks
di: Kuznetsov, Oleksandr
Pubblicazione: (2025)
di: Kuznetsov, Oleksandr
Pubblicazione: (2025)
Mind Your HEARTBEAT! Claw Background Execution Inherently Enables Silent Memory Pollution
di: Zhang, Yechao, et al.
Pubblicazione: (2026)
di: Zhang, Yechao, et al.
Pubblicazione: (2026)
Echoes within the Reasoning: Stealthy and Effective Watermarking via Chain of Thought
di: Lu, Jiacheng, et al.
Pubblicazione: (2026)
di: Lu, Jiacheng, et al.
Pubblicazione: (2026)
RLHFPoison: Reward Poisoning Attack for Reinforcement Learning with Human Feedback in Large Language Models
di: Wang, Jiongxiao, et al.
Pubblicazione: (2023)
di: Wang, Jiongxiao, et al.
Pubblicazione: (2023)
Reasoning Hijacking: The Fragility of Reasoning Alignment in Large Language Models
di: Liu, Yuansen, et al.
Pubblicazione: (2026)
di: Liu, Yuansen, et al.
Pubblicazione: (2026)
Stealthy Targeted Backdoor Attacks against Image Captioning
di: Fan, Wenshu, et al.
Pubblicazione: (2024)
di: Fan, Wenshu, et al.
Pubblicazione: (2024)
ExtendAttack: Attacking Servers of LRMs via Extending Reasoning
di: Zhu, Zhenhao, et al.
Pubblicazione: (2025)
di: Zhu, Zhenhao, et al.
Pubblicazione: (2025)
Reasoning-Style Poisoning of LLM Agents via Stealthy Style Transfer: Process-Level Attacks and Runtime Monitoring in RSV Space
di: Zhou, Xingfu, et al.
Pubblicazione: (2025)
di: Zhou, Xingfu, et al.
Pubblicazione: (2025)
Conflicts Make Large Reasoning Models Vulnerable to Attacks
di: Liu, Honghao, et al.
Pubblicazione: (2026)
di: Liu, Honghao, et al.
Pubblicazione: (2026)
Efficient and Stealthy Jailbreak Attacks via Adversarial Prompt Distillation from LLMs to SLMs
di: Li, Xiang, et al.
Pubblicazione: (2025)
di: Li, Xiang, et al.
Pubblicazione: (2025)
UAV Resilience Against Stealthy Attacks
di: Amorim, Arthur, et al.
Pubblicazione: (2025)
di: Amorim, Arthur, et al.
Pubblicazione: (2025)
RogueRFM: Attacking Refresh Management for Covert-Channel and Denial-of-Service
di: Taneja, Hritvik, et al.
Pubblicazione: (2025)
di: Taneja, Hritvik, et al.
Pubblicazione: (2025)
Rethinking Latency Denial-of-Service: Attacking the LLM Serving Framework, Not the Model
di: Wang, Tianyi, et al.
Pubblicazione: (2026)
di: Wang, Tianyi, et al.
Pubblicazione: (2026)
Documenti analoghi
-
AutoDAN-Reasoning: Enhancing Strategies Exploration based Jailbreak Attacks with Test-Time Scaling
di: Liu, Xiaogeng, et al.
Pubblicazione: (2025) -
Mitigating Indirect Prompt Injection via Instruction-Following Intent Analysis
di: Kang, Mintong, et al.
Pubblicazione: (2025) -
Architecting Secure AI Agents: Perspectives on System-Level Defenses Against Indirect Prompt Injection Attacks
di: Xiang, Chong, et al.
Pubblicazione: (2026) -
AdaShield: Safeguarding Multimodal Large Language Models from Structure-based Attack via Adaptive Shield Prompting
di: Wang, Yu, et al.
Pubblicazione: (2024) -
MirageBackdoor: A Stealthy Attack that Induces Think-Well-Answer-Wrong Reasoning
di: Zeng, Yizhe, et al.
Pubblicazione: (2026)