Thought Purity: A Defense Framework For Chain-of-Thought Attack
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Xue, Zihao, Bi, Zhen, Ma, Long, Hu, Zhenlin, Wang, Yan, Chen, Xueshu, Liu, Zhenfang, Zhao, Kang, Xiao, Jie, Lou, Jungang |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Thought-Transfer: Indirect Targeted Poisoning Attacks on Chain-of-Thought Reasoning Models
par: Chaudhari, Harsh, et autres
Publié: (2026)
par: Chaudhari, Harsh, et autres
Publié: (2026)
Chain-of-Thought Prompting of Large Language Models for Discovering and Fixing Software Vulnerabilities
par: Nong, Yu, et autres
Publié: (2024)
par: Nong, Yu, et autres
Publié: (2024)
Preemptive Answer "Attacks" on Chain-of-Thought Reasoning
par: Xu, Rongwu, et autres
Publié: (2024)
par: Xu, Rongwu, et autres
Publié: (2024)
BadChain: Backdoor Chain-of-Thought Prompting for Large Language Models
par: Xiang, Zhen, et autres
Publié: (2024)
par: Xiang, Zhen, et autres
Publié: (2024)
ExplainableGuard: Interpretable Adversarial Defense for Large Language Models Using Chain-of-Thought Reasoning
par: Guan, Shaowei, et autres
Publié: (2025)
par: Guan, Shaowei, et autres
Publié: (2025)
DarkMind: Latent Chain-of-Thought Backdoor in Customized LLMs
par: Guo, Zhen, et autres
Publié: (2025)
par: Guo, Zhen, et autres
Publié: (2025)
Shadow-Free Membership Inference Attacks: Recommender Systems Are More Vulnerable Than You Thought
par: Chi, Xiaoxiao, et autres
Publié: (2024)
par: Chi, Xiaoxiao, et autres
Publié: (2024)
BadThink: Triggered Overthinking Attacks on Chain-of-Thought Reasoning in Large Language Models
par: Liu, Shuaitong, et autres
Publié: (2025)
par: Liu, Shuaitong, et autres
Publié: (2025)
Defense Against Prompt Injection Attack by Leveraging Attack Techniques
par: Chen, Yulin, et autres
Publié: (2024)
par: Chen, Yulin, et autres
Publié: (2024)
Autonomous Chain-of-Thought Distillation for Graph-Based Fraud Detection
par: Li, Yuan, et autres
Publié: (2026)
par: Li, Yuan, et autres
Publié: (2026)
Unreal Thinking: Chain-of-Thought Hijacking via Two-stage Backdoor
par: Chang, Wenhan, et autres
Publié: (2026)
par: Chang, Wenhan, et autres
Publié: (2026)
Cross-Chain Arbitrage: The Next Frontier of MEV in Decentralized Finance
par: Öz, Burak, et autres
Publié: (2025)
par: Öz, Burak, et autres
Publié: (2025)
Refunded but Rewarded: The Double Dip Attack on Cashback Reward Engines
par: Rashid, S M Zia Ur, et autres
Publié: (2026)
par: Rashid, S M Zia Ur, et autres
Publié: (2026)
Implementing Zero Trust Architecture to Enhance Security and Resilience in the Pharmaceutical Supply Chain
par: Ghasemshirazi, Saeid, et autres
Publié: (2025)
par: Ghasemshirazi, Saeid, et autres
Publié: (2025)
SecPLF: Secure Protocols for Loanable Funds against Oracle Manipulation Attacks
par: Arora, Sanidhay, et autres
Publié: (2024)
par: Arora, Sanidhay, et autres
Publié: (2024)
The Black Tuesday Attack: how to crash the stock market with adversarial examples to financial forecasting models
par: Hofweber, Thomas, et autres
Publié: (2025)
par: Hofweber, Thomas, et autres
Publié: (2025)
Hybrid Stabilization Protocol for Cross-Chain Digital Assets Using Adaptor Signatures and AI-Driven Arbitrage
par: You, Shengwei, et autres
Publié: (2025)
par: You, Shengwei, et autres
Publié: (2025)
Tokenize Everything, But Can You Sell It? RWA Liquidity Challenges and the Road Ahead
par: Mafrur, Rischan
Publié: (2025)
par: Mafrur, Rischan
Publié: (2025)
From Storage to Steering: Memory Control Flow Attacks on LLM Agents
par: Xu, Zhenlin, et autres
Publié: (2026)
par: Xu, Zhenlin, et autres
Publié: (2026)
Enhancing Security in Blockchain Networks: Anomalies, Frauds, and Advanced Detection Techniques
par: Osterrieder, Joerg, et autres
Publié: (2024)
par: Osterrieder, Joerg, et autres
Publié: (2024)
Blockchain Metrics and Indicators in Cryptocurrency Trading
par: King, Juan C., et autres
Publié: (2024)
par: King, Juan C., et autres
Publié: (2024)
Assessing the Solvency of Virtual Asset Service Providers: Are Current Standards Sufficient?
par: Saggese, Pietro, et autres
Publié: (2023)
par: Saggese, Pietro, et autres
Publié: (2023)
The Satoshi Overhang: Why the Bear Case is Bounded
par: Ulrich, Karl T.
Publié: (2026)
par: Ulrich, Karl T.
Publié: (2026)
Towards A Post-Quantum Cryptography in Blockchain I: Basic Review on Theoretical Cryptography and Quantum Information Theory
par: Kikuchi, Tatsuru
Publié: (2024)
par: Kikuchi, Tatsuru
Publié: (2024)
Price manipulation schemes of new crypto-tokens in decentralized exchanges
par: Naviglio, Manuel, et autres
Publié: (2025)
par: Naviglio, Manuel, et autres
Publié: (2025)
Leverage Staking with Liquid Staking Derivatives (LSDs): Opportunities and Risks
par: Xiong, Xihan, et autres
Publié: (2023)
par: Xiong, Xihan, et autres
Publié: (2023)
Enhancing Meme Token Market Transparency: A Multi-Dimensional Entity-Linked Address Analysis for Liquidity Risk Evaluation
par: Liu, Qiangqiang, et autres
Publié: (2025)
par: Liu, Qiangqiang, et autres
Publié: (2025)
Auto-Balancer: Harnessing idle network resources for enhanced market stability
par: Abgaryan, Arman, et autres
Publié: (2025)
par: Abgaryan, Arman, et autres
Publié: (2025)
Tax Policy Handbook for Crypto Assets
par: Misra, Arindam
Publié: (2024)
par: Misra, Arindam
Publié: (2024)
CoTGuard: Using Chain-of-Thought Triggering for Copyright Protection in Multi-Agent LLM Systems
par: Wen, Yan, et autres
Publié: (2025)
par: Wen, Yan, et autres
Publié: (2025)
GoAT-X: A Graph of Auditing Thoughts for Securing Token Transactions in Cross-Chain Contracts
par: Feng, Zijun, et autres
Publié: (2026)
par: Feng, Zijun, et autres
Publié: (2026)
Six Levels of Privacy: A Framework for Financial Synthetic Data
par: Balch, Tucker, et autres
Publié: (2024)
par: Balch, Tucker, et autres
Publié: (2024)
BRC20 Pinning Attack
par: Qi, Minfeng, et autres
Publié: (2024)
par: Qi, Minfeng, et autres
Publié: (2024)
Trading Devil Final: Backdoor attack via Stock market and Bayesian Optimization
par: Mengara, Orson
Publié: (2024)
par: Mengara, Orson
Publié: (2024)
Output Supervision Can Obfuscate the Chain of Thought
par: Drori, Jacob, et autres
Publié: (2025)
par: Drori, Jacob, et autres
Publié: (2025)
Strengthening Human-Centric Chain-of-Thought Reasoning Integrity in LLMs via a Structured Prompt Framework
par: Zhou, Jiling, et autres
Publié: (2026)
par: Zhou, Jiling, et autres
Publié: (2026)
R-CoT: A Reasoning-Layer Watermark via Redundant Chain-of-Thought in Large Language Models
par: Zhang, Ziming, et autres
Publié: (2026)
par: Zhang, Ziming, et autres
Publié: (2026)
GasLiteAA: Optimizing ERC-4337 for Efficient and Secure Gas Sponsorship
par: Su, Hongxu, et autres
Publié: (2026)
par: Su, Hongxu, et autres
Publié: (2026)
SFCoT: Safer Chain-of-Thought via Active Safety Evaluation and Calibration
par: Pan, Yu, et autres
Publié: (2026)
par: Pan, Yu, et autres
Publié: (2026)
Echoes within the Reasoning: Stealthy and Effective Watermarking via Chain of Thought
par: Lu, Jiacheng, et autres
Publié: (2026)
par: Lu, Jiacheng, et autres
Publié: (2026)
Documents similaires
-
Thought-Transfer: Indirect Targeted Poisoning Attacks on Chain-of-Thought Reasoning Models
par: Chaudhari, Harsh, et autres
Publié: (2026) -
Chain-of-Thought Prompting of Large Language Models for Discovering and Fixing Software Vulnerabilities
par: Nong, Yu, et autres
Publié: (2024) -
Preemptive Answer "Attacks" on Chain-of-Thought Reasoning
par: Xu, Rongwu, et autres
Publié: (2024) -
BadChain: Backdoor Chain-of-Thought Prompting for Large Language Models
par: Xiang, Zhen, et autres
Publié: (2024) -
ExplainableGuard: Interpretable Adversarial Defense for Large Language Models Using Chain-of-Thought Reasoning
par: Guan, Shaowei, et autres
Publié: (2025)