How to Steal Reasoning Without Reasoning Traces
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Tingwei, Morris, John X., Shmatikov, Vitaly |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Deep-Research Agents Can Be Poisoned via User-Generated Content
di: Zhang, Tingwei, et al.
Pubblicazione: (2026)
di: Zhang, Tingwei, et al.
Pubblicazione: (2026)
Universal Zero-shot Embedding Inversion
di: Zhang, Collin, et al.
Pubblicazione: (2025)
di: Zhang, Collin, et al.
Pubblicazione: (2025)
Self-interpreting Adversarial Images
di: Zhang, Tingwei, et al.
Pubblicazione: (2024)
di: Zhang, Tingwei, et al.
Pubblicazione: (2024)
Adversarial Decoding: Generating Readable Documents for Adversarial Objectives
di: Zhang, Collin, et al.
Pubblicazione: (2024)
di: Zhang, Collin, et al.
Pubblicazione: (2024)
Adversarial Illusions in Multi-Modal Embeddings
di: Zhang, Tingwei, et al.
Pubblicazione: (2023)
di: Zhang, Tingwei, et al.
Pubblicazione: (2023)
Differential Degradation Vulnerabilities in Censorship Circumvention Systems
di: Sun, Zhen, et al.
Pubblicazione: (2024)
di: Sun, Zhen, et al.
Pubblicazione: (2024)
Adversarial Hubness in Multi-Modal Retrieval
di: Zhang, Tingwei, et al.
Pubblicazione: (2024)
di: Zhang, Tingwei, et al.
Pubblicazione: (2024)
Multi-Agent Systems Execute Arbitrary Malicious Code
di: Triedman, Harold, et al.
Pubblicazione: (2025)
di: Triedman, Harold, et al.
Pubblicazione: (2025)
Machine Against the RAG: Jamming Retrieval-Augmented Generation with Blocker Documents
di: Shafran, Avital, et al.
Pubblicazione: (2024)
di: Shafran, Avital, et al.
Pubblicazione: (2024)
Agent Meltdowns: The Road to Hell Is Paved with Helpful Agents
di: Jha, Rishi, et al.
Pubblicazione: (2026)
di: Jha, Rishi, et al.
Pubblicazione: (2026)
Rerouting LLM Routers
di: Shafran, Avital, et al.
Pubblicazione: (2025)
di: Shafran, Avital, et al.
Pubblicazione: (2025)
All Your Knowledge Belongs to Us: Stealing Knowledge Graphs via Reasoning APIs
di: Xi, Zhaohan
Pubblicazione: (2025)
di: Xi, Zhaohan
Pubblicazione: (2025)
Breaking and Fixing Defenses Against Control-Flow Hijacking in Multi-Agent Systems
di: Jha, Rishi, et al.
Pubblicazione: (2025)
di: Jha, Rishi, et al.
Pubblicazione: (2025)
Efficient Data-Free Model Stealing with Label Diversity
di: Liu, Yiyong, et al.
Pubblicazione: (2024)
di: Liu, Yiyong, et al.
Pubblicazione: (2024)
SoK: Stealing Cars Since Remote Keyless Entry Introduction and How to Defend From It
di: Bianchi, Tommaso, et al.
Pubblicazione: (2025)
di: Bianchi, Tommaso, et al.
Pubblicazione: (2025)
PSRT: Accelerating LRM-based Guard Models via Prefilled Safe Reasoning Traces
di: Zhao, Jiawei, et al.
Pubblicazione: (2025)
di: Zhao, Jiawei, et al.
Pubblicazione: (2025)
TraceGuard: Process-Guided Firewall against Reasoning Backdoors in Large Language Models
di: Guo, Zhen, et al.
Pubblicazione: (2026)
di: Guo, Zhen, et al.
Pubblicazione: (2026)
Stealing Part of a Production Language Model
di: Carlini, Nicholas, et al.
Pubblicazione: (2024)
di: Carlini, Nicholas, et al.
Pubblicazione: (2024)
Stealing Trust: Unraveling Blind Message Attacks in Web3 Authentication
di: Yan, Kailun, et al.
Pubblicazione: (2024)
di: Yan, Kailun, et al.
Pubblicazione: (2024)
How to Delete Without a Trace: Certified Deniability in a Quantum World
di: Çakan, Alper, et al.
Pubblicazione: (2024)
di: Çakan, Alper, et al.
Pubblicazione: (2024)
Prompt Pirates Need a Map: Stealing Seeds helps Stealing Prompts
di: Mächtle, Felix, et al.
Pubblicazione: (2025)
di: Mächtle, Felix, et al.
Pubblicazione: (2025)
Towards Effective Prompt Stealing Attack against Text-to-Image Diffusion Models
di: Zhao, Shiqian, et al.
Pubblicazione: (2025)
di: Zhao, Shiqian, et al.
Pubblicazione: (2025)
GraphSteal: Structural Knowledge Stealing from Graph RAG via Traversal Reconstruction
di: Gu, Jinze, et al.
Pubblicazione: (2026)
di: Gu, Jinze, et al.
Pubblicazione: (2026)
BarkBeetle: Stealing Decision Tree Models with Fault Injection
di: Wang, Qifan, et al.
Pubblicazione: (2025)
di: Wang, Qifan, et al.
Pubblicazione: (2025)
Electric Democracy: Proof of Work to secure Elections
di: Zuevsky, Vitaly
Pubblicazione: (2022)
di: Zuevsky, Vitaly
Pubblicazione: (2022)
Hidden Thoughts Are Not Secret: Reasoning Trace Exposure in LLMs
di: Lu, Yu-An, et al.
Pubblicazione: (2026)
di: Lu, Yu-An, et al.
Pubblicazione: (2026)
Black-Box Skill Stealing Attack from Proprietary LLM Agents: An Empirical Study
di: Wang, Zihan, et al.
Pubblicazione: (2026)
di: Wang, Zihan, et al.
Pubblicazione: (2026)
Prompt Stealing Attacks Against Large Language Models
di: Sha, Zeyang, et al.
Pubblicazione: (2024)
di: Sha, Zeyang, et al.
Pubblicazione: (2024)
Large Language Model Watermark Stealing With Mixed Integer Programming
di: Zhang, Zhaoxi, et al.
Pubblicazione: (2024)
di: Zhang, Zhaoxi, et al.
Pubblicazione: (2024)
On Stealing Graph Neural Network Models
di: Podhajski, Marcin, et al.
Pubblicazione: (2025)
di: Podhajski, Marcin, et al.
Pubblicazione: (2025)
Stealing Maggie's Secrets -- On the Challenges of IP Theft Through FPGA Reverse Engineering
di: Klix, Simon, et al.
Pubblicazione: (2023)
di: Klix, Simon, et al.
Pubblicazione: (2023)
Stealing Training Graphs from Graph Neural Networks
di: Lin, Minhua, et al.
Pubblicazione: (2024)
di: Lin, Minhua, et al.
Pubblicazione: (2024)
BESA: Boosting Encoder Stealing Attack with Perturbation Recovery
di: Ren, Xuhao, et al.
Pubblicazione: (2025)
di: Ren, Xuhao, et al.
Pubblicazione: (2025)
Merger-as-a-Stealer: Stealing Targeted PII from Aligned LLMs with Model Merging
di: Lu, Lin, et al.
Pubblicazione: (2025)
di: Lu, Lin, et al.
Pubblicazione: (2025)
InputSnatch: Stealing Input in LLM Services via Timing Side-Channel Attacks
di: Zheng, Xinyao, et al.
Pubblicazione: (2024)
di: Zheng, Xinyao, et al.
Pubblicazione: (2024)
Prompt Stealing Attacks Against Text-to-Image Generation Models
di: Shen, Xinyue, et al.
Pubblicazione: (2023)
di: Shen, Xinyue, et al.
Pubblicazione: (2023)
When Reasoning Leaks Membership: Membership Inference Attack on Black-box Large Reasoning Models
di: Hu, Ruihan, et al.
Pubblicazione: (2026)
di: Hu, Ruihan, et al.
Pubblicazione: (2026)
Reasoning Hijacking: The Fragility of Reasoning Alignment in Large Language Models
di: Liu, Yuansen, et al.
Pubblicazione: (2026)
di: Liu, Yuansen, et al.
Pubblicazione: (2026)
Practical Reasoning Interruption Attacks on Reasoning Large Language Models
di: Cui, Yu, et al.
Pubblicazione: (2025)
di: Cui, Yu, et al.
Pubblicazione: (2025)
Transpose Attack: Stealing Datasets with Bidirectional Training
di: Amit, Guy, et al.
Pubblicazione: (2023)
di: Amit, Guy, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Deep-Research Agents Can Be Poisoned via User-Generated Content
di: Zhang, Tingwei, et al.
Pubblicazione: (2026) -
Universal Zero-shot Embedding Inversion
di: Zhang, Collin, et al.
Pubblicazione: (2025) -
Self-interpreting Adversarial Images
di: Zhang, Tingwei, et al.
Pubblicazione: (2024) -
Adversarial Decoding: Generating Readable Documents for Adversarial Objectives
di: Zhang, Collin, et al.
Pubblicazione: (2024) -
Adversarial Illusions in Multi-Modal Embeddings
di: Zhang, Tingwei, et al.
Pubblicazione: (2023)