Unelicitable Backdoors in Language Models via Cryptographic Transformer Circuits
Fuente:
arXiv
Salvato in:
| Autori principali: | Draguns, Andis, Gritsevskiy, Andrew, Motwani, Sumeet Ramesh, Rogers-Smith, Charlie, Ladish, Jeffrey, de Witt, Christian Schroeder |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Secret Collusion among AI Agents: Multi-Agent Deception via Steganography
di: Motwani, Sumeet Ramesh, et al.
Pubblicazione: (2024)
di: Motwani, Sumeet Ramesh, et al.
Pubblicazione: (2024)
Language Models Can Autonomously Hack and Self-Replicate
di: Air, Alena, et al.
Pubblicazione: (2026)
di: Air, Alena, et al.
Pubblicazione: (2026)
Open Challenges in Multi-Agent Security: Towards Secure Systems of Interacting AI Agents
di: de Witt, Christian Schroeder, et al.
Pubblicazione: (2025)
di: de Witt, Christian Schroeder, et al.
Pubblicazione: (2025)
Cryptographic Backdoor for Neural Networks: Boon and Bane
di: Ngo, Anh Tu, et al.
Pubblicazione: (2025)
di: Ngo, Anh Tu, et al.
Pubblicazione: (2025)
Extending the OWASP Multi-Agentic System Threat Modeling Guide: Insights from Multi-Agent Security Research
di: Krawiecka, Klaudia, et al.
Pubblicazione: (2025)
di: Krawiecka, Klaudia, et al.
Pubblicazione: (2025)
VET Your Agent: Towards Host-Independent Autonomy via Verifiable Execution Traces
di: Grigor, Artem, et al.
Pubblicazione: (2025)
di: Grigor, Artem, et al.
Pubblicazione: (2025)
On the Formalization of Cryptographic Migration
di: Loebenberger, Daniel, et al.
Pubblicazione: (2024)
di: Loebenberger, Daniel, et al.
Pubblicazione: (2024)
The Hardness of Learning Quantum Circuits and its Cryptographic Applications
di: Fefferman, Bill, et al.
Pubblicazione: (2025)
di: Fefferman, Bill, et al.
Pubblicazione: (2025)
Backdoor Channels Hidden in Latent Space: Cryptographic Undetectability in Modern Neural Networks
di: Eggen, Marte, et al.
Pubblicazione: (2026)
di: Eggen, Marte, et al.
Pubblicazione: (2026)
Double Backdoored: Converting Code Large Language Model Backdoors to Traditional Malware via Adversarial Instruction Tuning Attacks
di: Hossen, Md Imran, et al.
Pubblicazione: (2024)
di: Hossen, Md Imran, et al.
Pubblicazione: (2024)
Cryptographic Choreographies
di: Mödersheim, Sebastian, et al.
Pubblicazione: (2026)
di: Mödersheim, Sebastian, et al.
Pubblicazione: (2026)
Cross-Modal Backdoors in Multimodal Large Language Models
di: Wang, Runhe, et al.
Pubblicazione: (2026)
di: Wang, Runhe, et al.
Pubblicazione: (2026)
Backdoor Attribution: Elucidating and Controlling Backdoor in Language Models
di: Yu, Miao, et al.
Pubblicazione: (2025)
di: Yu, Miao, et al.
Pubblicazione: (2025)
Quantum-Resistant Cryptographic Models for Next-Gen Cybersecurity
di: Chhibber, Navin, et al.
Pubblicazione: (2025)
di: Chhibber, Navin, et al.
Pubblicazione: (2025)
DROIDCCT: Cryptographic Compliance Test via Trillion-Scale Measurement
di: Moghimi, Daniel, et al.
Pubblicazione: (2026)
di: Moghimi, Daniel, et al.
Pubblicazione: (2026)
The Quantum-Cryptographic Co-evolution
di: Kundu, Ashish, et al.
Pubblicazione: (2026)
di: Kundu, Ashish, et al.
Pubblicazione: (2026)
Merge Hijacking: Backdoor Attacks to Model Merging of Large Language Models
di: Yuan, Zenghui, et al.
Pubblicazione: (2025)
di: Yuan, Zenghui, et al.
Pubblicazione: (2025)
Inhibitory Attacks on Backdoor-based Fingerprinting for Large Language Models
di: Fu, Hang, et al.
Pubblicazione: (2026)
di: Fu, Hang, et al.
Pubblicazione: (2026)
BadDLM: Backdooring Diffusion Language Models with Diverse Targets
di: Zhai, Shengfang, et al.
Pubblicazione: (2026)
di: Zhai, Shengfang, et al.
Pubblicazione: (2026)
Transferring Backdoors between Large Language Models by Knowledge Distillation
di: Cheng, Pengzhou, et al.
Pubblicazione: (2024)
di: Cheng, Pengzhou, et al.
Pubblicazione: (2024)
Condition-Triggered Cryptographic Asset Control via Dormant Authorization Paths
di: Wang, Jian Sheng
Pubblicazione: (2026)
di: Wang, Jian Sheng
Pubblicazione: (2026)
WiFaKey: Generating Cryptographic Keys from Face in the Wild
di: Dong, Xingbo, et al.
Pubblicazione: (2024)
di: Dong, Xingbo, et al.
Pubblicazione: (2024)
Cryptographic Verifiability for Voter Registration Systems
di: Fábrega, Andrés, et al.
Pubblicazione: (2025)
di: Fábrega, Andrés, et al.
Pubblicazione: (2025)
Cryptographic Data Exchange for Nuclear Warheads
di: Perry, Neil, et al.
Pubblicazione: (2025)
di: Perry, Neil, et al.
Pubblicazione: (2025)
Cryptographic Keywords in NVD: Statistics and Visualization
di: Stanek, Martin
Pubblicazione: (2024)
di: Stanek, Martin
Pubblicazione: (2024)
Systematic Review of Lightweight Cryptographic Algorithms
di: Khan, Mohsin, et al.
Pubblicazione: (2026)
di: Khan, Mohsin, et al.
Pubblicazione: (2026)
BackdoorDM: A Comprehensive Benchmark for Backdoor Learning on Diffusion Model
di: Lin, Weilin, et al.
Pubblicazione: (2025)
di: Lin, Weilin, et al.
Pubblicazione: (2025)
Toward a Common Understanding of Cryptographic Agility -- A Systematic Review
di: Näther, Christian, et al.
Pubblicazione: (2024)
di: Näther, Christian, et al.
Pubblicazione: (2024)
Patronus: Identifying and Mitigating Transferable Backdoors in Pre-trained Language Models
di: Zhao, Tianhang, et al.
Pubblicazione: (2025)
di: Zhao, Tianhang, et al.
Pubblicazione: (2025)
BadTemplate: A Training-Free Backdoor Attack via Chat Template Against Large Language Models
di: Wang, Zihan, et al.
Pubblicazione: (2026)
di: Wang, Zihan, et al.
Pubblicazione: (2026)
Backdooring Bias in Large Language Models
di: Das, Anudeep, et al.
Pubblicazione: (2026)
di: Das, Anudeep, et al.
Pubblicazione: (2026)
Backdooring Masked Diffusion Language Models
di: Cao, Daniel Yiming, et al.
Pubblicazione: (2026)
di: Cao, Daniel Yiming, et al.
Pubblicazione: (2026)
Backdoor Threats in Variational Quantum Circuits: Taxonomy, Attacks, and Defenses
di: Jiang, Lei, et al.
Pubblicazione: (2026)
di: Jiang, Lei, et al.
Pubblicazione: (2026)
Physical Backdoor Attack can Jeopardize Driving with Vision-Large-Language Models
di: Ni, Zhenyang, et al.
Pubblicazione: (2024)
di: Ni, Zhenyang, et al.
Pubblicazione: (2024)
Cryptographic Application of Elliptic Curve with High Rank
di: Cheng, Xiaogang, et al.
Pubblicazione: (2025)
di: Cheng, Xiaogang, et al.
Pubblicazione: (2025)
MECHA: Multithreaded and Efficient Cryptographic Hardware Access
di: Derry, Pratama, et al.
Pubblicazione: (2025)
di: Derry, Pratama, et al.
Pubblicazione: (2025)
On Cryptographic Mechanisms for the Selective Disclosure of Verifiable Credentials
di: Flamini, Andrea, et al.
Pubblicazione: (2024)
di: Flamini, Andrea, et al.
Pubblicazione: (2024)
Cryptographic Strengthening of MST3 cryptosystem via Automorphism Group of Suzuki Function Fields
di: Khalimov, Gennady, et al.
Pubblicazione: (2025)
di: Khalimov, Gennady, et al.
Pubblicazione: (2025)
Lite-BD: A Lightweight Black-box Backdoor Defense via Reviving Multi-Stage Image Transformations
di: Miah, Abdullah Arafat, et al.
Pubblicazione: (2026)
di: Miah, Abdullah Arafat, et al.
Pubblicazione: (2026)
Beyond Static Tools: Evaluating Large Language Models for Cryptographic Misuse Detection
di: Masood, Zohaib, et al.
Pubblicazione: (2024)
di: Masood, Zohaib, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Secret Collusion among AI Agents: Multi-Agent Deception via Steganography
di: Motwani, Sumeet Ramesh, et al.
Pubblicazione: (2024) -
Language Models Can Autonomously Hack and Self-Replicate
di: Air, Alena, et al.
Pubblicazione: (2026) -
Open Challenges in Multi-Agent Security: Towards Secure Systems of Interacting AI Agents
di: de Witt, Christian Schroeder, et al.
Pubblicazione: (2025) -
Cryptographic Backdoor for Neural Networks: Boon and Bane
di: Ngo, Anh Tu, et al.
Pubblicazione: (2025) -
Extending the OWASP Multi-Agentic System Threat Modeling Guide: Insights from Multi-Agent Security Research
di: Krawiecka, Klaudia, et al.
Pubblicazione: (2025)