"Yes, My LoRD." Guiding Language Model Extraction with Locality Reinforced Distillation
Fuente:
arXiv
Salvato in:
| Autori principali: | Liang, Zi, Ye, Qingqing, Wang, Yanyun, Zhang, Sen, Xiao, Yaxin, Li, Ronghua, Xu, Jianliang, Hu, Haibo |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Why Are My Prompts Leaked? Unraveling Prompt Extraction Threats in Customized Large Language Models
di: Liang, Zi, et al.
Pubblicazione: (2024)
di: Liang, Zi, et al.
Pubblicazione: (2024)
Can a Single Message Paralyze the AI Infrastructure? The Rise of AbO-DDoS Attacks through Targeted Mobius Injection
di: Liang, Zi, et al.
Pubblicazione: (2026)
di: Liang, Zi, et al.
Pubblicazione: (2026)
Does Low Rank Adaptation Lead to Lower Robustness against Training-Time Attacks?
di: Liang, Zi, et al.
Pubblicazione: (2025)
di: Liang, Zi, et al.
Pubblicazione: (2025)
Virus Infection Attack on LLMs: Your Poisoning Can Spread "VIA" Synthetic Data
di: Liang, Zi, et al.
Pubblicazione: (2025)
di: Liang, Zi, et al.
Pubblicazione: (2025)
PrivDPR: Synthetic Graph Publishing with Deep PageRank under Differential Privacy
di: Zhang, Sen, et al.
Pubblicazione: (2025)
di: Zhang, Sen, et al.
Pubblicazione: (2025)
Toward Efficient Inference Attacks: Shadow Model Sharing via Mixture-of-Experts
di: Bai, Li, et al.
Pubblicazione: (2025)
di: Bai, Li, et al.
Pubblicazione: (2025)
AdvSGM: Differentially Private Graph Learning via Adversarial Skip-gram Model
di: Zhang, Sen, et al.
Pubblicazione: (2025)
di: Zhang, Sen, et al.
Pubblicazione: (2025)
A Sample-Level Evaluation and Generative Framework for Model Inversion Attacks
di: Li, Haoyang, et al.
Pubblicazione: (2025)
di: Li, Haoyang, et al.
Pubblicazione: (2025)
Dual Utilization of Perturbation for Stream Data Publication under Local Differential Privacy
di: Du, Rong, et al.
Pubblicazione: (2025)
di: Du, Rong, et al.
Pubblicazione: (2025)
WiFinger: Fingerprinting Noisy IoT Event Traffic Using Packet-level Sequence Matching
di: Li, Ronghua, et al.
Pubblicazione: (2025)
di: Li, Ronghua, et al.
Pubblicazione: (2025)
Class-feature Watermark: A Resilient Black-box Watermark Against Model Extraction Attacks
di: Xiao, Yaxin, et al.
Pubblicazione: (2025)
di: Xiao, Yaxin, et al.
Pubblicazione: (2025)
Federated Heavy Hitter Analytics with Local Differential Privacy
di: Zhang, Yuemin, et al.
Pubblicazione: (2024)
di: Zhang, Yuemin, et al.
Pubblicazione: (2024)
Membership Inference Attacks and Defenses in Federated Learning: A Survey
di: Bai, Li, et al.
Pubblicazione: (2024)
di: Bai, Li, et al.
Pubblicazione: (2024)
How Much Do Large Language Model Cheat on Evaluation? Benchmarking Overestimation under the One-Time-Pad-Based Framework
di: Liang, Zi, et al.
Pubblicazione: (2025)
di: Liang, Zi, et al.
Pubblicazione: (2025)
Privacy for Free: Leveraging Local Differential Privacy Perturbed Data from Multiple Services
di: Du, Rong, et al.
Pubblicazione: (2025)
di: Du, Rong, et al.
Pubblicazione: (2025)
Data Poisoning Attacks to Local Differential Privacy Protocols for Graphs
di: He, Xi, et al.
Pubblicazione: (2024)
di: He, Xi, et al.
Pubblicazione: (2024)
PriPL-Tree: Accurate Range Query for Arbitrary Distribution under Local Differential Privacy
di: Wang, Leixia, et al.
Pubblicazione: (2024)
di: Wang, Leixia, et al.
Pubblicazione: (2024)
PrivShape: Extracting Shapes in Time Series under User-Level Local Differential Privacy
di: Mao, Yulian, et al.
Pubblicazione: (2024)
di: Mao, Yulian, et al.
Pubblicazione: (2024)
From Randomized Response to Randomized Index: Answering Subset Counting Queries with Local Differential Privacy
di: Ye, Qingqing, et al.
Pubblicazione: (2025)
di: Ye, Qingqing, et al.
Pubblicazione: (2025)
United We Defend: Collaborative Membership Inference Defenses in Federated Learning
di: Bai, Li, et al.
Pubblicazione: (2026)
di: Bai, Li, et al.
Pubblicazione: (2026)
Multi-class Item Mining under Local Differential Privacy
di: Mao, Yulian, et al.
Pubblicazione: (2025)
di: Mao, Yulian, et al.
Pubblicazione: (2025)
LDPRecover: Recovering Frequencies from Poisoning Attacks against Local Differential Privacy
di: Sun, Xinyue, et al.
Pubblicazione: (2024)
di: Sun, Xinyue, et al.
Pubblicazione: (2024)
Interactive Trimming against Evasive Online Data Manipulation Attacks: A Game-Theoretic Approach
di: Fu, Yue, et al.
Pubblicazione: (2024)
di: Fu, Yue, et al.
Pubblicazione: (2024)
MER-Inspector: Assessing model extraction risks from an attack-agnostic perspective
di: Zhang, Xinwei, et al.
Pubblicazione: (2025)
di: Zhang, Xinwei, et al.
Pubblicazione: (2025)
FIT to Forget: Robust Continual Unlearning for Large Language Models
di: Xu, Xiaoyu, et al.
Pubblicazione: (2026)
di: Xu, Xiaoyu, et al.
Pubblicazione: (2026)
Acoustic Interference: A New Paradigm Weaponizing Acoustic Latent Semantic for Universal Jailbreak against Large Audio Language Models
di: Wang, Yanyun, et al.
Pubblicazione: (2026)
di: Wang, Yanyun, et al.
Pubblicazione: (2026)
TSFool: Crafting Highly-Imperceptible Adversarial Time Series through Multi-Objective Attack
di: Wang, Yanyun, et al.
Pubblicazione: (2022)
di: Wang, Yanyun, et al.
Pubblicazione: (2022)
OBLIVIATE: Robust and Practical Machine Unlearning for Large Language Models
di: Xu, Xiaoyu, et al.
Pubblicazione: (2025)
di: Xu, Xiaoyu, et al.
Pubblicazione: (2025)
Bipartite Randomized Response Mechanism for Local Differential Privacy
di: Zhang, Shun, et al.
Pubblicazione: (2025)
di: Zhang, Shun, et al.
Pubblicazione: (2025)
Cross-Modal Backdoors in Multimodal Large Language Models
di: Wang, Runhe, et al.
Pubblicazione: (2026)
di: Wang, Runhe, et al.
Pubblicazione: (2026)
From Domains to Instances: Dual-Granularity Data Synthesis for LLM Unlearning
di: Xu, Xiaoyu, et al.
Pubblicazione: (2026)
di: Xu, Xiaoyu, et al.
Pubblicazione: (2026)
TrojanLoC: LLM-based Framework for RTL Trojan Localization
di: Xiao, Weihua, et al.
Pubblicazione: (2025)
di: Xiao, Weihua, et al.
Pubblicazione: (2025)
BiRD: A Bidirectional Ranking Defense Mechanism for Retrieval Augmented Generation
di: Gao, Chengcai, et al.
Pubblicazione: (2026)
di: Gao, Chengcai, et al.
Pubblicazione: (2026)
TraCS: Trajectory Collection in Continuous Space under Local Differential Privacy
di: Zheng, Ye, et al.
Pubblicazione: (2024)
di: Zheng, Ye, et al.
Pubblicazione: (2024)
When Routine Chats Turn Toxic: Unintended Long-Term State Poisoning in Personalized Agents
di: Xu, Xiaoyu, et al.
Pubblicazione: (2026)
di: Xu, Xiaoyu, et al.
Pubblicazione: (2026)
ExDoS: Expert-Guided Dual-Focus Cross-Modal Distillation for Smart Contract Vulnerability Detection
di: Tian, Ye, et al.
Pubblicazione: (2025)
di: Tian, Ye, et al.
Pubblicazione: (2025)
On the Adversarial Robustness of Large Vision-Language Models under Visual Token Compression
di: Zhang, Xinwei, et al.
Pubblicazione: (2026)
di: Zhang, Xinwei, et al.
Pubblicazione: (2026)
Fine-tuning is Not Fine: Mitigating Backdoor Attacks in GNNs with Limited Clean Data
di: Zhang, Jiale, et al.
Pubblicazione: (2025)
di: Zhang, Jiale, et al.
Pubblicazione: (2025)
Frequency Estimation of Correlated Multi-attribute Data under Local Differential Privacy
di: Seeam, Shafizur Rahman, et al.
Pubblicazione: (2025)
di: Seeam, Shafizur Rahman, et al.
Pubblicazione: (2025)
Explainable Android Malware Detection and Malicious Code Localization Using Graph Attention
di: Ipek, Merve Cigdem, et al.
Pubblicazione: (2025)
di: Ipek, Merve Cigdem, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Why Are My Prompts Leaked? Unraveling Prompt Extraction Threats in Customized Large Language Models
di: Liang, Zi, et al.
Pubblicazione: (2024) -
Can a Single Message Paralyze the AI Infrastructure? The Rise of AbO-DDoS Attacks through Targeted Mobius Injection
di: Liang, Zi, et al.
Pubblicazione: (2026) -
Does Low Rank Adaptation Lead to Lower Robustness against Training-Time Attacks?
di: Liang, Zi, et al.
Pubblicazione: (2025) -
Virus Infection Attack on LLMs: Your Poisoning Can Spread "VIA" Synthetic Data
di: Liang, Zi, et al.
Pubblicazione: (2025) -
PrivDPR: Synthetic Graph Publishing with Deep PageRank under Differential Privacy
di: Zhang, Sen, et al.
Pubblicazione: (2025)