How Much Do Large Language Model Cheat on Evaluation? Benchmarking Overestimation under the One-Time-Pad-Based Framework
Fuente:
arXiv
Saved in:
| Main Authors: | Liang, Zi, Yu, Liantong, Zhang, Shiyu, Ye, Qingqing, Hu, Haibo |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Dual Utilization of Perturbation for Stream Data Publication under Local Differential Privacy
by: Du, Rong, et al.
Published: (2025)
by: Du, Rong, et al.
Published: (2025)
From Randomized Response to Randomized Index: Answering Subset Counting Queries with Local Differential Privacy
by: Ye, Qingqing, et al.
Published: (2025)
by: Ye, Qingqing, et al.
Published: (2025)
Why Are My Prompts Leaked? Unraveling Prompt Extraction Threats in Customized Large Language Models
by: Liang, Zi, et al.
Published: (2024)
by: Liang, Zi, et al.
Published: (2024)
PrivShape: Extracting Shapes in Time Series under User-Level Local Differential Privacy
by: Mao, Yulian, et al.
Published: (2024)
by: Mao, Yulian, et al.
Published: (2024)
PrivDPR: Synthetic Graph Publishing with Deep PageRank under Differential Privacy
by: Zhang, Sen, et al.
Published: (2025)
by: Zhang, Sen, et al.
Published: (2025)
PriPL-Tree: Accurate Range Query for Arbitrary Distribution under Local Differential Privacy
by: Wang, Leixia, et al.
Published: (2024)
by: Wang, Leixia, et al.
Published: (2024)
Toward Efficient Inference Attacks: Shadow Model Sharing via Mixture-of-Experts
by: Bai, Li, et al.
Published: (2025)
by: Bai, Li, et al.
Published: (2025)
Does Low Rank Adaptation Lead to Lower Robustness against Training-Time Attacks?
by: Liang, Zi, et al.
Published: (2025)
by: Liang, Zi, et al.
Published: (2025)
Federated Heavy Hitter Analytics with Local Differential Privacy
by: Zhang, Yuemin, et al.
Published: (2024)
by: Zhang, Yuemin, et al.
Published: (2024)
Non-Degenerate One-Time Pad and the integrity of perfectly secret messages
by: Shafarenko, Alex
Published: (2024)
by: Shafarenko, Alex
Published: (2024)
Multi-class Item Mining under Local Differential Privacy
by: Mao, Yulian, et al.
Published: (2025)
by: Mao, Yulian, et al.
Published: (2025)
Can a Single Message Paralyze the AI Infrastructure? The Rise of AbO-DDoS Attacks through Targeted Mobius Injection
by: Liang, Zi, et al.
Published: (2026)
by: Liang, Zi, et al.
Published: (2026)
Privacy for Free: Leveraging Local Differential Privacy Perturbed Data from Multiple Services
by: Du, Rong, et al.
Published: (2025)
by: Du, Rong, et al.
Published: (2025)
"Yes, My LoRD." Guiding Language Model Extraction with Locality Reinforced Distillation
by: Liang, Zi, et al.
Published: (2024)
by: Liang, Zi, et al.
Published: (2024)
OBLIVIATE: Robust and Practical Machine Unlearning for Large Language Models
by: Xu, Xiaoyu, et al.
Published: (2025)
by: Xu, Xiaoyu, et al.
Published: (2025)
A Sample-Level Evaluation and Generative Framework for Model Inversion Attacks
by: Li, Haoyang, et al.
Published: (2025)
by: Li, Haoyang, et al.
Published: (2025)
Data Poisoning Attacks to Local Differential Privacy Protocols for Graphs
by: He, Xi, et al.
Published: (2024)
by: He, Xi, et al.
Published: (2024)
Interactive Trimming against Evasive Online Data Manipulation Attacks: A Game-Theoretic Approach
by: Fu, Yue, et al.
Published: (2024)
by: Fu, Yue, et al.
Published: (2024)
How Much Do Code Language Models Remember? An Investigation on Data Extraction Attacks before and after Fine-tuning
by: Salerno, Fabio, et al.
Published: (2025)
by: Salerno, Fabio, et al.
Published: (2025)
WiFinger: Fingerprinting Noisy IoT Event Traffic Using Packet-level Sequence Matching
by: Li, Ronghua, et al.
Published: (2025)
by: Li, Ronghua, et al.
Published: (2025)
MER-Inspector: Assessing model extraction risks from an attack-agnostic perspective
by: Zhang, Xinwei, et al.
Published: (2025)
by: Zhang, Xinwei, et al.
Published: (2025)
Virus Infection Attack on LLMs: Your Poisoning Can Spread "VIA" Synthetic Data
by: Liang, Zi, et al.
Published: (2025)
by: Liang, Zi, et al.
Published: (2025)
AdvSGM: Differentially Private Graph Learning via Adversarial Skip-gram Model
by: Zhang, Sen, et al.
Published: (2025)
by: Zhang, Sen, et al.
Published: (2025)
On the Adversarial Robustness of Large Vision-Language Models under Visual Token Compression
by: Zhang, Xinwei, et al.
Published: (2026)
by: Zhang, Xinwei, et al.
Published: (2026)
From Domains to Instances: Dual-Granularity Data Synthesis for LLM Unlearning
by: Xu, Xiaoyu, et al.
Published: (2026)
by: Xu, Xiaoyu, et al.
Published: (2026)
United We Defend: Collaborative Membership Inference Defenses in Federated Learning
by: Bai, Li, et al.
Published: (2026)
by: Bai, Li, et al.
Published: (2026)
Membership Inference Attacks and Defenses in Federated Learning: A Survey
by: Bai, Li, et al.
Published: (2024)
by: Bai, Li, et al.
Published: (2024)
A Thorough Study of State Leakage Mitigation in Quantum Computing with One-Time Pad
by: Xu, Chuanqi, et al.
Published: (2024)
by: Xu, Chuanqi, et al.
Published: (2024)
Cross-Modal Backdoors in Multimodal Large Language Models
by: Wang, Runhe, et al.
Published: (2026)
by: Wang, Runhe, et al.
Published: (2026)
One-time Pad Encryption Model for Non-local Correlations
by: Sidhardh, Govind Lal, et al.
Published: (2023)
by: Sidhardh, Govind Lal, et al.
Published: (2023)
LDPRecover: Recovering Frequencies from Poisoning Attacks against Local Differential Privacy
by: Sun, Xinyue, et al.
Published: (2024)
by: Sun, Xinyue, et al.
Published: (2024)
On the Reliability of Biometric Datasets: How Much Test Data Ensures Reliability?
by: Fallahi, Matin, et al.
Published: (2025)
by: Fallahi, Matin, et al.
Published: (2025)
A Systematic Review of Technical Defenses Against Software-Based Cheating in Online Multiplayer Games
by: Alangari, Adwa, et al.
Published: (2025)
by: Alangari, Adwa, et al.
Published: (2025)
SafeBench: A Safety Evaluation Framework for Multimodal Large Language Models
by: Ying, Zonghao, et al.
Published: (2024)
by: Ying, Zonghao, et al.
Published: (2024)
Padding Matters -- Exploring Function Detection in PE Files
by: Springer, Raphael, et al.
Published: (2025)
by: Springer, Raphael, et al.
Published: (2025)
Class-feature Watermark: A Resilient Black-box Watermark Against Model Extraction Attacks
by: Xiao, Yaxin, et al.
Published: (2025)
by: Xiao, Yaxin, et al.
Published: (2025)
Cheat-Penalised Quantum Weak Coin-Flipping
by: Arora, Atul Singh, et al.
Published: (2025)
by: Arora, Atul Singh, et al.
Published: (2025)
Synopticon: Consensus-Based Cheating Detection System for Competitive Games
by: Kang, Jeuk, et al.
Published: (2025)
by: Kang, Jeuk, et al.
Published: (2025)
FIT to Forget: Robust Continual Unlearning for Large Language Models
by: Xu, Xiaoyu, et al.
Published: (2026)
by: Xu, Xiaoyu, et al.
Published: (2026)
Addressing Network Packet-based Cheats in Multiplayer Games: A Secret Sharing Approach
by: Cai, Yaqi, et al.
Published: (2025)
by: Cai, Yaqi, et al.
Published: (2025)
Similar Items
-
Dual Utilization of Perturbation for Stream Data Publication under Local Differential Privacy
by: Du, Rong, et al.
Published: (2025) -
From Randomized Response to Randomized Index: Answering Subset Counting Queries with Local Differential Privacy
by: Ye, Qingqing, et al.
Published: (2025) -
Why Are My Prompts Leaked? Unraveling Prompt Extraction Threats in Customized Large Language Models
by: Liang, Zi, et al.
Published: (2024) -
PrivShape: Extracting Shapes in Time Series under User-Level Local Differential Privacy
by: Mao, Yulian, et al.
Published: (2024) -
PrivDPR: Synthetic Graph Publishing with Deep PageRank under Differential Privacy
by: Zhang, Sen, et al.
Published: (2025)