PerProb: Indirectly Evaluating Memorization in Large Language Models
Fuente:
arXiv
Saved in:
| Main Authors: | Liao, Yihan, Keung, Jacky, Ma, Xiaoxue, Zhang, Jingyu, Sun, Yicheng |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Exposing and Defending Membership Leakage in Vulnerability Prediction Models
by: Liao, Yihan, et al.
Published: (2025)
by: Liao, Yihan, et al.
Published: (2025)
Pop Quiz Attack: Black-box Membership Inference Attacks Against Large Language Models
by: Chen, Zeyuan, et al.
Published: (2026)
by: Chen, Zeyuan, et al.
Published: (2026)
Analyzing and Evaluating Unbiased Language Model Watermark
by: Wu, Yihan, et al.
Published: (2025)
by: Wu, Yihan, et al.
Published: (2025)
Hybrid Privacy Policy-Code Consistency Check using Knowledge Graphs and LLMs
by: Mao, Zhenyu, et al.
Published: (2025)
by: Mao, Zhenyu, et al.
Published: (2025)
Rethinking Backdoor Detection Evaluation for Language Models
by: Yan, Jun, et al.
Published: (2024)
by: Yan, Jun, et al.
Published: (2024)
Evaluating Large Language Models for Line-Level Vulnerability Localization
by: Zhang, Jian, et al.
Published: (2024)
by: Zhang, Jian, et al.
Published: (2024)
SoK: Taxonomy and Evaluation of Prompt Security in Large Language Models
by: Hong, Hanbin, et al.
Published: (2025)
by: Hong, Hanbin, et al.
Published: (2025)
Private Memorization Editing: Turning Memorization into a Defense to Strengthen Data Privacy in Large Language Models
by: Ruzzetti, Elena Sofia, et al.
Published: (2025)
by: Ruzzetti, Elena Sofia, et al.
Published: (2025)
Localizing Paragraph Memorization in Language Models
by: Stoehr, Niklas, et al.
Published: (2024)
by: Stoehr, Niklas, et al.
Published: (2024)
Auditing Pay-Per-Token in Large Language Models
by: Velasco, Ander Artola, et al.
Published: (2025)
by: Velasco, Ander Artola, et al.
Published: (2025)
Language Model Agents Under Attack: A Cross Model-Benchmark of Profit-Seeking Behaviors in Customer Service
by: Zhang, Jingyu
Published: (2025)
by: Zhang, Jingyu
Published: (2025)
An Ensemble Framework for Unbiased Language Model Watermarking
by: Wu, Yihan, et al.
Published: (2025)
by: Wu, Yihan, et al.
Published: (2025)
Evaluating and Enhancing the Vulnerability Reasoning Capabilities of Large Language Models
by: Lu, Li, et al.
Published: (2026)
by: Lu, Li, et al.
Published: (2026)
AICrypto: Evaluating Cryptography Capabilities of Large Language Models
by: Wang, Yu, et al.
Published: (2025)
by: Wang, Yu, et al.
Published: (2025)
InjecAgent: Benchmarking Indirect Prompt Injections in Tool-Integrated Large Language Model Agents
by: Zhan, Qiusi, et al.
Published: (2024)
by: Zhan, Qiusi, et al.
Published: (2024)
VirtualCrime: Evaluating Criminal Potential of Large Language Models via Sandbox Simulation
by: Tang, Yilin, et al.
Published: (2026)
by: Tang, Yilin, et al.
Published: (2026)
Efficiently Train ASR Models that Memorize Less and Perform Better with Per-core Clipping
by: Wang, Lun, et al.
Published: (2024)
by: Wang, Lun, et al.
Published: (2024)
Unlocking Memorization in Large Language Models with Dynamic Soft Prompting
by: Wang, Zhepeng, et al.
Published: (2024)
by: Wang, Zhepeng, et al.
Published: (2024)
Research on Large Language Model Cross-Cloud Privacy Protection and Collaborative Training based on Federated Learning
by: Yang, Ze, et al.
Published: (2025)
by: Yang, Ze, et al.
Published: (2025)
Quantifying Memorization and Privacy Risks in Genomic Language Models
by: Nemecek, Alexander, et al.
Published: (2026)
by: Nemecek, Alexander, et al.
Published: (2026)
Consiglieres in the Shadow: Understanding the Use of Uncensored Large Language Models in Cybercrimes
by: Lin, Zilong, et al.
Published: (2025)
by: Lin, Zilong, et al.
Published: (2025)
Generalization or Memorization: Data Contamination and Trustworthy Evaluation for Large Language Models
by: Dong, Yihong, et al.
Published: (2024)
by: Dong, Yihong, et al.
Published: (2024)
VOW: Verifiable and Oblivious Watermark Detection for Large Language Models
by: Luan, Xiaokun, et al.
Published: (2026)
by: Luan, Xiaokun, et al.
Published: (2026)
Watermarking Text Data on Large Language Models for Dataset Copyright
by: Liu, Yixin, et al.
Published: (2023)
by: Liu, Yixin, et al.
Published: (2023)
A Practical and Privacy-Preserving Framework for Real-World Large Language Model Services
by: Mao, Yu, et al.
Published: (2024)
by: Mao, Yu, et al.
Published: (2024)
CPA-RAG:Covert Poisoning Attacks on Retrieval-Augmented Generation in Large Language Models
by: Li, Chunyang, et al.
Published: (2025)
by: Li, Chunyang, et al.
Published: (2025)
Permit: Permission-Aware Representation Intervention for Controlled Generation in Large Language Models
by: Sun, Pengcheng, et al.
Published: (2026)
by: Sun, Pengcheng, et al.
Published: (2026)
Performance Testing of ChaCha20-Poly1305 for Internet of Things and Industrial Control System Devices
by: Ragnarsson, Kristján Orri, et al.
Published: (2026)
by: Ragnarsson, Kristján Orri, et al.
Published: (2026)
An Inversion-based Measure of Memorization for Diffusion Models
by: Ma, Zhe, et al.
Published: (2024)
by: Ma, Zhe, et al.
Published: (2024)
A General Framework for Per-record Differential Privacy
by: Chen, Xinghe, et al.
Published: (2025)
by: Chen, Xinghe, et al.
Published: (2025)
Exploring Traffic Simulation and Cybersecurity Strategies Using Large Language Models
by: Gao, Lu, et al.
Published: (2025)
by: Gao, Lu, et al.
Published: (2025)
Risks of Practicing Large Language Models in Smart Grid: Threat Modeling and Validation
by: Li, Jiangnan, et al.
Published: (2024)
by: Li, Jiangnan, et al.
Published: (2024)
Merge Hijacking: Backdoor Attacks to Model Merging of Large Language Models
by: Yuan, Zenghui, et al.
Published: (2025)
by: Yuan, Zenghui, et al.
Published: (2025)
Towards Supporting Penetration Testing Education with Large Language Models: an Evaluation and Comparison
by: Nizon-Deladoeuille, Martin, et al.
Published: (2025)
by: Nizon-Deladoeuille, Martin, et al.
Published: (2025)
SafeBench: A Safety Evaluation Framework for Multimodal Large Language Models
by: Ying, Zonghao, et al.
Published: (2024)
by: Ying, Zonghao, et al.
Published: (2024)
Indirect Prompt Injection in the Wild: An Empirical Study of Prevalence, Techniques, and Objectives
by: Khodayari, Soheil, et al.
Published: (2026)
by: Khodayari, Soheil, et al.
Published: (2026)
VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities
by: Wang, Weizhe, et al.
Published: (2025)
by: Wang, Weizhe, et al.
Published: (2025)
A Resilient and Accessible Distribution-Preserving Watermark for Large Language Models
by: Wu, Yihan, et al.
Published: (2023)
by: Wu, Yihan, et al.
Published: (2023)
Winter Soldier: Backdooring Language Models at Pre-Training with Indirect Data Poisoning
by: Bouaziz, Wassim, et al.
Published: (2025)
by: Bouaziz, Wassim, et al.
Published: (2025)
PSY: Posterior Sampling Based Privacy Enhancer in Large Language Models
by: Sun, Yulian, et al.
Published: (2024)
by: Sun, Yulian, et al.
Published: (2024)
Similar Items
-
Exposing and Defending Membership Leakage in Vulnerability Prediction Models
by: Liao, Yihan, et al.
Published: (2025) -
Pop Quiz Attack: Black-box Membership Inference Attacks Against Large Language Models
by: Chen, Zeyuan, et al.
Published: (2026) -
Analyzing and Evaluating Unbiased Language Model Watermark
by: Wu, Yihan, et al.
Published: (2025) -
Hybrid Privacy Policy-Code Consistency Check using Knowledge Graphs and LLMs
by: Mao, Zhenyu, et al.
Published: (2025) -
Rethinking Backdoor Detection Evaluation for Language Models
by: Yan, Jun, et al.
Published: (2024)