De-Anonymization at Scale via Tournament-Style Attribution
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Lirui, Zhang, Huishuai |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
IncogniText: Privacy-enhancing Conditional Text Anonymization via LLM-based Private Attribute Randomization
di: Frikha, Ahmed, et al.
Pubblicazione: (2024)
di: Frikha, Ahmed, et al.
Pubblicazione: (2024)
Towards the Anonymization of the Language Modeling
di: Boutet, Antoine, et al.
Pubblicazione: (2025)
di: Boutet, Antoine, et al.
Pubblicazione: (2025)
Privacy-Preserving Synthetic Review Generation with Diverse Writing Styles Using LLMs
di: Atwal, Tevin, et al.
Pubblicazione: (2025)
di: Atwal, Tevin, et al.
Pubblicazione: (2025)
RAT-Bench: A Comprehensive Benchmark for Text Anonymization
di: Krčo, Nataša, et al.
Pubblicazione: (2026)
di: Krčo, Nataša, et al.
Pubblicazione: (2026)
Two Birds with One Stone: Multi-Task Detection and Attribution of LLM-Generated Text
di: Rao, Zixin, et al.
Pubblicazione: (2025)
di: Rao, Zixin, et al.
Pubblicazione: (2025)
SecFormer: Fast and Accurate Privacy-Preserving Inference for Transformer Models via SMPC
di: Luo, Jinglong, et al.
Pubblicazione: (2024)
di: Luo, Jinglong, et al.
Pubblicazione: (2024)
Adaptive Pre-training Data Detection for Large Language Models via Surprising Tokens
di: Zhang, Anqi, et al.
Pubblicazione: (2024)
di: Zhang, Anqi, et al.
Pubblicazione: (2024)
Time Will Tell: Timing Side Channels via Output Token Count in Large Language Models
di: Zhang, Tianchen, et al.
Pubblicazione: (2024)
di: Zhang, Tianchen, et al.
Pubblicazione: (2024)
Robust and Secure Code Watermarking for Large Language Models via ML/Crypto Codesign
di: Zhang, Ruisi, et al.
Pubblicazione: (2025)
di: Zhang, Ruisi, et al.
Pubblicazione: (2025)
Assessing Deanonymization Risks with Stylometry-Assisted LLM Agent
di: Zhang, Boyang, et al.
Pubblicazione: (2026)
di: Zhang, Boyang, et al.
Pubblicazione: (2026)
Adversarial Decoding: Generating Readable Documents for Adversarial Objectives
di: Zhang, Collin, et al.
Pubblicazione: (2024)
di: Zhang, Collin, et al.
Pubblicazione: (2024)
SecureNet: A Comparative Study of DeBERTa and Large Language Models for Phishing Detection
di: Mahendru, Sakshi, et al.
Pubblicazione: (2024)
di: Mahendru, Sakshi, et al.
Pubblicazione: (2024)
Prompt Public Large Language Models to Synthesize Data for Private On-device Applications
di: Wu, Shanshan, et al.
Pubblicazione: (2024)
di: Wu, Shanshan, et al.
Pubblicazione: (2024)
VERA: Variational Inference Framework for Jailbreaking Large Language Models
di: Lochab, Anamika, et al.
Pubblicazione: (2025)
di: Lochab, Anamika, et al.
Pubblicazione: (2025)
SteganoBackdoor: Stealthy and Data-Efficient Backdoor Attacks on Language Models
di: Xue, Eric, et al.
Pubblicazione: (2025)
di: Xue, Eric, et al.
Pubblicazione: (2025)
LLM Unlearning Should Be Form-Independent
di: Ye, Xiaotian, et al.
Pubblicazione: (2025)
di: Ye, Xiaotian, et al.
Pubblicazione: (2025)
FreqMark: Frequency-Based Watermark for Sentence-Level Detection of LLM-Generated Text
di: Xu, Zhenyu, et al.
Pubblicazione: (2024)
di: Xu, Zhenyu, et al.
Pubblicazione: (2024)
PVMark: Enabling Public Verifiability for LLM Watermarking Schemes
di: Duan, Haohua, et al.
Pubblicazione: (2025)
di: Duan, Haohua, et al.
Pubblicazione: (2025)
Blind Baselines Beat Membership Inference Attacks for Foundation Models
di: Das, Debeshee, et al.
Pubblicazione: (2024)
di: Das, Debeshee, et al.
Pubblicazione: (2024)
Membership Inference Attacks and Privacy in Topic Modeling
di: Manzonelli, Nico, et al.
Pubblicazione: (2024)
di: Manzonelli, Nico, et al.
Pubblicazione: (2024)
UCD: Unlearning in LLMs via Contrastive Decoding
di: Suriyakumar, Vinith M., et al.
Pubblicazione: (2025)
di: Suriyakumar, Vinith M., et al.
Pubblicazione: (2025)
Debiasing Watermarks for Large Language Models via Maximal Coupling
di: Xie, Yangxinyu, et al.
Pubblicazione: (2024)
di: Xie, Yangxinyu, et al.
Pubblicazione: (2024)
Multi-Trigger Poisoning Amplifies Backdoor Vulnerabilities in LLMs
di: Sivapiromrat, Sanhanat, et al.
Pubblicazione: (2025)
di: Sivapiromrat, Sanhanat, et al.
Pubblicazione: (2025)
MPAT: Building Robust Deep Neural Networks against Textual Adversarial Attacks
di: Zhang, Fangyuan, et al.
Pubblicazione: (2024)
di: Zhang, Fangyuan, et al.
Pubblicazione: (2024)
Localizing Paragraph Memorization in Language Models
di: Stoehr, Niklas, et al.
Pubblicazione: (2024)
di: Stoehr, Niklas, et al.
Pubblicazione: (2024)
SOS! Soft Prompt Attack Against Open-Source Large Language Models
di: Yang, Ziqing, et al.
Pubblicazione: (2024)
di: Yang, Ziqing, et al.
Pubblicazione: (2024)
Differentially Private Knowledge Distillation via Synthetic Text Generation
di: Flemings, James, et al.
Pubblicazione: (2024)
di: Flemings, James, et al.
Pubblicazione: (2024)
Copyright-Protected Language Generation via Adaptive Model Fusion
di: Abad, Javier, et al.
Pubblicazione: (2024)
di: Abad, Javier, et al.
Pubblicazione: (2024)
Robust LLM safeguarding via refusal feature adversarial training
di: Yu, Lei, et al.
Pubblicazione: (2024)
di: Yu, Lei, et al.
Pubblicazione: (2024)
Hijacking Large Language Models via Adversarial In-Context Learning
di: Zhou, Xiangyu, et al.
Pubblicazione: (2023)
di: Zhou, Xiangyu, et al.
Pubblicazione: (2023)
Detecting and Understanding Vulnerabilities in Language Models via Mechanistic Interpretability
di: García-Carrasco, Jorge, et al.
Pubblicazione: (2024)
di: García-Carrasco, Jorge, et al.
Pubblicazione: (2024)
ProTransformer: Robustify Transformers via Plug-and-Play Paradigm
di: Hou, Zhichao, et al.
Pubblicazione: (2024)
di: Hou, Zhichao, et al.
Pubblicazione: (2024)
Proving membership in LLM pretraining data via data watermarks
di: Wei, Johnny Tian-Zheng, et al.
Pubblicazione: (2024)
di: Wei, Johnny Tian-Zheng, et al.
Pubblicazione: (2024)
AutoDefense: Multi-Agent LLM Defense against Jailbreak Attacks
di: Zeng, Yifan, et al.
Pubblicazione: (2024)
di: Zeng, Yifan, et al.
Pubblicazione: (2024)
A Resilient and Accessible Distribution-Preserving Watermark for Large Language Models
di: Wu, Yihan, et al.
Pubblicazione: (2023)
di: Wu, Yihan, et al.
Pubblicazione: (2023)
Reformulation is All You Need: Addressing Malicious Text Features in DNNs
di: Jiang, Yi, et al.
Pubblicazione: (2025)
di: Jiang, Yi, et al.
Pubblicazione: (2025)
Composite Backdoor Attacks Against Large Language Models
di: Huang, Hai, et al.
Pubblicazione: (2023)
di: Huang, Hai, et al.
Pubblicazione: (2023)
LiSA: Lifelong Safety Adaptation via Conservative Policy Induction
di: Kim, Minbeom, et al.
Pubblicazione: (2026)
di: Kim, Minbeom, et al.
Pubblicazione: (2026)
Deciphering the Chaos: Enhancing Jailbreak Attacks via Adversarial Prompt Translation
di: Li, Qizhang, et al.
Pubblicazione: (2024)
di: Li, Qizhang, et al.
Pubblicazione: (2024)
Cross-Entropy Attacks to Language Models via Rare Event Simulation
di: Ni, Mingze, et al.
Pubblicazione: (2025)
di: Ni, Mingze, et al.
Pubblicazione: (2025)
Documenti analoghi
-
IncogniText: Privacy-enhancing Conditional Text Anonymization via LLM-based Private Attribute Randomization
di: Frikha, Ahmed, et al.
Pubblicazione: (2024) -
Towards the Anonymization of the Language Modeling
di: Boutet, Antoine, et al.
Pubblicazione: (2025) -
Privacy-Preserving Synthetic Review Generation with Diverse Writing Styles Using LLMs
di: Atwal, Tevin, et al.
Pubblicazione: (2025) -
RAT-Bench: A Comprehensive Benchmark for Text Anonymization
di: Krčo, Nataša, et al.
Pubblicazione: (2026) -
Two Birds with One Stone: Multi-Task Detection and Attribution of LLM-Generated Text
di: Rao, Zixin, et al.
Pubblicazione: (2025)