Hide and Seek: Fingerprinting Large Language Models with Evolutionary Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Iourovitski, Dmitri, Sharma, Sanat, Talwar, Rakshak |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Hide and Seek in Embedding Space: Geometry-based Steganography and Detection in Large Language Models
di: Westphal, Charles, et al.
Pubblicazione: (2026)
di: Westphal, Charles, et al.
Pubblicazione: (2026)
LLMmap: Fingerprinting For Large Language Models
di: Pasquini, Dario, et al.
Pubblicazione: (2024)
di: Pasquini, Dario, et al.
Pubblicazione: (2024)
Hide&Seek: Remove Image Watermarks with Negligible Cost via Pixel-wise Reconstruction
di: Chen, Huajie, et al.
Pubblicazione: (2026)
di: Chen, Huajie, et al.
Pubblicazione: (2026)
MEraser: An Effective Fingerprint Erasure Approach for Large Language Models
di: Zhang, Jingxuan, et al.
Pubblicazione: (2025)
di: Zhang, Jingxuan, et al.
Pubblicazione: (2025)
Hide Your Malicious Goal Into Benign Narratives: Jailbreak Large Language Models through Carrier Articles
di: Wang, Zhilong, et al.
Pubblicazione: (2024)
di: Wang, Zhilong, et al.
Pubblicazione: (2024)
EditMF: Drawing an Invisible Fingerprint for Your Large Language Models
di: Wu, Jiaxuan, et al.
Pubblicazione: (2025)
di: Wu, Jiaxuan, et al.
Pubblicazione: (2025)
CoTSRF: Utilize Chain of Thought as Stealthy and Robust Fingerprint of Large Language Models
di: Ren, Zhenzhen, et al.
Pubblicazione: (2025)
di: Ren, Zhenzhen, et al.
Pubblicazione: (2025)
A Behavioral Fingerprint for Large Language Models: Provenance Tracking via Refusal Vectors
di: Xu, Zhenyu, et al.
Pubblicazione: (2026)
di: Xu, Zhenyu, et al.
Pubblicazione: (2026)
DNF: Dual-Layer Nested Fingerprinting for Large Language Model Intellectual Property Protection
di: Xu, Zhenhua, et al.
Pubblicazione: (2026)
di: Xu, Zhenhua, et al.
Pubblicazione: (2026)
REEF: Representation Encoding Fingerprints for Large Language Models
di: Zhang, Jie, et al.
Pubblicazione: (2024)
di: Zhang, Jie, et al.
Pubblicazione: (2024)
FNF: Functional Network Fingerprint for Large Language Models
di: Liu, Yiheng, et al.
Pubblicazione: (2026)
di: Liu, Yiheng, et al.
Pubblicazione: (2026)
Hiding in Plain Sight: Detectability-Aware Antidistillation of Reasoning Models
di: Hartman, Max, et al.
Pubblicazione: (2026)
di: Hartman, Max, et al.
Pubblicazione: (2026)
StruPhantom: Evolutionary Injection Attacks on Black-Box Tabular Agents Powered by Large Language Models
di: Feng, Yang, et al.
Pubblicazione: (2025)
di: Feng, Yang, et al.
Pubblicazione: (2025)
Layerwise Convergence Fingerprints for Runtime Misbehavior Detection in Large Language Models
di: Min, Nay Myat, et al.
Pubblicazione: (2026)
di: Min, Nay Myat, et al.
Pubblicazione: (2026)
SoK: Large Language Model Copyright Auditing via Fingerprinting
di: Shao, Shuo, et al.
Pubblicazione: (2025)
di: Shao, Shuo, et al.
Pubblicazione: (2025)
ForgetMark: Stealthy Fingerprint Embedding via Targeted Unlearning in Language Models
di: Xu, Zhenhua, et al.
Pubblicazione: (2026)
di: Xu, Zhenhua, et al.
Pubblicazione: (2026)
Instructional Fingerprinting of Large Language Models
di: Xu, Jiashu, et al.
Pubblicazione: (2024)
di: Xu, Jiashu, et al.
Pubblicazione: (2024)
LLM-Virus: Evolutionary Jailbreak Attack on Large Language Models
di: Yu, Miao, et al.
Pubblicazione: (2024)
di: Yu, Miao, et al.
Pubblicazione: (2024)
ForgeDAN: An Evolutionary Framework for Jailbreaking Aligned Large Language Models
di: Cheng, Siyang, et al.
Pubblicazione: (2025)
di: Cheng, Siyang, et al.
Pubblicazione: (2025)
Hiding in Plain Sight: A Steganographic Approach to Stealthy LLM Jailbreaks
di: Geng, Jianing, et al.
Pubblicazione: (2025)
di: Geng, Jianing, et al.
Pubblicazione: (2025)
BAFFLE: Hiding Backdoors in Offline Reinforcement Learning Datasets
di: Gong, Chen, et al.
Pubblicazione: (2022)
di: Gong, Chen, et al.
Pubblicazione: (2022)
Decoding BACnet Packets: A Large Language Model Approach for Packet Interpretation
di: Sharma, Rashi, et al.
Pubblicazione: (2024)
di: Sharma, Rashi, et al.
Pubblicazione: (2024)
Defending Large Language Models Against Jailbreak Exploits with Responsible AI Considerations
di: Wong, Ryan, et al.
Pubblicazione: (2025)
di: Wong, Ryan, et al.
Pubblicazione: (2025)
Hey, That's My Model! Introducing Chain & Hash, An LLM Fingerprinting Technique
di: Russinovich, Mark, et al.
Pubblicazione: (2024)
di: Russinovich, Mark, et al.
Pubblicazione: (2024)
SeedPrints: Fingerprints Can Even Tell Which Seed Your Large Language Model Was Trained From
di: Tong, Yao, et al.
Pubblicazione: (2025)
di: Tong, Yao, et al.
Pubblicazione: (2025)
Towards Fine-Grained Webpage Fingerprinting at Scale
di: Zhao, Xiyuan, et al.
Pubblicazione: (2024)
di: Zhao, Xiyuan, et al.
Pubblicazione: (2024)
Towards Robust Multi-tab Website Fingerprinting
di: Deng, Xinhao, et al.
Pubblicazione: (2025)
di: Deng, Xinhao, et al.
Pubblicazione: (2025)
ELBA-Bench: An Efficient Learning Backdoor Attacks Benchmark for Large Language Models
di: Liu, Xuxu, et al.
Pubblicazione: (2025)
di: Liu, Xuxu, et al.
Pubblicazione: (2025)
Undetectable Backdoors in Model Parameters: Hiding Sparse Secrets in High Dimensions
di: Choudhary, Sarthak, et al.
Pubblicazione: (2026)
di: Choudhary, Sarthak, et al.
Pubblicazione: (2026)
Untraceable DeepFakes via Traceable Fingerprint Elimination
di: Lai, Jiewei, et al.
Pubblicazione: (2025)
di: Lai, Jiewei, et al.
Pubblicazione: (2025)
Fingerprinting Deep Learning Models via Network Traffic Patterns in Federated Learning
di: Shuvo, Md Nahid Hasan, et al.
Pubblicazione: (2025)
di: Shuvo, Md Nahid Hasan, et al.
Pubblicazione: (2025)
(Security) Assertions by Large Language Models
di: Kande, Rahul, et al.
Pubblicazione: (2023)
di: Kande, Rahul, et al.
Pubblicazione: (2023)
Backdooring Bias in Large Language Models
di: Das, Anudeep, et al.
Pubblicazione: (2026)
di: Das, Anudeep, et al.
Pubblicazione: (2026)
Evolutionary Trigger Detection and Lightweight Model Repair Based Backdoor Defense
di: Zhou, Qi, et al.
Pubblicazione: (2024)
di: Zhou, Qi, et al.
Pubblicazione: (2024)
Watermarking and Anomaly Detection in Machine Learning Models for LORA RF Fingerprinting
di: Mahajan, Aarushi, et al.
Pubblicazione: (2025)
di: Mahajan, Aarushi, et al.
Pubblicazione: (2025)
TinyGuard:A lightweight Byzantine Defense for Resource-Constrained Federated Learning via Statistical Update Fingerprints
di: Mahdavi, Ali, et al.
Pubblicazione: (2026)
di: Mahdavi, Ali, et al.
Pubblicazione: (2026)
FPEdit: Robust LLM Fingerprinting through Localized Parameter Editing
di: Wang, Shida, et al.
Pubblicazione: (2025)
di: Wang, Shida, et al.
Pubblicazione: (2025)
FDLLM: A Dedicated Detector for Black-Box LLMs Fingerprinting
di: Fu, Zhiyuan, et al.
Pubblicazione: (2025)
di: Fu, Zhiyuan, et al.
Pubblicazione: (2025)
Fingerprinting Deep Neural Networks for Ownership Protection: An Analytical Approach
di: Yang, Guang, et al.
Pubblicazione: (2026)
di: Yang, Guang, et al.
Pubblicazione: (2026)
iSeal: Encrypted Fingerprinting for Reliable LLM Ownership Verification
di: Xiong, Zixun, et al.
Pubblicazione: (2025)
di: Xiong, Zixun, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Hide and Seek in Embedding Space: Geometry-based Steganography and Detection in Large Language Models
di: Westphal, Charles, et al.
Pubblicazione: (2026) -
LLMmap: Fingerprinting For Large Language Models
di: Pasquini, Dario, et al.
Pubblicazione: (2024) -
Hide&Seek: Remove Image Watermarks with Negligible Cost via Pixel-wise Reconstruction
di: Chen, Huajie, et al.
Pubblicazione: (2026) -
MEraser: An Effective Fingerprint Erasure Approach for Large Language Models
di: Zhang, Jingxuan, et al.
Pubblicazione: (2025) -
Hide Your Malicious Goal Into Benign Narratives: Jailbreak Large Language Models through Carrier Articles
di: Wang, Zhilong, et al.
Pubblicazione: (2024)