ForgetMark: Stealthy Fingerprint Embedding via Targeted Unlearning in Language Models
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Xu, Zhenhua, Zhang, Haobo, Wang, Zhebo, Liu, Qichen, Xu, Haitao, Xing, Wenpeng, Han, Meng |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
EverTracer: Hunting Stolen Large Language Models via Stealthy and Robust Probabilistic Fingerprint
von: Xu, Zhenhua, et al.
Veröffentlicht: (2025)
von: Xu, Zhenhua, et al.
Veröffentlicht: (2025)
Fingerprint Vector: Enabling Scalable and Efficient Model Fingerprint Transfer via Vector Addition
von: Xu, Zhenhua, et al.
Veröffentlicht: (2024)
von: Xu, Zhenhua, et al.
Veröffentlicht: (2024)
MEraser: An Effective Fingerprint Erasure Approach for Large Language Models
von: Zhang, Jingxuan, et al.
Veröffentlicht: (2025)
von: Zhang, Jingxuan, et al.
Veröffentlicht: (2025)
PREE: Towards Harmless and Adaptive Fingerprint Editing in Large Language Models via Knowledge Prefix Enhancement
von: Yue, Xubin, et al.
Veröffentlicht: (2025)
von: Yue, Xubin, et al.
Veröffentlicht: (2025)
Copyright Protection for Large Language Models: A Survey of Methods, Challenges, and Trends
von: Xu, Zhenhua, et al.
Veröffentlicht: (2025)
von: Xu, Zhenhua, et al.
Veröffentlicht: (2025)
KinGuard: Hierarchical Kinship-Aware Fingerprinting to Defend Against Large Language Model Stealing
von: Xu, Zhenhua, et al.
Veröffentlicht: (2026)
von: Xu, Zhenhua, et al.
Veröffentlicht: (2026)
AttnDiff: Attention-based Differential Fingerprinting for Large Language Models
von: Zhang, Haobo, et al.
Veröffentlicht: (2026)
von: Zhang, Haobo, et al.
Veröffentlicht: (2026)
DNF: Dual-Layer Nested Fingerprinting for Large Language Model Intellectual Property Protection
von: Xu, Zhenhua, et al.
Veröffentlicht: (2026)
von: Xu, Zhenhua, et al.
Veröffentlicht: (2026)
Unlocking the Effectiveness of LoRA-FP for Seamless Transfer Implantation of Fingerprints in Downstream Models
von: Xu, Zhenhua, et al.
Veröffentlicht: (2025)
von: Xu, Zhenhua, et al.
Veröffentlicht: (2025)
CoTSRF: Utilize Chain of Thought as Stealthy and Robust Fingerprint of Large Language Models
von: Ren, Zhenzhen, et al.
Veröffentlicht: (2025)
von: Ren, Zhenzhen, et al.
Veröffentlicht: (2025)
Temporal UI State Inconsistency in Desktop GUI Agents: Formalizing and Defending Against TOCTOU Attacks on Computer-Use Agents
von: Xu, Wenpeng
Veröffentlicht: (2026)
von: Xu, Wenpeng
Veröffentlicht: (2026)
Towards Backdoor Stealthiness in Model Parameter Space
von: Xu, Xiaoyun, et al.
Veröffentlicht: (2025)
von: Xu, Xiaoyun, et al.
Veröffentlicht: (2025)
Latent Fusion Jailbreak: Blending Harmful and Harmless Representations to Elicit Unsafe LLM Outputs
von: Xing, Wenpeng, et al.
Veröffentlicht: (2025)
von: Xing, Wenpeng, et al.
Veröffentlicht: (2025)
FIT to Forget: Robust Continual Unlearning for Large Language Models
von: Xu, Xiaoyu, et al.
Veröffentlicht: (2026)
von: Xu, Xiaoyu, et al.
Veröffentlicht: (2026)
A Behavioral Fingerprint for Large Language Models: Provenance Tracking via Refusal Vectors
von: Xu, Zhenyu, et al.
Veröffentlicht: (2026)
von: Xu, Zhenyu, et al.
Veröffentlicht: (2026)
Forget to Flourish: Leveraging Machine-Unlearning on Pretrained Language Models for Privacy Leakage
von: Rashid, Md Rafi Ur, et al.
Veröffentlicht: (2024)
von: Rashid, Md Rafi Ur, et al.
Veröffentlicht: (2024)
Towards Robust and Secure Embodied AI: A Survey on Vulnerabilities and Attacks
von: Xing, Wenpeng, et al.
Veröffentlicht: (2025)
von: Xing, Wenpeng, et al.
Veröffentlicht: (2025)
MalURLBench: A Benchmark Evaluating Agents' Vulnerabilities When Processing Web URLs
von: Kong, Dezhang, et al.
Veröffentlicht: (2026)
von: Kong, Dezhang, et al.
Veröffentlicht: (2026)
Cordon-MAS: Defending RAG against Knowledge Poisoning via Information-Flow Control
von: Yu, Zhe, et al.
Veröffentlicht: (2026)
von: Yu, Zhe, et al.
Veröffentlicht: (2026)
Towards Effective, Stealthy, and Persistent Backdoor Attacks Targeting Graph Foundation Models
von: Luo, Jiayi, et al.
Veröffentlicht: (2025)
von: Luo, Jiayi, et al.
Veröffentlicht: (2025)
OptMark: Robust Multi-bit Diffusion Watermarking via Inference Time Optimization
von: Xing, Jiazheng, et al.
Veröffentlicht: (2025)
von: Xing, Jiazheng, et al.
Veröffentlicht: (2025)
Trojan's Whisper: Stealthy Manipulation of OpenClaw through Injected Bootstrapped Guidance
von: Liu, Fazhong, et al.
Veröffentlicht: (2026)
von: Liu, Fazhong, et al.
Veröffentlicht: (2026)
SilentDrift: Exploiting Action Chunking for Stealthy Backdoor Attacks on Vision-Language-Action Models
von: Xu, Bingxin, et al.
Veröffentlicht: (2026)
von: Xu, Bingxin, et al.
Veröffentlicht: (2026)
ACU: Analytic Continual Unlearning for Efficient and Exact Forgetting with Privacy Preservation
von: Tang, Jianheng, et al.
Veröffentlicht: (2025)
von: Tang, Jianheng, et al.
Veröffentlicht: (2025)
Stealthy Backdoor Attack via Confidence-driven Sampling
von: He, Pengfei, et al.
Veröffentlicht: (2023)
von: He, Pengfei, et al.
Veröffentlicht: (2023)
Shadowcast: Stealthy Data Poisoning Attacks Against Vision-Language Models
von: Xu, Yuancheng, et al.
Veröffentlicht: (2024)
von: Xu, Yuancheng, et al.
Veröffentlicht: (2024)
Data Unlearning Beyond Uniform Forgetting via Diffusion Time and Frequency Selection
von: Park, Jinseong, et al.
Veröffentlicht: (2025)
von: Park, Jinseong, et al.
Veröffentlicht: (2025)
LLMmap: Fingerprinting For Large Language Models
von: Pasquini, Dario, et al.
Veröffentlicht: (2024)
von: Pasquini, Dario, et al.
Veröffentlicht: (2024)
Forgetting-MarI: LLM Unlearning via Marginal Information Regularization
von: Xu, Shizhou, et al.
Veröffentlicht: (2025)
von: Xu, Shizhou, et al.
Veröffentlicht: (2025)
StealthInk: A Multi-bit and Stealthy Watermark for Large Language Models
von: Jiang, Ya, et al.
Veröffentlicht: (2025)
von: Jiang, Ya, et al.
Veröffentlicht: (2025)
Stealthy and Persistent Unalignment on Large Language Models via Backdoor Injections
von: Cao, Yuanpu, et al.
Veröffentlicht: (2023)
von: Cao, Yuanpu, et al.
Veröffentlicht: (2023)
Don't Forget Too Much: Towards Machine Unlearning on Feature Level
von: Xu, Heng, et al.
Veröffentlicht: (2024)
von: Xu, Heng, et al.
Veröffentlicht: (2024)
Stealthy Backdoor Attack to Real-world Models in Android Apps
von: Wei, Jiali, et al.
Veröffentlicht: (2025)
von: Wei, Jiali, et al.
Veröffentlicht: (2025)
Towards Robust Multi-tab Website Fingerprinting
von: Deng, Xinhao, et al.
Veröffentlicht: (2025)
von: Deng, Xinhao, et al.
Veröffentlicht: (2025)
Beyond Max Tokens: Stealthy Resource Amplification via Tool Calling Chains in LLM Agents
von: Zhou, Kaiyu, et al.
Veröffentlicht: (2026)
von: Zhou, Kaiyu, et al.
Veröffentlicht: (2026)
MCP-Guard: A Multi-Stage Defense-in-Depth Framework for Securing Model Context Protocol in Agentic AI
von: Xing, Wenpeng, et al.
Veröffentlicht: (2025)
von: Xing, Wenpeng, et al.
Veröffentlicht: (2025)
Stealthy Targeted Backdoor Attacks against Image Captioning
von: Fan, Wenshu, et al.
Veröffentlicht: (2024)
von: Fan, Wenshu, et al.
Veröffentlicht: (2024)
Towards Fine-Grained Webpage Fingerprinting at Scale
von: Zhao, Xiyuan, et al.
Veröffentlicht: (2024)
von: Zhao, Xiyuan, et al.
Veröffentlicht: (2024)
FPEdit: Robust LLM Fingerprinting through Localized Parameter Editing
von: Wang, Shida, et al.
Veröffentlicht: (2025)
von: Wang, Shida, et al.
Veröffentlicht: (2025)
Transferable & Stealthy Ensemble Attacks: A Black-Box Jailbreaking Framework for Large Language Models
von: Yang, Yiqi, et al.
Veröffentlicht: (2024)
von: Yang, Yiqi, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
EverTracer: Hunting Stolen Large Language Models via Stealthy and Robust Probabilistic Fingerprint
von: Xu, Zhenhua, et al.
Veröffentlicht: (2025) -
Fingerprint Vector: Enabling Scalable and Efficient Model Fingerprint Transfer via Vector Addition
von: Xu, Zhenhua, et al.
Veröffentlicht: (2024) -
MEraser: An Effective Fingerprint Erasure Approach for Large Language Models
von: Zhang, Jingxuan, et al.
Veröffentlicht: (2025) -
PREE: Towards Harmless and Adaptive Fingerprint Editing in Large Language Models via Knowledge Prefix Enhancement
von: Yue, Xubin, et al.
Veröffentlicht: (2025) -
Copyright Protection for Large Language Models: A Survey of Methods, Challenges, and Trends
von: Xu, Zhenhua, et al.
Veröffentlicht: (2025)