Watermarking Language Models for Many Adaptive Users
Fuente:
arXiv
Guardado en:
| Autores principales: | Cohen, Aloni, Hoover, Alexander, Schoenbach, Gabe |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Provably Robust Watermarks for Open-Source Language Models
por: Christ, Miranda, et al.
Publicado: (2024)
por: Christ, Miranda, et al.
Publicado: (2024)
Mark My Words: Analyzing and Evaluating Language Model Watermarks
por: Piet, Julien, et al.
Publicado: (2023)
por: Piet, Julien, et al.
Publicado: (2023)
Learnable Linguistic Watermarks for Tracing Model Extraction Attacks on Large Language Models
por: Bai, Minhao, et al.
Publicado: (2024)
por: Bai, Minhao, et al.
Publicado: (2024)
Advancing Beyond Identification: Multi-bit Watermark for Large Language Models
por: Yoo, KiYoon, et al.
Publicado: (2023)
por: Yoo, KiYoon, et al.
Publicado: (2023)
NSmark: Null Space Based Black-box Watermarking Defense Framework for Language Models
por: Zhao, Haodong, et al.
Publicado: (2024)
por: Zhao, Haodong, et al.
Publicado: (2024)
GaussMark: A Practical Approach for Structural Watermarking of Language Models
por: Block, Adam, et al.
Publicado: (2025)
por: Block, Adam, et al.
Publicado: (2025)
Building Intelligence Identification System via Large Language Model Watermarking: A Survey and Beyond
por: Wang, Xuhong, et al.
Publicado: (2024)
por: Wang, Xuhong, et al.
Publicado: (2024)
Watermarking Makes Language Models Radioactive
por: Sander, Tom, et al.
Publicado: (2024)
por: Sander, Tom, et al.
Publicado: (2024)
CATMark: A Context-Aware Thresholding Framework for Robust Cross-Task Watermarking in Large Language Models
por: Zhang, Yu, et al.
Publicado: (2025)
por: Zhang, Yu, et al.
Publicado: (2025)
Duwak: Dual Watermarks in Large Language Models
por: Zhu, Chaoyi, et al.
Publicado: (2024)
por: Zhu, Chaoyi, et al.
Publicado: (2024)
Functional Invariants to Watermark Large Transformers
por: Fernandez, Pierre, et al.
Publicado: (2023)
por: Fernandez, Pierre, et al.
Publicado: (2023)
Blameless Users in a Clean Room: Defining Copyright Protection for Generative Models
por: Cohen, Aloni
Publicado: (2025)
por: Cohen, Aloni
Publicado: (2025)
SSG: Logit-Balanced Vocabulary Partitioning for LLM Watermarking
por: Gu, Chenxi, et al.
Publicado: (2026)
por: Gu, Chenxi, et al.
Publicado: (2026)
PostMark: A Robust Blackbox Watermark for Large Language Models
por: Chang, Yapei, et al.
Publicado: (2024)
por: Chang, Yapei, et al.
Publicado: (2024)
PoisonBench: Assessing Large Language Model Vulnerability to Data Poisoning
por: Fu, Tingchen, et al.
Publicado: (2024)
por: Fu, Tingchen, et al.
Publicado: (2024)
Waterfall: Framework for Robust and Scalable Text Watermarking and Provenance for LLMs
por: Lau, Gregory Kang Ruey, et al.
Publicado: (2024)
por: Lau, Gregory Kang Ruey, et al.
Publicado: (2024)
Less is More: Sparse Watermarking in LLMs with Enhanced Text Quality
por: Hoang, Duy C., et al.
Publicado: (2024)
por: Hoang, Duy C., et al.
Publicado: (2024)
XMark: Reliable Multi-Bit Watermarking for LLM-Generated Texts
por: Xu, Jiahao, et al.
Publicado: (2026)
por: Xu, Jiahao, et al.
Publicado: (2026)
SAMark: A Self-Anchored Text Watermarking with Paragraph-Level Paraphrase Robustness
por: Huo, Jiahao, et al.
Publicado: (2026)
por: Huo, Jiahao, et al.
Publicado: (2026)
Mark Your LLM: Detecting the Misuse of Open-Source Large Language Models via Watermarking
por: Xu, Yijie, et al.
Publicado: (2025)
por: Xu, Yijie, et al.
Publicado: (2025)
Beyond Context: Large Language Models' Failure to Grasp Users' Intent
por: Hussain, Ahmed M., et al.
Publicado: (2025)
por: Hussain, Ahmed M., et al.
Publicado: (2025)
SWAN: Semantic Watermarking with Abstract Meaning Representation
por: Ye, Ziping, et al.
Publicado: (2026)
por: Ye, Ziping, et al.
Publicado: (2026)
Optimizing Adaptive Attacks against Watermarks for Language Models
por: Diaa, Abdulrahman, et al.
Publicado: (2024)
por: Diaa, Abdulrahman, et al.
Publicado: (2024)
Reverse-Engineering Model Editing on Language Models
por: Sun, Zhiyu, et al.
Publicado: (2026)
por: Sun, Zhiyu, et al.
Publicado: (2026)
Watermarking Discrete Diffusion Language Models
por: Bagchi, Avi, et al.
Publicado: (2025)
por: Bagchi, Avi, et al.
Publicado: (2025)
Resource Consumption Threats in Large Language Models
por: Zhang, Yuanhe, et al.
Publicado: (2026)
por: Zhang, Yuanhe, et al.
Publicado: (2026)
Imperceptible Jailbreaking against Large Language Models
por: Gao, Kuofeng, et al.
Publicado: (2025)
por: Gao, Kuofeng, et al.
Publicado: (2025)
Toward Cybersecurity-Expert Small Language Models
por: Levi, Matan, et al.
Publicado: (2025)
por: Levi, Matan, et al.
Publicado: (2025)
No Attacker Needed: Unintentional Cross-User Contamination in Shared-State LLM Agents
por: Yang, Tiankai, et al.
Publicado: (2026)
por: Yang, Tiankai, et al.
Publicado: (2026)
Protecting Users From Themselves: Safeguarding Contextual Privacy in Interactions with Conversational Agents
por: Ngong, Ivoline, et al.
Publicado: (2025)
por: Ngong, Ivoline, et al.
Publicado: (2025)
RedAgent: Red Teaming Large Language Models with Context-aware Autonomous Language Agent
por: Xu, Huiyu, et al.
Publicado: (2024)
por: Xu, Huiyu, et al.
Publicado: (2024)
The Dark Side of Human Feedback: Poisoning Large Language Models via User Inputs
por: Chen, Bocheng, et al.
Publicado: (2024)
por: Chen, Bocheng, et al.
Publicado: (2024)
Downstream Trade-offs of a Family of Text Watermarks
por: Ajith, Anirudh, et al.
Publicado: (2023)
por: Ajith, Anirudh, et al.
Publicado: (2023)
REEF: Representation Encoding Fingerprints for Large Language Models
por: Zhang, Jie, et al.
Publicado: (2024)
por: Zhang, Jie, et al.
Publicado: (2024)
Distract Large Language Models for Automatic Jailbreak Attack
por: Xiao, Zeguan, et al.
Publicado: (2024)
por: Xiao, Zeguan, et al.
Publicado: (2024)
Text Embedding Inversion Security for Multilingual Language Models
por: Chen, Yiyi, et al.
Publicado: (2024)
por: Chen, Yiyi, et al.
Publicado: (2024)
Jailbreaking Large Language Models Through Content Concretization
por: Wahréus, Johan, et al.
Publicado: (2025)
por: Wahréus, Johan, et al.
Publicado: (2025)
PRISON: Unmasking the Criminal Potential of Large Language Models
por: Wu, Xinyi, et al.
Publicado: (2025)
por: Wu, Xinyi, et al.
Publicado: (2025)
FNF: Functional Network Fingerprint for Large Language Models
por: Liu, Yiheng, et al.
Publicado: (2026)
por: Liu, Yiheng, et al.
Publicado: (2026)
Internal Safety Collapse in Frontier Large Language Models
por: Wu, Yutao, et al.
Publicado: (2026)
por: Wu, Yutao, et al.
Publicado: (2026)
Ejemplares similares
-
Provably Robust Watermarks for Open-Source Language Models
por: Christ, Miranda, et al.
Publicado: (2024) -
Mark My Words: Analyzing and Evaluating Language Model Watermarks
por: Piet, Julien, et al.
Publicado: (2023) -
Learnable Linguistic Watermarks for Tracing Model Extraction Attacks on Large Language Models
por: Bai, Minhao, et al.
Publicado: (2024) -
Advancing Beyond Identification: Multi-bit Watermark for Large Language Models
por: Yoo, KiYoon, et al.
Publicado: (2023) -
NSmark: Null Space Based Black-box Watermarking Defense Framework for Language Models
por: Zhao, Haodong, et al.
Publicado: (2024)