PostMark: A Robust Blackbox Watermark for Large Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Chang, Yapei, Krishna, Kalpesh, Houmansadr, Amir, Wieting, John, Iyyer, Mohit |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
A Watermark for Black-Box Language Models
por: Bahri, Dara, et al.
Publicado: (2024)
por: Bahri, Dara, et al.
Publicado: (2024)
Mark Your LLM: Detecting the Misuse of Open-Source Large Language Models via Watermarking
por: Xu, Yijie, et al.
Publicado: (2025)
por: Xu, Yijie, et al.
Publicado: (2025)
GaussMark: A Practical Approach for Structural Watermarking of Language Models
por: Block, Adam, et al.
Publicado: (2025)
por: Block, Adam, et al.
Publicado: (2025)
AliMark: Enhancing Robustness of Sentence-Level Watermarking Against Text Paraphrasing
por: Li, Yuexin, et al.
Publicado: (2026)
por: Li, Yuexin, et al.
Publicado: (2026)
Mark My Words: Analyzing and Evaluating Language Model Watermarks
por: Piet, Julien, et al.
Publicado: (2023)
por: Piet, Julien, et al.
Publicado: (2023)
Duwak: Dual Watermarks in Large Language Models
por: Zhu, Chaoyi, et al.
Publicado: (2024)
por: Zhu, Chaoyi, et al.
Publicado: (2024)
Iteratively Prompting Multimodal LLMs to Reproduce Natural and AI-Generated Images
por: Naseh, Ali, et al.
Publicado: (2024)
por: Naseh, Ali, et al.
Publicado: (2024)
Watermarking Makes Language Models Radioactive
por: Sander, Tom, et al.
Publicado: (2024)
por: Sander, Tom, et al.
Publicado: (2024)
Provably Robust Watermarks for Open-Source Language Models
por: Christ, Miranda, et al.
Publicado: (2024)
por: Christ, Miranda, et al.
Publicado: (2024)
Backdooring Bias ($B^2$) into Stable Diffusion Models
por: Naseh, Ali, et al.
Publicado: (2024)
por: Naseh, Ali, et al.
Publicado: (2024)
CATMark: A Context-Aware Thresholding Framework for Robust Cross-Task Watermarking in Large Language Models
por: Zhang, Yu, et al.
Publicado: (2025)
por: Zhang, Yu, et al.
Publicado: (2025)
Watermark Stealing in Large Language Models
por: Jovanović, Nikola, et al.
Publicado: (2024)
por: Jovanović, Nikola, et al.
Publicado: (2024)
Can Large Language Models Really Recognize Your Name?
por: Pham, Dzung, et al.
Publicado: (2025)
por: Pham, Dzung, et al.
Publicado: (2025)
Learnable Linguistic Watermarks for Tracing Model Extraction Attacks on Large Language Models
por: Bai, Minhao, et al.
Publicado: (2024)
por: Bai, Minhao, et al.
Publicado: (2024)
Advancing Beyond Identification: Multi-bit Watermark for Large Language Models
por: Yoo, KiYoon, et al.
Publicado: (2023)
por: Yoo, KiYoon, et al.
Publicado: (2023)
Unforgeable Watermarks for Language Models via Robust Signatures
por: Lin, Huijia, et al.
Publicado: (2026)
por: Lin, Huijia, et al.
Publicado: (2026)
FIT to Forget: Robust Continual Unlearning for Large Language Models
por: Xu, Xiaoyu, et al.
Publicado: (2026)
por: Xu, Xiaoyu, et al.
Publicado: (2026)
OBLIVIATE: Robust and Practical Machine Unlearning for Large Language Models
por: Xu, Xiaoyu, et al.
Publicado: (2025)
por: Xu, Xiaoyu, et al.
Publicado: (2025)
Probing the Robustness of Large Language Models Safety to Latent Perturbations
por: Gu, Tianle, et al.
Publicado: (2025)
por: Gu, Tianle, et al.
Publicado: (2025)
Riddle Me This! Stealthy Membership Inference for Retrieval-Augmented Generation
por: Naseh, Ali, et al.
Publicado: (2025)
por: Naseh, Ali, et al.
Publicado: (2025)
Towards Robust Knowledge Unlearning: An Adversarial Framework for Assessing and Improving Unlearning Robustness in Large Language Models
por: Yuan, Hongbang, et al.
Publicado: (2024)
por: Yuan, Hongbang, et al.
Publicado: (2024)
Watermarking Language Models for Many Adaptive Users
por: Cohen, Aloni, et al.
Publicado: (2024)
por: Cohen, Aloni, et al.
Publicado: (2024)
Throttling Web Agents Using Reasoning Gates
por: Kumar, Abhinav, et al.
Publicado: (2025)
por: Kumar, Abhinav, et al.
Publicado: (2025)
OverThink: Slowdown Attacks on Reasoning LLMs
por: Kumar, Abhinav, et al.
Publicado: (2025)
por: Kumar, Abhinav, et al.
Publicado: (2025)
Building Intelligence Identification System via Large Language Model Watermarking: A Survey and Beyond
por: Wang, Xuhong, et al.
Publicado: (2024)
por: Wang, Xuhong, et al.
Publicado: (2024)
Invariant-based Robust Weights Watermark for Large Language Models
por: Guo, Qingxiao, et al.
Publicado: (2025)
por: Guo, Qingxiao, et al.
Publicado: (2025)
DMark: Order-Agnostic Watermarking for Diffusion Large Language Models
por: Wu, Linyu, et al.
Publicado: (2025)
por: Wu, Linyu, et al.
Publicado: (2025)
InvisMark: Invisible and Robust Watermarking for AI-generated Image Provenance
por: Xu, Rui, et al.
Publicado: (2024)
por: Xu, Rui, et al.
Publicado: (2024)
Multilingual and Multi-Accent Jailbreaking of Audio LLMs
por: Roh, Jaechul, et al.
Publicado: (2025)
por: Roh, Jaechul, et al.
Publicado: (2025)
Watermarking Diffusion Language Models
por: Gloaguen, Thibaud, et al.
Publicado: (2025)
por: Gloaguen, Thibaud, et al.
Publicado: (2025)
A High-Capacity and Secure Disambiguation Algorithm for Neural Linguistic Steganography
por: Feng, Yapei, et al.
Publicado: (2025)
por: Feng, Yapei, et al.
Publicado: (2025)
Functional Invariants to Watermark Large Transformers
por: Fernandez, Pierre, et al.
Publicado: (2023)
por: Fernandez, Pierre, et al.
Publicado: (2023)
Context-Aware Membership Inference Attacks against Pre-trained Large Language Models
por: Chang, Hongyan, et al.
Publicado: (2024)
por: Chang, Hongyan, et al.
Publicado: (2024)
EmMark: Robust Watermarks for IP Protection of Embedded Quantized Large Language Models
por: Zhang, Ruisi, et al.
Publicado: (2024)
por: Zhang, Ruisi, et al.
Publicado: (2024)
VideoMarkBench: Benchmarking Robustness of Video Watermarking
por: Jiang, Zhengyuan, et al.
Publicado: (2025)
por: Jiang, Zhengyuan, et al.
Publicado: (2025)
On Adversarial Robustness of Language Models in Transfer Learning
por: Turbal, Bohdan, et al.
Publicado: (2024)
por: Turbal, Bohdan, et al.
Publicado: (2024)
MarkTune: Improving the Quality-Detectability Trade-off in Open-Weight LLM Watermarking
por: Zhao, Yizhou, et al.
Publicado: (2025)
por: Zhao, Yizhou, et al.
Publicado: (2025)
FreeMark: A Non-Invasive White-Box Watermarking for Deep Neural Networks
por: Chen, Yuzhang, et al.
Publicado: (2024)
por: Chen, Yuzhang, et al.
Publicado: (2024)
Robust Distortion-free Watermarks for Language Models
por: Kuditipudi, Rohith, et al.
Publicado: (2023)
por: Kuditipudi, Rohith, et al.
Publicado: (2023)
Waterfall: Framework for Robust and Scalable Text Watermarking and Provenance for LLMs
por: Lau, Gregory Kang Ruey, et al.
Publicado: (2024)
por: Lau, Gregory Kang Ruey, et al.
Publicado: (2024)
Ejemplares similares
-
A Watermark for Black-Box Language Models
por: Bahri, Dara, et al.
Publicado: (2024) -
Mark Your LLM: Detecting the Misuse of Open-Source Large Language Models via Watermarking
por: Xu, Yijie, et al.
Publicado: (2025) -
GaussMark: A Practical Approach for Structural Watermarking of Language Models
por: Block, Adam, et al.
Publicado: (2025) -
AliMark: Enhancing Robustness of Sentence-Level Watermarking Against Text Paraphrasing
por: Li, Yuexin, et al.
Publicado: (2026) -
Mark My Words: Analyzing and Evaluating Language Model Watermarks
por: Piet, Julien, et al.
Publicado: (2023)