Task-Agnostic Language Model Watermarking via High Entropy Passthrough Layers
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Masrani, Vaden, Akbari, Mohammad, Yue, David Ming Xuan, Rezaei, Ahmad, Zhang, Yong |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
GOLD: Generalized Knowledge Distillation via Out-of-Distribution-Guided Language Data Generation
von: Gholami, Mohsen, et al.
Veröffentlicht: (2024)
von: Gholami, Mohsen, et al.
Veröffentlicht: (2024)
A Watermark for Order-Agnostic Language Models
von: Chen, Ruibo, et al.
Veröffentlicht: (2024)
von: Chen, Ruibo, et al.
Veröffentlicht: (2024)
LaWa: Using Latent Space for In-Generation Image Watermarking
von: Rezaei, Ahmad, et al.
Veröffentlicht: (2024)
von: Rezaei, Ahmad, et al.
Veröffentlicht: (2024)
Making Language Models Robust Against Negation
von: Rezaei, MohammadHossein, et al.
Veröffentlicht: (2025)
von: Rezaei, MohammadHossein, et al.
Veröffentlicht: (2025)
Multilingual Contrastive Decoding via Language-Agnostic Layers Skipping
von: Zhu, Wenhao, et al.
Veröffentlicht: (2024)
von: Zhu, Wenhao, et al.
Veröffentlicht: (2024)
AMUSE: Adaptive Multi-Segment Encoding for Dataset Watermarking
von: Alvar, Saeed Ranjbar, et al.
Veröffentlicht: (2024)
von: Alvar, Saeed Ranjbar, et al.
Veröffentlicht: (2024)
Meta-Prompting: Enhancing Language Models with Task-Agnostic Scaffolding
von: Suzgun, Mirac, et al.
Veröffentlicht: (2024)
von: Suzgun, Mirac, et al.
Veröffentlicht: (2024)
An Entropy-based Text Watermarking Detection Method
von: Lu, Yijian, et al.
Veröffentlicht: (2024)
von: Lu, Yijian, et al.
Veröffentlicht: (2024)
Watermarks for Language Models via Probabilistic Automata
von: Wang, Yangkun, et al.
Veröffentlicht: (2025)
von: Wang, Yangkun, et al.
Veröffentlicht: (2025)
Publicly-Detectable Watermarking for Language Models
von: Fairoze, Jaiden, et al.
Veröffentlicht: (2023)
von: Fairoze, Jaiden, et al.
Veröffentlicht: (2023)
Task Calibration: Calibrating Large Language Models on Inference Tasks
von: Li, Yingjie, et al.
Veröffentlicht: (2024)
von: Li, Yingjie, et al.
Veröffentlicht: (2024)
Invisible Entropy: Towards Safe and Efficient Low-Entropy LLM Watermarking
von: Gu, Tianle, et al.
Veröffentlicht: (2025)
von: Gu, Tianle, et al.
Veröffentlicht: (2025)
HATS: High-Accuracy Triple-Set Watermarking for Large Language Models
von: Hu, Zhiqing, et al.
Veröffentlicht: (2025)
von: Hu, Zhiqing, et al.
Veröffentlicht: (2025)
GumbelSoft: Diversified Language Model Watermarking via the GumbelMax-trick
von: Fu, Jiayi, et al.
Veröffentlicht: (2024)
von: Fu, Jiayi, et al.
Veröffentlicht: (2024)
Stylometric Watermarks for Large Language Models
von: Niess, Georg, et al.
Veröffentlicht: (2024)
von: Niess, Georg, et al.
Veröffentlicht: (2024)
Ensemble Watermarks for Large Language Models
von: Niess, Georg, et al.
Veröffentlicht: (2024)
von: Niess, Georg, et al.
Veröffentlicht: (2024)
In-Context Watermarks for Large Language Models
von: Liu, Yepeng, et al.
Veröffentlicht: (2025)
von: Liu, Yepeng, et al.
Veröffentlicht: (2025)
FamiCom: Further Demystifying Prompts for Language Models with Task-Agnostic Performance Estimation
von: Li, Bangzheng, et al.
Veröffentlicht: (2024)
von: Li, Bangzheng, et al.
Veröffentlicht: (2024)
Adaptive Text Watermark for Large Language Models
von: Liu, Yepeng, et al.
Veröffentlicht: (2024)
von: Liu, Yepeng, et al.
Veröffentlicht: (2024)
Improved Unbiased Watermark for Large Language Models
von: Chen, Ruibo, et al.
Veröffentlicht: (2025)
von: Chen, Ruibo, et al.
Veröffentlicht: (2025)
Spatial Reasoning with Vision-Language Models in Ego-Centric Multi-View Scenes
von: Gholami, Mohsen, et al.
Veröffentlicht: (2025)
von: Gholami, Mohsen, et al.
Veröffentlicht: (2025)
Yet Another Watermark for Large Language Models
von: Bao, Siyuan, et al.
Veröffentlicht: (2025)
von: Bao, Siyuan, et al.
Veröffentlicht: (2025)
Task-Agnostic Structured Pruning of Speech Representation Models
von: Wang, Haoyu, et al.
Veröffentlicht: (2023)
von: Wang, Haoyu, et al.
Veröffentlicht: (2023)
More Haste, Less Speed: Weaker Single-Layer Watermark Improves Distortion-Free Watermark Ensembles
von: Chen, Ruibo, et al.
Veröffentlicht: (2026)
von: Chen, Ruibo, et al.
Veröffentlicht: (2026)
Leave No TRACE: Black-box Detection of Copyrighted Dataset Usage in Large Language Models via Watermarking
von: Zhang, Jingqi, et al.
Veröffentlicht: (2025)
von: Zhang, Jingqi, et al.
Veröffentlicht: (2025)
Exa-PSD: a new Persian sentiment analysis dataset on Twitter
von: Ghaderi, Seyed Himan, et al.
Veröffentlicht: (2026)
von: Ghaderi, Seyed Himan, et al.
Veröffentlicht: (2026)
Debiasing Watermarks for Large Language Models via Maximal Coupling
von: Xie, Yangxinyu, et al.
Veröffentlicht: (2024)
von: Xie, Yangxinyu, et al.
Veröffentlicht: (2024)
REFINE-AF: A Task-Agnostic Framework to Align Language Models via Self-Generated Instructions using Reinforcement Learning from Automated Feedback
von: Roy, Aniruddha, et al.
Veröffentlicht: (2025)
von: Roy, Aniruddha, et al.
Veröffentlicht: (2025)
CATMark: A Context-Aware Thresholding Framework for Robust Cross-Task Watermarking in Large Language Models
von: Zhang, Yu, et al.
Veröffentlicht: (2025)
von: Zhang, Yu, et al.
Veröffentlicht: (2025)
BiMark: Unbiased Multilayer Watermarking for Large Language Models
von: Feng, Xiaoyan, et al.
Veröffentlicht: (2025)
von: Feng, Xiaoyan, et al.
Veröffentlicht: (2025)
Can Watermarks Survive Translation? On the Cross-lingual Consistency of Text Watermark for Large Language Models
von: He, Zhiwei, et al.
Veröffentlicht: (2024)
von: He, Zhiwei, et al.
Veröffentlicht: (2024)
Paraphrasing in Affirmative Terms Improves Negation Understanding
von: Rezaei, MohammadHossein, et al.
Veröffentlicht: (2024)
von: Rezaei, MohammadHossein, et al.
Veröffentlicht: (2024)
Majority Bit-Aware Watermarking For Large Language Models
von: Xu, Jiahao, et al.
Veröffentlicht: (2025)
von: Xu, Jiahao, et al.
Veröffentlicht: (2025)
De-mark: Watermark Removal in Large Language Models
von: Chen, Ruibo, et al.
Veröffentlicht: (2024)
von: Chen, Ruibo, et al.
Veröffentlicht: (2024)
LR-DWM: Efficient Watermarking for Diffusion Language Models
von: Raban, Ofek, et al.
Veröffentlicht: (2026)
von: Raban, Ofek, et al.
Veröffentlicht: (2026)
Improving Detection of Watermarked Language Models
von: Bahri, Dara, et al.
Veröffentlicht: (2025)
von: Bahri, Dara, et al.
Veröffentlicht: (2025)
Watermarking Large Language Models and the Generated Content: Opportunities and Challenges
von: Zhang, Ruisi, et al.
Veröffentlicht: (2024)
von: Zhang, Ruisi, et al.
Veröffentlicht: (2024)
Model Agnostic Hybrid Sharding For Heterogeneous Distributed Inference
von: Angione, Claudio, et al.
Veröffentlicht: (2024)
von: Angione, Claudio, et al.
Veröffentlicht: (2024)
Watermarking Language Models through Language Models
von: Dasgupta, Agnibh, et al.
Veröffentlicht: (2024)
von: Dasgupta, Agnibh, et al.
Veröffentlicht: (2024)
On the Learnability of Watermarks for Language Models
von: Gu, Chenchen, et al.
Veröffentlicht: (2023)
von: Gu, Chenchen, et al.
Veröffentlicht: (2023)
Ähnliche Einträge
-
GOLD: Generalized Knowledge Distillation via Out-of-Distribution-Guided Language Data Generation
von: Gholami, Mohsen, et al.
Veröffentlicht: (2024) -
A Watermark for Order-Agnostic Language Models
von: Chen, Ruibo, et al.
Veröffentlicht: (2024) -
LaWa: Using Latent Space for In-Generation Image Watermarking
von: Rezaei, Ahmad, et al.
Veröffentlicht: (2024) -
Making Language Models Robust Against Negation
von: Rezaei, MohammadHossein, et al.
Veröffentlicht: (2025) -
Multilingual Contrastive Decoding via Language-Agnostic Layers Skipping
von: Zhu, Wenhao, et al.
Veröffentlicht: (2024)