Robust and Minimally Invasive Watermarking for EaaS
Fuente:
arXiv
Guardado en:
| Autores principales: | Wang, Zongqi, Wu, Baoyuan, Deng, Jingyuan, Yang, Yujiu |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Your Semantic-Independent Watermark is Fragile: A Semantic Perturbation Attack against EaaS Watermark
por: Fei, Zekun, et al.
Publicado: (2024)
por: Fei, Zekun, et al.
Publicado: (2024)
MorphMark: Flexible Adaptive Watermarking for Large Language Models
por: Wang, Zongqi, et al.
Publicado: (2025)
por: Wang, Zongqi, et al.
Publicado: (2025)
MaskCD: Mitigating LVLM Hallucinations by Image Head Masked Contrastive Decoding
por: Deng, Jingyuan, et al.
Publicado: (2025)
por: Deng, Jingyuan, et al.
Publicado: (2025)
Invisible Entropy: Towards Safe and Efficient Low-Entropy LLM Watermarking
por: Gu, Tianle, et al.
Publicado: (2025)
por: Gu, Tianle, et al.
Publicado: (2025)
Rotation, Scale, and Translation Resilient Black-box Fingerprinting for Intellectual Property Protection of EaaS Models
por: Zhang, Hongjie, et al.
Publicado: (2025)
por: Zhang, Hongjie, et al.
Publicado: (2025)
S2J: Bridging the Gap Between Solving and Judging Ability in Generative Reward Models
por: Sun, Shaoning, et al.
Publicado: (2025)
por: Sun, Shaoning, et al.
Publicado: (2025)
SCAN: Structured Capability Assessment and Navigation for LLMs
por: Wang, Zongqi, et al.
Publicado: (2025)
por: Wang, Zongqi, et al.
Publicado: (2025)
Reward Modeling from Natural Language Human Feedback
por: Wang, Zongqi, et al.
Publicado: (2026)
por: Wang, Zongqi, et al.
Publicado: (2026)
LiFi: Lightweight Controlled Text Generation with Fine-Grained Control Codes
por: Shi, Chufan, et al.
Publicado: (2024)
por: Shi, Chufan, et al.
Publicado: (2024)
Probing the Robustness of Large Language Models Safety to Latent Perturbations
por: Gu, Tianle, et al.
Publicado: (2025)
por: Gu, Tianle, et al.
Publicado: (2025)
Robust LLM Watermarking with Minimal Semantic Distortion for IP Protection
por: Dang, Kieu, et al.
Publicado: (2026)
por: Dang, Kieu, et al.
Publicado: (2026)
Distilling Bayesian Belief States into Language Models for Auditable Negotiation
por: Cui, Zongqi, et al.
Publicado: (2026)
por: Cui, Zongqi, et al.
Publicado: (2026)
LoCa: Logit Calibration for Knowledge Distillation
por: Yang, Runming, et al.
Publicado: (2024)
por: Yang, Runming, et al.
Publicado: (2024)
Watermark under Fire: A Robustness Evaluation of LLM Watermarking
por: Liang, Jiacheng, et al.
Publicado: (2024)
por: Liang, Jiacheng, et al.
Publicado: (2024)
From Sparse Decisions to Dense Reasoning: A Multi-attribute Trajectory Paradigm for Multimodal Moderation
por: Gu, Tianle, et al.
Publicado: (2026)
por: Gu, Tianle, et al.
Publicado: (2026)
AdvChain: Adversarial Chain-of-Thought Tuning for Robust Safety Alignment of Large Reasoning Models
por: Zhu, Zihao, et al.
Publicado: (2025)
por: Zhu, Zihao, et al.
Publicado: (2025)
WatME: Towards Lossless Watermarking Through Lexical Redundancy
por: Chen, Liang, et al.
Publicado: (2023)
por: Chen, Liang, et al.
Publicado: (2023)
A Thorough Examination of Decoding Methods in the Era of LLMs
por: Shi, Chufan, et al.
Publicado: (2024)
por: Shi, Chufan, et al.
Publicado: (2024)
Think-with-Rubrics: From External Evaluator to Internal Reasoning Guidance
por: Yu, Jiachen, et al.
Publicado: (2026)
por: Yu, Jiachen, et al.
Publicado: (2026)
SemStamp: A Semantic Watermark with Paraphrastic Robustness for Text Generation
por: Hou, Abe Bohan, et al.
Publicado: (2023)
por: Hou, Abe Bohan, et al.
Publicado: (2023)
SongSage: A Large Musical Language Model with Lyric Generative Pre-training
por: Guo, Jiani, et al.
Publicado: (2026)
por: Guo, Jiani, et al.
Publicado: (2026)
ProFit: Leveraging High-Value Signals in SFT via Probability-Guided Token Selection
por: Liu, Tao, et al.
Publicado: (2026)
por: Liu, Tao, et al.
Publicado: (2026)
Internalize the Temperature: On-Policy Self-Distillation as Policy Reheater for Reinforcement Learning
por: Yang, Xuewei, et al.
Publicado: (2026)
por: Yang, Xuewei, et al.
Publicado: (2026)
Text Anomaly Detection with Simplified Isolation Kernel
por: Cao, Yang, et al.
Publicado: (2025)
por: Cao, Yang, et al.
Publicado: (2025)
Revisiting the Robustness of Watermarking to Paraphrasing Attacks
por: Rastogi, Saksham, et al.
Publicado: (2024)
por: Rastogi, Saksham, et al.
Publicado: (2024)
Semantics-Adaptive Activation Intervention for LLMs via Dynamic Steering Vectors
por: Wang, Weixuan, et al.
Publicado: (2024)
por: Wang, Weixuan, et al.
Publicado: (2024)
Towards Objectively Benchmarking Social Intelligence for Language Agents at Action Level
por: Wang, Chenxu, et al.
Publicado: (2024)
por: Wang, Chenxu, et al.
Publicado: (2024)
Unchosen Experts Can Contribute Too: Unleashing MoE Models' Power by Self-Contrast
por: Shi, Chufan, et al.
Publicado: (2024)
por: Shi, Chufan, et al.
Publicado: (2024)
Yet Another Watermark for Large Language Models
por: Bao, Siyuan, et al.
Publicado: (2025)
por: Bao, Siyuan, et al.
Publicado: (2025)
Improved Unbiased Watermark for Large Language Models
por: Chen, Ruibo, et al.
Publicado: (2025)
por: Chen, Ruibo, et al.
Publicado: (2025)
Robust Distortion-free Watermarks for Language Models
por: Kuditipudi, Rohith, et al.
Publicado: (2023)
por: Kuditipudi, Rohith, et al.
Publicado: (2023)
Compress to Impress: Unleashing the Potential of Compressive Memory in Real-World Long-Term Conversations
por: Chen, Nuo, et al.
Publicado: (2024)
por: Chen, Nuo, et al.
Publicado: (2024)
Robustness Assessment and Enhancement of Text Watermarking for Google's SynthID
por: Han, Xia, et al.
Publicado: (2025)
por: Han, Xia, et al.
Publicado: (2025)
Temperature Matters: Enhancing Watermark Robustness Against Paraphrasing Attacks
por: Idrissi, Badr Youbi, et al.
Publicado: (2025)
por: Idrissi, Badr Youbi, et al.
Publicado: (2025)
RoRA-VLM: Robust Retrieval-Augmented Vision Language Models
por: Qi, Jingyuan, et al.
Publicado: (2024)
por: Qi, Jingyuan, et al.
Publicado: (2024)
NJUST-KMG at TRAC-2024 Tasks 1 and 2: Offline Harm Potential Identification
por: Wang, Jingyuan, et al.
Publicado: (2024)
por: Wang, Jingyuan, et al.
Publicado: (2024)
PMark: Towards Robust and Distortion-free Semantic-level Watermarking with Channel Constraints
por: Huo, Jiahao, et al.
Publicado: (2025)
por: Huo, Jiahao, et al.
Publicado: (2025)
A Watermark for Order-Agnostic Language Models
por: Chen, Ruibo, et al.
Publicado: (2024)
por: Chen, Ruibo, et al.
Publicado: (2024)
De-mark: Watermark Removal in Large Language Models
por: Chen, Ruibo, et al.
Publicado: (2024)
por: Chen, Ruibo, et al.
Publicado: (2024)
PTD-SQL: Partitioning and Targeted Drilling with LLMs in Text-to-SQL
por: Luo, Ruilin, et al.
Publicado: (2024)
por: Luo, Ruilin, et al.
Publicado: (2024)
Ejemplares similares
-
Your Semantic-Independent Watermark is Fragile: A Semantic Perturbation Attack against EaaS Watermark
por: Fei, Zekun, et al.
Publicado: (2024) -
MorphMark: Flexible Adaptive Watermarking for Large Language Models
por: Wang, Zongqi, et al.
Publicado: (2025) -
MaskCD: Mitigating LVLM Hallucinations by Image Head Masked Contrastive Decoding
por: Deng, Jingyuan, et al.
Publicado: (2025) -
Invisible Entropy: Towards Safe and Efficient Low-Entropy LLM Watermarking
por: Gu, Tianle, et al.
Publicado: (2025) -
Rotation, Scale, and Translation Resilient Black-box Fingerprinting for Intellectual Property Protection of EaaS Models
por: Zhang, Hongjie, et al.
Publicado: (2025)