Optimal Estimation of Watermark Proportions in Hybrid AI-Human Texts
Fuente:
arXiv
Saved in:
| Main Authors: | Li, Xiang, Wen, Garrett, He, Weiqing, Wu, Jiayuan, Long, Qi, Su, Weijie J. |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Robust Detection of Watermarks for Large Language Models Under Human Edits
by: Li, Xiang, et al.
Published: (2024)
by: Li, Xiang, et al.
Published: (2024)
Optimal Detection for Language Watermarks with Pseudorandom Collision
by: Cai, T. Tony, et al.
Published: (2025)
by: Cai, T. Tony, et al.
Published: (2025)
Debiasing Watermarks for Large Language Models via Maximal Coupling
by: Xie, Yangxinyu, et al.
Published: (2024)
by: Xie, Yangxinyu, et al.
Published: (2024)
Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?
by: Li, Xiang, et al.
Published: (2025)
by: Li, Xiang, et al.
Published: (2025)
UCS: Estimating Unseen Coverage for Improved In-Context Learning
by: Xin, Jiayi, et al.
Published: (2026)
by: Xin, Jiayi, et al.
Published: (2026)
Improving the Trade-off Between Watermark Strength and Speculative Sampling Efficiency for Language Models
by: He, Weiqing, et al.
Published: (2026)
by: He, Weiqing, et al.
Published: (2026)
On the Empirical Power of Goodness-of-Fit Tests in Watermark Detection
by: He, Weiqing, et al.
Published: (2025)
by: He, Weiqing, et al.
Published: (2025)
Mitigating Privacy-Utility Trade-off in Decentralized Federated Learning via $f$-Differential Privacy
by: Li, Xiang, et al.
Published: (2025)
by: Li, Xiang, et al.
Published: (2025)
Tackling Copyright Issues in AI Image Generation Through Originality Estimation and Genericization
by: Chiba-Okabe, Hiroaki, et al.
Published: (2024)
by: Chiba-Okabe, Hiroaki, et al.
Published: (2024)
Recommending Best Paper Awards for ML/AI Conferences via the Isotonic Mechanism
by: Wen, Garrett G., et al.
Published: (2026)
by: Wen, Garrett G., et al.
Published: (2026)
Text Rationalization for Robust Causal Effect Estimation
by: Zhang, Lijinghua, et al.
Published: (2025)
by: Zhang, Lijinghua, et al.
Published: (2025)
On the Algorithmic Bias of Aligning Large Language Models with RLHF: Preference Collapse and Matching Regularization
by: Xiao, Jiancong, et al.
Published: (2024)
by: Xiao, Jiancong, et al.
Published: (2024)
Do Large Language Models (Really) Need Statistical Foundations?
by: Su, Weijie
Published: (2025)
by: Su, Weijie
Published: (2025)
Optimal Nuisance Function Tuning for Estimating a Doubly Robust Functional under Proportional Asymptotics
by: McGrath, Sean, et al.
Published: (2025)
by: McGrath, Sean, et al.
Published: (2025)
Adaptive Contrastive Search: Uncertainty-Guided Decoding for Open-Ended Text Generation
by: Arias, Esteban Garces, et al.
Published: (2024)
by: Arias, Esteban Garces, et al.
Published: (2024)
Proximal Causal Inference With Text Data
by: Chen, Jacob M., et al.
Published: (2024)
by: Chen, Jacob M., et al.
Published: (2024)
A Statistical Framework of Watermarks for Large Language Models: Pivot, Detection Efficiency and Optimal Rules
by: Li, Xiang, et al.
Published: (2024)
by: Li, Xiang, et al.
Published: (2024)
Provable Multi-Party Reinforcement Learning with Diverse Human Feedback
by: Zhong, Huiying, et al.
Published: (2024)
by: Zhong, Huiying, et al.
Published: (2024)
End-To-End Causal Effect Estimation from Unstructured Natural Language Data
by: Dhawan, Nikita, et al.
Published: (2024)
by: Dhawan, Nikita, et al.
Published: (2024)
Efficient and Debiased Learning of Average Hazard Under Non-Proportional Hazards
by: Meng, Xiang, et al.
Published: (2026)
by: Meng, Xiang, et al.
Published: (2026)
COKE: Causal Discovery with Chronological Order and Expert Knowledge in High Proportion of Missing Manufacturing Data
by: Ou, Ting-Yun, et al.
Published: (2024)
by: Ou, Ting-Yun, et al.
Published: (2024)
Online LLM watermark detection via e-processes
by: Su, Weijie, et al.
Published: (2026)
by: Su, Weijie, et al.
Published: (2026)
Optimizing Language Models for Human Preferences is a Causal Inference Problem
by: Lin, Victoria, et al.
Published: (2024)
by: Lin, Victoria, et al.
Published: (2024)
Everywhere Valid Bounds on False Discovery Proportions in Conformal Inference
by: Song, Ziang, et al.
Published: (2026)
by: Song, Ziang, et al.
Published: (2026)
Causal Inference on Outcomes Learned from Text
by: Modarressi, Iman, et al.
Published: (2025)
by: Modarressi, Iman, et al.
Published: (2025)
Enhancing Signal Proportion Estimation Through Leveraging Arbitrary Covariance Structures
by: Bai, Jingtian, et al.
Published: (2025)
by: Bai, Jingtian, et al.
Published: (2025)
DISCRET: Synthesizing Faithful Explanations For Treatment Effect Estimation
by: Wu, Yinjun, et al.
Published: (2024)
by: Wu, Yinjun, et al.
Published: (2024)
Embedding Trust: Semantic Isotropy Predicts Nonfactuality in Long-Form Text Generation
by: Bhardwaj, Dhrupad, et al.
Published: (2025)
by: Bhardwaj, Dhrupad, et al.
Published: (2025)
Robust Learning Rate Selection for Stochastic Optimization via Splitting Diagnostic
by: Sordello, Matteo, et al.
Published: (2019)
by: Sordello, Matteo, et al.
Published: (2019)
Adaptive Split Balancing for Optimal Random Forest
by: Zhang, Yuqian, et al.
Published: (2024)
by: Zhang, Yuqian, et al.
Published: (2024)
A Design-based Solution for Causal Inference with Text: Can a Language Model Be Too Large?
by: Tierney, Graham, et al.
Published: (2025)
by: Tierney, Graham, et al.
Published: (2025)
SGD with Dependent Data: Optimal Estimation, Regret, and Inference
by: Shen, Yinan, et al.
Published: (2026)
by: Shen, Yinan, et al.
Published: (2026)
An Economic Solution to Copyright Challenges of Generative AI
by: Wang, Jiachen T., et al.
Published: (2024)
by: Wang, Jiachen T., et al.
Published: (2024)
RCT Rejection Sampling for Causal Estimation Evaluation
by: Keith, Katherine A., et al.
Published: (2023)
by: Keith, Katherine A., et al.
Published: (2023)
Random Text, Zipf's Law, Critical Length,and Implications for Large Language Models
by: Berman, Vladimir
Published: (2025)
by: Berman, Vladimir
Published: (2025)
TWIN-GPT: Digital Twins for Clinical Trials via Large Language Model
by: Wang, Yue, et al.
Published: (2024)
by: Wang, Yue, et al.
Published: (2024)
Spiking the training data to correct for test set contamination
by: Wei, Johnny Tian-Zheng, et al.
Published: (2026)
by: Wei, Johnny Tian-Zheng, et al.
Published: (2026)
Adaptive Uncertainty Quantification for Generative AI
by: Kim, Jungeum, et al.
Published: (2024)
by: Kim, Jungeum, et al.
Published: (2024)
Hybrid Meta-learners for Estimating Heterogeneous Treatment Effects
by: Liang, Zhongyuan, et al.
Published: (2025)
by: Liang, Zhongyuan, et al.
Published: (2025)
From Ground Truth to Measurement: A Statistical Framework for Human Labeling
by: Chew, Robert, et al.
Published: (2026)
by: Chew, Robert, et al.
Published: (2026)
Similar Items
-
Robust Detection of Watermarks for Large Language Models Under Human Edits
by: Li, Xiang, et al.
Published: (2024) -
Optimal Detection for Language Watermarks with Pseudorandom Collision
by: Cai, T. Tony, et al.
Published: (2025) -
Debiasing Watermarks for Large Language Models via Maximal Coupling
by: Xie, Yangxinyu, et al.
Published: (2024) -
Evaluating the Unseen Capabilities: How Many Theorems Do LLMs Know?
by: Li, Xiang, et al.
Published: (2025) -
UCS: Estimating Unseen Coverage for Improved In-Context Learning
by: Xin, Jiayi, et al.
Published: (2026)