Text Detoxification: Data Efficiency, Semantic Preservation and Model Generalization
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yu, Jing, Zhao, Yibo, Zhu, Jiapeng, Shao, Wenming, Pang, Bo, Zhang, Zhao, Li, Xiang |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
ChatTraffic: Text-to-Traffic Generation via Diffusion Model
par: Zhang, Chengyang, et autres
Publié: (2023)
par: Zhang, Chengyang, et autres
Publié: (2023)
Efficient Detection of LLM-generated Texts with a Bayesian Surrogate Model
par: Miao, Yibo, et autres
Publié: (2023)
par: Miao, Yibo, et autres
Publié: (2023)
Human Cognition Inspired RAG with Knowledge Graph for Complex Problem Solving
par: Cheng, Yao, et autres
Publié: (2025)
par: Cheng, Yao, et autres
Publié: (2025)
Test-Time Detoxification without Training or Learning Anything
par: Saglam, Baturay, et autres
Publié: (2026)
par: Saglam, Baturay, et autres
Publié: (2026)
Controlled Generation for Private Synthetic Text
par: Zhao, Zihao, et autres
Publié: (2025)
par: Zhao, Zihao, et autres
Publié: (2025)
A General Framework for Producing Interpretable Semantic Text Embeddings
par: Sun, Yiqun, et autres
Publié: (2024)
par: Sun, Yiqun, et autres
Publié: (2024)
Text2Data: Low-Resource Data Generation with Textual Control
par: Wang, Shiyu, et autres
Publié: (2024)
par: Wang, Shiyu, et autres
Publié: (2024)
Scaling up Masked Diffusion Models on Text
par: Nie, Shen, et autres
Publié: (2024)
par: Nie, Shen, et autres
Publié: (2024)
Empowering Diffusion Models on the Embedding Space for Text Generation
par: Gao, Zhujin, et autres
Publié: (2022)
par: Gao, Zhujin, et autres
Publié: (2022)
How to Synthesize Text Data without Model Collapse?
par: Zhu, Xuekai, et autres
Publié: (2024)
par: Zhu, Xuekai, et autres
Publié: (2024)
You Can Generate It Again: Data-to-Text Generation with Verification and Correction Prompting
par: Ren, Xuan, et autres
Publié: (2023)
par: Ren, Xuan, et autres
Publié: (2023)
Channel Merging: Preserving Specialization for Merged Experts
par: Zhang, Mingyang, et autres
Publié: (2024)
par: Zhang, Mingyang, et autres
Publié: (2024)
Personalized Decision Modeling: Utility Optimization or Textualized-Symbolic Reasoning
par: Zhao, Yibo, et autres
Publié: (2025)
par: Zhao, Yibo, et autres
Publié: (2025)
T2VSafetyBench: Evaluating the Safety of Text-to-Video Generative Models
par: Miao, Yibo, et autres
Publié: (2024)
par: Miao, Yibo, et autres
Publié: (2024)
Breaking the Cloak! Unveiling Chinese Cloaked Toxicity with Homophone Graph and Toxic Lexicon
par: Ma, Xuchen, et autres
Publié: (2025)
par: Ma, Xuchen, et autres
Publié: (2025)
UDDETTS: Unifying Discrete and Dimensional Emotions for Controllable Emotional Text-to-Speech
par: Liu, Jiaxuan, et autres
Publié: (2025)
par: Liu, Jiaxuan, et autres
Publié: (2025)
DPIC: Decoupling Prompt and Intrinsic Characteristics for LLM Generated Text Detection
par: Yu, Xiao, et autres
Publié: (2023)
par: Yu, Xiao, et autres
Publié: (2023)
Domain Gating Ensemble Networks for AI-Generated Text Detection
par: Tripathi, Arihant, et autres
Publié: (2025)
par: Tripathi, Arihant, et autres
Publié: (2025)
NeSTR: A Neuro-Symbolic Abductive Framework for Temporal Reasoning in Large Language Models
par: Liang, Feng, et autres
Publié: (2025)
par: Liang, Feng, et autres
Publié: (2025)
Autonomous Data Selection with Zero-shot Generative Classifiers for Mathematical Texts
par: Zhang, Yifan, et autres
Publié: (2024)
par: Zhang, Yifan, et autres
Publié: (2024)
Projecting Out the Malice: A Global Subspace Approach to LLM Detoxification
par: Duan, Zenghao, et autres
Publié: (2026)
par: Duan, Zenghao, et autres
Publié: (2026)
Enhancing LLM-based Hatred and Toxicity Detection with Meta-Toxic Knowledge Graph
par: Zhao, Yibo, et autres
Publié: (2024)
par: Zhao, Yibo, et autres
Publié: (2024)
Self-Generated Critiques Boost Reward Modeling for Language Models
par: Yu, Yue, et autres
Publié: (2024)
par: Yu, Yue, et autres
Publié: (2024)
Learning from Reference Answers: Versatile Language Model Alignment without Binary Human Preference Data
par: Zhao, Shuai, et autres
Publié: (2025)
par: Zhao, Shuai, et autres
Publié: (2025)
RLHF Workflow: From Reward Modeling to Online RLHF
par: Dong, Hanze, et autres
Publié: (2024)
par: Dong, Hanze, et autres
Publié: (2024)
Anonymous-by-Construction: An LLM-Driven Framework for Privacy-Preserving Text
par: Albanese, Federico, et autres
Publié: (2026)
par: Albanese, Federico, et autres
Publié: (2026)
Advancing Tool-Augmented Large Language Models: Integrating Insights from Errors in Inference Trees
par: Chen, Sijia, et autres
Publié: (2024)
par: Chen, Sijia, et autres
Publié: (2024)
Many-to-English Machine Translation Tools, Data, and Pretrained Models
par: Gowda, Thamme, et autres
Publié: (2021)
par: Gowda, Thamme, et autres
Publié: (2021)
Bridging the Semantic Gap for Categorical Data Clustering via Large Language Models
par: Yang, Zihua, et autres
Publié: (2026)
par: Yang, Zihua, et autres
Publié: (2026)
ReAGent: A Model-agnostic Feature Attribution Method for Generative Language Models
par: Zhao, Zhixue, et autres
Publié: (2024)
par: Zhao, Zhixue, et autres
Publié: (2024)
MedualTime: A Dual-Adapter Language Model for Medical Time Series-Text Multimodal Learning
par: Ye, Jiexia, et autres
Publié: (2024)
par: Ye, Jiexia, et autres
Publié: (2024)
Diversity Boosts AI-Generated Text Detection
par: Basani, Advik Raj, et autres
Publié: (2025)
par: Basani, Advik Raj, et autres
Publié: (2025)
Sparse is Enough in Fine-tuning Pre-trained Large Language Models
par: Song, Weixi, et autres
Publié: (2023)
par: Song, Weixi, et autres
Publié: (2023)
Proxy-RLHF: Decoupling Generation and Alignment in Large Language Model with Proxy
par: Zhu, Yu, et autres
Publié: (2024)
par: Zhu, Yu, et autres
Publié: (2024)
Embedding Trust: Semantic Isotropy Predicts Nonfactuality in Long-Form Text Generation
par: Bhardwaj, Dhrupad, et autres
Publié: (2025)
par: Bhardwaj, Dhrupad, et autres
Publié: (2025)
Marco-o1 v2: Towards Widening The Distillation Bottleneck for Reasoning Models
par: Yin, Huifeng, et autres
Publié: (2025)
par: Yin, Huifeng, et autres
Publié: (2025)
Beyond Single Concept Vector: Modeling Concept Subspace in LLMs with Gaussian Distribution
par: Zhao, Haiyan, et autres
Publié: (2024)
par: Zhao, Haiyan, et autres
Publié: (2024)
Efficiency-Effectiveness Reranking FLOPs for LLM-based Rerankers
par: Peng, Zhiyuan, et autres
Publié: (2025)
par: Peng, Zhiyuan, et autres
Publié: (2025)
Causal Evaluation of Language Models
par: Chen, Sirui, et autres
Publié: (2024)
par: Chen, Sirui, et autres
Publié: (2024)
Rethinking Entropy Regularization in Large Reasoning Models
par: Jiang, Yuxian, et autres
Publié: (2025)
par: Jiang, Yuxian, et autres
Publié: (2025)
Documents similaires
-
ChatTraffic: Text-to-Traffic Generation via Diffusion Model
par: Zhang, Chengyang, et autres
Publié: (2023) -
Efficient Detection of LLM-generated Texts with a Bayesian Surrogate Model
par: Miao, Yibo, et autres
Publié: (2023) -
Human Cognition Inspired RAG with Knowledge Graph for Complex Problem Solving
par: Cheng, Yao, et autres
Publié: (2025) -
Test-Time Detoxification without Training or Learning Anything
par: Saglam, Baturay, et autres
Publié: (2026) -
Controlled Generation for Private Synthetic Text
par: Zhao, Zihao, et autres
Publié: (2025)