MultiParaDetox: Extending Text Detoxification with Parallel Data to New Languages
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Dementieva, Daryna, Babakov, Nikolay, Panchenko, Alexander |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Evaluating Text Style Transfer: A Nine-Language Benchmark for Text Detoxification
par: Protasov, Vitaly, et autres
Publié: (2025)
par: Protasov, Vitaly, et autres
Publié: (2025)
Multilingual and Explainable Text Detoxification with Parallel Corpora
par: Dementieva, Daryna, et autres
Publié: (2024)
par: Dementieva, Daryna, et autres
Publié: (2024)
EmoBench-UA: A Benchmark Dataset for Emotion Detection in Ukrainian
par: Dementieva, Daryna, et autres
Publié: (2025)
par: Dementieva, Daryna, et autres
Publié: (2025)
Cross-lingual Text Classification Transfer: The Case of Ukrainian
par: Dementieva, Daryna, et autres
Publié: (2024)
par: Dementieva, Daryna, et autres
Publié: (2024)
Toxicity Classification in Ukrainian
par: Dementieva, Daryna, et autres
Publié: (2024)
par: Dementieva, Daryna, et autres
Publié: (2024)
SynthDetoxM: Modern LLMs are Few-Shot Parallel Detoxification Data Annotators
par: Moskovskiy, Daniil, et autres
Publié: (2025)
par: Moskovskiy, Daniil, et autres
Publié: (2025)
SmurfCat at PAN 2024 TextDetox: Alignment of Multilingual Transformers for Text Detoxification
par: Rykov, Elisei, et autres
Publié: (2024)
par: Rykov, Elisei, et autres
Publié: (2024)
CausalDetox: Causal Head Selection and Intervention for Language Model Detoxification
par: Wang, Yian, et autres
Publié: (2026)
par: Wang, Yian, et autres
Publié: (2026)
Low-Resource, High-Impact: Building Corpora for Inclusive Language Technologies
par: Artemova, Ekaterina, et autres
Publié: (2025)
par: Artemova, Ekaterina, et autres
Publié: (2025)
Temperature Matters: Enhancing Watermark Robustness Against Paraphrasing Attacks
par: Idrissi, Badr Youbi, et autres
Publié: (2025)
par: Idrissi, Badr Youbi, et autres
Publié: (2025)
CrossNews-UA: A Cross-lingual News Semantic Similarity Benchmark for Ukrainian, Polish, Russian, and English
par: Dementieva, Daryna, et autres
Publié: (2025)
par: Dementieva, Daryna, et autres
Publié: (2025)
Data-Efficient Hate Speech Detection via Cross-Lingual Nearest Neighbor Retrieval with Limited Labeled Data
par: Ghorbanpour, Faeze, et autres
Publié: (2025)
par: Ghorbanpour, Faeze, et autres
Publié: (2025)
GemDetox at TextDetox CLEF 2025: Enhancing a Massively Multilingual Model for Text Detoxification on Low-resource Languages
par: Dang, Trung Duc Anh, et autres
Publié: (2025)
par: Dang, Trung Duc Anh, et autres
Publié: (2025)
Can Prompting LLMs Unlock Hate Speech Detection across Languages? A Zero-shot and Few-shot Study
par: Ghorbanpour, Faeze, et autres
Publié: (2025)
par: Ghorbanpour, Faeze, et autres
Publié: (2025)
BanglaNirTox: A Large-scale Parallel Corpus for Explainable AI in Bengali Text Detoxification
par: Mohsin, Ayesha Afroza, et autres
Publié: (2025)
par: Mohsin, Ayesha Afroza, et autres
Publié: (2025)
Text Detoxification: Data Efficiency, Semantic Preservation and Model Generalization
par: Yu, Jing, et autres
Publié: (2025)
par: Yu, Jing, et autres
Publié: (2025)
Demarked: A Strategy for Enhanced Abusive Speech Moderation through Counterspeech, Detoxification, and Message Management
par: Yimam, Seid Muhie, et autres
Publié: (2024)
par: Yimam, Seid Muhie, et autres
Publié: (2024)
DetoxLLM: A Framework for Detoxification with Explanations
par: Khondaker, Md Tawkat Islam, et autres
Publié: (2024)
par: Khondaker, Md Tawkat Islam, et autres
Publié: (2024)
Hallucination Detox: Sensitivity Dropout (SenD) for Large Language Model Training
par: Mohammadzadeh, Shahrad, et autres
Publié: (2024)
par: Mohammadzadeh, Shahrad, et autres
Publié: (2024)
Explainable Semantic Textual Similarity via Dissimilar Span Detection
par: Lozano, Diego Miguel, et autres
Publié: (2026)
par: Lozano, Diego Miguel, et autres
Publié: (2026)
S3: A Simple Strong Sample-effective Multimodal Dialog System
par: Rykov, Elisei, et autres
Publié: (2024)
par: Rykov, Elisei, et autres
Publié: (2024)
<think> So let's replace this phrase with insult... </think> Lessons learned from generation of toxic texts with LLMs
par: Pletenev, Sergey, et autres
Publié: (2025)
par: Pletenev, Sergey, et autres
Publié: (2025)
Parameter-Efficient Detoxification with Contrastive Decoding
par: Niu, Tong, et autres
Publié: (2024)
par: Niu, Tong, et autres
Publié: (2024)
SmurfCat at SemEval-2024 Task 6: Leveraging Synthetic Data for Hallucination Detection
par: Rykov, Elisei, et autres
Publié: (2024)
par: Rykov, Elisei, et autres
Publié: (2024)
UniDetox: Universal Detoxification of Large Language Models via Dataset Distillation
par: Lu, Huimin, et autres
Publié: (2025)
par: Lu, Huimin, et autres
Publié: (2025)
SGM: Safety Glasses for Multimodal Large Language Models via Neuron-Level Detoxification
par: Wang, Hongbo, et autres
Publié: (2025)
par: Wang, Hongbo, et autres
Publié: (2025)
Cleansing the Artificial Mind: A Self-Reflective Detoxification Framework for Large Language Models
par: Zhang, Kaituo, et autres
Publié: (2026)
par: Zhang, Kaituo, et autres
Publié: (2026)
Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model
par: Tian, Yuanhe, et autres
Publié: (2025)
par: Tian, Yuanhe, et autres
Publié: (2025)
Explaining Bayesian Networks in Natural Language using Factor Arguments. Evaluation in the medical domain
par: Sevilla, Jaime, et autres
Publié: (2024)
par: Sevilla, Jaime, et autres
Publié: (2024)
Learning from Response not Preference: A Stackelberg Approach for LLM Detoxification using Non-parallel Data
par: Xie, Xinhong, et autres
Publié: (2024)
par: Xie, Xinhong, et autres
Publié: (2024)
ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute
par: Wen, Hao, et autres
Publié: (2025)
par: Wen, Hao, et autres
Publié: (2025)
DESTEIN: Navigating Detoxification of Language Models via Universal Steering Pairs and Head-wise Activation Fusion
par: Li, Yu, et autres
Publié: (2024)
par: Li, Yu, et autres
Publié: (2024)
SparseGrad: A Selective Method for Efficient Fine-tuning of MLP Layers
par: Chekalina, Viktoriia, et autres
Publié: (2024)
par: Chekalina, Viktoriia, et autres
Publié: (2024)
Breaking mBad! Supervised Fine-tuning for Cross-Lingual Detoxification
par: Beniwal, Himanshu, et autres
Publié: (2025)
par: Beniwal, Himanshu, et autres
Publié: (2025)
Breaking Bad Molecules: Are MLLMs Ready for Structure-Level Molecular Detoxification?
par: Lin, Fei, et autres
Publié: (2025)
par: Lin, Fei, et autres
Publié: (2025)
MultiScript30k: Leveraging Multilingual Embeddings to Extend Cross Script Parallel Data
par: Driggers-Ellis, Christopher, et autres
Publié: (2025)
par: Driggers-Ellis, Christopher, et autres
Publié: (2025)
Scalability of Bayesian Network Structure Elicitation with Large Language Models: a Novel Methodology and Comparative Analysis
par: Babakov, Nikolay, et autres
Publié: (2024)
par: Babakov, Nikolay, et autres
Publié: (2024)
When Punctuation Matters: A Large-Scale Comparison of Prompt Robustness Methods for LLMs
par: Seleznyov, Mikhail, et autres
Publié: (2025)
par: Seleznyov, Mikhail, et autres
Publié: (2025)
Evolutionary Search for Automated Design of Uncertainty Quantification Methods
par: Seleznyov, Mikhail, et autres
Publié: (2026)
par: Seleznyov, Mikhail, et autres
Publié: (2026)
Test-Time Detoxification without Training or Learning Anything
par: Saglam, Baturay, et autres
Publié: (2026)
par: Saglam, Baturay, et autres
Publié: (2026)
Documents similaires
-
Evaluating Text Style Transfer: A Nine-Language Benchmark for Text Detoxification
par: Protasov, Vitaly, et autres
Publié: (2025) -
Multilingual and Explainable Text Detoxification with Parallel Corpora
par: Dementieva, Daryna, et autres
Publié: (2024) -
EmoBench-UA: A Benchmark Dataset for Emotion Detection in Ukrainian
par: Dementieva, Daryna, et autres
Publié: (2025) -
Cross-lingual Text Classification Transfer: The Case of Ukrainian
par: Dementieva, Daryna, et autres
Publié: (2024) -
Toxicity Classification in Ukrainian
par: Dementieva, Daryna, et autres
Publié: (2024)