ToxiFrench: Benchmarking and Enhancing Language Models via CoT Fine-Tuning for French Toxicity Detection
Fuente:
arXiv
Guardado en:
| Autores principales: | Delaval, Axel, Yang, Shujian, Wang, Haicheng, Qiu, Han, Lu, Jialiang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
NERCat: Fine-Tuning for Enhanced Named Entity Recognition in Catalan
por: Ferreres, Guillem Cadevall, et al.
Publicado: (2025)
por: Ferreres, Guillem Cadevall, et al.
Publicado: (2025)
MELoRA: Mini-Ensemble Low-Rank Adapters for Parameter-Efficient Fine-Tuning
por: Ren, Pengjie, et al.
Publicado: (2024)
por: Ren, Pengjie, et al.
Publicado: (2024)
PaperAudit-Bench: Benchmarking Error Detection in Research Papers for Critical Automated Peer Review
por: Tu, Songjun, et al.
Publicado: (2026)
por: Tu, Songjun, et al.
Publicado: (2026)
Obfuscation Rules for Detecting and Detoxifying Korean Toxicity
por: Lee, Yejin, et al.
Publicado: (2025)
por: Lee, Yejin, et al.
Publicado: (2025)
Enhancing OCR for Sino-Vietnamese Language Processing via Fine-tuned PaddleOCRv5
por: Nguyen, Minh Hoang, et al.
Publicado: (2025)
por: Nguyen, Minh Hoang, et al.
Publicado: (2025)
Co-NAML-LSTUR: A Combined Model with Attentive Multi-View Learning and Long- and Short-term User Representations for News Recommendation
por: Nguyen, Minh Hoang, et al.
Publicado: (2025)
por: Nguyen, Minh Hoang, et al.
Publicado: (2025)
WaterSeeker: Pioneering Efficient Detection of Watermarked Segments in Large Documents
por: Pan, Leyi, et al.
Publicado: (2024)
por: Pan, Leyi, et al.
Publicado: (2024)
Improving French Synthetic Speech Quality via SSML Prosody Control
por: Ouali, Nassima Ould, et al.
Publicado: (2025)
por: Ouali, Nassima Ould, et al.
Publicado: (2025)
AI-assisted German Employment Contract Review: A Benchmark Dataset
por: Wardas, Oliver, et al.
Publicado: (2025)
por: Wardas, Oliver, et al.
Publicado: (2025)
Compression Method Matters: Benchmark-Dependent Output Dynamics in LLM Prompt Compression
por: Johnson, Warren
Publicado: (2026)
por: Johnson, Warren
Publicado: (2026)
Omni-SafetyBench: A Benchmark for Safety Evaluation of Audio-Visual Large Language Models
por: Pan, Leyi, et al.
Publicado: (2025)
por: Pan, Leyi, et al.
Publicado: (2025)
Branching Narratives: Character Decision Points Detection
por: Tikhonov, Alexey
Publicado: (2024)
por: Tikhonov, Alexey
Publicado: (2024)
Targeted Lexical Injection: Unlocking Latent Cross-Lingual Alignment in Lugha-Llama via Early-Layer LoRA Fine-Tuning
por: Ngugi, Stanley
Publicado: (2025)
por: Ngugi, Stanley
Publicado: (2025)
Adaptive Steering and Remasking for Safe Generation in Diffusion Language Models
por: Lee, Yejin, et al.
Publicado: (2026)
por: Lee, Yejin, et al.
Publicado: (2026)
A Survey on Natural Language Counterfactual Generation
por: Wang, Yongjie, et al.
Publicado: (2024)
por: Wang, Yongjie, et al.
Publicado: (2024)
Direct Large Language Model Alignment Through Self-Rewarding Contrastive Prompt Distillation
por: Liu, Aiwei, et al.
Publicado: (2024)
por: Liu, Aiwei, et al.
Publicado: (2024)
Can LLM Watermarks Robustly Prevent Unauthorized Knowledge Distillation?
por: Pan, Leyi, et al.
Publicado: (2025)
por: Pan, Leyi, et al.
Publicado: (2025)
A Survey of Text Watermarking in the Era of Large Language Models
por: Liu, Aiwei, et al.
Publicado: (2023)
por: Liu, Aiwei, et al.
Publicado: (2023)
TIS-DPO: Token-level Importance Sampling for Direct Preference Optimization With Estimated Weights
por: Liu, Aiwei, et al.
Publicado: (2024)
por: Liu, Aiwei, et al.
Publicado: (2024)
XAutoLM: Efficient Fine-Tuning of Language Models via Meta-Learning and AutoML
por: Estevanell-Valladares, Ernesto L., et al.
Publicado: (2025)
por: Estevanell-Valladares, Ernesto L., et al.
Publicado: (2025)
Prompt Engineering and the Effectiveness of Large Language Models in Enhancing Human Productivity
por: Anam, Rizal Khoirul
Publicado: (2025)
por: Anam, Rizal Khoirul
Publicado: (2025)
ProSwitch: Knowledge-Guided Instruction Tuning to Switch Between Professional and Non-Professional Responses
por: Zong, Chang, et al.
Publicado: (2024)
por: Zong, Chang, et al.
Publicado: (2024)
Fine-tuning of Large Language Models for Constituency Parsing Using a Sequence to Sequence Approach
por: Delgado, Francisco Jose Cortes, et al.
Publicado: (2025)
por: Delgado, Francisco Jose Cortes, et al.
Publicado: (2025)
IFMTBench: A Comprehensive Benchmark for Multilingual Translation Instruction Following
por: Sun, Mingrui, et al.
Publicado: (2026)
por: Sun, Mingrui, et al.
Publicado: (2026)
The Knesset Corpus: An Annotated Corpus of Hebrew Parliamentary Proceedings
por: Goldin, Gili, et al.
Publicado: (2024)
por: Goldin, Gili, et al.
Publicado: (2024)
Math Natural Language Inference: this should be easy!
por: de Paiva, Valeria, et al.
Publicado: (2025)
por: de Paiva, Valeria, et al.
Publicado: (2025)
Fast Quiet-STaR: Thinking Without Thought Tokens
por: Huang, Wei, et al.
Publicado: (2025)
por: Huang, Wei, et al.
Publicado: (2025)
New Skills or Sharper Primitives? A Probabilistic Perspective on the Emergence of Reasoning in RLVR
por: Wang, Zhilin, et al.
Publicado: (2026)
por: Wang, Zhilin, et al.
Publicado: (2026)
d-TreeRPO: Towards More Reliable Policy Optimization for Diffusion Language Models
por: Pan, Leyi, et al.
Publicado: (2025)
por: Pan, Leyi, et al.
Publicado: (2025)
Towards Effective and Efficient Continual Pre-training of Large Language Models
por: Chen, Jie, et al.
Publicado: (2024)
por: Chen, Jie, et al.
Publicado: (2024)
An Unforgeable Publicly Verifiable Watermark for Large Language Models
por: Liu, Aiwei, et al.
Publicado: (2023)
por: Liu, Aiwei, et al.
Publicado: (2023)
The Unlikely Duel: Evaluating Creative Writing in LLMs through a Unique Scenario
por: Gómez-Rodríguez, Carlos, et al.
Publicado: (2024)
por: Gómez-Rodríguez, Carlos, et al.
Publicado: (2024)
SentiCSE: A Sentiment-aware Contrastive Sentence Embedding Framework with Sentiment-guided Textual Similarity
por: Kim, Jaemin, et al.
Publicado: (2024)
por: Kim, Jaemin, et al.
Publicado: (2024)
Exploiting Pre-trained Encoder-Decoder Transformers for Sequence-to-Sequence Constituent Parsing
por: Fernández-González, Daniel, et al.
Publicado: (2026)
por: Fernández-González, Daniel, et al.
Publicado: (2026)
Parametric Social Identity Injection and Diversification in Public Opinion Simulation
por: Wang, Hexi, et al.
Publicado: (2026)
por: Wang, Hexi, et al.
Publicado: (2026)
Trusted Uncertainty in Large Language Models: A Unified Framework for Confidence Calibration and Risk-Controlled Refusal
por: Oehri, Markus, et al.
Publicado: (2025)
por: Oehri, Markus, et al.
Publicado: (2025)
The Superalignment of Superhuman Intelligence with Large Language Models
por: Huang, Minlie, et al.
Publicado: (2024)
por: Huang, Minlie, et al.
Publicado: (2024)
ScoreRAG: A Retrieval-Augmented Generation Framework with Consistency-Relevance Scoring and Structured Summarization for News Generation
por: Lin, Pei-Yun, et al.
Publicado: (2025)
por: Lin, Pei-Yun, et al.
Publicado: (2025)
Unifying Uniform and Binary-coding Quantization for Accurate Compression of Large Language Models
por: Park, Seungcheol, et al.
Publicado: (2025)
por: Park, Seungcheol, et al.
Publicado: (2025)
When Retrieval Succeeds and Fails: Rethinking Retrieval-Augmented Generation for LLMs
por: Wang, Yongjie, et al.
Publicado: (2025)
por: Wang, Yongjie, et al.
Publicado: (2025)
Ejemplares similares
-
NERCat: Fine-Tuning for Enhanced Named Entity Recognition in Catalan
por: Ferreres, Guillem Cadevall, et al.
Publicado: (2025) -
MELoRA: Mini-Ensemble Low-Rank Adapters for Parameter-Efficient Fine-Tuning
por: Ren, Pengjie, et al.
Publicado: (2024) -
PaperAudit-Bench: Benchmarking Error Detection in Research Papers for Critical Automated Peer Review
por: Tu, Songjun, et al.
Publicado: (2026) -
Obfuscation Rules for Detecting and Detoxifying Korean Toxicity
por: Lee, Yejin, et al.
Publicado: (2025) -
Enhancing OCR for Sino-Vietnamese Language Processing via Fine-tuned PaddleOCRv5
por: Nguyen, Minh Hoang, et al.
Publicado: (2025)