A Collaborative Content Moderation Framework for Toxicity Detection based on Conformalized Estimates of Annotation Disagreement
Fuente:
arXiv
Salvato in:
| Autori principali: | Villate-Castillo, Guillermo, Del Ser, Javier, Sanz, Borja |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Towards Probabilistic Question Answering Over Tabular Data
di: Shen, Chen, et al.
Pubblicazione: (2025)
di: Shen, Chen, et al.
Pubblicazione: (2025)
Experimentation in Content Moderation using RWKV
di: Yildirim, Umut, et al.
Pubblicazione: (2024)
di: Yildirim, Umut, et al.
Pubblicazione: (2024)
Low-Resource Neural Machine Translation Using Recurrent Neural Networks and Transfer Learning: A Case Study on English-to-Igbo
di: Ekle, Ocheme Anthony, et al.
Pubblicazione: (2025)
di: Ekle, Ocheme Anthony, et al.
Pubblicazione: (2025)
Prompt Engineering and the Effectiveness of Large Language Models in Enhancing Human Productivity
di: Anam, Rizal Khoirul
Pubblicazione: (2025)
di: Anam, Rizal Khoirul
Pubblicazione: (2025)
What is lost in Normalization? Exploring Pitfalls in Multilingual ASR Model Evaluations
di: Manohar, Kavya, et al.
Pubblicazione: (2024)
di: Manohar, Kavya, et al.
Pubblicazione: (2024)
Towards Conversational AI for Human-Machine Collaborative MLOps
di: Fatouros, George, et al.
Pubblicazione: (2025)
di: Fatouros, George, et al.
Pubblicazione: (2025)
Value Lens: Using Large Language Models to Understand Human Values
di: Fernández, Eduardo de la Cruz, et al.
Pubblicazione: (2025)
di: Fernández, Eduardo de la Cruz, et al.
Pubblicazione: (2025)
An Epidemiological Knowledge Graph extracted from the World Health Organization's Disease Outbreak News
di: Consoli, Sergio, et al.
Pubblicazione: (2025)
di: Consoli, Sergio, et al.
Pubblicazione: (2025)
MedMemoryBench: Benchmarking Agent Memory in Personalized Healthcare
di: Wang, Yihao, et al.
Pubblicazione: (2026)
di: Wang, Yihao, et al.
Pubblicazione: (2026)
Understanding the Uncertainty of LLM Explanations: A Perspective Based on Reasoning Topology
di: Da, Longchao, et al.
Pubblicazione: (2025)
di: Da, Longchao, et al.
Pubblicazione: (2025)
LLM-Assisted Crisis Management: Building Advanced LLM Platforms for Effective Emergency Response and Public Collaboration
di: Otal, Hakan T., et al.
Pubblicazione: (2024)
di: Otal, Hakan T., et al.
Pubblicazione: (2024)
Exploring the Structure of AI-Induced Language Change in Scientific English
di: Galpin, Riley, et al.
Pubblicazione: (2025)
di: Galpin, Riley, et al.
Pubblicazione: (2025)
An Iterative Optimizing Framework for Radiology Report Summarization with ChatGPT
di: Ma, Chong, et al.
Pubblicazione: (2023)
di: Ma, Chong, et al.
Pubblicazione: (2023)
Humor Mechanics: Advancing Humor Generation with Multistep Reasoning
di: Tikhonov, Alexey, et al.
Pubblicazione: (2024)
di: Tikhonov, Alexey, et al.
Pubblicazione: (2024)
Constitution or Collapse? Exploring Constitutional AI with Llama 3-8B
di: Zhang, Xue
Pubblicazione: (2025)
di: Zhang, Xue
Pubblicazione: (2025)
The Knesset Corpus: An Annotated Corpus of Hebrew Parliamentary Proceedings
di: Goldin, Gili, et al.
Pubblicazione: (2024)
di: Goldin, Gili, et al.
Pubblicazione: (2024)
Disambiguation of Emotion Annotations by Contextualizing Events in Plausible Narratives
di: Schäfer, Johannes, et al.
Pubblicazione: (2025)
di: Schäfer, Johannes, et al.
Pubblicazione: (2025)
PerkwE_COQA: Enhanced Persian Conversational Question Answering by combining contextual keyword extraction with Large Language Models
di: Moradbeiki, Pardis, et al.
Pubblicazione: (2024)
di: Moradbeiki, Pardis, et al.
Pubblicazione: (2024)
Retrieval-Based Multi-Label Legal Annotation: Extensible, Data-Efficient and Hallucination-Free
di: Zhang, Li, et al.
Pubblicazione: (2026)
di: Zhang, Li, et al.
Pubblicazione: (2026)
JAM: Controllable and Responsible Text Generation via Causal Reasoning and Latent Vector Manipulation
di: Huang, Yingbing, et al.
Pubblicazione: (2025)
di: Huang, Yingbing, et al.
Pubblicazione: (2025)
Position: Uncertainty Quantification in LLMs is Just Unsupervised Clustering
di: Chen, Tiejin, et al.
Pubblicazione: (2026)
di: Chen, Tiejin, et al.
Pubblicazione: (2026)
Mitigating LLM Hallucinations through Domain-Grounded Tiered Retrieval
di: Haque, Md. Asraful, et al.
Pubblicazione: (2026)
di: Haque, Md. Asraful, et al.
Pubblicazione: (2026)
Triplètoile: Extraction of Knowledge from Microblogging Text
di: Zavarella, Vanni, et al.
Pubblicazione: (2024)
di: Zavarella, Vanni, et al.
Pubblicazione: (2024)
The Pursuit of Empathy: Evaluating Small Language Models for PTSD Dialogue Support
di: BN, Suhas, et al.
Pubblicazione: (2025)
di: BN, Suhas, et al.
Pubblicazione: (2025)
How much do LLMs learn from negative examples?
di: Hamdan, Shadi, et al.
Pubblicazione: (2025)
di: Hamdan, Shadi, et al.
Pubblicazione: (2025)
D-SMART: Enhancing LLM Dialogue Consistency via Dynamic Structured Memory And Reasoning Tree
di: Lei, Xiang, et al.
Pubblicazione: (2025)
di: Lei, Xiang, et al.
Pubblicazione: (2025)
NOTAI.AI: Explainable Detection of Machine-Generated Text via Curvature and Feature Attribution
di: Breneur, Oleksandr Marchenko, et al.
Pubblicazione: (2026)
di: Breneur, Oleksandr Marchenko, et al.
Pubblicazione: (2026)
Rethinking the Multilingual Reasoning Gap with Layer Swap
di: Lasbordes, Maxence, et al.
Pubblicazione: (2026)
di: Lasbordes, Maxence, et al.
Pubblicazione: (2026)
CLMN: Concept based Language Models via Neural Symbolic Reasoning
di: Yang, Yibo
Pubblicazione: (2025)
di: Yang, Yibo
Pubblicazione: (2025)
AI Agents-as-Judge: Automated Assessment of Accuracy, Consistency, Completeness and Clarity for Enterprise Documents
di: Dasgupta, Sudip, et al.
Pubblicazione: (2025)
di: Dasgupta, Sudip, et al.
Pubblicazione: (2025)
Large Language Models are Inconsistent and Biased Evaluators
di: Stureborg, Rickard, et al.
Pubblicazione: (2024)
di: Stureborg, Rickard, et al.
Pubblicazione: (2024)
NERCat: Fine-Tuning for Enhanced Named Entity Recognition in Catalan
di: Ferreres, Guillem Cadevall, et al.
Pubblicazione: (2025)
di: Ferreres, Guillem Cadevall, et al.
Pubblicazione: (2025)
TIS-DPO: Token-level Importance Sampling for Direct Preference Optimization With Estimated Weights
di: Liu, Aiwei, et al.
Pubblicazione: (2024)
di: Liu, Aiwei, et al.
Pubblicazione: (2024)
Co-NAML-LSTUR: A Combined Model with Attentive Multi-View Learning and Long- and Short-term User Representations for News Recommendation
di: Nguyen, Minh Hoang, et al.
Pubblicazione: (2025)
di: Nguyen, Minh Hoang, et al.
Pubblicazione: (2025)
XAutoLM: Efficient Fine-Tuning of Language Models via Meta-Learning and AutoML
di: Estevanell-Valladares, Ernesto L., et al.
Pubblicazione: (2025)
di: Estevanell-Valladares, Ernesto L., et al.
Pubblicazione: (2025)
Tailoring Vaccine Messaging with Common-Ground Opinions
di: Stureborg, Rickard, et al.
Pubblicazione: (2024)
di: Stureborg, Rickard, et al.
Pubblicazione: (2024)
Diagnosing Multi-step Reasoning Failures in Black-box LLMs via Stepwise Confidence Attribution
di: Liu, Xiaoou, et al.
Pubblicazione: (2026)
di: Liu, Xiaoou, et al.
Pubblicazione: (2026)
CognitiveArm: Enabling Real-Time EEG-Controlled Prosthetic Arm Using Embodied Machine Learning
di: Basit, Abdul, et al.
Pubblicazione: (2025)
di: Basit, Abdul, et al.
Pubblicazione: (2025)
Biomedical Visual Instruction Tuning with Clinician Preference Alignment
di: Cui, Hejie, et al.
Pubblicazione: (2024)
di: Cui, Hejie, et al.
Pubblicazione: (2024)
Large Language Models for Propaganda Span Annotation
di: Hasanain, Maram, et al.
Pubblicazione: (2023)
di: Hasanain, Maram, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Towards Probabilistic Question Answering Over Tabular Data
di: Shen, Chen, et al.
Pubblicazione: (2025) -
Experimentation in Content Moderation using RWKV
di: Yildirim, Umut, et al.
Pubblicazione: (2024) -
Low-Resource Neural Machine Translation Using Recurrent Neural Networks and Transfer Learning: A Case Study on English-to-Igbo
di: Ekle, Ocheme Anthony, et al.
Pubblicazione: (2025) -
Prompt Engineering and the Effectiveness of Large Language Models in Enhancing Human Productivity
di: Anam, Rizal Khoirul
Pubblicazione: (2025) -
What is lost in Normalization? Exploring Pitfalls in Multilingual ASR Model Evaluations
di: Manohar, Kavya, et al.
Pubblicazione: (2024)