Boosting Accuracy and Interpretability in Multilingual Hate Speech Detection Through Layer Freezing and Explainable AI
Fuente:
arXiv
Salvato in:
| Autori principali: | Bilehsavar, Meysam Shirdel, Mahmoudi, Negin, Torkamani, Mohammad Jalili, Kiashemshaki, Kiana |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Ensembling Multilingual Transformers for Robust Sentiment Analysis of Tweets
di: Bilehsavar, Meysam Shirdel, et al.
Pubblicazione: (2025)
di: Bilehsavar, Meysam Shirdel, et al.
Pubblicazione: (2025)
Simulating a Bias Mitigation Scenario in Large Language Models
di: Kiashemshaki, Kiana, et al.
Pubblicazione: (2025)
di: Kiashemshaki, Kiana, et al.
Pubblicazione: (2025)
Secure coding for web applications: Frameworks, challenges, and the role of LLMs
di: Kiashemshaki, Kiana, et al.
Pubblicazione: (2025)
di: Kiashemshaki, Kiana, et al.
Pubblicazione: (2025)
LLM-Driven Adaptive 6G-Ready Wireless Body Area Networks: Survey and Framework
di: Torkamani, Mohammad Jalili, et al.
Pubblicazione: (2025)
di: Torkamani, Mohammad Jalili, et al.
Pubblicazione: (2025)
Secure and Scalable Blockchain Voting: A Comparative Framework and the Role of Large Language Models
di: Kiashemshaki, Kiana, et al.
Pubblicazione: (2025)
di: Kiashemshaki, Kiana, et al.
Pubblicazione: (2025)
Automated Bug Triaging using Instruction-Tuned Large Language Models
di: Kiashemshaki, Kiana, et al.
Pubblicazione: (2025)
di: Kiashemshaki, Kiana, et al.
Pubblicazione: (2025)
Adaptive Edge-Cloud Inference for Speech-to-Action Systems Using ASR and Large Language Models
di: Torkamani, Mohammad Jalili, et al.
Pubblicazione: (2025)
di: Torkamani, Mohammad Jalili, et al.
Pubblicazione: (2025)
Streamlining Security Vulnerability Triage with Large Language Models
di: Torkamani, Mohammad Jalili, et al.
Pubblicazione: (2025)
di: Torkamani, Mohammad Jalili, et al.
Pubblicazione: (2025)
RomanLens: The Role Of Latent Romanization In Multilinguality In LLMs
di: Saji, Alan, et al.
Pubblicazione: (2025)
di: Saji, Alan, et al.
Pubblicazione: (2025)
Dealing with Annotator Disagreement in Hate Speech Classification
di: Dehghan, Somaiyeh, et al.
Pubblicazione: (2025)
di: Dehghan, Somaiyeh, et al.
Pubblicazione: (2025)
Confident, Calibrated, or Complicit: Safety Alignment and Ideological Bias in LLM Hate Speech Detection
di: Selvaganapathy, Sanjeeevan, et al.
Pubblicazione: (2025)
di: Selvaganapathy, Sanjeeevan, et al.
Pubblicazione: (2025)
Arabic Hate Speech Identification and Masking in Social Media using Deep Learning Models and Pre-trained Models Fine-tuning
di: Doghmash, Salam Thabet, et al.
Pubblicazione: (2025)
di: Doghmash, Salam Thabet, et al.
Pubblicazione: (2025)
Enhancing Hate Speech Detection on Social Media: A Comparative Analysis of Machine Learning Models and Text Transformation Approaches
di: Mishra, Saurabh, et al.
Pubblicazione: (2026)
di: Mishra, Saurabh, et al.
Pubblicazione: (2026)
Transparent but Powerful: Explainability, Accuracy, and Generalizability in ADHD Detection from Social Media Data
di: Wiechmann, D., et al.
Pubblicazione: (2024)
di: Wiechmann, D., et al.
Pubblicazione: (2024)
Predictive Simultaneous Interpretation: Harnessing Large Language Models for Democratizing Real-Time Multilingual Communication
di: Iida, Kurando, et al.
Pubblicazione: (2024)
di: Iida, Kurando, et al.
Pubblicazione: (2024)
2M-BELEBELE: Highly Multilingual Speech and American Sign Language Comprehension Dataset
di: Costa-jussà, Marta R., et al.
Pubblicazione: (2024)
di: Costa-jussà, Marta R., et al.
Pubblicazione: (2024)
RV-HATE: Reinforced Multi-Module Voting for Implicit Hate Speech Detection
di: Lee, Yejin, et al.
Pubblicazione: (2025)
di: Lee, Yejin, et al.
Pubblicazione: (2025)
Evaluation of Hate Speech Detection Using Large Language Models and Geographical Contextualization
di: Zahid, Anwar Hossain, et al.
Pubblicazione: (2025)
di: Zahid, Anwar Hossain, et al.
Pubblicazione: (2025)
Lightweight Connective Detection Using Gradient Boosting
di: Er, Mustafa Erolcan, et al.
Pubblicazione: (2024)
di: Er, Mustafa Erolcan, et al.
Pubblicazione: (2024)
Explainable AI for Smart Greenhouse Control: Interpretability of Temporal Fusion Transformer in the Internet of Robotic Things
di: Bashir, Muhammad Jawad, et al.
Pubblicazione: (2025)
di: Bashir, Muhammad Jawad, et al.
Pubblicazione: (2025)
Efficient Hate Speech Detection: Evaluating 38 Models from Traditional Methods to Transformers
di: Abusaqer, Mahmoud, et al.
Pubblicazione: (2025)
di: Abusaqer, Mahmoud, et al.
Pubblicazione: (2025)
MemeIntel: Explainable Detection of Propagandistic and Hateful Memes
di: Kmainasi, Mohamed Bayan, et al.
Pubblicazione: (2025)
di: Kmainasi, Mohamed Bayan, et al.
Pubblicazione: (2025)
Unveiling Hidden Factors: Explainable AI for Feature Boosting in Speech Emotion Recognition
di: Nfissi, Alaa, et al.
Pubblicazione: (2024)
di: Nfissi, Alaa, et al.
Pubblicazione: (2024)
LLM-Based Multi-Task Bangla Hate Speech Detection: Type, Severity, and Target
di: Hasan, Md Arid, et al.
Pubblicazione: (2025)
di: Hasan, Md Arid, et al.
Pubblicazione: (2025)
PathBench: Speech Intelligibility Benchmark for Automatic Pathological Speech Assessment
di: Halpern, Bence Mark, et al.
Pubblicazione: (2026)
di: Halpern, Bence Mark, et al.
Pubblicazione: (2026)
DimStance: Multilingual Datasets for Dimensional Stance Analysis
di: Becker, Jonas, et al.
Pubblicazione: (2026)
di: Becker, Jonas, et al.
Pubblicazione: (2026)
COT: A Generative Approach for Hate Speech Counter-Narratives via Contrastive Optimal Transport
di: Zhang, Linhao, et al.
Pubblicazione: (2024)
di: Zhang, Linhao, et al.
Pubblicazione: (2024)
Seeing Hate Differently: Hate Subspace Modeling for Culture-Aware Hate Speech Detection
di: Cai, Weibin, et al.
Pubblicazione: (2025)
di: Cai, Weibin, et al.
Pubblicazione: (2025)
Exploring the Maze of Multilingual Modeling
di: Nezhad, Sina Bagheri, et al.
Pubblicazione: (2023)
di: Nezhad, Sina Bagheri, et al.
Pubblicazione: (2023)
"AGI" team at SHROOM-CAP: Data-Centric Approach to Multilingual Hallucination Detection using XLM-RoBERTa
di: Rathva, Harsh, et al.
Pubblicazione: (2025)
di: Rathva, Harsh, et al.
Pubblicazione: (2025)
Qwerty AI: Explainable Automated Age Rating and Content Safety Assessment for Russian-Language Screenplays
di: Zmanovskii, Nikita
Pubblicazione: (2025)
di: Zmanovskii, Nikita
Pubblicazione: (2025)
Iterative Feature Boosting for Explainable Speech Emotion Recognition
di: Nfissi, Alaa, et al.
Pubblicazione: (2024)
di: Nfissi, Alaa, et al.
Pubblicazione: (2024)
Towards Massive Multilingual Holistic Bias
di: Tan, Xiaoqing Ellen, et al.
Pubblicazione: (2024)
di: Tan, Xiaoqing Ellen, et al.
Pubblicazione: (2024)
CRISP: Persistent Concept Unlearning via Sparse Autoencoders
di: Ashuach, Tomer, et al.
Pubblicazione: (2025)
di: Ashuach, Tomer, et al.
Pubblicazione: (2025)
What Drives Performance in Multilingual Language Models?
di: Nezhad, Sina Bagheri, et al.
Pubblicazione: (2024)
di: Nezhad, Sina Bagheri, et al.
Pubblicazione: (2024)
AmpleHate: Amplifying the Attention for Versatile Implicit Hate Detection
di: Lee, Yejin, et al.
Pubblicazione: (2025)
di: Lee, Yejin, et al.
Pubblicazione: (2025)
DimABSA: Building Multilingual and Multidomain Datasets for Dimensional Aspect-Based Sentiment Analysis
di: Lee, Lung-Hao, et al.
Pubblicazione: (2026)
di: Lee, Lung-Hao, et al.
Pubblicazione: (2026)
Self-Supervised Borrowing Detection on Multilingual Wordlists
di: Wientzek, Tim
Pubblicazione: (2025)
di: Wientzek, Tim
Pubblicazione: (2025)
Evaluating GenAI for Simplifying Texts for Education: Improving Accuracy and Consistency for Enhanced Readability
di: Day, Stephanie L., et al.
Pubblicazione: (2025)
di: Day, Stephanie L., et al.
Pubblicazione: (2025)
SeLeRoSa: Sentence-Level Romanian Satire Detection Dataset
di: Smădu, Răzvan-Alexandru, et al.
Pubblicazione: (2025)
di: Smădu, Răzvan-Alexandru, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Ensembling Multilingual Transformers for Robust Sentiment Analysis of Tweets
di: Bilehsavar, Meysam Shirdel, et al.
Pubblicazione: (2025) -
Simulating a Bias Mitigation Scenario in Large Language Models
di: Kiashemshaki, Kiana, et al.
Pubblicazione: (2025) -
Secure coding for web applications: Frameworks, challenges, and the role of LLMs
di: Kiashemshaki, Kiana, et al.
Pubblicazione: (2025) -
LLM-Driven Adaptive 6G-Ready Wireless Body Area Networks: Survey and Framework
di: Torkamani, Mohammad Jalili, et al.
Pubblicazione: (2025) -
Secure and Scalable Blockchain Voting: A Comparative Framework and the Role of Large Language Models
di: Kiashemshaki, Kiana, et al.
Pubblicazione: (2025)