Consolidating Strategies for Countering Hate Speech Using Persuasive Dialogues
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Saha, Sougata, Srihari, Rohini |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Hatred Stems from Ignorance! Distillation of the Persuasion Modes in Countering Conversational Hate Speech
par: Alyahya, Ghadi, et autres
Publié: (2024)
par: Alyahya, Ghadi, et autres
Publié: (2024)
Steering Conversational Large Language Models for Long Emotional Support Conversations
par: Madani, Navid, et autres
Publié: (2024)
par: Madani, Navid, et autres
Publié: (2024)
Mitigating Clickbait: An Approach to Spoiler Generation Using Multitask Learning
par: Pal, Sayantan, et autres
Publié: (2024)
par: Pal, Sayantan, et autres
Publié: (2024)
User Behavior Prediction as a Generic, Robust, Scalable, and Low-Cost Evaluation Strategy for Estimating Generalization in LLMs
par: Saha, Sougata, et autres
Publié: (2025)
par: Saha, Sougata, et autres
Publié: (2025)
Beyond Discrete Personas: Personality Modeling Through Journal Intensive Conversations
par: Pal, Sayantan, et autres
Publié: (2024)
par: Pal, Sayantan, et autres
Publié: (2024)
Exploring the Plausibility of Hate and Counter Speech Detectors with Explainable AI
par: Böck, Adrian Jaques, et autres
Publié: (2024)
par: Böck, Adrian Jaques, et autres
Publié: (2024)
Analysis and Detection of Multilingual Hate Speech Using Transformer Based Deep Learning
par: Das, Arijit, et autres
Publié: (2024)
par: Das, Arijit, et autres
Publié: (2024)
Enhancing Dialogue Generation in Werewolf Game Through Situation Analysis and Persuasion Strategies
par: Qi, Zhiyang, et autres
Publié: (2024)
par: Qi, Zhiyang, et autres
Publié: (2024)
A Recipe For Building a Compliant Real Estate Chatbot
par: Madani, Navid, et autres
Publié: (2024)
par: Madani, Navid, et autres
Publié: (2024)
PVP: An Image Dataset for Personalized Visual Persuasion with Persuasion Strategies, Viewer Characteristics, and Persuasiveness Ratings
par: Kim, Junseo, et autres
Publié: (2025)
par: Kim, Junseo, et autres
Publié: (2025)
HatePrototypes: Interpretable and Transferable Representations for Implicit and Explicit Hate Speech Detection
par: Proskurina, Irina, et autres
Publié: (2025)
par: Proskurina, Irina, et autres
Publié: (2025)
HateXScore: A Metric Suite for Evaluating Reasoning Quality in Hate Speech Explanations
par: Hu, Yujia, et autres
Publié: (2026)
par: Hu, Yujia, et autres
Publié: (2026)
Hierarchical Sentiment Analysis Framework for Hate Speech Detection: Implementing Binary and Multiclass Classification Strategy
par: Naznin, Faria, et autres
Publié: (2024)
par: Naznin, Faria, et autres
Publié: (2024)
Meta-Cultural Competence: Climbing the Right Hill of Cultural Awareness
par: Saha, Sougata, et autres
Publié: (2025)
par: Saha, Sougata, et autres
Publié: (2025)
Empirical Evaluation of Public HateSpeech Datasets
par: Jaf, Sadar, et autres
Publié: (2024)
par: Jaf, Sadar, et autres
Publié: (2024)
xList-Hate: A Checklist-Based Framework for Interpretable and Generalizable Hate Speech Detection
par: Girón, Adrián, et autres
Publié: (2026)
par: Girón, Adrián, et autres
Publié: (2026)
Reading between the Lines: Can LLMs Identify Cross-Cultural Communication Gaps?
par: Saha, Sougata, et autres
Publié: (2025)
par: Saha, Sougata, et autres
Publié: (2025)
Dialogues of Dissent: Thematic and Rhetorical Dimensions of Hate and Counter-Hate Speech in Social Media Conversations
par: Levi, Effi, et autres
Publié: (2025)
par: Levi, Effi, et autres
Publié: (2025)
Causal Discovery and Counterfactual Reasoning to Optimize Persuasive Dialogue Policies
par: Zeng, Donghuo, et autres
Publié: (2025)
par: Zeng, Donghuo, et autres
Publié: (2025)
Selective Demonstration Retrieval for Improved Implicit Hate Speech Detection
par: Kim, Yumin, et autres
Publié: (2025)
par: Kim, Yumin, et autres
Publié: (2025)
Harnessing Artificial Intelligence to Combat Online Hate: Exploring the Challenges and Opportunities of Large Language Models in Hate Speech Detection
par: Kumarage, Tharindu, et autres
Publié: (2024)
par: Kumarage, Tharindu, et autres
Publié: (2024)
BengaliSent140: A Large-Scale Bengali Binary Sentiment Dataset for Hate and Non-Hate Speech Classification
par: Islam, Akif, et autres
Publié: (2026)
par: Islam, Akif, et autres
Publié: (2026)
Using Persuasive Writing Strategies to Explain and Detect Health Misinformation
par: Kamali, Danial, et autres
Publié: (2022)
par: Kamali, Danial, et autres
Publié: (2022)
Towards Fairness Assessment of Dutch Hate Speech Detection
par: Bauer, Julie, et autres
Publié: (2025)
par: Bauer, Julie, et autres
Publié: (2025)
Distilling Knowledge from Large Language Models: A Concept Bottleneck Model for Hate and Counter Speech Recognition
par: Labadie-Tamayo, Roberto, et autres
Publié: (2025)
par: Labadie-Tamayo, Roberto, et autres
Publié: (2025)
Alternative Speech: Complementary Method to Counter-Narrative for Better Discourse
par: Lee, Seungyoon, et autres
Publié: (2024)
par: Lee, Seungyoon, et autres
Publié: (2024)
Towards Weakly-Supervised Hate Speech Classification Across Datasets
par: Jin, Yiping, et autres
Publié: (2023)
par: Jin, Yiping, et autres
Publié: (2023)
A Federated Approach to Few-Shot Hate Speech Detection for Marginalized Communities
par: Ye, Haotian, et autres
Publié: (2024)
par: Ye, Haotian, et autres
Publié: (2024)
Conditioning Large Language Models on Legal Systems? Detecting Punishable Hate Speech
par: Ludwig, Florian, et autres
Publié: (2025)
par: Ludwig, Florian, et autres
Publié: (2025)
Leveraging the Potential of Prompt Engineering for Hate Speech Detection in Low-Resource Languages
par: Prome, Ruhina Tabasshum, et autres
Publié: (2025)
par: Prome, Ruhina Tabasshum, et autres
Publié: (2025)
An EcoSage Assistant: Towards Building A Multimodal Plant Care Dialogue Assistant
par: Tomar, Mohit, et autres
Publié: (2024)
par: Tomar, Mohit, et autres
Publié: (2024)
Towards Generalizable Generic Harmful Speech Datasets for Implicit Hate Speech Detection
par: Almohaimeed, Saad, et autres
Publié: (2025)
par: Almohaimeed, Saad, et autres
Publié: (2025)
Hate Speech Detection using Large Language Models with Data Augmentation and Feature Enhancement
par: Nge, Brian Jing Hong, et autres
Publié: (2026)
par: Nge, Brian Jing Hong, et autres
Publié: (2026)
ChatCLIDS: Simulating Persuasive AI Dialogues to Promote Closed-Loop Insulin Adoption in Type 1 Diabetes Care
par: Yao, Zonghai, et autres
Publié: (2025)
par: Yao, Zonghai, et autres
Publié: (2025)
Towards Detecting Persuasion on Social Media: From Model Development to Insights on Persuasion Strategies
par: Meguellati, Elyas, et autres
Publié: (2025)
par: Meguellati, Elyas, et autres
Publié: (2025)
Navigating Dialectal Bias and Ethical Complexities in Levantine Arabic Hate Speech Detection
par: Ahmed, Ahmed Haj, et autres
Publié: (2024)
par: Ahmed, Ahmed Haj, et autres
Publié: (2024)
Can LLMs Evaluate What They Cannot Annotate? Revisiting LLM Reliability in Hate Speech Detection
par: Piot, Paloma, et autres
Publié: (2025)
par: Piot, Paloma, et autres
Publié: (2025)
More Than Sum of Its Parts: Deciphering Intent Shifts in Multimodal Hate Speech Detection
par: Sun, Runze, et autres
Publié: (2026)
par: Sun, Runze, et autres
Publié: (2026)
Improving Implicit Hate Speech Detection via a Community-Driven Multi-Agent Framework
par: Gajewska, Ewelina, et autres
Publié: (2026)
par: Gajewska, Ewelina, et autres
Publié: (2026)
Bridging Fairness and Explainability: Can Input-Based Explanations Promote Fairness in Hate Speech Detection?
par: Wang, Yifan, et autres
Publié: (2025)
par: Wang, Yifan, et autres
Publié: (2025)
Documents similaires
-
Hatred Stems from Ignorance! Distillation of the Persuasion Modes in Countering Conversational Hate Speech
par: Alyahya, Ghadi, et autres
Publié: (2024) -
Steering Conversational Large Language Models for Long Emotional Support Conversations
par: Madani, Navid, et autres
Publié: (2024) -
Mitigating Clickbait: An Approach to Spoiler Generation Using Multitask Learning
par: Pal, Sayantan, et autres
Publié: (2024) -
User Behavior Prediction as a Generic, Robust, Scalable, and Low-Cost Evaluation Strategy for Estimating Generalization in LLMs
par: Saha, Sougata, et autres
Publié: (2025) -
Beyond Discrete Personas: Personality Modeling Through Journal Intensive Conversations
par: Pal, Sayantan, et autres
Publié: (2024)