Counterspeech the ultimate shield! Multi-Conditioned Counterspeech Generation through Attributed Prefix Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Kumar, Aswini, Bandhakavi, Anil, Chakraborty, Tanmoy |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
CSEval: Towards Automated, Multi-Dimensional, and Reference-Free Counterspeech Evaluation using Auto-Calibrated LLMs
di: Hengle, Amey, et al.
Pubblicazione: (2025)
di: Hengle, Amey, et al.
Pubblicazione: (2025)
Intent-conditioned and Non-toxic Counterspeech Generation using Multi-Task Instruction Tuning with RLAIF
di: Hengle, Amey, et al.
Pubblicazione: (2024)
di: Hengle, Amey, et al.
Pubblicazione: (2024)
On Zero-Shot Counterspeech Generation by LLMs
di: Saha, Punyajoy, et al.
Pubblicazione: (2024)
di: Saha, Punyajoy, et al.
Pubblicazione: (2024)
CODEOFCONDUCT at Multilingual Counterspeech Generation: A Context-Aware Model for Robust Counterspeech Generation in Low-Resource Languages
di: Bennie, Michael, et al.
Pubblicazione: (2025)
di: Bennie, Michael, et al.
Pubblicazione: (2025)
Assessing the Human Likeness of AI-Generated Counterspeech
di: Song, Xiaoying, et al.
Pubblicazione: (2024)
di: Song, Xiaoying, et al.
Pubblicazione: (2024)
Low-Resource Counterspeech Generation for Indic Languages: The Case of Bengali and Hindi
di: Das, Mithun, et al.
Pubblicazione: (2024)
di: Das, Mithun, et al.
Pubblicazione: (2024)
Echoes of Discord: Forecasting Hater Reactions to Counterspeech
di: Song, Xiaoying, et al.
Pubblicazione: (2025)
di: Song, Xiaoying, et al.
Pubblicazione: (2025)
Assisted Counterspeech Writing at the Crossroads of Hate Speech and Misinformation
di: Martone, Genoveffa, et al.
Pubblicazione: (2026)
di: Martone, Genoveffa, et al.
Pubblicazione: (2026)
Counterspeech
Pubblicazione: (2025)
Pubblicazione: (2025)
NLP for Counterspeech against Hate: A Survey and How-To Guide
di: Bonaldi, Helena, et al.
Pubblicazione: (2024)
di: Bonaldi, Helena, et al.
Pubblicazione: (2024)
Speaking at the Right Level: Literacy-Controlled Counterspeech Generation with RAG-RL
di: Song, Xiaoying, et al.
Pubblicazione: (2025)
di: Song, Xiaoying, et al.
Pubblicazione: (2025)
Multi-Agent Retrieval-Augmented Framework for Evidence-Based Counterspeech Against Health Misinformation
di: Anik, Anirban Saha, et al.
Pubblicazione: (2025)
di: Anik, Anirban Saha, et al.
Pubblicazione: (2025)
Multilingual Hate Speech Detection and Counterspeech Generation: A Comprehensive Survey and Practical Guide
di: Fesaghandis, Zahra Safdari, et al.
Pubblicazione: (2026)
di: Fesaghandis, Zahra Safdari, et al.
Pubblicazione: (2026)
Counterspeech for Mitigating the Influence of Media Bias: Comparing Human and LLM-Generated Responses
di: Lin, Luyang, et al.
Pubblicazione: (2025)
di: Lin, Luyang, et al.
Pubblicazione: (2025)
Northeastern Uni at Multilingual Counterspeech Generation: Enhancing Counter Speech Generation with LLM Alignment through Direct Preference Optimization
di: Wadhwa, Sahil, et al.
Pubblicazione: (2024)
di: Wadhwa, Sahil, et al.
Pubblicazione: (2024)
Debunking with Dialogue? Exploring AI-Generated Counterspeech to Challenge Conspiracy Theories
di: Lisker, Mareike, et al.
Pubblicazione: (2025)
di: Lisker, Mareike, et al.
Pubblicazione: (2025)
Demarked: A Strategy for Enhanced Abusive Speech Moderation through Counterspeech, Detoxification, and Message Management
di: Yimam, Seid Muhie, et al.
Pubblicazione: (2024)
di: Yimam, Seid Muhie, et al.
Pubblicazione: (2024)
Can NLP Tackle Hate Speech in the Real World? Stakeholder-Informed Feedback and Survey on Counterspeech
di: Dinkar, Tanvi, et al.
Pubblicazione: (2025)
di: Dinkar, Tanvi, et al.
Pubblicazione: (2025)
NLP Systems That Can't Tell Use from Mention Censor Counterspeech, but Teaching the Distinction Helps
di: Gligoric, Kristina, et al.
Pubblicazione: (2024)
di: Gligoric, Kristina, et al.
Pubblicazione: (2024)
Behind the Counter: Exploring the Motivations and Barriers of Online Counterspeech Writing
di: Ping, Kaike, et al.
Pubblicazione: (2024)
di: Ping, Kaike, et al.
Pubblicazione: (2024)
PANDA -- Paired Anti-hate Narratives Dataset from Asia: Using an LLM-as-a-Judge to Create the First Chinese Counterspeech Dataset
di: Bennie, Michael, et al.
Pubblicazione: (2025)
di: Bennie, Michael, et al.
Pubblicazione: (2025)
Designing Human-AI Collaboration to Support Learning in Counterspeech Writing
di: Ding, Xiaohan, et al.
Pubblicazione: (2024)
di: Ding, Xiaohan, et al.
Pubblicazione: (2024)
Harmonizing Code-mixed Conversations: Personality-assisted Code-mixed Response Generation in Dialogues
di: Kumar, Shivani, et al.
Pubblicazione: (2024)
di: Kumar, Shivani, et al.
Pubblicazione: (2024)
Contextualized Counterspeech: Strategies for Adaptation, Personalization, and Evaluation
di: Cima, Lorenzo, et al.
Pubblicazione: (2024)
di: Cima, Lorenzo, et al.
Pubblicazione: (2024)
Rescuing Counterspeech: A Bridging-Based Approach to Combating Misinformation
di: Peng, Kenny, et al.
Pubblicazione: (2024)
di: Peng, Kenny, et al.
Pubblicazione: (2024)
Assessing How Hate, Counterspeech, and Toxicity Affect Hate Group Newcomers
di: Hickey, Daniel, et al.
Pubblicazione: (2024)
di: Hickey, Daniel, et al.
Pubblicazione: (2024)
MAGneT: Coordinated Multi-Agent Generation of Synthetic Multi-Turn Mental Health Counseling Sessions
di: Mandal, Aishik, et al.
Pubblicazione: (2025)
di: Mandal, Aishik, et al.
Pubblicazione: (2025)
Echoes of Norms: Investigating Counterspeech Bots' Influence on Bystanders in Online Communities
di: Wang, Mengyao, et al.
Pubblicazione: (2026)
di: Wang, Mengyao, et al.
Pubblicazione: (2026)
Tox-BART: Leveraging Toxicity Attributes for Explanation Generation of Implicit Hate Speech
di: Yadav, Neemesh, et al.
Pubblicazione: (2024)
di: Yadav, Neemesh, et al.
Pubblicazione: (2024)
Understanding the Physics of Key-Value Cache Compression for LLMs through Attention Dynamics
di: Ananthanarayanan, Samhruth, et al.
Pubblicazione: (2026)
di: Ananthanarayanan, Samhruth, et al.
Pubblicazione: (2026)
Rank, Chunk and Expand: Lineage-Oriented Reasoning for Taxonomy Expansion
di: Mishra, Sahil, et al.
Pubblicazione: (2025)
di: Mishra, Sahil, et al.
Pubblicazione: (2025)
Exposing Long-Tail Safety Failures in Large Language Models through Efficient Diverse Response Sampling
di: Hajra, Suvadeep, et al.
Pubblicazione: (2026)
di: Hajra, Suvadeep, et al.
Pubblicazione: (2026)
Generating Event-oriented Attribution for Movies via Two-Stage Prefix-Enhanced Multimodal LLM
di: Lyu, Yuanjie, et al.
Pubblicazione: (2024)
di: Lyu, Yuanjie, et al.
Pubblicazione: (2024)
Multilingual Test-Time Scaling via Initial Thought Transfer
di: Bajpai, Prasoon, et al.
Pubblicazione: (2025)
di: Bajpai, Prasoon, et al.
Pubblicazione: (2025)
coTherapist: A Behavior-Aligned Small Language Model to Support Mental Healthcare Experts
di: Adhikary, Prottay Kumar, et al.
Pubblicazione: (2026)
di: Adhikary, Prottay Kumar, et al.
Pubblicazione: (2026)
Decoding Memes: Benchmarking Narrative Role Classification across Multilingual and Multimodal Models
di: Sharma, Shivam, et al.
Pubblicazione: (2025)
di: Sharma, Shivam, et al.
Pubblicazione: (2025)
You Only Prune Once: Designing Calibration-Free Model Compression With Policy Learning
di: Sengupta, Ayan, et al.
Pubblicazione: (2025)
di: Sengupta, Ayan, et al.
Pubblicazione: (2025)
On the Generalization vs Fidelity Paradox in Knowledge Distillation
di: Ramesh, Suhas Kamasetty, et al.
Pubblicazione: (2025)
di: Ramesh, Suhas Kamasetty, et al.
Pubblicazione: (2025)
Factual and Edit-Sensitive Graph-to-Sequence Generation via Graph-Aware Adaptive Noising
di: Shahane, Aditya Hemant, et al.
Pubblicazione: (2026)
di: Shahane, Aditya Hemant, et al.
Pubblicazione: (2026)
Persona-aware Generative Model for Code-mixed Language
di: Sengupta, Ayan, et al.
Pubblicazione: (2023)
di: Sengupta, Ayan, et al.
Pubblicazione: (2023)
Documenti analoghi
-
CSEval: Towards Automated, Multi-Dimensional, and Reference-Free Counterspeech Evaluation using Auto-Calibrated LLMs
di: Hengle, Amey, et al.
Pubblicazione: (2025) -
Intent-conditioned and Non-toxic Counterspeech Generation using Multi-Task Instruction Tuning with RLAIF
di: Hengle, Amey, et al.
Pubblicazione: (2024) -
On Zero-Shot Counterspeech Generation by LLMs
di: Saha, Punyajoy, et al.
Pubblicazione: (2024) -
CODEOFCONDUCT at Multilingual Counterspeech Generation: A Context-Aware Model for Robust Counterspeech Generation in Low-Resource Languages
di: Bennie, Michael, et al.
Pubblicazione: (2025) -
Assessing the Human Likeness of AI-Generated Counterspeech
di: Song, Xiaoying, et al.
Pubblicazione: (2024)