MALicious INTent Dataset and Inoculating LLMs for Enhanced Disinformation Detection
Fuente:
arXiv
Salvato in:
| Autori principali: | Modzelewski, Arkadiusz, Sosnowski, Witold, Papadopulos, Eleni, Sartori, Elisa, Labruna, Tiziano, Martino, Giovanni Da San, Wierzbicki, Adam |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
PCoT: Persuasion-Augmented Chain of Thought for Detecting Fake News and Social Media Disinformation
di: Modzelewski, Arkadiusz, et al.
Pubblicazione: (2025)
di: Modzelewski, Arkadiusz, et al.
Pubblicazione: (2025)
Detecting Winning Arguments with Large Language Models and Persuasion Strategies
di: Labruna, Tiziano, et al.
Pubblicazione: (2026)
di: Labruna, Tiziano, et al.
Pubblicazione: (2026)
Positional Bias in Binary Question Answering: How Uncertainty Shapes Model Preferences
di: Labruna, Tiziano, et al.
Pubblicazione: (2025)
di: Labruna, Tiziano, et al.
Pubblicazione: (2025)
Can AI-Generated Persuasion Be Detected? Persuaficial Benchmark and AI vs. Human Linguistic Differences
di: Modzelewski, Arkadiusz, et al.
Pubblicazione: (2026)
di: Modzelewski, Arkadiusz, et al.
Pubblicazione: (2026)
Evaluating Task-Oriented Dialogue Consistency through Constraint Satisfaction
di: Labruna, Tiziano, et al.
Pubblicazione: (2024)
di: Labruna, Tiziano, et al.
Pubblicazione: (2024)
When to Retrieve: Teaching LLMs to Utilize Information Retrieval Effectively
di: Labruna, Tiziano, et al.
Pubblicazione: (2024)
di: Labruna, Tiziano, et al.
Pubblicazione: (2024)
PropXplain: Can LLMs Enable Explainable Propaganda Detection?
di: Hasanain, Maram, et al.
Pubblicazione: (2025)
di: Hasanain, Maram, et al.
Pubblicazione: (2025)
Enhancing Disinformation Detection with Explainable AI and Named Entity Replacement
di: González-Silot, Santiago, et al.
Pubblicazione: (2025)
di: González-Silot, Santiago, et al.
Pubblicazione: (2025)
Four Shades of Life Sciences: A Dataset for Disinformation Detection in the Life Sciences
di: Seidlmayer, Eva, et al.
Pubblicazione: (2025)
di: Seidlmayer, Eva, et al.
Pubblicazione: (2025)
AnomaLLMy -- Detecting anomalous tokens in black-box LLMs through low-confidence single-token predictions
di: Witold, Waligóra
Pubblicazione: (2024)
di: Witold, Waligóra
Pubblicazione: (2024)
CritiSense: Critical Digital Literacy and Resilience Against Misinformation
di: Alam, Firoj, et al.
Pubblicazione: (2026)
di: Alam, Firoj, et al.
Pubblicazione: (2026)
Entity Framing and Role Portrayal in the News
di: Mahmoud, Tarek, et al.
Pubblicazione: (2025)
di: Mahmoud, Tarek, et al.
Pubblicazione: (2025)
EUvsDisinfo: A Dataset for Multilingual Detection of Pro-Kremlin Disinformation in News Articles
di: Leite, João A., et al.
Pubblicazione: (2024)
di: Leite, João A., et al.
Pubblicazione: (2024)
Large Language Models in Legislative Content Analysis: A Dataset from the Polish Parliament
di: Bryłkowski, Arkadiusz, et al.
Pubblicazione: (2025)
di: Bryłkowski, Arkadiusz, et al.
Pubblicazione: (2025)
Disinformation Capabilities of Large Language Models
di: Vykopal, Ivan, et al.
Pubblicazione: (2023)
di: Vykopal, Ivan, et al.
Pubblicazione: (2023)
Retrieving Climate Change Disinformation by Narrative
di: Upravitelev, Max, et al.
Pubblicazione: (2026)
di: Upravitelev, Max, et al.
Pubblicazione: (2026)
Lying Blindly: Bypassing ChatGPT's Safeguards to Generate Hard-to-Detect Disinformation Claims
di: Heppell, Freddy, et al.
Pubblicazione: (2024)
di: Heppell, Freddy, et al.
Pubblicazione: (2024)
Proactive Defense: Compound AI for Detecting Persuasion Attacks and Measuring Inoculation Effectiveness
di: Volkova, Svitlana, et al.
Pubblicazione: (2025)
di: Volkova, Svitlana, et al.
Pubblicazione: (2025)
VLDBench Evaluating Multimodal Disinformation with Regulatory Alignment
di: Raza, Shaina, et al.
Pubblicazione: (2025)
di: Raza, Shaina, et al.
Pubblicazione: (2025)
Catching Chameleons: Detecting Evolving Disinformation Generated using Large Language Models
di: Jiang, Bohan, et al.
Pubblicazione: (2024)
di: Jiang, Bohan, et al.
Pubblicazione: (2024)
Inoculation Prompting: Eliciting traits from LLMs during training can suppress them at test-time
di: Tan, Daniel, et al.
Pubblicazione: (2025)
di: Tan, Daniel, et al.
Pubblicazione: (2025)
Temporal Dynamics of Coordinated Online Behavior: Stability, Archetypes, and Influence
di: Tardelli, Serena, et al.
Pubblicazione: (2023)
di: Tardelli, Serena, et al.
Pubblicazione: (2023)
Da cidadania regulada à universalização: a política de assistência social brasileira como paradigma emergente de política social de inclusão
di: Jorge Papadópulos
Pubblicazione: (2005)
di: Jorge Papadópulos
Pubblicazione: (2005)
Trust in Disinformation Narratives: a Trust in the News Experiment
di: Song, Hanbyul, et al.
Pubblicazione: (2025)
di: Song, Hanbyul, et al.
Pubblicazione: (2025)
Experimenting AI Technologies for Disinformation Combat: the IDMO Project
di: Canale, Lorenzo, et al.
Pubblicazione: (2023)
di: Canale, Lorenzo, et al.
Pubblicazione: (2023)
Support or Refute: Analyzing the Stance of Evidence to Detect Out-of-Context Mis- and Disinformation
di: Yuan, Xin, et al.
Pubblicazione: (2023)
di: Yuan, Xin, et al.
Pubblicazione: (2023)
Improving QA Model Performance with Cartographic Inoculation
di: Chen, Allen, et al.
Pubblicazione: (2024)
di: Chen, Allen, et al.
Pubblicazione: (2024)
Enriching GNNs with Text Contextual Representations for Detecting Disinformation Campaigns on Social Media
di: da Silva, Bruno Croso Cunha, et al.
Pubblicazione: (2024)
di: da Silva, Bruno Croso Cunha, et al.
Pubblicazione: (2024)
Narratives at Conflict: Computational Analysis of News Framing in Multilingual Disinformation Campaigns
di: Sinelnik, Antonina, et al.
Pubblicazione: (2024)
di: Sinelnik, Antonina, et al.
Pubblicazione: (2024)
Defending Against Disinformation Attacks in Open-Domain Question Answering
di: Weller, Orion, et al.
Pubblicazione: (2022)
di: Weller, Orion, et al.
Pubblicazione: (2022)
Combinatorial Optimization for All: Using LLMs to Aid Non-Experts in Improving Optimization Algorithms
di: Sartori, Camilo Chacón, et al.
Pubblicazione: (2025)
di: Sartori, Camilo Chacón, et al.
Pubblicazione: (2025)
MemeLens: Multilingual Multitask VLMs for Memes
di: Shahroor, Ali Ezzat, et al.
Pubblicazione: (2026)
di: Shahroor, Ali Ezzat, et al.
Pubblicazione: (2026)
A New Hybrid Intelligent Approach for Multimodal Detection of Suspected Disinformation on TikTok
di: Guerrero-Sosa, Jared D. T., et al.
Pubblicazione: (2025)
di: Guerrero-Sosa, Jared D. T., et al.
Pubblicazione: (2025)
Accurate Legal Reasoning at Scale: Neuro-Symbolic Offloading and Structural Auditability for Robust Legal Adjudication
di: Sójka, Stanisław, et al.
Pubblicazione: (2026)
di: Sójka, Stanisław, et al.
Pubblicazione: (2026)
Towards Enhancing Coherence in Extractive Summarization: Dataset and Experiments with LLMs
di: Parmar, Mihir, et al.
Pubblicazione: (2024)
di: Parmar, Mihir, et al.
Pubblicazione: (2024)
Improving Existing Optimization Algorithms with LLMs
di: Sartori, Camilo Chacón, et al.
Pubblicazione: (2025)
di: Sartori, Camilo Chacón, et al.
Pubblicazione: (2025)
A Multilingual, Large-Scale Study of the Interplay between LLM Safeguards, Personalisation, and Disinformation
di: Leite, João A., et al.
Pubblicazione: (2025)
di: Leite, João A., et al.
Pubblicazione: (2025)
Evaluation of LLM Vulnerabilities to Being Misused for Personalized Disinformation Generation
di: Zugecova, Aneta, et al.
Pubblicazione: (2024)
di: Zugecova, Aneta, et al.
Pubblicazione: (2024)
PolyTruth: Multilingual Disinformation Detection using Transformer-Based Language Models
di: Gouliev, Zaur, et al.
Pubblicazione: (2025)
di: Gouliev, Zaur, et al.
Pubblicazione: (2025)
ExU: AI Models for Examining Multilingual Disinformation Narratives and Understanding their Spread
di: Vasilakes, Jake, et al.
Pubblicazione: (2024)
di: Vasilakes, Jake, et al.
Pubblicazione: (2024)
Documenti analoghi
-
PCoT: Persuasion-Augmented Chain of Thought for Detecting Fake News and Social Media Disinformation
di: Modzelewski, Arkadiusz, et al.
Pubblicazione: (2025) -
Detecting Winning Arguments with Large Language Models and Persuasion Strategies
di: Labruna, Tiziano, et al.
Pubblicazione: (2026) -
Positional Bias in Binary Question Answering: How Uncertainty Shapes Model Preferences
di: Labruna, Tiziano, et al.
Pubblicazione: (2025) -
Can AI-Generated Persuasion Be Detected? Persuaficial Benchmark and AI vs. Human Linguistic Differences
di: Modzelewski, Arkadiusz, et al.
Pubblicazione: (2026) -
Evaluating Task-Oriented Dialogue Consistency through Constraint Satisfaction
di: Labruna, Tiziano, et al.
Pubblicazione: (2024)