When Claims Evolve: Evaluating and Enhancing the Robustness of Embedding Models Against Misinformation Edits
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Magomere, Jabez, La Malfa, Emanuele, Tonneau, Manuel, Kazemi, Ashkan, Hale, Scott |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Scaling Crowdsourced Election Monitoring: Construction and Evaluation of Classification Models for Multilingual and Cross-Domain Classification Settings
par: Magomere, Jabez, et autres
Publié: (2025)
par: Magomere, Jabez, et autres
Publié: (2025)
SynDy: Synthetic Dynamic Dataset Generation Framework for Misinformation Tasks
par: Shliselberg, Michael, et autres
Publié: (2024)
par: Shliselberg, Michael, et autres
Publié: (2024)
Distill and Align Decomposition for Enhanced Claim Verification
par: Magomere, Jabez, et autres
Publié: (2026)
par: Magomere, Jabez, et autres
Publié: (2026)
FinNLI: Novel Dataset for Multi-Genre Financial Natural Language Inference Benchmarking
par: Magomere, Jabez, et autres
Publié: (2025)
par: Magomere, Jabez, et autres
Publié: (2025)
A Variational Approach for Mitigating Entity Bias in Relation Extraction
par: Mensah, Samuel, et autres
Publié: (2025)
par: Mensah, Samuel, et autres
Publié: (2025)
LLM Robustness Against Misinformation in Biomedical Question Answering
par: Bondarenko, Alexander, et autres
Publié: (2024)
par: Bondarenko, Alexander, et autres
Publié: (2024)
Deep Neural Networks via Complex Network Theory: a Perspective
par: La Malfa, Emanuele, et autres
Publié: (2024)
par: La Malfa, Emanuele, et autres
Publié: (2024)
A Notion of Complexity for Theory of Mind via Discrete World Models
par: Huang, X. Angelo, et autres
Publié: (2024)
par: Huang, X. Angelo, et autres
Publié: (2024)
Graph-enhanced Large Language Models in Asynchronous Plan Reasoning
par: Lin, Fangru, et autres
Publié: (2024)
par: Lin, Fangru, et autres
Publié: (2024)
Code Simulation Challenges for Large Language Models
par: La Malfa, Emanuele, et autres
Publié: (2024)
par: La Malfa, Emanuele, et autres
Publié: (2024)
Capturing Pertinent Symbolic Features for Enhanced Content-Based Misinformation Detection
par: Merenda, Flavio, et autres
Publié: (2024)
par: Merenda, Flavio, et autres
Publié: (2024)
Robustness of Prompting: Enhancing Robustness of Large Language Models Against Prompting Attacks
par: Mu, Lin, et autres
Publié: (2025)
par: Mu, Lin, et autres
Publié: (2025)
Combating Biomedical Misinformation through Multi-modal Claim Detection and Evidence-based Verification
par: Barone, Mariano, et autres
Publié: (2025)
par: Barone, Mariano, et autres
Publié: (2025)
EvolvR: Self-Evolving Pairwise Reasoning for Story Evaluation to Enhance Generation
par: Wang, Xinda, et autres
Publié: (2025)
par: Wang, Xinda, et autres
Publié: (2025)
A Survey on Proactive Defense Strategies Against Misinformation in Large Language Models
par: Liu, Shuliang, et autres
Publié: (2025)
par: Liu, Shuliang, et autres
Publié: (2025)
Robust Claim Verification Through Fact Detection
par: Jafari, Nazanin, et autres
Publié: (2024)
par: Jafari, Nazanin, et autres
Publié: (2024)
When Verification Fails: How Compositionally Infeasible Claims Escape Rejection
par: Liu, Muxin, et autres
Publié: (2026)
par: Liu, Muxin, et autres
Publié: (2026)
Multilingual != Multicultural: Evaluating Gaps Between Multilingual Capabilities and Cultural Alignment in LLMs
par: Rystrøm, Jonathan, et autres
Publié: (2025)
par: Rystrøm, Jonathan, et autres
Publié: (2025)
Known By Their Actions: Fingerprinting LLM Browser Agents via UI Traces
par: Lugoloobi, William, et autres
Publié: (2026)
par: Lugoloobi, William, et autres
Publié: (2026)
Let the Code LLM Edit Itself When You Edit the Code
par: He, Zhenyu, et autres
Publié: (2024)
par: He, Zhenyu, et autres
Publié: (2024)
Temperature Matters: Enhancing Watermark Robustness Against Paraphrasing Attacks
par: Idrissi, Badr Youbi, et autres
Publié: (2025)
par: Idrissi, Badr Youbi, et autres
Publié: (2025)
SciClaims: An End-to-End Generative System for Biomedical Claim Analysis
par: Ortega, Raúl, et autres
Publié: (2025)
par: Ortega, Raúl, et autres
Publié: (2025)
When Models Know More Than They Say: Probing Analogical Reasoning in LLMs
par: McGovern, Hope, et autres
Publié: (2026)
par: McGovern, Hope, et autres
Publié: (2026)
Small Edits, Big Consequences: Telling Good from Bad Robustness in Large Language Models
par: Ismailov, Altynbek, et autres
Publié: (2025)
par: Ismailov, Altynbek, et autres
Publié: (2025)
ClaimPKG: Enhancing Claim Verification via Pseudo-Subgraph Generation with Lightweight Specialized LLM
par: Pham, Hoang, et autres
Publié: (2025)
par: Pham, Hoang, et autres
Publié: (2025)
When Facts Change: Probing LLMs on Evolving Knowledge with evolveQA
par: Nakshatri, Nishanth Sridhar, et autres
Publié: (2025)
par: Nakshatri, Nishanth Sridhar, et autres
Publié: (2025)
Misinformation Detection using Large Language Models with Explainability
par: Patel, Jainee, et autres
Publié: (2025)
par: Patel, Jainee, et autres
Publié: (2025)
ClaimBrush: A Novel Framework for Automated Patent Claim Refinement Based on Large Language Models
par: Kawano, Seiya, et autres
Publié: (2024)
par: Kawano, Seiya, et autres
Publié: (2024)
ClaimIQ at CheckThat! 2025: Comparing Prompted and Fine-Tuned Language Models for Verifying Numerical Claims
par: Anik, Anirban Saha, et autres
Publié: (2025)
par: Anik, Anirban Saha, et autres
Publié: (2025)
Fixed Point Explainability
par: La Malfa, Emanuele, et autres
Publié: (2025)
par: La Malfa, Emanuele, et autres
Publié: (2025)
ChartEditBench: Evaluating Grounded Multi-Turn Chart Editing in Multimodal Language Models
par: Kapadnis, Manav Nitin, et autres
Publié: (2026)
par: Kapadnis, Manav Nitin, et autres
Publié: (2026)
Uncertainty Resolution in Misinformation Detection
par: Orlovskiy, Yury, et autres
Publié: (2024)
par: Orlovskiy, Yury, et autres
Publié: (2024)
PatentScore: Multi-dimensional Evaluation of LLM-Generated Patent Claims
par: Yoo, Yongmin, et autres
Publié: (2025)
par: Yoo, Yongmin, et autres
Publié: (2025)
OFFSIDE: Benchmarking Unlearning Misinformation in Multimodal Large Language Models
par: Zheng, Hao, et autres
Publié: (2025)
par: Zheng, Hao, et autres
Publié: (2025)
ContiGuard: A Framework for Continual Toxicity Detection Against Evolving Evasive Perturbations
par: Kang, Hankun, et autres
Publié: (2026)
par: Kang, Hankun, et autres
Publié: (2026)
Bot Wars Evolved: Orchestrating Competing LLMs in a Counterstrike Against Phone Scams
par: Basta, Nardine, et autres
Publié: (2025)
par: Basta, Nardine, et autres
Publié: (2025)
Large Language Models Miss the Multi-Agent Mark
par: La Malfa, Emanuele, et autres
Publié: (2025)
par: La Malfa, Emanuele, et autres
Publié: (2025)
EditPropBench: Measuring Factual Edit Propagation in Scientific Manuscripts
par: Kruthof, Garvin
Publié: (2026)
par: Kruthof, Garvin
Publié: (2026)
Robust Prompt Optimization for Large Language Models Against Distribution Shifts
par: Li, Moxin, et autres
Publié: (2023)
par: Li, Moxin, et autres
Publié: (2023)
Misinforming LLMs: vulnerabilities, challenges and opportunities
par: Zhou, Bo, et autres
Publié: (2024)
par: Zhou, Bo, et autres
Publié: (2024)
Documents similaires
-
Scaling Crowdsourced Election Monitoring: Construction and Evaluation of Classification Models for Multilingual and Cross-Domain Classification Settings
par: Magomere, Jabez, et autres
Publié: (2025) -
SynDy: Synthetic Dynamic Dataset Generation Framework for Misinformation Tasks
par: Shliselberg, Michael, et autres
Publié: (2024) -
Distill and Align Decomposition for Enhanced Claim Verification
par: Magomere, Jabez, et autres
Publié: (2026) -
FinNLI: Novel Dataset for Multi-Genre Financial Natural Language Inference Benchmarking
par: Magomere, Jabez, et autres
Publié: (2025) -
A Variational Approach for Mitigating Entity Bias in Relation Extraction
par: Mensah, Samuel, et autres
Publié: (2025)