Distill and Align Decomposition for Enhanced Claim Verification
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Magomere, Jabez, Kochkina, Elena, Mensah, Samuel, Kaur, Simerjot, Acero, Fernando, Oncevay, Arturo, Smiley, Charese H., Liu, Xiaomo, Veloso, Manuela |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
FinNLI: Novel Dataset for Multi-Genre Financial Natural Language Inference Benchmarking
par: Magomere, Jabez, et autres
Publié: (2025)
par: Magomere, Jabez, et autres
Publié: (2025)
A Variational Approach for Mitigating Entity Bias in Relation Extraction
par: Mensah, Samuel, et autres
Publié: (2025)
par: Mensah, Samuel, et autres
Publié: (2025)
Large Language Models as Financial Data Annotators: A Study on Effectiveness and Efficiency
par: Aguda, Toyin, et autres
Publié: (2024)
par: Aguda, Toyin, et autres
Publié: (2024)
FinQAPT: Empowering Financial Decisions with End-to-End LLM-driven Question Answering Pipeline
par: Singh, Kuldeep, et autres
Publié: (2024)
par: Singh, Kuldeep, et autres
Publié: (2024)
Grounding LLM Reasoning with Knowledge Graphs
par: Amayuelas, Alfonso, et autres
Publié: (2025)
par: Amayuelas, Alfonso, et autres
Publié: (2025)
AI Analyst: Framework and Comprehensive Evaluation of Large Language Models for Financial Time Series Report Generation
par: Fons, Elizabeth, et autres
Publié: (2025)
par: Fons, Elizabeth, et autres
Publié: (2025)
Conservative Bias in Large Language Models: Measuring Relation Predictions
par: Aguda, Toyin, et autres
Publié: (2025)
par: Aguda, Toyin, et autres
Publié: (2025)
Scaling Crowdsourced Election Monitoring: Construction and Evaluation of Classification Models for Multilingual and Cross-Domain Classification Settings
par: Magomere, Jabez, et autres
Publié: (2025)
par: Magomere, Jabez, et autres
Publié: (2025)
When Claims Evolve: Evaluating and Enhancing the Robustness of Embedding Models Against Misinformation Edits
par: Magomere, Jabez, et autres
Publié: (2025)
par: Magomere, Jabez, et autres
Publié: (2025)
Deep FinResearch Bench: Evaluating AI's Ability to Conduct Professional Financial Investment Research
par: Haque, Mirazul, et autres
Publié: (2026)
par: Haque, Mirazul, et autres
Publié: (2026)
Grounded or Guessing? LVLM Confidence Estimation via Blind-Image Contrastive Ranking
par: Khanmohammadi, Reza, et autres
Publié: (2026)
par: Khanmohammadi, Reza, et autres
Publié: (2026)
How Reliable are Confidence Estimators for Large Reasoning Models? A Systematic Benchmark on High-Stakes Domains
par: Khanmohammadi, Reza, et autres
Publié: (2026)
par: Khanmohammadi, Reza, et autres
Publié: (2026)
Calibrating LLM Confidence by Probing Perturbed Representation Stability
par: Khanmohammadi, Reza, et autres
Publié: (2025)
par: Khanmohammadi, Reza, et autres
Publié: (2025)
WorldMemArena: Evaluating Multimodal Agent Memory Through Action-World Interaction
par: Liu, Chengzhi, et autres
Publié: (2026)
par: Liu, Chengzhi, et autres
Publié: (2026)
ExStrucTiny: A Benchmark for Schema-Variable Structured Information Extraction from Document Images
par: Sibue, Mathieu, et autres
Publié: (2026)
par: Sibue, Mathieu, et autres
Publié: (2026)
Optimizing Decomposition for Optimal Claim Verification
par: Lu, Yining, et autres
Publié: (2025)
par: Lu, Yining, et autres
Publié: (2025)
The Influence of Biomedical Research on Future Business Funding: Analyzing Scientific Impact and Content in Industrial Investments
par: Khanmohammadi, Reza, et autres
Publié: (2024)
par: Khanmohammadi, Reza, et autres
Publié: (2024)
The Alignment Bottleneck in Decomposition-Based Claim Verification
par: Akhter, Mahmud Elahi, et autres
Publié: (2026)
par: Akhter, Mahmud Elahi, et autres
Publié: (2026)
DocLLM: A layout-aware generative language model for multimodal document understanding
par: Wang, Dongsheng, et autres
Publié: (2023)
par: Wang, Dongsheng, et autres
Publié: (2023)
Perturb Your Data: Paraphrase-Guided Training Data Watermarking
par: Shetty, Pranav, et autres
Publié: (2025)
par: Shetty, Pranav, et autres
Publié: (2025)
A Claim Decomposition Benchmark for Long-form Answer Verification
par: Zhang, Zhihao, et autres
Publié: (2024)
par: Zhang, Zhihao, et autres
Publié: (2024)
"What is the value of {templates}?" Rethinking Document Information Extraction Datasets for LLMs
par: Zmigrod, Ran, et autres
Publié: (2024)
par: Zmigrod, Ran, et autres
Publié: (2024)
Pelican: Correcting Hallucination in Vision-LLMs via Claim Decomposition and Program of Thought Verification
par: Sahu, Pritish, et autres
Publié: (2024)
par: Sahu, Pritish, et autres
Publié: (2024)
MuSciClaims: Multimodal Scientific Claim Verification
par: Lal, Yash Kumar, et autres
Publié: (2025)
par: Lal, Yash Kumar, et autres
Publié: (2025)
GenPlanX. Generation of Plans and Execution
par: Borrajo, Daniel, et autres
Publié: (2025)
par: Borrajo, Daniel, et autres
Publié: (2025)
ClaimPKG: Enhancing Claim Verification via Pseudo-Subgraph Generation with Lightweight Specialized LLM
par: Pham, Hoang, et autres
Publié: (2025)
par: Pham, Hoang, et autres
Publié: (2025)
LINGOLY: A Benchmark of Olympiad-Level Linguistic Reasoning Puzzles in Low-Resource and Extinct Languages
par: Bean, Andrew M., et autres
Publié: (2024)
par: Bean, Andrew M., et autres
Publié: (2024)
SciClaimEval: Cross-modal Claim Verification in Scientific Papers
par: Ho, Xanh, et autres
Publié: (2026)
par: Ho, Xanh, et autres
Publié: (2026)
MedScore: Generalizable Factuality Evaluation of Free-Form Medical Answers by Domain-adapted Claim Decomposition and Verification
par: Huang, Heyuan, et autres
Publié: (2025)
par: Huang, Heyuan, et autres
Publié: (2025)
A Closer Look at Claim Decomposition
par: Wanner, Miriam, et autres
Publié: (2024)
par: Wanner, Miriam, et autres
Publié: (2024)
Minimal Evidence Group Identification for Claim Verification
par: Li, Xiangci, et autres
Publié: (2024)
par: Li, Xiangci, et autres
Publié: (2024)
Complex Claim Verification with Evidence Retrieved in the Wild
par: Chen, Jifan, et autres
Publié: (2023)
par: Chen, Jifan, et autres
Publié: (2023)
Atomic Reasoning for Scientific Table Claim Verification
par: Zhang, Yuji, et autres
Publié: (2025)
par: Zhang, Yuji, et autres
Publié: (2025)
SciClaimHunt: A Large Dataset for Evidence-based Scientific Claim Verification
par: Kumar, Sujit, et autres
Publié: (2025)
par: Kumar, Sujit, et autres
Publié: (2025)
LETS-C: Leveraging Text Embedding for Time Series Classification
par: Kaur, Rachneet, et autres
Publié: (2024)
par: Kaur, Rachneet, et autres
Publié: (2024)
A Benchmark for Open-Domain Numerical Fact-Checking Enhanced by Claim Decomposition
par: Venktesh, V, et autres
Publié: (2025)
par: Venktesh, V, et autres
Publié: (2025)
Robust Claim Verification Through Fact Detection
par: Jafari, Nazanin, et autres
Publié: (2024)
par: Jafari, Nazanin, et autres
Publié: (2024)
Peerispect: Claim Verification in Scientific Peer Reviews
par: Ghorbanpour, Ali, et autres
Publié: (2026)
par: Ghorbanpour, Ali, et autres
Publié: (2026)
SynClaimEval: A Framework for Evaluating the Utility of Synthetic Data in Long-Context Claim Verification
par: Elaraby, Mohamed, et autres
Publié: (2025)
par: Elaraby, Mohamed, et autres
Publié: (2025)
Evergreen: Efficient Claim Verification for Semantic Aggregates
par: Lee, Alexander W., et autres
Publié: (2026)
par: Lee, Alexander W., et autres
Publié: (2026)
Documents similaires
-
FinNLI: Novel Dataset for Multi-Genre Financial Natural Language Inference Benchmarking
par: Magomere, Jabez, et autres
Publié: (2025) -
A Variational Approach for Mitigating Entity Bias in Relation Extraction
par: Mensah, Samuel, et autres
Publié: (2025) -
Large Language Models as Financial Data Annotators: A Study on Effectiveness and Efficiency
par: Aguda, Toyin, et autres
Publié: (2024) -
FinQAPT: Empowering Financial Decisions with End-to-End LLM-driven Question Answering Pipeline
par: Singh, Kuldeep, et autres
Publié: (2024) -
Grounding LLM Reasoning with Knowledge Graphs
par: Amayuelas, Alfonso, et autres
Publié: (2025)