Veri-R1: Toward Precise and Faithful Claim Verification via Online Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | He, Qi, Qian, Cheng, Chen, Xiusi, He, Bingxiang, Fung, Yi R., Ji, Heng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
PEARL: Self-Evolving Assistant for Time Management with Reinforcement Learning
di: Li, Bingxuan, et al.
Pubblicazione: (2026)
di: Li, Bingxuan, et al.
Pubblicazione: (2026)
EscapeBench: Towards Advancing Creative Intelligence of Language Model Agents
di: Qian, Cheng, et al.
Pubblicazione: (2024)
di: Qian, Cheng, et al.
Pubblicazione: (2024)
Atomic Reasoning for Scientific Table Claim Verification
di: Zhang, Yuji, et al.
Pubblicazione: (2025)
di: Zhang, Yuji, et al.
Pubblicazione: (2025)
CostBench: Evaluating Multi-Turn Cost-Optimal Planning and Adaptation in Dynamic Environments for LLM Tool-Use Agents
di: Liu, Jiayu, et al.
Pubblicazione: (2025)
di: Liu, Jiayu, et al.
Pubblicazione: (2025)
ToolRL: Reward is All Tool Learning Needs
di: Qian, Cheng, et al.
Pubblicazione: (2025)
di: Qian, Cheng, et al.
Pubblicazione: (2025)
Current Agents Fail to Leverage World Model as Tool for Foresight
di: Qian, Cheng, et al.
Pubblicazione: (2026)
di: Qian, Cheng, et al.
Pubblicazione: (2026)
DecisionFlow: Advancing Large Language Model as Principled Decision Maker
di: Chen, Xiusi, et al.
Pubblicazione: (2025)
di: Chen, Xiusi, et al.
Pubblicazione: (2025)
Alice: Proactive Learning with Teacher's Demonstrations for Weak-to-Strong Generalization
di: Wu, Shujin, et al.
Pubblicazione: (2025)
di: Wu, Shujin, et al.
Pubblicazione: (2025)
Reinforcement Learning from Denoising Feedback
di: He, Qi, et al.
Pubblicazione: (2026)
di: He, Qi, et al.
Pubblicazione: (2026)
Self-Correction is More than Refinement: A Learning Framework for Visual and Language Reasoning Tasks
di: He, Jiayi, et al.
Pubblicazione: (2024)
di: He, Jiayi, et al.
Pubblicazione: (2024)
Beyond Sample-Level Feedback: Using Reference-Level Feedback to Guide Data Synthesis
di: Mehri, Shuhaib, et al.
Pubblicazione: (2025)
di: Mehri, Shuhaib, et al.
Pubblicazione: (2025)
Debating Truth: Debate-driven Claim Verification with Multiple Large Language Model Agents
di: He, Haorui, et al.
Pubblicazione: (2025)
di: He, Haorui, et al.
Pubblicazione: (2025)
ClinTutor-R1: Advancing Scalable and Robust One-to-Many Alignment in Clinical Socratic Education
di: He, Zhitao, et al.
Pubblicazione: (2025)
di: He, Zhitao, et al.
Pubblicazione: (2025)
Can LLMs Produce Faithful Explanations For Fact-checking? Towards Faithful Explainable Fact-Checking via Multi-Agent Debate
di: Kim, Kyungha, et al.
Pubblicazione: (2024)
di: Kim, Kyungha, et al.
Pubblicazione: (2024)
CREATOR: Tool Creation for Disentangling Abstract and Concrete Reasoning of Large Language Models
di: Qian, Cheng, et al.
Pubblicazione: (2023)
di: Qian, Cheng, et al.
Pubblicazione: (2023)
Towards LifeSpan Cognitive Systems
di: Wang, Yu, et al.
Pubblicazione: (2024)
di: Wang, Yu, et al.
Pubblicazione: (2024)
Parallel-R1: Towards Parallel Thinking via Reinforcement Learning
di: Zheng, Tong, et al.
Pubblicazione: (2025)
di: Zheng, Tong, et al.
Pubblicazione: (2025)
LEMMA: Towards LVLM-Enhanced Multimodal Misinformation Detection with External Knowledge Augmentation
di: Xuan, Keyang, et al.
Pubblicazione: (2024)
di: Xuan, Keyang, et al.
Pubblicazione: (2024)
RM-R1: Reward Modeling as Reasoning
di: Chen, Xiusi, et al.
Pubblicazione: (2025)
di: Chen, Xiusi, et al.
Pubblicazione: (2025)
SciClaimEval: Cross-modal Claim Verification in Scientific Papers
di: Ho, Xanh, et al.
Pubblicazione: (2026)
di: Ho, Xanh, et al.
Pubblicazione: (2026)
CPMobius: Iterative Coach-Player Reasoning for Data-Free Reinforcement Learning
di: Li, Ran, et al.
Pubblicazione: (2026)
di: Li, Ran, et al.
Pubblicazione: (2026)
MuSciClaims: Multimodal Scientific Claim Verification
di: Lal, Yash Kumar, et al.
Pubblicazione: (2025)
di: Lal, Yash Kumar, et al.
Pubblicazione: (2025)
RebuttalAgent: Strategic Persuasion in Academic Rebuttal via Theory of Mind
di: He, Zhitao, et al.
Pubblicazione: (2026)
di: He, Zhitao, et al.
Pubblicazione: (2026)
VeriEQL: Bounded Equivalence Verification for Complex SQL Queries with Integrity Constraints
di: He, Yang, et al.
Pubblicazione: (2024)
di: He, Yang, et al.
Pubblicazione: (2024)
Assessing the Reasoning Capabilities of LLMs in the context of Evidence-based Claim Verification
di: Dougrez-Lewis, John, et al.
Pubblicazione: (2024)
di: Dougrez-Lewis, John, et al.
Pubblicazione: (2024)
Towards Faithful and Controllable Personalization via Critique-Post-Edit Reinforcement Learning
di: Zhu, Chenghao, et al.
Pubblicazione: (2025)
di: Zhu, Chenghao, et al.
Pubblicazione: (2025)
Fast and Faithful: Real-Time Verification for Long-Document Retrieval-Augmented Generation Systems
di: Liu, Xunzhuo, et al.
Pubblicazione: (2026)
di: Liu, Xunzhuo, et al.
Pubblicazione: (2026)
Faithful Autoformalization via Roundtrip Verification and Repair
di: Amrollahi, Daneshvar, et al.
Pubblicazione: (2026)
di: Amrollahi, Daneshvar, et al.
Pubblicazione: (2026)
Minimal Evidence Group Identification for Claim Verification
di: Li, Xiangci, et al.
Pubblicazione: (2024)
di: Li, Xiangci, et al.
Pubblicazione: (2024)
Complex Claim Verification with Evidence Retrieved in the Wild
di: Chen, Jifan, et al.
Pubblicazione: (2023)
di: Chen, Jifan, et al.
Pubblicazione: (2023)
Towards Faithful Explanations for Text Classification with Robustness Improvement and Explanation Guided Training
di: Li, Dongfang, et al.
Pubblicazione: (2023)
di: Li, Dongfang, et al.
Pubblicazione: (2023)
Teaching Large Language Models to Maintain Contextual Faithfulness via Synthetic Tasks and Reinforcement Learning
di: Si, Shuzheng, et al.
Pubblicazione: (2025)
di: Si, Shuzheng, et al.
Pubblicazione: (2025)
FaithRL: Learning to Reason Faithfully through Step-Level Faithfulness Maximization
di: Gui, Runquan, et al.
Pubblicazione: (2026)
di: Gui, Runquan, et al.
Pubblicazione: (2026)
A Desideratum for Conversational Agents: Capabilities, Challenges, and Future Directions
di: Acikgoz, Emre Can, et al.
Pubblicazione: (2025)
di: Acikgoz, Emre Can, et al.
Pubblicazione: (2025)
DocCHA: Towards LLM-Augmented Interactive Online diagnosis System
di: Liu, Xinyi, et al.
Pubblicazione: (2025)
di: Liu, Xinyi, et al.
Pubblicazione: (2025)
Aligning LLMs with Individual Preferences via Interaction
di: Wu, Shujin, et al.
Pubblicazione: (2024)
di: Wu, Shujin, et al.
Pubblicazione: (2024)
MedRAGChecker: Claim-Level Verification for Biomedical Retrieval-Augmented Generation
di: Ji, Yuelyu, et al.
Pubblicazione: (2026)
di: Ji, Yuelyu, et al.
Pubblicazione: (2026)
Faithful-MR1: Faithful Multimodal Reasoning via Anchoring and Reinforcing Visual Attention
di: Tian, Changyuan, et al.
Pubblicazione: (2026)
di: Tian, Changyuan, et al.
Pubblicazione: (2026)
Shop-R1: Rewarding LLMs to Simulate Human Behavior in Online Shopping via Reinforcement Learning
di: Zhang, Yimeng, et al.
Pubblicazione: (2025)
di: Zhang, Yimeng, et al.
Pubblicazione: (2025)
ClaimPKG: Enhancing Claim Verification via Pseudo-Subgraph Generation with Lightweight Specialized LLM
di: Pham, Hoang, et al.
Pubblicazione: (2025)
di: Pham, Hoang, et al.
Pubblicazione: (2025)
Documenti analoghi
-
PEARL: Self-Evolving Assistant for Time Management with Reinforcement Learning
di: Li, Bingxuan, et al.
Pubblicazione: (2026) -
EscapeBench: Towards Advancing Creative Intelligence of Language Model Agents
di: Qian, Cheng, et al.
Pubblicazione: (2024) -
Atomic Reasoning for Scientific Table Claim Verification
di: Zhang, Yuji, et al.
Pubblicazione: (2025) -
CostBench: Evaluating Multi-Turn Cost-Optimal Planning and Adaptation in Dynamic Environments for LLM Tool-Use Agents
di: Liu, Jiayu, et al.
Pubblicazione: (2025) -
ToolRL: Reward is All Tool Learning Needs
di: Qian, Cheng, et al.
Pubblicazione: (2025)