SAFE: Stepwise Atomic Feedback for Error correction in Multi-hop Reasoning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kwon, Daeyong, Yoon, Soyoung, Hwang, Seung-won |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
GRADE: Generating multi-hop QA and fine-gRAined Difficulty matrix for RAG Evaluation
par: Lee, Jeongsoo, et autres
Publié: (2025)
par: Lee, Jeongsoo, et autres
Publié: (2025)
AcuRank: Uncertainty-Aware Adaptive Computation for Listwise Reranking
par: Yoon, Soyoung, et autres
Publié: (2025)
par: Yoon, Soyoung, et autres
Publié: (2025)
RoToR: Towards More Reliable Responses for Order-Invariant Inputs
par: Yoon, Soyoung, et autres
Publié: (2025)
par: Yoon, Soyoung, et autres
Publié: (2025)
Counterfactual-Consistency Prompting for Relative Temporal Understanding in Large Language Models
par: Kim, Jongho, et autres
Publié: (2025)
par: Kim, Jongho, et autres
Publié: (2025)
CoEx -- Co-evolving World-model and Exploration
par: Kim, Minsoo, et autres
Publié: (2025)
par: Kim, Minsoo, et autres
Publié: (2025)
On Listwise Reranking for Corpus Feedback
par: Yoon, Soyoung, et autres
Publié: (2025)
par: Yoon, Soyoung, et autres
Publié: (2025)
ConvCodeWorld: Benchmarking Conversational Code Generation in Reproducible Feedback Environments
par: Han, Hojae, et autres
Publié: (2025)
par: Han, Hojae, et autres
Publié: (2025)
HARP: Hesitation-Aware Reframing in Transformer Inference Pass
par: Storaï, Romain, et autres
Publié: (2024)
par: Storaï, Romain, et autres
Publié: (2024)
CREFT: Sequential Multi-Agent LLM for Character Relation Extraction
par: Chun, Ye Eun, et autres
Publié: (2025)
par: Chun, Ye Eun, et autres
Publié: (2025)
MUST-RAG: MUSical Text Question Answering with Retrieval Augmented Generation
par: Kwon, Daeyong, et autres
Publié: (2025)
par: Kwon, Daeyong, et autres
Publié: (2025)
ArtistMus: A Globally Diverse, Artist-Centric Benchmark for Retrieval-Augmented Music Question Answering
par: Kwon, Daeyong, et autres
Publié: (2025)
par: Kwon, Daeyong, et autres
Publié: (2025)
Chain of Grounded Objectives: Bridging Process and Goal-oriented Prompting for Code Generation
par: Yeo, Sangyeop, et autres
Publié: (2025)
par: Yeo, Sangyeop, et autres
Publié: (2025)
Relevance to Utility: Process-Supervised Rewrite for RAG
par: Kim, Jaeyoung, et autres
Publié: (2025)
par: Kim, Jaeyoung, et autres
Publié: (2025)
ECoRAG: Evidentiality-guided Compression for Long Context RAG
par: Jeong, Yeonseok, et autres
Publié: (2025)
par: Jeong, Yeonseok, et autres
Publié: (2025)
Kinship Data Benchmark for Multi-hop Reasoning
par: Sun, Tianda, et autres
Publié: (2026)
par: Sun, Tianda, et autres
Publié: (2026)
Relation-based Counterfactual Data Augmentation and Contrastive Learning for Robustifying Natural Language Inference Models
par: Yang, Heerin, et autres
Publié: (2024)
par: Yang, Heerin, et autres
Publié: (2024)
Benchmarking Chinese Commonsense Reasoning with a Multi-hop Reasoning Perspective
par: You, Wangjie, et autres
Publié: (2025)
par: You, Wangjie, et autres
Publié: (2025)
R$^3$-SQL: Ranking Reward and Resampling for Text-to-SQL
par: Han, Hojae, et autres
Publié: (2026)
par: Han, Hojae, et autres
Publié: (2026)
PERC: Plan-As-Query Example Retrieval for Underrepresented Code Generation
par: Yoo, Jaeseok, et autres
Publié: (2024)
par: Yoo, Jaeseok, et autres
Publié: (2024)
ArchCode: Incorporating Software Requirements in Code Generation with Large Language Models
par: Han, Hojae, et autres
Publié: (2024)
par: Han, Hojae, et autres
Publié: (2024)
Ever-Evolving Memory by Blending and Refining the Past
par: Kim, Seo Hyun, et autres
Publié: (2024)
par: Kim, Seo Hyun, et autres
Publié: (2024)
Stepwise Verification and Remediation of Student Reasoning Errors with Large Language Model Tutors
par: Daheim, Nico, et autres
Publié: (2024)
par: Daheim, Nico, et autres
Publié: (2024)
MARCH: Evaluating the Intersection of Ambiguity Interpretation and Multi-hop Inference
par: Park, Jeonghyun, et autres
Publié: (2025)
par: Park, Jeonghyun, et autres
Publié: (2025)
Multimodal Cognitive Reframing Therapy via Multi-hop Psychotherapeutic Reasoning
par: Kim, Subin, et autres
Publié: (2025)
par: Kim, Subin, et autres
Publié: (2025)
Omne-R1: Learning to Reason with Memory for Multi-hop Question Answering
par: Liu, Boyuan, et autres
Publié: (2025)
par: Liu, Boyuan, et autres
Publié: (2025)
StepWiser: Stepwise Generative Judges for Wiser Reasoning
par: Xiong, Wei, et autres
Publié: (2025)
par: Xiong, Wei, et autres
Publié: (2025)
Shattering the Shortcut: A Topology-Regularized Benchmark for Multi-hop Medical Reasoning in LLMs
par: Zi, Xing, et autres
Publié: (2026)
par: Zi, Xing, et autres
Publié: (2026)
SAT: Balancing Reasoning Accuracy and Efficiency with Stepwise Adaptive Thinking
par: Huang, Weiyang, et autres
Publié: (2026)
par: Huang, Weiyang, et autres
Publié: (2026)
Learning from Synthetic Data Improves Multi-hop Reasoning
par: Kabra, Anmol, et autres
Publié: (2026)
par: Kabra, Anmol, et autres
Publié: (2026)
BeamAggR: Beam Aggregation Reasoning over Multi-source Knowledge for Multi-hop Question Answering
par: Chu, Zheng, et autres
Publié: (2024)
par: Chu, Zheng, et autres
Publié: (2024)
Improving Multi-hop Logical Reasoning in Knowledge Graphs with Context-Aware Query Representation Learning
par: Kim, Jeonghoon, et autres
Publié: (2024)
par: Kim, Jeonghoon, et autres
Publié: (2024)
GlobalRAG: Enhancing Global Reasoning in Multi-hop Question Answering via Reinforcement Learning
par: Luo, Jinchang, et autres
Publié: (2025)
par: Luo, Jinchang, et autres
Publié: (2025)
Towards Error-Free EHRs: Reasoning-Intensive Consistency Verification Between Clinical Notes and Structured Tables in Electronic Health Records
par: Kwon, Yeonsu, et autres
Publié: (2026)
par: Kwon, Yeonsu, et autres
Publié: (2026)
Towards Stepwise Domain Knowledge-Driven Reasoning Optimization and Reflection Improvement
par: Liu, Chengyuan, et autres
Publié: (2025)
par: Liu, Chengyuan, et autres
Publié: (2025)
M3-SLU: Evaluating Speaker-Attributed Reasoning in Multimodal Large Language Models
par: Kwon, Yejin, et autres
Publié: (2025)
par: Kwon, Yejin, et autres
Publié: (2025)
StepHint: Multi-level Stepwise Hints Enhance Reinforcement Learning to Reason
par: Zhang, Kaiyi, et autres
Publié: (2025)
par: Zhang, Kaiyi, et autres
Publié: (2025)
TRIM: Hybrid Inference via Targeted Stepwise Routing in Multi-Step Reasoning Tasks
par: Kapoor, Vansh, et autres
Publié: (2026)
par: Kapoor, Vansh, et autres
Publié: (2026)
DepWiGNN: A Depth-wise Graph Neural Network for Multi-hop Spatial Reasoning in Text
par: Li, Shuaiyi, et autres
Publié: (2023)
par: Li, Shuaiyi, et autres
Publié: (2023)
Stepwise Penalization for Length-Efficient Chain-of-Thought Reasoning
par: Li, Xintong, et autres
Publié: (2026)
par: Li, Xintong, et autres
Publié: (2026)
STRIDE-ED: A Strategy-Grounded Stepwise Reasoning Framework for Empathetic Dialogue Systems
par: Ji, Hongru, et autres
Publié: (2026)
par: Ji, Hongru, et autres
Publié: (2026)
Documents similaires
-
GRADE: Generating multi-hop QA and fine-gRAined Difficulty matrix for RAG Evaluation
par: Lee, Jeongsoo, et autres
Publié: (2025) -
AcuRank: Uncertainty-Aware Adaptive Computation for Listwise Reranking
par: Yoon, Soyoung, et autres
Publié: (2025) -
RoToR: Towards More Reliable Responses for Order-Invariant Inputs
par: Yoon, Soyoung, et autres
Publié: (2025) -
Counterfactual-Consistency Prompting for Relative Temporal Understanding in Large Language Models
par: Kim, Jongho, et autres
Publié: (2025) -
CoEx -- Co-evolving World-model and Exploration
par: Kim, Minsoo, et autres
Publié: (2025)