Can We Further Elicit Reasoning in LLMs? Critic-Guided Planning with Retrieval-Augmentation for Solving Challenging Tasks
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Xingxuan, Xu, Weiwen, Zhao, Ruochen, Jiao, Fangkai, Joty, Shafiq, Bing, Lidong |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
ParaICL: Towards Parallel In-Context Learning
par: Li, Xingxuan, et autres
Publié: (2024)
par: Li, Xingxuan, et autres
Publié: (2024)
ChatGPT's One-year Anniversary: Are Open-Source Large Language Models Catching up?
par: Chen, Hailin, et autres
Publié: (2023)
par: Chen, Hailin, et autres
Publié: (2023)
Evaluating Psychological Safety of Large Language Models
par: Li, Xingxuan, et autres
Publié: (2022)
par: Li, Xingxuan, et autres
Publié: (2022)
Chain-of-Knowledge: Grounding Large Language Models via Dynamic Knowledge Adapting over Heterogeneous Sources
par: Li, Xingxuan, et autres
Publié: (2023)
par: Li, Xingxuan, et autres
Publié: (2023)
Unlocking Temporal Question Answering for Large Language Models with Tailor-Made Reasoning Logic
par: Li, Xingxuan, et autres
Publié: (2023)
par: Li, Xingxuan, et autres
Publié: (2023)
Learning Planning-based Reasoning by Trajectories Collection and Process Reward Synthesizing
par: Jiao, Fangkai, et autres
Publié: (2024)
par: Jiao, Fangkai, et autres
Publié: (2024)
A Comprehensive Survey of Contamination Detection Methods in Large Language Models
par: Ravaut, Mathieu, et autres
Publié: (2024)
par: Ravaut, Mathieu, et autres
Publié: (2024)
Relevant or Random: Can LLMs Truly Perform Analogical Reasoning?
par: Qin, Chengwei, et autres
Publié: (2024)
par: Qin, Chengwei, et autres
Publié: (2024)
VIBEPASS: Can Vibe Coders Really Pass the Vibe Check?
par: Bansal, Srijan, et autres
Publié: (2026)
par: Bansal, Srijan, et autres
Publié: (2026)
Democratizing LLMs for Low-Resource Languages by Leveraging their English Dominant Abilities with Linguistically-Diverse Prompts
par: Nguyen, Xuan-Phi, et autres
Publié: (2023)
par: Nguyen, Xuan-Phi, et autres
Publié: (2023)
Preference Optimization for Reasoning with Pseudo Feedback
par: Jiao, Fangkai, et autres
Publié: (2024)
par: Jiao, Fangkai, et autres
Publié: (2024)
Topic-Guided Reinforcement Learning with LLMs for Enhancing Multi-Document Summarization
par: Li, Chuyuan, et autres
Publié: (2025)
par: Li, Chuyuan, et autres
Publié: (2025)
FINEREASON: Evaluating and Improving LLMs' Deliberate Reasoning through Reflective Puzzle Solving
par: Chen, Guizhen, et autres
Publié: (2025)
par: Chen, Guizhen, et autres
Publié: (2025)
Exploring Self-supervised Logic-enhanced Training for Large Language Models
par: Jiao, Fangkai, et autres
Publié: (2023)
par: Jiao, Fangkai, et autres
Publié: (2023)
Auto-Arena: Automating LLM Evaluations with Agent Peer Battles and Committee Discussions
par: Zhao, Ruochen, et autres
Publié: (2024)
par: Zhao, Ruochen, et autres
Publié: (2024)
StructTest: Benchmarking LLMs' Reasoning through Compositional Structured Outputs
par: Chen, Hailin, et autres
Publié: (2024)
par: Chen, Hailin, et autres
Publié: (2024)
Lifelong Event Detection with Embedding Space Separation and Compaction
par: Qin, Chengwei, et autres
Publié: (2024)
par: Qin, Chengwei, et autres
Publié: (2024)
Modeling Uncertainty and Using Post-fusion as Fallback Improves Retrieval Augmented Generation with LLMs
par: Liu, Ye, et autres
Publié: (2023)
par: Liu, Ye, et autres
Publié: (2023)
Multi-Agent Tool-Integrated Policy Optimization
par: Mo, Zhanfeng, et autres
Publié: (2025)
par: Mo, Zhanfeng, et autres
Publié: (2025)
Data Augmentation using Large Language Models: Data Perspectives, Learning Paradigms and Challenges
par: Ding, Bosheng, et autres
Publié: (2024)
par: Ding, Bosheng, et autres
Publié: (2024)
Eliciting Critical Reasoning in Retrieval-Augmented Language Models via Contrastive Explanations
par: Ranaldi, Leonardo, et autres
Publié: (2024)
par: Ranaldi, Leonardo, et autres
Publié: (2024)
Open-RAG: Enhanced Retrieval-Augmented Reasoning with Open-Source Large Language Models
par: Islam, Shayekh Bin, et autres
Publié: (2024)
par: Islam, Shayekh Bin, et autres
Publié: (2024)
Beyond Output Matching: Bidirectional Alignment for Enhanced In-Context Learning
par: Qin, Chengwei, et autres
Publié: (2023)
par: Qin, Chengwei, et autres
Publié: (2023)
A Survey of Frontiers in LLM Reasoning: Inference Scaling, Learning to Reason, and Agentic Systems
par: Ke, Zixuan, et autres
Publié: (2025)
par: Ke, Zixuan, et autres
Publié: (2025)
MedReason: Eliciting Factual Medical Reasoning Steps in LLMs via Knowledge Graphs
par: Wu, Juncheng, et autres
Publié: (2025)
par: Wu, Juncheng, et autres
Publié: (2025)
Reasoning Paths Optimization: Learning to Reason and Explore From Diverse Paths
par: Chia, Yew Ken, et autres
Publié: (2024)
par: Chia, Yew Ken, et autres
Publié: (2024)
Foundational Automatic Evaluators: Scaling Multi-Task Generative Evaluator Training for Reasoning-Centric Domains
par: Xu, Austin, et autres
Publié: (2025)
par: Xu, Austin, et autres
Publié: (2025)
Chain of Ideas: Revolutionizing Research Via Novel Idea Development with LLM Agents
par: Li, Long, et autres
Publié: (2024)
par: Li, Long, et autres
Publié: (2024)
XL-HeadTags: Leveraging Multimodal Retrieval Augmentation for the Multilingual Generation of News Headlines and Tags
par: Shohan, Faisal Tareque, et autres
Publié: (2024)
par: Shohan, Faisal Tareque, et autres
Publié: (2024)
Personalised Distillation: Empowering Open-Sourced LLMs with Adaptive Learning for Code Generation
par: Chen, Hailin, et autres
Publié: (2023)
par: Chen, Hailin, et autres
Publié: (2023)
Beyond Accuracy: Dissecting Mathematical Reasoning for LLMs Under Reinforcement Learning
par: Wang, Jiayu, et autres
Publié: (2025)
par: Wang, Jiayu, et autres
Publié: (2025)
Is Translation All You Need? A Study on Solving Multilingual Tasks with Large Language Models
par: Liu, Chaoqun, et autres
Publié: (2024)
par: Liu, Chaoqun, et autres
Publié: (2024)
NAACL2025 Tutorial: Adaptation of Large Language Models
par: Ke, Zixuan, et autres
Publié: (2025)
par: Ke, Zixuan, et autres
Publié: (2025)
Unsupervised Summarization Re-ranking
par: Ravaut, Mathieu, et autres
Publié: (2022)
par: Ravaut, Mathieu, et autres
Publié: (2022)
Harnessing LLM Agents with Skill Programs
par: Liu, Hongjun, et autres
Publié: (2026)
par: Liu, Hongjun, et autres
Publié: (2026)
Strategic Chain-of-Thought: Guiding Accurate Reasoning in LLMs through Strategy Elicitation
par: Wang, Yu, et autres
Publié: (2024)
par: Wang, Yu, et autres
Publié: (2024)
Text2Vis: A Challenging and Diverse Benchmark for Generating Multimodal Visualizations from Text
par: Rahman, Mizanur, et autres
Publié: (2025)
par: Rahman, Mizanur, et autres
Publié: (2025)
Demystifying Domain-adaptive Post-training for Financial LLMs
par: Ke, Zixuan, et autres
Publié: (2025)
par: Ke, Zixuan, et autres
Publié: (2025)
G-DRAGON: Geospatial Reasoning and Dynamic Planning for Retrieval-Augmented Outdoor Navigation
par: Wang, Dongzhihan, et autres
Publié: (2026)
par: Wang, Dongzhihan, et autres
Publié: (2026)
LLMs Can Plan Only If We Tell Them
par: Sel, Bilgehan, et autres
Publié: (2025)
par: Sel, Bilgehan, et autres
Publié: (2025)
Documents similaires
-
ParaICL: Towards Parallel In-Context Learning
par: Li, Xingxuan, et autres
Publié: (2024) -
ChatGPT's One-year Anniversary: Are Open-Source Large Language Models Catching up?
par: Chen, Hailin, et autres
Publié: (2023) -
Evaluating Psychological Safety of Large Language Models
par: Li, Xingxuan, et autres
Publié: (2022) -
Chain-of-Knowledge: Grounding Large Language Models via Dynamic Knowledge Adapting over Heterogeneous Sources
par: Li, Xingxuan, et autres
Publié: (2023) -
Unlocking Temporal Question Answering for Large Language Models with Tailor-Made Reasoning Logic
par: Li, Xingxuan, et autres
Publié: (2023)