Guiding Reinforcement Learning Using Uncertainty-Aware Large Language Models
Fuente:
arXiv
Saved in:
| Main Authors: | Shoaeinaeini, Maryam, Harrison, Brent |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Uncertainty-Guided Checkpoint Selection for Reinforcement Finetuning of Large Language Models
by: Nguyen, Manh, et al.
Published: (2025)
by: Nguyen, Manh, et al.
Published: (2025)
Goal-Guided Efficient Exploration via Large Language Model in Reinforcement Learning
by: Qi, Yajie, et al.
Published: (2025)
by: Qi, Yajie, et al.
Published: (2025)
Hierarchical Reinforcement Learning with Uncertainty-Guided Diffusional Subgoals
by: Wang, Vivienne Huiling, et al.
Published: (2025)
by: Wang, Vivienne Huiling, et al.
Published: (2025)
Large Language Model Guided Incentive Aware Reward Design for Cooperative Multi-Agent Reinforcement Learning
by: Urgun, Dogan, et al.
Published: (2026)
by: Urgun, Dogan, et al.
Published: (2026)
FERA: Uncertainty-Aware Federated Reasoning for Large Language Models
by: Wang, Ruhan, et al.
Published: (2026)
by: Wang, Ruhan, et al.
Published: (2026)
Uncertainty-Aware Multi-Objective Reinforcement Learning-Guided Diffusion Models for 3D De Novo Molecular Design
by: Chen, Lianghong, et al.
Published: (2025)
by: Chen, Lianghong, et al.
Published: (2025)
Internalizing Meta-Experience into Memory for Guided Reinforcement Learning in Large Language Models
by: Huang, Shiting, et al.
Published: (2026)
by: Huang, Shiting, et al.
Published: (2026)
Guided Uncertainty Learning Using a Post-Hoc Evidential Meta-Model
by: Barker, Charmaine, et al.
Published: (2025)
by: Barker, Charmaine, et al.
Published: (2025)
Harnessing the Power of Large Language Model for Uncertainty Aware Graph Processing
by: Qian, Zhenyu, et al.
Published: (2024)
by: Qian, Zhenyu, et al.
Published: (2024)
Distributional Reinforcement Learning with Information Bottleneck for Uncertainty-Aware DRAM Equalization
by: Usama, Muhammad, et al.
Published: (2026)
by: Usama, Muhammad, et al.
Published: (2026)
Efficient and Uncertainty-Aware Diffusion Framework for Offline-to-Online Reinforcement Learning
by: Bui, Ha Manh, et al.
Published: (2026)
by: Bui, Ha Manh, et al.
Published: (2026)
Group-Aware Reinforcement Learning for Output Diversity in Large Language Models
by: Anschel, Oron, et al.
Published: (2025)
by: Anschel, Oron, et al.
Published: (2025)
Uncertainty of Thoughts: Uncertainty-Aware Planning Enhances Information Seeking in Large Language Models
by: Hu, Zhiyuan, et al.
Published: (2024)
by: Hu, Zhiyuan, et al.
Published: (2024)
Attribution-Guided Continual Learning for Large Language Models
by: Liu, Yazheng, et al.
Published: (2026)
by: Liu, Yazheng, et al.
Published: (2026)
Synthesizing Programmatic Reinforcement Learning Policies with Large Language Model Guided Search
by: Liu, Max, et al.
Published: (2024)
by: Liu, Max, et al.
Published: (2024)
Uncertainty-Aware Explainable Recommendation with Large Language Models
by: Peng, Yicui, et al.
Published: (2024)
by: Peng, Yicui, et al.
Published: (2024)
Efficient Reinforcement Learning with Large Language Model Priors
by: Yan, Xue, et al.
Published: (2024)
by: Yan, Xue, et al.
Published: (2024)
Teaching Large Language Models to Reason with Reinforcement Learning
by: Havrilla, Alex, et al.
Published: (2024)
by: Havrilla, Alex, et al.
Published: (2024)
Uncertainty-Aware Transformers: Conformal Prediction for Language Models
by: Vellore, Abhiram, et al.
Published: (2026)
by: Vellore, Abhiram, et al.
Published: (2026)
Uncertainty Quantification for In-Context Learning of Large Language Models
by: Ling, Chen, et al.
Published: (2024)
by: Ling, Chen, et al.
Published: (2024)
Recurrent Confidence Chain: Temporal-Aware Uncertainty Quantification in Large Language Models
by: Mao, Zhenjiang, et al.
Published: (2026)
by: Mao, Zhenjiang, et al.
Published: (2026)
Uncertainty-Aware Generative Oversampling Using an Entropy-Guided Conditional Variational Autoencoder
by: Zare, Amirhossein, et al.
Published: (2025)
by: Zare, Amirhossein, et al.
Published: (2025)
Saliency-Aware Regularized Quantization Calibration for Large Language Models
by: Zhao, Yanlong, et al.
Published: (2026)
by: Zhao, Yanlong, et al.
Published: (2026)
Evaluating Reinforcement Learning Algorithms for Navigation in Simulated Robotic Quadrupeds: A Comparative Study Inspired by Guide Dog Behaviour
by: Harrison, Emma M. A.
Published: (2025)
by: Harrison, Emma M. A.
Published: (2025)
Reinforcement Learning Finetunes Small Subnetworks in Large Language Models
by: Mukherjee, Sagnik, et al.
Published: (2025)
by: Mukherjee, Sagnik, et al.
Published: (2025)
Fuz-RL: A Fuzzy-Guided Robust Framework for Safe Reinforcement Learning under Uncertainty
by: Wan, Xu, et al.
Published: (2026)
by: Wan, Xu, et al.
Published: (2026)
An Empirical Categorization of Prompting Techniques for Large Language Models: A Practitioner's Guide
by: Fagbohun, Oluwole, et al.
Published: (2024)
by: Fagbohun, Oluwole, et al.
Published: (2024)
Zero-shot Model-based Reinforcement Learning using Large Language Models
by: Benechehab, Abdelhakim, et al.
Published: (2024)
by: Benechehab, Abdelhakim, et al.
Published: (2024)
A Simple Unified Uncertainty-Guided Framework for Offline-to-Online Reinforcement Learning
by: Guo, Siyuan, et al.
Published: (2023)
by: Guo, Siyuan, et al.
Published: (2023)
Unlocking Graph Structure Learning with Tree-Guided Large Language Models
by: Zhang, Zhihan, et al.
Published: (2025)
by: Zhang, Zhihan, et al.
Published: (2025)
Trustworthy Summarization via Uncertainty Quantification and Risk Awareness in Large Language Models
by: Pan, Shuaidong, et al.
Published: (2025)
by: Pan, Shuaidong, et al.
Published: (2025)
Uncertainty-Aware Fusion: An Ensemble Framework for Mitigating Hallucinations in Large Language Models
by: Dey, Prasenjit, et al.
Published: (2025)
by: Dey, Prasenjit, et al.
Published: (2025)
On the Importance of Uncertainty in Decision-Making with Large Language Models
by: Felicioni, Nicolò, et al.
Published: (2024)
by: Felicioni, Nicolò, et al.
Published: (2024)
Uncertainty Quantification for Large Language Model Reward Learning under Heterogeneous Human Feedback
by: Liu, Pangpang, et al.
Published: (2025)
by: Liu, Pangpang, et al.
Published: (2025)
Large Language Model-Enhanced Reinforcement Learning for Diverse and Novel Recommendations
by: Woo, Jiin, et al.
Published: (2025)
by: Woo, Jiin, et al.
Published: (2025)
TROLL: Trust Regions improve Reinforcement Learning for Large Language Models
by: Becker, Philipp, et al.
Published: (2025)
by: Becker, Philipp, et al.
Published: (2025)
DYSTIL: Dynamic Strategy Induction with Large Language Models for Reinforcement Learning
by: Wang, Borui, et al.
Published: (2025)
by: Wang, Borui, et al.
Published: (2025)
Grounding Large Language Models in Interactive Environments with Online Reinforcement Learning
by: Carta, Thomas, et al.
Published: (2023)
by: Carta, Thomas, et al.
Published: (2023)
ImagineBench: Evaluating Reinforcement Learning with Large Language Model Rollouts
by: Pang, Jing-Cheng, et al.
Published: (2025)
by: Pang, Jing-Cheng, et al.
Published: (2025)
Using Large Language Models to Automate and Expedite Reinforcement Learning with Reward Machine
by: Alsadat, Shayan Meshkat, et al.
Published: (2024)
by: Alsadat, Shayan Meshkat, et al.
Published: (2024)
Similar Items
-
Uncertainty-Guided Checkpoint Selection for Reinforcement Finetuning of Large Language Models
by: Nguyen, Manh, et al.
Published: (2025) -
Goal-Guided Efficient Exploration via Large Language Model in Reinforcement Learning
by: Qi, Yajie, et al.
Published: (2025) -
Hierarchical Reinforcement Learning with Uncertainty-Guided Diffusional Subgoals
by: Wang, Vivienne Huiling, et al.
Published: (2025) -
Large Language Model Guided Incentive Aware Reward Design for Cooperative Multi-Agent Reinforcement Learning
by: Urgun, Dogan, et al.
Published: (2026) -
FERA: Uncertainty-Aware Federated Reasoning for Large Language Models
by: Wang, Ruhan, et al.
Published: (2026)