Human-Inspired Multi-Level Reinforcement Learning
Fuente:
arXiv
Saved in:
| Main Authors: | Wu, Mingkang, White, Devin, Lawhern, Vernon, Waytowich, Nicholas R., Cao, Yongcan |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Multi-Task Reward Learning from Human Ratings
by: Wu, Mingkang, et al.
Published: (2025)
by: Wu, Mingkang, et al.
Published: (2025)
Performance Optimization of Ratings-Based Reinforcement Learning
by: Rose, Evelyn, et al.
Published: (2025)
by: Rose, Evelyn, et al.
Published: (2025)
Rating-based Reinforcement Learning
by: White, Devin, et al.
Published: (2023)
by: White, Devin, et al.
Published: (2023)
R2BC: Multi-Agent Imitation Learning from Single-Agent Demonstrations
by: Mattson, Connor, et al.
Published: (2025)
by: Mattson, Connor, et al.
Published: (2025)
Adaptive Event-triggered Reinforcement Learning Control for Complex Nonlinear Systems
by: Siddique, Umer, et al.
Published: (2024)
by: Siddique, Umer, et al.
Published: (2024)
From Explainability to Interpretability: Interpretable Policies in Reinforcement Learning Via Model Explanation
by: Li, Peilang, et al.
Published: (2025)
by: Li, Peilang, et al.
Published: (2025)
Atari-GPT: Benchmarking Multimodal Large Language Models as Low-Level Policies in Atari Games
by: Waytowich, Nicholas R., et al.
Published: (2024)
by: Waytowich, Nicholas R., et al.
Published: (2024)
Human-Inspired Framework to Accelerate Reinforcement Learning
by: Beikmohammadi, Ali, et al.
Published: (2023)
by: Beikmohammadi, Ali, et al.
Published: (2023)
Scalable Interactive Machine Learning for Future Command and Control
by: Madison, Anna, et al.
Published: (2024)
by: Madison, Anna, et al.
Published: (2024)
Empirical Design in Reinforcement Learning
by: Patterson, Andrew, et al.
Published: (2023)
by: Patterson, Andrew, et al.
Published: (2023)
Too Big to Think: Capacity, Memorization, and Generalization in Pre-Trained Transformers
by: Barron, Joshua, et al.
Published: (2025)
by: Barron, Joshua, et al.
Published: (2025)
ReCollab: Retrieval-Augmented LLMs for Cooperative Ad-hoc Teammate Modeling
by: Wallace, Conor, et al.
Published: (2025)
by: Wallace, Conor, et al.
Published: (2025)
Creating Multi-Level Skill Hierarchies in Reinforcement Learning
by: Evans, Joshua B., et al.
Published: (2023)
by: Evans, Joshua B., et al.
Published: (2023)
Stratified GRPO: Handling Structural Heterogeneity in Reinforcement Learning of LLM Search Agents
by: Zhu, Mingkang, et al.
Published: (2025)
by: Zhu, Mingkang, et al.
Published: (2025)
Real-Time Recurrent Learning using Trace Units in Reinforcement Learning
by: Elelimy, Esraa, et al.
Published: (2024)
by: Elelimy, Esraa, et al.
Published: (2024)
$K$-Level Policy Gradients for Multi-Agent Reinforcement Learning
by: Reddi, Aryaman, et al.
Published: (2025)
by: Reddi, Aryaman, et al.
Published: (2025)
Brain-Inspired Planning for Better Generalization in Reinforcement Learning
by: Zhao, Mingde "Harry"
Published: (2025)
by: Zhao, Mingde "Harry"
Published: (2025)
Provable Multi-Party Reinforcement Learning with Diverse Human Feedback
by: Zhong, Huiying, et al.
Published: (2024)
by: Zhong, Huiying, et al.
Published: (2024)
A Generalized Projected Bellman Error for Off-policy Value Estimation in Reinforcement Learning
by: Patterson, Andrew, et al.
Published: (2021)
by: Patterson, Andrew, et al.
Published: (2021)
Deep Reinforcement Learning with Gradient Eligibility Traces
by: Elelimy, Esraa, et al.
Published: (2025)
by: Elelimy, Esraa, et al.
Published: (2025)
A New View on Planning in Online Reinforcement Learning
by: Roice, Kevin, et al.
Published: (2024)
by: Roice, Kevin, et al.
Published: (2024)
Consciousness-Inspired Spatio-Temporal Abstractions for Better Generalization in Reinforcement Learning
by: Zhao, Mingde, et al.
Published: (2023)
by: Zhao, Mingde, et al.
Published: (2023)
Rethinking the Foundations for Continual Reinforcement Learning
by: Elelimy, Esraa, et al.
Published: (2025)
by: Elelimy, Esraa, et al.
Published: (2025)
A Method for Evaluating Hyperparameter Sensitivity in Reinforcement Learning
by: Adkins, Jacob, et al.
Published: (2024)
by: Adkins, Jacob, et al.
Published: (2024)
Harnessing Discrete Representations For Continual Reinforcement Learning
by: Meyer, Edan, et al.
Published: (2023)
by: Meyer, Edan, et al.
Published: (2023)
Value Bonuses using Ensemble Errors for Exploration in Reinforcement Learning
by: Wahab, Abdul, et al.
Published: (2026)
by: Wahab, Abdul, et al.
Published: (2026)
Neuro-Inspired Hierarchical Multimodal Learning
by: Xiao, Xiongye, et al.
Published: (2023)
by: Xiao, Xiongye, et al.
Published: (2023)
Unveiling the Significance of Toddler-Inspired Reward Transition in Goal-Oriented Reinforcement Learning
by: Park, Junseok, et al.
Published: (2024)
by: Park, Junseok, et al.
Published: (2024)
SLEA-RL: Step-Level Experience Augmented Reinforcement Learning for Multi-Turn Agentic Training
by: Wang, Prince Zizhuang, et al.
Published: (2026)
by: Wang, Prince Zizhuang, et al.
Published: (2026)
Stabilizing Reinforcement Learning in Differentiable Multiphysics Simulation
by: Xing, Eliot, et al.
Published: (2024)
by: Xing, Eliot, et al.
Published: (2024)
TGDPO: Harnessing Token-Level Reward Guidance for Enhancing Direct Preference Optimization
by: Zhu, Mingkang, et al.
Published: (2025)
by: Zhu, Mingkang, et al.
Published: (2025)
Fairness in Reinforcement Learning: A Survey
by: Reuel, Anka, et al.
Published: (2024)
by: Reuel, Anka, et al.
Published: (2024)
Understanding and Mitigating Spurious Signal Amplification in Test-Time Reinforcement Learning for Math Reasoning
by: Yu, Yongcan, et al.
Published: (2026)
by: Yu, Yongcan, et al.
Published: (2026)
Explainable Reinforcement Learning for Formula One Race Strategy
by: Thomas, Devin, et al.
Published: (2025)
by: Thomas, Devin, et al.
Published: (2025)
Safe RLHF-V: Safe Reinforcement Learning from Multi-modal Human Feedback
by: Ji, Jiaming, et al.
Published: (2025)
by: Ji, Jiaming, et al.
Published: (2025)
Policy-regularized Offline Multi-objective Reinforcement Learning
by: Lin, Qian, et al.
Published: (2024)
by: Lin, Qian, et al.
Published: (2024)
Generalized Munchausen Reinforcement Learning using Tsallis KL Divergence
by: Zhu, Lingwei, et al.
Published: (2023)
by: Zhu, Lingwei, et al.
Published: (2023)
When is Offline Policy Selection Sample Efficient for Reinforcement Learning?
by: Liu, Vincent, et al.
Published: (2023)
by: Liu, Vincent, et al.
Published: (2023)
Residual Reward Models for Preference-based Reinforcement Learning
by: Cao, Chenyang, et al.
Published: (2025)
by: Cao, Chenyang, et al.
Published: (2025)
ARC-RL: A Reinforcement Learning Playground Inspired by ARC Raiders
by: Romeo, Carlo, et al.
Published: (2026)
by: Romeo, Carlo, et al.
Published: (2026)
Similar Items
-
Multi-Task Reward Learning from Human Ratings
by: Wu, Mingkang, et al.
Published: (2025) -
Performance Optimization of Ratings-Based Reinforcement Learning
by: Rose, Evelyn, et al.
Published: (2025) -
Rating-based Reinforcement Learning
by: White, Devin, et al.
Published: (2023) -
R2BC: Multi-Agent Imitation Learning from Single-Agent Demonstrations
by: Mattson, Connor, et al.
Published: (2025) -
Adaptive Event-triggered Reinforcement Learning Control for Complex Nonlinear Systems
by: Siddique, Umer, et al.
Published: (2024)