Opinion-Guided Reinforcement Learning
Fuente:
arXiv
Guardado en:
| Autores principales: | Dagenais, Kyanna, David, Istvan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Complex Model Transformations by Reinforcement Learning with Uncertain Human Guidance
por: Dagenais, Kyanna, et al.
Publicado: (2025)
por: Dagenais, Kyanna, et al.
Publicado: (2025)
Trust the AI, Doubt Yourself: The Effect of Urgency on Self-Confidence in Human-AI Interaction
por: Shajari, Baran, et al.
Publicado: (2026)
por: Shajari, Baran, et al.
Publicado: (2026)
A Reference Architecture of Reinforcement Learning Frameworks
por: Liu, Xiaoran, et al.
Publicado: (2026)
por: Liu, Xiaoran, et al.
Publicado: (2026)
Advantage-Guided Diffusion for Model-Based Reinforcement Learning
por: Foffano, Daniele, et al.
Publicado: (2026)
por: Foffano, Daniele, et al.
Publicado: (2026)
Reinforcement Learning-Guided Semi-Supervised Learning
por: Heidari, Marzi, et al.
Publicado: (2024)
por: Heidari, Marzi, et al.
Publicado: (2024)
Reinforcement Learning by Guided Safe Exploration
por: Yang, Qisong, et al.
Publicado: (2023)
por: Yang, Qisong, et al.
Publicado: (2023)
Operator-Guided Invariance Learning for Continuous Reinforcement Learning
por: Zhang, Zuyuan, et al.
Publicado: (2026)
por: Zhang, Zuyuan, et al.
Publicado: (2026)
Demonstration Guided Multi-Objective Reinforcement Learning
por: Lu, Junlin, et al.
Publicado: (2024)
por: Lu, Junlin, et al.
Publicado: (2024)
Diffusion Guided Adversarial State Perturbations in Reinforcement Learning
por: Sun, Xiaolin, et al.
Publicado: (2025)
por: Sun, Xiaolin, et al.
Publicado: (2025)
Normality-Guided Distributional Reinforcement Learning for Continuous Control
por: Byun, Ju-Seung, et al.
Publicado: (2022)
por: Byun, Ju-Seung, et al.
Publicado: (2022)
Language-Guided Reinforcement Learning for Hard Attention in Few-Shot Learning
por: Nikpour, Bahareh, et al.
Publicado: (2023)
por: Nikpour, Bahareh, et al.
Publicado: (2023)
Can LLMs Guide Their Own Exploration? Gradient-Guided Reinforcement Learning for LLM Reasoning
por: Liang, Zhenwen, et al.
Publicado: (2025)
por: Liang, Zhenwen, et al.
Publicado: (2025)
State-Novelty Guided Action Persistence in Deep Reinforcement Learning
por: Hu, Jianshu, et al.
Publicado: (2024)
por: Hu, Jianshu, et al.
Publicado: (2024)
Guiding Exploration in Reinforcement Learning Through LLM-Augmented Observations
por: Jain, Vaibhav, et al.
Publicado: (2025)
por: Jain, Vaibhav, et al.
Publicado: (2025)
Guiding Diffusion Models with Reinforcement Learning for Stable Molecule Generation
por: Zhou, Zhijian, et al.
Publicado: (2025)
por: Zhou, Zhijian, et al.
Publicado: (2025)
Memory-Based Advantage Shaping for LLM-Guided Reinforcement Learning
por: Nourzad, Narjes, et al.
Publicado: (2026)
por: Nourzad, Narjes, et al.
Publicado: (2026)
ORPR: An OR-Guided Pretrain-then-Reinforce Learning Model for Inventory Management
por: Zhao, Lingjie, et al.
Publicado: (2025)
por: Zhao, Lingjie, et al.
Publicado: (2025)
CausalGDP: Causality-Guided Diffusion Policies for Reinforcement Learning
por: Xiao, Xiaofeng, et al.
Publicado: (2026)
por: Xiao, Xiaofeng, et al.
Publicado: (2026)
Analytic Energy-Guided Policy Optimization for Offline Reinforcement Learning
por: Hu, Jifeng, et al.
Publicado: (2025)
por: Hu, Jifeng, et al.
Publicado: (2025)
Reinforcement Learning-based Heuristics to Guide Domain-Independent Dynamic Programming
por: Narita, Minori, et al.
Publicado: (2025)
por: Narita, Minori, et al.
Publicado: (2025)
Epigraph-Guided Flow Matching for Safe and Performant Offline Reinforcement Learning
por: Tayal, Manan, et al.
Publicado: (2026)
por: Tayal, Manan, et al.
Publicado: (2026)
Guided Exploration in Reinforcement Learning via Monte Carlo Critic Optimization
por: Kuznetsov, Igor
Publicado: (2022)
por: Kuznetsov, Igor
Publicado: (2022)
Guided Cooperation in Hierarchical Reinforcement Learning via Model-based Rollout
por: Wang, Haoran, et al.
Publicado: (2023)
por: Wang, Haoran, et al.
Publicado: (2023)
POLO: Preference-Guided Multi-Turn Reinforcement Learning for Lead Optimization
por: Wang, Ziqing, et al.
Publicado: (2025)
por: Wang, Ziqing, et al.
Publicado: (2025)
Deep Reinforcement Learning Guided Improvement Heuristic for Job Shop Scheduling
por: Zhang, Cong, et al.
Publicado: (2022)
por: Zhang, Cong, et al.
Publicado: (2022)
Learning in Context, Guided by Choice: A Reward-Free Paradigm for Reinforcement Learning with Transformers
por: Dong, Juncheng, et al.
Publicado: (2026)
por: Dong, Juncheng, et al.
Publicado: (2026)
Guided Flow Policy: Learning from High-Value Actions in Offline Reinforcement Learning
por: Tiofack, Franki Nguimatsia, et al.
Publicado: (2025)
por: Tiofack, Franki Nguimatsia, et al.
Publicado: (2025)
Affordance-Guided Reinforcement Learning via Visual Prompting
por: Lee, Olivia Y., et al.
Publicado: (2024)
por: Lee, Olivia Y., et al.
Publicado: (2024)
The Definitive Guide to Policy Gradients in Deep Reinforcement Learning: Theory, Algorithms and Implementations
por: Lehmann, Matthias
Publicado: (2024)
por: Lehmann, Matthias
Publicado: (2024)
LLM-Guided Reinforcement Learning: Addressing Training Bottlenecks through Policy Modulation
por: Tan, Heng, et al.
Publicado: (2025)
por: Tan, Heng, et al.
Publicado: (2025)
GDSD: Reinforcement Learning as Guided Denoiser Self-Distillation for Diffusion Language Models
por: Tang, Xiaohang, et al.
Publicado: (2026)
por: Tang, Xiaohang, et al.
Publicado: (2026)
TGPO: Tree-Guided Preference Optimization for Robust Web Agent Reinforcement Learning
por: Chen, Ziyuan, et al.
Publicado: (2025)
por: Chen, Ziyuan, et al.
Publicado: (2025)
Reinforcement Learning-Guided Dynamic Multi-Graph Fusion for Evacuation Traffic Prediction
por: Rafi, Md Nafees Fuad, et al.
Publicado: (2026)
por: Rafi, Md Nafees Fuad, et al.
Publicado: (2026)
Fisher-Guided Selective Forgetting: Mitigating The Primacy Bias in Deep Reinforcement Learning
por: Falzari, Massimiliano, et al.
Publicado: (2025)
por: Falzari, Massimiliano, et al.
Publicado: (2025)
A Simple Unified Uncertainty-Guided Framework for Offline-to-Online Reinforcement Learning
por: Guo, Siyuan, et al.
Publicado: (2023)
por: Guo, Siyuan, et al.
Publicado: (2023)
Subgoal Graph-Augmented Planning for LLM-Guided Open-World Reinforcement Learning
por: Fan, Shanwei, et al.
Publicado: (2025)
por: Fan, Shanwei, et al.
Publicado: (2025)
NurseSchedRL: Attention-Guided Reinforcement Learning for Nurse-Patient Assignment
por: Koduri, Harsha
Publicado: (2025)
por: Koduri, Harsha
Publicado: (2025)
Internalizing Meta-Experience into Memory for Guided Reinforcement Learning in Large Language Models
por: Huang, Shiting, et al.
Publicado: (2026)
por: Huang, Shiting, et al.
Publicado: (2026)
Breaking the Grid: Distance-Guided Reinforcement Learning in Large Discrete Action Spaces
por: Hoppe, Heiko, et al.
Publicado: (2026)
por: Hoppe, Heiko, et al.
Publicado: (2026)
Three Dogmas of Reinforcement Learning
por: Abel, David, et al.
Publicado: (2024)
por: Abel, David, et al.
Publicado: (2024)
Ejemplares similares
-
Complex Model Transformations by Reinforcement Learning with Uncertain Human Guidance
por: Dagenais, Kyanna, et al.
Publicado: (2025) -
Trust the AI, Doubt Yourself: The Effect of Urgency on Self-Confidence in Human-AI Interaction
por: Shajari, Baran, et al.
Publicado: (2026) -
A Reference Architecture of Reinforcement Learning Frameworks
por: Liu, Xiaoran, et al.
Publicado: (2026) -
Advantage-Guided Diffusion for Model-Based Reinforcement Learning
por: Foffano, Daniele, et al.
Publicado: (2026) -
Reinforcement Learning-Guided Semi-Supervised Learning
por: Heidari, Marzi, et al.
Publicado: (2024)