Adaptive trajectory-constrained exploration strategy for deep reinforcement learning
Fuente:
arXiv
Guardado en:
| Autores principales: | Wang, Guojian, Wu, Faguo, Zhang, Xiao, Guo, Ning, Zheng, Zhiming |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Trajectory-Oriented Policy Optimization with Sparse Rewards
por: Wang, Guojian, et al.
Publicado: (2024)
por: Wang, Guojian, et al.
Publicado: (2024)
Policy Optimization with Smooth Guidance Learned from State-Only Demonstrations
por: Wang, Guojian, et al.
Publicado: (2023)
por: Wang, Guojian, et al.
Publicado: (2023)
Learning Diverse Policies with Soft Self-Generated Guidance
por: Wang, Guojian, et al.
Publicado: (2024)
por: Wang, Guojian, et al.
Publicado: (2024)
Preference-Guided Reinforcement Learning for Efficient Exploration
por: Wang, Guojian, et al.
Publicado: (2024)
por: Wang, Guojian, et al.
Publicado: (2024)
Dealing with uncertainty: balancing exploration and exploitation in deep recurrent reinforcement learning
por: Zangirolami, Valentina, et al.
Publicado: (2023)
por: Zangirolami, Valentina, et al.
Publicado: (2023)
Capacity-constrained demand response in smart grids using deep reinforcement learning
por: Pashaki, Shafagh Abband, et al.
Publicado: (2026)
por: Pashaki, Shafagh Abband, et al.
Publicado: (2026)
Generalized Bayesian deep reinforcement learning
por: Roy, Shreya Sinha, et al.
Publicado: (2024)
por: Roy, Shreya Sinha, et al.
Publicado: (2024)
A deep reinforcement learning platform for antibiotic discovery
por: Cao, Hanqun, et al.
Publicado: (2025)
por: Cao, Hanqun, et al.
Publicado: (2025)
An invariance constrained deep learning network for PDE discovery
por: Chen, Chao, et al.
Publicado: (2024)
por: Chen, Chao, et al.
Publicado: (2024)
Learning optimal treatment strategies for intraoperative hypotension using deep reinforcement learning
por: Adiyeke, Esra, et al.
Publicado: (2025)
por: Adiyeke, Esra, et al.
Publicado: (2025)
Knowledge-data fusion oriented traffic state estimation: A stochastic physics-informed deep learning approach
por: Wang, Ting, et al.
Publicado: (2024)
por: Wang, Ting, et al.
Publicado: (2024)
Risk-anticipatory autonomous driving strategies considering vehicles' weights, based on hierarchical deep reinforcement learning
por: Chen, Di, et al.
Publicado: (2023)
por: Chen, Di, et al.
Publicado: (2023)
Measure gradients, not activations! Enhancing neuronal activity in deep reinforcement learning
por: Liu, Jiashun, et al.
Publicado: (2025)
por: Liu, Jiashun, et al.
Publicado: (2025)
Economic span selection of bridge based on deep reinforcement learning
por: Zhang, Leye, et al.
Publicado: (2024)
por: Zhang, Leye, et al.
Publicado: (2024)
Dragonfly: a modular deep reinforcement learning library
por: Viquerat, Jonathan, et al.
Publicado: (2025)
por: Viquerat, Jonathan, et al.
Publicado: (2025)
Contingency-constrained economic dispatch with safe reinforcement learning
por: Eichelbeck, Michael, et al.
Publicado: (2022)
por: Eichelbeck, Michael, et al.
Publicado: (2022)
FoX: Formation-aware exploration in multi-agent reinforcement learning
por: Jo, Yonghyeon, et al.
Publicado: (2023)
por: Jo, Yonghyeon, et al.
Publicado: (2023)
Physics-informed deep operator network for traffic state estimation
por: Li, Zhihao, et al.
Publicado: (2025)
por: Li, Zhihao, et al.
Publicado: (2025)
Discovering autonomous quantum error correction via deep reinforcement learning
por: Yin, Yue, et al.
Publicado: (2025)
por: Yin, Yue, et al.
Publicado: (2025)
An efficient deep reinforcement learning environment for flexible job-shop scheduling
por: Wu, Xinquan, et al.
Publicado: (2025)
por: Wu, Xinquan, et al.
Publicado: (2025)
Explainable deep reinforcement learning reveals energy-efficient control strategies for turbulent drag reduction
por: Tonti, Federica, et al.
Publicado: (2026)
por: Tonti, Federica, et al.
Publicado: (2026)
Adaptive traffic signal safety and efficiency improvement by multi objective deep reinforcement learning approach
por: Mirbakhsh, Shahin, et al.
Publicado: (2024)
por: Mirbakhsh, Shahin, et al.
Publicado: (2024)
Applications of deep reinforcement learning to urban transit network design
por: Holliday, Andrew
Publicado: (2025)
por: Holliday, Andrew
Publicado: (2025)
A modular framework for stabilizing deep reinforcement learning control
por: Lawrence, Nathan P., et al.
Publicado: (2023)
por: Lawrence, Nathan P., et al.
Publicado: (2023)
Transfer learning strategies for accelerating reinforcement-learning-based flow control
por: Salehi, Saeed
Publicado: (2025)
por: Salehi, Saeed
Publicado: (2025)
Adaptive sampling using variational autoencoder and reinforcement learning
por: Rasheed, Adil, et al.
Publicado: (2025)
por: Rasheed, Adil, et al.
Publicado: (2025)
Acting upon Imagination: when to trust imagined trajectories in model based reinforcement learning
por: Remonda, Adrian, et al.
Publicado: (2021)
por: Remonda, Adrian, et al.
Publicado: (2021)
Learning a local trading strategy: deep reinforcement learning for grid-scale renewable energy integration
por: Ju, Caleb, et al.
Publicado: (2024)
por: Ju, Caleb, et al.
Publicado: (2024)
Controlling dynamics of stochastic systems with deep reinforcement learning
por: Mukhamadiarov, Ruslan
Publicado: (2025)
por: Mukhamadiarov, Ruslan
Publicado: (2025)
Optimization of geological carbon storage operations with multimodal latent dynamic model and deep reinforcement learning
por: Wang, Zhongzheng, et al.
Publicado: (2024)
por: Wang, Zhongzheng, et al.
Publicado: (2024)
How to craft a deep reinforcement learning policy for wind farm flow control
por: Kadoche, Elie, et al.
Publicado: (2025)
por: Kadoche, Elie, et al.
Publicado: (2025)
On the consistency of hyper-parameter selection in value-based deep reinforcement learning
por: Obando-Ceron, Johan, et al.
Publicado: (2024)
por: Obando-Ceron, Johan, et al.
Publicado: (2024)
BAPR: Bayesian amnesic piecewise-robust reinforcement learning for non-stationary continuous control
por: Zhang, Yifan, et al.
Publicado: (2026)
por: Zhang, Yifan, et al.
Publicado: (2026)
MaxInfoRL: Boosting exploration in reinforcement learning through information gain maximization
por: Sukhija, Bhavya, et al.
Publicado: (2024)
por: Sukhija, Bhavya, et al.
Publicado: (2024)
Transfer learning-enhanced deep reinforcement learning for aerodynamic airfoil optimisation subject to structural constraints
por: Ramos, David, et al.
Publicado: (2025)
por: Ramos, David, et al.
Publicado: (2025)
Dynamic object goal pushing with mobile manipulators through model-free constrained reinforcement learning
por: Dadiotis, Ioannis, et al.
Publicado: (2025)
por: Dadiotis, Ioannis, et al.
Publicado: (2025)
Load constrained wind farm flow control through multi-objective multi-agent reinforcement learning
por: Åstrand, Teodor, et al.
Publicado: (2026)
por: Åstrand, Teodor, et al.
Publicado: (2026)
Selective experience replay compression using coresets for lifelong deep reinforcement learning in medical imaging
por: Zheng, Guangyao, et al.
Publicado: (2023)
por: Zheng, Guangyao, et al.
Publicado: (2023)
A comparative study of deep learning and ensemble learning to extend the horizon of traffic forecasting
por: Zheng, Xiao, et al.
Publicado: (2025)
por: Zheng, Xiao, et al.
Publicado: (2025)
An approach of deep reinforcement learning for maximizing the net present value of stochastic projects
por: Xu, Wei, et al.
Publicado: (2025)
por: Xu, Wei, et al.
Publicado: (2025)
Ejemplares similares
-
Trajectory-Oriented Policy Optimization with Sparse Rewards
por: Wang, Guojian, et al.
Publicado: (2024) -
Policy Optimization with Smooth Guidance Learned from State-Only Demonstrations
por: Wang, Guojian, et al.
Publicado: (2023) -
Learning Diverse Policies with Soft Self-Generated Guidance
por: Wang, Guojian, et al.
Publicado: (2024) -
Preference-Guided Reinforcement Learning for Efficient Exploration
por: Wang, Guojian, et al.
Publicado: (2024) -
Dealing with uncertainty: balancing exploration and exploitation in deep recurrent reinforcement learning
por: Zangirolami, Valentina, et al.
Publicado: (2023)