$β$-DQN: Improving Deep Q-Learning By Evolving the Behavior
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhang, Hongming, Bai, Fengshuo, Xiao, Chenjun, Gao, Chao, Xu, Bo, Müller, Martin |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Provable Representation with Efficient Planning for Partial Observable Reinforcement Learning
por: Zhang, Hongming, et al.
Publicado: (2023)
por: Zhang, Hongming, et al.
Publicado: (2023)
A Distance-based Anomaly Detection Framework for Deep Reinforcement Learning
por: Zhang, Hongming, et al.
Publicado: (2021)
por: Zhang, Hongming, et al.
Publicado: (2021)
Beyond ReLU: Chebyshev-DQN for Enhanced Deep Q-Networks
por: Yazdannik, Saman, et al.
Publicado: (2025)
por: Yazdannik, Saman, et al.
Publicado: (2025)
Behavior-Regularized Diffusion Policy Optimization for Offline Reinforcement Learning
por: Gao, Chen-Xiao, et al.
Publicado: (2025)
por: Gao, Chen-Xiao, et al.
Publicado: (2025)
Efficient Preference-based Reinforcement Learning via Aligned Experience Estimation
por: Bai, Fengshuo, et al.
Publicado: (2024)
por: Bai, Fengshuo, et al.
Publicado: (2024)
Diffusion Spectral Representation for Reinforcement Learning
por: Shribak, Dmitry, et al.
Publicado: (2024)
por: Shribak, Dmitry, et al.
Publicado: (2024)
RAT: Adversarial Attacks on Deep Reinforcement Agents for Targeted Behaviors
por: Bai, Fengshuo, et al.
Publicado: (2024)
por: Bai, Fengshuo, et al.
Publicado: (2024)
Hindsight Preference Learning for Offline Preference-based Reinforcement Learning
por: Gao, Chen-Xiao, et al.
Publicado: (2024)
por: Gao, Chen-Xiao, et al.
Publicado: (2024)
Hybrid DQN-TD3 Reinforcement Learning for Autonomous Navigation in Dynamic Environments
por: He, Xiaoyi, et al.
Publicado: (2025)
por: He, Xiaoyi, et al.
Publicado: (2025)
Improving the Diversity of Bootstrapped DQN by Replacing Priors With Noise
por: Meng, Li, et al.
Publicado: (2022)
por: Meng, Li, et al.
Publicado: (2022)
A Controlled Study of Double DQN and Dueling DQN Under Cross-Environment Transfer
por: Nasir, Azkaa, et al.
Publicado: (2026)
por: Nasir, Azkaa, et al.
Publicado: (2026)
An MRP Formulation for Supervised Learning: Generalized Temporal Difference Learning Models
por: Pan, Yangchen, et al.
Publicado: (2024)
por: Pan, Yangchen, et al.
Publicado: (2024)
Monte Carlo Tree Search in the Presence of Transition Uncertainty
por: Kohankhaki, Farnaz, et al.
Publicado: (2023)
por: Kohankhaki, Farnaz, et al.
Publicado: (2023)
Easy Samples Are All You Need: Self-Evolving LLMs via Data-Efficient Reinforcement Learning
por: Yu, Zhiyin, et al.
Publicado: (2026)
por: Yu, Zhiyin, et al.
Publicado: (2026)
Value of Information-Enhanced Exploration in Bootstrapped DQN
por: Plataniotis, Stergios, et al.
Publicado: (2025)
por: Plataniotis, Stergios, et al.
Publicado: (2025)
Improving Offline-to-Online Reinforcement Learning with Q Conditioned State Entropy Exploration
por: Zhang, Ziqi, et al.
Publicado: (2023)
por: Zhang, Ziqi, et al.
Publicado: (2023)
Wormhole: Concept-Aware Deep Representation Learning for Co-Evolving Sequences
por: Xu, Kunpeng, et al.
Publicado: (2024)
por: Xu, Kunpeng, et al.
Publicado: (2024)
Suppressing Overestimation in Q-Learning through Adversarial Behaviors
por: Lee, HyeAnn, et al.
Publicado: (2023)
por: Lee, HyeAnn, et al.
Publicado: (2023)
Behavior Backdoor for Deep Learning Models
por: Wang, Jiakai, et al.
Publicado: (2024)
por: Wang, Jiakai, et al.
Publicado: (2024)
Learn as Individuals, Evolve as a Team: Multi-agent LLMs Adaptation in Embodied Environments
por: Li, Xinran, et al.
Publicado: (2025)
por: Li, Xinran, et al.
Publicado: (2025)
DQN Performance with Epsilon Greedy Policies and Prioritized Experience Replay
por: Perkins, Daniel, et al.
Publicado: (2025)
por: Perkins, Daniel, et al.
Publicado: (2025)
Behavior-Consistent Deep Reinforcement Learning
por: Hussing, Marcel, et al.
Publicado: (2026)
por: Hussing, Marcel, et al.
Publicado: (2026)
Scalable In-Context Q-Learning
por: Liu, Jinmei, et al.
Publicado: (2025)
por: Liu, Jinmei, et al.
Publicado: (2025)
Priors Matter: Addressing Misspecification in Bayesian Deep Q-Learning
por: van der Vaart, Pascal R., et al.
Publicado: (2025)
por: van der Vaart, Pascal R., et al.
Publicado: (2025)
Learning Distinguishable Representations in Deep Q-Networks for Linear Transfer
por: Sathish, Sooraj, et al.
Publicado: (2025)
por: Sathish, Sooraj, et al.
Publicado: (2025)
Double Successive Over-Relaxation Q-Learning with an Extension to Deep Reinforcement Learning
por: R, Shreyas S
Publicado: (2024)
por: R, Shreyas S
Publicado: (2024)
MergeIT: From Selection to Merging for Efficient Instruction Tuning
por: Cai, Hongyi, et al.
Publicado: (2025)
por: Cai, Hongyi, et al.
Publicado: (2025)
Deep k-grouping: An Unsupervised Learning Framework for Combinatorial Optimization on Graphs and Hypergraphs
por: Bai, Sen, et al.
Publicado: (2025)
por: Bai, Sen, et al.
Publicado: (2025)
Deep Double Q-learning
por: Nagarajan, Prabhat, et al.
Publicado: (2025)
por: Nagarajan, Prabhat, et al.
Publicado: (2025)
Smart Sampling: Self-Attention and Bootstrapping for Improved Ensembled Q-Learning
por: Khan, Muhammad Junaid, et al.
Publicado: (2024)
por: Khan, Muhammad Junaid, et al.
Publicado: (2024)
Large Language Model-Enhanced Multi-Armed Bandits
por: Sun, Jiahang, et al.
Publicado: (2025)
por: Sun, Jiahang, et al.
Publicado: (2025)
CMKL: Modality-Aware Continual Learning for Evolving Biomedical Knowledge Graphs
por: Radwan, Yousef A., et al.
Publicado: (2026)
por: Radwan, Yousef A., et al.
Publicado: (2026)
Adaptive $Q$-Network: On-the-fly Target Selection for Deep Reinforcement Learning
por: Vincent, Théo, et al.
Publicado: (2024)
por: Vincent, Théo, et al.
Publicado: (2024)
Revisiting Essential and Nonessential Settings of Evidential Deep Learning
por: Chen, Mengyuan, et al.
Publicado: (2024)
por: Chen, Mengyuan, et al.
Publicado: (2024)
Ensemble Elastic DQN: A novel multi-step ensemble approach to address overestimation in deep value-based reinforcement learning
por: Ly, Adrian, et al.
Publicado: (2025)
por: Ly, Adrian, et al.
Publicado: (2025)
SelfBC: Self Behavior Cloning for Offline Reinforcement Learning
por: Liu, Shirong, et al.
Publicado: (2024)
por: Liu, Shirong, et al.
Publicado: (2024)
R-Zero: Self-Evolving Reasoning LLM from Zero Data
por: Huang, Chengsong, et al.
Publicado: (2025)
por: Huang, Chengsong, et al.
Publicado: (2025)
A* Search Without Expansions: Learning Heuristic Functions with Deep Q-Networks
por: Agostinelli, Forest, et al.
Publicado: (2021)
por: Agostinelli, Forest, et al.
Publicado: (2021)
Scheduled Curiosity-Deep Dyna-Q: Efficient Exploration for Dialog Policy Learning
por: Niu, Xuecheng, et al.
Publicado: (2024)
por: Niu, Xuecheng, et al.
Publicado: (2024)
Deep Causal Behavioral Policy Learning: Applications to Healthcare
por: Knecht, Jonas, et al.
Publicado: (2025)
por: Knecht, Jonas, et al.
Publicado: (2025)
Ejemplares similares
-
Provable Representation with Efficient Planning for Partial Observable Reinforcement Learning
por: Zhang, Hongming, et al.
Publicado: (2023) -
A Distance-based Anomaly Detection Framework for Deep Reinforcement Learning
por: Zhang, Hongming, et al.
Publicado: (2021) -
Beyond ReLU: Chebyshev-DQN for Enhanced Deep Q-Networks
por: Yazdannik, Saman, et al.
Publicado: (2025) -
Behavior-Regularized Diffusion Policy Optimization for Offline Reinforcement Learning
por: Gao, Chen-Xiao, et al.
Publicado: (2025) -
Efficient Preference-based Reinforcement Learning via Aligned Experience Estimation
por: Bai, Fengshuo, et al.
Publicado: (2024)