Enhancing Deep Deterministic Policy Gradients on Continuous Control Tasks with Decoupled Prioritized Experience Replay
Fuente:
arXiv
Salvato in:
| Autori principali: | Lorasdagi, Mehmet Efe, Cicek, Dogan Can, Mutlu, Furkan Burak, Kozat, Suleyman Serdar |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
CUER: Corrected Uniform Experience Replay for Off-Policy Continuous Deep Reinforcement Learning Algorithms
di: Yenicesu, Arda Sarp, et al.
Pubblicazione: (2024)
di: Yenicesu, Arda Sarp, et al.
Pubblicazione: (2024)
Fitting Multiple Machine Learning Models with Performance Based Clustering
di: Lorasdagi, Mehmet Efe, et al.
Pubblicazione: (2024)
di: Lorasdagi, Mehmet Efe, et al.
Pubblicazione: (2024)
Binary Feature Mask Optimization for Feature Selection
di: Lorasdagi, Mehmet E., et al.
Pubblicazione: (2024)
di: Lorasdagi, Mehmet E., et al.
Pubblicazione: (2024)
AFS-BM: Enhancing Model Performance through Adaptive Feature Selection with Binary Masking
di: Turali, Mehmet Y., et al.
Pubblicazione: (2024)
di: Turali, Mehmet Y., et al.
Pubblicazione: (2024)
Soft Gradient Boosting with Learnable Feature Transforms for Sequential Regression
di: Karaca, Huseyin, et al.
Pubblicazione: (2025)
di: Karaca, Huseyin, et al.
Pubblicazione: (2025)
PySAD: A Streaming Anomaly Detection Framework in Python
di: Yilmaz, Selim F., et al.
Pubblicazione: (2020)
di: Yilmaz, Selim F., et al.
Pubblicazione: (2020)
Uncertainty Prioritized Experience Replay
di: Carrasco-Davis, Rodrigo, et al.
Pubblicazione: (2025)
di: Carrasco-Davis, Rodrigo, et al.
Pubblicazione: (2025)
Reliability-Adjusted Prioritized Experience Replay
di: Pleiss, Leonard S., et al.
Pubblicazione: (2025)
di: Pleiss, Leonard S., et al.
Pubblicazione: (2025)
DQN Performance with Epsilon Greedy Policies and Prioritized Experience Replay
di: Perkins, Daniel, et al.
Pubblicazione: (2025)
di: Perkins, Daniel, et al.
Pubblicazione: (2025)
Prioritized Generative Replay
di: Wang, Renhao, et al.
Pubblicazione: (2024)
di: Wang, Renhao, et al.
Pubblicazione: (2024)
Enhancing LLM Agents for Code Generation with Possibility and Pass-rate Prioritized Experience Replay
di: Chen, Yuyang, et al.
Pubblicazione: (2024)
di: Chen, Yuyang, et al.
Pubblicazione: (2024)
Hierarchical Ensemble-Based Feature Selection for Time Series Forecasting
di: Tumay, Aysin, et al.
Pubblicazione: (2023)
di: Tumay, Aysin, et al.
Pubblicazione: (2023)
ETGL-DDPG: A Deep Deterministic Policy Gradient Algorithm for Sparse Reward Continuous Control
di: Futuhi, Ehsan, et al.
Pubblicazione: (2024)
di: Futuhi, Ehsan, et al.
Pubblicazione: (2024)
Freshness-Aware Prioritized Experience Replay for LLM/VLM Reinforcement Learning
di: Ma, Weiyu, et al.
Pubblicazione: (2026)
di: Ma, Weiyu, et al.
Pubblicazione: (2026)
Task-Agnostic Federated Continual Learning via Replay-Free Gradient Projection
di: Cha, Seohyeon, et al.
Pubblicazione: (2025)
di: Cha, Seohyeon, et al.
Pubblicazione: (2025)
Investigating the Interplay of Prioritized Replay and Generalization
di: Panahi, Parham Mohammad, et al.
Pubblicazione: (2024)
di: Panahi, Parham Mohammad, et al.
Pubblicazione: (2024)
Prioritized Replay for RL Post-training
di: Fatemi, Mehdi
Pubblicazione: (2026)
di: Fatemi, Mehdi
Pubblicazione: (2026)
On the Limitation and Experience Replay for GNNs in Continual Learning
di: Su, Junwei, et al.
Pubblicazione: (2023)
di: Su, Junwei, et al.
Pubblicazione: (2023)
Prioritized Trajectory Replay: A Replay Memory for Data-driven Reinforcement Learning
di: Liu, Jinyi, et al.
Pubblicazione: (2023)
di: Liu, Jinyi, et al.
Pubblicazione: (2023)
Deterministic Policy Gradient for Reinforcement Learning with Continuous Time and State
di: Cheng, Ziheng, et al.
Pubblicazione: (2025)
di: Cheng, Ziheng, et al.
Pubblicazione: (2025)
Hindsight Experience Replay Accelerates Proximal Policy Optimization
di: Crowder, Douglas C., et al.
Pubblicazione: (2024)
di: Crowder, Douglas C., et al.
Pubblicazione: (2024)
Variance Reduction Based Experience Replay for Policy Optimization
di: Zheng, Hua, et al.
Pubblicazione: (2026)
di: Zheng, Hua, et al.
Pubblicazione: (2026)
Learning Optimal Deterministic Policies with Stochastic Policy Gradients
di: Montenegro, Alessandro, et al.
Pubblicazione: (2024)
di: Montenegro, Alessandro, et al.
Pubblicazione: (2024)
D-SPEAR: Dual-Stream Prioritized Experience Adaptive Replay for Stable Reinforcement Learning in Robotic Manipulation
di: Zhang, Yu, et al.
Pubblicazione: (2026)
di: Zhang, Yu, et al.
Pubblicazione: (2026)
Deep Policy Gradient Methods Without Batch Updates, Target Networks, or Replay Buffers
di: Vasan, Gautham, et al.
Pubblicazione: (2024)
di: Vasan, Gautham, et al.
Pubblicazione: (2024)
Revisiting Softmax Masking: Stop Gradient for Enhancing Stability in Replay-based Continual Learning
di: Kim, Hoyong, et al.
Pubblicazione: (2023)
di: Kim, Hoyong, et al.
Pubblicazione: (2023)
Solving Reach-Avoid-Stay Problems Using Deep Deterministic Policy Gradients
di: Chenevert, Gabriel, et al.
Pubblicazione: (2024)
di: Chenevert, Gabriel, et al.
Pubblicazione: (2024)
Experience Replay Addresses Loss of Plasticity in Continual Learning
di: Wang, Jiuqi, et al.
Pubblicazione: (2025)
di: Wang, Jiuqi, et al.
Pubblicazione: (2025)
Soft Deterministic Policy Gradient with Gaussian Smoothing
di: Na, Hyunjun, et al.
Pubblicazione: (2026)
di: Na, Hyunjun, et al.
Pubblicazione: (2026)
Optimizing Drivers' Discount Order Acceptance Strategies: A Policy-Improved Deep Deterministic Policy Gradient Framework
di: Dai, Hanwen, et al.
Pubblicazione: (2025)
di: Dai, Hanwen, et al.
Pubblicazione: (2025)
MGSER-SAM: Memory-Guided Soft Experience Replay with Sharpness-Aware Optimization for Enhanced Continual Learning
di: Li, Xingyu, et al.
Pubblicazione: (2024)
di: Li, Xingyu, et al.
Pubblicazione: (2024)
CodeIt: Self-Improving Language Models with Prioritized Hindsight Replay
di: Butt, Natasha, et al.
Pubblicazione: (2024)
di: Butt, Natasha, et al.
Pubblicazione: (2024)
Epidemic Control on a Large-Scale-Agent-Based Epidemiology Model using Deep Deterministic Policy Gradient
di: Deshkar, Gaurav, et al.
Pubblicazione: (2023)
di: Deshkar, Gaurav, et al.
Pubblicazione: (2023)
AdaER: An Adaptive Experience Replay Approach for Continual Lifelong Learning
di: Li, Xingyu, et al.
Pubblicazione: (2023)
di: Li, Xingyu, et al.
Pubblicazione: (2023)
Decoupled Prioritized Resampling for Offline RL
di: Yue, Yang, et al.
Pubblicazione: (2023)
di: Yue, Yang, et al.
Pubblicazione: (2023)
IDER: IDempotent Experience Replay for Reliable Continual Learning
di: Liu, Zhanwang, et al.
Pubblicazione: (2026)
di: Liu, Zhanwang, et al.
Pubblicazione: (2026)
Taming the Adversary: Stable Minimax Deep Deterministic Policy Gradient via Fractional Objectives
di: Lee, Taeho, et al.
Pubblicazione: (2026)
di: Lee, Taeho, et al.
Pubblicazione: (2026)
Edge Delayed Deep Deterministic Policy Gradient: efficient continuous control for edge scenarios
di: Sinigaglia, Alberto, et al.
Pubblicazione: (2024)
di: Sinigaglia, Alberto, et al.
Pubblicazione: (2024)
Learning Deterministic Policies with Policy Gradients in Constrained Markov Decision Processes
di: Montenegro, Alessandro, et al.
Pubblicazione: (2025)
di: Montenegro, Alessandro, et al.
Pubblicazione: (2025)
OER: Offline Experience Replay for Continual Offline Reinforcement Learning
di: Gai, Sibo, et al.
Pubblicazione: (2023)
di: Gai, Sibo, et al.
Pubblicazione: (2023)
Documenti analoghi
-
CUER: Corrected Uniform Experience Replay for Off-Policy Continuous Deep Reinforcement Learning Algorithms
di: Yenicesu, Arda Sarp, et al.
Pubblicazione: (2024) -
Fitting Multiple Machine Learning Models with Performance Based Clustering
di: Lorasdagi, Mehmet Efe, et al.
Pubblicazione: (2024) -
Binary Feature Mask Optimization for Feature Selection
di: Lorasdagi, Mehmet E., et al.
Pubblicazione: (2024) -
AFS-BM: Enhancing Model Performance through Adaptive Feature Selection with Binary Masking
di: Turali, Mehmet Y., et al.
Pubblicazione: (2024) -
Soft Gradient Boosting with Learnable Feature Transforms for Sequential Regression
di: Karaca, Huseyin, et al.
Pubblicazione: (2025)