Adaptive Horizon Actor-Critic for Policy Learning in Contact-Rich Differentiable Simulation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Georgiev, Ignat, Srinivasan, Krishnan, Xu, Jie, Heiden, Eric, Garg, Animesh |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
PWM: Policy Learning with Multi-Task World Models
par: Georgiev, Ignat, et autres
Publié: (2024)
par: Georgiev, Ignat, et autres
Publié: (2024)
Offline-Boosted Actor-Critic: Adaptively Blending Optimal Historical Behaviors in Deep Off-Policy RL
par: Luo, Yu, et autres
Publié: (2024)
par: Luo, Yu, et autres
Publié: (2024)
Distributional Soft Actor-Critic with Diffusion Policy
par: Liu, Tong, et autres
Publié: (2025)
par: Liu, Tong, et autres
Publié: (2025)
Functional Critics Are Essential for Actor-Critic: From Off-Policy Stability to Efficient Exploration
par: Bai, Qinxun, et autres
Publié: (2025)
par: Bai, Qinxun, et autres
Publié: (2025)
Limits of Actor-Critic Algorithms for Decision Tree Policies Learning in IBMDPs
par: Kohler, Hector, et autres
Publié: (2023)
par: Kohler, Hector, et autres
Publié: (2023)
Enabling Off-Policy Imitation Learning with Deep Actor Critic Stabilization
par: Sen, Sayambhu, et autres
Publié: (2025)
par: Sen, Sayambhu, et autres
Publié: (2025)
Causal Policy Learning in Reinforcement Learning: Backdoor-Adjusted Soft Actor-Critic
par: Vo, Thanh Vinh, et autres
Publié: (2025)
par: Vo, Thanh Vinh, et autres
Publié: (2025)
ReinforceGen: Hybrid Skill Policies with Automated Data Generation and Reinforcement Learning
par: Zhou, Zihan, et autres
Publié: (2025)
par: Zhou, Zihan, et autres
Publié: (2025)
Reactive Diffusion Policy: Slow-Fast Visual-Tactile Policy Learning for Contact-Rich Manipulation
par: Xue, Han, et autres
Publié: (2025)
par: Xue, Han, et autres
Publié: (2025)
Revisiting Mixture Policies in Entropy-Regularized Actor-Critic
par: He, Jiamin, et autres
Publié: (2026)
par: He, Jiamin, et autres
Publié: (2026)
Relative Importance Sampling for off-Policy Actor-Critic in Deep Reinforcement Learning
par: Humayoo, Mahammad, et autres
Publié: (2018)
par: Humayoo, Mahammad, et autres
Publié: (2018)
Stabilizing the Q-Gradient Field for Policy Smoothness in Actor-Critic
par: Lee, Jeong Woon, et autres
Publié: (2026)
par: Lee, Jeong Woon, et autres
Publié: (2026)
Federated Natural Policy Gradient and Actor Critic Methods for Multi-task Reinforcement Learning
par: Yang, Tong, et autres
Publié: (2023)
par: Yang, Tong, et autres
Publié: (2023)
Maximum Entropy On-Policy Actor-Critic via Entropy Advantage Estimation
par: Choe, Jean Seong Bjorn, et autres
Publié: (2024)
par: Choe, Jean Seong Bjorn, et autres
Publié: (2024)
Flow Actor-Critic for Offline Reinforcement Learning
par: Chae, Jongseong, et autres
Publié: (2026)
par: Chae, Jongseong, et autres
Publié: (2026)
ACE : Off-Policy Actor-Critic with Causality-Aware Entropy Regularization
par: Ji, Tianying, et autres
Publié: (2024)
par: Ji, Tianying, et autres
Publié: (2024)
Efficient $Q$-Learning and Actor-Critic Methods for Robust Average Reward Reinforcement Learning
par: Xu, Yang, et autres
Publié: (2025)
par: Xu, Yang, et autres
Publié: (2025)
SPIRE: Synergistic Planning, Imitation, and Reinforcement Learning for Long-Horizon Manipulation
par: Zhou, Zihan, et autres
Publié: (2024)
par: Zhou, Zihan, et autres
Publié: (2024)
Collaborative Yet Personalized Policy Training: Single-Timescale Federated Actor-Critic
par: Wang, Leo Muxing, et autres
Publié: (2026)
par: Wang, Leo Muxing, et autres
Publié: (2026)
DiffSim2Real: Deploying Quadrupedal Locomotion Policies Purely Trained in Differentiable Simulation
par: Bagajo, Joshua, et autres
Publié: (2024)
par: Bagajo, Joshua, et autres
Publié: (2024)
Uniformly Safe RL with Objective Suppression for Multi-Constraint Safety-Critical Applications
par: Zhou, Zihan, et autres
Publié: (2024)
par: Zhou, Zihan, et autres
Publié: (2024)
Ask-AC: An Initiative Advisor-in-the-Loop Actor-Critic Framework
par: Liu, Shunyu, et autres
Publié: (2022)
par: Liu, Shunyu, et autres
Publié: (2022)
Seizing Serendipity: Exploiting the Value of Past Success in Off-Policy Actor-Critic
par: Ji, Tianying, et autres
Publié: (2023)
par: Ji, Tianying, et autres
Publié: (2023)
ADWIN: Adaptive Windows for Horizon-Aware On-Policy Distillation
par: Liang, Kun, et autres
Publié: (2026)
par: Liang, Kun, et autres
Publié: (2026)
Second-Order Actor-Critic Methods for Discounted MDPs via Policy Hessian Decomposition
par: Manivannan, Sanjeev, et autres
Publié: (2026)
par: Manivannan, Sanjeev, et autres
Publié: (2026)
Broad Critic Deep Actor Reinforcement Learning for Continuous Control
par: Thalagala, Shiron, et autres
Publié: (2024)
par: Thalagala, Shiron, et autres
Publié: (2024)
Studying the Interplay Between the Actor and Critic Representations in Reinforcement Learning
par: Garcin, Samuel, et autres
Publié: (2025)
par: Garcin, Samuel, et autres
Publié: (2025)
Decorrelated Soft Actor-Critic for Efficient Deep Reinforcement Learning
par: Küçükoğlu, Burcu, et autres
Publié: (2025)
par: Küçükoğlu, Burcu, et autres
Publié: (2025)
Value Improved Actor Critic Algorithms
par: Oren, Yaniv, et autres
Publié: (2024)
par: Oren, Yaniv, et autres
Publié: (2024)
Diffusion Actor-Critic with Entropy Regulator
par: Wang, Yinuo, et autres
Publié: (2024)
par: Wang, Yinuo, et autres
Publié: (2024)
Revisiting Discrete Soft Actor-Critic
par: Zhou, Haibin, et autres
Publié: (2022)
par: Zhou, Haibin, et autres
Publié: (2022)
Average-Reward Soft Actor-Critic
par: Adamczyk, Jacob, et autres
Publié: (2025)
par: Adamczyk, Jacob, et autres
Publié: (2025)
Double Actor-Critic with TD Error-Driven Regularization in Reinforcement Learning
par: Chen, Haohui, et autres
Publié: (2024)
par: Chen, Haohui, et autres
Publié: (2024)
DSAC: Distributional Soft Actor-Critic for Risk-Sensitive Reinforcement Learning
par: Ma, Xiaoteng, et autres
Publié: (2020)
par: Ma, Xiaoteng, et autres
Publié: (2020)
Pareto Actor-Critic for Communication and Computation Co-Optimization in Non-Cooperative Federated Learning Services
par: Tan, Renxuan, et autres
Publié: (2025)
par: Tan, Renxuan, et autres
Publié: (2025)
Quantum Advantage Actor-Critic for Reinforcement Learning
par: Kölle, Michael, et autres
Publié: (2024)
par: Kölle, Michael, et autres
Publié: (2024)
Off-Policy Actor-Critic for Adversarial Observation Robustness: Virtual Alternative Training via Symmetric Policy Evaluation
par: Nakanishi, Kosuke, et autres
Publié: (2025)
par: Nakanishi, Kosuke, et autres
Publié: (2025)
Offline Actor-Critic Reinforcement Learning Scales to Large Models
par: Springenberg, Jost Tobias, et autres
Publié: (2024)
par: Springenberg, Jost Tobias, et autres
Publié: (2024)
Proximal Action Replacement for Behavior Cloning Actor-Critic in Offline Reinforcement Learning
par: Dong, Jinzong, et autres
Publié: (2026)
par: Dong, Jinzong, et autres
Publié: (2026)
Monte Carlo Beam Search for Actor-Critic Reinforcement Learning in Continuous Control
par: Alzorgan, Hazim, et autres
Publié: (2025)
par: Alzorgan, Hazim, et autres
Publié: (2025)
Documents similaires
-
PWM: Policy Learning with Multi-Task World Models
par: Georgiev, Ignat, et autres
Publié: (2024) -
Offline-Boosted Actor-Critic: Adaptively Blending Optimal Historical Behaviors in Deep Off-Policy RL
par: Luo, Yu, et autres
Publié: (2024) -
Distributional Soft Actor-Critic with Diffusion Policy
par: Liu, Tong, et autres
Publié: (2025) -
Functional Critics Are Essential for Actor-Critic: From Off-Policy Stability to Efficient Exploration
par: Bai, Qinxun, et autres
Publié: (2025) -
Limits of Actor-Critic Algorithms for Decision Tree Policies Learning in IBMDPs
par: Kohler, Hector, et autres
Publié: (2023)