Studying the Interplay Between the Actor and Critic Representations in Reinforcement Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Garcin, Samuel, McInroe, Trevor, Castro, Pablo Samuel, Panangaden, Prakash, Lucas, Christopher G., Abel, David, Albrecht, Stefano V. |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
PixelBrax: Learning Continuous Control from Pixels End-to-End on the GPU
par: McInroe, Trevor, et autres
Publié: (2025)
par: McInroe, Trevor, et autres
Publié: (2025)
Multi-Horizon Representations with Hierarchical Forward Models for Reinforcement Learning
par: McInroe, Trevor, et autres
Publié: (2022)
par: McInroe, Trevor, et autres
Publié: (2022)
Planning to Go Out-of-Distribution in Offline-to-Online Reinforcement Learning
par: McInroe, Trevor, et autres
Publié: (2023)
par: McInroe, Trevor, et autres
Publié: (2023)
Terra Nova: A Comprehensive Challenge Environment for Intelligent Agents
par: McInroe, Trevor
Publié: (2025)
par: McInroe, Trevor
Publié: (2025)
Enhancing Tactile-based Reinforcement Learning for Robotic Control
par: Miller, Elle, et autres
Publié: (2025)
par: Miller, Elle, et autres
Publié: (2025)
Efficient Offline Reinforcement Learning: First Imitate, then Improve
par: Jelley, Adam, et autres
Publié: (2024)
par: Jelley, Adam, et autres
Publié: (2024)
LLM-Personalize: Aligning LLM Planners with Human Preferences via Reinforced Self-Training for Housekeeping Robots
par: Han, Dongge, et autres
Publié: (2024)
par: Han, Dongge, et autres
Publié: (2024)
Object-Centric World Models from Few-Shot Annotations for Sample-Efficient Reinforcement Learning
par: Zhang, Weipu, et autres
Publié: (2025)
par: Zhang, Weipu, et autres
Publié: (2025)
DRED: Zero-Shot Transfer in Reinforcement Learning via Data-Regularised Environment Design
par: Garcin, Samuel, et autres
Publié: (2024)
par: Garcin, Samuel, et autres
Publié: (2024)
Assistax: A Hardware-Accelerated Reinforcement Learning Benchmark for Assistive Robotics
par: Hinckeldey, Leonard, et autres
Publié: (2025)
par: Hinckeldey, Leonard, et autres
Publié: (2025)
roto 2.0: The Robot Tactile Olympiad
par: Miller, Elle, et autres
Publié: (2026)
par: Miller, Elle, et autres
Publié: (2026)
Forgetting is Everywhere
par: Sanati, Ben, et autres
Publié: (2025)
par: Sanati, Ben, et autres
Publié: (2025)
CODA: Coordination via On-Policy Diffusion for Multi-Agent Offline Reinforcement Learning
par: Hedman, Marcel, et autres
Publié: (2026)
par: Hedman, Marcel, et autres
Publié: (2026)
Global dynamical structures from infinitesimal data
par: McInroe, Benjamin, et autres
Publié: (2024)
par: McInroe, Benjamin, et autres
Publié: (2024)
A Survey of State Representation Learning for Deep Reinforcement Learning
par: Echchahed, Ayoub, et autres
Publié: (2025)
par: Echchahed, Ayoub, et autres
Publié: (2025)
Simplicial Embeddings Improve Sample Efficiency in Actor-Critic Agents
par: Obando-Ceron, Johan, et autres
Publié: (2025)
par: Obando-Ceron, Johan, et autres
Publié: (2025)
A categorical characterization of relative entropy on standard Borel spaces
par: Gagne, Nicolas, et autres
Publié: (2017)
par: Gagne, Nicolas, et autres
Publié: (2017)
The Formalism-Implementation Gap in Reinforcement Learning Research
par: Castro, Pablo Samuel
Publié: (2025)
par: Castro, Pablo Samuel
Publié: (2025)
Reinforcement Learning with Pairwise Preferences in Long-Term Decision Problems
par: Carr, Jonathan Colaço, et autres
Publié: (2026)
par: Carr, Jonathan Colaço, et autres
Publié: (2026)
Actor-Critic Reinforcement Learning with Phased Actor
par: Wu, Ruofan, et autres
Publié: (2024)
par: Wu, Ruofan, et autres
Publié: (2024)
Credit scoring using neural networks and SURE posterior probability calibration
par: Garcin, Matthieu, et autres
Publié: (2021)
par: Garcin, Matthieu, et autres
Publié: (2021)
Exploring the Interplay Between Quantum Entanglement and Decoherence
par: Gonzalez, Samuel Marquez
Publié: (2025)
par: Gonzalez, Samuel Marquez
Publié: (2025)
Physics-Guided Actor-Critic Reinforcement Learning for Swimming in Turbulence
par: Koh, Christopher, et autres
Publié: (2024)
par: Koh, Christopher, et autres
Publié: (2024)
Behavioural pseudometrics for continuous-time diffusions
par: Chen, Linan, et autres
Publié: (2023)
par: Chen, Linan, et autres
Publié: (2023)
Two behavioural pseudometrics for continuous-time Markov processes
par: Chen, Linan, et autres
Publié: (2025)
par: Chen, Linan, et autres
Publié: (2025)
Bisimulation for Feller-Dynkin Processes
par: Chen, Linan, et autres
Publié: (2019)
par: Chen, Linan, et autres
Publié: (2019)
A behavioural pseudometric for continuous-time Markov processes
par: Chen, Linan, et autres
Publié: (2025)
par: Chen, Linan, et autres
Publié: (2025)
Mind the GAP! The Challenges of Scale in Pixel-based Deep Reinforcement Learning
par: Sokar, Ghada, et autres
Publié: (2025)
par: Sokar, Ghada, et autres
Publié: (2025)
Multi-view Disentanglement for Reinforcement Learning with Multiple Cameras
par: Dunion, Mhairi, et autres
Publié: (2024)
par: Dunion, Mhairi, et autres
Publié: (2024)
Quantum Advantage Actor-Critic for Reinforcement Learning
par: Kölle, Michael, et autres
Publié: (2024)
par: Kölle, Michael, et autres
Publié: (2024)
Flow Actor-Critic for Offline Reinforcement Learning
par: Chae, Jongseong, et autres
Publié: (2026)
par: Chae, Jongseong, et autres
Publié: (2026)
Conditions on Preference Relations that Guarantee the Existence of Optimal Policies
par: Carr, Jonathan Colaço, et autres
Publié: (2023)
par: Carr, Jonathan Colaço, et autres
Publié: (2023)
Stable Deep Reinforcement Learning via Isotropic Gaussian Representations
par: Pasand, Ali Saheb, et autres
Publié: (2026)
par: Pasand, Ali Saheb, et autres
Publié: (2026)
SMAC: Score-Matched Actor-Critics for Robust Offline-to-Online Transfer
par: de Lara, Nathan Samuel, et autres
Publié: (2026)
par: de Lara, Nathan Samuel, et autres
Publié: (2026)
Weak Convergence Analysis of Online Neural Actor-Critic Algorithms
par: Lam, Samuel Chun-Hei, et autres
Publié: (2024)
par: Lam, Samuel Chun-Hei, et autres
Publié: (2024)
Neural Actor-Critic Methods for Hamilton-Jacobi-Bellman PDEs: Asymptotic Analysis and Numerical Studies
par: Cohen, Samuel N., et autres
Publié: (2025)
par: Cohen, Samuel N., et autres
Publié: (2025)
Revisiting Mixture Policies in Entropy-Regularized Actor-Critic
par: He, Jiamin, et autres
Publié: (2026)
par: He, Jiamin, et autres
Publié: (2026)
Pretraining in Actor-Critic Reinforcement Learning for Robot Locomotion
par: Fan, Jiale, et autres
Publié: (2025)
par: Fan, Jiale, et autres
Publié: (2025)
Quantum Machine Learning: An Interplay Between Quantum Computing and Machine Learning
par: Qi, Jun, et autres
Publié: (2024)
par: Qi, Jun, et autres
Publié: (2024)
Interpreting Lambda Calculus in Domain-Valued Random Variables
par: Furber, Robert, et autres
Publié: (2021)
par: Furber, Robert, et autres
Publié: (2021)
Documents similaires
-
PixelBrax: Learning Continuous Control from Pixels End-to-End on the GPU
par: McInroe, Trevor, et autres
Publié: (2025) -
Multi-Horizon Representations with Hierarchical Forward Models for Reinforcement Learning
par: McInroe, Trevor, et autres
Publié: (2022) -
Planning to Go Out-of-Distribution in Offline-to-Online Reinforcement Learning
par: McInroe, Trevor, et autres
Publié: (2023) -
Terra Nova: A Comprehensive Challenge Environment for Intelligent Agents
par: McInroe, Trevor
Publié: (2025) -
Enhancing Tactile-based Reinforcement Learning for Robotic Control
par: Miller, Elle, et autres
Publié: (2025)