Adapting Critic Match Loss Landscape Visualization to Off-policy Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Liu, Jingyi, Guo, Jian, Gill, Eberhard |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Visualizing Critic Match Loss Landscapes for Interpretation of Online Reinforcement Learning Control Algorithms
di: Liu, Jingyi, et al.
Pubblicazione: (2026)
di: Liu, Jingyi, et al.
Pubblicazione: (2026)
A Loss Landscape Visualization Framework for Interpreting Reinforcement Learning: An ADHDP Case Study
di: Liu, Jingyi, et al.
Pubblicazione: (2026)
di: Liu, Jingyi, et al.
Pubblicazione: (2026)
MOBODY: Model Based Off-Dynamics Offline Reinforcement Learning
di: Guo, Yihong, et al.
Pubblicazione: (2025)
di: Guo, Yihong, et al.
Pubblicazione: (2025)
Off-Dynamics Reinforcement Learning via Domain Adaptation and Reward Augmented Imitation
di: Guo, Yihong, et al.
Pubblicazione: (2024)
di: Guo, Yihong, et al.
Pubblicazione: (2024)
Cross-Domain Energy-Guided Diffusion Generation for Off-Dynamics Reinforcement Learning
di: Yang, Yu, et al.
Pubblicazione: (2026)
di: Yang, Yu, et al.
Pubblicazione: (2026)
Return Augmented Decision Transformer for Off-Dynamics Reinforcement Learning
di: Wang, Ruhan, et al.
Pubblicazione: (2024)
di: Wang, Ruhan, et al.
Pubblicazione: (2024)
TADPO: Reinforcement Learning Goes Off-road
di: Wu, Zhouchonghao, et al.
Pubblicazione: (2026)
di: Wu, Zhouchonghao, et al.
Pubblicazione: (2026)
Bootstrap Off-policy with World Model
di: Zhan, Guojian, et al.
Pubblicazione: (2025)
di: Zhan, Guojian, et al.
Pubblicazione: (2025)
Sample Complexity of Distributionally Robust Off-Dynamics Reinforcement Learning with Online Interaction
di: He, Yiting, et al.
Pubblicazione: (2025)
di: He, Yiting, et al.
Pubblicazione: (2025)
Localized Dynamics-Aware Domain Adaption for Off-Dynamics Offline Reinforcement Learning
di: Xia, Zhangjie, et al.
Pubblicazione: (2026)
di: Xia, Zhangjie, et al.
Pubblicazione: (2026)
Frugal Actor-Critic: Sample Efficient Off-Policy Deep Reinforcement Learning Using Unique Experiences
di: Singh, Nikhil Kumar, et al.
Pubblicazione: (2024)
di: Singh, Nikhil Kumar, et al.
Pubblicazione: (2024)
Offline Actor-Critic Reinforcement Learning Scales to Large Models
di: Springenberg, Jost Tobias, et al.
Pubblicazione: (2024)
di: Springenberg, Jost Tobias, et al.
Pubblicazione: (2024)
Hierarchical Multi-Agent Reinforcement Learning with Control Barrier Functions for Safety-Critical Autonomous Systems
di: Ahmad, H. M. Sabbir, et al.
Pubblicazione: (2025)
di: Ahmad, H. M. Sabbir, et al.
Pubblicazione: (2025)
TOPPO: Rethinking PPO for Multi-Task Reinforcement Learning with Critic Balancing
di: Li, Yuanpeng, et al.
Pubblicazione: (2026)
di: Li, Yuanpeng, et al.
Pubblicazione: (2026)
Improving generalization of robot locomotion policies via Sharpness-Aware Reinforcement Learning
di: Bochem, Severin, et al.
Pubblicazione: (2024)
di: Bochem, Severin, et al.
Pubblicazione: (2024)
Affordance-Guided Reinforcement Learning via Visual Prompting
di: Lee, Olivia Y., et al.
Pubblicazione: (2024)
di: Lee, Olivia Y., et al.
Pubblicazione: (2024)
Reinforcement Learning Position Control of a Quadrotor Using Soft Actor-Critic (SAC)
di: Mahran, Youssef, et al.
Pubblicazione: (2025)
di: Mahran, Youssef, et al.
Pubblicazione: (2025)
ACL-QL: Adaptive Conservative Level in Q-Learning for Offline Reinforcement Learning
di: Wu, Kun, et al.
Pubblicazione: (2024)
di: Wu, Kun, et al.
Pubblicazione: (2024)
Off-Policy Actor-Critic for Adversarial Observation Robustness: Virtual Alternative Training via Symmetric Policy Evaluation
di: Nakanishi, Kosuke, et al.
Pubblicazione: (2025)
di: Nakanishi, Kosuke, et al.
Pubblicazione: (2025)
Autonomous Navigation of an Ultrasound Probe Towards Standard Scan Planes with Deep Reinforcement Learning
di: Li, Keyu, et al.
Pubblicazione: (2021)
di: Li, Keyu, et al.
Pubblicazione: (2021)
Multi-Agent Reinforcement Learning for Unmanned Aerial Vehicle Coordination by Multi-Critic Policy Gradient Optimization
di: Alon, Yoav, et al.
Pubblicazione: (2020)
di: Alon, Yoav, et al.
Pubblicazione: (2020)
GOPT: Generalizable Online 3D Bin Packing via Transformer-based Deep Reinforcement Learning
di: Xiong, Heng, et al.
Pubblicazione: (2024)
di: Xiong, Heng, et al.
Pubblicazione: (2024)
Learning Autonomy: Off-Road Navigation Enhanced by Human Input
di: Nagariya, Akhil, et al.
Pubblicazione: (2025)
di: Nagariya, Akhil, et al.
Pubblicazione: (2025)
A Safety Modulator Actor-Critic Method in Model-Free Safe Reinforcement Learning and Application in UAV Hovering
di: Qi, Qihan, et al.
Pubblicazione: (2024)
di: Qi, Qihan, et al.
Pubblicazione: (2024)
Adapting World Models with Latent-State Dynamics Residuals
di: Lanier, JB, et al.
Pubblicazione: (2025)
di: Lanier, JB, et al.
Pubblicazione: (2025)
GUARD: A Safe Reinforcement Learning Benchmark
di: Zhao, Weiye, et al.
Pubblicazione: (2023)
di: Zhao, Weiye, et al.
Pubblicazione: (2023)
Mining the Long Tail: A Comparative Study of Data-Centric Criticality Metrics for Robust Offline Reinforcement Learning in Autonomous Motion Planning
di: Guillen-Perez, Antonio
Pubblicazione: (2025)
di: Guillen-Perez, Antonio
Pubblicazione: (2025)
SLIM: Skill Learning with Multiple Critics
di: Emukpere, David, et al.
Pubblicazione: (2024)
di: Emukpere, David, et al.
Pubblicazione: (2024)
Boundary-to-Region Supervision for Offline Safe Reinforcement Learning
di: Su, Huikang, et al.
Pubblicazione: (2025)
di: Su, Huikang, et al.
Pubblicazione: (2025)
Hierarchical Reinforcement Learning for Swarm Confrontation with High Uncertainty
di: Wu, Qizhen, et al.
Pubblicazione: (2024)
di: Wu, Qizhen, et al.
Pubblicazione: (2024)
Implicit Safe Set Algorithm for Provably Safe Reinforcement Learning
di: Zhao, Weiye, et al.
Pubblicazione: (2024)
di: Zhao, Weiye, et al.
Pubblicazione: (2024)
Performance Asymmetry in Model-Based Reinforcement Learning
di: Lim, Jing Yu, et al.
Pubblicazione: (2025)
di: Lim, Jing Yu, et al.
Pubblicazione: (2025)
Solving New Tasks by Adapting Internet Video Knowledge
di: Luo, Calvin, et al.
Pubblicazione: (2025)
di: Luo, Calvin, et al.
Pubblicazione: (2025)
RL-100: Performant Robotic Manipulation with Real-World Reinforcement Learning
di: Lei, Kun, et al.
Pubblicazione: (2025)
di: Lei, Kun, et al.
Pubblicazione: (2025)
One-Shot Imitation Learning with Invariance Matching for Robotic Manipulation
di: Zhang, Xinyu, et al.
Pubblicazione: (2024)
di: Zhang, Xinyu, et al.
Pubblicazione: (2024)
Robust Offline Reinforcement Learning with Linearly Structured f-Divergence Regularization
di: Tang, Cheng, et al.
Pubblicazione: (2024)
di: Tang, Cheng, et al.
Pubblicazione: (2024)
Reinforcement Learning with Action Chunking
di: Li, Qiyang, et al.
Pubblicazione: (2025)
di: Li, Qiyang, et al.
Pubblicazione: (2025)
RILe: Reinforced Imitation Learning
di: Albaba, Mert, et al.
Pubblicazione: (2024)
di: Albaba, Mert, et al.
Pubblicazione: (2024)
Rating-based Reinforcement Learning
di: White, Devin, et al.
Pubblicazione: (2023)
di: White, Devin, et al.
Pubblicazione: (2023)
Offline Goal-Conditioned Reinforcement Learning for Safety-Critical Tasks with Recovery Policy
di: Cao, Chenyang, et al.
Pubblicazione: (2024)
di: Cao, Chenyang, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Visualizing Critic Match Loss Landscapes for Interpretation of Online Reinforcement Learning Control Algorithms
di: Liu, Jingyi, et al.
Pubblicazione: (2026) -
A Loss Landscape Visualization Framework for Interpreting Reinforcement Learning: An ADHDP Case Study
di: Liu, Jingyi, et al.
Pubblicazione: (2026) -
MOBODY: Model Based Off-Dynamics Offline Reinforcement Learning
di: Guo, Yihong, et al.
Pubblicazione: (2025) -
Off-Dynamics Reinforcement Learning via Domain Adaptation and Reward Augmented Imitation
di: Guo, Yihong, et al.
Pubblicazione: (2024) -
Cross-Domain Energy-Guided Diffusion Generation for Off-Dynamics Reinforcement Learning
di: Yang, Yu, et al.
Pubblicazione: (2026)