Salvato in:
| Autori principali: | Lee, Sungyoung, Kim, Dohyeong, Balachandar, Eshan, Mustafaoglu, Zelal Su, Pingali, Keshav |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2605.01663 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Optimize Wider, Not Deeper: Consensus Aggregation for Policy Optimization
di: Su, Zelal, et al.
Pubblicazione: (2026)
di: Su, Zelal, et al.
Pubblicazione: (2026)
Evolutionary Policy Optimization
di: Mustafaoglu, Zelal Su "Lain", et al.
Pubblicazione: (2025)
di: Mustafaoglu, Zelal Su "Lain", et al.
Pubblicazione: (2025)
Flashlight: PyTorch Compiler Extensions to Accelerate Attention Variants
di: You, Bozhi, et al.
Pubblicazione: (2025)
di: You, Bozhi, et al.
Pubblicazione: (2025)
ReFORM: Reflected Flows for On-support Offline RL via Noise Manipulation
di: Zhang, Songyuan, et al.
Pubblicazione: (2026)
di: Zhang, Songyuan, et al.
Pubblicazione: (2026)
Causal Flow Q-Learning for Robust Offline Reinforcement Learning
di: Li, Mingxuan, et al.
Pubblicazione: (2026)
di: Li, Mingxuan, et al.
Pubblicazione: (2026)
FlowQ: Energy-Guided Flow Policies for Offline Reinforcement Learning
di: Alles, Marvin, et al.
Pubblicazione: (2025)
di: Alles, Marvin, et al.
Pubblicazione: (2025)
DEAS: DEtached value learning with Action Sequence for Scalable Offline RL
di: Kim, Changyeon, et al.
Pubblicazione: (2025)
di: Kim, Changyeon, et al.
Pubblicazione: (2025)
Flow-Based Single-Step Completion for Efficient and Expressive Policy Learning
di: Koirala, Prajwal, et al.
Pubblicazione: (2025)
di: Koirala, Prajwal, et al.
Pubblicazione: (2025)
FLAG: Flow Policy MaxEnt-RL by Latent Augmented Guidance
di: Kim, Sungha, et al.
Pubblicazione: (2026)
di: Kim, Sungha, et al.
Pubblicazione: (2026)
Balancing Signal and Variance: Adaptive Offline RL Post-Training for VLA Flow Models
di: Zhang, Hongyin, et al.
Pubblicazione: (2025)
di: Zhang, Hongyin, et al.
Pubblicazione: (2025)
Adaptive Q-Chunking for Offline-to-Online Reinforcement Learning
di: Gireesh, Nandiraju, et al.
Pubblicazione: (2026)
di: Gireesh, Nandiraju, et al.
Pubblicazione: (2026)
Learning Generalizable Visuomotor Policy through Dynamics-Alignment
di: Lee, Dohyeok, et al.
Pubblicazione: (2025)
di: Lee, Dohyeok, et al.
Pubblicazione: (2025)
Uncertainty-Aware Rank-One MIMO Q Network Framework for Accelerated Offline Reinforcement Learning
di: Nguyen, Thanh, et al.
Pubblicazione: (2026)
di: Nguyen, Thanh, et al.
Pubblicazione: (2026)
Efficient Online RL Fine Tuning with Offline Pre-trained Policy Only
di: Xiao, Wei, et al.
Pubblicazione: (2025)
di: Xiao, Wei, et al.
Pubblicazione: (2025)
Q-value Regularized Decision ConvFormer for Offline Reinforcement Learning
di: Yan, Teng, et al.
Pubblicazione: (2024)
di: Yan, Teng, et al.
Pubblicazione: (2024)
Diffusion Models as Optimizers for Efficient Planning in Offline RL
di: Huang, Renming, et al.
Pubblicazione: (2024)
di: Huang, Renming, et al.
Pubblicazione: (2024)
ENOTO: Improving Offline-to-Online Reinforcement Learning with Q-Ensembles
di: Zhao, Kai, et al.
Pubblicazione: (2023)
di: Zhao, Kai, et al.
Pubblicazione: (2023)
Compositional Conservatism: A Transductive Approach in Offline Reinforcement Learning
di: Song, Yeda, et al.
Pubblicazione: (2024)
di: Song, Yeda, et al.
Pubblicazione: (2024)
CtRL-Sim: Reactive and Controllable Driving Agents with Offline Reinforcement Learning
di: Rowe, Luke, et al.
Pubblicazione: (2024)
di: Rowe, Luke, et al.
Pubblicazione: (2024)
Robust Policy Learning via Offline Skill Diffusion
di: Kim, Woo Kyung, et al.
Pubblicazione: (2024)
di: Kim, Woo Kyung, et al.
Pubblicazione: (2024)
Language-Conditioned Offline RL for Multi-Robot Navigation
di: Morad, Steven, et al.
Pubblicazione: (2024)
di: Morad, Steven, et al.
Pubblicazione: (2024)
ACL-QL: Adaptive Conservative Level in Q-Learning for Offline Reinforcement Learning
di: Wu, Kun, et al.
Pubblicazione: (2024)
di: Wu, Kun, et al.
Pubblicazione: (2024)
HIQL: Offline Goal-Conditioned RL with Latent States as Actions
di: Park, Seohong, et al.
Pubblicazione: (2023)
di: Park, Seohong, et al.
Pubblicazione: (2023)
Learn Where Outcomes Diverge: Efficient VLA RL via Probabilistic Chunk Masking
di: Bagaria, Vaidehi, et al.
Pubblicazione: (2026)
di: Bagaria, Vaidehi, et al.
Pubblicazione: (2026)
SutureFormer: Learning Surgical Trajectories via Goal-conditioned Offline RL in Pixel Space
di: Liu, Huanrong, et al.
Pubblicazione: (2026)
di: Liu, Huanrong, et al.
Pubblicazione: (2026)
Failure-Aware RL: Reliable Offline-to-Online Reinforcement Learning with Self-Recovery for Real-World Manipulation
di: Li, Huanyu, et al.
Pubblicazione: (2026)
di: Li, Huanyu, et al.
Pubblicazione: (2026)
Scaling Offline RL via Efficient and Expressive Shortcut Models
di: Espinosa-Dice, Nicolas, et al.
Pubblicazione: (2025)
di: Espinosa-Dice, Nicolas, et al.
Pubblicazione: (2025)
A Recipe for Stable Offline Multi-agent Reinforcement Learning
di: Lee, Dongsu, et al.
Pubblicazione: (2026)
di: Lee, Dongsu, et al.
Pubblicazione: (2026)
Sim-Anchored Learning for On-the-Fly Adaptation
di: Mabsout, Bassel El, et al.
Pubblicazione: (2023)
di: Mabsout, Bassel El, et al.
Pubblicazione: (2023)
Equivariant Offline Reinforcement Learning
di: Tangri, Arsh, et al.
Pubblicazione: (2024)
di: Tangri, Arsh, et al.
Pubblicazione: (2024)
H2O+: An Improved Framework for Hybrid Offline-and-Online RL with Dynamics Gaps
di: Niu, Haoyi, et al.
Pubblicazione: (2023)
di: Niu, Haoyi, et al.
Pubblicazione: (2023)
Stage-Wise Reward Shaping for Acrobatic Robots: A Constrained Multi-Objective Reinforcement Learning Approach
di: Kim, Dohyeong, et al.
Pubblicazione: (2024)
di: Kim, Dohyeong, et al.
Pubblicazione: (2024)
Q-Guided Stein Variational Model Predictive Control via RL-informed Policy Prior
di: Cai, Shizhe, et al.
Pubblicazione: (2025)
di: Cai, Shizhe, et al.
Pubblicazione: (2025)
Boundary-to-Region Supervision for Offline Safe Reinforcement Learning
di: Su, Huikang, et al.
Pubblicazione: (2025)
di: Su, Huikang, et al.
Pubblicazione: (2025)
Graph-Assisted Stitching for Offline Hierarchical Reinforcement Learning
di: Baek, Seungho, et al.
Pubblicazione: (2025)
di: Baek, Seungho, et al.
Pubblicazione: (2025)
Trust Region Q Adjoint Matching
di: Dong, Yonghoon, et al.
Pubblicazione: (2026)
di: Dong, Yonghoon, et al.
Pubblicazione: (2026)
From Prior to Pro: Efficient Skill Mastery via Distribution Contractive RL Finetuning
di: Sun, Zhanyi, et al.
Pubblicazione: (2026)
di: Sun, Zhanyi, et al.
Pubblicazione: (2026)
Dual-Granularity Contrastive Reward via Generated Episodic Guidance for Efficient Embodied RL
di: Liu, Xin, et al.
Pubblicazione: (2026)
di: Liu, Xin, et al.
Pubblicazione: (2026)
Towards Robust Policy: Enhancing Offline Reinforcement Learning with Adversarial Attacks and Defenses
di: Nguyen, Thanh, et al.
Pubblicazione: (2024)
di: Nguyen, Thanh, et al.
Pubblicazione: (2024)
Temporal Distance-aware Transition Augmentation for Offline Model-based Reinforcement Learning
di: Lee, Dongsu, et al.
Pubblicazione: (2025)
di: Lee, Dongsu, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Optimize Wider, Not Deeper: Consensus Aggregation for Policy Optimization
di: Su, Zelal, et al.
Pubblicazione: (2026) -
Evolutionary Policy Optimization
di: Mustafaoglu, Zelal Su "Lain", et al.
Pubblicazione: (2025) -
Flashlight: PyTorch Compiler Extensions to Accelerate Attention Variants
di: You, Bozhi, et al.
Pubblicazione: (2025) -
ReFORM: Reflected Flows for On-support Offline RL via Noise Manipulation
di: Zhang, Songyuan, et al.
Pubblicazione: (2026) -
Causal Flow Q-Learning for Robust Offline Reinforcement Learning
di: Li, Mingxuan, et al.
Pubblicazione: (2026)