Enregistré dans:
| Auteurs principaux: | Luo, Zhenglong, Chen, Zhiyong, Liu, Aoxiang |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2601.04511 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Scalable Multiagent Reinforcement Learning with Collective Influence Estimation
par: Luo, Zhenglong, et autres
Publié: (2026)
par: Luo, Zhenglong, et autres
Publié: (2026)
PRIMER: Perception-Aware Robust Learning-based Multiagent Trajectory Planner
par: Kondo, Kota, et autres
Publié: (2024)
par: Kondo, Kota, et autres
Publié: (2024)
Double Actor-Critic with TD Error-Driven Regularization in Reinforcement Learning
par: Chen, Haohui, et autres
Publié: (2024)
par: Chen, Haohui, et autres
Publié: (2024)
Mitigating Estimation Bias with Representation Learning in TD Error-Driven Regularization
par: Chen, Haohui, et autres
Publié: (2025)
par: Chen, Haohui, et autres
Publié: (2025)
Reinforcement Learning with Action Chunking
par: Li, Qiyang, et autres
Publié: (2025)
par: Li, Qiyang, et autres
Publié: (2025)
Simple Recipe Works: Vision-Language-Action Models are Natural Continual Learners with Reinforcement Learning
par: Hu, Jiaheng, et autres
Publié: (2026)
par: Hu, Jiaheng, et autres
Publié: (2026)
Safe Hybrid-Action Reinforcement Learning-Based Decision and Control for Discretionary Lane Change
par: Xu, Ruichen, et autres
Publié: (2024)
par: Xu, Ruichen, et autres
Publié: (2024)
Hierarchical Reinforcement Learning for Safe Mapless Navigation with Congestion Estimation
par: Gao, Jianqi, et autres
Publié: (2025)
par: Gao, Jianqi, et autres
Publié: (2025)
Dual Action Policy for Robust Sim-to-Real Reinforcement Learning
par: Terence, Ng Wen Zheng, et autres
Publié: (2024)
par: Terence, Ng Wen Zheng, et autres
Publié: (2024)
Collision Avoidance Verification of Multiagent Systems with Learned Policies
par: Dong, Zihao, et autres
Publié: (2024)
par: Dong, Zihao, et autres
Publié: (2024)
Equivariant Action Sampling for Reinforcement Learning and Planning
par: Zhao, Linfeng, et autres
Publié: (2024)
par: Zhao, Linfeng, et autres
Publié: (2024)
Robustness Evaluation of Offline Reinforcement Learning for Robot Control Against Action Perturbations
par: Ayabe, Shingo, et autres
Publié: (2024)
par: Ayabe, Shingo, et autres
Publié: (2024)
Vintix: Action Model via In-Context Reinforcement Learning
par: Polubarov, Andrey, et autres
Publié: (2025)
par: Polubarov, Andrey, et autres
Publié: (2025)
Towards Practical World Model-based Reinforcement Learning for Vision-Language-Action Models
par: Zhang, Zhilong, et autres
Publié: (2026)
par: Zhang, Zhilong, et autres
Publié: (2026)
Beyond Non-Expert Demonstrations: Outcome-Driven Action Constraint for Offline Reinforcement Learning
par: Jiang, Ke, et autres
Publié: (2025)
par: Jiang, Ke, et autres
Publié: (2025)
Efficient Multi-Task Reinforcement Learning via Task-Specific Action Correction
par: Feng, Jinyuan, et autres
Publié: (2024)
par: Feng, Jinyuan, et autres
Publié: (2024)
Reinforcement Fine-Tuning of Flow-Matching Policies for Vision-Language-Action Models
par: Lyu, Mingyang, et autres
Publié: (2025)
par: Lyu, Mingyang, et autres
Publié: (2025)
Improving Vision-Language-Action Model with Online Reinforcement Learning
par: Guo, Yanjiang, et autres
Publié: (2025)
par: Guo, Yanjiang, et autres
Publié: (2025)
Jump-Start Reinforcement Learning with Vision-Language-Action Regularization
par: Moroncelli, Angelo, et autres
Publié: (2026)
par: Moroncelli, Angelo, et autres
Publié: (2026)
Constraint-Aware Reinforcement Learning via Adaptive Action Scaling
par: Dawood, Murad, et autres
Publié: (2025)
par: Dawood, Murad, et autres
Publié: (2025)
Estimator-Coupled Reinforcement Learning for Robust Purely Tactile In-Hand Manipulation
par: Röstel, Lennart, et autres
Publié: (2023)
par: Röstel, Lennart, et autres
Publié: (2023)
Parameter Estimation using Reinforcement Learning Causal Curiosity: Limits and Challenges
par: Arana-Catania, Miguel, et autres
Publié: (2025)
par: Arana-Catania, Miguel, et autres
Publié: (2025)
Cost Function Estimation Using Inverse Reinforcement Learning with Minimal Observations
par: Mehrdad, Sarmad, et autres
Publié: (2025)
par: Mehrdad, Sarmad, et autres
Publié: (2025)
Safety-Aware Reinforcement Learning for Control via Risk-Sensitive Action-Value Iteration and Quantile Regression
par: Enwerem, Clinton, et autres
Publié: (2025)
par: Enwerem, Clinton, et autres
Publié: (2025)
PolicyFlow: Policy Optimization with Continuous Normalizing Flow in Reinforcement Learning
par: Yang, Shunpeng, et autres
Publié: (2026)
par: Yang, Shunpeng, et autres
Publié: (2026)
Accelerating Residual Reinforcement Learning with Uncertainty Estimation
par: Dodeja, Lakshita, et autres
Publié: (2025)
par: Dodeja, Lakshita, et autres
Publié: (2025)
CO-RFT: Efficient Fine-Tuning of Vision-Language-Action Models through Chunked Offline Reinforcement Learning
par: Huang, Dongchi, et autres
Publié: (2025)
par: Huang, Dongchi, et autres
Publié: (2025)
Coarse-to-fine Q-Network with Action Sequence for Data-Efficient Reinforcement Learning
par: Seo, Younggyo, et autres
Publié: (2024)
par: Seo, Younggyo, et autres
Publié: (2024)
Scheduling Drone and Mobile Charger via Hybrid-Action Deep Reinforcement Learning
par: Dou, Jizhe, et autres
Publié: (2024)
par: Dou, Jizhe, et autres
Publié: (2024)
Action-Constrained Imitation Learning
par: Yeh, Chia-Han, et autres
Publié: (2025)
par: Yeh, Chia-Han, et autres
Publié: (2025)
Filtering Learning Histories Enhances In-Context Reinforcement Learning
par: Chen, Weiqin, et autres
Publié: (2025)
par: Chen, Weiqin, et autres
Publié: (2025)
Hybrid Action Based Reinforcement Learning for Multi-Objective Compatible Autonomous Driving
par: Jin, Guizhe, et autres
Publié: (2025)
par: Jin, Guizhe, et autres
Publié: (2025)
Multi-Agent Reinforcement Learning-Based UAV Pathfinding for Obstacle Avoidance in Stochastic Environment
par: Wu, Qizhen, et autres
Publié: (2023)
par: Wu, Qizhen, et autres
Publié: (2023)
Efficient Coordination with the System-Level Shared State: An Embodied-AI Native Modular Framework
par: Deng, Yixuan, et autres
Publié: (2026)
par: Deng, Yixuan, et autres
Publié: (2026)
RobustVLA: Robustness-Aware Reinforcement Post-Training for Vision-Language-Action Models
par: Zhang, Hongyin, et autres
Publié: (2025)
par: Zhang, Hongyin, et autres
Publié: (2025)
Crowd-Robot Interaction: Crowd-aware Robot Navigation with Attention-based Deep Reinforcement Learning
par: Chen, Changan, et autres
Publié: (2018)
par: Chen, Changan, et autres
Publié: (2018)
State Chrono Representation for Enhancing Generalization in Reinforcement Learning
par: Chen, Jianda, et autres
Publié: (2024)
par: Chen, Jianda, et autres
Publié: (2024)
Physics-Aware Combinatorial Assembly Sequence Planning using Data-free Action Masking
par: Liu, Ruixuan, et autres
Publié: (2024)
par: Liu, Ruixuan, et autres
Publié: (2024)
Imitation Learning with Limited Actions via Diffusion Planners and Deep Koopman Controllers
par: Bi, Jianxin, et autres
Publié: (2024)
par: Bi, Jianxin, et autres
Publié: (2024)
Trajectory Entropy Reinforcement Learning for Predictable and Robust Control
par: You, Bang, et autres
Publié: (2025)
par: You, Bang, et autres
Publié: (2025)
Documents similaires
-
Scalable Multiagent Reinforcement Learning with Collective Influence Estimation
par: Luo, Zhenglong, et autres
Publié: (2026) -
PRIMER: Perception-Aware Robust Learning-based Multiagent Trajectory Planner
par: Kondo, Kota, et autres
Publié: (2024) -
Double Actor-Critic with TD Error-Driven Regularization in Reinforcement Learning
par: Chen, Haohui, et autres
Publié: (2024) -
Mitigating Estimation Bias with Representation Learning in TD Error-Driven Regularization
par: Chen, Haohui, et autres
Publié: (2025) -
Reinforcement Learning with Action Chunking
par: Li, Qiyang, et autres
Publié: (2025)