RLinf-USER: A Unified and Extensible System for Real-World Online Policy Learning in Embodied AI
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zang, Hongzhi, Yu, Shu'ang, Lin, Hao, Zhou, Tianxing, Huang, Zefang, Guo, Zhen, Xu, Xin, Zhou, Jiakai, Sheng, Yuze, Zhang, Shizhe, Gao, Feng, Tang, Wenhao, Yue, Yufeng, Zhang, Quanlu, Chen, Xinlei, Yu, Chao, Wang, Yu |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
RLinf-VLA: A Unified and Efficient Framework for Reinforcement Learning of Vision-Language-Action Models
par: Zang, Hongzhi, et autres
Publié: (2025)
par: Zang, Hongzhi, et autres
Publié: (2025)
RLinf: Flexible and Efficient Large-scale Reinforcement Learning via Macro-to-Micro Flow Transformation
par: Yu, Chao, et autres
Publié: (2025)
par: Yu, Chao, et autres
Publié: (2025)
WoVR: World Models as Reliable Simulators for Post-Training VLA Policies with RL
par: Jiang, Zhennan, et autres
Publié: (2026)
par: Jiang, Zhennan, et autres
Publié: (2026)
$π_\texttt{RL}$: Online RL Fine-tuning for Flow-based Vision-Language-Action Models
par: Chen, Kang, et autres
Publié: (2025)
par: Chen, Kang, et autres
Publié: (2025)
Enabling Extensible Embodied Capabilities with Tools
par: Zhou, Xueyang, et autres
Publié: (2026)
par: Zhou, Xueyang, et autres
Publié: (2026)
Localization matters too: How localization error affects UAV flight
par: Zhang, Suquan, et autres
Publié: (2024)
par: Zhang, Suquan, et autres
Publié: (2024)
JuggleRL: Mastering Ball Juggling with a Quadrotor via Deep Reinforcement Learning
par: Ji, Shilong, et autres
Publié: (2025)
par: Ji, Shilong, et autres
Publié: (2025)
Multi-Robot System for Cooperative Exploration in Unknown Environments: A Survey
par: Wang, Chuqi, et autres
Publié: (2025)
par: Wang, Chuqi, et autres
Publié: (2025)
MCTS-EP: Empowering Embodied Planning with Online Preference Optimization
par: Xu, Hang, et autres
Publié: (2025)
par: Xu, Hang, et autres
Publié: (2025)
RoboScape-R: Unified Reward-Observation World Models for Generalizable Robotics Training via RL
par: Tang, Yinzhou, et autres
Publié: (2025)
par: Tang, Yinzhou, et autres
Publié: (2025)
LMFlow: An Extensible Toolkit for Finetuning and Inference of Large Foundation Models
par: Diao, Shizhe, et autres
Publié: (2023)
par: Diao, Shizhe, et autres
Publié: (2023)
SAC Flow: Sample-Efficient Reinforcement Learning of Flow-Based Policies via Velocity-Reparameterized Sequential Modeling
par: Zhang, Yixian, et autres
Publié: (2025)
par: Zhang, Yixian, et autres
Publié: (2025)
Cellular Senescence in Cancer: Mechanisms, Roles in Tumor Progression, and Therapeutic Implications
par: Jingrui Yan, et autres
Publié: (2025)
par: Jingrui Yan, et autres
Publié: (2025)
Key-Gram: Extensible World Knowledge for Embodied Manipulation
par: Fan, Jingjing, et autres
Publié: (2026)
par: Fan, Jingjing, et autres
Publié: (2026)
Drivora: A Unified and Extensible Infrastructure for Search-based Autonomous Driving Testing
par: Cheng, Mingfei, et autres
Publié: (2026)
par: Cheng, Mingfei, et autres
Publié: (2026)
EasySteer: A Unified Framework for High-Performance and Extensible LLM Steering
par: Xu, Haolei, et autres
Publié: (2025)
par: Xu, Haolei, et autres
Publié: (2025)
ADAM: An Embodied Causal Agent in Open-World Environments
par: Yu, Shu, et autres
Publié: (2024)
par: Yu, Shu, et autres
Publié: (2024)
ProEx: A Unified Framework Leveraging Large Language Model with Profile Extrapolation for Recommendation
par: Zhang, Yi, et autres
Publié: (2025)
par: Zhang, Yi, et autres
Publié: (2025)
Compromising Embodied Agents with Contextual Backdoor Attacks
par: Liu, Aishan, et autres
Publié: (2024)
par: Liu, Aishan, et autres
Publié: (2024)
Uncertainty-Based Extensible Codebook for Discrete Federated Learning in Heterogeneous Data Silos
par: Zhang, Tianyi, et autres
Publié: (2024)
par: Zhang, Tianyi, et autres
Publié: (2024)
Jailbreak Large Vision-Language Models Through Multi-Modal Linkage
par: Wang, Yu, et autres
Publié: (2024)
par: Wang, Yu, et autres
Publié: (2024)
A Time-Domain Harmonic Balance Unified Gas-Kinetic Scheme for Temporally Periodic Flows Across all Knudsen Regimes
par: Zhu, Yuze, et autres
Publié: (2026)
par: Zhu, Yuze, et autres
Publié: (2026)
What Matters in Learning A Zero-Shot Sim-to-Real RL Policy for Quadrotor Control? A Comprehensive Study
par: Chen, Jiayu, et autres
Publié: (2024)
par: Chen, Jiayu, et autres
Publié: (2024)
Aixel: A Unified, Adaptive and Extensible System for AI-powered Data Analysis
par: Zhang, Meihui, et autres
Publié: (2025)
par: Zhang, Meihui, et autres
Publié: (2025)
Reinforced Reasoning for Embodied Planning
par: Wu, Di, et autres
Publié: (2025)
par: Wu, Di, et autres
Publié: (2025)
Adapting to Continuous Covariate Shift via Online Density Ratio Estimation
par: Zhang, Yu-Jie, et autres
Publié: (2023)
par: Zhang, Yu-Jie, et autres
Publié: (2023)
EmbodiedCity: A Benchmark Platform for Embodied Agent in Real-world City Environment
par: Gao, Chen, et autres
Publié: (2024)
par: Gao, Chen, et autres
Publié: (2024)
GTA-Net: An IoT-Integrated 3D Human Pose Estimation System for Real-Time Adolescent Sports Posture Correction
par: Yuan, Shizhe, et autres
Publié: (2024)
par: Yuan, Shizhe, et autres
Publié: (2024)
Farthest Point Sampling in Property Designated Chemical Feature Space as a General Strategy for Enhancing the Machine Learning Model Performance for Small Scale Chemical Dataset
par: Liu, Yuze, et autres
Publié: (2024)
par: Liu, Yuze, et autres
Publié: (2024)
When Agents Overtrust Environmental Evidence: An Extensible Agentic Framework for Benchmarking Evidence-Grounding Defects in LLM Agents
par: Sheng, Strick, et autres
Publié: (2026)
par: Sheng, Strick, et autres
Publié: (2026)
Online Linear Programming with Replenishment
par: Chen, Yuze, et autres
Publié: (2026)
par: Chen, Yuze, et autres
Publié: (2026)
DynaTrain: Fast Online Parallelism Switching for Elastic LLM Training
par: Wang, Yuanqing, et autres
Publié: (2026)
par: Wang, Yuanqing, et autres
Publié: (2026)
Building Open-Ended Embodied Agent via Language-Policy Bidirectional Adaptation
par: Zhai, Shaopeng, et autres
Publié: (2023)
par: Zhai, Shaopeng, et autres
Publié: (2023)
ArtiSG: Functional 3D Scene Graph Construction via Human-demonstrated Articulated Objects Manipulation
par: Gu, Qiuyi, et autres
Publié: (2025)
par: Gu, Qiuyi, et autres
Publié: (2025)
An Unforgeable Publicly Verifiable Watermark for Large Language Models
par: Liu, Aiwei, et autres
Publié: (2023)
par: Liu, Aiwei, et autres
Publié: (2023)
Multi-UAV Formation Control with Static and Dynamic Obstacle Avoidance via Reinforcement Learning
par: Xie, Yuqing, et autres
Publié: (2024)
par: Xie, Yuqing, et autres
Publié: (2024)
WideSeek-R1: Exploring Width Scaling for Broad Information Seeking via Multi-Agent Reinforcement Learning
par: Xu, Zelai, et autres
Publié: (2026)
par: Xu, Zelai, et autres
Publié: (2026)
Awesome-OL: An Extensible Toolkit for Online Learning
par: Liu, Zeyi, et autres
Publié: (2025)
par: Liu, Zeyi, et autres
Publié: (2025)
SmartAgent: Chain-of-User-Thought for Embodied Personalized Agent in Cyber World
par: Zhang, Jiaqi, et autres
Publié: (2024)
par: Zhang, Jiaqi, et autres
Publié: (2024)
MP5: A Multi-modal Open-ended Embodied System in Minecraft via Active Perception
par: Qin, Yiran, et autres
Publié: (2023)
par: Qin, Yiran, et autres
Publié: (2023)
Documents similaires
-
RLinf-VLA: A Unified and Efficient Framework for Reinforcement Learning of Vision-Language-Action Models
par: Zang, Hongzhi, et autres
Publié: (2025) -
RLinf: Flexible and Efficient Large-scale Reinforcement Learning via Macro-to-Micro Flow Transformation
par: Yu, Chao, et autres
Publié: (2025) -
WoVR: World Models as Reliable Simulators for Post-Training VLA Policies with RL
par: Jiang, Zhennan, et autres
Publié: (2026) -
$π_\texttt{RL}$: Online RL Fine-tuning for Flow-based Vision-Language-Action Models
par: Chen, Kang, et autres
Publié: (2025) -
Enabling Extensible Embodied Capabilities with Tools
par: Zhou, Xueyang, et autres
Publié: (2026)