RLinf-USER: A Unified and Extensible System for Real-World Online Policy Learning in Embodied AI
Fuente:
arXiv
Guardado en:
| Autores principales: | Zang, Hongzhi, Yu, Shu'ang, Lin, Hao, Zhou, Tianxing, Huang, Zefang, Guo, Zhen, Xu, Xin, Zhou, Jiakai, Sheng, Yuze, Zhang, Shizhe, Gao, Feng, Tang, Wenhao, Yue, Yufeng, Zhang, Quanlu, Chen, Xinlei, Yu, Chao, Wang, Yu |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
RLinf-VLA: A Unified and Efficient Framework for Reinforcement Learning of Vision-Language-Action Models
por: Zang, Hongzhi, et al.
Publicado: (2025)
por: Zang, Hongzhi, et al.
Publicado: (2025)
RLinf: Flexible and Efficient Large-scale Reinforcement Learning via Macro-to-Micro Flow Transformation
por: Yu, Chao, et al.
Publicado: (2025)
por: Yu, Chao, et al.
Publicado: (2025)
WoVR: World Models as Reliable Simulators for Post-Training VLA Policies with RL
por: Jiang, Zhennan, et al.
Publicado: (2026)
por: Jiang, Zhennan, et al.
Publicado: (2026)
$π_\texttt{RL}$: Online RL Fine-tuning for Flow-based Vision-Language-Action Models
por: Chen, Kang, et al.
Publicado: (2025)
por: Chen, Kang, et al.
Publicado: (2025)
Enabling Extensible Embodied Capabilities with Tools
por: Zhou, Xueyang, et al.
Publicado: (2026)
por: Zhou, Xueyang, et al.
Publicado: (2026)
Localization matters too: How localization error affects UAV flight
por: Zhang, Suquan, et al.
Publicado: (2024)
por: Zhang, Suquan, et al.
Publicado: (2024)
JuggleRL: Mastering Ball Juggling with a Quadrotor via Deep Reinforcement Learning
por: Ji, Shilong, et al.
Publicado: (2025)
por: Ji, Shilong, et al.
Publicado: (2025)
Multi-Robot System for Cooperative Exploration in Unknown Environments: A Survey
por: Wang, Chuqi, et al.
Publicado: (2025)
por: Wang, Chuqi, et al.
Publicado: (2025)
MCTS-EP: Empowering Embodied Planning with Online Preference Optimization
por: Xu, Hang, et al.
Publicado: (2025)
por: Xu, Hang, et al.
Publicado: (2025)
RoboScape-R: Unified Reward-Observation World Models for Generalizable Robotics Training via RL
por: Tang, Yinzhou, et al.
Publicado: (2025)
por: Tang, Yinzhou, et al.
Publicado: (2025)
LMFlow: An Extensible Toolkit for Finetuning and Inference of Large Foundation Models
por: Diao, Shizhe, et al.
Publicado: (2023)
por: Diao, Shizhe, et al.
Publicado: (2023)
SAC Flow: Sample-Efficient Reinforcement Learning of Flow-Based Policies via Velocity-Reparameterized Sequential Modeling
por: Zhang, Yixian, et al.
Publicado: (2025)
por: Zhang, Yixian, et al.
Publicado: (2025)
Cellular Senescence in Cancer: Mechanisms, Roles in Tumor Progression, and Therapeutic Implications
por: Jingrui Yan, et al.
Publicado: (2025)
por: Jingrui Yan, et al.
Publicado: (2025)
Key-Gram: Extensible World Knowledge for Embodied Manipulation
por: Fan, Jingjing, et al.
Publicado: (2026)
por: Fan, Jingjing, et al.
Publicado: (2026)
Drivora: A Unified and Extensible Infrastructure for Search-based Autonomous Driving Testing
por: Cheng, Mingfei, et al.
Publicado: (2026)
por: Cheng, Mingfei, et al.
Publicado: (2026)
EasySteer: A Unified Framework for High-Performance and Extensible LLM Steering
por: Xu, Haolei, et al.
Publicado: (2025)
por: Xu, Haolei, et al.
Publicado: (2025)
ADAM: An Embodied Causal Agent in Open-World Environments
por: Yu, Shu, et al.
Publicado: (2024)
por: Yu, Shu, et al.
Publicado: (2024)
ProEx: A Unified Framework Leveraging Large Language Model with Profile Extrapolation for Recommendation
por: Zhang, Yi, et al.
Publicado: (2025)
por: Zhang, Yi, et al.
Publicado: (2025)
Compromising Embodied Agents with Contextual Backdoor Attacks
por: Liu, Aishan, et al.
Publicado: (2024)
por: Liu, Aishan, et al.
Publicado: (2024)
Uncertainty-Based Extensible Codebook for Discrete Federated Learning in Heterogeneous Data Silos
por: Zhang, Tianyi, et al.
Publicado: (2024)
por: Zhang, Tianyi, et al.
Publicado: (2024)
Jailbreak Large Vision-Language Models Through Multi-Modal Linkage
por: Wang, Yu, et al.
Publicado: (2024)
por: Wang, Yu, et al.
Publicado: (2024)
A Time-Domain Harmonic Balance Unified Gas-Kinetic Scheme for Temporally Periodic Flows Across all Knudsen Regimes
por: Zhu, Yuze, et al.
Publicado: (2026)
por: Zhu, Yuze, et al.
Publicado: (2026)
What Matters in Learning A Zero-Shot Sim-to-Real RL Policy for Quadrotor Control? A Comprehensive Study
por: Chen, Jiayu, et al.
Publicado: (2024)
por: Chen, Jiayu, et al.
Publicado: (2024)
Aixel: A Unified, Adaptive and Extensible System for AI-powered Data Analysis
por: Zhang, Meihui, et al.
Publicado: (2025)
por: Zhang, Meihui, et al.
Publicado: (2025)
Reinforced Reasoning for Embodied Planning
por: Wu, Di, et al.
Publicado: (2025)
por: Wu, Di, et al.
Publicado: (2025)
Adapting to Continuous Covariate Shift via Online Density Ratio Estimation
por: Zhang, Yu-Jie, et al.
Publicado: (2023)
por: Zhang, Yu-Jie, et al.
Publicado: (2023)
EmbodiedCity: A Benchmark Platform for Embodied Agent in Real-world City Environment
por: Gao, Chen, et al.
Publicado: (2024)
por: Gao, Chen, et al.
Publicado: (2024)
GTA-Net: An IoT-Integrated 3D Human Pose Estimation System for Real-Time Adolescent Sports Posture Correction
por: Yuan, Shizhe, et al.
Publicado: (2024)
por: Yuan, Shizhe, et al.
Publicado: (2024)
Farthest Point Sampling in Property Designated Chemical Feature Space as a General Strategy for Enhancing the Machine Learning Model Performance for Small Scale Chemical Dataset
por: Liu, Yuze, et al.
Publicado: (2024)
por: Liu, Yuze, et al.
Publicado: (2024)
When Agents Overtrust Environmental Evidence: An Extensible Agentic Framework for Benchmarking Evidence-Grounding Defects in LLM Agents
por: Sheng, Strick, et al.
Publicado: (2026)
por: Sheng, Strick, et al.
Publicado: (2026)
Online Linear Programming with Replenishment
por: Chen, Yuze, et al.
Publicado: (2026)
por: Chen, Yuze, et al.
Publicado: (2026)
DynaTrain: Fast Online Parallelism Switching for Elastic LLM Training
por: Wang, Yuanqing, et al.
Publicado: (2026)
por: Wang, Yuanqing, et al.
Publicado: (2026)
Building Open-Ended Embodied Agent via Language-Policy Bidirectional Adaptation
por: Zhai, Shaopeng, et al.
Publicado: (2023)
por: Zhai, Shaopeng, et al.
Publicado: (2023)
ArtiSG: Functional 3D Scene Graph Construction via Human-demonstrated Articulated Objects Manipulation
por: Gu, Qiuyi, et al.
Publicado: (2025)
por: Gu, Qiuyi, et al.
Publicado: (2025)
An Unforgeable Publicly Verifiable Watermark for Large Language Models
por: Liu, Aiwei, et al.
Publicado: (2023)
por: Liu, Aiwei, et al.
Publicado: (2023)
Multi-UAV Formation Control with Static and Dynamic Obstacle Avoidance via Reinforcement Learning
por: Xie, Yuqing, et al.
Publicado: (2024)
por: Xie, Yuqing, et al.
Publicado: (2024)
WideSeek-R1: Exploring Width Scaling for Broad Information Seeking via Multi-Agent Reinforcement Learning
por: Xu, Zelai, et al.
Publicado: (2026)
por: Xu, Zelai, et al.
Publicado: (2026)
Awesome-OL: An Extensible Toolkit for Online Learning
por: Liu, Zeyi, et al.
Publicado: (2025)
por: Liu, Zeyi, et al.
Publicado: (2025)
SmartAgent: Chain-of-User-Thought for Embodied Personalized Agent in Cyber World
por: Zhang, Jiaqi, et al.
Publicado: (2024)
por: Zhang, Jiaqi, et al.
Publicado: (2024)
MP5: A Multi-modal Open-ended Embodied System in Minecraft via Active Perception
por: Qin, Yiran, et al.
Publicado: (2023)
por: Qin, Yiran, et al.
Publicado: (2023)
Ejemplares similares
-
RLinf-VLA: A Unified and Efficient Framework for Reinforcement Learning of Vision-Language-Action Models
por: Zang, Hongzhi, et al.
Publicado: (2025) -
RLinf: Flexible and Efficient Large-scale Reinforcement Learning via Macro-to-Micro Flow Transformation
por: Yu, Chao, et al.
Publicado: (2025) -
WoVR: World Models as Reliable Simulators for Post-Training VLA Policies with RL
por: Jiang, Zhennan, et al.
Publicado: (2026) -
$π_\texttt{RL}$: Online RL Fine-tuning for Flow-based Vision-Language-Action Models
por: Chen, Kang, et al.
Publicado: (2025) -
Enabling Extensible Embodied Capabilities with Tools
por: Zhou, Xueyang, et al.
Publicado: (2026)