RoboOS-NeXT: A Unified Memory-based Framework for Lifelong, Scalable, and Robust Multi-Robot Collaboration
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Tan, Huajie, Chi, Cheng, Chen, Xiansheng, Ji, Yuheng, Zhao, Zhongxia, Hao, Xiaoshuai, Lyu, Yaoxu, Cao, Mingyu, Zhao, Junkai, Lyu, Huaihai, Zhou, Enshen, Chen, Ning, Fu, Yankai, Peng, Cheng, Guo, Wei, Liang, Dong, Chen, Zhuo, Lyu, Mengsi, He, Chenrui, Ao, Yulong, Lin, Yonghua, Wang, Pengwei, Wang, Zhongyuan, Zhang, Shanghang |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
RoboOS: A Hierarchical Embodied Framework for Cross-Embodiment and Multi-Agent Collaboration
von: Tan, Huajie, et al.
Veröffentlicht: (2025)
von: Tan, Huajie, et al.
Veröffentlicht: (2025)
Robo-Dopamine: General Process Reward Modeling for High-Precision Robotic Manipulation
von: Tan, Huajie, et al.
Veröffentlicht: (2025)
von: Tan, Huajie, et al.
Veröffentlicht: (2025)
MathSticks: A Benchmark for Visual Symbolic Compositional Reasoning with Matchstick Puzzles
von: Ji, Yuheng, et al.
Veröffentlicht: (2025)
von: Ji, Yuheng, et al.
Veröffentlicht: (2025)
Reason-RFT: Reinforcement Fine-Tuning for Visual Reasoning of Vision Language Models
von: Tan, Huajie, et al.
Veröffentlicht: (2025)
von: Tan, Huajie, et al.
Veröffentlicht: (2025)
OmniSAT: Compact Action Token, Faster Auto Regression
von: Lyu, Huaihai, et al.
Veröffentlicht: (2025)
von: Lyu, Huaihai, et al.
Veröffentlicht: (2025)
NeXT-IMDL: Build Benchmark for NeXT-Generation Image Manipulation Detection & Localization
von: Li, Yifei, et al.
Veröffentlicht: (2025)
von: Li, Yifei, et al.
Veröffentlicht: (2025)
RoboBrain 2.0 Technical Report
von: BAAI RoboBrain Team, et al.
Veröffentlicht: (2025)
von: BAAI RoboBrain Team, et al.
Veröffentlicht: (2025)
RoboBrain: A Unified Brain Model for Robotic Manipulation from Abstract to Concrete
von: Ji, Yuheng, et al.
Veröffentlicht: (2025)
von: Ji, Yuheng, et al.
Veröffentlicht: (2025)
Action-Sketcher: From Reasoning to Action via Visual Sketches for Long-Horizon Robotic Manipulation
von: Tan, Huajie, et al.
Veröffentlicht: (2026)
von: Tan, Huajie, et al.
Veröffentlicht: (2026)
RoboBrain 2.5: Depth in Sight, Time in Mind
von: Tan, Huajie, et al.
Veröffentlicht: (2026)
von: Tan, Huajie, et al.
Veröffentlicht: (2026)
TrimTokenator: Towards Adaptive Visual Token Pruning for Large Multimodal Models
von: Zhang, Hao, et al.
Veröffentlicht: (2025)
von: Zhang, Hao, et al.
Veröffentlicht: (2025)
EgoPrompt: Prompt Learning for Egocentric Action Recognition
von: Lyu, Huaihai, et al.
Veröffentlicht: (2025)
von: Lyu, Huaihai, et al.
Veröffentlicht: (2025)
Desktop Video: Multi-Media on the NeXT Computer.
von: Stammen, Ronald M., et al.
Veröffentlicht: (1992)
von: Stammen, Ronald M., et al.
Veröffentlicht: (1992)
PRM-as-a-Judge: A Dense Evaluation Paradigm for Fine-Grained Robotic Auditing
von: Ji, Yuheng, et al.
Veröffentlicht: (2026)
von: Ji, Yuheng, et al.
Veröffentlicht: (2026)
RoboTracer: Mastering Spatial Trace with Reasoning in Vision-Language Models for Robotics
von: Zhou, Enshen, et al.
Veröffentlicht: (2025)
von: Zhou, Enshen, et al.
Veröffentlicht: (2025)
METIS: Multi-Source Egocentric Training for Integrated Dexterous Vision-Language-Action Model
von: Fu, Yankai, et al.
Veröffentlicht: (2025)
von: Fu, Yankai, et al.
Veröffentlicht: (2025)
RoboRefer: Towards Spatial Referring with Reasoning in Vision-Language Models for Robotics
von: Zhou, Enshen, et al.
Veröffentlicht: (2025)
von: Zhou, Enshen, et al.
Veröffentlicht: (2025)
General Covariant Action Modeling: Constructing Generalized Manifolds via Spatio-Temporal Decoupling
von: Lyu, Huaihai, et al.
Veröffentlicht: (2026)
von: Lyu, Huaihai, et al.
Veröffentlicht: (2026)
VisualTrans: A Benchmark for Real-World Visual Transformation Reasoning
von: Ji, Yuheng, et al.
Veröffentlicht: (2025)
von: Ji, Yuheng, et al.
Veröffentlicht: (2025)
PDTrim: Targeted Pruning for Prefill-Decode Disaggregation in Inference
von: Zhang, Hao, et al.
Veröffentlicht: (2025)
von: Zhang, Hao, et al.
Veröffentlicht: (2025)
SaPaVe: Towards Active Perception and Manipulation in Vision-Language-Action Models for Robotics
von: Liu, Mengzhen, et al.
Veröffentlicht: (2026)
von: Liu, Mengzhen, et al.
Veröffentlicht: (2026)
TrimTokenator-LC: Towards Adaptive Visual Token Pruning for Large Multimodal Models with Long Contexts
von: Zhang, Hao, et al.
Veröffentlicht: (2025)
von: Zhang, Hao, et al.
Veröffentlicht: (2025)
URDF-Anything+: End-to-End Generation for Simulation-Ready Articulated Assets
von: Wu, Zhuangzhe, et al.
Veröffentlicht: (2026)
von: Wu, Zhuangzhe, et al.
Veröffentlicht: (2026)
H2R: A Human-to-Robot Data Augmentation for Robot Pre-training from Videos
von: Li, Guangrun, et al.
Veröffentlicht: (2025)
von: Li, Guangrun, et al.
Veröffentlicht: (2025)
TIGeR: Tool-Integrated Geometric Reasoning in Vision-Language Models for Robotics
von: Han, Yi, et al.
Veröffentlicht: (2025)
von: Han, Yi, et al.
Veröffentlicht: (2025)
Reshaping Action Error Distributions for Reliable Vision-Language-Action Models
von: Bai, Shuanghao, et al.
Veröffentlicht: (2026)
von: Bai, Shuanghao, et al.
Veröffentlicht: (2026)
Degree-heterogeneous Latent Class Analysis for High-dimensional Discrete Data
von: Lyu, Zhongyuan, et al.
Veröffentlicht: (2024)
von: Lyu, Zhongyuan, et al.
Veröffentlicht: (2024)
LLaVA-NeXT-Interleave: Tackling Multi-image, Video, and 3D in Large Multimodal Models
von: Li, Feng, et al.
Veröffentlicht: (2024)
von: Li, Feng, et al.
Veröffentlicht: (2024)
RoboMirror: Understand Before You Imitate for Video to Humanoid Locomotion
von: Li, Zhe, et al.
Veröffentlicht: (2025)
von: Li, Zhe, et al.
Veröffentlicht: (2025)
Latent Reasoning VLA: Latent Thinking and Prediction for Vision-Language-Action Models
von: Bai, Shuanghao, et al.
Veröffentlicht: (2026)
von: Bai, Shuanghao, et al.
Veröffentlicht: (2026)
Large-dimensional Factor Analysis with Weighted PCA
von: Lyu, Zhongyuan, et al.
Veröffentlicht: (2025)
von: Lyu, Zhongyuan, et al.
Veröffentlicht: (2025)
HeteroJIVE: Joint Subspace Estimation for Heterogeneous Multi-View Data
von: Li, Jingyang, et al.
Veröffentlicht: (2025)
von: Li, Jingyang, et al.
Veröffentlicht: (2025)
Spectral Clustering with Likelihood Refinement for High-dimensional Latent Class Recovery
von: Lyu, Zhongyuan, et al.
Veröffentlicht: (2025)
von: Lyu, Zhongyuan, et al.
Veröffentlicht: (2025)
A Cataloger's Workstation: Using a NeXT Computer and Digital Librarian Software to Access the "Anglo-American Cataloguing Rules."
von: Gomez, Joni
Veröffentlicht: (1993)
von: Gomez, Joni
Veröffentlicht: (1993)
AffordGrasp: In-Context Affordance Reasoning for Open-Vocabulary Task-Oriented Grasping in Clutter
von: Tang, Yingbo, et al.
Veröffentlicht: (2025)
von: Tang, Yingbo, et al.
Veröffentlicht: (2025)
Learnable Similarity and Dissimilarity Guided Symmetric Non-Negative Matrix Factorization
von: Lyu, Wenlong, et al.
Veröffentlicht: (2024)
von: Lyu, Wenlong, et al.
Veröffentlicht: (2024)
RoboHanger: Learning Generalizable Robotic Hanger Insertion for Diverse Garments
von: Chen, Yuxing, et al.
Veröffentlicht: (2024)
von: Chen, Yuxing, et al.
Veröffentlicht: (2024)
Refine and Purify: Orthogonal Basis Optimization with Null-Space Denoising for Conditional Representation Learning
von: Wang, Jiaquan, et al.
Veröffentlicht: (2026)
von: Wang, Jiaquan, et al.
Veröffentlicht: (2026)
Mask World Model: Predicting What Matters for Robust Robot Policy Learning
von: Lou, Yunfan, et al.
Veröffentlicht: (2026)
von: Lou, Yunfan, et al.
Veröffentlicht: (2026)
Video-CoT: A Comprehensive Dataset for Spatiotemporal Understanding of Videos Based on Chain-of-Thought
von: Zhang, Shuyi, et al.
Veröffentlicht: (2025)
von: Zhang, Shuyi, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
RoboOS: A Hierarchical Embodied Framework for Cross-Embodiment and Multi-Agent Collaboration
von: Tan, Huajie, et al.
Veröffentlicht: (2025) -
Robo-Dopamine: General Process Reward Modeling for High-Precision Robotic Manipulation
von: Tan, Huajie, et al.
Veröffentlicht: (2025) -
MathSticks: A Benchmark for Visual Symbolic Compositional Reasoning with Matchstick Puzzles
von: Ji, Yuheng, et al.
Veröffentlicht: (2025) -
Reason-RFT: Reinforcement Fine-Tuning for Visual Reasoning of Vision Language Models
von: Tan, Huajie, et al.
Veröffentlicht: (2025) -
OmniSAT: Compact Action Token, Faster Auto Regression
von: Lyu, Huaihai, et al.
Veröffentlicht: (2025)