LabUtopia: High-Fidelity Simulation and Hierarchical Benchmark for Scientific Embodied Agents
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Rui, Hu, Zixuan, Qu, Wenxi, Zhang, Jinouwen, Yin, Zhenfei, Zhang, Sha, Huang, Xuantuo, Wang, Hanqing, Wang, Tai, Pang, Jiangmiao, Ouyang, Wanli, Bai, Lei, Zuo, Wangmeng, Duan, Ling-Yu, Zhou, Dongzhan, Tang, Shixiang |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Position: Intelligent Science Laboratory Requires the Integration of Cognitive and Embodied AI
par: Zhang, Sha, et autres
Publié: (2025)
par: Zhang, Sha, et autres
Publié: (2025)
Charting Empirical Laws for LLM Fine-Tuning in Scientific Multi-Discipline Learning
par: Wang, Lintao, et autres
Publié: (2026)
par: Wang, Lintao, et autres
Publié: (2026)
Language-to-Space Programming for Training-Free 3D Visual Grounding
par: Mi, Boyu, et autres
Publié: (2025)
par: Mi, Boyu, et autres
Publié: (2025)
Rethinking the Embodied Gap in Vision-and-Language Navigation: A Holistic Study of Physical and Visual Disparities
par: Wang, Liuyi, et autres
Publié: (2025)
par: Wang, Liuyi, et autres
Publié: (2025)
OVExp: Open Vocabulary Exploration for Object-Oriented Navigation
par: Wei, Meng, et autres
Publié: (2024)
par: Wei, Meng, et autres
Publié: (2024)
LabBuilder: Protocol-Grounded 3D Layout Generation for Interactable and Safe Laboratory
par: Cao, Jianbao, et autres
Publié: (2026)
par: Cao, Jianbao, et autres
Publié: (2026)
ResearchBench: Benchmarking LLMs in Scientific Discovery via Inspiration-Based Task Decomposition
par: Liu, Yujie, et autres
Publié: (2025)
par: Liu, Yujie, et autres
Publié: (2025)
SciIF: Benchmarking Scientific Instruction Following Towards Rigorous Scientific Intelligence
par: Su, Encheng, et autres
Publié: (2026)
par: Su, Encheng, et autres
Publié: (2026)
CoEnv: Driving Embodied Multi-Agent Collaboration via Compositional Environment
par: Kang, Li, et autres
Publié: (2026)
par: Kang, Li, et autres
Publié: (2026)
CMT: A Cascade MAR with Topology Predictor for Multimodal Conditional CAD Generation
par: Wu, Jianyu, et autres
Publié: (2025)
par: Wu, Jianyu, et autres
Publié: (2025)
Agent3D-Zero: An Agent for Zero-shot 3D Understanding
par: Zhang, Sha, et autres
Publié: (2024)
par: Zhang, Sha, et autres
Publié: (2024)
FuncGenFoil: Airfoil Generation and Editing Model in Function Space
par: Zhang, Jinouwen, et autres
Publié: (2025)
par: Zhang, Jinouwen, et autres
Publié: (2025)
Accessing GPT-4 level Mathematical Olympiad Solutions via Monte Carlo Tree Self-refine with LLaMa-3 8B
par: Zhang, Di, et autres
Publié: (2024)
par: Zhang, Di, et autres
Publié: (2024)
MOOSE-Chem2: Exploring LLM Limits in Fine-Grained Scientific Hypothesis Discovery via Hierarchical Search
par: Yang, Zonglin, et autres
Publié: (2025)
par: Yang, Zonglin, et autres
Publié: (2025)
LLaVA-3D: A Simple yet Effective Pathway to Empowering LMMs with 3D-awareness
par: Zhu, Chenming, et autres
Publié: (2024)
par: Zhu, Chenming, et autres
Publié: (2024)
Towards Latency-Aware 3D Streaming Perception for Autonomous Driving
par: Peng, Jiaqi, et autres
Publié: (2025)
par: Peng, Jiaqi, et autres
Publié: (2025)
NavDP: Learning Sim-to-Real Navigation Diffusion Policy with Privileged Information Guidance
par: Cai, Wenzhe, et autres
Publié: (2025)
par: Cai, Wenzhe, et autres
Publié: (2025)
Solving all laminar flows around airfoils all-at-once using a parametric neural network solver
par: Cao, Wenbo, et autres
Publié: (2025)
par: Cao, Wenbo, et autres
Publié: (2025)
Multi-Object Tracking by Hierarchical Visual Representations
par: Cao, Jinkun, et autres
Publié: (2024)
par: Cao, Jinkun, et autres
Publié: (2024)
A CLIP-Powered Framework for Robust and Generalizable Data Selection
par: Yang, Suorong, et autres
Publié: (2024)
par: Yang, Suorong, et autres
Publié: (2024)
Many Heads Are Better Than One: Improved Scientific Idea Generation by A LLM-Based Multi-Agent System
par: Su, Haoyang, et autres
Publié: (2024)
par: Su, Haoyang, et autres
Publié: (2024)
A Comprehensive Survey on 3D Content Generation
par: Liu, Jian, et autres
Publié: (2024)
par: Liu, Jian, et autres
Publié: (2024)
Nimbus: A Unified Embodied Synthetic Data Generation Framework
par: He, Zeyu, et autres
Publié: (2026)
par: He, Zeyu, et autres
Publié: (2026)
VL-LN Bench: Towards Long-horizon Goal-oriented Navigation with Active Dialogs
par: Huang, Wensi, et autres
Publié: (2025)
par: Huang, Wensi, et autres
Publié: (2025)
MOOSE-Chem: Large Language Models for Rediscovering Unseen Chemistry Scientific Hypotheses
par: Yang, Zonglin, et autres
Publié: (2024)
par: Yang, Zonglin, et autres
Publié: (2024)
GenNBV: Generalizable Next-Best-View Policy for Active 3D Reconstruction
par: Chen, Xiao, et autres
Publié: (2024)
par: Chen, Xiao, et autres
Publié: (2024)
Owl-AuraID 1.0: An Intelligent System for Autonomous Scientific Instrumentation and Scientific Data Analysis
par: Deng, Han, et autres
Publié: (2026)
par: Deng, Han, et autres
Publié: (2026)
Tac2Real: Reliable and GPU Visuotactile Simulation for Online Reinforcement Learning and Zero-Shot Real-World Deployment
par: Yan, Ningyu, et autres
Publié: (2026)
par: Yan, Ningyu, et autres
Publié: (2026)
NeuRodin: A Two-stage Framework for High-Fidelity Neural Surface Reconstruction
par: Wang, Yifan, et autres
Publié: (2024)
par: Wang, Yifan, et autres
Publié: (2024)
Self-Supervised Learning for Real-World Super-Resolution from Dual and Multiple Zoomed Observations
par: Zhang, Zhilu, et autres
Publié: (2024)
par: Zhang, Zhilu, et autres
Publié: (2024)
ReCrit: Transition-Aware Reinforcement Learning for Scientific Critic Reasoning
par: Xu, Wanghan, et autres
Publié: (2026)
par: Xu, Wanghan, et autres
Publié: (2026)
InstructVLA: Vision-Language-Action Instruction Tuning from Understanding to Manipulation
par: Yang, Shuai, et autres
Publié: (2025)
par: Yang, Shuai, et autres
Publié: (2025)
HiVLA: A Visual-Grounded-Centric Hierarchical Embodied Manipulation System
par: Yang, Tianshuo, et autres
Publié: (2026)
par: Yang, Tianshuo, et autres
Publié: (2026)
MLLM-based Discovery of Intrinsic Coordinates and Governing Equations from High-Dimensional Data
par: Li, Ruikun, et autres
Publié: (2025)
par: Li, Ruikun, et autres
Publié: (2025)
CPRet: A Dataset, Benchmark, and Model for Retrieval in Competitive Programming
par: Deng, Han, et autres
Publié: (2025)
par: Deng, Han, et autres
Publié: (2025)
Iterative Pretraining Framework for Interatomic Potentials
par: Cui, Taoyong, et autres
Publié: (2025)
par: Cui, Taoyong, et autres
Publié: (2025)
PointLLM: Empowering Large Language Models to Understand Point Clouds
par: Xu, Runsen, et autres
Publié: (2023)
par: Xu, Runsen, et autres
Publié: (2023)
GENMANIP: LLM-driven Simulation for Generalizable Instruction-Following Manipulation
par: Gao, Ning, et autres
Publié: (2025)
par: Gao, Ning, et autres
Publié: (2025)
AI-Driven Automation Can Become the Foundation of Next-Era Science of Science Research
par: Chen, Renqi, et autres
Publié: (2025)
par: Chen, Renqi, et autres
Publié: (2025)
VLNVerse: A Benchmark for Vision-Language Navigation with Versatile, Embodied, Realistic Simulation and Evaluation
par: Lin, Sihao, et autres
Publié: (2025)
par: Lin, Sihao, et autres
Publié: (2025)
Documents similaires
-
Position: Intelligent Science Laboratory Requires the Integration of Cognitive and Embodied AI
par: Zhang, Sha, et autres
Publié: (2025) -
Charting Empirical Laws for LLM Fine-Tuning in Scientific Multi-Discipline Learning
par: Wang, Lintao, et autres
Publié: (2026) -
Language-to-Space Programming for Training-Free 3D Visual Grounding
par: Mi, Boyu, et autres
Publié: (2025) -
Rethinking the Embodied Gap in Vision-and-Language Navigation: A Holistic Study of Physical and Visual Disparities
par: Wang, Liuyi, et autres
Publié: (2025) -
OVExp: Open Vocabulary Exploration for Object-Oriented Navigation
par: Wei, Meng, et autres
Publié: (2024)