LEGENT: Open Platform for Embodied Agents
Fuente:
arXiv
Guardado en:
| Autores principales: | Cheng, Zhili, Wang, Zhitong, Hu, Jinyi, Hu, Shengding, Liu, An, Tu, Yuge, Li, Pengkai, Shi, Lei, Liu, Zhiyuan, Sun, Maosong |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
EmbodiedEval: Evaluate Multimodal LLMs as Embodied Agents
por: Cheng, Zhili, et al.
Publicado: (2025)
por: Cheng, Zhili, et al.
Publicado: (2025)
MiMo-Embodied: X-Embodied Foundation Model Technical Report
por: Hao, Xiaoshuai, et al.
Publicado: (2025)
por: Hao, Xiaoshuai, et al.
Publicado: (2025)
World Action Models: The Next Frontier in Embodied AI
por: Wang, Siyin, et al.
Publicado: (2026)
por: Wang, Siyin, et al.
Publicado: (2026)
IS-Bench: Evaluating Interactive Safety of VLM-Driven Embodied Agents in Daily Household Tasks
por: Lu, Xiaoya, et al.
Publicado: (2025)
por: Lu, Xiaoya, et al.
Publicado: (2025)
States Hidden in Hidden States: LLMs Emerge Discrete State Representations Implicitly
por: Chen, Junhao, et al.
Publicado: (2024)
por: Chen, Junhao, et al.
Publicado: (2024)
Embodied Agents for Efficient Exploration and Smart Scene Description
por: Bigazzi, Roberto, et al.
Publicado: (2023)
por: Bigazzi, Roberto, et al.
Publicado: (2023)
DecisionNCE: Embodied Multimodal Representations via Implicit Preference Learning
por: Li, Jianxiong, et al.
Publicado: (2024)
por: Li, Jianxiong, et al.
Publicado: (2024)
Embodied Web Agents: Bridging Physical-Digital Realms for Integrated Agent Intelligence
por: Hong, Yining, et al.
Publicado: (2025)
por: Hong, Yining, et al.
Publicado: (2025)
ACDiT: Interpolating Autoregressive Conditional Modeling and Diffusion Transformer
por: Hu, Jinyi, et al.
Publicado: (2024)
por: Hu, Jinyi, et al.
Publicado: (2024)
World Modeling Makes a Better Planner: Dual Preference Optimization for Embodied Task Planning
por: Wang, Siyin, et al.
Publicado: (2025)
por: Wang, Siyin, et al.
Publicado: (2025)
Building Cooperative Embodied Agents Modularly with Large Language Models
por: Zhang, Hongxin, et al.
Publicado: (2023)
por: Zhang, Hongxin, et al.
Publicado: (2023)
JARVIS: A Neuro-Symbolic Commonsense Reasoning Framework for Conversational Embodied Agents
por: Zheng, Kaizhi, et al.
Publicado: (2022)
por: Zheng, Kaizhi, et al.
Publicado: (2022)
AgentThink: A Unified Framework for Tool-Augmented Chain-of-Thought Reasoning in Vision-Language Models for Autonomous Driving
por: Qian, Kangan, et al.
Publicado: (2025)
por: Qian, Kangan, et al.
Publicado: (2025)
Virtual Community: An Open World for Humans, Robots, and Society
por: Zhou, Qinhong, et al.
Publicado: (2025)
por: Zhou, Qinhong, et al.
Publicado: (2025)
Affordance RAG: Hierarchical Multimodal Retrieval with Affordance-Aware Embodied Memory for Mobile Manipulation
por: Korekata, Ryosuke, et al.
Publicado: (2025)
por: Korekata, Ryosuke, et al.
Publicado: (2025)
Holodeck: Language Guided Generation of 3D Embodied AI Environments
por: Yang, Yue, et al.
Publicado: (2023)
por: Yang, Yue, et al.
Publicado: (2023)
Multi-Modal Multi-Granularity Tokenizer for Chu Bamboo Slip Scripts
por: Chen, Yingfa, et al.
Publicado: (2024)
por: Chen, Yingfa, et al.
Publicado: (2024)
Beyond Description: Cognitively Benchmarking Fine-Grained Action for Embodied Agents
por: Liu, Dayong, et al.
Publicado: (2025)
por: Liu, Dayong, et al.
Publicado: (2025)
ENACT: Evaluating Embodied Cognition with World Modeling of Egocentric Interaction
por: Wang, Qineng, et al.
Publicado: (2025)
por: Wang, Qineng, et al.
Publicado: (2025)
OceanGym: A Benchmark Environment for Underwater Embodied Agents
por: Xue, Yida, et al.
Publicado: (2025)
por: Xue, Yida, et al.
Publicado: (2025)
Can-Do! A Dataset and Neuro-Symbolic Grounded Framework for Embodied Planning with Large Multimodal Models
por: Chia, Yew Ken, et al.
Publicado: (2024)
por: Chia, Yew Ken, et al.
Publicado: (2024)
Rethinking the Embodied Gap in Vision-and-Language Navigation: A Holistic Study of Physical and Visual Disparities
por: Wang, Liuyi, et al.
Publicado: (2025)
por: Wang, Liuyi, et al.
Publicado: (2025)
Teaching Embodied Reinforcement Learning Agents: Informativeness and Diversity of Language Use
por: Xi, Jiajun, et al.
Publicado: (2024)
por: Xi, Jiajun, et al.
Publicado: (2024)
RLHF-V: Towards Trustworthy MLLMs via Behavior Alignment from Fine-grained Correctional Human Feedback
por: Yu, Tianyu, et al.
Publicado: (2023)
por: Yu, Tianyu, et al.
Publicado: (2023)
Embodied Domain Adaptation for Object Detection
por: Shi, Xiangyu, et al.
Publicado: (2025)
por: Shi, Xiangyu, et al.
Publicado: (2025)
GraphEQA: Using 3D Semantic Scene Graphs for Real-time Embodied Question Answering
por: Saxena, Saumya, et al.
Publicado: (2024)
por: Saxena, Saumya, et al.
Publicado: (2024)
VisRAG 2.0: Evidence-Guided Multi-Image Reasoning in Visual Retrieval-Augmented Generation
por: Sun, Yubo, et al.
Publicado: (2025)
por: Sun, Yubo, et al.
Publicado: (2025)
Emma-X: An Embodied Multimodal Action Model with Grounded Chain of Thought and Look-ahead Spatial Reasoning
por: Sun, Qi, et al.
Publicado: (2024)
por: Sun, Qi, et al.
Publicado: (2024)
AutoRT: Embodied Foundation Models for Large Scale Orchestration of Robotic Agents
por: Ahn, Michael, et al.
Publicado: (2024)
por: Ahn, Michael, et al.
Publicado: (2024)
Wanderland: Geometrically Grounded Simulation for Open-World Embodied AI
por: Liu, Xinhao, et al.
Publicado: (2025)
por: Liu, Xinhao, et al.
Publicado: (2025)
RoboView-Bias: Benchmarking Visual Bias in Embodied Agents for Robotic Manipulation
por: Liu, Enguang, et al.
Publicado: (2025)
por: Liu, Enguang, et al.
Publicado: (2025)
NavAgent: Multi-scale Urban Street View Fusion For UAV Embodied Vision-and-Language Navigation
por: Liu, Youzhi, et al.
Publicado: (2024)
por: Liu, Youzhi, et al.
Publicado: (2024)
OmniEVA: Embodied Versatile Planner via Task-Adaptive 3D-Grounded and Embodiment-aware Reasoning
por: Liu, Yuecheng, et al.
Publicado: (2025)
por: Liu, Yuecheng, et al.
Publicado: (2025)
GUICourse: From General Vision Language Models to Versatile GUI Agents
por: Chen, Wentong, et al.
Publicado: (2024)
por: Chen, Wentong, et al.
Publicado: (2024)
WorldArena 2.0: Extending Embodied World Model Benchmarking on Modality, Functionality and Platform
por: Shang, Yu, et al.
Publicado: (2026)
por: Shang, Yu, et al.
Publicado: (2026)
The Safety Challenge of World Models for Embodied AI Agents: A Review
por: Baraldi, Lorenzo, et al.
Publicado: (2025)
por: Baraldi, Lorenzo, et al.
Publicado: (2025)
ROVER: Recursive Reasoning Over Videos with Vision-Language Models for Embodied Tasks
por: Schroeder, Philip, et al.
Publicado: (2025)
por: Schroeder, Philip, et al.
Publicado: (2025)
Open-Vocabulary Mobile Manipulation Based on Double Relaxed Contrastive Learning with Dense Labeling
por: Yashima, Daichi, et al.
Publicado: (2024)
por: Yashima, Daichi, et al.
Publicado: (2024)
BrainMem: Brain-Inspired Evolving Memory for Embodied Agent Task Planning
por: Ma, Xiaoyu, et al.
Publicado: (2026)
por: Ma, Xiaoyu, et al.
Publicado: (2026)
DivScene: Towards Open-Vocabulary Object Navigation with Large Vision Language Models in Diverse Scenes
por: Wang, Zhaowei, et al.
Publicado: (2024)
por: Wang, Zhaowei, et al.
Publicado: (2024)
Ejemplares similares
-
EmbodiedEval: Evaluate Multimodal LLMs as Embodied Agents
por: Cheng, Zhili, et al.
Publicado: (2025) -
MiMo-Embodied: X-Embodied Foundation Model Technical Report
por: Hao, Xiaoshuai, et al.
Publicado: (2025) -
World Action Models: The Next Frontier in Embodied AI
por: Wang, Siyin, et al.
Publicado: (2026) -
IS-Bench: Evaluating Interactive Safety of VLM-Driven Embodied Agents in Daily Household Tasks
por: Lu, Xiaoya, et al.
Publicado: (2025) -
States Hidden in Hidden States: LLMs Emerge Discrete State Representations Implicitly
por: Chen, Junhao, et al.
Publicado: (2024)