Building Cooperative Embodied Agents Modularly with Large Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhang, Hongxin, Du, Weihua, Shan, Jiaming, Zhou, Qinhong, Du, Yilun, Tenenbaum, Joshua B., Shu, Tianmin, Gan, Chuang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
HAZARD Challenge: Embodied Decision Making in Dynamically Changing Environments
por: Zhou, Qinhong, et al.
Publicado: (2024)
por: Zhou, Qinhong, et al.
Publicado: (2024)
Constrained Human-AI Cooperation: An Inclusive Embodied Social Intelligence Challenge
por: Du, Weihua, et al.
Publicado: (2024)
por: Du, Weihua, et al.
Publicado: (2024)
Ella: Embodied Social Agents with Lifelong Memory
por: Zhang, Hongxin, et al.
Publicado: (2025)
por: Zhang, Hongxin, et al.
Publicado: (2025)
TesserAct: Learning 4D Embodied World Models
por: Zhen, Haoyu, et al.
Publicado: (2025)
por: Zhen, Haoyu, et al.
Publicado: (2025)
3D-Mem: 3D Scene Memory for Embodied Exploration and Reasoning
por: Yang, Yuncong, et al.
Publicado: (2024)
por: Yang, Yuncong, et al.
Publicado: (2024)
COMBO: Compositional World Models for Embodied Multi-Agent Cooperation
por: Zhang, Hongxin, et al.
Publicado: (2024)
por: Zhang, Hongxin, et al.
Publicado: (2024)
Sentinel: Embodied Cooperative Spatial Reasoning and Planning
por: Lin, Xiangye, et al.
Publicado: (2026)
por: Lin, Xiangye, et al.
Publicado: (2026)
3D-VLA: A 3D Vision-Language-Action Generative World Model
por: Zhen, Haoyu, et al.
Publicado: (2024)
por: Zhen, Haoyu, et al.
Publicado: (2024)
Learning 3D Persistent Embodied World Models
por: Zhou, Siyuan, et al.
Publicado: (2025)
por: Zhou, Siyuan, et al.
Publicado: (2025)
MultiPLY: A Multisensory Object-Centric Embodied Large Language Model in 3D World
por: Hong, Yining, et al.
Publicado: (2024)
por: Hong, Yining, et al.
Publicado: (2024)
Potential Based Diffusion Motion Planning
por: Luo, Yunhao, et al.
Publicado: (2024)
por: Luo, Yunhao, et al.
Publicado: (2024)
Pragmatic Embodied Spoken Instruction Following in Human-Robot Collaboration with Theory of Mind
por: Ying, Lance, et al.
Publicado: (2024)
por: Ying, Lance, et al.
Publicado: (2024)
Coherence-Driven Multimodal Safety Dialogue with Active Learning for Embodied Agents
por: Hassan, Sabit, et al.
Publicado: (2024)
por: Hassan, Sabit, et al.
Publicado: (2024)
Neuro-Symbolic Concepts
por: Mao, Jiayuan, et al.
Publicado: (2025)
por: Mao, Jiayuan, et al.
Publicado: (2025)
Statler: State-Maintaining Language Models for Embodied Reasoning
por: Yoneda, Takuma, et al.
Publicado: (2023)
por: Yoneda, Takuma, et al.
Publicado: (2023)
Virtual Community: An Open World for Humans, Robots, and Society
por: Zhou, Qinhong, et al.
Publicado: (2025)
por: Zhou, Qinhong, et al.
Publicado: (2025)
Grounding Large Language Models In Embodied Environment With Imperfect World Models
por: Liu, Haolan, et al.
Publicado: (2024)
por: Liu, Haolan, et al.
Publicado: (2024)
Few-Shot Task Learning through Inverse Generative Modeling
por: Netanyahu, Aviv, et al.
Publicado: (2024)
por: Netanyahu, Aviv, et al.
Publicado: (2024)
HyCodePolicy: Hybrid Language Controllers for Multimodal Monitoring and Decision in Embodied Agents
por: Liu, Yibin, et al.
Publicado: (2025)
por: Liu, Yibin, et al.
Publicado: (2025)
REI-Bench: Can Embodied Agents Understand Vague Human Instructions in Task Planning?
por: Jiang, Chenxi, et al.
Publicado: (2025)
por: Jiang, Chenxi, et al.
Publicado: (2025)
Embodied Agent Interface: Benchmarking LLMs for Embodied Decision Making
por: Li, Manling, et al.
Publicado: (2024)
por: Li, Manling, et al.
Publicado: (2024)
Simulating User Agents for Embodied Conversational-AI
por: Philipov, Daniel, et al.
Publicado: (2024)
por: Philipov, Daniel, et al.
Publicado: (2024)
GOMA: Proactive Embodied Cooperative Communication via Goal-Oriented Mental Alignment
por: Ying, Lance, et al.
Publicado: (2024)
por: Ying, Lance, et al.
Publicado: (2024)
Rethinking the Embodied Gap in Vision-and-Language Navigation: A Holistic Study of Physical and Visual Disparities
por: Wang, Liuyi, et al.
Publicado: (2025)
por: Wang, Liuyi, et al.
Publicado: (2025)
AdaWorld: Learning Adaptable World Models with Latent Actions
por: Gao, Shenyuan, et al.
Publicado: (2025)
por: Gao, Shenyuan, et al.
Publicado: (2025)
REFLEX: Metacognitive Reasoning for Reflective Zero-Shot Robotic Planning with Large Language Models
por: Lin, Wenjie, et al.
Publicado: (2025)
por: Lin, Wenjie, et al.
Publicado: (2025)
MiMo-Embodied: X-Embodied Foundation Model Technical Report
por: Hao, Xiaoshuai, et al.
Publicado: (2025)
por: Hao, Xiaoshuai, et al.
Publicado: (2025)
LLM-Empowered Embodied Agent for Memory-Augmented Task Planning in Household Robotics
por: Glocker, Marc, et al.
Publicado: (2025)
por: Glocker, Marc, et al.
Publicado: (2025)
JARVIS: A Neuro-Symbolic Commonsense Reasoning Framework for Conversational Embodied Agents
por: Zheng, Kaizhi, et al.
Publicado: (2022)
por: Zheng, Kaizhi, et al.
Publicado: (2022)
Embodied Agents for Efficient Exploration and Smart Scene Description
por: Bigazzi, Roberto, et al.
Publicado: (2023)
por: Bigazzi, Roberto, et al.
Publicado: (2023)
Teaching Embodied Reinforcement Learning Agents: Informativeness and Diversity of Language Use
por: Xi, Jiajun, et al.
Publicado: (2024)
por: Xi, Jiajun, et al.
Publicado: (2024)
Seeing Isn't Believing: Mitigating Belief Inertia via Active Intervention in Embodied Agents
por: Wang, Hanlin, et al.
Publicado: (2026)
por: Wang, Hanlin, et al.
Publicado: (2026)
AutoRT: Embodied Foundation Models for Large Scale Orchestration of Robotic Agents
por: Ahn, Michael, et al.
Publicado: (2024)
por: Ahn, Michael, et al.
Publicado: (2024)
Empathic Grounding: Explorations using Multimodal Interaction and Large Language Models with Conversational Agents
por: Arjmand, Mehdi, et al.
Publicado: (2024)
por: Arjmand, Mehdi, et al.
Publicado: (2024)
LEGENT: Open Platform for Embodied Agents
por: Cheng, Zhili, et al.
Publicado: (2024)
por: Cheng, Zhili, et al.
Publicado: (2024)
STAR: A Benchmark for Situated Reasoning in Real-World Videos
por: Wu, Bo, et al.
Publicado: (2024)
por: Wu, Bo, et al.
Publicado: (2024)
Multi-Agent Consensus Seeking via Large Language Models
por: Chen, Huaben, et al.
Publicado: (2023)
por: Chen, Huaben, et al.
Publicado: (2023)
CAMON: Cooperative Agents for Multi-Object Navigation with LLM-based Conversations
por: Wu, Pengying, et al.
Publicado: (2024)
por: Wu, Pengying, et al.
Publicado: (2024)
Shoot First, Ask Questions Later? Building Rational Agents that Explore and Act Like People
por: Grand, Gabriel, et al.
Publicado: (2025)
por: Grand, Gabriel, et al.
Publicado: (2025)
SALMON: Self-Alignment with Instructable Reward Models
por: Sun, Zhiqing, et al.
Publicado: (2023)
por: Sun, Zhiqing, et al.
Publicado: (2023)
Ejemplares similares
-
HAZARD Challenge: Embodied Decision Making in Dynamically Changing Environments
por: Zhou, Qinhong, et al.
Publicado: (2024) -
Constrained Human-AI Cooperation: An Inclusive Embodied Social Intelligence Challenge
por: Du, Weihua, et al.
Publicado: (2024) -
Ella: Embodied Social Agents with Lifelong Memory
por: Zhang, Hongxin, et al.
Publicado: (2025) -
TesserAct: Learning 4D Embodied World Models
por: Zhen, Haoyu, et al.
Publicado: (2025) -
3D-Mem: 3D Scene Memory for Embodied Exploration and Reasoning
por: Yang, Yuncong, et al.
Publicado: (2024)