Sentinel: Embodied Cooperative Spatial Reasoning and Planning
Fuente:
arXiv
Guardado en:
| Autores principales: | Lin, Xiangye, Zhang, Hongxin, Deng, Ruxi, Zhou, Qinhong, Gan, Chuang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
COMBO: Compositional World Models for Embodied Multi-Agent Cooperation
por: Zhang, Hongxin, et al.
Publicado: (2024)
por: Zhang, Hongxin, et al.
Publicado: (2024)
CaPo: Cooperative Plan Optimization for Efficient Embodied Multi-Agent Cooperation
por: Liu, Jie, et al.
Publicado: (2024)
por: Liu, Jie, et al.
Publicado: (2024)
Unified End-to-End V2X Cooperative Autonomous Driving
por: Li, Zhiwei, et al.
Publicado: (2024)
por: Li, Zhiwei, et al.
Publicado: (2024)
EI-Drive: A Platform for Cooperative Perception with Realistic Communication Models
por: Zhou, Hanchu, et al.
Publicado: (2024)
por: Zhou, Hanchu, et al.
Publicado: (2024)
V2X-DGPE: Addressing Domain Gaps and Pose Errors for Robust Collaborative 3D Object Detection
por: Wang, Sichao, et al.
Publicado: (2025)
por: Wang, Sichao, et al.
Publicado: (2025)
BrainMem: Brain-Inspired Evolving Memory for Embodied Agent Task Planning
por: Ma, Xiaoyu, et al.
Publicado: (2026)
por: Ma, Xiaoyu, et al.
Publicado: (2026)
ProCrit: Self-Elicited Multi-Perspective Reasoning with Critic-Guided Revision for Multimodal Sarcasm Detection
por: Xu, Yingjia, et al.
Publicado: (2026)
por: Xu, Yingjia, et al.
Publicado: (2026)
UNCAP: Uncertainty-Guided Neurosymbolic Planning Using Natural Language Communication for Cooperative Autonomous Vehicles
por: Bhatt, Neel P., et al.
Publicado: (2025)
por: Bhatt, Neel P., et al.
Publicado: (2025)
Ella: Embodied Social Agents with Lifelong Memory
por: Zhang, Hongxin, et al.
Publicado: (2025)
por: Zhang, Hongxin, et al.
Publicado: (2025)
CollaMamba: Efficient Collaborative Perception with Cross-Agent Spatial-Temporal State Space Model
por: Li, Yang, et al.
Publicado: (2024)
por: Li, Yang, et al.
Publicado: (2024)
MAG-3D: Multi-Agent Grounded Reasoning for 3D Understanding
por: Zheng, Henry, et al.
Publicado: (2026)
por: Zheng, Henry, et al.
Publicado: (2026)
A Multi-Agent Perception-Action Alliance for Efficient Long Video Reasoning
por: Xu, Yichang, et al.
Publicado: (2026)
por: Xu, Yichang, et al.
Publicado: (2026)
CoPAD : Multi-source Trajectory Fusion and Cooperative Trajectory Prediction with Anchor-oriented Decoder in V2X Scenarios
por: Wu, Kangyu, et al.
Publicado: (2025)
por: Wu, Kangyu, et al.
Publicado: (2025)
AstroVLM: Expert Multi-agent Collaborative Reasoning for Astronomical Imaging Quality Diagnosis
por: Han, Yaohui, et al.
Publicado: (2026)
por: Han, Yaohui, et al.
Publicado: (2026)
VideoChat-M1: Collaborative Policy Planning for Video Understanding via Multi-Agent Reinforcement Learning
por: Chen, Boyu, et al.
Publicado: (2025)
por: Chen, Boyu, et al.
Publicado: (2025)
End-to-End Autonomous Driving through V2X Cooperation
por: Yu, Haibao, et al.
Publicado: (2024)
por: Yu, Haibao, et al.
Publicado: (2024)
StarCraftImage: A Dataset For Prototyping Spatial Reasoning Methods For Multi-Agent Environments
por: Kulinski, Sean, et al.
Publicado: (2024)
por: Kulinski, Sean, et al.
Publicado: (2024)
AgentCVR: Active Multi-Agent Cross-Video Reasoning via Script-Simulated Reinforcement Learning
por: Qiu, Yilun, et al.
Publicado: (2026)
por: Qiu, Yilun, et al.
Publicado: (2026)
What Makes Good Collaborative Views? Contrastive Mutual Information Maximization for Multi-Agent Perception
por: Su, Wanfang, et al.
Publicado: (2024)
por: Su, Wanfang, et al.
Publicado: (2024)
ReCCur: A Recursive Corner-Case Curation Framework for Robust Vision-Language Understanding in Open and Edge Scenarios
por: Wei, Yihan, et al.
Publicado: (2026)
por: Wei, Yihan, et al.
Publicado: (2026)
Transductive Visual Programming: Evolving Tool Libraries from Experience for Spatial Reasoning
por: Wu, Shengguang, et al.
Publicado: (2025)
por: Wu, Shengguang, et al.
Publicado: (2025)
Building Cooperative Embodied Agents Modularly with Large Language Models
por: Zhang, Hongxin, et al.
Publicado: (2023)
por: Zhang, Hongxin, et al.
Publicado: (2023)
CAMON: Cooperative Agents for Multi-Object Navigation with LLM-based Conversations
por: Wu, Pengying, et al.
Publicado: (2024)
por: Wu, Pengying, et al.
Publicado: (2024)
Allen: Rethinking MAS Design through Step-Level Policy Autonomy
por: Zhou, Qiangong, et al.
Publicado: (2025)
por: Zhou, Qiangong, et al.
Publicado: (2025)
REVECA: Adaptive Planning and Trajectory-based Validation in Cooperative Language Agents using Information Relevance and Relative Proximity
por: Seo, SeungWon, et al.
Publicado: (2024)
por: Seo, SeungWon, et al.
Publicado: (2024)
OralAgent: Integrating Reasoning, Tools, and Knowledge for Interactive Dental Image Analysis
por: Hao, Jing, et al.
Publicado: (2026)
por: Hao, Jing, et al.
Publicado: (2026)
Fast2comm:Collaborative perception combined with prior knowledge
por: Zhang, Zhengbin, et al.
Publicado: (2025)
por: Zhang, Zhengbin, et al.
Publicado: (2025)
PreGSU-A Generalized Traffic Scene Understanding Model for Autonomous Driving based on Pre-trained Graph Attention Network
por: Wang, Yuning, et al.
Publicado: (2024)
por: Wang, Yuning, et al.
Publicado: (2024)
RadAgents: Multimodal Agentic Reasoning for Chest X-ray Interpretation with Radiologist-like Workflows
por: Zhang, Kai, et al.
Publicado: (2025)
por: Zhang, Kai, et al.
Publicado: (2025)
SPACE: 3D Spatial Co-operation and Exploration Framework for Robust Mapping and Coverage with Multi-Robot Systems
por: Ghanta, Sai Krishna, et al.
Publicado: (2024)
por: Ghanta, Sai Krishna, et al.
Publicado: (2024)
CoLMDriver: LLM-based Negotiation Benefits Cooperative Autonomous Driving
por: Liu, Changxing, et al.
Publicado: (2025)
por: Liu, Changxing, et al.
Publicado: (2025)
Enhancing CLIP Robustness via Cross-Modality Alignment
por: Zhu, Xingyu, et al.
Publicado: (2025)
por: Zhu, Xingyu, et al.
Publicado: (2025)
Visual Multi-Agent System: Mitigating Hallucination Snowballing via Visual Flow
por: Yu, Xinlei, et al.
Publicado: (2025)
por: Yu, Xinlei, et al.
Publicado: (2025)
LogiStory: A Logic-Aware Framework for Multi-Image Story Visualization
por: Meng, Chutian, et al.
Publicado: (2026)
por: Meng, Chutian, et al.
Publicado: (2026)
AniMaker: Multi-Agent Animated Storytelling with MCTS-Driven Clip Generation
por: Shi, Haoyuan, et al.
Publicado: (2025)
por: Shi, Haoyuan, et al.
Publicado: (2025)
Concept-RuleNet: Grounded Multi-Agent Neurosymbolic Reasoning in Vision Language Models
por: Sinha, Sanchit, et al.
Publicado: (2025)
por: Sinha, Sanchit, et al.
Publicado: (2025)
Hollywood Town: Long-Video Generation via Cross-Modal Multi-Agent Orchestration
por: Wei, Zheng, et al.
Publicado: (2025)
por: Wei, Zheng, et al.
Publicado: (2025)
TeamHOI: Learning a Unified Policy for Cooperative Human-Object Interactions with Any Team Size
por: Lionar, Stefan, et al.
Publicado: (2026)
por: Lionar, Stefan, et al.
Publicado: (2026)
EmboTeam: Grounding LLM Reasoning into Reactive Behavior Trees via PDDL for Embodied Multi-Robot Collaboration
por: Zeng, Haishan, et al.
Publicado: (2026)
por: Zeng, Haishan, et al.
Publicado: (2026)
An Agentic System for Rare Disease Diagnosis with Traceable Reasoning
por: Zhao, Weike, et al.
Publicado: (2025)
por: Zhao, Weike, et al.
Publicado: (2025)
Ejemplares similares
-
COMBO: Compositional World Models for Embodied Multi-Agent Cooperation
por: Zhang, Hongxin, et al.
Publicado: (2024) -
CaPo: Cooperative Plan Optimization for Efficient Embodied Multi-Agent Cooperation
por: Liu, Jie, et al.
Publicado: (2024) -
Unified End-to-End V2X Cooperative Autonomous Driving
por: Li, Zhiwei, et al.
Publicado: (2024) -
EI-Drive: A Platform for Cooperative Perception with Realistic Communication Models
por: Zhou, Hanchu, et al.
Publicado: (2024) -
V2X-DGPE: Addressing Domain Gaps and Pose Errors for Robust Collaborative 3D Object Detection
por: Wang, Sichao, et al.
Publicado: (2025)