From Perception to Action: Spatial AI Agents and World Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Felicia, Gloria, Bryant, Nolan, Putra, Handi, Gazali, Ayaan, Lobo, Eliel, Rojas, Esteban |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
EI-Drive: A Platform for Cooperative Perception with Realistic Communication Models
par: Zhou, Hanchu, et autres
Publié: (2024)
par: Zhou, Hanchu, et autres
Publié: (2024)
SPACE: 3D Spatial Co-operation and Exploration Framework for Robust Mapping and Coverage with Multi-Robot Systems
par: Ghanta, Sai Krishna, et autres
Publié: (2024)
par: Ghanta, Sai Krishna, et autres
Publié: (2024)
Knowledge-Informed Multi-Agent Trajectory Prediction at Signalized Intersections for Infrastructure-to-Everything
par: Yin, Huilin, et autres
Publié: (2025)
par: Yin, Huilin, et autres
Publié: (2025)
DVM-SLAM: Decentralized Visual Monocular Simultaneous Localization and Mapping for Multi-Agent Systems
par: Bird, Joshua, et autres
Publié: (2025)
par: Bird, Joshua, et autres
Publié: (2025)
CollaMamba: Efficient Collaborative Perception with Cross-Agent Spatial-Temporal State Space Model
par: Li, Yang, et autres
Publié: (2024)
par: Li, Yang, et autres
Publié: (2024)
A Multi-Agent Perception-Action Alliance for Efficient Long Video Reasoning
par: Xu, Yichang, et autres
Publié: (2026)
par: Xu, Yichang, et autres
Publié: (2026)
A Spatial Calibration Method for Robust Cooperative Perception
par: Song, Zhiying, et autres
Publié: (2023)
par: Song, Zhiying, et autres
Publié: (2023)
TRACE: A Self-Improving Framework for Robot Behavior Forecasting with Vision-Language Models
par: Puthumanaillam, Gokul, et autres
Publié: (2025)
par: Puthumanaillam, Gokul, et autres
Publié: (2025)
CoPAD : Multi-source Trajectory Fusion and Cooperative Trajectory Prediction with Anchor-oriented Decoder in V2X Scenarios
par: Wu, Kangyu, et autres
Publié: (2025)
par: Wu, Kangyu, et autres
Publié: (2025)
C$^2$T: Captioning-Structure and LLM-Aligned Common-Sense Reward Learning for Traffic--Vehicle Coordination
par: Chen, Yuyang, et autres
Publié: (2026)
par: Chen, Yuyang, et autres
Publié: (2026)
End-to-End Autonomous Driving through V2X Cooperation
par: Yu, Haibao, et autres
Publié: (2024)
par: Yu, Haibao, et autres
Publié: (2024)
Aligning Cyber Space with Physical World: A Comprehensive Survey on Embodied AI
par: Liu, Yang, et autres
Publié: (2024)
par: Liu, Yang, et autres
Publié: (2024)
CAMON: Cooperative Agents for Multi-Object Navigation with LLM-based Conversations
par: Wu, Pengying, et autres
Publié: (2024)
par: Wu, Pengying, et autres
Publié: (2024)
BrainMem: Brain-Inspired Evolving Memory for Embodied Agent Task Planning
par: Ma, Xiaoyu, et autres
Publié: (2026)
par: Ma, Xiaoyu, et autres
Publié: (2026)
Wireless Communication as an Information Sensor for Multi-agent Cooperative Perception: A Survey
par: Song, Zhiying, et autres
Publié: (2025)
par: Song, Zhiying, et autres
Publié: (2025)
Drive My Way: Preference Alignment of Vision-Language-Action Model for Personalized Driving
par: Wang, Zehao, et autres
Publié: (2026)
par: Wang, Zehao, et autres
Publié: (2026)
PECMAN: Perception-enabled Collaborative Multi-Agent Navigation in Unknown Environments
par: Fang, Tianchonghui, et autres
Publié: (2026)
par: Fang, Tianchonghui, et autres
Publié: (2026)
Modelling and Control of Spatial Behaviours in Multi-Agent Systems with Applications to Biology and Robotics
par: Giusti, Andrea
Publié: (2024)
par: Giusti, Andrea
Publié: (2024)
SceneDiffuser++: City-Scale Traffic Simulation via a Generative World Model
par: Tan, Shuhan, et autres
Publié: (2025)
par: Tan, Shuhan, et autres
Publié: (2025)
TeamHOI: Learning a Unified Policy for Cooperative Human-Object Interactions with Any Team Size
par: Lionar, Stefan, et autres
Publié: (2026)
par: Lionar, Stefan, et autres
Publié: (2026)
Relational Q-Functionals: Multi-Agent Learning to Recover from Unforeseen Robot Malfunctions in Continuous Action Domains
par: Findik, Yasin, et autres
Publié: (2024)
par: Findik, Yasin, et autres
Publié: (2024)
GNN-based Decentralized Perception in Multirobot Systems for Predicting Worker Actions
par: Imran, Ali, et autres
Publié: (2025)
par: Imran, Ali, et autres
Publié: (2025)
CMP: Cooperative Motion Prediction with Multi-Agent Communication
par: Wang, Zehao, et autres
Publié: (2024)
par: Wang, Zehao, et autres
Publié: (2024)
MATRIX: Multi-Agent Trajectory Generation with Diverse Contexts
par: Xu, Zhuo, et autres
Publié: (2024)
par: Xu, Zhuo, et autres
Publié: (2024)
From Gridworlds to Warehouses: Adapting Lightweight One-shot Multi-Agent Pathfinding for AGVs
par: Nagai, Hiroki, et autres
Publié: (2026)
par: Nagai, Hiroki, et autres
Publié: (2026)
Multi-Agent Dynamic Relational Reasoning for Social Robot Navigation
par: Li, Jiachen, et autres
Publié: (2024)
par: Li, Jiachen, et autres
Publié: (2024)
Robust and Safe Multi-Agent Reinforcement Learning with Communication for Autonomous Vehicles: From Simulation to Hardware
par: Smith, Keshawn, et autres
Publié: (2025)
par: Smith, Keshawn, et autres
Publié: (2025)
Spatio-Temporal Graph Dual-Attention Network for Multi-Agent Prediction and Tracking
par: Li, Jiachen, et autres
Publié: (2021)
par: Li, Jiachen, et autres
Publié: (2021)
When Simultaneous Localization and Mapping Meets Wireless Communications: A Survey
par: Gounis, Konstantinos, et autres
Publié: (2026)
par: Gounis, Konstantinos, et autres
Publié: (2026)
UNCAP: Uncertainty-Guided Neurosymbolic Planning Using Natural Language Communication for Cooperative Autonomous Vehicles
par: Bhatt, Neel P., et autres
Publié: (2025)
par: Bhatt, Neel P., et autres
Publié: (2025)
HiMemFormer: Hierarchical Memory-Aware Transformer for Multi-Agent Action Anticipation
par: Wang, Zirui, et autres
Publié: (2024)
par: Wang, Zirui, et autres
Publié: (2024)
CommCP: Efficient Multi-Agent Coordination via LLM-Based Communication with Conformal Prediction
par: Zhang, Xiaopan, et autres
Publié: (2026)
par: Zhang, Xiaopan, et autres
Publié: (2026)
What Makes Good Collaborative Views? Contrastive Mutual Information Maximization for Multi-Agent Perception
par: Su, Wanfang, et autres
Publié: (2024)
par: Su, Wanfang, et autres
Publié: (2024)
LaMMA-P: Generalizable Multi-Agent Long-Horizon Task Allocation and Planning with LM-Driven PDDL Planner
par: Zhang, Xiaopan, et autres
Publié: (2024)
par: Zhang, Xiaopan, et autres
Publié: (2024)
Streamlining the Action Dependency Graph Framework: Two Key Enhancements
par: Dunkel, Joachim
Publié: (2024)
par: Dunkel, Joachim
Publié: (2024)
MDG: Masked Denoising Generation for Multi-Agent Behavior Modeling in Traffic Environments
par: Huang, Zhiyu, et autres
Publié: (2025)
par: Huang, Zhiyu, et autres
Publié: (2025)
From Marginal to Joint Predictions: Evaluating Scene-Consistent Trajectory Prediction Approaches for Automated Driving
par: Konstantinidis, Fabian, et autres
Publié: (2025)
par: Konstantinidis, Fabian, et autres
Publié: (2025)
Improving Multi-Vehicle Perception Fusion with Millimeter-Wave Radar Assistance
par: Luo, Zhiqing, et autres
Publié: (2025)
par: Luo, Zhiqing, et autres
Publié: (2025)
Visual Heading Prediction for Autonomous Aerial Vehicles
par: Ahmari, Reza, et autres
Publié: (2025)
par: Ahmari, Reza, et autres
Publié: (2025)
Multi-UAV Search and Rescue in Wilderness Using Smart Agent-Based Probability Models
par: Ge, Zijian, et autres
Publié: (2024)
par: Ge, Zijian, et autres
Publié: (2024)
Documents similaires
-
EI-Drive: A Platform for Cooperative Perception with Realistic Communication Models
par: Zhou, Hanchu, et autres
Publié: (2024) -
SPACE: 3D Spatial Co-operation and Exploration Framework for Robust Mapping and Coverage with Multi-Robot Systems
par: Ghanta, Sai Krishna, et autres
Publié: (2024) -
Knowledge-Informed Multi-Agent Trajectory Prediction at Signalized Intersections for Infrastructure-to-Everything
par: Yin, Huilin, et autres
Publié: (2025) -
DVM-SLAM: Decentralized Visual Monocular Simultaneous Localization and Mapping for Multi-Agent Systems
par: Bird, Joshua, et autres
Publié: (2025) -
CollaMamba: Efficient Collaborative Perception with Cross-Agent Spatial-Temporal State Space Model
par: Li, Yang, et autres
Publié: (2024)