Saved in:
| Main Authors: | Chen, Jiao, Wang, Haoyi, Tang, Jianhua, Wang, Junyi |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | https://arxiv.org/abs/2511.11720 |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Local Prompt Adaptation for Style-Consistent Multi-Object Generation in Diffusion Models
by: Sanjyal, Ankit
Published: (2025)
by: Sanjyal, Ankit
Published: (2025)
VLM-Guided Iterative Refinement for Surgical Image Segmentation with Foundation Models
by: Lou, Ange, et al.
Published: (2026)
by: Lou, Ange, et al.
Published: (2026)
PreGSU-A Generalized Traffic Scene Understanding Model for Autonomous Driving based on Pre-trained Graph Attention Network
by: Wang, Yuning, et al.
Published: (2024)
by: Wang, Yuning, et al.
Published: (2024)
Next Generation Intelligent Low-Altitude Economy Deployments: The O-RAN Perspective
by: Abdalla, Aly Sabri, et al.
Published: (2026)
by: Abdalla, Aly Sabri, et al.
Published: (2026)
FEAT: A Multi-Agent Forensic AI System with Domain-Adapted Large Language Model for Automated Cause-of-Death Analysis
by: Shen, Chen, et al.
Published: (2025)
by: Shen, Chen, et al.
Published: (2025)
ProCrit: Self-Elicited Multi-Perspective Reasoning with Critic-Guided Revision for Multimodal Sarcasm Detection
by: Xu, Yingjia, et al.
Published: (2026)
by: Xu, Yingjia, et al.
Published: (2026)
VideoChat-M1: Collaborative Policy Planning for Video Understanding via Multi-Agent Reinforcement Learning
by: Chen, Boyu, et al.
Published: (2025)
by: Chen, Boyu, et al.
Published: (2025)
AstroVLM: Expert Multi-agent Collaborative Reasoning for Astronomical Imaging Quality Diagnosis
by: Han, Yaohui, et al.
Published: (2026)
by: Han, Yaohui, et al.
Published: (2026)
AniMaker: Multi-Agent Animated Storytelling with MCTS-Driven Clip Generation
by: Shi, Haoyuan, et al.
Published: (2025)
by: Shi, Haoyuan, et al.
Published: (2025)
Multi-Agent Amodal Completion: Direct Synthesis with Fine-Grained Semantic Guidance
by: Fan, Hongxing, et al.
Published: (2025)
by: Fan, Hongxing, et al.
Published: (2025)
V2X-DGPE: Addressing Domain Gaps and Pose Errors for Robust Collaborative 3D Object Detection
by: Wang, Sichao, et al.
Published: (2025)
by: Wang, Sichao, et al.
Published: (2025)
A Stochastic Geo-spatiotemporal Bipartite Network to Optimize GCOOS Sensor Placement Strategies
by: Holmberg, Ted Edward, et al.
Published: (2024)
by: Holmberg, Ted Edward, et al.
Published: (2024)
Allen: Rethinking MAS Design through Step-Level Policy Autonomy
by: Zhou, Qiangong, et al.
Published: (2025)
by: Zhou, Qiangong, et al.
Published: (2025)
Enhancing CLIP Robustness via Cross-Modality Alignment
by: Zhu, Xingyu, et al.
Published: (2025)
by: Zhu, Xingyu, et al.
Published: (2025)
AgentCVR: Active Multi-Agent Cross-Video Reasoning via Script-Simulated Reinforcement Learning
by: Qiu, Yilun, et al.
Published: (2026)
by: Qiu, Yilun, et al.
Published: (2026)
HiMemFormer: Hierarchical Memory-Aware Transformer for Multi-Agent Action Anticipation
by: Wang, Zirui, et al.
Published: (2024)
by: Wang, Zirui, et al.
Published: (2024)
Chain-of-Anomaly Thoughts with Large Vision-Language Models
by: Domingos, Pedro, et al.
Published: (2025)
by: Domingos, Pedro, et al.
Published: (2025)
DiffCP: Ultra-Low Bit Collaborative Perception via Diffusion Model
by: Mao, Ruiqing, et al.
Published: (2024)
by: Mao, Ruiqing, et al.
Published: (2024)
Visual Sensor Pose Optimisation Using Visibility Models for Smart Cities
by: Arnold, Eduardo, et al.
Published: (2021)
by: Arnold, Eduardo, et al.
Published: (2021)
SPAgent: Adaptive Task Decomposition and Model Selection for General Video Generation and Editing
by: Tu, Rong-Cheng, et al.
Published: (2024)
by: Tu, Rong-Cheng, et al.
Published: (2024)
CollaMamba: Efficient Collaborative Perception with Cross-Agent Spatial-Temporal State Space Model
by: Li, Yang, et al.
Published: (2024)
by: Li, Yang, et al.
Published: (2024)
C$^2$T: Captioning-Structure and LLM-Aligned Common-Sense Reward Learning for Traffic--Vehicle Coordination
by: Chen, Yuyang, et al.
Published: (2026)
by: Chen, Yuyang, et al.
Published: (2026)
UNCAP: Uncertainty-Guided Neurosymbolic Planning Using Natural Language Communication for Cooperative Autonomous Vehicles
by: Bhatt, Neel P., et al.
Published: (2025)
by: Bhatt, Neel P., et al.
Published: (2025)
What Makes Good Collaborative Views? Contrastive Mutual Information Maximization for Multi-Agent Perception
by: Su, Wanfang, et al.
Published: (2024)
by: Su, Wanfang, et al.
Published: (2024)
How Modality Shapes Perception and Reasoning: A Study of Error Propagation in ARC-AGI
by: Wen, Bo, et al.
Published: (2025)
by: Wen, Bo, et al.
Published: (2025)
Visual Multi-Agent System: Mitigating Hallucination Snowballing via Visual Flow
by: Yu, Xinlei, et al.
Published: (2025)
by: Yu, Xinlei, et al.
Published: (2025)
FetalAgents: A Multi-Agent System for Fetal Ultrasound Image and Video Analysis
by: Hu, Xiaotian, et al.
Published: (2026)
by: Hu, Xiaotian, et al.
Published: (2026)
COMBO: Compositional World Models for Embodied Multi-Agent Cooperation
by: Zhang, Hongxin, et al.
Published: (2024)
by: Zhang, Hongxin, et al.
Published: (2024)
Towards Reliable Fetal Ultrasound Interpretation with Multi-Agent Collaboration
by: Hu, Xiaotian, et al.
Published: (2026)
by: Hu, Xiaotian, et al.
Published: (2026)
CoLMDriver: LLM-based Negotiation Benefits Cooperative Autonomous Driving
by: Liu, Changxing, et al.
Published: (2025)
by: Liu, Changxing, et al.
Published: (2025)
Active Scout: Multi-Target Tracking Using Neural Radiance Fields in Dense Urban Environments
by: Hsu, Christopher D., et al.
Published: (2024)
by: Hsu, Christopher D., et al.
Published: (2024)
LogiStory: A Logic-Aware Framework for Multi-Image Story Visualization
by: Meng, Chutian, et al.
Published: (2026)
by: Meng, Chutian, et al.
Published: (2026)
Sentinel: Embodied Cooperative Spatial Reasoning and Planning
by: Lin, Xiangye, et al.
Published: (2026)
by: Lin, Xiangye, et al.
Published: (2026)
Cascading multi-agent anomaly detection in surveillance systems via vision-language models and embedding-based classification
by: Rehman, Tayyab, et al.
Published: (2026)
by: Rehman, Tayyab, et al.
Published: (2026)
Fast2comm:Collaborative perception combined with prior knowledge
by: Zhang, Zhengbin, et al.
Published: (2025)
by: Zhang, Zhengbin, et al.
Published: (2025)
Hollywood Town: Long-Video Generation via Cross-Modal Multi-Agent Orchestration
by: Wei, Zheng, et al.
Published: (2025)
by: Wei, Zheng, et al.
Published: (2025)
FootBots: A Transformer-based Architecture for Motion Prediction in Soccer
by: Capellera, Guillem, et al.
Published: (2024)
by: Capellera, Guillem, et al.
Published: (2024)
MAG-3D: Multi-Agent Grounded Reasoning for 3D Understanding
by: Zheng, Henry, et al.
Published: (2026)
by: Zheng, Henry, et al.
Published: (2026)
Unified End-to-End V2X Cooperative Autonomous Driving
by: Li, Zhiwei, et al.
Published: (2024)
by: Li, Zhiwei, et al.
Published: (2024)
Learning Collective Dynamics of Multi-Agent Systems using Event-based Vision
by: Lee, Minah, et al.
Published: (2024)
by: Lee, Minah, et al.
Published: (2024)
Similar Items
-
Local Prompt Adaptation for Style-Consistent Multi-Object Generation in Diffusion Models
by: Sanjyal, Ankit
Published: (2025) -
VLM-Guided Iterative Refinement for Surgical Image Segmentation with Foundation Models
by: Lou, Ange, et al.
Published: (2026) -
PreGSU-A Generalized Traffic Scene Understanding Model for Autonomous Driving based on Pre-trained Graph Attention Network
by: Wang, Yuning, et al.
Published: (2024) -
Next Generation Intelligent Low-Altitude Economy Deployments: The O-RAN Perspective
by: Abdalla, Aly Sabri, et al.
Published: (2026) -
FEAT: A Multi-Agent Forensic AI System with Domain-Adapted Large Language Model for Automated Cause-of-Death Analysis
by: Shen, Chen, et al.
Published: (2025)