A Cascading Cooperative Multi-agent Framework for On-ramp Merging Control Integrating Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Miao, Fang, Zhenlong, Wang, Tianyi, Zhang, Qian, Lu, Shuai, Jiao, Junfeng, Shi, Tianyu |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
AgentsCoMerge: Large Language Model Empowered Collaborative Decision Making for Ramp Merging
di: Hu, Senkang, et al.
Pubblicazione: (2024)
di: Hu, Senkang, et al.
Pubblicazione: (2024)
Unsupervised Multi-agent and Single-agent Perception from Cooperative Views
di: Yang, Haochen, et al.
Pubblicazione: (2026)
di: Yang, Haochen, et al.
Pubblicazione: (2026)
mmCooper: A Multi-agent Multi-stage Communication-efficient and Collaboration-robust Cooperative Perception Framework
di: Liu, Bingyi, et al.
Pubblicazione: (2025)
di: Liu, Bingyi, et al.
Pubblicazione: (2025)
Enhancing Multi-Modal LLMs Reasoning via Difficulty-Aware Group Normalization
di: Li, Jinghan, et al.
Pubblicazione: (2026)
di: Li, Jinghan, et al.
Pubblicazione: (2026)
UrbanSense:A Framework for Quantitative Analysis of Urban Streetscapes leveraging Vision Large Language Models
di: Yin, Jun, et al.
Pubblicazione: (2025)
di: Yin, Jun, et al.
Pubblicazione: (2025)
TSCnet: A Text-driven Semantic-level Controllable Framework for Customized Low-Light Image Enhancement
di: Zhang, Miao, et al.
Pubblicazione: (2025)
di: Zhang, Miao, et al.
Pubblicazione: (2025)
Exploring Large Vision-Language Models for Robust and Efficient Industrial Anomaly Detection
di: Qian, Kun, et al.
Pubblicazione: (2024)
di: Qian, Kun, et al.
Pubblicazione: (2024)
PromptLNet: Region-Adaptive Aesthetic Enhancement via Prompt Guidance in Low-Light Enhancement Net
di: Yin, Jun, et al.
Pubblicazione: (2025)
di: Yin, Jun, et al.
Pubblicazione: (2025)
When to Lock Attention: Training-Free KV Control in Video Diffusion
di: Zeng, Tianyi, et al.
Pubblicazione: (2026)
di: Zeng, Tianyi, et al.
Pubblicazione: (2026)
ArchiLense: A Framework for Quantitative Analysis of Architectural Styles Based on Vision Large Language Models
di: Zhong, Jing, et al.
Pubblicazione: (2025)
di: Zhong, Jing, et al.
Pubblicazione: (2025)
Multi-modality Affinity Inference for Weakly Supervised 3D Semantic Segmentation
di: Li, Xiawei, et al.
Pubblicazione: (2023)
di: Li, Xiawei, et al.
Pubblicazione: (2023)
GuardAlign: Test-time Safety Alignment in Multimodal Large Language Models
di: Zhu, Xingyu, et al.
Pubblicazione: (2026)
di: Zhu, Xingyu, et al.
Pubblicazione: (2026)
Seeing Together: Multi-Robot Cooperative Egocentric Spatial Reasoning with Multimodal Large Language Models
di: Peng, Kunyu, et al.
Pubblicazione: (2026)
di: Peng, Kunyu, et al.
Pubblicazione: (2026)
Harnessing Large Vision and Language Models in Agriculture: A Review
di: Zhu, Hongyan, et al.
Pubblicazione: (2024)
di: Zhu, Hongyan, et al.
Pubblicazione: (2024)
MergeTok: Unified Continuous and Discrete Visual Tokenization via Token Merging
di: Zhang, Luyuan, et al.
Pubblicazione: (2026)
di: Zhang, Luyuan, et al.
Pubblicazione: (2026)
MergeVQ: A Unified Framework for Visual Generation and Representation with Disentangled Token Merging and Quantization
di: Li, Siyuan, et al.
Pubblicazione: (2025)
di: Li, Siyuan, et al.
Pubblicazione: (2025)
Enhanced Safety in Autonomous Driving: Integrating Latent State Diffusion Model for End-to-End Navigation
di: Chu, Detian, et al.
Pubblicazione: (2024)
di: Chu, Detian, et al.
Pubblicazione: (2024)
LayoutCoT: Unleashing the Deep Reasoning Potential of Large Language Models for Layout Generation
di: Shi, Hengyu, et al.
Pubblicazione: (2025)
di: Shi, Hengyu, et al.
Pubblicazione: (2025)
DualFocus: Integrating Macro and Micro Perspectives in Multi-modal Large Language Models
di: Cao, Yuhang, et al.
Pubblicazione: (2024)
di: Cao, Yuhang, et al.
Pubblicazione: (2024)
Dinomaly: The Less Is More Philosophy in Multi-Class Unsupervised Anomaly Detection
di: Guo, Jia, et al.
Pubblicazione: (2024)
di: Guo, Jia, et al.
Pubblicazione: (2024)
DocRefine: An Intelligent Framework for Scientific Document Understanding and Content Optimization based on Multimodal Large Model Agents
di: Qian, Kun, et al.
Pubblicazione: (2025)
di: Qian, Kun, et al.
Pubblicazione: (2025)
The Curse of Multi-Modalities: Evaluating Hallucinations of Large Multimodal Models across Language, Visual, and Audio
di: Leng, Sicong, et al.
Pubblicazione: (2024)
di: Leng, Sicong, et al.
Pubblicazione: (2024)
LAST: LeArning to Think in Space and Time for Generalist Vision-Language Models
di: Wang, Shuai, et al.
Pubblicazione: (2025)
di: Wang, Shuai, et al.
Pubblicazione: (2025)
Dual-Level Precision Edges Guided Multi-View Stereo with Accurate Planarization
di: Chen, Kehua, et al.
Pubblicazione: (2024)
di: Chen, Kehua, et al.
Pubblicazione: (2024)
RAD: Retrieval-Augmented Decision-Making of Meta-Actions with Vision-Language Models in Autonomous Driving
di: Wang, Yujin, et al.
Pubblicazione: (2025)
di: Wang, Yujin, et al.
Pubblicazione: (2025)
Mitigating Hallucinations in Large Vision-Language Models without Performance Degradation
di: Zhu, Xingyu, et al.
Pubblicazione: (2026)
di: Zhu, Xingyu, et al.
Pubblicazione: (2026)
HCOMC: A Hierarchical Cooperative On-Ramp Merging Control Framework in Mixed Traffic Environment on Two-Lane Highways
di: Wang, Tianyi, et al.
Pubblicazione: (2025)
di: Wang, Tianyi, et al.
Pubblicazione: (2025)
Mitigating Entangled Steering in Large Vision-Language Models for Hallucination Reduction
di: Zhang, Yuanhong, et al.
Pubblicazione: (2026)
di: Zhang, Yuanhong, et al.
Pubblicazione: (2026)
InfoMerge: Information-aware Token Compression for Efficient Video Large Language Models
di: Liu, Xinxin, et al.
Pubblicazione: (2026)
di: Liu, Xinxin, et al.
Pubblicazione: (2026)
TSAR-MVS: Textureless-aware Segmentation and Correlative Refinement Guided Multi-View Stereo
di: Yuan, Zhenlong, et al.
Pubblicazione: (2023)
di: Yuan, Zhenlong, et al.
Pubblicazione: (2023)
LENS: Multi-level Evaluation of Multimodal Reasoning with Large Language Models
di: Yao, Ruilin, et al.
Pubblicazione: (2025)
di: Yao, Ruilin, et al.
Pubblicazione: (2025)
Progressive Modality Cooperation for Multi-Modality Domain Adaptation
di: Zhang, Weichen, et al.
Pubblicazione: (2025)
di: Zhang, Weichen, et al.
Pubblicazione: (2025)
HCF: Hierarchical Cascade Framework for Distributed Multi-Stage Image Compression
di: Cai, Junhao, et al.
Pubblicazione: (2025)
di: Cai, Junhao, et al.
Pubblicazione: (2025)
Multi-Scale and Detail-Enhanced Segment Anything Model for Salient Object Detection
di: Gao, Shixuan, et al.
Pubblicazione: (2024)
di: Gao, Shixuan, et al.
Pubblicazione: (2024)
MultiShotMaster: A Controllable Multi-Shot Video Generation Framework
di: Wang, Qinghe, et al.
Pubblicazione: (2025)
di: Wang, Qinghe, et al.
Pubblicazione: (2025)
HoliTom: Holistic Token Merging for Fast Video Large Language Models
di: Shao, Kele, et al.
Pubblicazione: (2025)
di: Shao, Kele, et al.
Pubblicazione: (2025)
SiCP: Simultaneous Individual and Cooperative Perception for 3D Object Detection in Connected and Automated Vehicles
di: Qu, Deyuan, et al.
Pubblicazione: (2023)
di: Qu, Deyuan, et al.
Pubblicazione: (2023)
Verb Mirage: Unveiling and Assessing Verb Concept Hallucinations in Multimodal Large Language Models
di: Wang, Zehao, et al.
Pubblicazione: (2024)
di: Wang, Zehao, et al.
Pubblicazione: (2024)
Exploring Model Kinship for Merging Large Language Models
di: Hu, Yedi, et al.
Pubblicazione: (2024)
di: Hu, Yedi, et al.
Pubblicazione: (2024)
PPTBench: Towards Holistic Evaluation of Large Language Models for PowerPoint Layout and Design Understanding
di: Huang, Zheng, et al.
Pubblicazione: (2025)
di: Huang, Zheng, et al.
Pubblicazione: (2025)
Documenti analoghi
-
AgentsCoMerge: Large Language Model Empowered Collaborative Decision Making for Ramp Merging
di: Hu, Senkang, et al.
Pubblicazione: (2024) -
Unsupervised Multi-agent and Single-agent Perception from Cooperative Views
di: Yang, Haochen, et al.
Pubblicazione: (2026) -
mmCooper: A Multi-agent Multi-stage Communication-efficient and Collaboration-robust Cooperative Perception Framework
di: Liu, Bingyi, et al.
Pubblicazione: (2025) -
Enhancing Multi-Modal LLMs Reasoning via Difficulty-Aware Group Normalization
di: Li, Jinghan, et al.
Pubblicazione: (2026) -
UrbanSense:A Framework for Quantitative Analysis of Urban Streetscapes leveraging Vision Large Language Models
di: Yin, Jun, et al.
Pubblicazione: (2025)