V2X-UniPool: Unifying Multimodal Perception and Knowledge Reasoning for Autonomous Driving
Fuente:
arXiv
Guardado en:
| Autores principales: | Luo, Xuewen, Yang, Fengze, Ding, Fan, Gao, Xiangbo, Xing, Shuo, Zhou, Yang, Tu, Zhengzhong, Liu, Chenxi |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
AirV2X: Unified Air-Ground Vehicle-to-Everything Collaboration
por: Gao, Xiangbo, et al.
Publicado: (2025)
por: Gao, Xiangbo, et al.
Publicado: (2025)
Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance
por: Yang, Fengze, et al.
Publicado: (2025)
por: Yang, Fengze, et al.
Publicado: (2025)
SenseRAG: Constructing Environmental Knowledge Bases with Proactive Querying for LLM-Based Autonomous Driving
por: Luo, Xuewen, et al.
Publicado: (2025)
por: Luo, Xuewen, et al.
Publicado: (2025)
DRAMA-X: A Fine-grained Intent Prediction and Risk Reasoning Benchmark For Driving
por: Godbole, Mihir, et al.
Publicado: (2025)
por: Godbole, Mihir, et al.
Publicado: (2025)
UniPool: A Globally Shared Expert Pool for Mixture-of-Experts
por: Huang, Minbin, et al.
Publicado: (2026)
por: Huang, Minbin, et al.
Publicado: (2026)
UniOcc: A Unified Benchmark for Occupancy Forecasting and Prediction in Autonomous Driving
por: Wang, Yuping, et al.
Publicado: (2025)
por: Wang, Yuping, et al.
Publicado: (2025)
LangCoop: Collaborative Driving with Language
por: Gao, Xiangbo, et al.
Publicado: (2025)
por: Gao, Xiangbo, et al.
Publicado: (2025)
OpenEMMA: Open-Source Multimodal Model for End-to-End Autonomous Driving
por: Xing, Shuo, et al.
Publicado: (2024)
por: Xing, Shuo, et al.
Publicado: (2024)
KnowDiffuser: A Knowledge-Guided Diffusion Planner with LLM Reasoning
por: Ding, Fan, et al.
Publicado: (2026)
por: Ding, Fan, et al.
Publicado: (2026)
AutoTrust: Benchmarking Trustworthiness in Large Vision Language Models for Autonomous Driving
por: Xing, Shuo, et al.
Publicado: (2024)
por: Xing, Shuo, et al.
Publicado: (2024)
STAMP: Scalable Task And Model-agnostic Collaborative Perception
por: Gao, Xiangbo, et al.
Publicado: (2025)
por: Gao, Xiangbo, et al.
Publicado: (2025)
CoCMT: Communication-Efficient Cross-Modal Transformer for Collaborative Perception
por: Wang, Rujia, et al.
Publicado: (2025)
por: Wang, Rujia, et al.
Publicado: (2025)
Background Fades, Foreground Leads: Curriculum-Guided Background Pruning for Efficient Foreground-Centric Collaborative Perception
por: Wu, Yuheng, et al.
Publicado: (2025)
por: Wu, Yuheng, et al.
Publicado: (2025)
PKRD-CoT: A Unified Chain-of-thought Prompting for Multi-Modal Large Language Models in Autonomous Driving
por: Luo, Xuewen, et al.
Publicado: (2024)
por: Luo, Xuewen, et al.
Publicado: (2024)
UniDriveVLA: Unifying Understanding, Perception, and Action Planning for Autonomous Driving
por: Li, Yongkang, et al.
Publicado: (2026)
por: Li, Yongkang, et al.
Publicado: (2026)
NuScenes-SpatialQA: A Spatial Understanding and Reasoning Benchmark for Vision-Language Models in Autonomous Driving
por: Tian, Kexin, et al.
Publicado: (2025)
por: Tian, Kexin, et al.
Publicado: (2025)
Locatability-Guided Adaptive Reasoning for Image Geo-Localization with Vision-Language Models
por: Yu, Bo, et al.
Publicado: (2026)
por: Yu, Bo, et al.
Publicado: (2026)
UniM$^2$AE: Multi-modal Masked Autoencoders with Unified 3D Representation for 3D Perception in Autonomous Driving
por: Zou, Jian, et al.
Publicado: (2023)
por: Zou, Jian, et al.
Publicado: (2023)
End-to-End Autonomous Driving through V2X Cooperation
por: Yu, Haibao, et al.
Publicado: (2024)
por: Yu, Haibao, et al.
Publicado: (2024)
Automated Vehicles Should be Connected with Natural Language
por: Gao, Xiangbo, et al.
Publicado: (2025)
por: Gao, Xiangbo, et al.
Publicado: (2025)
MMTL-UniAD: A Unified Framework for Multimodal and Multi-Task Learning in Assistive Driving Perception
por: Liu, Wenzhuo, et al.
Publicado: (2025)
por: Liu, Wenzhuo, et al.
Publicado: (2025)
DecAlign: Hierarchical Cross-Modal Alignment for Decoupled Multimodal Representation Learning
por: Qian, Chengxuan, et al.
Publicado: (2025)
por: Qian, Chengxuan, et al.
Publicado: (2025)
UniDrive-WM: Unified Understanding, Planning and Generation World Model For Autonomous Driving
por: Xiong, Zhexiao, et al.
Publicado: (2026)
por: Xiong, Zhexiao, et al.
Publicado: (2026)
VISTAv2: World Imagination for Indoor Vision-and-Language Navigation
por: Huang, Yanjia, et al.
Publicado: (2025)
por: Huang, Yanjia, et al.
Publicado: (2025)
FORGE-Tree: Diffusion-Forcing Tree Search for Long-Horizon Robot Manipulation
por: Huang, Yanjia, et al.
Publicado: (2025)
por: Huang, Yanjia, et al.
Publicado: (2025)
Unified End-to-End V2X Cooperative Autonomous Driving
por: Li, Zhiwei, et al.
Publicado: (2024)
por: Li, Zhiwei, et al.
Publicado: (2024)
GUIDE: Gaussian Unified Instance Detection for Enhanced Obstacle Perception in Autonomous Driving
por: Hu, Chunyong, et al.
Publicado: (2025)
por: Hu, Chunyong, et al.
Publicado: (2025)
UniUGP: Unifying Understanding, Generation, and Planing For End-to-end Autonomous Driving
por: Lu, Hao, et al.
Publicado: (2025)
por: Lu, Hao, et al.
Publicado: (2025)
PriorFusion: Unified Integration of Priors for Robust Road Perception in Autonomous Driving
por: Tang, Xuewei, et al.
Publicado: (2025)
por: Tang, Xuewei, et al.
Publicado: (2025)
UniDriveDreamer: A Single-Stage Multimodal World Model for Autonomous Driving
por: Zhao, Guosheng, et al.
Publicado: (2026)
por: Zhao, Guosheng, et al.
Publicado: (2026)
UniHash: Unifying Pointwise and Pairwise Hashing Paradigms
por: Ma, Xiaoxu, et al.
Publicado: (2026)
por: Ma, Xiaoxu, et al.
Publicado: (2026)
Let the Abyss Stare Back Adaptive Falsification for Autonomous Scientific Discovery
por: Li, Peiran, et al.
Publicado: (2026)
por: Li, Peiran, et al.
Publicado: (2026)
UniPath: Adaptive Coordination of Understanding and Generation for Unified Multimodal Reasoning
por: Bai, Hayes, et al.
Publicado: (2026)
por: Bai, Hayes, et al.
Publicado: (2026)
"What's Happening"- A Human-centered Multimodal Interpreter Explaining the Actions of Autonomous Vehicles
por: Luo, Xuewen, et al.
Publicado: (2025)
por: Luo, Xuewen, et al.
Publicado: (2025)
The Pulse of Motion: Measuring Physical Frame Rate from Visual Dynamics
por: Gao, Xiangbo, et al.
Publicado: (2026)
por: Gao, Xiangbo, et al.
Publicado: (2026)
An Autonomous Driving Model Integrated with BEV-V2X Perception, Fusion Prediction of Motion and Occupancy, and Driving Planning, in Complex Traffic Intersections
por: Li, Fukang, et al.
Publicado: (2023)
por: Li, Fukang, et al.
Publicado: (2023)
Does RLVR Extend Reasoning Boundaries? Investigating Capability Expansion in Vision-Language Models
por: Shen, Minghe, et al.
Publicado: (2025)
por: Shen, Minghe, et al.
Publicado: (2025)
ADS-Edit: A Multimodal Knowledge Editing Dataset for Autonomous Driving Systems
por: Wang, Chenxi, et al.
Publicado: (2025)
por: Wang, Chenxi, et al.
Publicado: (2025)
UniUncer: Unified Dynamic Static Uncertainty for End to End Driving
por: Gao, Yu, et al.
Publicado: (2026)
por: Gao, Yu, et al.
Publicado: (2026)
SEPT: Standard-Definition Map Enhanced Scene Perception and Topology Reasoning for Autonomous Driving
por: Pei, Muleilan, et al.
Publicado: (2025)
por: Pei, Muleilan, et al.
Publicado: (2025)
Ejemplares similares
-
AirV2X: Unified Air-Ground Vehicle-to-Everything Collaboration
por: Gao, Xiangbo, et al.
Publicado: (2025) -
Edge-Based Multimodal Sensor Data Fusion with Vision Language Models (VLMs) for Real-time Autonomous Vehicle Accident Avoidance
por: Yang, Fengze, et al.
Publicado: (2025) -
SenseRAG: Constructing Environmental Knowledge Bases with Proactive Querying for LLM-Based Autonomous Driving
por: Luo, Xuewen, et al.
Publicado: (2025) -
DRAMA-X: A Fine-grained Intent Prediction and Risk Reasoning Benchmark For Driving
por: Godbole, Mihir, et al.
Publicado: (2025) -
UniPool: A Globally Shared Expert Pool for Mixture-of-Experts
por: Huang, Minbin, et al.
Publicado: (2026)