A Novel Multi-layer Task-centric and Data Quality Framework for Autonomous Driving
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhou, Yuhan, Chen, Haihua, Sha, Kewei |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Modeling and Measuring Redundancy in Multisource Multimodal Data for Autonomous Driving
por: Zhou, Yuhan, et al.
Publicado: (2026)
por: Zhou, Yuhan, et al.
Publicado: (2026)
iPad: Iterative Proposal-centric End-to-End Autonomous Driving
por: Guo, Ke, et al.
Publicado: (2025)
por: Guo, Ke, et al.
Publicado: (2025)
EMT: A Visual Multi-Task Benchmark Dataset for Autonomous Driving
por: Madjid, Nadya Abdel, et al.
Publicado: (2025)
por: Madjid, Nadya Abdel, et al.
Publicado: (2025)
Drive-KD: Multi-Teacher Distillation for VLMs in Autonomous Driving
por: Lian, Weitong, et al.
Publicado: (2026)
por: Lian, Weitong, et al.
Publicado: (2026)
A Simple Efficiency Incremental Learning Framework via Vision-Language Model with Nonlinear Multi-Adapters
por: Luo, Haihua, et al.
Publicado: (2026)
por: Luo, Haihua, et al.
Publicado: (2026)
DriveVLA-W0: World Models Amplify Data Scaling Law in Autonomous Driving
por: Li, Yingyan, et al.
Publicado: (2025)
por: Li, Yingyan, et al.
Publicado: (2025)
Rethinking Driving World Model as Synthetic Data Generator for Perception Tasks
por: Zeng, Kai, et al.
Publicado: (2025)
por: Zeng, Kai, et al.
Publicado: (2025)
Image-Guided Outdoor LiDAR Perception Quality Assessment for Autonomous Driving
por: Zhang, Ce, et al.
Publicado: (2024)
por: Zhang, Ce, et al.
Publicado: (2024)
Exploring Radar Data Representations in Autonomous Driving: A Comprehensive Review
por: Yao, Shanliang, et al.
Publicado: (2023)
por: Yao, Shanliang, et al.
Publicado: (2023)
ST-Prune: Training-Free Spatio-Temporal Token Pruning for Vision-Language Models in Autonomous Driving
por: Sha, Lin, et al.
Publicado: (2026)
por: Sha, Lin, et al.
Publicado: (2026)
Towards a Multi-Agent Vision-Language System for Zero-Shot Novel Hazardous Object Detection for Autonomous Driving Safety
por: Shriram, Shashank, et al.
Publicado: (2025)
por: Shriram, Shashank, et al.
Publicado: (2025)
OmniDrive-R1: Reinforcement-driven Interleaved Multi-modal Chain-of-Thought for Trustworthy Vision-Language Autonomous Driving
por: Zhang, Zhenguo, et al.
Publicado: (2025)
por: Zhang, Zhenguo, et al.
Publicado: (2025)
CoWorld-VLA: Thinking in a Multi-Expert World Model for Autonomous Driving
por: Huang, Minqing, et al.
Publicado: (2026)
por: Huang, Minqing, et al.
Publicado: (2026)
Data Shift of Object Detection in Autonomous Driving
por: Xu, Lida
Publicado: (2025)
por: Xu, Lida
Publicado: (2025)
Enhancing Vision-Language Models for Autonomous Driving through Task-Specific Prompting and Spatial Reasoning
por: Wu, Aodi, et al.
Publicado: (2025)
por: Wu, Aodi, et al.
Publicado: (2025)
Vision Language Models in Autonomous Driving: A Survey and Outlook
por: Zhou, Xingcheng, et al.
Publicado: (2023)
por: Zhou, Xingcheng, et al.
Publicado: (2023)
H-MBA: Hierarchical MamBa Adaptation for Multi-Modal Video Understanding in Autonomous Driving
por: Chen, Siran, et al.
Publicado: (2025)
por: Chen, Siran, et al.
Publicado: (2025)
A Unified Perception-Language-Action Framework for Adaptive Autonomous Driving
por: Zhang, Yi, et al.
Publicado: (2025)
por: Zhang, Yi, et al.
Publicado: (2025)
Uncertainty-Encoded Multi-Modal Fusion for Robust Object Detection in Autonomous Driving
por: Lou, Yang, et al.
Publicado: (2023)
por: Lou, Yang, et al.
Publicado: (2023)
DriveAction: A Benchmark for Exploring Human-like Driving Decisions in VLA Models
por: Hao, Yuhan, et al.
Publicado: (2025)
por: Hao, Yuhan, et al.
Publicado: (2025)
Multimodal-Enhanced Objectness Learner for Corner Case Detection in Autonomous Driving
por: Xiao, Lixing, et al.
Publicado: (2024)
por: Xiao, Lixing, et al.
Publicado: (2024)
Exploring Camera Encoder Designs for Autonomous Driving Perception
por: Lakshmanan, Barath, et al.
Publicado: (2024)
por: Lakshmanan, Barath, et al.
Publicado: (2024)
DrivingGen: A Comprehensive Benchmark for Generative Video World Models in Autonomous Driving
por: Zhou, Yang, et al.
Publicado: (2026)
por: Zhou, Yang, et al.
Publicado: (2026)
Multi-Scale Spectral Attention Module-based Hyperspectral Segmentation in Autonomous Driving Scenarios
por: Shah, Imad Ali, et al.
Publicado: (2025)
por: Shah, Imad Ali, et al.
Publicado: (2025)
Multi-Frame, Lightweight & Efficient Vision-Language Models for Question Answering in Autonomous Driving
por: Gopalkrishnan, Akshay, et al.
Publicado: (2024)
por: Gopalkrishnan, Akshay, et al.
Publicado: (2024)
VLM-RL: A Unified Vision Language Models and Reinforcement Learning Framework for Safe Autonomous Driving
por: Huang, Zilin, et al.
Publicado: (2024)
por: Huang, Zilin, et al.
Publicado: (2024)
LaVida Drive: Vision-Text Interaction VLM for Autonomous Driving with Token Selection, Recovery and Enhancement
por: Jiao, Siwen, et al.
Publicado: (2024)
por: Jiao, Siwen, et al.
Publicado: (2024)
DriveGenVLM: Real-world Video Generation for Vision Language Model based Autonomous Driving
por: Fu, Yongjie, et al.
Publicado: (2024)
por: Fu, Yongjie, et al.
Publicado: (2024)
ProVision: Programmatically Scaling Vision-centric Instruction Data for Multimodal Language Models
por: Zhang, Jieyu, et al.
Publicado: (2024)
por: Zhang, Jieyu, et al.
Publicado: (2024)
Progressive Homeostatic and Plastic Prompt Tuning for Audio-Visual Multi-Task Incremental Learning
por: Yin, Jiong, et al.
Publicado: (2025)
por: Yin, Jiong, et al.
Publicado: (2025)
FRED: A Multi-Modal Autonomous Driving Dataset for Flooded Road Environments
por: Malone, Connor, et al.
Publicado: (2026)
por: Malone, Connor, et al.
Publicado: (2026)
Towards Full-scene Domain Generalization in Multi-agent Collaborative Bird's Eye View Segmentation for Connected and Autonomous Driving
por: Hu, Senkang, et al.
Publicado: (2023)
por: Hu, Senkang, et al.
Publicado: (2023)
Learning Physical Dynamics for Object-centric Visual Prediction
por: Xu, Huilin, et al.
Publicado: (2024)
por: Xu, Huilin, et al.
Publicado: (2024)
Towards Adaptive Human-centric Video Anomaly Detection: A Comprehensive Framework and A New Benchmark
por: Pazho, Armin Danesh, et al.
Publicado: (2024)
por: Pazho, Armin Danesh, et al.
Publicado: (2024)
VGA-Bench: A Unified Benchmark and Multi-Model Framework for Video Aesthetics and Generation Quality Evaluation
por: Jiang, Longteng, et al.
Publicado: (2026)
por: Jiang, Longteng, et al.
Publicado: (2026)
Adversarial Flow Matching for Imperceptible Attacks on End-to-End Autonomous Driving
por: Zeng, Xinyu, et al.
Publicado: (2026)
por: Zeng, Xinyu, et al.
Publicado: (2026)
WaymoQA: A Multi-View Visual Question Answering Dataset for Safety-Critical Reasoning in Autonomous Driving
por: Yu, Seungjun, et al.
Publicado: (2025)
por: Yu, Seungjun, et al.
Publicado: (2025)
DAP: A Discrete-token Autoregressive Planner for Autonomous Driving
por: Ye, Bowen, et al.
Publicado: (2025)
por: Ye, Bowen, et al.
Publicado: (2025)
MHLA: Restoring Expressivity of Linear Attention via Token-Level Multi-Head
por: Zhang, Kewei, et al.
Publicado: (2026)
por: Zhang, Kewei, et al.
Publicado: (2026)
Generative AI for Autonomous Driving: Frontiers and Opportunities
por: Wang, Yuping, et al.
Publicado: (2025)
por: Wang, Yuping, et al.
Publicado: (2025)
Ejemplares similares
-
Modeling and Measuring Redundancy in Multisource Multimodal Data for Autonomous Driving
por: Zhou, Yuhan, et al.
Publicado: (2026) -
iPad: Iterative Proposal-centric End-to-End Autonomous Driving
por: Guo, Ke, et al.
Publicado: (2025) -
EMT: A Visual Multi-Task Benchmark Dataset for Autonomous Driving
por: Madjid, Nadya Abdel, et al.
Publicado: (2025) -
Drive-KD: Multi-Teacher Distillation for VLMs in Autonomous Driving
por: Lian, Weitong, et al.
Publicado: (2026) -
A Simple Efficiency Incremental Learning Framework via Vision-Language Model with Nonlinear Multi-Adapters
por: Luo, Haihua, et al.
Publicado: (2026)