MMTL-UniAD: A Unified Framework for Multimodal and Multi-Task Learning in Assistive Driving Perception
Fuente:
arXiv
Salvato in:
| Autori principali: | Liu, Wenzhuo, Wang, Wenshuo, Qiao, Yicheng, Guo, Qiannan, Zhu, Jiayin, Li, Pengfei, Chen, Zilong, Yang, Huiming, Li, Zhiwei, Wang, Lening, Tan, Tiao, Liu, Huaping |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
UV-M3TL: A Unified and Versatile Multimodal Multi-Task Learning Framework for Assistive Driving Perception
di: Liu, Wenzhuo, et al.
Pubblicazione: (2026)
di: Liu, Wenzhuo, et al.
Pubblicazione: (2026)
TEM^3-Learning: Time-Efficient Multimodal Multi-Task Learning for Advanced Assistive Driving
di: Liu, Wenzhuo, et al.
Pubblicazione: (2025)
di: Liu, Wenzhuo, et al.
Pubblicazione: (2025)
CrossRay3D: Geometry and Distribution Guidance for Efficient Multimodal 3D Detection
di: Yang, Huiming, et al.
Pubblicazione: (2025)
di: Yang, Huiming, et al.
Pubblicazione: (2025)
MIPD: A Multi-sensory Interactive Perception Dataset for Embodied Intelligent Driving
di: Li, Zhiwei, et al.
Pubblicazione: (2024)
di: Li, Zhiwei, et al.
Pubblicazione: (2024)
UniDriveVLA: Unifying Understanding, Perception, and Action Planning for Autonomous Driving
di: Li, Yongkang, et al.
Pubblicazione: (2026)
di: Li, Yongkang, et al.
Pubblicazione: (2026)
Unified End-to-End V2X Cooperative Autonomous Driving
di: Li, Zhiwei, et al.
Pubblicazione: (2024)
di: Li, Zhiwei, et al.
Pubblicazione: (2024)
UniRS: Unifying Multi-temporal Remote Sensing Tasks through Vision Language Models
di: Li, Yujie, et al.
Pubblicazione: (2024)
di: Li, Yujie, et al.
Pubblicazione: (2024)
The Effects of Communication Delay on Human Performance and Neurocognitive Responses in Mobile Robot Teleoperation
di: Chen, Zhaokun, et al.
Pubblicazione: (2025)
di: Chen, Zhaokun, et al.
Pubblicazione: (2025)
DiffAD: A Unified Diffusion Modeling Approach for Autonomous Driving
di: Wang, Tao, et al.
Pubblicazione: (2025)
di: Wang, Tao, et al.
Pubblicazione: (2025)
Text-to-3D using Gaussian Splatting
di: Chen, Zilong, et al.
Pubblicazione: (2023)
di: Chen, Zilong, et al.
Pubblicazione: (2023)
UniAlignment: Semantic Alignment for Unified Image Generation, Understanding, Manipulation and Perception
di: Song, Xinyang, et al.
Pubblicazione: (2025)
di: Song, Xinyang, et al.
Pubblicazione: (2025)
Cognitive-Causal Multi-Task Learning with Psychological State Conditioning for Assistive Driving Perception
di: Inoshita, Keito, et al.
Pubblicazione: (2026)
di: Inoshita, Keito, et al.
Pubblicazione: (2026)
SymDrive: Realistic and Controllable Driving Simulator via Symmetric Auto-regressive Online Restoration
di: Liu, Zhiyuan, et al.
Pubblicazione: (2025)
di: Liu, Zhiyuan, et al.
Pubblicazione: (2025)
UniFormer: Unifying Convolution and Self-attention for Visual Recognition
di: Li, Kunchang, et al.
Pubblicazione: (2022)
di: Li, Kunchang, et al.
Pubblicazione: (2022)
UniScene: Unified Occupancy-centric Driving Scene Generation
di: Li, Bohan, et al.
Pubblicazione: (2024)
di: Li, Bohan, et al.
Pubblicazione: (2024)
V2X-UniPool: Unifying Multimodal Perception and Knowledge Reasoning for Autonomous Driving
di: Luo, Xuewen, et al.
Pubblicazione: (2025)
di: Luo, Xuewen, et al.
Pubblicazione: (2025)
On the Utility of External Agent Intention Predictor for Human-AI Coordination
di: Wang, Chenxu, et al.
Pubblicazione: (2024)
di: Wang, Chenxu, et al.
Pubblicazione: (2024)
UniDrive: Towards Universal Driving Perception Across Camera Configurations
di: Li, Ye, et al.
Pubblicazione: (2024)
di: Li, Ye, et al.
Pubblicazione: (2024)
UniAV: Unified Audio-Visual Perception for Multi-Task Video Event Localization
di: Geng, Tiantian, et al.
Pubblicazione: (2024)
di: Geng, Tiantian, et al.
Pubblicazione: (2024)
UniVideo: Unified Understanding, Generation, and Editing for Videos
di: Wei, Cong, et al.
Pubblicazione: (2025)
di: Wei, Cong, et al.
Pubblicazione: (2025)
V3D: Video Diffusion Models are Effective 3D Generators
di: Chen, Zilong, et al.
Pubblicazione: (2024)
di: Chen, Zilong, et al.
Pubblicazione: (2024)
UniLION: Towards Unified Autonomous Driving Model with Linear Group RNNs
di: Liu, Zhe, et al.
Pubblicazione: (2025)
di: Liu, Zhe, et al.
Pubblicazione: (2025)
Uni-Edit: Intelligent Editing Is A General Task For Unified Model Tuning
di: Zheng, Dian, et al.
Pubblicazione: (2026)
di: Zheng, Dian, et al.
Pubblicazione: (2026)
6‐1: Multi‐dimensional Convertible Optical See‐through Head‐mounted Display Using Multiplexed Holographic Optical Element
di: Qiang Li, et al.
Pubblicazione: (2024)
di: Qiang Li, et al.
Pubblicazione: (2024)
Uni-NaVid: A Video-based Vision-Language-Action Model for Unifying Embodied Navigation Tasks
di: Zhang, Jiazhao, et al.
Pubblicazione: (2024)
di: Zhang, Jiazhao, et al.
Pubblicazione: (2024)
OpenAD: Open-World Autonomous Driving Benchmark for 3D Object Detection
di: Xia, Zhongyu, et al.
Pubblicazione: (2024)
di: Xia, Zhongyu, et al.
Pubblicazione: (2024)
Unified 4D World Action Modeling from Video Priors with Asynchronous Denoising
di: Guo, Jun, et al.
Pubblicazione: (2026)
di: Guo, Jun, et al.
Pubblicazione: (2026)
UniHead: Unifying Multi-Perception for Detection Heads
di: Zhou, Hantao, et al.
Pubblicazione: (2023)
di: Zhou, Hantao, et al.
Pubblicazione: (2023)
UniFlow: Unifying Speech Front-End Tasks via Continuous Generative Modeling
di: Wang, Ziqian, et al.
Pubblicazione: (2025)
di: Wang, Ziqian, et al.
Pubblicazione: (2025)
UniOcc: A Unified Benchmark for Occupancy Forecasting and Prediction in Autonomous Driving
di: Wang, Yuping, et al.
Pubblicazione: (2025)
di: Wang, Yuping, et al.
Pubblicazione: (2025)
UniMixer: A Unified Architecture for Scaling Laws in Recommendation Systems
di: Ha, Mingming, et al.
Pubblicazione: (2026)
di: Ha, Mingming, et al.
Pubblicazione: (2026)
UniMMVSR: A Unified Multi-Modal Framework for Cascaded Video Super-Resolution
di: Du, Shian, et al.
Pubblicazione: (2025)
di: Du, Shian, et al.
Pubblicazione: (2025)
UniCode: Learning a Unified Codebook for Multimodal Large Language Models
di: Zheng, Sipeng, et al.
Pubblicazione: (2024)
di: Zheng, Sipeng, et al.
Pubblicazione: (2024)
UniUncer: Unified Dynamic Static Uncertainty for End to End Driving
di: Gao, Yu, et al.
Pubblicazione: (2026)
di: Gao, Yu, et al.
Pubblicazione: (2026)
UniVision: A Unified Framework for Vision-Centric 3D Perception
di: Hong, Yu, et al.
Pubblicazione: (2024)
di: Hong, Yu, et al.
Pubblicazione: (2024)
UniDWM: Towards a Unified Driving World Model via Multifaceted Representation Learning
di: Liu, Shuai, et al.
Pubblicazione: (2026)
di: Liu, Shuai, et al.
Pubblicazione: (2026)
UniPercept: Towards Unified Perceptual-Level Image Understanding across Aesthetics, Quality, Structure, and Texture
di: Cao, Shuo, et al.
Pubblicazione: (2025)
di: Cao, Shuo, et al.
Pubblicazione: (2025)
UniDrive-WM: Unified Understanding, Planning and Generation World Model For Autonomous Driving
di: Xiong, Zhexiao, et al.
Pubblicazione: (2026)
di: Xiong, Zhexiao, et al.
Pubblicazione: (2026)
UniGaussian: Driving Scene Reconstruction from Multiple Camera Models via Unified Gaussian Representations
di: Ren, Yuan, et al.
Pubblicazione: (2024)
di: Ren, Yuan, et al.
Pubblicazione: (2024)
A Comprehensive Review of 3D Object Detection in Autonomous Driving: Technological Advances and Future Directions
di: Wang, Yu, et al.
Pubblicazione: (2024)
di: Wang, Yu, et al.
Pubblicazione: (2024)
Documenti analoghi
-
UV-M3TL: A Unified and Versatile Multimodal Multi-Task Learning Framework for Assistive Driving Perception
di: Liu, Wenzhuo, et al.
Pubblicazione: (2026) -
TEM^3-Learning: Time-Efficient Multimodal Multi-Task Learning for Advanced Assistive Driving
di: Liu, Wenzhuo, et al.
Pubblicazione: (2025) -
CrossRay3D: Geometry and Distribution Guidance for Efficient Multimodal 3D Detection
di: Yang, Huiming, et al.
Pubblicazione: (2025) -
MIPD: A Multi-sensory Interactive Perception Dataset for Embodied Intelligent Driving
di: Li, Zhiwei, et al.
Pubblicazione: (2024) -
UniDriveVLA: Unifying Understanding, Perception, and Action Planning for Autonomous Driving
di: Li, Yongkang, et al.
Pubblicazione: (2026)