Forging Vision Foundation Models for Autonomous Driving: Challenges, Methodologies, and Opportunities
Fuente:
arXiv
Salvato in:
| Autori principali: | Yan, Xu, Zhang, Haiming, Cai, Yingjie, Guo, Jingming, Qiu, Weichao, Gao, Bin, Zhou, Kaiqiang, Zhao, Yue, Jin, Huan, Gao, Jiantao, Li, Zhen, Jiang, Lihui, Zhang, Wei, Zhang, Hongbo, Dai, Dengxin, Liu, Bingbing |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
VisionPAD: A Vision-Centric Pre-training Paradigm for Autonomous Driving
di: Zhang, Haiming, et al.
Pubblicazione: (2024)
di: Zhang, Haiming, et al.
Pubblicazione: (2024)
DLWM: Dual Latent World Models enable Holistic Gaussian-centric Pre-training in Autonomous Driving
di: Zhu, Yiyao, et al.
Pubblicazione: (2026)
di: Zhu, Yiyao, et al.
Pubblicazione: (2026)
Prioritizing Perception-Guided Self-Supervision: A New Paradigm for Causal Modeling in End-to-End Autonomous Driving
di: Huang, Yi, et al.
Pubblicazione: (2025)
di: Huang, Yi, et al.
Pubblicazione: (2025)
SQS: Enhancing Sparse Perception Models via Query-based Splatting in Autonomous Driving
di: Zhang, Haiming, et al.
Pubblicazione: (2025)
di: Zhang, Haiming, et al.
Pubblicazione: (2025)
NuGrounding: A Multi-View 3D Visual Grounding Framework in Autonomous Driving
di: Li, Fuhao, et al.
Pubblicazione: (2025)
di: Li, Fuhao, et al.
Pubblicazione: (2025)
An Efficient Occupancy World Model via Decoupled Dynamic Flow and Image-assisted Training
di: Zhang, Haiming, et al.
Pubblicazione: (2024)
di: Zhang, Haiming, et al.
Pubblicazione: (2024)
Driving with DINO: Vision Foundation Features as a Unified Bridge for Sim-to-Real Generation in Autonomous Driving
di: Chen, Xuyang, et al.
Pubblicazione: (2026)
di: Chen, Xuyang, et al.
Pubblicazione: (2026)
OmniBooth: Learning Latent Control for Image Synthesis with Multi-modal Instruction
di: Li, Leheng, et al.
Pubblicazione: (2024)
di: Li, Leheng, et al.
Pubblicazione: (2024)
PG-Attack: A Precision-Guided Adversarial Attack Framework Against Vision Foundation Models for Autonomous Driving
di: Fu, Jiyuan, et al.
Pubblicazione: (2024)
di: Fu, Jiyuan, et al.
Pubblicazione: (2024)
ECCV 2024 W-CODA: 1st Workshop on Multimodal Perception and Comprehension of Corner Cases in Autonomous Driving
di: Chen, Kai, et al.
Pubblicazione: (2025)
di: Chen, Kai, et al.
Pubblicazione: (2025)
Towards Unbiased Source-Free Object Detection via Vision Foundation Models
di: Cai, Zhi, et al.
Pubblicazione: (2026)
di: Cai, Zhi, et al.
Pubblicazione: (2026)
Lotus: Diffusion-based Visual Foundation Model for High-quality Dense Prediction
di: He, Jing, et al.
Pubblicazione: (2024)
di: He, Jing, et al.
Pubblicazione: (2024)
Dynamic Transfer of Chiral Edge States in Topological Type-II Hyperbolic Lattices
di: Chen, Jingming, et al.
Pubblicazione: (2025)
di: Chen, Jingming, et al.
Pubblicazione: (2025)
Higher-order Topological Type-II Hyperbolic Lattices
di: Chen, Liren, et al.
Pubblicazione: (2026)
di: Chen, Liren, et al.
Pubblicazione: (2026)
All-Optical Segmentation via Diffractive Neural Networks for Autonomous Driving
di: Li, Yingjie, et al.
Pubblicazione: (2026)
di: Li, Yingjie, et al.
Pubblicazione: (2026)
Application of Vision-Language Model to Pedestrians Behavior and Scene Understanding in Autonomous Driving
di: Gao, Haoxiang, et al.
Pubblicazione: (2025)
di: Gao, Haoxiang, et al.
Pubblicazione: (2025)
Occ-LLM: Enhancing Autonomous Driving with Occupancy-Based Large Language Models
di: Xu, Tianshuo, et al.
Pubblicazione: (2025)
di: Xu, Tianshuo, et al.
Pubblicazione: (2025)
Large Language Models and Foundation Models in Smart Agriculture: Basics, Opportunities, and Challenges
di: Li, Jiajia, et al.
Pubblicazione: (2023)
di: Li, Jiajia, et al.
Pubblicazione: (2023)
Decision Transformer as a Foundation Model for Partially Observable Continuous Control
di: Zhang, Xiangyuan, et al.
Pubblicazione: (2024)
di: Zhang, Xiangyuan, et al.
Pubblicazione: (2024)
A Survey for Foundation Models in Autonomous Driving
di: Gao, Haoxiang, et al.
Pubblicazione: (2024)
di: Gao, Haoxiang, et al.
Pubblicazione: (2024)
Toward Fully Autonomous Driving: AI, Challenges, Opportunities, and Needs
di: Ullrich, Lars, et al.
Pubblicazione: (2026)
di: Ullrich, Lars, et al.
Pubblicazione: (2026)
Advancing Sensory Modulation Wound Healing of Bionic Polymer Microneedle Patch
di: Shana Zhang, et al.
Pubblicazione: (2025)
di: Shana Zhang, et al.
Pubblicazione: (2025)
WiseAD: Knowledge Augmented End-to-End Autonomous Driving with Vision-Language Model
di: Zhang, Songyan, et al.
Pubblicazione: (2024)
di: Zhang, Songyan, et al.
Pubblicazione: (2024)
AlignDrive: Aligned Lateral-Longitudinal Planning for End-to-End Autonomous Driving
di: Wu, Yanhao, et al.
Pubblicazione: (2026)
di: Wu, Yanhao, et al.
Pubblicazione: (2026)
RealDriveSim: A Realistic Multi-Modal Multi-Task Synthetic Dataset for Autonomous Driving
di: Jadon, Arpit, et al.
Pubblicazione: (2025)
di: Jadon, Arpit, et al.
Pubblicazione: (2025)
Advancing Autonomous Driving System Testing: Demands, Challenges, and Future Directions
di: Liao, Yihan, et al.
Pubblicazione: (2025)
di: Liao, Yihan, et al.
Pubblicazione: (2025)
Test-Time Adaptive Object Detection with Foundation Model
di: Gao, Yingjie, et al.
Pubblicazione: (2025)
di: Gao, Yingjie, et al.
Pubblicazione: (2025)
Reconfigurable Intelligent Surface Empowered Full Duplex Systems: Opportunities and Challenges
di: Huang, Chong, et al.
Pubblicazione: (2024)
di: Huang, Chong, et al.
Pubblicazione: (2024)
MedForge: Building Medical Foundation Models Like Open Source Software Development
di: Tan, Zheling, et al.
Pubblicazione: (2025)
di: Tan, Zheling, et al.
Pubblicazione: (2025)
Spatio-Temporal Foundation Models: Vision, Challenges, and Opportunities
di: Goodge, Adam, et al.
Pubblicazione: (2025)
di: Goodge, Adam, et al.
Pubblicazione: (2025)
VECTOR-Drive: Tightly Coupled Vision-Language and Trajectory Expert Routing for End-to-End Autonomous Driving
di: Zhao, Rui, et al.
Pubblicazione: (2026)
di: Zhao, Rui, et al.
Pubblicazione: (2026)
Investigating the Methodology of Multisource Data Fusion in Wind Speed Forecasting Correction
di: Julong Chen, et al.
Pubblicazione: (2025)
di: Julong Chen, et al.
Pubblicazione: (2025)
Ego-centric Learning of Communicative World Models for Autonomous Driving
di: Wang, Hang, et al.
Pubblicazione: (2025)
di: Wang, Hang, et al.
Pubblicazione: (2025)
Collaborative Perception for Connected and Autonomous Driving: Challenges, Possible Solutions and Opportunities
di: Hu, Senkang, et al.
Pubblicazione: (2024)
di: Hu, Senkang, et al.
Pubblicazione: (2024)
VLADriver-RAG: Retrieval-Augmented Vision-Language-Action Models for Autonomous Driving
di: Zhao, Rui, et al.
Pubblicazione: (2026)
di: Zhao, Rui, et al.
Pubblicazione: (2026)
Forging a Dynamic Memory: Retrieval-Guided Continual Learning for Generalist Medical Foundation Models
di: Chen, Zizhi, et al.
Pubblicazione: (2025)
di: Chen, Zizhi, et al.
Pubblicazione: (2025)
Application of Machine Learning in Stock Market Forecasting: A Case Study of Disney Stock
di: Huang, Dengxin
Pubblicazione: (2023)
di: Huang, Dengxin
Pubblicazione: (2023)
Evaluation of Safety Cognition Capability in Vision-Language Models for Autonomous Driving
di: Zhang, Enming, et al.
Pubblicazione: (2025)
di: Zhang, Enming, et al.
Pubblicazione: (2025)
One Language-Free Foundation Model Is Enough for Universal Vision Anomaly Detection
di: Gao, Bin-Bin, et al.
Pubblicazione: (2026)
di: Gao, Bin-Bin, et al.
Pubblicazione: (2026)
Generative AI for Autonomous Driving: Frontiers and Opportunities
di: Wang, Yuping, et al.
Pubblicazione: (2025)
di: Wang, Yuping, et al.
Pubblicazione: (2025)
Documenti analoghi
-
VisionPAD: A Vision-Centric Pre-training Paradigm for Autonomous Driving
di: Zhang, Haiming, et al.
Pubblicazione: (2024) -
DLWM: Dual Latent World Models enable Holistic Gaussian-centric Pre-training in Autonomous Driving
di: Zhu, Yiyao, et al.
Pubblicazione: (2026) -
Prioritizing Perception-Guided Self-Supervision: A New Paradigm for Causal Modeling in End-to-End Autonomous Driving
di: Huang, Yi, et al.
Pubblicazione: (2025) -
SQS: Enhancing Sparse Perception Models via Query-based Splatting in Autonomous Driving
di: Zhang, Haiming, et al.
Pubblicazione: (2025) -
NuGrounding: A Multi-View 3D Visual Grounding Framework in Autonomous Driving
di: Li, Fuhao, et al.
Pubblicazione: (2025)