GPT-4V Explorations: Mining Autonomous Driving
Fuente:
arXiv
Guardado en:
| Autor principal: | Li, Zixuan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
DriveGPT4: Interpretable End-to-end Autonomous Driving via Large Language Model
por: Xu, Zhenhua, et al.
Publicado: (2023)
por: Xu, Zhenhua, et al.
Publicado: (2023)
DrivingWorld: Constructing World Model for Autonomous Driving via Video GPT
por: Hu, Xiaotao, et al.
Publicado: (2024)
por: Hu, Xiaotao, et al.
Publicado: (2024)
ExploreVLA: Dense World Modeling and Exploration for End-to-End Autonomous Driving
por: Sheng, Zihao, et al.
Publicado: (2026)
por: Sheng, Zihao, et al.
Publicado: (2026)
SparseDriveV2: Scoring is All You Need for End-to-End Autonomous Driving
por: Sun, Wenchao, et al.
Publicado: (2026)
por: Sun, Wenchao, et al.
Publicado: (2026)
GPT-4 Enhanced Multimodal Grounding for Autonomous Driving: Leveraging Cross-Modal Attention with Large Language Models
por: Liao, Haicheng, et al.
Publicado: (2023)
por: Liao, Haicheng, et al.
Publicado: (2023)
MagicDrive-V2: High-Resolution Long Video Generation for Autonomous Driving with Adaptive Control
por: Gao, Ruiyuan, et al.
Publicado: (2024)
por: Gao, Ruiyuan, et al.
Publicado: (2024)
DrivingRecon: Large 4D Gaussian Reconstruction Model For Autonomous Driving
por: Lu, Hao, et al.
Publicado: (2024)
por: Lu, Hao, et al.
Publicado: (2024)
GPT-4V-AD: Exploring Grounding Potential of VQA-oriented GPT-4V for Zero-shot Anomaly Detection
por: Zhang, Jiangning, et al.
Publicado: (2023)
por: Zhang, Jiangning, et al.
Publicado: (2023)
ImagiDrive: A Unified Imagination-and-Planning Framework for Autonomous Driving
por: Li, Jingyu, et al.
Publicado: (2025)
por: Li, Jingyu, et al.
Publicado: (2025)
DiffusionDriveV2: Reinforcement Learning-Constrained Truncated Diffusion Modeling in End-to-End Autonomous Driving
por: Zou, Jialv, et al.
Publicado: (2025)
por: Zou, Jialv, et al.
Publicado: (2025)
DriveWorld: 4D Pre-trained Scene Understanding via World Models for Autonomous Driving
por: Min, Chen, et al.
Publicado: (2024)
por: Min, Chen, et al.
Publicado: (2024)
MiniCPM-V: A GPT-4V Level MLLM on Your Phone
por: Yao, Yuan, et al.
Publicado: (2024)
por: Yao, Yuan, et al.
Publicado: (2024)
Harnessing GPT-4V(ision) for Insurance: A Preliminary Exploration
por: Lin, Chenwei, et al.
Publicado: (2024)
por: Lin, Chenwei, et al.
Publicado: (2024)
Open 3D World in Autonomous Driving
por: Cheng, Xinlong, et al.
Publicado: (2024)
por: Cheng, Xinlong, et al.
Publicado: (2024)
World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model
por: Zheng, Yupeng, et al.
Publicado: (2025)
por: Zheng, Yupeng, et al.
Publicado: (2025)
Data-Centric Evolution in Autonomous Driving: A Comprehensive Survey of Big Data System, Data Mining, and Closed-Loop Technologies
por: Li, Lincan, et al.
Publicado: (2024)
por: Li, Lincan, et al.
Publicado: (2024)
Image and Data Mining in Reticular Chemistry Using GPT-4V
por: Zheng, Zhiling, et al.
Publicado: (2023)
por: Zheng, Zhiling, et al.
Publicado: (2023)
ITPNet: Towards Instantaneous Trajectory Prediction for Autonomous Driving
por: Li, Rongqing, et al.
Publicado: (2024)
por: Li, Rongqing, et al.
Publicado: (2024)
PADriver: Towards Personalized Autonomous Driving
por: Kou, Genghua, et al.
Publicado: (2025)
por: Kou, Genghua, et al.
Publicado: (2025)
RadarMP: Motion Perception for 4D mmWave Radar in Autonomous Driving
por: Cheng, Ruiqi, et al.
Publicado: (2025)
por: Cheng, Ruiqi, et al.
Publicado: (2025)
Unified End-to-End V2X Cooperative Autonomous Driving
por: Li, Zhiwei, et al.
Publicado: (2024)
por: Li, Zhiwei, et al.
Publicado: (2024)
V3LMA: Visual 3D-enhanced Language Model for Autonomous Driving
por: Lübberstedt, Jannik, et al.
Publicado: (2025)
por: Lübberstedt, Jannik, et al.
Publicado: (2025)
DeMo++: Motion Decoupling for Autonomous Driving
por: Zhang, Bozhou, et al.
Publicado: (2025)
por: Zhang, Bozhou, et al.
Publicado: (2025)
D2-V2X: Depth-Driven Cooperative V2X Reasoning for Autonomous Driving
por: Richard, Kevin, et al.
Publicado: (2026)
por: Richard, Kevin, et al.
Publicado: (2026)
SpaceDrive: Infusing Spatial Awareness into VLM-based Autonomous Driving
por: Li, Peizheng, et al.
Publicado: (2025)
por: Li, Peizheng, et al.
Publicado: (2025)
DriveFuture: Future-Aware Latent World Models for Autonomous Driving
por: Hong, Yufeng, et al.
Publicado: (2026)
por: Hong, Yufeng, et al.
Publicado: (2026)
DriveLiDAR4D: Sequential and Controllable LiDAR Scene Generation for Autonomous Driving
por: Cai, Kaiwen, et al.
Publicado: (2025)
por: Cai, Kaiwen, et al.
Publicado: (2025)
DriveVLM: The Convergence of Autonomous Driving and Large Vision-Language Models
por: Tian, Xiaoyu, et al.
Publicado: (2024)
por: Tian, Xiaoyu, et al.
Publicado: (2024)
Language Prompt for Autonomous Driving
por: Wu, Dongming, et al.
Publicado: (2023)
por: Wu, Dongming, et al.
Publicado: (2023)
DynamicVGGT: Learning Dynamic Point Maps for 4D Scene Reconstruction in Autonomous Driving
por: He, Zhuolin, et al.
Publicado: (2026)
por: He, Zhuolin, et al.
Publicado: (2026)
DriveCombo: Benchmarking Compositional Traffic Rule Reasoning in Autonomous Driving
por: Ma, Enhui, et al.
Publicado: (2026)
por: Ma, Enhui, et al.
Publicado: (2026)
Post-interactive Multimodal Trajectory Prediction for Autonomous Driving
por: Huang, Ziyi, et al.
Publicado: (2025)
por: Huang, Ziyi, et al.
Publicado: (2025)
OmniScene: Attention-Augmented Multimodal 4D Scene Understanding for Autonomous Driving
por: Liu, Pei, et al.
Publicado: (2025)
por: Liu, Pei, et al.
Publicado: (2025)
DeepInteraction++: Multi-Modality Interaction for Autonomous Driving
por: Yang, Zeyu, et al.
Publicado: (2024)
por: Yang, Zeyu, et al.
Publicado: (2024)
Reason2Drive: Towards Interpretable and Chain-based Reasoning for Autonomous Driving
por: Nie, Ming, et al.
Publicado: (2023)
por: Nie, Ming, et al.
Publicado: (2023)
Driving with InternVL: Oustanding Champion in the Track on Driving with Language of the Autonomous Grand Challenge at CVPR 2024
por: Li, Jiahan, et al.
Publicado: (2024)
por: Li, Jiahan, et al.
Publicado: (2024)
Applications of Large Scale Foundation Models for Autonomous Driving
por: Huang, Yu, et al.
Publicado: (2023)
por: Huang, Yu, et al.
Publicado: (2023)
Neural Radiance Field in Autonomous Driving: A Survey
por: He, Lei, et al.
Publicado: (2024)
por: He, Lei, et al.
Publicado: (2024)
DriveX: Omni Scene Modeling for Learning Generalizable World Knowledge in Autonomous Driving
por: Shi, Chen, et al.
Publicado: (2025)
por: Shi, Chen, et al.
Publicado: (2025)
DrivePI: Spatial-aware 4D MLLM for Unified Autonomous Driving Understanding, Perception, Prediction and Planning
por: Liu, Zhe, et al.
Publicado: (2025)
por: Liu, Zhe, et al.
Publicado: (2025)
Ejemplares similares
-
DriveGPT4: Interpretable End-to-end Autonomous Driving via Large Language Model
por: Xu, Zhenhua, et al.
Publicado: (2023) -
DrivingWorld: Constructing World Model for Autonomous Driving via Video GPT
por: Hu, Xiaotao, et al.
Publicado: (2024) -
ExploreVLA: Dense World Modeling and Exploration for End-to-End Autonomous Driving
por: Sheng, Zihao, et al.
Publicado: (2026) -
SparseDriveV2: Scoring is All You Need for End-to-End Autonomous Driving
por: Sun, Wenchao, et al.
Publicado: (2026) -
GPT-4 Enhanced Multimodal Grounding for Autonomous Driving: Leveraging Cross-Modal Attention with Large Language Models
por: Liao, Haicheng, et al.
Publicado: (2023)