Driving with InternVL: Oustanding Champion in the Track on Driving with Language of the Autonomous Grand Challenge at CVPR 2024
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Jiahan, Li, Zhiqi, Lu, Tong |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
InternVL-X: Advancing and Accelerating InternVL Series with Efficient Visual Token Compression
par: Lu, Dongchen, et autres
Publié: (2025)
par: Lu, Dongchen, et autres
Publié: (2025)
The System Description of CPS Team for Track on Driving with Language of CVPR 2024 Autonomous Grand Challenge
par: Peng, Jinghan, et autres
Publié: (2025)
par: Peng, Jinghan, et autres
Publié: (2025)
InternVL: Scaling up Vision Foundation Models and Aligning for Generic Visual-Linguistic Tasks
par: Chen, Zhe, et autres
Publié: (2023)
par: Chen, Zhe, et autres
Publié: (2023)
MapVision: CVPR 2024 Autonomous Grand Challenge Mapless Driving Tech Report
par: Yang, Zhongyu, et autres
Publié: (2024)
par: Yang, Zhongyu, et autres
Publié: (2024)
Mini-InternVL: A Flexible-Transfer Pocket Multimodal Model with 5% Parameters and 90% Performance
par: Gao, Zhangwei, et autres
Publié: (2024)
par: Gao, Zhangwei, et autres
Publié: (2024)
Mono-InternVL-1.5: Towards Cheaper and Faster Monolithic Multimodal Large Language Models
par: Luo, Gen, et autres
Publié: (2025)
par: Luo, Gen, et autres
Publié: (2025)
InternVL-U: Democratizing Unified Multimodal Models for Understanding, Reasoning, Generation and Editing
par: Tian, Changyao, et autres
Publié: (2026)
par: Tian, Changyao, et autres
Publié: (2026)
InternVL3.5: Advancing Open-Source Multimodal Models in Versatility, Reasoning, and Efficiency
par: Wang, Weiyun, et autres
Publié: (2025)
par: Wang, Weiyun, et autres
Publié: (2025)
InternVL3: Exploring Advanced Training and Test-Time Recipes for Open-Source Multimodal Models
par: Zhu, Jinguo, et autres
Publié: (2025)
par: Zhu, Jinguo, et autres
Publié: (2025)
Mono-InternVL: Pushing the Boundaries of Monolithic Multimodal Large Language Models with Endogenous Visual Pre-training
par: Luo, Gen, et autres
Publié: (2024)
par: Luo, Gen, et autres
Publié: (2024)
Is Ego Status All You Need for Open-Loop End-to-End Autonomous Driving?
par: Li, Zhiqi, et autres
Publié: (2023)
par: Li, Zhiqi, et autres
Publié: (2023)
2nd Place Solution for CVPR2024 E2E Challenge: End-to-End Autonomous Driving Using Vision Language Model
par: Guo, Zilong, et autres
Publié: (2025)
par: Guo, Zilong, et autres
Publié: (2025)
WoodScape Motion Segmentation for Autonomous Driving -- CVPR 2023 OmniCV Workshop Challenge
par: Ramachandran, Saravanabalagi, et autres
Publié: (2023)
par: Ramachandran, Saravanabalagi, et autres
Publié: (2023)
Technique Report of CVPR 2024 PBDL Challenges
par: Fu, Ying, et autres
Publié: (2024)
par: Fu, Ying, et autres
Publié: (2024)
DriveMLM: Aligning Multi-Modal Large Language Models with Behavioral Planning States for Autonomous Driving
par: Cui, Erfei, et autres
Publié: (2023)
par: Cui, Erfei, et autres
Publié: (2023)
The Solution for the CVPR2024 NICE Image Captioning Challenge
par: Huang, Longfei, et autres
Publié: (2024)
par: Huang, Longfei, et autres
Publié: (2024)
VL-DPO: Vision-Language-Guided Finetuning for Preference-Aligned Autonomous Driving
par: Xu, Zhefan, et autres
Publié: (2026)
par: Xu, Zhefan, et autres
Publié: (2026)
Solution for CVPR 2024 UG2+ Challenge Track on All Weather Semantic Segmentation
par: Yu, Jun, et autres
Publié: (2024)
par: Yu, Jun, et autres
Publié: (2024)
CoGen: 3D Consistent Video Generation via Adaptive Conditioning for Autonomous Driving
par: Ji, Yishen, et autres
Publié: (2025)
par: Ji, Yishen, et autres
Publié: (2025)
DriveVLM: The Convergence of Autonomous Driving and Large Vision-Language Models
par: Tian, Xiaoyu, et autres
Publié: (2024)
par: Tian, Xiaoyu, et autres
Publié: (2024)
Multi-Modal UAV Detection, Classification and Tracking Algorithm -- Technical Report for CVPR 2024 UG2 Challenge
par: Deng, Tianchen, et autres
Publié: (2024)
par: Deng, Tianchen, et autres
Publié: (2024)
Language Prompt for Autonomous Driving
par: Wu, Dongming, et autres
Publié: (2023)
par: Wu, Dongming, et autres
Publié: (2023)
AdaDrive: Self-Adaptive Slow-Fast System for Language-Grounded Autonomous Driving
par: Zhang, Ruifei, et autres
Publié: (2025)
par: Zhang, Ruifei, et autres
Publié: (2025)
The Solution for CVPR2024 Foundational Few-Shot Object Detection Challenge
par: Pan, Hongpeng, et autres
Publié: (2024)
par: Pan, Hongpeng, et autres
Publié: (2024)
ImagiDrive: A Unified Imagination-and-Planning Framework for Autonomous Driving
par: Li, Jingyu, et autres
Publié: (2025)
par: Li, Jingyu, et autres
Publié: (2025)
OmniDrive: A Holistic Vision-Language Dataset for Autonomous Driving with Counterfactual Reasoning
par: Wang, Shihao, et autres
Publié: (2024)
par: Wang, Shihao, et autres
Publié: (2024)
OmniDrive: A Holistic Vision-Language Dataset for Autonomous Driving with Counterfactual Reasoning
par: Wang, Shihao, et autres
Publié: (2025)
par: Wang, Shihao, et autres
Publié: (2025)
DriveCombo: Benchmarking Compositional Traffic Rule Reasoning in Autonomous Driving
par: Ma, Enhui, et autres
Publié: (2026)
par: Ma, Enhui, et autres
Publié: (2026)
Technical Report for CVPR 2024 WeatherProof Dataset Challenge: Semantic Segmentation on Paired Real Data
par: Cao, Guojin, et autres
Publié: (2024)
par: Cao, Guojin, et autres
Publié: (2024)
1st Place Solution for MOSE Track in CVPR 2024 PVUW Workshop: Complex Video Object Segmentation
par: Miao, Deshui, et autres
Publié: (2024)
par: Miao, Deshui, et autres
Publié: (2024)
DINO-SD: Champion Solution for ICRA 2024 RoboDepth Challenge
par: Mao, Yifan, et autres
Publié: (2024)
par: Mao, Yifan, et autres
Publié: (2024)
STT: Stateful Tracking with Transformers for Autonomous Driving
par: Jing, Longlong, et autres
Publié: (2024)
par: Jing, Longlong, et autres
Publié: (2024)
3rd Place Solution for MeViS Track in CVPR 2024 PVUW workshop: Motion Expression guided Video Segmentation
par: Pan, Feiyu, et autres
Publié: (2024)
par: Pan, Feiyu, et autres
Publié: (2024)
Unifying Language-Action Understanding and Generation for Autonomous Driving
par: Wang, Xinyang, et autres
Publié: (2026)
par: Wang, Xinyang, et autres
Publié: (2026)
WiCV@CVPR2024: The Thirteenth Women In Computer Vision Workshop at the Annual CVPR Conference
par: Aslam, Asra, et autres
Publié: (2024)
par: Aslam, Asra, et autres
Publié: (2024)
Forging Vision Foundation Models for Autonomous Driving: Challenges, Methodologies, and Opportunities
par: Yan, Xu, et autres
Publié: (2024)
par: Yan, Xu, et autres
Publié: (2024)
An Effective Solution for the CVPR 2026 8th UG2+ Challenge Track 3: Dynamic Object Segmentation in Turbulence
par: Li, Hongzhen, et autres
Publié: (2026)
par: Li, Hongzhen, et autres
Publié: (2026)
AD-H: Language-guided Autonomous Driving with Hierarchical Agents
par: Zhang, Zaibin, et autres
Publié: (2024)
par: Zhang, Zaibin, et autres
Publié: (2024)
Open 3D World in Autonomous Driving
par: Cheng, Xinlong, et autres
Publié: (2024)
par: Cheng, Xinlong, et autres
Publié: (2024)
Team Samsung-RAL: Technical Report for 2024 RoboDrive Challenge-Robust Map Segmentation Track
par: Hao, Xiaoshuai, et autres
Publié: (2024)
par: Hao, Xiaoshuai, et autres
Publié: (2024)
Documents similaires
-
InternVL-X: Advancing and Accelerating InternVL Series with Efficient Visual Token Compression
par: Lu, Dongchen, et autres
Publié: (2025) -
The System Description of CPS Team for Track on Driving with Language of CVPR 2024 Autonomous Grand Challenge
par: Peng, Jinghan, et autres
Publié: (2025) -
InternVL: Scaling up Vision Foundation Models and Aligning for Generic Visual-Linguistic Tasks
par: Chen, Zhe, et autres
Publié: (2023) -
MapVision: CVPR 2024 Autonomous Grand Challenge Mapless Driving Tech Report
par: Yang, Zhongyu, et autres
Publié: (2024) -
Mini-InternVL: A Flexible-Transfer Pocket Multimodal Model with 5% Parameters and 90% Performance
par: Gao, Zhangwei, et autres
Publié: (2024)