DriveVGGT: Calibration-Constrained Visual Geometry Transformers for Multi-Camera Autonomous Driving
Fuente:
arXiv
Salvato in:
| Autori principali: | Jia, Xiaosong, Liu, Yanhao, Hong, Yu, Xia, Renqiu, You, Junqi, Sun, Bin, Hao, Zhihui, Yan, Junchi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
DriveTransformer: Unified Transformer for Scalable End-to-End Autonomous Driving
di: Jia, Xiaosong, et al.
Pubblicazione: (2025)
di: Jia, Xiaosong, et al.
Pubblicazione: (2025)
Bench2Drive-R: Turning Real World Data into Reactive Closed-Loop Autonomous Driving Benchmark by Generative Model
di: You, Junqi, et al.
Pubblicazione: (2024)
di: You, Junqi, et al.
Pubblicazione: (2024)
FlatFusion: Delving into Details of Sparse Transformer-based Camera-LiDAR Fusion for Autonomous Driving
di: Zhu, Yutao, et al.
Pubblicazione: (2024)
di: Zhu, Yutao, et al.
Pubblicazione: (2024)
LLM4Drive: A Survey of Large Language Models for Autonomous Driving
di: Yang, Zhenjie, et al.
Pubblicazione: (2023)
di: Yang, Zhenjie, et al.
Pubblicazione: (2023)
Can Users Specify Driving Speed? Bench2Drive-Speed: Benchmark and Baselines for Desired-Speed Conditioned Autonomous Driving
di: Shao, Yuqian, et al.
Pubblicazione: (2026)
di: Shao, Yuqian, et al.
Pubblicazione: (2026)
Bench2Drive: Towards Multi-Ability Benchmarking of Closed-Loop End-To-End Autonomous Driving
di: Jia, Xiaosong, et al.
Pubblicazione: (2024)
di: Jia, Xiaosong, et al.
Pubblicazione: (2024)
Think2Drive: Efficient Reinforcement Learning by Thinking in Latent World Model for Quasi-Realistic Autonomous Driving (in CARLA-v2)
di: Li, Qifeng, et al.
Pubblicazione: (2024)
di: Li, Qifeng, et al.
Pubblicazione: (2024)
VGGT-MPR: VGGT-Enhanced Multimodal Place Recognition in Autonomous Driving Environments
di: Xu, Jingyi, et al.
Pubblicazione: (2026)
di: Xu, Jingyi, et al.
Pubblicazione: (2026)
Bench2Drive-VL: Benchmarks for Closed-Loop Autonomous Driving with Vision-Language Models
di: Jia, Xiaosong, et al.
Pubblicazione: (2026)
di: Jia, Xiaosong, et al.
Pubblicazione: (2026)
Raw2Drive: Reinforcement Learning with Aligned World Models for End-to-End Autonomous Driving (in CARLA v2)
di: Yang, Zhenjie, et al.
Pubblicazione: (2025)
di: Yang, Zhenjie, et al.
Pubblicazione: (2025)
ActiveAD: Planning-Oriented Active Learning for End-to-End Autonomous Driving
di: Lu, Han, et al.
Pubblicazione: (2024)
di: Lu, Han, et al.
Pubblicazione: (2024)
DriveMoE: Mixture-of-Experts for Vision-Language-Action Model in End-to-End Autonomous Driving
di: Yang, Zhenjie, et al.
Pubblicazione: (2025)
di: Yang, Zhenjie, et al.
Pubblicazione: (2025)
Visual Implicit Geometry Transformer for Autonomous Driving
di: Shirokov, Arsenii, et al.
Pubblicazione: (2026)
di: Shirokov, Arsenii, et al.
Pubblicazione: (2026)
AMP: Autoregressive Motion Prediction Revisited with Next Token Prediction for Autonomous Driving
di: Jia, Xiaosong, et al.
Pubblicazione: (2024)
di: Jia, Xiaosong, et al.
Pubblicazione: (2024)
VGGT-World: Transforming VGGT into an Autoregressive Geometry World Model
di: Sun, Xiangyu, et al.
Pubblicazione: (2026)
di: Sun, Xiangyu, et al.
Pubblicazione: (2026)
VGGT: Visual Geometry Grounded Transformer
di: Wang, Jianyuan, et al.
Pubblicazione: (2025)
di: Wang, Jianyuan, et al.
Pubblicazione: (2025)
Spatial Retrieval Augmented Autonomous Driving
di: Jia, Xiaosong, et al.
Pubblicazione: (2025)
di: Jia, Xiaosong, et al.
Pubblicazione: (2025)
FastVGGT: Training-Free Acceleration of Visual Geometry Transformer
di: Shen, You, et al.
Pubblicazione: (2025)
di: Shen, You, et al.
Pubblicazione: (2025)
Bench2Drive-Robust: Benchmarking Closed-Loop Autonomous Driving under Deployment Perturbations
di: Zhang, Zhiyuan, et al.
Pubblicazione: (2026)
di: Zhang, Zhiyuan, et al.
Pubblicazione: (2026)
DynamicVGGT: Learning Dynamic Point Maps for 4D Scene Reconstruction in Autonomous Driving
di: He, Zhuolin, et al.
Pubblicazione: (2026)
di: He, Zhuolin, et al.
Pubblicazione: (2026)
StereoVGGT: A Training-Free Visual Geometry Transformer for Stereo Vision
di: Chen, Ziyang, et al.
Pubblicazione: (2026)
di: Chen, Ziyang, et al.
Pubblicazione: (2026)
HD-VGGT: High-Resolution Visual Geometry Transformer
di: Chen, Tianrun, et al.
Pubblicazione: (2026)
di: Chen, Tianrun, et al.
Pubblicazione: (2026)
OmniVGGT: Omni-Modality Driven Visual Geometry Grounded Transformer
di: Peng, Haosong, et al.
Pubblicazione: (2025)
di: Peng, Haosong, et al.
Pubblicazione: (2025)
ReSimAD: Zero-Shot 3D Domain Transfer for Autonomous Driving with Source Reconstruction and Target Simulation
di: Zhang, Bo, et al.
Pubblicazione: (2023)
di: Zhang, Bo, et al.
Pubblicazione: (2023)
DVGT: Driving Visual Geometry Transformer
di: Zuo, Sicheng, et al.
Pubblicazione: (2025)
di: Zuo, Sicheng, et al.
Pubblicazione: (2025)
DriveCamSim: Generalizable Camera Simulation via Explicit Camera Modeling for Autonomous Driving
di: Sun, Wenchao, et al.
Pubblicazione: (2025)
di: Sun, Wenchao, et al.
Pubblicazione: (2025)
InfiniteVGGT: Visual Geometry Grounded Transformer for Endless Streams
di: Yuan, Shuai, et al.
Pubblicazione: (2026)
di: Yuan, Shuai, et al.
Pubblicazione: (2026)
Reloc-VGGT: Visual Re-localization with Geometry Grounded Transformer
di: Deng, Tianchen, et al.
Pubblicazione: (2025)
di: Deng, Tianchen, et al.
Pubblicazione: (2025)
4D-CAAL: 4D Radar-Camera Calibration and Auto-Labeling for Autonomous Driving
di: Yao, Shanliang, et al.
Pubblicazione: (2026)
di: Yao, Shanliang, et al.
Pubblicazione: (2026)
Uni-World VLA: Interleaved World Modeling and Planning for Autonomous Driving
di: Liu, Qiqi, et al.
Pubblicazione: (2026)
di: Liu, Qiqi, et al.
Pubblicazione: (2026)
Efficient Multi-Camera Tokenization with Triplanes for End-to-End Driving
di: Ivanovic, Boris, et al.
Pubblicazione: (2025)
di: Ivanovic, Boris, et al.
Pubblicazione: (2025)
SGDrive: Scene-to-Goal Hierarchical World Cognition for Autonomous Driving
di: Li, Jingyu, et al.
Pubblicazione: (2026)
di: Li, Jingyu, et al.
Pubblicazione: (2026)
Vec-QMDP: Vectorized POMDP Planning on CPUs for Real-Time Autonomous Driving
di: Jin, Xuanjin, et al.
Pubblicazione: (2026)
di: Jin, Xuanjin, et al.
Pubblicazione: (2026)
DriveMamba: Task-Centric Scalable State Space Model for Efficient End-to-End Autonomous Driving
di: Su, Haisheng, et al.
Pubblicazione: (2026)
di: Su, Haisheng, et al.
Pubblicazione: (2026)
LaneSegNet: Map Learning with Lane Segment Perception for Autonomous Driving
di: Li, Tianyu, et al.
Pubblicazione: (2023)
di: Li, Tianyu, et al.
Pubblicazione: (2023)
FLARE: Learning Future-Aware Latent Representations from Vision-Language Models for Autonomous Driving
di: Xie, Chengen, et al.
Pubblicazione: (2026)
di: Xie, Chengen, et al.
Pubblicazione: (2026)
Open-sourced Data Ecosystem in Autonomous Driving: the Present and Future
di: Li, Hongyang, et al.
Pubblicazione: (2023)
di: Li, Hongyang, et al.
Pubblicazione: (2023)
DriveCombo: Benchmarking Compositional Traffic Rule Reasoning in Autonomous Driving
di: Ma, Enhui, et al.
Pubblicazione: (2026)
di: Ma, Enhui, et al.
Pubblicazione: (2026)
4DLangVGGT: 4D Language-Visual Geometry Grounded Transformer
di: Wu, Xianfeng, et al.
Pubblicazione: (2025)
di: Wu, Xianfeng, et al.
Pubblicazione: (2025)
PaceVGGT: Pre-Alternating-Attention Token Pruning for Visual Geometry Transformers
di: Li, Haotang, et al.
Pubblicazione: (2026)
di: Li, Haotang, et al.
Pubblicazione: (2026)
Documenti analoghi
-
DriveTransformer: Unified Transformer for Scalable End-to-End Autonomous Driving
di: Jia, Xiaosong, et al.
Pubblicazione: (2025) -
Bench2Drive-R: Turning Real World Data into Reactive Closed-Loop Autonomous Driving Benchmark by Generative Model
di: You, Junqi, et al.
Pubblicazione: (2024) -
FlatFusion: Delving into Details of Sparse Transformer-based Camera-LiDAR Fusion for Autonomous Driving
di: Zhu, Yutao, et al.
Pubblicazione: (2024) -
LLM4Drive: A Survey of Large Language Models for Autonomous Driving
di: Yang, Zhenjie, et al.
Pubblicazione: (2023) -
Can Users Specify Driving Speed? Bench2Drive-Speed: Benchmark and Baselines for Desired-Speed Conditioned Autonomous Driving
di: Shao, Yuqian, et al.
Pubblicazione: (2026)