Visual Implicit Geometry Transformer for Autonomous Driving
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Shirokov, Arsenii, Kuznetsov, Mikhail, Stepochkin, Danila, Evdokimov, Egor, Glazkov, Daniil, Patakin, Nikolay, Konushin, Anton, Senushkin, Dmitry |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Unified Sensor Simulation for Autonomous Driving
par: Patakin, Nikolay, et autres
Publié: (2026)
par: Patakin, Nikolay, et autres
Publié: (2026)
DepthART: Monocular Depth Estimation as Autoregressive Refinement Task
par: Gabdullin, Bulat, et autres
Publié: (2024)
par: Gabdullin, Bulat, et autres
Publié: (2024)
A3D: Does Diffusion Dream about 3D Alignment?
par: Ignatyev, Savva, et autres
Publié: (2024)
par: Ignatyev, Savva, et autres
Publié: (2024)
Z3D: Zero-Shot 3D Visual Grounding from Images
par: Drozdov, Nikita, et autres
Publié: (2026)
par: Drozdov, Nikita, et autres
Publié: (2026)
Cooperative Face Liveness Detection from Optical Flow
par: Sokolov, Artem, et autres
Publié: (2025)
par: Sokolov, Artem, et autres
Publié: (2025)
UniDet3D: Multi-dataset Indoor 3D Object Detection
par: Kolodiazhnyi, Maksim, et autres
Publié: (2024)
par: Kolodiazhnyi, Maksim, et autres
Publié: (2024)
Zoo3D: Zero-Shot 3D Object Detection at Scene Level
par: Lemeshko, Andrey, et autres
Publié: (2025)
par: Lemeshko, Andrey, et autres
Publié: (2025)
DynaMix: Generalizable Person Re-identification via Dynamic Relabeling and Mixed Data Sampling
par: Mamedov, Timur, et autres
Publié: (2025)
par: Mamedov, Timur, et autres
Publié: (2025)
ReMix: Training Generalized Person Re-identification on a Mixture of Data
par: Mamedov, Timur, et autres
Publié: (2024)
par: Mamedov, Timur, et autres
Publié: (2024)
DriveVGGT: Calibration-Constrained Visual Geometry Transformers for Multi-Camera Autonomous Driving
par: Jia, Xiaosong, et autres
Publié: (2025)
par: Jia, Xiaosong, et autres
Publié: (2025)
HawkDrive: A Transformer-driven Visual Perception System for Autonomous Driving in Night Scene
par: Guo, Ziang, et autres
Publié: (2024)
par: Guo, Ziang, et autres
Publié: (2024)
ReText: Text Boosts Generalization in Image-Based Person Re-identification
par: Mamedov, Timur, et autres
Publié: (2026)
par: Mamedov, Timur, et autres
Publié: (2026)
TUN3D: Towards Real-World Scene Understanding from Unposed Images
par: Konushin, Anton, et autres
Publié: (2025)
par: Konushin, Anton, et autres
Publié: (2025)
DVGT: Driving Visual Geometry Transformer
par: Zuo, Sicheng, et autres
Publié: (2025)
par: Zuo, Sicheng, et autres
Publié: (2025)
Switti: Designing Scale-Wise Transformers for Text-to-Image Synthesis
par: Voronov, Anton, et autres
Publié: (2024)
par: Voronov, Anton, et autres
Publié: (2024)
HairFastGAN: Realistic and Robust Hair Transfer with a Fast Encoder-Based Approach
par: Nikolaev, Maxim, et autres
Publié: (2024)
par: Nikolaev, Maxim, et autres
Publié: (2024)
cadrille: Multi-modal CAD Reconstruction with Reinforcement Learning
par: Kolodiazhnyi, Maksim, et autres
Publié: (2025)
par: Kolodiazhnyi, Maksim, et autres
Publié: (2025)
MADrive: Memory-Augmented Driving Scene Modeling
par: Karpikova, Polina, et autres
Publié: (2025)
par: Karpikova, Polina, et autres
Publié: (2025)
Towards properties of adversarial image perturbations
par: Kuznetsov, Egor, et autres
Publié: (2025)
par: Kuznetsov, Egor, et autres
Publié: (2025)
DriveDiTFit: Fine-tuning Diffusion Transformers for Autonomous Driving
par: Tu, Jiahang, et autres
Publié: (2024)
par: Tu, Jiahang, et autres
Publié: (2024)
Unsupervised Monocular Road Segmentation for Autonomous Driving via Scene Geometry
par: Rostami, Sara Hatami, et autres
Publié: (2025)
par: Rostami, Sara Hatami, et autres
Publié: (2025)
Geo-EVS: Geometry-Conditioned Extrapolative View Synthesis for Autonomous Driving
par: Lan, Yatong, et autres
Publié: (2026)
par: Lan, Yatong, et autres
Publié: (2026)
VGGT: Visual Geometry Grounded Transformer
par: Wang, Jianyuan, et autres
Publié: (2025)
par: Wang, Jianyuan, et autres
Publié: (2025)
Quantized Visual Geometry Grounded Transformer
par: Feng, Weilun, et autres
Publié: (2025)
par: Feng, Weilun, et autres
Publié: (2025)
FutureSightDrive: Thinking Visually with Spatio-Temporal CoT for Autonomous Driving
par: Zeng, Shuang, et autres
Publié: (2025)
par: Zeng, Shuang, et autres
Publié: (2025)
Lightweight Temporal Transformer Decomposition for Federated Autonomous Driving
par: Do, Tuong, et autres
Publié: (2025)
par: Do, Tuong, et autres
Publié: (2025)
TinyDrive: Multiscale Visual Question Answering with Selective Token Routing for Autonomous Driving
par: Hassani, Hossein, et autres
Publié: (2025)
par: Hassani, Hossein, et autres
Publié: (2025)
CADReasoner: Iterative Program Editing for CAD Reverse Engineering
par: Kabisov, Soslan, et autres
Publié: (2026)
par: Kabisov, Soslan, et autres
Publié: (2026)
Modulate and Reconstruct: Learning Hyperspectral Imaging from Misaligned Smartphone Views
par: Reutsky, Daniil, et autres
Publié: (2025)
par: Reutsky, Daniil, et autres
Publié: (2025)
Visual Point Cloud Forecasting enables Scalable Autonomous Driving
par: Yang, Zetong, et autres
Publié: (2023)
par: Yang, Zetong, et autres
Publié: (2023)
Visual Adversarial Attack on Vision-Language Models for Autonomous Driving
par: Zhang, Tianyuan, et autres
Publié: (2024)
par: Zhang, Tianyuan, et autres
Publié: (2024)
Multiscale Video Transformers for Class Agnostic Segmentation in Autonomous Driving
par: Cheshmi, Leila, et autres
Publié: (2025)
par: Cheshmi, Leila, et autres
Publié: (2025)
Think as Needed: Geometry-Driven Adaptive Perception for Autonomous Driving
par: Kim, Donghyun, et autres
Publié: (2026)
par: Kim, Donghyun, et autres
Publié: (2026)
DriveTransformer: Unified Transformer for Scalable End-to-End Autonomous Driving
par: Jia, Xiaosong, et autres
Publié: (2025)
par: Jia, Xiaosong, et autres
Publié: (2025)
LIX: Implicitly Infusing Spatial Geometric Prior Knowledge into Visual Semantic Segmentation for Autonomous Driving
par: Guo, Sicen, et autres
Publié: (2024)
par: Guo, Sicen, et autres
Publié: (2024)
KAGE-Bench: Fast Known-Axis Visual Generalization Evaluation for Reinforcement Learning
par: Cherepanov, Egor, et autres
Publié: (2026)
par: Cherepanov, Egor, et autres
Publié: (2026)
HD-VGGT: High-Resolution Visual Geometry Transformer
par: Chen, Tianrun, et autres
Publié: (2026)
par: Chen, Tianrun, et autres
Publié: (2026)
Hints of Prompt: Enhancing Visual Representation for Multimodal LLMs in Autonomous Driving
par: Zhou, Hao, et autres
Publié: (2024)
par: Zhou, Hao, et autres
Publié: (2024)
ControlLoc: Physical-World Hijacking Attack on Visual Perception in Autonomous Driving
par: Ma, Chen, et autres
Publié: (2024)
par: Ma, Chen, et autres
Publié: (2024)
QVGGT: Post-Training Quantized Visual Geometry Grounded Transformer
par: Pan, Zhizhen, et autres
Publié: (2026)
par: Pan, Zhizhen, et autres
Publié: (2026)
Documents similaires
-
Unified Sensor Simulation for Autonomous Driving
par: Patakin, Nikolay, et autres
Publié: (2026) -
DepthART: Monocular Depth Estimation as Autoregressive Refinement Task
par: Gabdullin, Bulat, et autres
Publié: (2024) -
A3D: Does Diffusion Dream about 3D Alignment?
par: Ignatyev, Savva, et autres
Publié: (2024) -
Z3D: Zero-Shot 3D Visual Grounding from Images
par: Drozdov, Nikita, et autres
Publié: (2026) -
Cooperative Face Liveness Detection from Optical Flow
par: Sokolov, Artem, et autres
Publié: (2025)