BEV-VAE: Multi-view Image Generation with Spatial Consistency for Autonomous Driving
Fuente:
arXiv
Salvato in:
| Autori principali: | Chen, Zeming, Zhao, Hang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
BEV-LLM: Leveraging Multimodal BEV Maps for Scene Captioning in Autonomous Driving
di: Brandstaetter, Felix, et al.
Pubblicazione: (2025)
di: Brandstaetter, Felix, et al.
Pubblicazione: (2025)
BEV-TSR: Text-Scene Retrieval in BEV Space for Autonomous Driving
di: Tang, Tao, et al.
Pubblicazione: (2024)
di: Tang, Tao, et al.
Pubblicazione: (2024)
GMF-Drive: Gated Mamba Fusion with Spatial-Aware BEV Representation for End-to-End Autonomous Driving
di: Wang, Jian, et al.
Pubblicazione: (2025)
di: Wang, Jian, et al.
Pubblicazione: (2025)
Hierarchical and Decoupled BEV Perception Learning Framework for Autonomous Driving
di: Dai, Yuqi, et al.
Pubblicazione: (2024)
di: Dai, Yuqi, et al.
Pubblicazione: (2024)
GeoBEV: Learning Geometric BEV Representation for Multi-view 3D Object Detection
di: Zhang, Jinqing, et al.
Pubblicazione: (2024)
di: Zhang, Jinqing, et al.
Pubblicazione: (2024)
MVPbev: Multi-view Perspective Image Generation from BEV with Test-time Controllability and Generalizability
di: Liu, Buyu, et al.
Pubblicazione: (2024)
di: Liu, Buyu, et al.
Pubblicazione: (2024)
MV-Adapter: Multi-view Consistent Image Generation Made Easy
di: Huang, Zehuan, et al.
Pubblicazione: (2024)
di: Huang, Zehuan, et al.
Pubblicazione: (2024)
BEVPredFormer: Spatio-temporal Attention for BEV Instance Prediction in Autonomous Driving
di: Antunes-García, Miguel, et al.
Pubblicazione: (2026)
di: Antunes-García, Miguel, et al.
Pubblicazione: (2026)
SABER: Spatially Consistent 3D Universal Adversarial Objects for BEV Detectors
di: Li, Aixuan, et al.
Pubblicazione: (2025)
di: Li, Aixuan, et al.
Pubblicazione: (2025)
MSMVD: Exploiting Multi-scale Image Features via Multi-scale BEV Features for Multi-view Pedestrian Detection
di: Yamane, Taiga, et al.
Pubblicazione: (2025)
di: Yamane, Taiga, et al.
Pubblicazione: (2025)
TiGDistill-BEV: Multi-view BEV 3D Object Detection via Target Inner-Geometry Learning Distillation
di: Xu, Shaoqing, et al.
Pubblicazione: (2024)
di: Xu, Shaoqing, et al.
Pubblicazione: (2024)
SpaceDrive: Infusing Spatial Awareness into VLM-based Autonomous Driving
di: Li, Peizheng, et al.
Pubblicazione: (2025)
di: Li, Peizheng, et al.
Pubblicazione: (2025)
UniMLVG: Unified Framework for Multi-view Long Video Generation with Comprehensive Control Capabilities for Autonomous Driving
di: Chen, Rui, et al.
Pubblicazione: (2024)
di: Chen, Rui, et al.
Pubblicazione: (2024)
FSD-BEV: Foreground Self-Distillation for Multi-view 3D Object Detection
di: Jiang, Zheng, et al.
Pubblicazione: (2024)
di: Jiang, Zheng, et al.
Pubblicazione: (2024)
Spatial Retrieval Augmented Autonomous Driving
di: Jia, Xiaosong, et al.
Pubblicazione: (2025)
di: Jia, Xiaosong, et al.
Pubblicazione: (2025)
BEVal: A Cross-dataset Evaluation Study of BEV Segmentation Models for Autonomous Driving
di: Diaz-Zapata, Manuel Alejandro, et al.
Pubblicazione: (2024)
di: Diaz-Zapata, Manuel Alejandro, et al.
Pubblicazione: (2024)
FSF-Net: Enhance 4D Occupancy Forecasting with Coarse BEV Scene Flow for Autonomous Driving
di: Guo, Erxin, et al.
Pubblicazione: (2024)
di: Guo, Erxin, et al.
Pubblicazione: (2024)
MiLA: Multi-view Intensive-fidelity Long-term Video Generation World Model for Autonomous Driving
di: Wang, Haiguang, et al.
Pubblicazione: (2025)
di: Wang, Haiguang, et al.
Pubblicazione: (2025)
BEV-MAE: Bird's Eye View Masked Autoencoders for Point Cloud Pre-training in Autonomous Driving Scenarios
di: Lin, Zhiwei, et al.
Pubblicazione: (2022)
di: Lin, Zhiwei, et al.
Pubblicazione: (2022)
Auto-Regressively Generating Multi-View Consistent Images
di: Hu, JiaKui, et al.
Pubblicazione: (2025)
di: Hu, JiaKui, et al.
Pubblicazione: (2025)
Diffusion-Based Generative Models for 3D Occupancy Prediction in Autonomous Driving
di: Wang, Yunshen, et al.
Pubblicazione: (2025)
di: Wang, Yunshen, et al.
Pubblicazione: (2025)
BEVWorld: A Multimodal World Simulator for Autonomous Driving via Scene-Level BEV Latents
di: Zhang, Yumeng, et al.
Pubblicazione: (2024)
di: Zhang, Yumeng, et al.
Pubblicazione: (2024)
Cross-view image geo-localization with Panorama-BEV Co-Retrieval Network
di: Ye, Junyan, et al.
Pubblicazione: (2024)
di: Ye, Junyan, et al.
Pubblicazione: (2024)
DriveVLM: The Convergence of Autonomous Driving and Large Vision-Language Models
di: Tian, Xiaoyu, et al.
Pubblicazione: (2024)
di: Tian, Xiaoyu, et al.
Pubblicazione: (2024)
DiffSemanticFusion: Semantic Raster BEV Fusion for Autonomous Driving via Online HD Map Diffusion
di: Sun, Zhigang, et al.
Pubblicazione: (2025)
di: Sun, Zhigang, et al.
Pubblicazione: (2025)
EagleVision: A Dual-Stage Framework with BEV-grounding-based Chain-of-Thought for Spatial Intelligence
di: Wan, Jiaxu, et al.
Pubblicazione: (2025)
di: Wan, Jiaxu, et al.
Pubblicazione: (2025)
SimDistill: Simulated Multi-modal Distillation for BEV 3D Object Detection
di: Zhao, Haimei, et al.
Pubblicazione: (2023)
di: Zhao, Haimei, et al.
Pubblicazione: (2023)
Generalizing Motion Planners with Mixture of Experts for Autonomous Driving
di: Sun, Qiao, et al.
Pubblicazione: (2024)
di: Sun, Qiao, et al.
Pubblicazione: (2024)
PIXART-δ: Fast and Controllable Image Generation with Latent Consistency Models
di: Chen, Junsong, et al.
Pubblicazione: (2024)
di: Chen, Junsong, et al.
Pubblicazione: (2024)
TexPainter: Generative Mesh Texturing with Multi-view Consistency
di: Zhang, Hongkun, et al.
Pubblicazione: (2024)
di: Zhang, Hongkun, et al.
Pubblicazione: (2024)
Multi-view Image Prompted Multi-view Diffusion for Improved 3D Generation
di: Kim, Seungwook, et al.
Pubblicazione: (2024)
di: Kim, Seungwook, et al.
Pubblicazione: (2024)
Sparse BEV Fusion with Self-View Consistency for Multi-View Detection and Tracking
di: Toida, Keisuke, et al.
Pubblicazione: (2025)
di: Toida, Keisuke, et al.
Pubblicazione: (2025)
SimBEV: A Synthetic Multi-Task Multi-Sensor Driving Data Generation Tool and Dataset
di: Mehr, Goodarz, et al.
Pubblicazione: (2025)
di: Mehr, Goodarz, et al.
Pubblicazione: (2025)
CoGen: 3D Consistent Video Generation via Adaptive Conditioning for Autonomous Driving
di: Ji, Yishen, et al.
Pubblicazione: (2025)
di: Ji, Yishen, et al.
Pubblicazione: (2025)
NoiseController: Towards Consistent Multi-view Video Generation via Noise Decomposition and Collaboration
di: Dong, Haotian, et al.
Pubblicazione: (2025)
di: Dong, Haotian, et al.
Pubblicazione: (2025)
MaskBEV: Towards A Unified Framework for BEV Detection and Map Segmentation
di: Zhao, Xiao, et al.
Pubblicazione: (2024)
di: Zhao, Xiao, et al.
Pubblicazione: (2024)
Multi-view Consistent 3D Gaussian Head Avatars 'without' Multi-view Generation
di: Chharia, Aviral, et al.
Pubblicazione: (2026)
di: Chharia, Aviral, et al.
Pubblicazione: (2026)
Consistent Human Image and Video Generation with Spatially Conditioned Diffusion
di: Cao, Mingdeng, et al.
Pubblicazione: (2024)
di: Cao, Mingdeng, et al.
Pubblicazione: (2024)
Spatial-aware Vision Language Model for Autonomous Driving
di: Wei, Weijie, et al.
Pubblicazione: (2025)
di: Wei, Weijie, et al.
Pubblicazione: (2025)
Model as a Game: On Numerical and Spatial Consistency for Generative Games
di: Chen, Jingye, et al.
Pubblicazione: (2025)
di: Chen, Jingye, et al.
Pubblicazione: (2025)
Documenti analoghi
-
BEV-LLM: Leveraging Multimodal BEV Maps for Scene Captioning in Autonomous Driving
di: Brandstaetter, Felix, et al.
Pubblicazione: (2025) -
BEV-TSR: Text-Scene Retrieval in BEV Space for Autonomous Driving
di: Tang, Tao, et al.
Pubblicazione: (2024) -
GMF-Drive: Gated Mamba Fusion with Spatial-Aware BEV Representation for End-to-End Autonomous Driving
di: Wang, Jian, et al.
Pubblicazione: (2025) -
Hierarchical and Decoupled BEV Perception Learning Framework for Autonomous Driving
di: Dai, Yuqi, et al.
Pubblicazione: (2024) -
GeoBEV: Learning Geometric BEV Representation for Multi-view 3D Object Detection
di: Zhang, Jinqing, et al.
Pubblicazione: (2024)