Sce2DriveX: A Generalized MLLM Framework for Scene-to-Drive Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhao, Rui, Yuan, Qirui, Li, Jinyu, Hu, Haofeng, Li, Yun, Zheng, Chengyuan, Gao, Fei |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
DriveX: Omni Scene Modeling for Learning Generalizable World Knowledge in Autonomous Driving
di: Shi, Chen, et al.
Pubblicazione: (2025)
di: Shi, Chen, et al.
Pubblicazione: (2025)
VLADriver-RAG: Retrieval-Augmented Vision-Language-Action Models for Autonomous Driving
di: Zhao, Rui, et al.
Pubblicazione: (2026)
di: Zhao, Rui, et al.
Pubblicazione: (2026)
DrivingScene: A Multi-Task Online Feed-Forward 3D Gaussian Splatting Method for Dynamic Driving Scenes
di: Hou, Qirui, et al.
Pubblicazione: (2025)
di: Hou, Qirui, et al.
Pubblicazione: (2025)
UniScene: Unified Occupancy-centric Driving Scene Generation
di: Li, Bohan, et al.
Pubblicazione: (2024)
di: Li, Bohan, et al.
Pubblicazione: (2024)
DrivePI: Spatial-aware 4D MLLM for Unified Autonomous Driving Understanding, Perception, Prediction and Planning
di: Liu, Zhe, et al.
Pubblicazione: (2025)
di: Liu, Zhe, et al.
Pubblicazione: (2025)
DriveSceneGen: Generating Diverse and Realistic Driving Scenarios from Scratch
di: Sun, Shuo, et al.
Pubblicazione: (2023)
di: Sun, Shuo, et al.
Pubblicazione: (2023)
GA-Drive: Geometry-Appearance Decoupled Modeling for Free-viewpoint Driving Scene Generation
di: Zhang, Hao, et al.
Pubblicazione: (2026)
di: Zhang, Hao, et al.
Pubblicazione: (2026)
4D Driving Scene Generation With Stereo Forcing
di: Lu, Hao, et al.
Pubblicazione: (2025)
di: Lu, Hao, et al.
Pubblicazione: (2025)
Generating Multimodal Driving Scenes via Next-Scene Prediction
di: Wu, Yanhao, et al.
Pubblicazione: (2025)
di: Wu, Yanhao, et al.
Pubblicazione: (2025)
DrivePTS: A Progressive Learning Framework with Textual and Structural Enhancement for Driving Scene Generation
di: Wang, Zhechao, et al.
Pubblicazione: (2026)
di: Wang, Zhechao, et al.
Pubblicazione: (2026)
ReinDriveGen: Reinforcement Post-Training for Out-of-Distribution Driving Scene Generation
di: Zhang, Hao, et al.
Pubblicazione: (2026)
di: Zhang, Hao, et al.
Pubblicazione: (2026)
DriveGen3D: Boosting Feed-Forward Driving Scene Generation with Efficient Video Diffusion
di: Wang, Weijie, et al.
Pubblicazione: (2025)
di: Wang, Weijie, et al.
Pubblicazione: (2025)
V2XCrafter: Learning to Generate Driving Scene Across Agents
di: Tao, Yihang, et al.
Pubblicazione: (2026)
di: Tao, Yihang, et al.
Pubblicazione: (2026)
X-Scene: Large-Scale Driving Scene Generation with High Fidelity and Flexible Controllability
di: Yang, Yu, et al.
Pubblicazione: (2025)
di: Yang, Yu, et al.
Pubblicazione: (2025)
Active Learning from Scene Embeddings for End-to-End Autonomous Driving
di: Jiang, Wenhao, et al.
Pubblicazione: (2025)
di: Jiang, Wenhao, et al.
Pubblicazione: (2025)
ReconDreamer++: Harmonizing Generative and Reconstructive Models for Driving Scene Representation
di: Zhao, Guosheng, et al.
Pubblicazione: (2025)
di: Zhao, Guosheng, et al.
Pubblicazione: (2025)
DriveWorld: 4D Pre-trained Scene Understanding via World Models for Autonomous Driving
di: Min, Chen, et al.
Pubblicazione: (2024)
di: Min, Chen, et al.
Pubblicazione: (2024)
DriveSplat: Unified Neural Gaussian Reconstruction for Dynamic Driving Scenes
di: Wang, Cong, et al.
Pubblicazione: (2025)
di: Wang, Cong, et al.
Pubblicazione: (2025)
DriveFix: Spatio-Temporally Coherent Driving Scene Restoration
di: Si, Heyu, et al.
Pubblicazione: (2026)
di: Si, Heyu, et al.
Pubblicazione: (2026)
VECTOR-Drive: Tightly Coupled Vision-Language and Trajectory Expert Routing for End-to-End Autonomous Driving
di: Zhao, Rui, et al.
Pubblicazione: (2026)
di: Zhao, Rui, et al.
Pubblicazione: (2026)
FlexDrive: Toward Trajectory Flexibility in Driving Scene Reconstruction and Rendering
di: Zhou, Jingqiu, et al.
Pubblicazione: (2025)
di: Zhou, Jingqiu, et al.
Pubblicazione: (2025)
HoloDrive: Holistic 2D-3D Multi-Modal Street Scene Generation for Autonomous Driving
di: Wu, Zehuan, et al.
Pubblicazione: (2024)
di: Wu, Zehuan, et al.
Pubblicazione: (2024)
SparseDrive: End-to-End Autonomous Driving via Sparse Scene Representation
di: Sun, Wenchao, et al.
Pubblicazione: (2024)
di: Sun, Wenchao, et al.
Pubblicazione: (2024)
LangDriveCTRL: Natural Language Controllable Driving Scene Editing with Multi-modal Agents
di: He, Yun, et al.
Pubblicazione: (2025)
di: He, Yun, et al.
Pubblicazione: (2025)
DriveLiDAR4D: Sequential and Controllable LiDAR Scene Generation for Autonomous Driving
di: Cai, Kaiwen, et al.
Pubblicazione: (2025)
di: Cai, Kaiwen, et al.
Pubblicazione: (2025)
Unified Modeling of Lane and Lane Topology for Driving Scene Reasoning
di: Li, Han, et al.
Pubblicazione: (2026)
di: Li, Han, et al.
Pubblicazione: (2026)
DiVE: Efficient Multi-View Driving Scenes Generation Based on Video Diffusion Transformer
di: Jiang, Junpeng, et al.
Pubblicazione: (2025)
di: Jiang, Junpeng, et al.
Pubblicazione: (2025)
SGDrive: Scene-to-Goal Hierarchical World Cognition for Autonomous Driving
di: Li, Jingyu, et al.
Pubblicazione: (2026)
di: Li, Jingyu, et al.
Pubblicazione: (2026)
Physics-Aware 3D Gaussian Editing for Driving Scene Generation
di: Zhou, Feng, et al.
Pubblicazione: (2026)
di: Zhou, Feng, et al.
Pubblicazione: (2026)
Challenger: Affordable Adversarial Driving Video Generation
di: Xu, Zhiyuan, et al.
Pubblicazione: (2025)
di: Xu, Zhiyuan, et al.
Pubblicazione: (2025)
AnyScene: Towards Highly Controllable Driving Scene Generation at Anywhere and Beyond
di: Zhang, Haiming, et al.
Pubblicazione: (2026)
di: Zhang, Haiming, et al.
Pubblicazione: (2026)
DriveXQA: Cross-modal Visual Question Answering for Adverse Driving Scene Understanding
di: Tao, Mingzhe, et al.
Pubblicazione: (2026)
di: Tao, Mingzhe, et al.
Pubblicazione: (2026)
SimGen: Simulator-conditioned Driving Scene Generation
di: Zhou, Yunsong, et al.
Pubblicazione: (2024)
di: Zhou, Yunsong, et al.
Pubblicazione: (2024)
SceneCrafter: Controllable Multi-View Driving Scene Editing
di: Zhu, Zehao, et al.
Pubblicazione: (2025)
di: Zhu, Zehao, et al.
Pubblicazione: (2025)
ImagiDrive: A Unified Imagination-and-Planning Framework for Autonomous Driving
di: Li, Jingyu, et al.
Pubblicazione: (2025)
di: Li, Jingyu, et al.
Pubblicazione: (2025)
DriveMA: Driving Vision-Language-Action Models with verifiable Meta-Actions
di: Zheng, Weicheng, et al.
Pubblicazione: (2026)
di: Zheng, Weicheng, et al.
Pubblicazione: (2026)
Unsupervised Collaborative Domain Adaptation for Driving Scene Parsing
di: Fan, Jiahe, et al.
Pubblicazione: (2026)
di: Fan, Jiahe, et al.
Pubblicazione: (2026)
RelTopo: Multi-Level Relational Modeling for Driving Scene Topology Reasoning
di: Luo, Yueru, et al.
Pubblicazione: (2025)
di: Luo, Yueru, et al.
Pubblicazione: (2025)
GraphAD: Interaction Scene Graph for End-to-end Autonomous Driving
di: Zhang, Yunpeng, et al.
Pubblicazione: (2024)
di: Zhang, Yunpeng, et al.
Pubblicazione: (2024)
SceMoS: Scene-Aware 3D Human Motion Synthesis by Planning with Geometry-Grounded Tokens
di: Ghosh, Anindita, et al.
Pubblicazione: (2026)
di: Ghosh, Anindita, et al.
Pubblicazione: (2026)
Documenti analoghi
-
DriveX: Omni Scene Modeling for Learning Generalizable World Knowledge in Autonomous Driving
di: Shi, Chen, et al.
Pubblicazione: (2025) -
VLADriver-RAG: Retrieval-Augmented Vision-Language-Action Models for Autonomous Driving
di: Zhao, Rui, et al.
Pubblicazione: (2026) -
DrivingScene: A Multi-Task Online Feed-Forward 3D Gaussian Splatting Method for Dynamic Driving Scenes
di: Hou, Qirui, et al.
Pubblicazione: (2025) -
UniScene: Unified Occupancy-centric Driving Scene Generation
di: Li, Bohan, et al.
Pubblicazione: (2024) -
DrivePI: Spatial-aware 4D MLLM for Unified Autonomous Driving Understanding, Perception, Prediction and Planning
di: Liu, Zhe, et al.
Pubblicazione: (2025)