LongDWM: Cross-Granularity Distillation for Building a Long-Term Driving World Model
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Xiaodong, Wu, Zhirong, Peng, Peixi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
ProphetDWM: A Driving World Model for Rolling Out Future Actions and Videos
di: Wang, Xiaodong, et al.
Pubblicazione: (2025)
di: Wang, Xiaodong, et al.
Pubblicazione: (2025)
UniDWM: Towards a Unified Driving World Model via Multifaceted Representation Learning
di: Liu, Shuai, et al.
Pubblicazione: (2026)
di: Liu, Shuai, et al.
Pubblicazione: (2026)
GaussianDWM: 3D Gaussian Driving World Model for Unified Scene Understanding and Multi-Modal Generation
di: Deng, Tianchen, et al.
Pubblicazione: (2025)
di: Deng, Tianchen, et al.
Pubblicazione: (2025)
FreeGen: Feed-Forward Reconstruction-Generation Co-Training for Free-Viewpoint Driving Scene Synthesis
di: Chen, Shijie, et al.
Pubblicazione: (2025)
di: Chen, Shijie, et al.
Pubblicazione: (2025)
LiViBench: An Omnimodal Benchmark for Interactive Livestream Video Understanding
di: Wang, Xiaodong, et al.
Pubblicazione: (2026)
di: Wang, Xiaodong, et al.
Pubblicazione: (2026)
LeanPO: Lean Preference Optimization for Likelihood Alignment in Video-LLMs
di: Wang, Xiaodong, et al.
Pubblicazione: (2025)
di: Wang, Xiaodong, et al.
Pubblicazione: (2025)
WorldPlay: Towards Long-Term Geometric Consistency for Real-Time Interactive World Modeling
di: Sun, Wenqiang, et al.
Pubblicazione: (2025)
di: Sun, Wenqiang, et al.
Pubblicazione: (2025)
HorizonDrive: Self-Corrective Autoregressive World Model for Long-horizon Driving Simulation
di: Zhang, Conglang, et al.
Pubblicazione: (2026)
di: Zhang, Conglang, et al.
Pubblicazione: (2026)
STAGE: A Stream-Centric Generative World Model for Long-Horizon Driving-Scene Simulation
di: Wang, Jiamin, et al.
Pubblicazione: (2025)
di: Wang, Jiamin, et al.
Pubblicazione: (2025)
WorldCompass: Reinforcement Learning for Long-Horizon World Models
di: Wang, Zehan, et al.
Pubblicazione: (2026)
di: Wang, Zehan, et al.
Pubblicazione: (2026)
4Seasons: Benchmarking Visual SLAM and Long-Term Localization for Autonomous Driving in Challenging Conditions
di: Wenzel, Patrick, et al.
Pubblicazione: (2022)
di: Wenzel, Patrick, et al.
Pubblicazione: (2022)
MiLA: Multi-view Intensive-fidelity Long-term Video Generation World Model for Autonomous Driving
di: Wang, Haiguang, et al.
Pubblicazione: (2025)
di: Wang, Haiguang, et al.
Pubblicazione: (2025)
GAGS: Granularity-Aware Feature Distillation for Language Gaussian Splatting
di: Peng, Yuning, et al.
Pubblicazione: (2024)
di: Peng, Yuning, et al.
Pubblicazione: (2024)
Cross-Modal Dual-Causal Learning for Long-Term Action Recognition
di: Shaowu, Xu, et al.
Pubblicazione: (2025)
di: Shaowu, Xu, et al.
Pubblicazione: (2025)
PCSTracker: Long-Term Scene Flow Estimation for Point Cloud Sequences
di: Lin, Min, et al.
Pubblicazione: (2026)
di: Lin, Min, et al.
Pubblicazione: (2026)
SimCast: Enhancing Precipitation Nowcasting with Short-to-Long Term Knowledge Distillation
di: Yin, Yifang, et al.
Pubblicazione: (2025)
di: Yin, Yifang, et al.
Pubblicazione: (2025)
DeepSight: Long-Horizon World Modeling via Latent States Prediction for End-to-End Autonomous Driving
di: Zhang, Lingjun, et al.
Pubblicazione: (2026)
di: Zhang, Lingjun, et al.
Pubblicazione: (2026)
LongScape: Advancing Long-Horizon Embodied World Models with Context-Aware MoE
di: Shang, Yu, et al.
Pubblicazione: (2025)
di: Shang, Yu, et al.
Pubblicazione: (2025)
Long-Horizon Streaming Video Generation via Hybrid Attention with Decoupled Distillation
di: Li, Ruibin, et al.
Pubblicazione: (2026)
di: Li, Ruibin, et al.
Pubblicazione: (2026)
Video World Models with Long-term Spatial Memory
di: Wu, Tong, et al.
Pubblicazione: (2025)
di: Wu, Tong, et al.
Pubblicazione: (2025)
TeleMem: Building Long-Term and Multimodal Memory for Agentic AI
di: Chen, Chunliang, et al.
Pubblicazione: (2025)
di: Chen, Chunliang, et al.
Pubblicazione: (2025)
Holmes-VAU: Towards Long-term Video Anomaly Understanding at Any Granularity
di: Zhang, Huaxin, et al.
Pubblicazione: (2024)
di: Zhang, Huaxin, et al.
Pubblicazione: (2024)
LongVie 2: Multimodal Controllable Ultra-Long Video World Model
di: Gao, Jianxiong, et al.
Pubblicazione: (2025)
di: Gao, Jianxiong, et al.
Pubblicazione: (2025)
Unsupervised Long-Term Person Re-Identification with Clothes Change
di: Li, Mingkun, et al.
Pubblicazione: (2022)
di: Li, Mingkun, et al.
Pubblicazione: (2022)
LT-Gaussian: Long-Term Map Update Using 3D Gaussian Splatting for Autonomous Driving
di: Cheng, Luqi, et al.
Pubblicazione: (2025)
di: Cheng, Luqi, et al.
Pubblicazione: (2025)
Physical Informed Driving World Model
di: Yang, Zhuoran, et al.
Pubblicazione: (2024)
di: Yang, Zhuoran, et al.
Pubblicazione: (2024)
InfinityHuman: Towards Long-Term Audio-Driven Human
di: Li, Xiaodi, et al.
Pubblicazione: (2025)
di: Li, Xiaodi, et al.
Pubblicazione: (2025)
TruckDrive: Long-Range Autonomous Highway Driving Dataset
di: Ghilotti, Filippo, et al.
Pubblicazione: (2026)
di: Ghilotti, Filippo, et al.
Pubblicazione: (2026)
Distilling Knowledge for Short-to-Long Term Trajectory Prediction
di: Das, Sourav, et al.
Pubblicazione: (2023)
di: Das, Sourav, et al.
Pubblicazione: (2023)
Long-tailed Adversarial Training with Self-Distillation
di: Cho, Seungju, et al.
Pubblicazione: (2025)
di: Cho, Seungju, et al.
Pubblicazione: (2025)
MagicWorld: Towards Long-Horizon Stability for Interactive Video World Exploration
di: Li, Guangyuan, et al.
Pubblicazione: (2025)
di: Li, Guangyuan, et al.
Pubblicazione: (2025)
Towards Consistent Long-Term Pose Generation
di: Li, Yayuan, et al.
Pubblicazione: (2025)
di: Li, Yayuan, et al.
Pubblicazione: (2025)
Alleviating Sparse Rewards by Modeling Step-Wise and Long-Term Sampling Effects in Flow-Based GRPO
di: Tong, Yunze, et al.
Pubblicazione: (2026)
di: Tong, Yunze, et al.
Pubblicazione: (2026)
Long-Context State-Space Video World Models
di: Po, Ryan, et al.
Pubblicazione: (2025)
di: Po, Ryan, et al.
Pubblicazione: (2025)
LIVE: Long-horizon Interactive Video World Modeling
di: Huang, Junchao, et al.
Pubblicazione: (2026)
di: Huang, Junchao, et al.
Pubblicazione: (2026)
MambaMIL+: Modeling Long-Term Contextual Patterns for Gigapixel Whole Slide Image
di: Zeng, Qian, et al.
Pubblicazione: (2025)
di: Zeng, Qian, et al.
Pubblicazione: (2025)
Orbis: Overcoming Challenges of Long-Horizon Prediction in Driving World Models
di: Mousakhan, Arian, et al.
Pubblicazione: (2025)
di: Mousakhan, Arian, et al.
Pubblicazione: (2025)
Long-Term TalkingFace Generation via Motion-Prior Conditional Diffusion Model
di: Shen, Fei, et al.
Pubblicazione: (2025)
di: Shen, Fei, et al.
Pubblicazione: (2025)
InfinityDrive: Breaking Time Limits in Driving World Models
di: Guo, Xi, et al.
Pubblicazione: (2024)
di: Guo, Xi, et al.
Pubblicazione: (2024)
StateSpaceDiffuser: Bringing Long Context to Diffusion World Models
di: Savov, Nedko, et al.
Pubblicazione: (2025)
di: Savov, Nedko, et al.
Pubblicazione: (2025)
Documenti analoghi
-
ProphetDWM: A Driving World Model for Rolling Out Future Actions and Videos
di: Wang, Xiaodong, et al.
Pubblicazione: (2025) -
UniDWM: Towards a Unified Driving World Model via Multifaceted Representation Learning
di: Liu, Shuai, et al.
Pubblicazione: (2026) -
GaussianDWM: 3D Gaussian Driving World Model for Unified Scene Understanding and Multi-Modal Generation
di: Deng, Tianchen, et al.
Pubblicazione: (2025) -
FreeGen: Feed-Forward Reconstruction-Generation Co-Training for Free-Viewpoint Driving Scene Synthesis
di: Chen, Shijie, et al.
Pubblicazione: (2025) -
LiViBench: An Omnimodal Benchmark for Interactive Livestream Video Understanding
di: Wang, Xiaodong, et al.
Pubblicazione: (2026)