WcDT: World-centric Diffusion Transformer for Traffic Scene Generation
Fuente:
arXiv
Guardado en:
| Autores principales: | Yang, Chen, He, Yangfan, Tian, Aaron Xuxiang, Chen, Dong, Wang, Jianhui, Shi, Tianyu, Heydarian, Arsalan, Liu, Pei |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
TSDiT: Traffic Scene Diffusion Models With Transformers
por: Yang, Chen, et al.
Publicado: (2023)
por: Yang, Chen, et al.
Publicado: (2023)
Multimodal Data Integration for Sustainable Indoor Gardening: Tracking Anyplant with Time Series Foundation Model
por: Nabaei, Seyed Hamidreza, et al.
Publicado: (2025)
por: Nabaei, Seyed Hamidreza, et al.
Publicado: (2025)
Free-Mask: A Novel Paradigm of Integration Between the Segmentation Diffusion Model and Image Editing
por: Gao, Bo, et al.
Publicado: (2024)
por: Gao, Bo, et al.
Publicado: (2024)
Real-Time Roadway Obstacle Detection for Electric Scooters Using Deep Learning and Multi-Sensor Fusion
por: Zheng, Zeyang, et al.
Publicado: (2025)
por: Zheng, Zeyang, et al.
Publicado: (2025)
DDPM-MoCo: Advancing Industrial Surface Defect Generation and Detection with Generative and Contrastive Learning
por: He, Yangfan, et al.
Publicado: (2024)
por: He, Yangfan, et al.
Publicado: (2024)
UAV-Based Infrastructure Inspections: A Literature Review and Proposed Framework for AEC+FM
por: Nikkhah, Amir Farzin, et al.
Publicado: (2026)
por: Nikkhah, Amir Farzin, et al.
Publicado: (2026)
UniScene: Unified Occupancy-centric Driving Scene Generation
por: Li, Bohan, et al.
Publicado: (2024)
por: Li, Bohan, et al.
Publicado: (2024)
Performance Evaluation of Real-Time Object Detection for Electric Scooters
por: Chen, Dong, et al.
Publicado: (2024)
por: Chen, Dong, et al.
Publicado: (2024)
Action-slot: Visual Action-centric Representations for Multi-label Atomic Activity Recognition in Traffic Scenes
por: Kung, Chi-Hsi, et al.
Publicado: (2023)
por: Kung, Chi-Hsi, et al.
Publicado: (2023)
Optimizing Multi-Round Enhanced Training in Diffusion Models for Improved Preference Understanding
por: Li, Kun, et al.
Publicado: (2025)
por: Li, Kun, et al.
Publicado: (2025)
MaRI: Material Retrieval Integration across Domains
por: Wang, Jianhui, et al.
Publicado: (2025)
por: Wang, Jianhui, et al.
Publicado: (2025)
DT-NVS: Diffusion Transformers for Novel View Synthesis
por: Jang, Wonbong, et al.
Publicado: (2025)
por: Jang, Wonbong, et al.
Publicado: (2025)
Reflective Human-Machine Co-adaptation for Enhanced Text-to-Image Generation Dialogue System
por: Feng, Yuheng, et al.
Publicado: (2024)
por: Feng, Yuheng, et al.
Publicado: (2024)
Lay-Your-Scene: Natural Scene Layout Generation with Diffusion Transformers
por: Srivastava, Divyansh, et al.
Publicado: (2025)
por: Srivastava, Divyansh, et al.
Publicado: (2025)
Ego3DT: Tracking Every 3D Object in Ego-centric Videos
por: Hao, Shengyu, et al.
Publicado: (2024)
por: Hao, Shengyu, et al.
Publicado: (2024)
SceneDiffuser++: City-Scale Traffic Simulation via a Generative World Model
por: Tan, Shuhan, et al.
Publicado: (2025)
por: Tan, Shuhan, et al.
Publicado: (2025)
Generative Image Coding with Diffusion Prior
por: Chang, Jianhui
Publicado: (2025)
por: Chang, Jianhui
Publicado: (2025)
Memory Forcing: Spatio-Temporal Memory for Consistent Scene Generation on Minecraft
por: Huang, Junchao, et al.
Publicado: (2025)
por: Huang, Junchao, et al.
Publicado: (2025)
Optimization-Guided Diffusion for Interactive Scene Generation
por: Li, Shihao, et al.
Publicado: (2025)
por: Li, Shihao, et al.
Publicado: (2025)
Decoupled Diffusion Sparks Adaptive Scene Generation
por: Zhou, Yunsong, et al.
Publicado: (2025)
por: Zhou, Yunsong, et al.
Publicado: (2025)
Situational Scene Graph for Structured Human-centric Situation Understanding
por: Sugandhika, Chinthani, et al.
Publicado: (2024)
por: Sugandhika, Chinthani, et al.
Publicado: (2024)
DORSal: Diffusion for Object-centric Representations of Scenes et al
por: Jabri, Allan, et al.
Publicado: (2023)
por: Jabri, Allan, et al.
Publicado: (2023)
SegDT: A Diffusion Transformer-Based Segmentation Model for Medical Imaging
por: Bekhouche, Salah Eddine, et al.
Publicado: (2025)
por: Bekhouche, Salah Eddine, et al.
Publicado: (2025)
Efficient Temporal Consistency in Diffusion-Based Video Editing with Adaptor Modules: A Theoretical Framework
por: Song, Xinyuan, et al.
Publicado: (2025)
por: Song, Xinyuan, et al.
Publicado: (2025)
EgoExoLearn: A Dataset for Bridging Asynchronous Ego- and Exo-centric View of Procedural Activities in Real World
por: Huang, Yifei, et al.
Publicado: (2024)
por: Huang, Yifei, et al.
Publicado: (2024)
GTA: Advancing Image-to-3D World Generation via Geometry Then Appearance Video Diffusion
por: Zhu, Hanxin, et al.
Publicado: (2026)
por: Zhu, Hanxin, et al.
Publicado: (2026)
Twin Co-Adaptive Dialogue for Progressive Image Generation
por: Wang, Jianhui, et al.
Publicado: (2025)
por: Wang, Jianhui, et al.
Publicado: (2025)
TrackingWorld: World-centric Monocular 3D Tracking of Almost All Pixels
por: Lu, Jiahao, et al.
Publicado: (2025)
por: Lu, Jiahao, et al.
Publicado: (2025)
USRNet: Unified Scene Recovery Network for Enhancing Traffic Imaging under Multiple Adverse Weather Conditions
por: Lu, Yuxu, et al.
Publicado: (2025)
por: Lu, Yuxu, et al.
Publicado: (2025)
Voyager: Long-Range and World-Consistent Video Diffusion for Explorable 3D Scene Generation
por: Huang, Tianyu, et al.
Publicado: (2025)
por: Huang, Tianyu, et al.
Publicado: (2025)
Dynamic Avatar-Scene Rendering from Human-centric Context
por: Wang, Wenqing, et al.
Publicado: (2025)
por: Wang, Wenqing, et al.
Publicado: (2025)
Impact of Road Infrastructure and Traffic Scenarios on E-scooterists' Riding and Gaze Behavior
por: Chen, Dong, et al.
Publicado: (2024)
por: Chen, Dong, et al.
Publicado: (2024)
CrashSight: A Phase-Aware, Infrastructure-Centric Video Benchmark for Traffic Crash Scene Understanding and Reasoning
por: Gan, Rui, et al.
Publicado: (2026)
por: Gan, Rui, et al.
Publicado: (2026)
DIFFVSGG: Diffusion-Driven Online Video Scene Graph Generation
por: Chen, Mu, et al.
Publicado: (2025)
por: Chen, Mu, et al.
Publicado: (2025)
EP-Diffuser: An Efficient Diffusion Model for Traffic Scene Generation and Prediction via Polynomial Representations
por: Yao, Yue, et al.
Publicado: (2025)
por: Yao, Yue, et al.
Publicado: (2025)
EgoExo-Gen: Ego-centric Video Prediction by Watching Exo-centric Videos
por: Xu, Jilan, et al.
Publicado: (2025)
por: Xu, Jilan, et al.
Publicado: (2025)
MIDI: Multi-Instance Diffusion for Single Image to 3D Scene Generation
por: Huang, Zehuan, et al.
Publicado: (2024)
por: Huang, Zehuan, et al.
Publicado: (2024)
Hazard-Aware Traffic Scene Graph Generation
por: Huang, Yaoqi, et al.
Publicado: (2026)
por: Huang, Yaoqi, et al.
Publicado: (2026)
SANA-WM: Efficient Minute-Scale World Modeling with Hybrid Linear Diffusion Transformer
por: Zhu, Haoyi, et al.
Publicado: (2026)
por: Zhu, Haoyi, et al.
Publicado: (2026)
DragTraffic: Interactive and Controllable Traffic Scene Generation for Autonomous Driving
por: Wang, Sheng, et al.
Publicado: (2024)
por: Wang, Sheng, et al.
Publicado: (2024)
Ejemplares similares
-
TSDiT: Traffic Scene Diffusion Models With Transformers
por: Yang, Chen, et al.
Publicado: (2023) -
Multimodal Data Integration for Sustainable Indoor Gardening: Tracking Anyplant with Time Series Foundation Model
por: Nabaei, Seyed Hamidreza, et al.
Publicado: (2025) -
Free-Mask: A Novel Paradigm of Integration Between the Segmentation Diffusion Model and Image Editing
por: Gao, Bo, et al.
Publicado: (2024) -
Real-Time Roadway Obstacle Detection for Electric Scooters Using Deep Learning and Multi-Sensor Fusion
por: Zheng, Zeyang, et al.
Publicado: (2025) -
DDPM-MoCo: Advancing Industrial Surface Defect Generation and Detection with Generative and Contrastive Learning
por: He, Yangfan, et al.
Publicado: (2024)