ChronosObserver: Taming 4D World with Hyperspace Diffusion Sampling
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Qisen, Zhao, Yifan, Shen, Peisen, Li, Jialu, Li, Jia |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
WorldTree: Towards 4D Dynamic Worlds from Monocular Video using Tree-Chains
di: Wang, Qisen, et al.
Pubblicazione: (2026)
di: Wang, Qisen, et al.
Pubblicazione: (2026)
How to Use Diffusion Priors under Sparse Views?
di: Wang, Qisen, et al.
Pubblicazione: (2024)
di: Wang, Qisen, et al.
Pubblicazione: (2024)
ChronoEdit: Towards Temporal Reasoning for Image Editing and World Simulation
di: Wu, Jay Zhangjie, et al.
Pubblicazione: (2025)
di: Wu, Jay Zhangjie, et al.
Pubblicazione: (2025)
DiT4SR: Taming Diffusion Transformer for Real-World Image Super-Resolution
di: Duan, Zheng-Peng, et al.
Pubblicazione: (2025)
di: Duan, Zheng-Peng, et al.
Pubblicazione: (2025)
Taming Sampling Perturbations with Variance Expansion Loss for Latent Diffusion Models
di: Li, Qifan, et al.
Pubblicazione: (2026)
di: Li, Qifan, et al.
Pubblicazione: (2026)
DOME: Taming Diffusion Model into High-Fidelity Controllable Occupancy World Model
di: Gu, Songen, et al.
Pubblicazione: (2024)
di: Gu, Songen, et al.
Pubblicazione: (2024)
HoloTime: Taming Video Diffusion Models for Panoramic 4D Scene Generation
di: Zhou, Haiyang, et al.
Pubblicazione: (2025)
di: Zhou, Haiyang, et al.
Pubblicazione: (2025)
Taming Real-World Space-Time Video Super-Resolution with One-Step Diffusion
di: Wei, Shuoyan, et al.
Pubblicazione: (2026)
di: Wei, Shuoyan, et al.
Pubblicazione: (2026)
ControlSR: Taming Diffusion Models for Consistent Real-World Image Super Resolution
di: Wan, Yuhao, et al.
Pubblicazione: (2024)
di: Wan, Yuhao, et al.
Pubblicazione: (2024)
DepthMaster: Taming Diffusion Models for Monocular Depth Estimation
di: Song, Ziyang, et al.
Pubblicazione: (2025)
di: Song, Ziyang, et al.
Pubblicazione: (2025)
OneWorld: Taming Scene Generation with 3D Unified Representation Autoencoder
di: Gao, Sensen, et al.
Pubblicazione: (2026)
di: Gao, Sensen, et al.
Pubblicazione: (2026)
Gradient-Free Classifier Guidance for Diffusion Model Sampling
di: Shenoy, Rahul, et al.
Pubblicazione: (2024)
di: Shenoy, Rahul, et al.
Pubblicazione: (2024)
DiP: Taming Diffusion Models in Pixel Space
di: Chen, Zhennan, et al.
Pubblicazione: (2025)
di: Chen, Zhennan, et al.
Pubblicazione: (2025)
ArtHOI: Taming Foundation Models for Monocular 4D Reconstruction of Hand-Articulated-Object Interactions
di: Wang, Zikai, et al.
Pubblicazione: (2026)
di: Wang, Zikai, et al.
Pubblicazione: (2026)
Diffusion-Classifier Synergy: Reward-Aligned Learning via Mutual Boosting Loop for FSCIL
di: Wu, Ruitao, et al.
Pubblicazione: (2025)
di: Wu, Ruitao, et al.
Pubblicazione: (2025)
ChronoTailor: Harnessing Attention Guidance for Fine-Grained Video Virtual Try-On
di: Wang, Jinjuan, et al.
Pubblicazione: (2025)
di: Wang, Jinjuan, et al.
Pubblicazione: (2025)
Ranni: Taming Text-to-Image Diffusion for Accurate Instruction Following
di: Feng, Yutong, et al.
Pubblicazione: (2023)
di: Feng, Yutong, et al.
Pubblicazione: (2023)
Taming Diffusion Models for Image Restoration: A Review
di: Luo, Ziwei, et al.
Pubblicazione: (2024)
di: Luo, Ziwei, et al.
Pubblicazione: (2024)
VSDiffusion: Taming Ill-Posed Shadow Generation via Visibility-Constrained Diffusion
di: Li, Jing, et al.
Pubblicazione: (2026)
di: Li, Jing, et al.
Pubblicazione: (2026)
Taming Diffusion Prior for Image Super-Resolution with Domain Shift SDEs
di: Cui, Qinpeng, et al.
Pubblicazione: (2024)
di: Cui, Qinpeng, et al.
Pubblicazione: (2024)
VD3D: Taming Large Video Diffusion Transformers for 3D Camera Control
di: Bahmani, Sherwin, et al.
Pubblicazione: (2024)
di: Bahmani, Sherwin, et al.
Pubblicazione: (2024)
Zero-1-to-G: Taming Pretrained 2D Diffusion Model for Direct 3D Generation
di: Meng, Xuyi, et al.
Pubblicazione: (2025)
di: Meng, Xuyi, et al.
Pubblicazione: (2025)
SpikeVAEDiff: Neural Spike-based Natural Visual Scene Reconstruction via VD-VAE and Versatile Diffusion
di: Li, Jialu, et al.
Pubblicazione: (2026)
di: Li, Jialu, et al.
Pubblicazione: (2026)
OmniWorld: A Multi-Domain and Multi-Modal Dataset for 4D World Modeling
di: Zhou, Yang, et al.
Pubblicazione: (2025)
di: Zhou, Yang, et al.
Pubblicazione: (2025)
UMG-CLIP: A Unified Multi-Granularity Vision Generalist for Open-World Understanding
di: Shi, Bowen, et al.
Pubblicazione: (2024)
di: Shi, Bowen, et al.
Pubblicazione: (2024)
OCCDiff: Occupancy Diffusion Model for High-Fidelity 3D Building Reconstruction from Noisy Point Clouds
di: Sui, Jialu, et al.
Pubblicazione: (2025)
di: Sui, Jialu, et al.
Pubblicazione: (2025)
Taming Video Diffusion Prior with Scene-Grounding Guidance for 3D Gaussian Splatting from Sparse Inputs
di: Zhong, Yingji, et al.
Pubblicazione: (2025)
di: Zhong, Yingji, et al.
Pubblicazione: (2025)
CharacterFactory: Sampling Consistent Characters with GANs for Diffusion Models
di: Wang, Qinghe, et al.
Pubblicazione: (2024)
di: Wang, Qinghe, et al.
Pubblicazione: (2024)
Tango: Taming Visual Signals for Efficient Video Large Language Models
di: Yin, Shukang, et al.
Pubblicazione: (2026)
di: Yin, Shukang, et al.
Pubblicazione: (2026)
You Only Sample Once: Taming One-Step Text-to-Image Synthesis by Self-Cooperative Diffusion GANs
di: Luo, Yihong, et al.
Pubblicazione: (2024)
di: Luo, Yihong, et al.
Pubblicazione: (2024)
MuDG: Taming Multi-modal Diffusion with Gaussian Splatting for Urban Scene Reconstruction
di: Zou, Yingshuang, et al.
Pubblicazione: (2025)
di: Zou, Yingshuang, et al.
Pubblicazione: (2025)
ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis
di: Yu, Wangbo, et al.
Pubblicazione: (2024)
di: Yu, Wangbo, et al.
Pubblicazione: (2024)
Diffuman4D: 4D Consistent Human View Synthesis from Sparse-View Videos with Spatio-Temporal Diffusion Models
di: Jin, Yudong, et al.
Pubblicazione: (2025)
di: Jin, Yudong, et al.
Pubblicazione: (2025)
Taming Preference Mode Collapse via Directional Decoupling Alignment in Diffusion Reinforcement Learning
di: Chen, Chubin, et al.
Pubblicazione: (2025)
di: Chen, Chubin, et al.
Pubblicazione: (2025)
Lifting Motion to the 3D World via 2D Diffusion
di: Li, Jiaman, et al.
Pubblicazione: (2024)
di: Li, Jiaman, et al.
Pubblicazione: (2024)
HABIT: Chrono-Synergia Robust Progressive Learning Framework for Composed Image Retrieval
di: Li, Zixu, et al.
Pubblicazione: (2026)
di: Li, Zixu, et al.
Pubblicazione: (2026)
TACO: Taming Diffusion for in-the-wild Video Amodal Completion
di: Lu, Ruijie, et al.
Pubblicazione: (2025)
di: Lu, Ruijie, et al.
Pubblicazione: (2025)
Taming Video Models for 3D and 4D Generation via Zero-Shot Camera Control
di: Song, Chenxi, et al.
Pubblicazione: (2025)
di: Song, Chenxi, et al.
Pubblicazione: (2025)
Learning Yourself: Class-Incremental Semantic Segmentation with Language-Inspired Bootstrapped Disentanglement
di: Wu, Ruitao, et al.
Pubblicazione: (2025)
di: Wu, Ruitao, et al.
Pubblicazione: (2025)
Parsing Objects at a Finer Granularity: A Survey
di: Zhao, Yifan, et al.
Pubblicazione: (2022)
di: Zhao, Yifan, et al.
Pubblicazione: (2022)
Documenti analoghi
-
WorldTree: Towards 4D Dynamic Worlds from Monocular Video using Tree-Chains
di: Wang, Qisen, et al.
Pubblicazione: (2026) -
How to Use Diffusion Priors under Sparse Views?
di: Wang, Qisen, et al.
Pubblicazione: (2024) -
ChronoEdit: Towards Temporal Reasoning for Image Editing and World Simulation
di: Wu, Jay Zhangjie, et al.
Pubblicazione: (2025) -
DiT4SR: Taming Diffusion Transformer for Real-World Image Super-Resolution
di: Duan, Zheng-Peng, et al.
Pubblicazione: (2025) -
Taming Sampling Perturbations with Variance Expansion Loss for Latent Diffusion Models
di: Li, Qifan, et al.
Pubblicazione: (2026)