Guardado en:
| Autores principales: | Wang, Qisen, Zhao, Yifan, Shen, Peisen, Li, Jialu, Li, Jia |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2512.01481 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
WorldTree: Towards 4D Dynamic Worlds from Monocular Video using Tree-Chains
por: Wang, Qisen, et al.
Publicado: (2026)
por: Wang, Qisen, et al.
Publicado: (2026)
How to Use Diffusion Priors under Sparse Views?
por: Wang, Qisen, et al.
Publicado: (2024)
por: Wang, Qisen, et al.
Publicado: (2024)
ChronoEdit: Towards Temporal Reasoning for Image Editing and World Simulation
por: Wu, Jay Zhangjie, et al.
Publicado: (2025)
por: Wu, Jay Zhangjie, et al.
Publicado: (2025)
DiT4SR: Taming Diffusion Transformer for Real-World Image Super-Resolution
por: Duan, Zheng-Peng, et al.
Publicado: (2025)
por: Duan, Zheng-Peng, et al.
Publicado: (2025)
Taming Sampling Perturbations with Variance Expansion Loss for Latent Diffusion Models
por: Li, Qifan, et al.
Publicado: (2026)
por: Li, Qifan, et al.
Publicado: (2026)
DOME: Taming Diffusion Model into High-Fidelity Controllable Occupancy World Model
por: Gu, Songen, et al.
Publicado: (2024)
por: Gu, Songen, et al.
Publicado: (2024)
Taming Real-World Space-Time Video Super-Resolution with One-Step Diffusion
por: Wei, Shuoyan, et al.
Publicado: (2026)
por: Wei, Shuoyan, et al.
Publicado: (2026)
HoloTime: Taming Video Diffusion Models for Panoramic 4D Scene Generation
por: Zhou, Haiyang, et al.
Publicado: (2025)
por: Zhou, Haiyang, et al.
Publicado: (2025)
ControlSR: Taming Diffusion Models for Consistent Real-World Image Super Resolution
por: Wan, Yuhao, et al.
Publicado: (2024)
por: Wan, Yuhao, et al.
Publicado: (2024)
Gradient-Free Classifier Guidance for Diffusion Model Sampling
por: Shenoy, Rahul, et al.
Publicado: (2024)
por: Shenoy, Rahul, et al.
Publicado: (2024)
DepthMaster: Taming Diffusion Models for Monocular Depth Estimation
por: Song, Ziyang, et al.
Publicado: (2025)
por: Song, Ziyang, et al.
Publicado: (2025)
OneWorld: Taming Scene Generation with 3D Unified Representation Autoencoder
por: Gao, Sensen, et al.
Publicado: (2026)
por: Gao, Sensen, et al.
Publicado: (2026)
Diffusion-Classifier Synergy: Reward-Aligned Learning via Mutual Boosting Loop for FSCIL
por: Wu, Ruitao, et al.
Publicado: (2025)
por: Wu, Ruitao, et al.
Publicado: (2025)
DiP: Taming Diffusion Models in Pixel Space
por: Chen, Zhennan, et al.
Publicado: (2025)
por: Chen, Zhennan, et al.
Publicado: (2025)
SpikeVAEDiff: Neural Spike-based Natural Visual Scene Reconstruction via VD-VAE and Versatile Diffusion
por: Li, Jialu, et al.
Publicado: (2026)
por: Li, Jialu, et al.
Publicado: (2026)
UMG-CLIP: A Unified Multi-Granularity Vision Generalist for Open-World Understanding
por: Shi, Bowen, et al.
Publicado: (2024)
por: Shi, Bowen, et al.
Publicado: (2024)
ChronoTailor: Harnessing Attention Guidance for Fine-Grained Video Virtual Try-On
por: Wang, Jinjuan, et al.
Publicado: (2025)
por: Wang, Jinjuan, et al.
Publicado: (2025)
Ranni: Taming Text-to-Image Diffusion for Accurate Instruction Following
por: Feng, Yutong, et al.
Publicado: (2023)
por: Feng, Yutong, et al.
Publicado: (2023)
ArtHOI: Taming Foundation Models for Monocular 4D Reconstruction of Hand-Articulated-Object Interactions
por: Wang, Zikai, et al.
Publicado: (2026)
por: Wang, Zikai, et al.
Publicado: (2026)
Taming Diffusion Models for Image Restoration: A Review
por: Luo, Ziwei, et al.
Publicado: (2024)
por: Luo, Ziwei, et al.
Publicado: (2024)
OCCDiff: Occupancy Diffusion Model for High-Fidelity 3D Building Reconstruction from Noisy Point Clouds
por: Sui, Jialu, et al.
Publicado: (2025)
por: Sui, Jialu, et al.
Publicado: (2025)
Taming Diffusion Prior for Image Super-Resolution with Domain Shift SDEs
por: Cui, Qinpeng, et al.
Publicado: (2024)
por: Cui, Qinpeng, et al.
Publicado: (2024)
VSDiffusion: Taming Ill-Posed Shadow Generation via Visibility-Constrained Diffusion
por: Li, Jing, et al.
Publicado: (2026)
por: Li, Jing, et al.
Publicado: (2026)
OmniWorld: A Multi-Domain and Multi-Modal Dataset for 4D World Modeling
por: Zhou, Yang, et al.
Publicado: (2025)
por: Zhou, Yang, et al.
Publicado: (2025)
VD3D: Taming Large Video Diffusion Transformers for 3D Camera Control
por: Bahmani, Sherwin, et al.
Publicado: (2024)
por: Bahmani, Sherwin, et al.
Publicado: (2024)
Zero-1-to-G: Taming Pretrained 2D Diffusion Model for Direct 3D Generation
por: Meng, Xuyi, et al.
Publicado: (2025)
por: Meng, Xuyi, et al.
Publicado: (2025)
Taming Video Diffusion Prior with Scene-Grounding Guidance for 3D Gaussian Splatting from Sparse Inputs
por: Zhong, Yingji, et al.
Publicado: (2025)
por: Zhong, Yingji, et al.
Publicado: (2025)
Tango: Taming Visual Signals for Efficient Video Large Language Models
por: Yin, Shukang, et al.
Publicado: (2026)
por: Yin, Shukang, et al.
Publicado: (2026)
CharacterFactory: Sampling Consistent Characters with GANs for Diffusion Models
por: Wang, Qinghe, et al.
Publicado: (2024)
por: Wang, Qinghe, et al.
Publicado: (2024)
Taming Video Models for 3D and 4D Generation via Zero-Shot Camera Control
por: Song, Chenxi, et al.
Publicado: (2025)
por: Song, Chenxi, et al.
Publicado: (2025)
Diffuman4D: 4D Consistent Human View Synthesis from Sparse-View Videos with Spatio-Temporal Diffusion Models
por: Jin, Yudong, et al.
Publicado: (2025)
por: Jin, Yudong, et al.
Publicado: (2025)
MuDG: Taming Multi-modal Diffusion with Gaussian Splatting for Urban Scene Reconstruction
por: Zou, Yingshuang, et al.
Publicado: (2025)
por: Zou, Yingshuang, et al.
Publicado: (2025)
Taming Diffusion for Dataset Distillation with High Representativeness
por: Zhao, Lin, et al.
Publicado: (2025)
por: Zhao, Lin, et al.
Publicado: (2025)
HABIT: Chrono-Synergia Robust Progressive Learning Framework for Composed Image Retrieval
por: Li, Zixu, et al.
Publicado: (2026)
por: Li, Zixu, et al.
Publicado: (2026)
Learning Yourself: Class-Incremental Semantic Segmentation with Language-Inspired Bootstrapped Disentanglement
por: Wu, Ruitao, et al.
Publicado: (2025)
por: Wu, Ruitao, et al.
Publicado: (2025)
Parsing Objects at a Finer Granularity: A Survey
por: Zhao, Yifan, et al.
Publicado: (2022)
por: Zhao, Yifan, et al.
Publicado: (2022)
ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis
por: Yu, Wangbo, et al.
Publicado: (2024)
por: Yu, Wangbo, et al.
Publicado: (2024)
Taming Preference Mode Collapse via Directional Decoupling Alignment in Diffusion Reinforcement Learning
por: Chen, Chubin, et al.
Publicado: (2025)
por: Chen, Chubin, et al.
Publicado: (2025)
You Only Sample Once: Taming One-Step Text-to-Image Synthesis by Self-Cooperative Diffusion GANs
por: Luo, Yihong, et al.
Publicado: (2024)
por: Luo, Yihong, et al.
Publicado: (2024)
Free Lunch to Meet the Gap: Intermediate Domain Reconstruction for Cross-Domain Few-Shot Learning
por: Zhang, Tong, et al.
Publicado: (2025)
por: Zhang, Tong, et al.
Publicado: (2025)
Ejemplares similares
-
WorldTree: Towards 4D Dynamic Worlds from Monocular Video using Tree-Chains
por: Wang, Qisen, et al.
Publicado: (2026) -
How to Use Diffusion Priors under Sparse Views?
por: Wang, Qisen, et al.
Publicado: (2024) -
ChronoEdit: Towards Temporal Reasoning for Image Editing and World Simulation
por: Wu, Jay Zhangjie, et al.
Publicado: (2025) -
DiT4SR: Taming Diffusion Transformer for Real-World Image Super-Resolution
por: Duan, Zheng-Peng, et al.
Publicado: (2025) -
Taming Sampling Perturbations with Variance Expansion Loss for Latent Diffusion Models
por: Li, Qifan, et al.
Publicado: (2026)