Tuning Timestep-Distilled Diffusion Model Using Pairwise Sample Optimization
Fuente:
arXiv
Salvato in:
| Autori principali: | Miao, Zichen, Yang, Zhengyuan, Lin, Kevin, Wang, Ze, Liu, Zicheng, Wang, Lijuan, Qiu, Qiang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Conditional Text-to-Image Generation with Reference Guidance
di: Kim, Taewook, et al.
Pubblicazione: (2024)
di: Kim, Taewook, et al.
Pubblicazione: (2024)
Bring Metric Functions into Diffusion Models
di: An, Jie, et al.
Pubblicazione: (2024)
di: An, Jie, et al.
Pubblicazione: (2024)
Coeff-Tuning: A Graph Filter Subspace View for Tuning Attention-Based Large Models
di: Miao, Zichen, et al.
Pubblicazione: (2025)
di: Miao, Zichen, et al.
Pubblicazione: (2025)
Motion Consistency Model: Accelerating Video Diffusion with Disentangled Motion-Appearance Distillation
di: Zhai, Yuanhao, et al.
Pubblicazione: (2024)
di: Zhai, Yuanhao, et al.
Pubblicazione: (2024)
Large Convolutional Model Tuning via Filter Subspace
di: Chen, Wei, et al.
Pubblicazione: (2024)
di: Chen, Wei, et al.
Pubblicazione: (2024)
Idea2Img: Iterative Self-Refinement with GPT-4V(ision) for Automatic Image Design and Generation
di: Yang, Zhengyuan, et al.
Pubblicazione: (2023)
di: Yang, Zhengyuan, et al.
Pubblicazione: (2023)
IDOL: Unified Dual-Modal Latent Diffusion for Human-Centric Joint Video-Depth Generation
di: Zhai, Yuanhao, et al.
Pubblicazione: (2024)
di: Zhai, Yuanhao, et al.
Pubblicazione: (2024)
Glance: Accelerating Diffusion Models with 1 Sample
di: Dong, Zhuobai, et al.
Pubblicazione: (2025)
di: Dong, Zhuobai, et al.
Pubblicazione: (2025)
Sparse Fine-Tuning of Transformers for Generative Tasks
di: Chen, Wei, et al.
Pubblicazione: (2025)
di: Chen, Wei, et al.
Pubblicazione: (2025)
Timestep-Aware Correction for Quantized Diffusion Models
di: Yao, Yuzhe, et al.
Pubblicazione: (2024)
di: Yao, Yuzhe, et al.
Pubblicazione: (2024)
Image-Free Timestep Distillation via Continuous-Time Consistency with Trajectory-Sampled Pairs
di: Tang, Bao, et al.
Pubblicazione: (2025)
di: Tang, Bao, et al.
Pubblicazione: (2025)
Model-Agnostic Human Preference Inversion in Diffusion Models
di: Kim, Jeeyung, et al.
Pubblicazione: (2024)
di: Kim, Jeeyung, et al.
Pubblicazione: (2024)
Timestep Embedding Tells: It's Time to Cache for Video Diffusion Model
di: Liu, Feng, et al.
Pubblicazione: (2024)
di: Liu, Feng, et al.
Pubblicazione: (2024)
MM-Vet: Evaluating Large Multimodal Models for Integrated Capabilities
di: Yu, Weihao, et al.
Pubblicazione: (2023)
di: Yu, Weihao, et al.
Pubblicazione: (2023)
TASR: Timestep-Aware Diffusion Model for Image Super-Resolution
di: Lin, Qinwei, et al.
Pubblicazione: (2024)
di: Lin, Qinwei, et al.
Pubblicazione: (2024)
ERTACache: Error Rectification and Timesteps Adjustment for Efficient Diffusion
di: Peng, Xurui, et al.
Pubblicazione: (2025)
di: Peng, Xurui, et al.
Pubblicazione: (2025)
DisCo: Disentangled Control for Realistic Human Dance Generation
di: Wang, Tan, et al.
Pubblicazione: (2023)
di: Wang, Tan, et al.
Pubblicazione: (2023)
SoTA with Less: MCTS-Guided Sample Selection for Data-Efficient Visual Reasoning Self-Improvement
di: Wang, Xiyao, et al.
Pubblicazione: (2025)
di: Wang, Xiyao, et al.
Pubblicazione: (2025)
LiVOS: Light Video Object Segmentation with Gated Linear Matching
di: Liu, Qin, et al.
Pubblicazione: (2024)
di: Liu, Qin, et al.
Pubblicazione: (2024)
COSMO: COntrastive Streamlined MultimOdal Model with Interleaved Pre-Training
di: Wang, Alex Jinpeng, et al.
Pubblicazione: (2024)
di: Wang, Alex Jinpeng, et al.
Pubblicazione: (2024)
Target-Driven Distillation: Consistency Distillation with Target Timestep Selection and Decoupled Guidance
di: Wang, Cunzheng, et al.
Pubblicazione: (2024)
di: Wang, Cunzheng, et al.
Pubblicazione: (2024)
FantasyTalking2: Timestep-Layer Adaptive Preference Optimization for Audio-Driven Portrait Animation
di: Wang, MengChao, et al.
Pubblicazione: (2025)
di: Wang, MengChao, et al.
Pubblicazione: (2025)
TCAQ-DM: Timestep-Channel Adaptive Quantization for Diffusion Models
di: Huang, Haocheng, et al.
Pubblicazione: (2024)
di: Huang, Haocheng, et al.
Pubblicazione: (2024)
Generative Multimodal Pretraining with Discrete Diffusion Timestep Tokens
di: Pan, Kaihang, et al.
Pubblicazione: (2025)
di: Pan, Kaihang, et al.
Pubblicazione: (2025)
MM-Vet v2: A Challenging Benchmark to Evaluate Large Multimodal Models for Integrated Capabilities
di: Yu, Weihao, et al.
Pubblicazione: (2024)
di: Yu, Weihao, et al.
Pubblicazione: (2024)
Towards More Accurate Diffusion Model Acceleration with A Timestep Tuner
di: Xia, Mengfei, et al.
Pubblicazione: (2023)
di: Xia, Mengfei, et al.
Pubblicazione: (2023)
Adaptive Non-uniform Timestep Sampling for Accelerating Diffusion Model Training
di: Kim, Myunsoo, et al.
Pubblicazione: (2024)
di: Kim, Myunsoo, et al.
Pubblicazione: (2024)
D-OPSD: On-Policy Self-Distillation for Continuously Tuning Step-Distilled Diffusion Models
di: Jiang, Dengyang, et al.
Pubblicazione: (2026)
di: Jiang, Dengyang, et al.
Pubblicazione: (2026)
Beyond Words: Advancing Long-Text Image Generation via Multimodal Autoregressive Models
di: Wang, Alex Jinpeng, et al.
Pubblicazione: (2025)
di: Wang, Alex Jinpeng, et al.
Pubblicazione: (2025)
Point-RFT: Improving Multimodal Reasoning with Visually Grounded Reinforcement Finetuning
di: Ni, Minheng, et al.
Pubblicazione: (2025)
di: Ni, Minheng, et al.
Pubblicazione: (2025)
ImageGen-CoT: Enhancing Text-to-Image In-context Learning with Chain-of-Thought Reasoning
di: Liao, Jiaqi, et al.
Pubblicazione: (2025)
di: Liao, Jiaqi, et al.
Pubblicazione: (2025)
Redefining Temporal Modeling in Video Diffusion: The Vectorized Timestep Approach
di: Liu, Yaofang, et al.
Pubblicazione: (2024)
di: Liu, Yaofang, et al.
Pubblicazione: (2024)
Timestep-Aware Diffusion Model for Extreme Image Rescaling
di: Wang, Ce, et al.
Pubblicazione: (2024)
di: Wang, Ce, et al.
Pubblicazione: (2024)
DyDiT++: Diffusion Transformers with Timestep and Spatial Dynamics for Efficient Visual Generation
di: Zhao, Wangbo, et al.
Pubblicazione: (2025)
di: Zhao, Wangbo, et al.
Pubblicazione: (2025)
AutoDirector: Online Auto-scheduling Agents for Multi-sensory Composition
di: Ni, Minheng, et al.
Pubblicazione: (2024)
di: Ni, Minheng, et al.
Pubblicazione: (2024)
Timestep-Aware Block Masking for Efficient Diffusion Model Inference
di: He, Haodong, et al.
Pubblicazione: (2026)
di: He, Haodong, et al.
Pubblicazione: (2026)
TiNO-Edit: Timestep and Noise Optimization for Robust Diffusion-Based Image Editing
di: Chen, Sherry X., et al.
Pubblicazione: (2024)
di: Chen, Sherry X., et al.
Pubblicazione: (2024)
Reasoning Physical Video Generation with Diffusion Timestep Tokens via Reinforcement Learning
di: Lin, Wang, et al.
Pubblicazione: (2025)
di: Lin, Wang, et al.
Pubblicazione: (2025)
Frame-wise Conditioning Adaptation for Fine-Tuning Diffusion Models in Text-to-Video Prediction
di: Liu, Zheyuan, et al.
Pubblicazione: (2025)
di: Liu, Zheyuan, et al.
Pubblicazione: (2025)
Early-Bird Diffusion: Investigating and Leveraging Timestep-Aware Early-Bird Tickets in Diffusion Models for Efficient Training
di: Whalen, Lexington, et al.
Pubblicazione: (2025)
di: Whalen, Lexington, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Conditional Text-to-Image Generation with Reference Guidance
di: Kim, Taewook, et al.
Pubblicazione: (2024) -
Bring Metric Functions into Diffusion Models
di: An, Jie, et al.
Pubblicazione: (2024) -
Coeff-Tuning: A Graph Filter Subspace View for Tuning Attention-Based Large Models
di: Miao, Zichen, et al.
Pubblicazione: (2025) -
Motion Consistency Model: Accelerating Video Diffusion with Disentangled Motion-Appearance Distillation
di: Zhai, Yuanhao, et al.
Pubblicazione: (2024) -
Large Convolutional Model Tuning via Filter Subspace
di: Chen, Wei, et al.
Pubblicazione: (2024)