AdaDiff: Adaptive Step Selection for Fast Diffusion Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, Hui, Wu, Zuxuan, Xing, Zhen, Shao, Jie, Jiang, Yu-Gang |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
AdaDiff: Accelerating Diffusion Models through Step-Wise Adaptive Computation
par: Tang, Shengkun, et autres
Publié: (2023)
par: Tang, Shengkun, et autres
Publié: (2023)
MagDiff: Multi-Alignment Diffusion for High-Fidelity Video Generation and Editing
par: Zhao, Haoyu, et autres
Publié: (2023)
par: Zhao, Haoyu, et autres
Publié: (2023)
AID: Adapting Image2Video Diffusion Models for Instruction-guided Video Prediction
par: Xing, Zhen, et autres
Publié: (2024)
par: Xing, Zhen, et autres
Publié: (2024)
A Survey on Video Diffusion Models
par: Xing, Zhen, et autres
Publié: (2023)
par: Xing, Zhen, et autres
Publié: (2023)
ArcFlow: Unleashing 2-Step Text-to-Image Generation via High-Precision Non-Linear Flow Distillation
par: Yang, Zihan, et autres
Publié: (2026)
par: Yang, Zihan, et autres
Publié: (2026)
AdaCorrection: Adaptive Offset Cache Correction for Accurate Diffusion Transformers
par: Liu, Dong, et autres
Publié: (2026)
par: Liu, Dong, et autres
Publié: (2026)
Downstream Transfer Attack: Adversarial Attacks on Downstream Models with Pre-trained Vision Transformers
par: Zheng, Weijie, et autres
Publié: (2024)
par: Zheng, Weijie, et autres
Publié: (2024)
StableAnimator++: Overcoming Pose Misalignment and Face Distortion for Human Image Animation
par: Tu, Shuyuan, et autres
Publié: (2025)
par: Tu, Shuyuan, et autres
Publié: (2025)
GeoGS3D: Single-view 3D Reconstruction via Geometric-aware Diffusion Model and Gaussian Splatting
par: Feng, Qijun, et autres
Publié: (2024)
par: Feng, Qijun, et autres
Publié: (2024)
DiffPoint: Single and Multi-view Point Cloud Reconstruction with ViT Based Diffusion Model
par: Feng, Yu, et autres
Publié: (2024)
par: Feng, Yu, et autres
Publié: (2024)
Daily-Omni: Towards Audio-Visual Reasoning with Temporal Alignment across Modalities
par: Zhou, Ziwei, et autres
Publié: (2025)
par: Zhou, Ziwei, et autres
Publié: (2025)
DiffMoE: Dynamic Token Selection for Scalable Diffusion Transformers
par: Shi, Minglei, et autres
Publié: (2025)
par: Shi, Minglei, et autres
Publié: (2025)
FlashMotion: Few-Step Controllable Video Generation with Trajectory Guidance
par: Li, Quanhao, et autres
Publié: (2026)
par: Li, Quanhao, et autres
Publié: (2026)
DiffSketcher: Text Guided Vector Sketch Synthesis through Latent Diffusion Models
par: Xing, Ximing, et autres
Publié: (2023)
par: Xing, Ximing, et autres
Publié: (2023)
VLA-Pro: Cross-Task Procedural Memory Transfer for Vision-Language-Action Models
par: Si, Shengyu, et autres
Publié: (2026)
par: Si, Shengyu, et autres
Publié: (2026)
GenRec: Unifying Video Generation and Recognition with Diffusion Models
par: Weng, Zejia, et autres
Publié: (2024)
par: Weng, Zejia, et autres
Publié: (2024)
Fuse Your Latents: Video Editing with Multi-source Latent Diffusion Models
par: Lu, Tianyi, et autres
Publié: (2023)
par: Lu, Tianyi, et autres
Publié: (2023)
Fast ODE-based Sampling for Diffusion Models in Around 5 Steps
par: Zhou, Zhenyu, et autres
Publié: (2023)
par: Zhou, Zhenyu, et autres
Publié: (2023)
MacDiff: Unified Skeleton Modeling with Masked Conditional Diffusion
par: Wu, Lehong, et autres
Publié: (2024)
par: Wu, Lehong, et autres
Publié: (2024)
Efficient-LVSM: Faster, Cheaper, and Better Large View Synthesis Model via Decoupled Co-Refinement Attention
par: Jia, Xiaosong, et autres
Publié: (2026)
par: Jia, Xiaosong, et autres
Publié: (2026)
VidLaDA: Bidirectional Diffusion Large Language Models for Efficient Video Understanding
par: He, Zhihao, et autres
Publié: (2026)
par: He, Zhihao, et autres
Publié: (2026)
AdaVid: Adaptive Video-Language Pretraining
par: Patel, Chaitanya, et autres
Publié: (2025)
par: Patel, Chaitanya, et autres
Publié: (2025)
MagicMotion: Controllable Video Generation with Dense-to-Sparse Trajectory Guidance
par: Li, Quanhao, et autres
Publié: (2025)
par: Li, Quanhao, et autres
Publié: (2025)
Ada-Tracker: Soft Tissue Tracking via Inter-Frame and Adaptive-Template Matching
par: Guo, Jiaxin, et autres
Publié: (2024)
par: Guo, Jiaxin, et autres
Publié: (2024)
AdaSVD: Adaptive Singular Value Decomposition for Large Language Models
par: Li, Zhiteng, et autres
Publié: (2025)
par: Li, Zhiteng, et autres
Publié: (2025)
DivDiff: A Conditional Diffusion Model for Diverse Human Motion Prediction
par: Yu, Hua, et autres
Publié: (2024)
par: Yu, Hua, et autres
Publié: (2024)
AnimateDiff-Lightning: Cross-Model Diffusion Distillation
par: Lin, Shanchuan, et autres
Publié: (2024)
par: Lin, Shanchuan, et autres
Publié: (2024)
AsyncDiff: Parallelizing Diffusion Models by Asynchronous Denoising
par: Chen, Zigeng, et autres
Publié: (2024)
par: Chen, Zigeng, et autres
Publié: (2024)
StableAnimator: High-Quality Identity-Preserving Human Image Animation
par: Tu, Shuyuan, et autres
Publié: (2024)
par: Tu, Shuyuan, et autres
Publié: (2024)
DiffSpeaker: Speech-Driven 3D Facial Animation with Diffusion Transformer
par: Ma, Zhiyuan, et autres
Publié: (2024)
par: Ma, Zhiyuan, et autres
Publié: (2024)
AdaZoom-GUI: Adaptive Zoom-based GUI Grounding with Instruction Refinement
par: Pei, Siqi, et autres
Publié: (2026)
par: Pei, Siqi, et autres
Publié: (2026)
DiffCAP: Diffusion-based Cumulative Adversarial Purification for Vision Language Models
par: Fu, Jia, et autres
Publié: (2025)
par: Fu, Jia, et autres
Publié: (2025)
FluxMem: Adaptive Hierarchical Memory for Streaming Video Understanding
par: Xie, Yiweng, et autres
Publié: (2026)
par: Xie, Yiweng, et autres
Publié: (2026)
CoCoDiff: Correspondence-Consistent Diffusion Model for Fine-grained Style Transfer
par: Nie, Wenbo, et autres
Publié: (2026)
par: Nie, Wenbo, et autres
Publié: (2026)
DiffGuard: Text-Based Safety Checker for Diffusion Models
par: Khader, Massine El, et autres
Publié: (2024)
par: Khader, Massine El, et autres
Publié: (2024)
DiffMorph: Text-less Image Morphing with Diffusion Models
par: Chatterjee, Shounak
Publié: (2024)
par: Chatterjee, Shounak
Publié: (2024)
RealignDiff: Boosting Text-to-Image Diffusion Model with Coarse-to-fine Semantic Re-alignment
par: Jiang, Zutao, et autres
Publié: (2023)
par: Jiang, Zutao, et autres
Publié: (2023)
DualFast: Dual-Speedup Framework for Fast Sampling of Diffusion Models
par: Yu, Hu, et autres
Publié: (2025)
par: Yu, Hu, et autres
Publié: (2025)
AdaTP: Attention-Debiased Token Pruning for Video Large Language Models
par: Sun, Fengyuan, et autres
Publié: (2025)
par: Sun, Fengyuan, et autres
Publié: (2025)
DiffHDR: Re-Exposing LDR Videos with Video Diffusion Models
par: Yu, Zhengming, et autres
Publié: (2026)
par: Yu, Zhengming, et autres
Publié: (2026)
Documents similaires
-
AdaDiff: Accelerating Diffusion Models through Step-Wise Adaptive Computation
par: Tang, Shengkun, et autres
Publié: (2023) -
MagDiff: Multi-Alignment Diffusion for High-Fidelity Video Generation and Editing
par: Zhao, Haoyu, et autres
Publié: (2023) -
AID: Adapting Image2Video Diffusion Models for Instruction-guided Video Prediction
par: Xing, Zhen, et autres
Publié: (2024) -
A Survey on Video Diffusion Models
par: Xing, Zhen, et autres
Publié: (2023) -
ArcFlow: Unleashing 2-Step Text-to-Image Generation via High-Precision Non-Linear Flow Distillation
par: Yang, Zihan, et autres
Publié: (2026)