Accelerating Parallel Diffusion Model Serving with Residual Compression
Fuente:
arXiv
Guardado en:
| Autores principales: | Luo, Jiajun, Xiao, Yicheng, Xu, Jianru, You, Yangxiu, Lu, Rongwei, Tang, Chen, Jiang, Jingyan, Wang, Zhi |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
FREE: Uncertainty-Aware Autoregression for Parallel Diffusion Transformers
por: Wen, Xinwan, et al.
Publicado: (2025)
por: Wen, Xinwan, et al.
Publicado: (2025)
MesonGS: Post-training Compression of 3D Gaussians via Efficient Attribute Transformation
por: Xie, Shuzhao, et al.
Publicado: (2024)
por: Xie, Shuzhao, et al.
Publicado: (2024)
VVS: Accelerating Speculative Decoding for Visual Autoregressive Generation via Partial Verification Skipping
por: Dong, Haotian, et al.
Publicado: (2025)
por: Dong, Haotian, et al.
Publicado: (2025)
Staleness-Centric Optimizations for Parallel Diffusion MoE Inference
por: Luo, Jiajun, et al.
Publicado: (2024)
por: Luo, Jiajun, et al.
Publicado: (2024)
Neural Collapse in Test-Time Adaptation
por: Chen, Xiao, et al.
Publicado: (2025)
por: Chen, Xiao, et al.
Publicado: (2025)
Retraining-free Model Quantization via One-Shot Weight-Coupling Learning
por: Tang, Chen, et al.
Publicado: (2024)
por: Tang, Chen, et al.
Publicado: (2024)
Partially Conditioned Patch Parallelism for Accelerated Diffusion Model Inference
por: Zhang, XiuYu, et al.
Publicado: (2024)
por: Zhang, XiuYu, et al.
Publicado: (2024)
Ultra Lowrate Image Compression with Semantic Residual Coding and Compression-aware Diffusion
por: Ke, Anle, et al.
Publicado: (2025)
por: Ke, Anle, et al.
Publicado: (2025)
ParallelVLM: Lossless Video-LLM Acceleration with Visual Alignment Aware Parallel Speculative Decoding
por: Kong, Quan, et al.
Publicado: (2026)
por: Kong, Quan, et al.
Publicado: (2026)
RDEIC: Accelerating Diffusion-Based Extreme Image Compression with Relay Residual Diffusion
por: Li, Zhiyuan, et al.
Publicado: (2024)
por: Li, Zhiyuan, et al.
Publicado: (2024)
Test-Time Distillation for Continual Model Adaptation
por: Chen, Xiao, et al.
Publicado: (2025)
por: Chen, Xiao, et al.
Publicado: (2025)
Invertible Residual Rescaling Models
por: Li, Jinmin, et al.
Publicado: (2024)
por: Li, Jinmin, et al.
Publicado: (2024)
Parallel Diffusion Solver via Residual Dirichlet Policy Optimization
por: Wang, Ruoyu, et al.
Publicado: (2025)
por: Wang, Ruoyu, et al.
Publicado: (2025)
Beyond Few-Step Inference: Accelerating Video Diffusion Transformer Model Serving with Inter-Request Caching Reuse
por: Liu, Hao, et al.
Publicado: (2026)
por: Liu, Hao, et al.
Publicado: (2026)
ProCache: Constraint-Aware Feature Caching with Selective Computation for Diffusion Transformer Acceleration
por: Cao, Fanpu, et al.
Publicado: (2025)
por: Cao, Fanpu, et al.
Publicado: (2025)
Q-DiT: Accurate Post-Training Quantization for Diffusion Transformers
por: Chen, Lei, et al.
Publicado: (2024)
por: Chen, Lei, et al.
Publicado: (2024)
TMPQ-DM: Joint Timestep Reduction and Quantization Precision Selection for Efficient Diffusion Models
por: Sun, Haojun, et al.
Publicado: (2024)
por: Sun, Haojun, et al.
Publicado: (2024)
OFA-Diffusion Compression: Compressing Diffusion Model in One-Shot Manner
por: Jiang, Haoyang, et al.
Publicado: (2026)
por: Jiang, Haoyang, et al.
Publicado: (2026)
Forcing-KV: Hybrid KV Cache Compression for Efficient Autoregressive Video Diffusion Models
por: Ji, Yicheng, et al.
Publicado: (2026)
por: Ji, Yicheng, et al.
Publicado: (2026)
SCott: Accelerating Diffusion Models with Stochastic Consistency Distillation
por: Liu, Hongjian, et al.
Publicado: (2024)
por: Liu, Hongjian, et al.
Publicado: (2024)
HiDiffusion: Unlocking Higher-Resolution Creativity and Efficiency in Pretrained Diffusion Models
por: Zhang, Shen, et al.
Publicado: (2023)
por: Zhang, Shen, et al.
Publicado: (2023)
POINTS-Reader: Distillation-Free Adaptation of Vision-Language Models for Document Conversion
por: Liu, Yuan, et al.
Publicado: (2025)
por: Liu, Yuan, et al.
Publicado: (2025)
Residual Denoising Diffusion Models
por: Liu, Jiawei, et al.
Publicado: (2023)
por: Liu, Jiawei, et al.
Publicado: (2023)
LAPTOP-Diff: Layer Pruning and Normalized Distillation for Compressing Diffusion Models
por: Zhang, Dingkun, et al.
Publicado: (2024)
por: Zhang, Dingkun, et al.
Publicado: (2024)
Denoising as Path Planning: Training-Free Acceleration of Diffusion Models with DPCache
por: Cui, Bowen, et al.
Publicado: (2026)
por: Cui, Bowen, et al.
Publicado: (2026)
POINTS-GUI-G: GUI-Grounding Journey
por: Zhao, Zhongyin, et al.
Publicado: (2026)
por: Zhao, Zhongyin, et al.
Publicado: (2026)
RPD-Diff: Region-Adaptive Physics-Guided Diffusion Model for Visibility Enhancement under Dense and Non-Uniform Haze
por: Zhang, Ruicheng, et al.
Publicado: (2025)
por: Zhang, Ruicheng, et al.
Publicado: (2025)
Prior-Guided Residual Diffusion: Calibrated and Efficient Medical Image Segmentation
por: Mao, Fuyou, et al.
Publicado: (2025)
por: Mao, Fuyou, et al.
Publicado: (2025)
Residual Diffusion Bridge Model for Image Restoration
por: Wang, Hebaixu, et al.
Publicado: (2025)
por: Wang, Hebaixu, et al.
Publicado: (2025)
Invertible Diffusion Models for Compressed Sensing
por: Chen, Bin, et al.
Publicado: (2024)
por: Chen, Bin, et al.
Publicado: (2024)
Deep Compression Autoencoder for Efficient High-Resolution Diffusion Models
por: Chen, Junyu, et al.
Publicado: (2024)
por: Chen, Junyu, et al.
Publicado: (2024)
Optimizing Diffusion Noise Can Serve As Universal Motion Priors
por: Karunratanakul, Korrawe, et al.
Publicado: (2023)
por: Karunratanakul, Korrawe, et al.
Publicado: (2023)
Rethinking Autoregressive Models for Lossless Image Compression via Hierarchical Parallelism and Progressive Adaptation
por: Li, Daxin, et al.
Publicado: (2025)
por: Li, Daxin, et al.
Publicado: (2025)
RecDiffusion: Rectangling for Image Stitching with Diffusion Models
por: Zhou, Tianhao, et al.
Publicado: (2024)
por: Zhou, Tianhao, et al.
Publicado: (2024)
Immiscible Diffusion: Accelerating Diffusion Training with Noise Assignment
por: Li, Yiheng, et al.
Publicado: (2024)
por: Li, Yiheng, et al.
Publicado: (2024)
IPAD: Iterative, Parallel, and Diffusion-based Network for Scene Text Recognition
por: Yang, Xiaomeng, et al.
Publicado: (2023)
por: Yang, Xiaomeng, et al.
Publicado: (2023)
Trajectory-Consistent Calibration for Cache-Accelerated Diffusion Models
por: Liang, Mingyu, et al.
Publicado: (2026)
por: Liang, Mingyu, et al.
Publicado: (2026)
RAPID^3: Tri-Level Reinforced Acceleration Policies for Diffusion Transformer
por: Zhao, Wangbo, et al.
Publicado: (2025)
por: Zhao, Wangbo, et al.
Publicado: (2025)
AdaDiff: Accelerating Diffusion Models through Step-Wise Adaptive Computation
por: Tang, Shengkun, et al.
Publicado: (2023)
por: Tang, Shengkun, et al.
Publicado: (2023)
BWCache: Accelerating Video Diffusion Transformers through Block-Wise Caching
por: Cui, Hanshuai, et al.
Publicado: (2025)
por: Cui, Hanshuai, et al.
Publicado: (2025)
Ejemplares similares
-
FREE: Uncertainty-Aware Autoregression for Parallel Diffusion Transformers
por: Wen, Xinwan, et al.
Publicado: (2025) -
MesonGS: Post-training Compression of 3D Gaussians via Efficient Attribute Transformation
por: Xie, Shuzhao, et al.
Publicado: (2024) -
VVS: Accelerating Speculative Decoding for Visual Autoregressive Generation via Partial Verification Skipping
por: Dong, Haotian, et al.
Publicado: (2025) -
Staleness-Centric Optimizations for Parallel Diffusion MoE Inference
por: Luo, Jiajun, et al.
Publicado: (2024) -
Neural Collapse in Test-Time Adaptation
por: Chen, Xiao, et al.
Publicado: (2025)