Partially Conditioned Patch Parallelism for Accelerated Diffusion Model Inference
Fuente:
arXiv
Saved in:
| Main Authors: | Zhang, XiuYu, Luo, Zening, Lu, Michelle E. |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
STADI: Fine-Grained Step-Patch Diffusion Parallelism for Heterogeneous GPUs
by: Liang, Han, et al.
Published: (2025)
by: Liang, Han, et al.
Published: (2025)
SwiftFusion: Scalable Sequence Parallelism for Distributed Inference of Diffusion Transformers on GPUs
by: Yang, Jiacheng, et al.
Published: (2026)
by: Yang, Jiacheng, et al.
Published: (2026)
Parallel Watershed Partitioning: GPU-Based Hierarchical Image Segmentation
by: Yeghiazaryan, Varduhi, et al.
Published: (2024)
by: Yeghiazaryan, Varduhi, et al.
Published: (2024)
LongLive-2.0: An NVFP4 Parallel Infrastructure for Long Video Generation
by: Chen, Yukang, et al.
Published: (2026)
by: Chen, Yukang, et al.
Published: (2026)
Accelerating ViT Inference on FPGA through Static and Dynamic Pruning
by: Parikh, Dhruv, et al.
Published: (2024)
by: Parikh, Dhruv, et al.
Published: (2024)
KnapFormer: An Online Load Balancer for Efficient Diffusion Transformers Training
by: Zhang, Kai, et al.
Published: (2025)
by: Zhang, Kai, et al.
Published: (2025)
DSFedMed: Dual-Scale Federated Medical Image Segmentation via Mutual Distillation Between Foundation and Lightweight Models
by: Zhang, Hanwen, et al.
Published: (2026)
by: Zhang, Hanwen, et al.
Published: (2026)
InvarDiff: Cross-Scale Invariance Caching for Accelerated Diffusion Models
by: Wu, Zihao
Published: (2025)
by: Wu, Zihao
Published: (2025)
Covariance-Guided Resource Adaptive Learning for Efficient Edge Inference
by: Nabhaan, Ahmad N. L., et al.
Published: (2026)
by: Nabhaan, Ahmad N. L., et al.
Published: (2026)
DSV: Exploiting Dynamic Sparsity to Accelerate Large-Scale Video DiT Training
by: Tan, Xin, et al.
Published: (2025)
by: Tan, Xin, et al.
Published: (2025)
GraphLeap: Decoupling Graph Construction and Convolution for Vision GNN Acceleration on FPGA
by: Ramachandran, Anvitha, et al.
Published: (2026)
by: Ramachandran, Anvitha, et al.
Published: (2026)
Argus: Quality-Aware High-Throughput Text-to-Image Inference Serving System
by: Agarwal, Shubham, et al.
Published: (2025)
by: Agarwal, Shubham, et al.
Published: (2025)
PipeDiT: Accelerating Diffusion Transformers in Video Generation with Task Pipelining and Model Decoupling
by: Wang, Sijie, et al.
Published: (2025)
by: Wang, Sijie, et al.
Published: (2025)
Ask the Expert: Collaborative Inference for Vision Transformers with Near-Edge Accelerators
by: Liu, Hao, et al.
Published: (2026)
by: Liu, Hao, et al.
Published: (2026)
Transforming the Use of Earth Observation Data: Exascale Training of a Generative Compression Model with Historical Priors for up to 10,000x Data Reduction
by: Zhang, Jinxiao, et al.
Published: (2026)
by: Zhang, Jinxiao, et al.
Published: (2026)
A New One-Shot Federated Learning Framework for Medical Imaging Classification with Feature-Guided Rectified Flow and Knowledge Distillation
by: Ma, Yufei, et al.
Published: (2025)
by: Ma, Yufei, et al.
Published: (2025)
Staleness-Centric Optimizations for Parallel Diffusion MoE Inference
by: Luo, Jiajun, et al.
Published: (2024)
by: Luo, Jiajun, et al.
Published: (2024)
Federated Learning for Medical Image Classification: A Comprehensive Benchmark
by: Zhou, Zhekai, et al.
Published: (2025)
by: Zhou, Zhekai, et al.
Published: (2025)
FedDyMem: Efficient Federated Learning with Dynamic Memory and Memory-Reduce for Unsupervised Image Anomaly Detection
by: Chen, Silin, et al.
Published: (2025)
by: Chen, Silin, et al.
Published: (2025)
Decentralized Diffusion Models
by: McAllister, David, et al.
Published: (2025)
by: McAllister, David, et al.
Published: (2025)
Personalized Federated Fine-Tuning of Vision Foundation Models for Healthcare
by: Tupper, Adam, et al.
Published: (2025)
by: Tupper, Adam, et al.
Published: (2025)
ECORE: Energy-Conscious Optimized Routing for Deep Learning Models at the Edge
by: Alqahtani, Daghash K., et al.
Published: (2025)
by: Alqahtani, Daghash K., et al.
Published: (2025)
FedVSR: Towards Model-Agnostic Federated Learning in Video Super-Resolution
by: Dehaghi, Ali Mollaahmadi, et al.
Published: (2025)
by: Dehaghi, Ali Mollaahmadi, et al.
Published: (2025)
Federated Learning for Diffusion Models
by: Peng, Zihao, et al.
Published: (2025)
by: Peng, Zihao, et al.
Published: (2025)
RedunCut: Measurement-Driven Sampling and Accuracy Performance Modeling for Low-Cost Live Video Analytics
by: Sela, Gur-Eyal, et al.
Published: (2025)
by: Sela, Gur-Eyal, et al.
Published: (2025)
Improving Zero-shot ADL Recognition with Large Language Models through Event-based Context and Confidence
by: Fiori, Michele, et al.
Published: (2026)
by: Fiori, Michele, et al.
Published: (2026)
VL-Cache: Sparsity and Modality-Aware KV Cache Compression for Vision-Language Model Inference Acceleration
by: Tu, Dezhan, et al.
Published: (2024)
by: Tu, Dezhan, et al.
Published: (2024)
A Scene-aware Models Adaptation Scheme for Cross-scene Online Inference on Mobile Devices
by: Li, Yunzhe, et al.
Published: (2024)
by: Li, Yunzhe, et al.
Published: (2024)
CodecSight: Leveraging Video Codec Signals for Efficient Streaming VLM Inference
by: Zou, Yulin, et al.
Published: (2026)
by: Zou, Yulin, et al.
Published: (2026)
Parallax: Runtime Parallelization for Operator Fallbacks in Heterogeneous Edge Systems
by: Tang, Chong, et al.
Published: (2025)
by: Tang, Chong, et al.
Published: (2025)
RO-SVD: A Reconfigurable Hardware Copyright Protection Framework for AIGC Applications
by: Ran, Zhuoheng, et al.
Published: (2024)
by: Ran, Zhuoheng, et al.
Published: (2024)
Investigation of Federated Learning Algorithms for Retinal Optical Coherence Tomography Image Classification with Statistical Heterogeneity
by: Amgain, Sanskar, et al.
Published: (2024)
by: Amgain, Sanskar, et al.
Published: (2024)
Radiant: Large-scale 3D Gaussian Rendering based on Hierarchical Framework
by: Peng, Haosong, et al.
Published: (2024)
by: Peng, Haosong, et al.
Published: (2024)
Real-World Federated Learning in Radiology: Hurdles to overcome and Benefits to gain
by: Bujotzek, Markus R., et al.
Published: (2024)
by: Bujotzek, Markus R., et al.
Published: (2024)
Research on Improved U-net Based Remote Sensing Image Segmentation Algorithm
by: Yang, Qiming, et al.
Published: (2024)
by: Yang, Qiming, et al.
Published: (2024)
Enabling Cross-Camera Collaboration for Video Analytics on Distributed Smart Cameras
by: Min, Chulhong, et al.
Published: (2024)
by: Min, Chulhong, et al.
Published: (2024)
FedMM: Federated Multi-Modal Learning with Modality Heterogeneity in Computational Pathology
by: Peng, Yuanzhe, et al.
Published: (2024)
by: Peng, Yuanzhe, et al.
Published: (2024)
CRSFL: Cluster-based Resource-aware Split Federated Learning for Continuous Authentication
by: Wazzeh, Mohamad, et al.
Published: (2024)
by: Wazzeh, Mohamad, et al.
Published: (2024)
DecentNeRFs: Decentralized Neural Radiance Fields from Crowdsourced Images
by: Tasneem, Zaid, et al.
Published: (2024)
by: Tasneem, Zaid, et al.
Published: (2024)
CloudEye: A New Paradigm of Video Analysis System for Mobile Visual Scenarios
by: Cui, Huan, et al.
Published: (2024)
by: Cui, Huan, et al.
Published: (2024)
Similar Items
-
STADI: Fine-Grained Step-Patch Diffusion Parallelism for Heterogeneous GPUs
by: Liang, Han, et al.
Published: (2025) -
SwiftFusion: Scalable Sequence Parallelism for Distributed Inference of Diffusion Transformers on GPUs
by: Yang, Jiacheng, et al.
Published: (2026) -
Parallel Watershed Partitioning: GPU-Based Hierarchical Image Segmentation
by: Yeghiazaryan, Varduhi, et al.
Published: (2024) -
LongLive-2.0: An NVFP4 Parallel Infrastructure for Long Video Generation
by: Chen, Yukang, et al.
Published: (2026) -
Accelerating ViT Inference on FPGA through Static and Dynamic Pruning
by: Parikh, Dhruv, et al.
Published: (2024)