KnapFormer: An Online Load Balancer for Efficient Diffusion Transformers Training
Fuente:
arXiv
Saved in:
| Main Authors: | Zhang, Kai, Wang, Peng, Bi, Sai, Zhang, Jianming, Xiong, Yuanjun |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
SwiftFusion: Scalable Sequence Parallelism for Distributed Inference of Diffusion Transformers on GPUs
by: Yang, Jiacheng, et al.
Published: (2026)
by: Yang, Jiacheng, et al.
Published: (2026)
Transforming the Use of Earth Observation Data: Exascale Training of a Generative Compression Model with Historical Priors for up to 10,000x Data Reduction
by: Zhang, Jinxiao, et al.
Published: (2026)
by: Zhang, Jinxiao, et al.
Published: (2026)
Partially Conditioned Patch Parallelism for Accelerated Diffusion Model Inference
by: Zhang, XiuYu, et al.
Published: (2024)
by: Zhang, XiuYu, et al.
Published: (2024)
STADI: Fine-Grained Step-Patch Diffusion Parallelism for Heterogeneous GPUs
by: Liang, Han, et al.
Published: (2025)
by: Liang, Han, et al.
Published: (2025)
A3FR: Agile 3D Gaussian Splatting with Incremental Gaze Tracked Foveated Rendering in Virtual Reality
by: Xin, Shuo, et al.
Published: (2025)
by: Xin, Shuo, et al.
Published: (2025)
DSV: Exploiting Dynamic Sparsity to Accelerate Large-Scale Video DiT Training
by: Tan, Xin, et al.
Published: (2025)
by: Tan, Xin, et al.
Published: (2025)
Skewness-Guided Pruning of Multimodal Swin Transformers for Federated Skin Lesion Classification on Edge Devices
by: Paxton, Kuniko, et al.
Published: (2025)
by: Paxton, Kuniko, et al.
Published: (2025)
Real-Time Video Generation with Pyramid Attention Broadcast
by: Zhao, Xuanlei, et al.
Published: (2024)
by: Zhao, Xuanlei, et al.
Published: (2024)
Covariance-Guided Resource Adaptive Learning for Efficient Edge Inference
by: Nabhaan, Ahmad N. L., et al.
Published: (2026)
by: Nabhaan, Ahmad N. L., et al.
Published: (2026)
FedMM: Federated Multi-Modal Learning with Modality Heterogeneity in Computational Pathology
by: Peng, Yuanzhe, et al.
Published: (2024)
by: Peng, Yuanzhe, et al.
Published: (2024)
Efficient Pyramidal Analysis of Gigapixel Images on a Decentralized Modest Computer Cluster
by: Reinbigler, Marie, et al.
Published: (2025)
by: Reinbigler, Marie, et al.
Published: (2025)
ClusterViG: Efficient Globally Aware Vision GNNs via Image Partitioning
by: Parikh, Dhruv, et al.
Published: (2025)
by: Parikh, Dhruv, et al.
Published: (2025)
EdgeOL: Efficient in-situ Online Learning on Edge Devices
by: Li, Sheng, et al.
Published: (2024)
by: Li, Sheng, et al.
Published: (2024)
Déjà Vu: Efficient Video-Language Query Engine with Learning-based Inter-Frame Computation Reuse
by: Hwang, Jinwoo, et al.
Published: (2025)
by: Hwang, Jinwoo, et al.
Published: (2025)
FedDyMem: Efficient Federated Learning with Dynamic Memory and Memory-Reduce for Unsupervised Image Anomaly Detection
by: Chen, Silin, et al.
Published: (2025)
by: Chen, Silin, et al.
Published: (2025)
DSFedMed: Dual-Scale Federated Medical Image Segmentation via Mutual Distillation Between Foundation and Lightweight Models
by: Zhang, Hanwen, et al.
Published: (2026)
by: Zhang, Hanwen, et al.
Published: (2026)
A New One-Shot Federated Learning Framework for Medical Imaging Classification with Feature-Guided Rectified Flow and Knowledge Distillation
by: Ma, Yufei, et al.
Published: (2025)
by: Ma, Yufei, et al.
Published: (2025)
Radiant: Large-scale 3D Gaussian Rendering based on Hierarchical Framework
by: Peng, Haosong, et al.
Published: (2024)
by: Peng, Haosong, et al.
Published: (2024)
RO-SVD: A Reconfigurable Hardware Copyright Protection Framework for AIGC Applications
by: Ran, Zhuoheng, et al.
Published: (2024)
by: Ran, Zhuoheng, et al.
Published: (2024)
FedBiP: Heterogeneous One-Shot Federated Learning with Personalized Latent Diffusion Models
by: Chen, Haokun, et al.
Published: (2024)
by: Chen, Haokun, et al.
Published: (2024)
Federated Learning for Diffusion Models
by: Peng, Zihao, et al.
Published: (2025)
by: Peng, Zihao, et al.
Published: (2025)
PipeDiT: Accelerating Diffusion Transformers in Video Generation with Task Pipelining and Model Decoupling
by: Wang, Sijie, et al.
Published: (2025)
by: Wang, Sijie, et al.
Published: (2025)
LongLive-2.0: An NVFP4 Parallel Infrastructure for Long Video Generation
by: Chen, Yukang, et al.
Published: (2026)
by: Chen, Yukang, et al.
Published: (2026)
Evaluation of Resource-Efficient Crater Detectors on Embedded Systems
by: Vellas, Simon, et al.
Published: (2024)
by: Vellas, Simon, et al.
Published: (2024)
A Scene-aware Models Adaptation Scheme for Cross-scene Online Inference on Mobile Devices
by: Li, Yunzhe, et al.
Published: (2024)
by: Li, Yunzhe, et al.
Published: (2024)
DeepFedNAS: Efficient Hardware-Aware Architecture Adaptation for Heterogeneous IoT Federations via Pareto-Guided Supernet Training
by: Khan, Bostan, et al.
Published: (2026)
by: Khan, Bostan, et al.
Published: (2026)
Federated Unsupervised Visual Representation Learning via Exploiting General Content and Personal Style
by: Yang, Yuewei, et al.
Published: (2022)
by: Yang, Yuewei, et al.
Published: (2022)
A Scalable Distributed Framework for Multimodal GigaVoxel Image Registration
by: Jena, Rohit, et al.
Published: (2025)
by: Jena, Rohit, et al.
Published: (2025)
SlimEdge: Performance and Device Aware Distributed DNN Deployment on Resource-Constrained Edge Hardware
by: Kumar, Mahadev Sunil, et al.
Published: (2025)
by: Kumar, Mahadev Sunil, et al.
Published: (2025)
Benchmarking Federated Learning Frameworks for Medical Imaging Deployment: A Comparative Study of NVIDIA FLARE, Flower, and Owkin Substra
by: Gupta, Riya, et al.
Published: (2025)
by: Gupta, Riya, et al.
Published: (2025)
Investigation of Federated Learning Algorithms for Retinal Optical Coherence Tomography Image Classification with Statistical Heterogeneity
by: Amgain, Sanskar, et al.
Published: (2024)
by: Amgain, Sanskar, et al.
Published: (2024)
Argus: Quality-Aware High-Throughput Text-to-Image Inference Serving System
by: Agarwal, Shubham, et al.
Published: (2025)
by: Agarwal, Shubham, et al.
Published: (2025)
Multi-modal video data-pipelines for machine learning with minimal human supervision
by: Pîrvu, Mihai-Cristian, et al.
Published: (2025)
by: Pîrvu, Mihai-Cristian, et al.
Published: (2025)
SC-MII: Infrastructure LiDAR-based 3D Object Detection on Edge Devices for Split Computing with Multiple Intermediate Outputs Integration
by: Noguchi, Taisuke, et al.
Published: (2026)
by: Noguchi, Taisuke, et al.
Published: (2026)
Cross-architecture universal feature coding via distribution alignment
by: Gao, Changsheng, et al.
Published: (2025)
by: Gao, Changsheng, et al.
Published: (2025)
Validation of Various Normalization Methods for Brain Tumor Segmentation: Can Federated Learning Overcome This Heterogeneity?
by: Fiszer, Jan, et al.
Published: (2025)
by: Fiszer, Jan, et al.
Published: (2025)
Reliable Multi-view 3D Reconstruction for `Just-in-time' Edge Environments
by: Absur, Md. Nurul, et al.
Published: (2025)
by: Absur, Md. Nurul, et al.
Published: (2025)
Real-World Federated Learning in Radiology: Hurdles to overcome and Benefits to gain
by: Bujotzek, Markus R., et al.
Published: (2024)
by: Bujotzek, Markus R., et al.
Published: (2024)
Research on Improved U-net Based Remote Sensing Image Segmentation Algorithm
by: Yang, Qiming, et al.
Published: (2024)
by: Yang, Qiming, et al.
Published: (2024)
Enabling Cross-Camera Collaboration for Video Analytics on Distributed Smart Cameras
by: Min, Chulhong, et al.
Published: (2024)
by: Min, Chulhong, et al.
Published: (2024)
Similar Items
-
SwiftFusion: Scalable Sequence Parallelism for Distributed Inference of Diffusion Transformers on GPUs
by: Yang, Jiacheng, et al.
Published: (2026) -
Transforming the Use of Earth Observation Data: Exascale Training of a Generative Compression Model with Historical Priors for up to 10,000x Data Reduction
by: Zhang, Jinxiao, et al.
Published: (2026) -
Partially Conditioned Patch Parallelism for Accelerated Diffusion Model Inference
by: Zhang, XiuYu, et al.
Published: (2024) -
STADI: Fine-Grained Step-Patch Diffusion Parallelism for Heterogeneous GPUs
by: Liang, Han, et al.
Published: (2025) -
A3FR: Agile 3D Gaussian Splatting with Incremental Gaze Tracked Foveated Rendering in Virtual Reality
by: Xin, Shuo, et al.
Published: (2025)