DPQuant: Efficient and Differentially-Private Model Training via Dynamic Quantization Scheduling
Fuente:
arXiv
Guardado en:
| Autores principales: | Gao, Yubo, Tu, Renbo, Pekhimenko, Gennady, Vijaykumar, Nandita |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
LoRAFusion: Efficient LoRA Fine-Tuning for LLMs
por: Zhu, Zhanda, et al.
Publicado: (2025)
por: Zhu, Zhanda, et al.
Publicado: (2025)
Mist: Efficient Distributed Training of Large Language Models via Memory-Parallelism Co-Optimization
por: Zhu, Zhanda, et al.
Publicado: (2025)
por: Zhu, Zhanda, et al.
Publicado: (2025)
FedComLoc: Communication-Efficient Distributed Training of Sparse and Quantized Models
por: Yi, Kai, et al.
Publicado: (2024)
por: Yi, Kai, et al.
Publicado: (2024)
Semantic Parallelism: Redefining Efficient MoE Inference via Model-Data Co-Scheduling
por: Li, Yan, et al.
Publicado: (2025)
por: Li, Yan, et al.
Publicado: (2025)
Online Client Scheduling and Resource Allocation for Efficient Federated Edge Learning
por: Gao, Zhidong, et al.
Publicado: (2024)
por: Gao, Zhidong, et al.
Publicado: (2024)
Tackling the Dynamicity in a Production LLM Serving System with SOTA Optimizations via Hybrid Prefill/Decode/Verify Scheduling on Efficient Meta-kernels
por: Song, Mingcong, et al.
Publicado: (2024)
por: Song, Mingcong, et al.
Publicado: (2024)
Efficient Asynchronous Federated Learning with Sparsification and Quantization
por: Jia, Juncheng, et al.
Publicado: (2023)
por: Jia, Juncheng, et al.
Publicado: (2023)
Efficient Training on Multiple Consumer GPUs with RoundPipe
por: Luo, Yibin, et al.
Publicado: (2026)
por: Luo, Yibin, et al.
Publicado: (2026)
NestQuant: Post-Training Integer-Nesting Quantization for On-Device DNN
por: Xie, Jianhang, et al.
Publicado: (2025)
por: Xie, Jianhang, et al.
Publicado: (2025)
Echo: Efficient Co-Scheduling of Hybrid Online-Offline Tasks for Large Language Model Serving
por: Wang, Zhibin, et al.
Publicado: (2025)
por: Wang, Zhibin, et al.
Publicado: (2025)
Efficient Resource Scheduling for Distributed Infrastructures Using Negotiation Capabilities
por: Chu, Junjie, et al.
Publicado: (2024)
por: Chu, Junjie, et al.
Publicado: (2024)
ZipMoE: Efficient On-Device MoE Serving via Lossless Compression and Cache-Affinity Scheduling
por: Yang, Yuchen, et al.
Publicado: (2026)
por: Yang, Yuchen, et al.
Publicado: (2026)
Piper: Efficient Large-Scale MoE Training via Resource Modeling and Pipelined Hybrid Parallelism
por: Dash, Sajal, et al.
Publicado: (2026)
por: Dash, Sajal, et al.
Publicado: (2026)
ELIS: Efficient LLM Iterative Scheduling System with Response Length Predictor
por: Choi, Seungbeom, et al.
Publicado: (2025)
por: Choi, Seungbeom, et al.
Publicado: (2025)
Galvatron: An Automatic Distributed System for Efficient Foundation Model Training
por: Liu, Xinyi, et al.
Publicado: (2025)
por: Liu, Xinyi, et al.
Publicado: (2025)
Justitia: Fair and Efficient Scheduling of Task-parallel LLM Agents with Selective Pampering
por: Yang, Mingyan, et al.
Publicado: (2025)
por: Yang, Mingyan, et al.
Publicado: (2025)
Seesaw: High-throughput LLM Inference via Model Re-sharding
por: Su, Qidong, et al.
Publicado: (2025)
por: Su, Qidong, et al.
Publicado: (2025)
Sustainable Carbon-Aware and Water-Efficient LLM Scheduling in Geo-Distributed Cloud Datacenters
por: Moore, Hayden, et al.
Publicado: (2025)
por: Moore, Hayden, et al.
Publicado: (2025)
Interpretable Modeling of Deep Reinforcement Learning Driven Scheduling
por: Li, Boyang, et al.
Publicado: (2024)
por: Li, Boyang, et al.
Publicado: (2024)
Towards the Next Frontier of LLMs, Training on Private Data: A Cross-Domain Benchmark for Federated Fine-Tuning
por: Jimenez-Gutierrez, Daniel M., et al.
Publicado: (2026)
por: Jimenez-Gutierrez, Daniel M., et al.
Publicado: (2026)
Communication-Efficient and Differentially Private Vertical Federated Learning with Zeroth-Order Optimization
por: Zhang, Jianing, et al.
Publicado: (2025)
por: Zhang, Jianing, et al.
Publicado: (2025)
Hybrid Learning and Optimization-Based Dynamic Scheduling for DL Workloads on Heterogeneous GPU Clusters
por: Dongare, Shruti, et al.
Publicado: (2025)
por: Dongare, Shruti, et al.
Publicado: (2025)
Arena: Efficiently Training Large Models via Dynamic Scheduling and Adaptive Parallelism Co-Design
por: Xue, Chunyu, et al.
Publicado: (2024)
por: Xue, Chunyu, et al.
Publicado: (2024)
InstGenIE: Generative Image Editing Made Efficient with Mask-aware Caching and Scheduling
por: Jiang, Xiaoxiao, et al.
Publicado: (2025)
por: Jiang, Xiaoxiao, et al.
Publicado: (2025)
Intelligent Sampling of Extreme-Scale Turbulence Datasets for Accurate and Efficient Spatiotemporal Model Training
por: Brewer, Wesley, et al.
Publicado: (2025)
por: Brewer, Wesley, et al.
Publicado: (2025)
ProTrain: Efficient LLM Training via Memory-Aware Techniques
por: Yang, Hanmei, et al.
Publicado: (2024)
por: Yang, Hanmei, et al.
Publicado: (2024)
QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference
por: Li, Xiangchen, et al.
Publicado: (2025)
por: Li, Xiangchen, et al.
Publicado: (2025)
CRAFT: Fine-Grained Cost-Aware Expert Replication For Efficient Mixture-of-Experts Serving
por: Zhao, Adrian, et al.
Publicado: (2026)
por: Zhao, Adrian, et al.
Publicado: (2026)
AdaptiveLoad: Towards Efficient Video Diffusion Transformer Training
por: Guo, Yucheng, et al.
Publicado: (2026)
por: Guo, Yucheng, et al.
Publicado: (2026)
RollArt: Scaling Agentic RL Training via Disaggregated Infrastructure
por: Gao, Wei, et al.
Publicado: (2025)
por: Gao, Wei, et al.
Publicado: (2025)
Efficient Federated Fine-Tuning of Large Language Models with Layer Dropout
por: Wang, Shilong, et al.
Publicado: (2025)
por: Wang, Shilong, et al.
Publicado: (2025)
SFPrompt: Communication-Efficient Split Federated Fine-Tuning for Large Pre-Trained Models over Resource-Limited Devices
por: Cao, Linxiao, et al.
Publicado: (2024)
por: Cao, Linxiao, et al.
Publicado: (2024)
FedTrans: Efficient Federated Learning via Multi-Model Transformation
por: Zhu, Yuxuan, et al.
Publicado: (2024)
por: Zhu, Yuxuan, et al.
Publicado: (2024)
PGT-I: Scaling Spatiotemporal GNNs with Memory-Efficient Distributed Training
por: Ockerman, Seth, et al.
Publicado: (2025)
por: Ockerman, Seth, et al.
Publicado: (2025)
Taming the Long-Tail: Efficient Reasoning RL Training with Adaptive Drafter
por: Hu, Qinghao, et al.
Publicado: (2025)
por: Hu, Qinghao, et al.
Publicado: (2025)
A Parallel Alternative for Energy-Efficient Neural Network Training and Inferencing
por: Seal, Sudip K., et al.
Publicado: (2025)
por: Seal, Sudip K., et al.
Publicado: (2025)
Inclusive, Differentially Private Federated Learning for Clinical Data
por: Parampottupadam, Santhosh, et al.
Publicado: (2025)
por: Parampottupadam, Santhosh, et al.
Publicado: (2025)
AB-Training: A Communication-Efficient Approach for Distributed Low-Rank Learning
por: Coquelin, Daniel, et al.
Publicado: (2024)
por: Coquelin, Daniel, et al.
Publicado: (2024)
MoEBlaze: Breaking the Memory Wall for Efficient MoE Training on Modern GPUs
por: Zhang, Jiyuan, et al.
Publicado: (2026)
por: Zhang, Jiyuan, et al.
Publicado: (2026)
Fairness-Aware Job Scheduling for Multi-Job Federated Learning
por: Shi, Yuxin, et al.
Publicado: (2024)
por: Shi, Yuxin, et al.
Publicado: (2024)
Ejemplares similares
-
LoRAFusion: Efficient LoRA Fine-Tuning for LLMs
por: Zhu, Zhanda, et al.
Publicado: (2025) -
Mist: Efficient Distributed Training of Large Language Models via Memory-Parallelism Co-Optimization
por: Zhu, Zhanda, et al.
Publicado: (2025) -
FedComLoc: Communication-Efficient Distributed Training of Sparse and Quantized Models
por: Yi, Kai, et al.
Publicado: (2024) -
Semantic Parallelism: Redefining Efficient MoE Inference via Model-Data Co-Scheduling
por: Li, Yan, et al.
Publicado: (2025) -
Online Client Scheduling and Resource Allocation for Efficient Federated Edge Learning
por: Gao, Zhidong, et al.
Publicado: (2024)