Salvato in:
| Autori principali: | Wu, Zihan, Huang, Zhaoke, Yan, Hong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2410.18113 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Challenges of Heterogeneity in Big Data: A Comparative Study of Classification in Large-Scale Structured and Unstructured Domains
di: Eduardo, González Trigueros Jesús, et al.
Pubblicazione: (2025)
di: Eduardo, González Trigueros Jesús, et al.
Pubblicazione: (2025)
Heuristic Search Space Partitioning for Low-Latency Multi-Tenant Cloud Queries
di: Pathak, Prashant Kumar, et al.
Pubblicazione: (2026)
di: Pathak, Prashant Kumar, et al.
Pubblicazione: (2026)
Spark-LLM-Eval: A Distributed Framework for Statistically Rigorous Large Language Model Evaluation
di: Mitra, Subhadip
Pubblicazione: (2026)
di: Mitra, Subhadip
Pubblicazione: (2026)
Scalability Optimization in Cloud-Based AI Inference Services: Strategies for Real-Time Load Balancing and Automated Scaling
di: Jin, Yihong, et al.
Pubblicazione: (2025)
di: Jin, Yihong, et al.
Pubblicazione: (2025)
Cost-Aware Logging: Measuring the Financial Impact of Excessive Log Retention in Small-Scale Cloud Deployments
di: Putra, Jody Almaida
Pubblicazione: (2026)
di: Putra, Jody Almaida
Pubblicazione: (2026)
A Semantic Partitioning Method for Large-Scale Training of Knowledge Graph Embeddings
di: Bai, Yuhe
Pubblicazione: (2025)
di: Bai, Yuhe
Pubblicazione: (2025)
Revisiting Reliability in Large-Scale Machine Learning Research Clusters
di: Kokolis, Apostolos, et al.
Pubblicazione: (2024)
di: Kokolis, Apostolos, et al.
Pubblicazione: (2024)
Learning Interpretable Scheduling Algorithms for Data Processing Clusters
di: Hu, Zhibo, et al.
Pubblicazione: (2024)
di: Hu, Zhibo, et al.
Pubblicazione: (2024)
Token Arena: A Continuous Benchmark Unifying Energy and Cognition in AI Inference
di: Gao, Yuxuan, et al.
Pubblicazione: (2026)
di: Gao, Yuxuan, et al.
Pubblicazione: (2026)
AsyncHZP: Hierarchical ZeRO Parallelism with Asynchronous Scheduling for Scalable LLM Training
di: Bai, Huawei, et al.
Pubblicazione: (2025)
di: Bai, Huawei, et al.
Pubblicazione: (2025)
SiDA-MoE: Sparsity-Inspired Data-Aware Serving for Efficient and Scalable Large Mixture-of-Experts Models
di: Du, Zhixu, et al.
Pubblicazione: (2023)
di: Du, Zhixu, et al.
Pubblicazione: (2023)
Deploy, Calibrate, Monitor, Heal -- No Human Required: An Autonomous AI SRE Agent for Elasticsearch
di: Mukkolakkal, Muhamed Ramees Cheriya
Pubblicazione: (2026)
di: Mukkolakkal, Muhamed Ramees Cheriya
Pubblicazione: (2026)
Scalable High-Dimensional Multivariate Linear Regression for Feature-Distributed Data
di: Huang, Shuo-Chieh, et al.
Pubblicazione: (2023)
di: Huang, Shuo-Chieh, et al.
Pubblicazione: (2023)
Arena: Efficiently Training Large Models via Dynamic Scheduling and Adaptive Parallelism Co-Design
di: Xue, Chunyu, et al.
Pubblicazione: (2024)
di: Xue, Chunyu, et al.
Pubblicazione: (2024)
ASTRA-sim2.0: Modeling Hierarchical Networks and Disaggregated Systems for Large-model Training at Scale
di: Won, William, et al.
Pubblicazione: (2023)
di: Won, William, et al.
Pubblicazione: (2023)
Learning the Optimal Path and DNN Partition for Collaborative Edge Inference
di: Huang, Yin, et al.
Pubblicazione: (2024)
di: Huang, Yin, et al.
Pubblicazione: (2024)
Decoupled Vertical Federated Learning for Practical Training on Vertically Partitioned Data
di: Amalanshu, Avi, et al.
Pubblicazione: (2024)
di: Amalanshu, Avi, et al.
Pubblicazione: (2024)
Efficient Construction of Large Search Spaces for Auto-Tuning
di: Willemsen, Floris-Jan, et al.
Pubblicazione: (2025)
di: Willemsen, Floris-Jan, et al.
Pubblicazione: (2025)
EmbedPart: Embedding-Driven Graph Partitioning for Scalable Graph Neural Network Training
di: Merkel, Nikolai, et al.
Pubblicazione: (2026)
di: Merkel, Nikolai, et al.
Pubblicazione: (2026)
EncCluster: Scalable Functional Encryption in Federated Learning through Weight Clustering and Probabilistic Filters
di: Tsouvalas, Vasileios, et al.
Pubblicazione: (2024)
di: Tsouvalas, Vasileios, et al.
Pubblicazione: (2024)
Rethinking Personalized Federated Learning with Clustering-based Dynamic Graph Propagation
di: Wang, Jiaqi, et al.
Pubblicazione: (2024)
di: Wang, Jiaqi, et al.
Pubblicazione: (2024)
FedClust: Optimizing Federated Learning on Non-IID Data through Weight-Driven Client Clustering
di: Islam, Md Sirajul, et al.
Pubblicazione: (2024)
di: Islam, Md Sirajul, et al.
Pubblicazione: (2024)
Cross-Silo Federated Learning for Multi-Tier Networks with Vertical and Horizontal Data Partitioning
di: Das, Anirban, et al.
Pubblicazione: (2021)
di: Das, Anirban, et al.
Pubblicazione: (2021)
Communication-Efficient Hybrid Federated Learning for E-health with Horizontal and Vertical Data Partitioning
di: Yu, Chong, et al.
Pubblicazione: (2024)
di: Yu, Chong, et al.
Pubblicazione: (2024)
SURGE: SuperBatch Unified Resource-efficient GPU Encoding for Heterogeneous Partitioned Data
di: Kapadia, Shashank, et al.
Pubblicazione: (2026)
di: Kapadia, Shashank, et al.
Pubblicazione: (2026)
Large-Scale Graph Building in Dynamic Environments: Low Latency and High Quality
di: de Almeida, Filipe Miguel Gonçalves, et al.
Pubblicazione: (2025)
di: de Almeida, Filipe Miguel Gonçalves, et al.
Pubblicazione: (2025)
Guard: Scalable Straggler Detection and Node Health Management for Large-Scale Training
di: Liu, Guanliang, et al.
Pubblicazione: (2026)
di: Liu, Guanliang, et al.
Pubblicazione: (2026)
FLEdge: Benchmarking Federated Machine Learning Applications in Edge Computing Systems
di: Woisetschläger, Herbert, et al.
Pubblicazione: (2023)
di: Woisetschläger, Herbert, et al.
Pubblicazione: (2023)
LLM-PQ: Serving LLM on Heterogeneous Clusters with Phase-Aware Partition and Adaptive Quantization
di: Zhao, Juntao, et al.
Pubblicazione: (2024)
di: Zhao, Juntao, et al.
Pubblicazione: (2024)
Flexible Clustered Federated Learning for Client-Level Data Distribution Shift
di: Duan, Moming, et al.
Pubblicazione: (2021)
di: Duan, Moming, et al.
Pubblicazione: (2021)
N2N: A Parallel Framework for Large-Scale MILP under Distributed Memory
di: Wang, Longfei, et al.
Pubblicazione: (2025)
di: Wang, Longfei, et al.
Pubblicazione: (2025)
Operational Memory Architecture for Kubernetes:Preserving Causal Context Across the Evidence Horizon
di: Khan, Shamsher
Pubblicazione: (2026)
di: Khan, Shamsher
Pubblicazione: (2026)
A Semi-Supervised Federated Learning Framework with Hierarchical Clustering Aggregation for Heterogeneous Satellite Networks
di: Liu, Zhuocheng, et al.
Pubblicazione: (2025)
di: Liu, Zhuocheng, et al.
Pubblicazione: (2025)
CE-CoLLM: Efficient and Adaptive Large Language Models Through Cloud-Edge Collaboration
di: Jin, Hongpeng, et al.
Pubblicazione: (2024)
di: Jin, Hongpeng, et al.
Pubblicazione: (2024)
Reinforcement Learning Optimization for Large-Scale Learning: An Efficient and User-Friendly Scaling Library
di: Wang, Weixun, et al.
Pubblicazione: (2025)
di: Wang, Weixun, et al.
Pubblicazione: (2025)
AMDP: Asynchronous Multi-Directional Pipeline Parallelism for Large-Scale Models Training
di: Chen, Ling, et al.
Pubblicazione: (2026)
di: Chen, Ling, et al.
Pubblicazione: (2026)
MegaScale: Scaling Large Language Model Training to More Than 10,000 GPUs
di: Jiang, Ziheng, et al.
Pubblicazione: (2024)
di: Jiang, Ziheng, et al.
Pubblicazione: (2024)
Hierarchical Resource Partitioning on Modern GPUs: A Reinforcement Learning Approach
di: Saroliya, Urvij, et al.
Pubblicazione: (2024)
di: Saroliya, Urvij, et al.
Pubblicazione: (2024)
DualSparse-MoE: Coordinating Tensor/Neuron-Level Sparsity with Expert Partition and Reconstruction
di: Cai, Weilin, et al.
Pubblicazione: (2025)
di: Cai, Weilin, et al.
Pubblicazione: (2025)
Hydraulis: Balancing Large Transformer Model Training via Co-designing Parallel Strategies and Data Assignment
di: Li, Haoyang, et al.
Pubblicazione: (2024)
di: Li, Haoyang, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Challenges of Heterogeneity in Big Data: A Comparative Study of Classification in Large-Scale Structured and Unstructured Domains
di: Eduardo, González Trigueros Jesús, et al.
Pubblicazione: (2025) -
Heuristic Search Space Partitioning for Low-Latency Multi-Tenant Cloud Queries
di: Pathak, Prashant Kumar, et al.
Pubblicazione: (2026) -
Spark-LLM-Eval: A Distributed Framework for Statistically Rigorous Large Language Model Evaluation
di: Mitra, Subhadip
Pubblicazione: (2026) -
Scalability Optimization in Cloud-Based AI Inference Services: Strategies for Real-Time Load Balancing and Automated Scaling
di: Jin, Yihong, et al.
Pubblicazione: (2025) -
Cost-Aware Logging: Measuring the Financial Impact of Excessive Log Retention in Small-Scale Cloud Deployments
di: Putra, Jody Almaida
Pubblicazione: (2026)