Enregistré dans:
| Auteurs principaux: | Wu, Zihan, Huang, Zhaoke, Yan, Hong |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2410.18113 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Challenges of Heterogeneity in Big Data: A Comparative Study of Classification in Large-Scale Structured and Unstructured Domains
par: Eduardo, González Trigueros Jesús, et autres
Publié: (2025)
par: Eduardo, González Trigueros Jesús, et autres
Publié: (2025)
Heuristic Search Space Partitioning for Low-Latency Multi-Tenant Cloud Queries
par: Pathak, Prashant Kumar, et autres
Publié: (2026)
par: Pathak, Prashant Kumar, et autres
Publié: (2026)
Spark-LLM-Eval: A Distributed Framework for Statistically Rigorous Large Language Model Evaluation
par: Mitra, Subhadip
Publié: (2026)
par: Mitra, Subhadip
Publié: (2026)
Scalability Optimization in Cloud-Based AI Inference Services: Strategies for Real-Time Load Balancing and Automated Scaling
par: Jin, Yihong, et autres
Publié: (2025)
par: Jin, Yihong, et autres
Publié: (2025)
Cost-Aware Logging: Measuring the Financial Impact of Excessive Log Retention in Small-Scale Cloud Deployments
par: Putra, Jody Almaida
Publié: (2026)
par: Putra, Jody Almaida
Publié: (2026)
A Semantic Partitioning Method for Large-Scale Training of Knowledge Graph Embeddings
par: Bai, Yuhe
Publié: (2025)
par: Bai, Yuhe
Publié: (2025)
Revisiting Reliability in Large-Scale Machine Learning Research Clusters
par: Kokolis, Apostolos, et autres
Publié: (2024)
par: Kokolis, Apostolos, et autres
Publié: (2024)
Learning Interpretable Scheduling Algorithms for Data Processing Clusters
par: Hu, Zhibo, et autres
Publié: (2024)
par: Hu, Zhibo, et autres
Publié: (2024)
Token Arena: A Continuous Benchmark Unifying Energy and Cognition in AI Inference
par: Gao, Yuxuan, et autres
Publié: (2026)
par: Gao, Yuxuan, et autres
Publié: (2026)
AsyncHZP: Hierarchical ZeRO Parallelism with Asynchronous Scheduling for Scalable LLM Training
par: Bai, Huawei, et autres
Publié: (2025)
par: Bai, Huawei, et autres
Publié: (2025)
SiDA-MoE: Sparsity-Inspired Data-Aware Serving for Efficient and Scalable Large Mixture-of-Experts Models
par: Du, Zhixu, et autres
Publié: (2023)
par: Du, Zhixu, et autres
Publié: (2023)
Deploy, Calibrate, Monitor, Heal -- No Human Required: An Autonomous AI SRE Agent for Elasticsearch
par: Mukkolakkal, Muhamed Ramees Cheriya
Publié: (2026)
par: Mukkolakkal, Muhamed Ramees Cheriya
Publié: (2026)
Scalable High-Dimensional Multivariate Linear Regression for Feature-Distributed Data
par: Huang, Shuo-Chieh, et autres
Publié: (2023)
par: Huang, Shuo-Chieh, et autres
Publié: (2023)
Arena: Efficiently Training Large Models via Dynamic Scheduling and Adaptive Parallelism Co-Design
par: Xue, Chunyu, et autres
Publié: (2024)
par: Xue, Chunyu, et autres
Publié: (2024)
ASTRA-sim2.0: Modeling Hierarchical Networks and Disaggregated Systems for Large-model Training at Scale
par: Won, William, et autres
Publié: (2023)
par: Won, William, et autres
Publié: (2023)
Learning the Optimal Path and DNN Partition for Collaborative Edge Inference
par: Huang, Yin, et autres
Publié: (2024)
par: Huang, Yin, et autres
Publié: (2024)
Decoupled Vertical Federated Learning for Practical Training on Vertically Partitioned Data
par: Amalanshu, Avi, et autres
Publié: (2024)
par: Amalanshu, Avi, et autres
Publié: (2024)
Efficient Construction of Large Search Spaces for Auto-Tuning
par: Willemsen, Floris-Jan, et autres
Publié: (2025)
par: Willemsen, Floris-Jan, et autres
Publié: (2025)
EmbedPart: Embedding-Driven Graph Partitioning for Scalable Graph Neural Network Training
par: Merkel, Nikolai, et autres
Publié: (2026)
par: Merkel, Nikolai, et autres
Publié: (2026)
EncCluster: Scalable Functional Encryption in Federated Learning through Weight Clustering and Probabilistic Filters
par: Tsouvalas, Vasileios, et autres
Publié: (2024)
par: Tsouvalas, Vasileios, et autres
Publié: (2024)
Rethinking Personalized Federated Learning with Clustering-based Dynamic Graph Propagation
par: Wang, Jiaqi, et autres
Publié: (2024)
par: Wang, Jiaqi, et autres
Publié: (2024)
FedClust: Optimizing Federated Learning on Non-IID Data through Weight-Driven Client Clustering
par: Islam, Md Sirajul, et autres
Publié: (2024)
par: Islam, Md Sirajul, et autres
Publié: (2024)
Cross-Silo Federated Learning for Multi-Tier Networks with Vertical and Horizontal Data Partitioning
par: Das, Anirban, et autres
Publié: (2021)
par: Das, Anirban, et autres
Publié: (2021)
Communication-Efficient Hybrid Federated Learning for E-health with Horizontal and Vertical Data Partitioning
par: Yu, Chong, et autres
Publié: (2024)
par: Yu, Chong, et autres
Publié: (2024)
SURGE: SuperBatch Unified Resource-efficient GPU Encoding for Heterogeneous Partitioned Data
par: Kapadia, Shashank, et autres
Publié: (2026)
par: Kapadia, Shashank, et autres
Publié: (2026)
Large-Scale Graph Building in Dynamic Environments: Low Latency and High Quality
par: de Almeida, Filipe Miguel Gonçalves, et autres
Publié: (2025)
par: de Almeida, Filipe Miguel Gonçalves, et autres
Publié: (2025)
Guard: Scalable Straggler Detection and Node Health Management for Large-Scale Training
par: Liu, Guanliang, et autres
Publié: (2026)
par: Liu, Guanliang, et autres
Publié: (2026)
FLEdge: Benchmarking Federated Machine Learning Applications in Edge Computing Systems
par: Woisetschläger, Herbert, et autres
Publié: (2023)
par: Woisetschläger, Herbert, et autres
Publié: (2023)
LLM-PQ: Serving LLM on Heterogeneous Clusters with Phase-Aware Partition and Adaptive Quantization
par: Zhao, Juntao, et autres
Publié: (2024)
par: Zhao, Juntao, et autres
Publié: (2024)
Flexible Clustered Federated Learning for Client-Level Data Distribution Shift
par: Duan, Moming, et autres
Publié: (2021)
par: Duan, Moming, et autres
Publié: (2021)
N2N: A Parallel Framework for Large-Scale MILP under Distributed Memory
par: Wang, Longfei, et autres
Publié: (2025)
par: Wang, Longfei, et autres
Publié: (2025)
Operational Memory Architecture for Kubernetes:Preserving Causal Context Across the Evidence Horizon
par: Khan, Shamsher
Publié: (2026)
par: Khan, Shamsher
Publié: (2026)
A Semi-Supervised Federated Learning Framework with Hierarchical Clustering Aggregation for Heterogeneous Satellite Networks
par: Liu, Zhuocheng, et autres
Publié: (2025)
par: Liu, Zhuocheng, et autres
Publié: (2025)
CE-CoLLM: Efficient and Adaptive Large Language Models Through Cloud-Edge Collaboration
par: Jin, Hongpeng, et autres
Publié: (2024)
par: Jin, Hongpeng, et autres
Publié: (2024)
Reinforcement Learning Optimization for Large-Scale Learning: An Efficient and User-Friendly Scaling Library
par: Wang, Weixun, et autres
Publié: (2025)
par: Wang, Weixun, et autres
Publié: (2025)
AMDP: Asynchronous Multi-Directional Pipeline Parallelism for Large-Scale Models Training
par: Chen, Ling, et autres
Publié: (2026)
par: Chen, Ling, et autres
Publié: (2026)
MegaScale: Scaling Large Language Model Training to More Than 10,000 GPUs
par: Jiang, Ziheng, et autres
Publié: (2024)
par: Jiang, Ziheng, et autres
Publié: (2024)
Hierarchical Resource Partitioning on Modern GPUs: A Reinforcement Learning Approach
par: Saroliya, Urvij, et autres
Publié: (2024)
par: Saroliya, Urvij, et autres
Publié: (2024)
DualSparse-MoE: Coordinating Tensor/Neuron-Level Sparsity with Expert Partition and Reconstruction
par: Cai, Weilin, et autres
Publié: (2025)
par: Cai, Weilin, et autres
Publié: (2025)
Hydraulis: Balancing Large Transformer Model Training via Co-designing Parallel Strategies and Data Assignment
par: Li, Haoyang, et autres
Publié: (2024)
par: Li, Haoyang, et autres
Publié: (2024)
Documents similaires
-
Challenges of Heterogeneity in Big Data: A Comparative Study of Classification in Large-Scale Structured and Unstructured Domains
par: Eduardo, González Trigueros Jesús, et autres
Publié: (2025) -
Heuristic Search Space Partitioning for Low-Latency Multi-Tenant Cloud Queries
par: Pathak, Prashant Kumar, et autres
Publié: (2026) -
Spark-LLM-Eval: A Distributed Framework for Statistically Rigorous Large Language Model Evaluation
par: Mitra, Subhadip
Publié: (2026) -
Scalability Optimization in Cloud-Based AI Inference Services: Strategies for Real-Time Load Balancing and Automated Scaling
par: Jin, Yihong, et autres
Publié: (2025) -
Cost-Aware Logging: Measuring the Financial Impact of Excessive Log Retention in Small-Scale Cloud Deployments
par: Putra, Jody Almaida
Publié: (2026)