Similar Items
Enhancing Large-Scale AI Training Efficiency: The C4 Solution for Real-Time Anomaly Detection and Communication Optimization
by: Dong, Jianbo, et al.
Published: (2024)
by: Dong, Jianbo, et al.
Published: (2024)
Cost-Efficient Multimodal LLM Inference via Cross-Tier GPU Heterogeneity
by: Yu, Donglin
Published: (2026)
by: Yu, Donglin
Published: (2026)
Federated Learning with Limited Node Labels
by: Tang, Bisheng, et al.
Published: (2024)
by: Tang, Bisheng, et al.
Published: (2024)
SRL: Scaling Distributed Reinforcement Learning to Over Ten Thousand Cores
by: Mei, Zhiyu, et al.
Published: (2023)
by: Mei, Zhiyu, et al.
Published: (2023)
FedMT: Federated Learning with Mixed-type Labels
by: Zhang, Qiong, et al.
Published: (2022)
by: Zhang, Qiong, et al.
Published: (2022)
DeepHYDRA: Resource-Efficient Time-Series Anomaly Detection in Dynamically-Configured Systems
by: Stehle, Franz Kevin, et al.
Published: (2024)
by: Stehle, Franz Kevin, et al.
Published: (2024)
Scaling Decentralized Learning with FLock
by: Cheng, Zehua, et al.
Published: (2025)
by: Cheng, Zehua, et al.
Published: (2025)
Encoded Spatial Attribute in Multi-Tier Federated Learning
by: Kawnine, Asfia, et al.
Published: (2025)
by: Kawnine, Asfia, et al.
Published: (2025)
FedFusion: Federated Learning with Diversity- and Cluster-Aware Encoders for Robust Adaptation under Label Scarcity
by: Kahenga, Ferdinand, et al.
Published: (2025)
by: Kahenga, Ferdinand, et al.
Published: (2025)
Guard: Scalable Straggler Detection and Node Health Management for Large-Scale Training
by: Liu, Guanliang, et al.
Published: (2026)
by: Liu, Guanliang, et al.
Published: (2026)
ByteScale: Efficient Scaling of LLM Training with a 2048K Context Length on More Than 12,000 GPUs
by: Ge, Hao, et al.
Published: (2025)
by: Ge, Hao, et al.
Published: (2025)
Scale-up Unlearnable Examples Learning with High-Performance Computing
by: Zhu, Yanfan, et al.
Published: (2025)
by: Zhu, Yanfan, et al.
Published: (2025)
Federated Multi-Objective Learning
by: Yang, Haibo, et al.
Published: (2023)
by: Yang, Haibo, et al.
Published: (2023)
Scaling Deep Learning Research with Kubernetes on the NRP Nautilus HyperCluster
by: Hurt, J. Alex, et al.
Published: (2024)
by: Hurt, J. Alex, et al.
Published: (2024)
Accelerating Privacy-Preserving Federated Learning in Large-Scale LEO Satellite Systems
by: Guo, Binquan, et al.
Published: (2025)
by: Guo, Binquan, et al.
Published: (2025)
Parallel-friendly Spatio-Temporal Graph Learning for Photovoltaic Degradation Analysis at Scale
by: Fan, Yangxin, et al.
Published: (2024)
by: Fan, Yangxin, et al.
Published: (2024)
Federated Graph Learning with Structure Proxy Alignment
by: Fu, Xingbo, et al.
Published: (2024)
by: Fu, Xingbo, et al.
Published: (2024)
Learning to Collaborate Over Graphs: A Selective Federated Multi-Task Learning Approach
by: Elbakary, Ahmed, et al.
Published: (2025)
by: Elbakary, Ahmed, et al.
Published: (2025)
veScale-FSDP: Flexible and High-Performance FSDP at Scale
by: Wang, Zezhou, et al.
Published: (2026)
by: Wang, Zezhou, et al.
Published: (2026)
Fairness-Aware Job Scheduling for Multi-Job Federated Learning
by: Shi, Yuxin, et al.
Published: (2024)
by: Shi, Yuxin, et al.
Published: (2024)
Enhancing Kubernetes Automated Scheduling with Deep Learning and Reinforcement Techniques for Large-Scale Cloud Computing Optimization
by: Xu, Zheng, et al.
Published: (2024)
by: Xu, Zheng, et al.
Published: (2024)
FedHERO: A Federated Learning Approach for Node Classification Task on Heterophilic Graphs
by: Chen, Zihan, et al.
Published: (2025)
by: Chen, Zihan, et al.
Published: (2025)
FedPBS: Proximal-Balanced Scaling Federated Learning Model for Robust Personalized Training for Non-IID Data
by: AbouNassar, Eman M., et al.
Published: (2026)
by: AbouNassar, Eman M., et al.
Published: (2026)
TierCheck: Tiered Checkpointing for Fault Tolerance in Large Language Model Training
by: Han, Shujie, et al.
Published: (2026)
by: Han, Shujie, et al.
Published: (2026)
FedTrans: Efficient Federated Learning via Multi-Model Transformation
by: Zhu, Yuxuan, et al.
Published: (2024)
by: Zhu, Yuxuan, et al.
Published: (2024)
TRAIL: Trust-Aware Client Scheduling for Semi-Decentralized Federated Learning
by: Hu, Gangqiang, et al.
Published: (2024)
by: Hu, Gangqiang, et al.
Published: (2024)
FL-GUARD: A Holistic Framework for Run-Time Detection and Recovery of Negative Federated Learning
by: Lin, Hong, et al.
Published: (2024)
by: Lin, Hong, et al.
Published: (2024)
Online Parallel Multi-Task Relationship Learning via Alternating Direction Method of Multipliers
by: Li, Ruiyu, et al.
Published: (2024)
by: Li, Ruiyu, et al.
Published: (2024)
Cross-Silo Federated Learning for Multi-Tier Networks with Vertical and Horizontal Data Partitioning
by: Das, Anirban, et al.
Published: (2021)
by: Das, Anirban, et al.
Published: (2021)
Communication-Efficient Personalized Federal Graph Learning via Low-Rank Decomposition
by: Liu, Ruyue, et al.
Published: (2024)
by: Liu, Ruyue, et al.
Published: (2024)
Federated PCA on Grassmann Manifold for IoT Anomaly Detection
by: Nguyen, Tung-Anh, et al.
Published: (2024)
by: Nguyen, Tung-Anh, et al.
Published: (2024)
Multi-Worker Selection based Distributed Swarm Learning for Edge IoT with Non-i.i.d. Data
by: Yao, Zhuoyu, et al.
Published: (2025)
by: Yao, Zhuoyu, et al.
Published: (2025)
Federated Koopman-Reservoir Learning for Large-Scale Multivariate Time-Series Anomaly Detection
by: Le, Long Tan, et al.
Published: (2025)
by: Le, Long Tan, et al.
Published: (2025)
Adaptive Consensus Gradients Aggregation for Scaled Distributed Training
by: Choukroun, Yoni, et al.
Published: (2024)
by: Choukroun, Yoni, et al.
Published: (2024)
A Green Multi-Attribute Client Selection for Over-The-Air Federated Learning: A Grey-Wolf-Optimizer Approach
by: Driss, Maryam Ben, et al.
Published: (2024)
by: Driss, Maryam Ben, et al.
Published: (2024)
RelayGR: Scaling Long-Sequence Generative Recommendation via Cross-Stage Relay-Race Inference
by: Wang, Jiarui, et al.
Published: (2026)
by: Wang, Jiarui, et al.
Published: (2026)
Synera: Synergistic LLM Serving across Device and Cloud at Scale
by: Wang, Genglin, et al.
Published: (2025)
by: Wang, Genglin, et al.
Published: (2025)
Full Scaling Automation for Sustainable Development of Green Data Centers
by: Wang, Shiyu, et al.
Published: (2023)
by: Wang, Shiyu, et al.
Published: (2023)
PGT-I: Scaling Spatiotemporal GNNs with Memory-Efficient Distributed Training
by: Ockerman, Seth, et al.
Published: (2025)
by: Ockerman, Seth, et al.
Published: (2025)
RollArt: Scaling Agentic RL Training via Disaggregated Infrastructure
by: Gao, Wei, et al.
Published: (2025)
by: Gao, Wei, et al.
Published: (2025)
Similar Items
-
Enhancing Large-Scale AI Training Efficiency: The C4 Solution for Real-Time Anomaly Detection and Communication Optimization
by: Dong, Jianbo, et al.
Published: (2024) -
Cost-Efficient Multimodal LLM Inference via Cross-Tier GPU Heterogeneity
by: Yu, Donglin
Published: (2026) -
Federated Learning with Limited Node Labels
by: Tang, Bisheng, et al.
Published: (2024) -
SRL: Scaling Distributed Reinforcement Learning to Over Ten Thousand Cores
by: Mei, Zhiyu, et al.
Published: (2023) -
FedMT: Federated Learning with Mixed-type Labels
by: Zhang, Qiong, et al.
Published: (2022)