Mao: Machine learning approach for NUMA optimization in Warehouse Scale Computers
Fuente:
arXiv
Salvato in:
| Autori principali: | Liu, Yueji, Jin, Jun, Shu, Wenhui, Li, Shiyong, He, Yongzhan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
A Bring-Your-Own-Model Approach for ML-Driven Storage Placement in Warehouse-Scale Computers
di: Yang, Chenxi, et al.
Pubblicazione: (2025)
di: Yang, Chenxi, et al.
Pubblicazione: (2025)
Blockchain-aided wireless federated learning: Resource allocation and client scheduling
di: Li, Jun, et al.
Pubblicazione: (2024)
di: Li, Jun, et al.
Pubblicazione: (2024)
SmartPQ: An Adaptive Concurrent Priority Queue for NUMA Architectures
di: Giannoula, Christina, et al.
Pubblicazione: (2024)
di: Giannoula, Christina, et al.
Pubblicazione: (2024)
Optimising Virtual Resource Mapping in Multi-Level NUMA Disaggregated Systems
di: Lakew, Ewnetu Bayuh, et al.
Pubblicazione: (2025)
di: Lakew, Ewnetu Bayuh, et al.
Pubblicazione: (2025)
ESS: An Offload-Centric Latent-Cache Management Architecture for DeepSeek-V3.2-Exp
di: Chen, Xinhang, et al.
Pubblicazione: (2025)
di: Chen, Xinhang, et al.
Pubblicazione: (2025)
Overview and Prospects of Using Integer Surrogate Keys for Data Warehouse Performance Optimization
di: Stumpf, Sviatoslav, et al.
Pubblicazione: (2025)
di: Stumpf, Sviatoslav, et al.
Pubblicazione: (2025)
Distributed On-Device LLM Inference With Over-the-Air Computation
di: Zhang, Kai, et al.
Pubblicazione: (2025)
di: Zhang, Kai, et al.
Pubblicazione: (2025)
Carbon: Scaling Trusted Payments with Untrusted Machines
di: Camaioni, Martina, et al.
Pubblicazione: (2022)
di: Camaioni, Martina, et al.
Pubblicazione: (2022)
Exploring Uncore Frequency Scaling for Heterogeneous Computing
di: Zheng, Zhong, et al.
Pubblicazione: (2025)
di: Zheng, Zhong, et al.
Pubblicazione: (2025)
CCRSat: A Collaborative Computation Reuse Framework for Satellite Edge Computing Networks
di: Zhang, Ye, et al.
Pubblicazione: (2025)
di: Zhang, Ye, et al.
Pubblicazione: (2025)
KUBEDIRECT: Unleashing the Full Power of the Cluster Manager for Serverless Computing
di: Qi, Sheng, et al.
Pubblicazione: (2026)
di: Qi, Sheng, et al.
Pubblicazione: (2026)
EinDecomp: Decomposition of Declaratively-Specified Machine Learning and Numerical Computations for Parallel Execution
di: Bourgeois, Daniel, et al.
Pubblicazione: (2024)
di: Bourgeois, Daniel, et al.
Pubblicazione: (2024)
Scalable Analysis of Urban Scaling Laws: Leveraging Cloud Computing to Analyze 21,280 Global Cities
di: Li, Zhenhui, et al.
Pubblicazione: (2024)
di: Li, Zhenhui, et al.
Pubblicazione: (2024)
DistServe: Disaggregating Prefill and Decoding for Goodput-optimized Large Language Model Serving
di: Zhong, Yinmin, et al.
Pubblicazione: (2024)
di: Zhong, Yinmin, et al.
Pubblicazione: (2024)
Large-Scale Metric Computation in Online Controlled Experiment Platform
di: Xiong, Tao, et al.
Pubblicazione: (2024)
di: Xiong, Tao, et al.
Pubblicazione: (2024)
MPI-Q: A Message Communication Library for Large-Scale Classical-Quantum Heterogeneous Hybrid Distributed Computing
di: Wang, Feng, et al.
Pubblicazione: (2026)
di: Wang, Feng, et al.
Pubblicazione: (2026)
WaterWise: Co-optimizing Carbon- and Water-Footprint Toward Environmentally Sustainable Cloud Computing
di: Jiang, Yankai, et al.
Pubblicazione: (2025)
di: Jiang, Yankai, et al.
Pubblicazione: (2025)
Driving Computational Efficiency in Large-Scale Platforms using HPC Technologies
di: Mendez, Alexander Martinez, et al.
Pubblicazione: (2026)
di: Mendez, Alexander Martinez, et al.
Pubblicazione: (2026)
Scale: Deep Reinforcement Learning for Container Scheduling in Serverless Edge Computing
di: Chen, Chen, et al.
Pubblicazione: (2026)
di: Chen, Chen, et al.
Pubblicazione: (2026)
EdgeFaaS: A Function-based Framework for Edge Computing
di: Jin, Runyu, et al.
Pubblicazione: (2022)
di: Jin, Runyu, et al.
Pubblicazione: (2022)
Approximated Coded Computing: Towards Fast, Private and Secure Distributed Machine Learning
di: Qiu, Houming, et al.
Pubblicazione: (2024)
di: Qiu, Houming, et al.
Pubblicazione: (2024)
FlashFuser: Expanding the Scale of Kernel Fusion for Compute-Intensive Operators via Inter-Core Connection
di: Huang, Ziyu, et al.
Pubblicazione: (2025)
di: Huang, Ziyu, et al.
Pubblicazione: (2025)
WindGP: Efficient Graph Partitioning on Heterogenous Machines
di: Zeng, Li, et al.
Pubblicazione: (2024)
di: Zeng, Li, et al.
Pubblicazione: (2024)
PipeBoost: Resilient Pipelined Architecture for Fast Serverless LLM Scaling
di: Liu, Chongpeng, et al.
Pubblicazione: (2025)
di: Liu, Chongpeng, et al.
Pubblicazione: (2025)
HGraphScale: Hierarchical Graph Learning for Autoscaling Microservice Applications in Container-based Cloud Computing
di: Fang, Zhengxin, et al.
Pubblicazione: (2025)
di: Fang, Zhengxin, et al.
Pubblicazione: (2025)
Low-Latency Federated Fine-Tuning for Large Language Models Over Wireless Networks
di: Pang, Zhiwen, et al.
Pubblicazione: (2026)
di: Pang, Zhiwen, et al.
Pubblicazione: (2026)
Polar: Agentic RL on Any Harness at Scale
di: Xu, Binfeng, et al.
Pubblicazione: (2026)
di: Xu, Binfeng, et al.
Pubblicazione: (2026)
Incremental GNN Embedding Computation on Streaming Graphs
di: Wang, Qiange, et al.
Pubblicazione: (2026)
di: Wang, Qiange, et al.
Pubblicazione: (2026)
Profiling and optimization of multi-card GPU machine learning jobs
di: Lawenda, Marcin, et al.
Pubblicazione: (2025)
di: Lawenda, Marcin, et al.
Pubblicazione: (2025)
Akita: A High Usability Simulation Framework for Computer Architecture
di: Jannat, Sabila Al, et al.
Pubblicazione: (2026)
di: Jannat, Sabila Al, et al.
Pubblicazione: (2026)
Building State Machine Replication Using Practical Network Synchrony
di: Wan, Yiliang, et al.
Pubblicazione: (2025)
di: Wan, Yiliang, et al.
Pubblicazione: (2025)
A Distributed Approach for Persistent Homology Computation on a Large Scale
di: Ceccaroni, Riccardo, et al.
Pubblicazione: (2024)
di: Ceccaroni, Riccardo, et al.
Pubblicazione: (2024)
TileLink: Generating Efficient Compute-Communication Overlapping Kernels using Tile-Centric Primitives
di: Zheng, Size, et al.
Pubblicazione: (2025)
di: Zheng, Size, et al.
Pubblicazione: (2025)
Scaling LLM Inference Beyond Amdahl`s Limits via Eliminating Non-Scalable Overheads
di: Zhao, Alan, et al.
Pubblicazione: (2026)
di: Zhao, Alan, et al.
Pubblicazione: (2026)
Mean field optimal Core Allocation across Malleable jobs
di: Li, Zhouzi, et al.
Pubblicazione: (2026)
di: Li, Zhouzi, et al.
Pubblicazione: (2026)
Advancing Anomaly Detection in Computational Workflows with Active Learning
di: Raghavan, Krishnan, et al.
Pubblicazione: (2024)
di: Raghavan, Krishnan, et al.
Pubblicazione: (2024)
EvoSort: A Genetic-Algorithm-Based Adaptive Parallel Sorting Framework for Large-Scale High Performance Computing
di: Raj, Shashank, et al.
Pubblicazione: (2025)
di: Raj, Shashank, et al.
Pubblicazione: (2025)
DeepServe: Serverless Large Language Model Serving at Scale
di: Hu, Junhao, et al.
Pubblicazione: (2025)
di: Hu, Junhao, et al.
Pubblicazione: (2025)
Collaborative Satellite Computing through Adaptive DNN Task Splitting and Offloading
di: Peng, Shifeng, et al.
Pubblicazione: (2024)
di: Peng, Shifeng, et al.
Pubblicazione: (2024)
Flow-Bench: A Dataset for Computational Workflow Anomaly Detection
di: Papadimitriou, George, et al.
Pubblicazione: (2023)
di: Papadimitriou, George, et al.
Pubblicazione: (2023)
Documenti analoghi
-
A Bring-Your-Own-Model Approach for ML-Driven Storage Placement in Warehouse-Scale Computers
di: Yang, Chenxi, et al.
Pubblicazione: (2025) -
Blockchain-aided wireless federated learning: Resource allocation and client scheduling
di: Li, Jun, et al.
Pubblicazione: (2024) -
SmartPQ: An Adaptive Concurrent Priority Queue for NUMA Architectures
di: Giannoula, Christina, et al.
Pubblicazione: (2024) -
Optimising Virtual Resource Mapping in Multi-Level NUMA Disaggregated Systems
di: Lakew, Ewnetu Bayuh, et al.
Pubblicazione: (2025) -
ESS: An Offload-Centric Latent-Cache Management Architecture for DeepSeek-V3.2-Exp
di: Chen, Xinhang, et al.
Pubblicazione: (2025)