PS-WL: A Probability-Sensitive Wear Leveling scheme for SSD array scaling
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Xu, Shuhang, Gu, Yunfei, Liu, Linhui, Wu, Chentao |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
AGILE: Lightweight and Efficient Asynchronous GPU-SSD Integration
par: Yang, Zhuoping, et autres
Publié: (2025)
par: Yang, Zhuoping, et autres
Publié: (2025)
Efficient Graph Embedding at Scale: Optimizing CPU-GPU-SSD Integration
par: Li, Zhonggen, et autres
Publié: (2025)
par: Li, Zhonggen, et autres
Publié: (2025)
MemAscend: System Memory Optimization for SSD-Offloaded LLM Fine-Tuning
par: Liaw, Yong-Cheng, et autres
Publié: (2025)
par: Liaw, Yong-Cheng, et autres
Publié: (2025)
Half a Century of Distributed Byzantine Fault-Tolerant Consensus: Design Principles and Evolutionary Pathways
par: Wu, Huanyu, et autres
Publié: (2024)
par: Wu, Huanyu, et autres
Publié: (2024)
BLOCKS: Blockchain-supported Cross-Silo Knowledge Sharing for Efficient LLM Services
par: Zhou, Zhaojiacheng, et autres
Publié: (2025)
par: Zhou, Zhaojiacheng, et autres
Publié: (2025)
NAVIS: Concurrent Search and Update with Low Position-Seeking Overhead in On-SSD Graph-Based Vector Search
par: Song, Jaeyong, et autres
Publié: (2026)
par: Song, Jaeyong, et autres
Publié: (2026)
FlexFL: Heterogeneous Federated Learning via APoZ-Guided Flexible Pruning in Uncertain Scenarios
par: Chen, Zekai, et autres
Publié: (2024)
par: Chen, Zekai, et autres
Publié: (2024)
Auto-scaling Approaches for Microservice Applications: A Survey and Taxonomy
par: Xu, Minxian, et autres
Publié: (2025)
par: Xu, Minxian, et autres
Publié: (2025)
KORAL: Knowledge Graph Guided LLM Reasoning for SSD Operational Analysis
par: Akewar, Mayur, et autres
Publié: (2026)
par: Akewar, Mayur, et autres
Publié: (2026)
Large-scale Neural Network Quantum States for ab initio Quantum Chemistry Simulations on Fugaku
par: Xu, Hongtao, et autres
Publié: (2025)
par: Xu, Hongtao, et autres
Publié: (2025)
SWIFT: Expedited Failure Recovery for Large-scale DNN Training
par: Zhong, Yuchen, et autres
Publié: (2023)
par: Zhong, Yuchen, et autres
Publié: (2023)
BSODiag: A Global Diagnosis Framework for Batch Servers Outage in Large-scale Cloud Infrastructure Systems
par: Duan, Tao, et autres
Publié: (2025)
par: Duan, Tao, et autres
Publié: (2025)
DawnPiper: A Memory-scablable Pipeline Parallel Training Framework
par: Peng, Xuan, et autres
Publié: (2025)
par: Peng, Xuan, et autres
Publié: (2025)
An Efficient, Reliable and Observable Collective Communication Library in Large-scale GPU Training Clusters
par: Zhang, Mingjun, et autres
Publié: (2025)
par: Zhang, Mingjun, et autres
Publié: (2025)
The Logarithmic Random Bidding for the Parallel Roulette Wheel Selection with Precise Probabilities
par: Nakano, Koji
Publié: (2024)
par: Nakano, Koji
Publié: (2024)
GMLake: Efficient and Transparent GPU Memory Defragmentation for Large-scale DNN Training with Virtual Memory Stitching
par: Guo, Cong, et autres
Publié: (2024)
par: Guo, Cong, et autres
Publié: (2024)
WgPy: GPU-accelerated NumPy-like array library for web browsers
par: Hidaka, Masatoshi, et autres
Publié: (2025)
par: Hidaka, Masatoshi, et autres
Publié: (2025)
HAS-GPU: Efficient Hybrid Auto-scaling with Fine-grained GPU Allocation for SLO-aware Serverless Inferences
par: Gu, Jianfeng, et autres
Publié: (2025)
par: Gu, Jianfeng, et autres
Publié: (2025)
MOSS: A Large-scale Open Microscopic Traffic Simulation System
par: Zhang, Jun, et autres
Publié: (2024)
par: Zhang, Jun, et autres
Publié: (2024)
MoEntwine: Unleashing the Potential of Wafer-scale Chips for Large-scale Expert Parallel Inference
par: Tang, Xinru, et autres
Publié: (2025)
par: Tang, Xinru, et autres
Publié: (2025)
Harnessing Your DRAM and SSD for Sustainable and Accessible LLM Inference with Mixed-Precision and Multi-level Caching
par: Peng, Jie, et autres
Publié: (2024)
par: Peng, Jie, et autres
Publié: (2024)
PALM: A Efficient Performance Simulator for Tiled Accelerators with Large-scale Model Training
par: Fang, Jiahao, et autres
Publié: (2024)
par: Fang, Jiahao, et autres
Publié: (2024)
C-Koordinator: Interference-aware Management for Large-scale and Co-located Microservice Clusters
par: Song, Shengye, et autres
Publié: (2025)
par: Song, Shengye, et autres
Publié: (2025)
LSH-MoE: Communication-efficient MoE Training via Locality-Sensitive Hashing
par: Nie, Xiaonan, et autres
Publié: (2024)
par: Nie, Xiaonan, et autres
Publié: (2024)
Fantasy: Efficient Large-scale Vector Search on GPU Clusters with GPUDirect Async
par: Liu, Yi, et autres
Publié: (2025)
par: Liu, Yi, et autres
Publié: (2025)
A New Approach for Evaluating the Performance of Distributed Latency-Sensitive Services
par: Theodoropoulos, Theodoros, et autres
Publié: (2024)
par: Theodoropoulos, Theodoros, et autres
Publié: (2024)
Humas: A Heterogeneity- and Upgrade-aware Microservice Auto-scaling Framework in Large-scale Data Centers
par: Hua, Qin, et autres
Publié: (2024)
par: Hua, Qin, et autres
Publié: (2024)
Seq1F1B: Efficient Sequence-Level Pipeline Parallelism for Large Language Model Training
par: Sun, Ao, et autres
Publié: (2024)
par: Sun, Ao, et autres
Publié: (2024)
Redox: Improving I/O Efficiency of Model Training Through File Redirection
par: Li, Yuhao, et autres
Publié: (2025)
par: Li, Yuhao, et autres
Publié: (2025)
GPU-Accelerated Distributed QAOA on Large-scale HPC Ecosystems
par: Xu, Zhihao, et autres
Publié: (2025)
par: Xu, Zhihao, et autres
Publié: (2025)
Schedule-Level Shared-Prefix Reuse for LLM RL Training
par: Li, Pengbo, et autres
Publié: (2026)
par: Li, Pengbo, et autres
Publié: (2026)
SwarmIO: Towards 100 Million IOPS SSD Emulation for Next-generation GPU-centric Storage Systems
par: Kim, Hyeseong, et autres
Publié: (2026)
par: Kim, Hyeseong, et autres
Publié: (2026)
Squeezing Edge Performance: A Sensitivity-Aware Container Management for Heterogeneous Tasks
par: Zhang, Yongmin, et autres
Publié: (2025)
par: Zhang, Yongmin, et autres
Publié: (2025)
HarmonyBatch: Batching multi-SLO DNN Inference with Heterogeneous Serverless Functions
par: Chen, Jiabin, et autres
Publié: (2024)
par: Chen, Jiabin, et autres
Publié: (2024)
Kilometer-Level Coupled Modeling Using 40 Million Cores: An Eight-Year Journey of Model Development
par: Duan, Xiaohui, et autres
Publié: (2024)
par: Duan, Xiaohui, et autres
Publié: (2024)
Accelerating OpenPangu Inference on NPU via Speculative Decoding
par: Dai, Yuntao, et autres
Publié: (2026)
par: Dai, Yuntao, et autres
Publié: (2026)
cuSZ-$i$: High-Ratio Scientific Lossy Compression on GPUs with Optimized Multi-Level Interpolation
par: Liu, Jinyang, et autres
Publié: (2023)
par: Liu, Jinyang, et autres
Publié: (2023)
RollMux: Phase-Level Multiplexing for Disaggregated RL Post-Training
par: Wu, Tianyuan, et autres
Publié: (2025)
par: Wu, Tianyuan, et autres
Publié: (2025)
Duet instrumentation: An Agentic Approach to Improving Sensitivity in Cloud Service Benchmarking
par: Koch, Sebastian, et autres
Publié: (2026)
par: Koch, Sebastian, et autres
Publié: (2026)
Pro-Prophet: A Systematic Load Balancing Method for Efficient Parallel Training of Large-scale MoE Models
par: Wang, Wei, et autres
Publié: (2024)
par: Wang, Wei, et autres
Publié: (2024)
Documents similaires
-
AGILE: Lightweight and Efficient Asynchronous GPU-SSD Integration
par: Yang, Zhuoping, et autres
Publié: (2025) -
Efficient Graph Embedding at Scale: Optimizing CPU-GPU-SSD Integration
par: Li, Zhonggen, et autres
Publié: (2025) -
MemAscend: System Memory Optimization for SSD-Offloaded LLM Fine-Tuning
par: Liaw, Yong-Cheng, et autres
Publié: (2025) -
Half a Century of Distributed Byzantine Fault-Tolerant Consensus: Design Principles and Evolutionary Pathways
par: Wu, Huanyu, et autres
Publié: (2024) -
BLOCKS: Blockchain-supported Cross-Silo Knowledge Sharing for Efficient LLM Services
par: Zhou, Zhaojiacheng, et autres
Publié: (2025)