LiveR: Fine-Grained Elasticity via Live Reconfiguration for Model Training
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Liu, Haoyuan, Zhou, Kairui, Qi, Shuyao, Yang, Qinwei, Lin, Shengkai, Zhao, Shizhen, Zhang, Wei |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
FEPLB: Exploiting Copy Engines for Nearly Free MoE Load Balancing in Distributed Training
par: Qi, Shuyao, et autres
Publié: (2026)
par: Qi, Shuyao, et autres
Publié: (2026)
SAIR: Cost-Efficient Multi-Stage ML Pipeline Autoscaling via In-Context Reinforcement Learning
par: Su, Jianchang, et autres
Publié: (2026)
par: Su, Jianchang, et autres
Publié: (2026)
PipeLive: Efficient Live In-place Pipeline Parallelism Reconfiguration for Dynamic LLM Serving
par: Bai, Xu, et autres
Publié: (2026)
par: Bai, Xu, et autres
Publié: (2026)
MemFine: Memory-Aware Fine-Grained Scheduling for MoE Training
par: Zhao, Lu, et autres
Publié: (2025)
par: Zhao, Lu, et autres
Publié: (2025)
ROSE: Rollout On Serving GPUs via Cooperative Elasticity for Agentic RL
par: Gao, Wei, et autres
Publié: (2026)
par: Gao, Wei, et autres
Publié: (2026)
VersaSlot: Efficient Fine-grained FPGA Sharing with Big.Little Slots and Live Migration in FPGA Cluster
par: Gu, Jianfeng, et autres
Publié: (2025)
par: Gu, Jianfeng, et autres
Publié: (2025)
Quantifying Liveness and Safety of Avalanche's Snowball
par: Kniep, Quentin, et autres
Publié: (2024)
par: Kniep, Quentin, et autres
Publié: (2024)
A Spark Optimizer for Adaptive, Fine-Grained Parameter Tuning
par: Lyu, Chenghao, et autres
Publié: (2024)
par: Lyu, Chenghao, et autres
Publié: (2024)
Fine-Grained Modeling and Optimization for Intelligent Resource Management in Big Data Processing
par: Lyu, Chenghao, et autres
Publié: (2022)
par: Lyu, Chenghao, et autres
Publié: (2022)
ElasWave: An Elastic-Native System for Scalable Hybrid-Parallel Training
par: Kang, Xueze, et autres
Publié: (2025)
par: Kang, Xueze, et autres
Publié: (2025)
Persistent HyTM via Fast Path Fine-Grained Locking
par: Coccimiglio, Gaetano, et autres
Publié: (2025)
par: Coccimiglio, Gaetano, et autres
Publié: (2025)
Seamless Transitions: A Comprehensive Review of Live Migration Technologies
par: Attar-Khorasani, Sima, et autres
Publié: (2025)
par: Attar-Khorasani, Sima, et autres
Publié: (2025)
HotSwap: Enabling Live Dependency Sharing in Serverless Computing
par: Li, Rui, et autres
Publié: (2024)
par: Li, Rui, et autres
Publié: (2024)
Rubick: Exploiting Job Reconfigurability for Deep Learning Cluster Scheduling
par: Zhang, Xinyi, et autres
Publié: (2024)
par: Zhang, Xinyi, et autres
Publié: (2024)
Elastic Mixture of Rank-Wise Experts for Knowledge Reuse in Federated Fine-Tuning
par: Wu, Yebo, et autres
Publié: (2025)
par: Wu, Yebo, et autres
Publié: (2025)
FASER: Fine-Grained Phase Management for Speculative Decoding in Dynamic LLM Serving
par: Chen, Wenyan, et autres
Publié: (2026)
par: Chen, Wenyan, et autres
Publié: (2026)
ACE-Sync: An Adaptive Cloud-Edge Synchronization Framework for Communication-Efficient Large-Scale Distributed Model Training
par: Yang, Yi, et autres
Publié: (2025)
par: Yang, Yi, et autres
Publié: (2025)
Unleashing Scalable Context Parallelism for Foundation Models Pre-Training via FCP
par: Zhao, Yilong, et autres
Publié: (2026)
par: Zhao, Yilong, et autres
Publié: (2026)
Fine-Grained Vectorized Merge Sorting on RISC-V: From Register to Cache
par: Zhang, Jin, et autres
Publié: (2024)
par: Zhang, Jin, et autres
Publié: (2024)
BLITZSCALE: Fast and Live Large Model Autoscaling with O(1) Host Caching
par: Zhang, Dingyan, et autres
Publié: (2024)
par: Zhang, Dingyan, et autres
Publié: (2024)
Lazarus: Resilient and Elastic Training of Mixture-of-Experts Models
par: Wu, Yongji, et autres
Publié: (2024)
par: Wu, Yongji, et autres
Publié: (2024)
FedFQ: Federated Learning with Fine-Grained Quantization
par: Li, Haowei, et autres
Publié: (2024)
par: Li, Haowei, et autres
Publié: (2024)
Linear Complexity $\mathcal{H}^2$ Direct Solver for Fine-Grained Parallel Architectures
par: Boukaram, Wajih, et autres
Publié: (2025)
par: Boukaram, Wajih, et autres
Publié: (2025)
Dilu: Enabling GPU Resourcing-on-Demand for Serverless DL Serving via Introspective Elasticity
par: Lv, Cunchi, et autres
Publié: (2025)
par: Lv, Cunchi, et autres
Publié: (2025)
DynaTrain: Fast Online Parallelism Switching for Elastic LLM Training
par: Wang, Yuanqing, et autres
Publié: (2026)
par: Wang, Yuanqing, et autres
Publié: (2026)
Enabling Elastic Model Serving with MultiWorld
par: Lee, Myungjin, et autres
Publié: (2024)
par: Lee, Myungjin, et autres
Publié: (2024)
Seer: Proactive Revenue-Aware Scheduling for Live Streaming Services in Crowdsourced Cloud-Edge Platforms
par: Huang, Shaoyuan, et autres
Publié: (2024)
par: Huang, Shaoyuan, et autres
Publié: (2024)
A Framework for Fine-Grained Synchronization of Dependent GPU Kernels
par: Jangda, Abhinav, et autres
Publié: (2023)
par: Jangda, Abhinav, et autres
Publié: (2023)
Towards Fine-Grained Scalability for Stateful Stream Processing Systems
par: Qing, Yunfan, et autres
Publié: (2025)
par: Qing, Yunfan, et autres
Publié: (2025)
DynaFlow: Transparent and Flexible Intra-Device Parallelism via Programmable Operator Scheduling
par: Pan, Yi, et autres
Publié: (2026)
par: Pan, Yi, et autres
Publié: (2026)
Unleashing Efficient Asynchronous RL Post-Training via Staleness-Constrained Rollout Coordination
par: Li, Haoyang, et autres
Publié: (2026)
par: Li, Haoyang, et autres
Publié: (2026)
OTAS: An Elastic Transformer Serving System via Token Adaptation
par: Chen, Jinyu, et autres
Publié: (2024)
par: Chen, Jinyu, et autres
Publié: (2024)
LiveData -- A Worldwide Data Mesh for Stratified Data
par: Bocca, Simone, et autres
Publié: (2024)
par: Bocca, Simone, et autres
Publié: (2024)
Efficient Distributed Algorithms for Shape Reduction via Reconfigurable Circuits
par: Almalki, Nada, et autres
Publié: (2025)
par: Almalki, Nada, et autres
Publié: (2025)
ONCache: A Cache-Based Low-Overhead Container Overlay Network
par: Lin, Shengkai, et autres
Publié: (2023)
par: Lin, Shengkai, et autres
Publié: (2023)
Shared Memory-Aware Latency-Sensitive Message Aggregation for Fine-Grained Communication
par: Chandrasekar, Kavitha, et autres
Publié: (2024)
par: Chandrasekar, Kavitha, et autres
Publié: (2024)
Multithreaded Fine-Grained Asynchronous BSP for Integer Sorting with LCI and OpenMP
par: Cheng, Minyu, et autres
Publié: (2026)
par: Cheng, Minyu, et autres
Publié: (2026)
eLLM: Elastic Memory Management Framework for Efficient LLM Serving
par: Xu, Jiale, et autres
Publié: (2025)
par: Xu, Jiale, et autres
Publié: (2025)
Communication-Efficient Sparsely-Activated Model Training via Sequence Migration and Token Condensation
par: Chen, Fahao, et autres
Publié: (2024)
par: Chen, Fahao, et autres
Publié: (2024)
PromptTuner: SLO-Aware Elastic System for LLM Prompt Tuning
par: Gao, Wei, et autres
Publié: (2026)
par: Gao, Wei, et autres
Publié: (2026)
Documents similaires
-
FEPLB: Exploiting Copy Engines for Nearly Free MoE Load Balancing in Distributed Training
par: Qi, Shuyao, et autres
Publié: (2026) -
SAIR: Cost-Efficient Multi-Stage ML Pipeline Autoscaling via In-Context Reinforcement Learning
par: Su, Jianchang, et autres
Publié: (2026) -
PipeLive: Efficient Live In-place Pipeline Parallelism Reconfiguration for Dynamic LLM Serving
par: Bai, Xu, et autres
Publié: (2026) -
MemFine: Memory-Aware Fine-Grained Scheduling for MoE Training
par: Zhao, Lu, et autres
Publié: (2025) -
ROSE: Rollout On Serving GPUs via Cooperative Elasticity for Agentic RL
par: Gao, Wei, et autres
Publié: (2026)