Ding-Dong Ditch: Peeking Into Spot Instance Availability
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kim, Kyumin, Song, Moohyun, Kim, Taeyoon, Lee, Kyungyong |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SpotVista: Availability-Aware Recommendation System for Reliable and Cost-Efficient Multi-Node Spot Instances
par: Kim, Taeyoon, et autres
Publié: (2026)
par: Kim, Taeyoon, et autres
Publié: (2026)
KubePACS: Kubernetes Cluster Using Performant, Highly Available, and Cost Efficient Spot Instances
par: Kim, Taeyoon, et autres
Publié: (2026)
par: Kim, Taeyoon, et autres
Publié: (2026)
Why Do AI Agents Systematically Fail at Cloud Root Cause Analysis?
par: Kim, Taeyoon, et autres
Publié: (2026)
par: Kim, Taeyoon, et autres
Publié: (2026)
DeepVM: Integrating Spot and On-Demand VMs for Cost-Efficient Deep Learning Clusters in the Cloud
par: Kim, Yoochan, et autres
Publié: (2024)
par: Kim, Yoochan, et autres
Publié: (2024)
SneakPeek: Data-Aware Model Selection and Scheduling for Inference Serving on the Edge
par: Wolfrath, Joel, et autres
Publié: (2025)
par: Wolfrath, Joel, et autres
Publié: (2025)
GFS: A Preemption-aware Scheduling Framework for GPU Clusters with Predictive Spot Instance Management
par: Duan, Jiaang, et autres
Publié: (2025)
par: Duan, Jiaang, et autres
Publié: (2025)
AGAThA: Fast and Efficient GPU Acceleration of Guided Sequence Alignment for Long Read Mapping
par: Park, Seongyeon, et autres
Publié: (2024)
par: Park, Seongyeon, et autres
Publié: (2024)
SpotKube: Cost-Optimal Microservices Deployment with Cluster Autoscaling and Spot Pricing
par: Edirisinghe, Dasith, et autres
Publié: (2024)
par: Edirisinghe, Dasith, et autres
Publié: (2024)
SkyServe: Serving AI Models across Regions and Clouds with Spot Instances
par: Mao, Ziming, et autres
Publié: (2024)
par: Mao, Ziming, et autres
Publié: (2024)
Parcae: Proactive, Liveput-Optimized DNN Training on Preemptible Instances
par: Duan, Jiangfei, et autres
Publié: (2024)
par: Duan, Jiangfei, et autres
Publié: (2024)
Arbitration-Free Consistency is Available (and Vice Versa)
par: Attiya, Hagit, et autres
Publié: (2025)
par: Attiya, Hagit, et autres
Publié: (2025)
Signalling Health for Improved Kubernetes Microservice Availability
par: Roberts, Jacob, et autres
Publié: (2025)
par: Roberts, Jacob, et autres
Publié: (2025)
Optimal Checkpoint Interval with Availability as an Objective Function
par: Saxena, Nirmal Raj, et autres
Publié: (2024)
par: Saxena, Nirmal Raj, et autres
Publié: (2024)
Availability Modeling for Blockchain Provisioning in Private Clouds
par: Dantas, J, et autres
Publié: (2025)
par: Dantas, J, et autres
Publié: (2025)
A Hierarchical Sharded Blockchain Balancing Performance and Availability
par: Jo, Yongrae, et autres
Publié: (2025)
par: Jo, Yongrae, et autres
Publié: (2025)
Assessing Redundancy Strategies to Improve Availability in Virtualized System Architectures
par: Silva, Alison, et autres
Publié: (2025)
par: Silva, Alison, et autres
Publié: (2025)
SmartShards: Churn-Tolerant Continuously Available Distributed Ledger
par: Oglio, Joseph, et autres
Publié: (2025)
par: Oglio, Joseph, et autres
Publié: (2025)
FlexiWalker: Extensible GPU Framework for Efficient Dynamic Random Walks with Runtime Adaptation
par: Park, Seongyeon, et autres
Publié: (2025)
par: Park, Seongyeon, et autres
Publié: (2025)
Optimal Workload Placement on Multi-Instance GPUs
par: Turkkan, Bekir, et autres
Publié: (2024)
par: Turkkan, Bekir, et autres
Publié: (2024)
A Decentralized Sequencer and Data Availability Committee for Rollups Using Set Consensus
par: Capretto, Margarita, et autres
Publié: (2025)
par: Capretto, Margarita, et autres
Publié: (2025)
DFLOP: A Data-driven Framework for Multimodal LLM Training Pipeline Optimization
par: An, Hyeonjun, et autres
Publié: (2026)
par: An, Hyeonjun, et autres
Publié: (2026)
Diving into 3D Parallelism with Heterogeneous Spot Instance GPUs: Design and Implications
par: Wang, Yuxiao, et autres
Publié: (2025)
par: Wang, Yuxiao, et autres
Publié: (2025)
AI-Driven Multi-Region Provisioning for Cloud Services Using Spot Fleets
par: Fabra, Javier, et autres
Publié: (2026)
par: Fabra, Javier, et autres
Publié: (2026)
Incisor: Ex Ante Cloud Instance Selection for HPC Jobs
par: Laurenzano, Michael A., et autres
Publié: (2026)
par: Laurenzano, Michael A., et autres
Publié: (2026)
Managing Multi Instance GPUs for High Throughput and Energy Savings
par: Saraha, Abhijeet, et autres
Publié: (2025)
par: Saraha, Abhijeet, et autres
Publié: (2025)
PIM-SHERPA: Software Method for On-device LLM Inference by Resolving PIM Memory Attribute and Layout Inconsistencies
par: Lee, Sunjung, et autres
Publié: (2026)
par: Lee, Sunjung, et autres
Publié: (2026)
Evaluating Multi-Instance DNN Inferencing on Multiple Accelerators of an Edge Device
par: Tayal, Mumuksh, et autres
Publié: (2025)
par: Tayal, Mumuksh, et autres
Publié: (2025)
MaaSO: SLO-aware Orchestration of Heterogeneous Model Instances for MaaS
par: Xuan, Mo, et autres
Publié: (2025)
par: Xuan, Mo, et autres
Publié: (2025)
Improving GPU Multi-Tenancy Through Dynamic Multi-Instance GPU Reconfiguration
par: Wang, Tianyu, et autres
Publié: (2024)
par: Wang, Tianyu, et autres
Publié: (2024)
Minos: Exploiting Cloud Performance Variation with Function-as-a-Service Instance Selection
par: Schirmer, Trever, et autres
Publié: (2025)
par: Schirmer, Trever, et autres
Publié: (2025)
Efficient Routing of Inference Requests across LLM Instances in Cloud-Edge Computing
par: Yu, Shibo, et autres
Publié: (2025)
par: Yu, Shibo, et autres
Publié: (2025)
Accelerating Sparse Matrix-Matrix Multiplication on GPUs with Processing Near HBMs
par: Li, Shiju, et autres
Publié: (2025)
par: Li, Shiju, et autres
Publié: (2025)
Distributed Application Provisioning over Ethereum based private and permissioned Blockchain: Availability modeling, capacity, and costs planning
par: Melo, Carlos, et autres
Publié: (2025)
par: Melo, Carlos, et autres
Publié: (2025)
SkyNomad: On Using Multi-Region Spot Instances to Minimize AI Batch Job Cost
par: Li, Zhifei, et autres
Publié: (2026)
par: Li, Zhifei, et autres
Publié: (2026)
An Online Fragmentation-Aware Scheduler for Managing GPU-Sharing Workloads on Multi-Instance GPUs
par: Ting, Hsu-Tzu, et autres
Publié: (2025)
par: Ting, Hsu-Tzu, et autres
Publié: (2025)
New Improvements in Solving Large LABS Instances Using Massively Parallelizable Memetic Tabu Search
par: Zhang, Zhiwei, et autres
Publié: (2025)
par: Zhang, Zhiwei, et autres
Publié: (2025)
EcoServe: Enabling Cost-effective LLM Serving with Proactive Intra- and Inter-Instance Orchestration
par: Du, Jiangsu, et autres
Publié: (2025)
par: Du, Jiangsu, et autres
Publié: (2025)
Taurus Database: How to be Fast, Available, and Frugal in the Cloud
par: Depoutovitch, Alex, et autres
Publié: (2024)
par: Depoutovitch, Alex, et autres
Publié: (2024)
TraCT: Disaggregated LLM Serving with CXL Shared Memory KV Cache at Rack-Scale
par: Yoon, Dongha, et autres
Publié: (2025)
par: Yoon, Dongha, et autres
Publié: (2025)
Characterizing Compute-Communication Overlap in GPU-Accelerated Distributed Deep Learning: Performance and Power Implications
par: Lee, Seonho, et autres
Publié: (2025)
par: Lee, Seonho, et autres
Publié: (2025)
Documents similaires
-
SpotVista: Availability-Aware Recommendation System for Reliable and Cost-Efficient Multi-Node Spot Instances
par: Kim, Taeyoon, et autres
Publié: (2026) -
KubePACS: Kubernetes Cluster Using Performant, Highly Available, and Cost Efficient Spot Instances
par: Kim, Taeyoon, et autres
Publié: (2026) -
Why Do AI Agents Systematically Fail at Cloud Root Cause Analysis?
par: Kim, Taeyoon, et autres
Publié: (2026) -
DeepVM: Integrating Spot and On-Demand VMs for Cost-Efficient Deep Learning Clusters in the Cloud
par: Kim, Yoochan, et autres
Publié: (2024) -
SneakPeek: Data-Aware Model Selection and Scheduling for Inference Serving on the Edge
par: Wolfrath, Joel, et autres
Publié: (2025)