Risk-aware Adaptive Virtual CPU Oversubscription in Microsoft Cloud via Prototypical Human-in-the-loop Imitation Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Lu, Das, Mayukh, Yang, Fangkai, Sheng, Junjie, Qiao, Bo, Dong, Hang, Qin, Si, Rühle, Victor, Bansal, Chetan, Cortez, Eli, Goiri, Íñigo, Rajmohan, Saravan, Lin, Qingwei, Zhang, Dongmei |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
COIN: Chance-Constrained Imitation Learning for Uncertainty-aware Adaptive Resource Oversubscription Policy
di: Wang, Lu, et al.
Pubblicazione: (2024)
di: Wang, Lu, et al.
Pubblicazione: (2024)
Coach: Exploiting Temporal Patterns for All-Resource Oversubscription in Cloud Platforms
di: Reidys, Benjamin, et al.
Pubblicazione: (2025)
di: Reidys, Benjamin, et al.
Pubblicazione: (2025)
A Tale of Two Graphs: Separating Knowledge Exploration from Outline Structure for Open-Ended Deep Research
di: Shi, Zhuofan, et al.
Pubblicazione: (2026)
di: Shi, Zhuofan, et al.
Pubblicazione: (2026)
Cost-Aware Retrieval-Augmentation Reasoning Models with Adaptive Retrieval Depth
di: Hashemi, Helia, et al.
Pubblicazione: (2025)
di: Hashemi, Helia, et al.
Pubblicazione: (2025)
Large Language Models can Deliver Accurate and Interpretable Time Series Anomaly Detection
di: Liu, Jun, et al.
Pubblicazione: (2024)
di: Liu, Jun, et al.
Pubblicazione: (2024)
From Reasoning to Answer: Empirical, Attention-Based and Mechanistic Insights into Distilled DeepSeek R1 Models
di: Zhang, Jue, et al.
Pubblicazione: (2025)
di: Zhang, Jue, et al.
Pubblicazione: (2025)
DoVer: Intervention-Driven Auto Debugging for LLM Multi-Agent Systems
di: Ma, Ming, et al.
Pubblicazione: (2025)
di: Ma, Ming, et al.
Pubblicazione: (2025)
Workload Intelligence: Punching Holes Through the Cloud Abstraction
di: Huang, Lexiang, et al.
Pubblicazione: (2024)
di: Huang, Lexiang, et al.
Pubblicazione: (2024)
Intelligent Router for LLM Workloads: Improving Performance Through Workload-Aware Load Balancing
di: Jain, Kunal, et al.
Pubblicazione: (2024)
di: Jain, Kunal, et al.
Pubblicazione: (2024)
An Advanced Reinforcement Learning Framework for Online Scheduling of Deferrable Workloads in Cloud Computing
di: Dong, Hang, et al.
Pubblicazione: (2024)
di: Dong, Hang, et al.
Pubblicazione: (2024)
Intelligent Monitoring Framework for Cloud Services: A Data-Driven Approach
di: Srinivas, Pooja, et al.
Pubblicazione: (2024)
di: Srinivas, Pooja, et al.
Pubblicazione: (2024)
LLM Reasoning as Trajectories: Step-Specific Representation Geometry and Correctness Signals
di: Sun, Lihao, et al.
Pubblicazione: (2026)
di: Sun, Lihao, et al.
Pubblicazione: (2026)
Towards Cloud Efficiency with Large-scale Workload Characterization
di: Parayil, Anjaly, et al.
Pubblicazione: (2024)
di: Parayil, Anjaly, et al.
Pubblicazione: (2024)
Dependency Aware Incident Linking in Large Cloud Systems
di: Ghosh, Supriyo, et al.
Pubblicazione: (2024)
di: Ghosh, Supriyo, et al.
Pubblicazione: (2024)
Attention Enhanced Entity Recommendation for Intelligent Monitoring in Cloud Systems
di: Hussain, Fiza, et al.
Pubblicazione: (2025)
di: Hussain, Fiza, et al.
Pubblicazione: (2025)
AMPO: Active Multi-Preference Optimization for Self-play Preference Selection
di: Gupta, Taneesh, et al.
Pubblicazione: (2025)
di: Gupta, Taneesh, et al.
Pubblicazione: (2025)
REFA: Reference Free Alignment for multi-preference optimization
di: Gupta, Taneesh, et al.
Pubblicazione: (2024)
di: Gupta, Taneesh, et al.
Pubblicazione: (2024)
Automated Root Causing of Cloud Incidents using In-Context Learning with GPT-4
di: Zhang, Xuchao, et al.
Pubblicazione: (2024)
di: Zhang, Xuchao, et al.
Pubblicazione: (2024)
An Empirical Study of Production Incidents in Generative AI Cloud Services
di: Yan, Haoran, et al.
Pubblicazione: (2025)
di: Yan, Haoran, et al.
Pubblicazione: (2025)
Pretrain Value, Not Reward: Decoupled Value Policy Optimization
di: Huang, Chenghua, et al.
Pubblicazione: (2025)
di: Huang, Chenghua, et al.
Pubblicazione: (2025)
ExeCoder: Empowering Large Language Models with Executability Representation for Code Translation
di: He, Minghua, et al.
Pubblicazione: (2025)
di: He, Minghua, et al.
Pubblicazione: (2025)
Learning to Refine: Self-Refinement of Parallel Reasoning in LLMs
di: Wang, Qibin, et al.
Pubblicazione: (2025)
di: Wang, Qibin, et al.
Pubblicazione: (2025)
The Vision of Autonomic Computing: Can LLMs Make It a Reality?
di: Zhang, Zhiyang, et al.
Pubblicazione: (2024)
di: Zhang, Zhiyang, et al.
Pubblicazione: (2024)
Memora: A Harmonic Memory Representation Balancing Abstraction and Specificity
di: Xia, Menglin, et al.
Pubblicazione: (2026)
di: Xia, Menglin, et al.
Pubblicazione: (2026)
WarriorMath: Enhancing the Mathematical Ability of Large Language Models with a Defect-aware Framework
di: Chen, Yue, et al.
Pubblicazione: (2025)
di: Chen, Yue, et al.
Pubblicazione: (2025)
Contrastive Attribution in the Wild: An Interpretability Analysis of LLM Failures on Realistic Benchmarks
di: Tan, Rongyuan, et al.
Pubblicazione: (2026)
di: Tan, Rongyuan, et al.
Pubblicazione: (2026)
X-lifecycle Learning for Cloud Incident Management using LLMs
di: Goel, Drishti, et al.
Pubblicazione: (2024)
di: Goel, Drishti, et al.
Pubblicazione: (2024)
Revisiting Transformer Layer Parameterization Through Causal Energy Minimization
di: Xu, Jin, et al.
Pubblicazione: (2026)
di: Xu, Jin, et al.
Pubblicazione: (2026)
Semantic Caching of Contextual Summaries for Efficient Question-Answering with Language Models
di: Couturier, Camille, et al.
Pubblicazione: (2025)
di: Couturier, Camille, et al.
Pubblicazione: (2025)
SageServe: Optimizing LLM Serving on Cloud Data Centers with Forecast Aware Auto-Scaling
di: Jaiswal, Shashwat, et al.
Pubblicazione: (2025)
di: Jaiswal, Shashwat, et al.
Pubblicazione: (2025)
AutoRAG-HP: Automatic Online Hyper-Parameter Tuning for Retrieval-Augmented Generation
di: Fu, Jia, et al.
Pubblicazione: (2024)
di: Fu, Jia, et al.
Pubblicazione: (2024)
AI Delegates with a Dual Focus: Ensuring Privacy and Strategic Self-Disclosure
di: Zhang, Zhiyang, et al.
Pubblicazione: (2024)
di: Zhang, Zhiyang, et al.
Pubblicazione: (2024)
AXIS: Efficient Human-Agent-Computer Interaction with API-First LLM-Based Agents
di: Lu, Junting, et al.
Pubblicazione: (2024)
di: Lu, Junting, et al.
Pubblicazione: (2024)
RepoGenesis: Benchmarking End-to-End Microservice Generation from Readme to Repository
di: Peng, Zhiyuan, et al.
Pubblicazione: (2026)
di: Peng, Zhiyuan, et al.
Pubblicazione: (2026)
Self-Evolved Reward Learning for LLMs
di: Huang, Chenghua, et al.
Pubblicazione: (2024)
di: Huang, Chenghua, et al.
Pubblicazione: (2024)
VEM: Environment-Free Exploration for Training GUI Agent with Value Environment Model
di: Zheng, Jiani, et al.
Pubblicazione: (2025)
di: Zheng, Jiani, et al.
Pubblicazione: (2025)
EfficientRAG: Efficient Retriever for Multi-Hop Question Answering
di: Zhuang, Ziyuan, et al.
Pubblicazione: (2024)
di: Zhuang, Ziyuan, et al.
Pubblicazione: (2024)
AutoAdapt: An Automated Domain Adaptation Framework for LLMs
di: Sinha, Sidharth, et al.
Pubblicazione: (2026)
di: Sinha, Sidharth, et al.
Pubblicazione: (2026)
Multi-Preference Optimization: Generalizing DPO via Set-Level Contrasts
di: Gupta, Taneesh, et al.
Pubblicazione: (2024)
di: Gupta, Taneesh, et al.
Pubblicazione: (2024)
Text2Grad: Reinforcement Learning from Natural Language Feedback
di: Wang, Hanyang, et al.
Pubblicazione: (2025)
di: Wang, Hanyang, et al.
Pubblicazione: (2025)
Documenti analoghi
-
COIN: Chance-Constrained Imitation Learning for Uncertainty-aware Adaptive Resource Oversubscription Policy
di: Wang, Lu, et al.
Pubblicazione: (2024) -
Coach: Exploiting Temporal Patterns for All-Resource Oversubscription in Cloud Platforms
di: Reidys, Benjamin, et al.
Pubblicazione: (2025) -
A Tale of Two Graphs: Separating Knowledge Exploration from Outline Structure for Open-Ended Deep Research
di: Shi, Zhuofan, et al.
Pubblicazione: (2026) -
Cost-Aware Retrieval-Augmentation Reasoning Models with Adaptive Retrieval Depth
di: Hashemi, Helia, et al.
Pubblicazione: (2025) -
Large Language Models can Deliver Accurate and Interpretable Time Series Anomaly Detection
di: Liu, Jun, et al.
Pubblicazione: (2024)