Learning Virtual Machine Scheduling in Cloud Computing through Language Agents
Fuente:
arXiv
Guardado en:
| Autores principales: | Wu, JieHao, Wang, Ziwei, Sheng, Junjie, Li, Wenhao, Wang, Xiangfeng, Luo, Jun |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Scalable Reinforcement Learning for Virtual Machine Scheduling
por: Sheng, Junjie, et al.
Publicado: (2025)
por: Sheng, Junjie, et al.
Publicado: (2025)
TextAtari: 100K Frames Game Playing with Language Agents
por: Li, Wenhao, et al.
Publicado: (2025)
por: Li, Wenhao, et al.
Publicado: (2025)
AscendOptimizer: Episodic Agent for Ascend NPU Operator Optimization
por: Wu, Jiehao, et al.
Publicado: (2026)
por: Wu, Jiehao, et al.
Publicado: (2026)
Mean-Field Diffuser: Scaling Offline MARL to Thousands of Agents
por: Li, Wenhao, et al.
Publicado: (2026)
por: Li, Wenhao, et al.
Publicado: (2026)
MobileGUI-RL: Advancing Mobile GUI Agent through Reinforcement Learning in Online Environment
por: Shi, Yucheng, et al.
Publicado: (2025)
por: Shi, Yucheng, et al.
Publicado: (2025)
MiniDisc: Minimal Distillation Schedule for Language Model Compression
por: Zhang, Chen, et al.
Publicado: (2022)
por: Zhang, Chen, et al.
Publicado: (2022)
Disentangled Representation Learning with Large Language Models for Text-Attributed Graphs
por: Qin, Yijian, et al.
Publicado: (2023)
por: Qin, Yijian, et al.
Publicado: (2023)
DVM: A Bytecode Virtual Machine Approach for Dynamic Tensor Computation
por: Fang, Jingzhi, et al.
Publicado: (2026)
por: Fang, Jingzhi, et al.
Publicado: (2026)
MLR-Copilot: Autonomous Machine Learning Research based on Large Language Models Agents
por: Li, Ruochen, et al.
Publicado: (2024)
por: Li, Ruochen, et al.
Publicado: (2024)
Internalize the Temperature: On-Policy Self-Distillation as Policy Reheater for Reinforcement Learning
por: Yang, Xuewei, et al.
Publicado: (2026)
por: Yang, Xuewei, et al.
Publicado: (2026)
AI-Slop to AI-Polish? Aligning Language Models through Edit-Based Writing Rewards and Test-time Computation
por: Chakrabarty, Tuhin, et al.
Publicado: (2025)
por: Chakrabarty, Tuhin, et al.
Publicado: (2025)
Watch Every Step! LLM Agent Learning via Iterative Step-Level Process Refinement
por: Xiong, Weimin, et al.
Publicado: (2024)
por: Xiong, Weimin, et al.
Publicado: (2024)
Synthetic Sandbox for Training Machine Learning Engineering Agents
por: Zhou, Yuhang, et al.
Publicado: (2026)
por: Zhou, Yuhang, et al.
Publicado: (2026)
Promoting Data and Model Privacy in Federated Learning through Quantized LoRA
por: Zhu, JianHao, et al.
Publicado: (2024)
por: Zhu, JianHao, et al.
Publicado: (2024)
Mental Modeling of Reinforcement Learning Agents by Language Models
por: Lu, Wenhao, et al.
Publicado: (2024)
por: Lu, Wenhao, et al.
Publicado: (2024)
AgentTTS: Large Language Model Agent for Test-time Compute-optimal Scaling Strategy in Complex Tasks
por: Wang, Fali, et al.
Publicado: (2025)
por: Wang, Fali, et al.
Publicado: (2025)
Adaptive Social Learning via Mode Policy Optimization for Language Agents
por: Wang, Minzheng, et al.
Publicado: (2025)
por: Wang, Minzheng, et al.
Publicado: (2025)
T1: Advancing Language Model Reasoning through Reinforcement Learning and Inference Scaling
por: Hou, Zhenyu, et al.
Publicado: (2025)
por: Hou, Zhenyu, et al.
Publicado: (2025)
A light-weight and efficient punctuation and word casing prediction model for on-device streaming ASR
por: You, Jian, et al.
Publicado: (2024)
por: You, Jian, et al.
Publicado: (2024)
Direct Multi-Turn Preference Optimization for Language Agents
por: Shi, Wentao, et al.
Publicado: (2024)
por: Shi, Wentao, et al.
Publicado: (2024)
Navigating the Shortcut Maze: A Comprehensive Analysis of Shortcut Learning in Text Classification by Language Models
por: Zhou, Yuqing, et al.
Publicado: (2024)
por: Zhou, Yuqing, et al.
Publicado: (2024)
Driving Intelligent IoT Monitoring and Control through Cloud Computing and Machine Learning
por: Li, Hanzhe, et al.
Publicado: (2024)
por: Li, Hanzhe, et al.
Publicado: (2024)
CodeACT: Code Adaptive Compute-efficient Tuning Framework for Code LLMs
por: Lv, Weijie, et al.
Publicado: (2024)
por: Lv, Weijie, et al.
Publicado: (2024)
Backdooring Instruction-Tuned Large Language Models with Virtual Prompt Injection
por: Yan, Jun, et al.
Publicado: (2023)
por: Yan, Jun, et al.
Publicado: (2023)
Generative Multi-Agent Collaboration in Embodied AI: A Systematic Review
por: Wu, Di, et al.
Publicado: (2025)
por: Wu, Di, et al.
Publicado: (2025)
Formal-LLM: Integrating Formal Language and Natural Language for Controllable LLM-based Agents
por: Li, Zelong, et al.
Publicado: (2024)
por: Li, Zelong, et al.
Publicado: (2024)
Fighting Spurious Correlations in Text Classification via a Causal Learning Perspective
por: Zhou, Yuqing, et al.
Publicado: (2024)
por: Zhou, Yuqing, et al.
Publicado: (2024)
Structured Agent Distillation for Large Language Model
por: Liu, Jun, et al.
Publicado: (2025)
por: Liu, Jun, et al.
Publicado: (2025)
Unlocking the Potentials of Retrieval-Augmented Generation for Diffusion Language Models
por: Yu, Chuanyue, et al.
Publicado: (2026)
por: Yu, Chuanyue, et al.
Publicado: (2026)
Fine-Tuning is Subgraph Search: A New Lens on Learning Dynamics
por: Li, Yueyan, et al.
Publicado: (2025)
por: Li, Yueyan, et al.
Publicado: (2025)
Mixture of Experts Made Personalized: Federated Prompt Learning for Vision-Language Models
por: Luo, Jun, et al.
Publicado: (2024)
por: Luo, Jun, et al.
Publicado: (2024)
Fine-tuning Large Language Models for Domain-specific Machine Translation
por: Zheng, Jiawei, et al.
Publicado: (2024)
por: Zheng, Jiawei, et al.
Publicado: (2024)
Continual Learning for Large Language Models: A Survey
por: Wu, Tongtong, et al.
Publicado: (2024)
por: Wu, Tongtong, et al.
Publicado: (2024)
Adversarial Reinforcement Learning for Large Language Model Agent Safety
por: Wang, Zizhao, et al.
Publicado: (2025)
por: Wang, Zizhao, et al.
Publicado: (2025)
AgentGym-RL: Training LLM Agents for Long-Horizon Decision Making through Multi-Turn Reinforcement Learning
por: Xi, Zhiheng, et al.
Publicado: (2025)
por: Xi, Zhiheng, et al.
Publicado: (2025)
Verifying Computational Graphs in Production-Grade Distributed Machine Learning Frameworks
por: Zulkifli, Kahfi S., et al.
Publicado: (2025)
por: Zulkifli, Kahfi S., et al.
Publicado: (2025)
Learning Instruction-Following Policies through Open-Ended Instruction Relabeling with Large Language Models
por: Zhang, Zhicheng, et al.
Publicado: (2025)
por: Zhang, Zhicheng, et al.
Publicado: (2025)
VCRL: Variance-based Curriculum Reinforcement Learning for Large Language Models
por: Jiang, Guochao, et al.
Publicado: (2025)
por: Jiang, Guochao, et al.
Publicado: (2025)
Co-Evolution of Policy and Internal Reward for Language Agents
por: Wang, Xinyu, et al.
Publicado: (2026)
por: Wang, Xinyu, et al.
Publicado: (2026)
A Survey of Automatic Prompt Engineering: An Optimization Perspective
por: Li, Wenwu, et al.
Publicado: (2025)
por: Li, Wenwu, et al.
Publicado: (2025)
Ejemplares similares
-
Scalable Reinforcement Learning for Virtual Machine Scheduling
por: Sheng, Junjie, et al.
Publicado: (2025) -
TextAtari: 100K Frames Game Playing with Language Agents
por: Li, Wenhao, et al.
Publicado: (2025) -
AscendOptimizer: Episodic Agent for Ascend NPU Operator Optimization
por: Wu, Jiehao, et al.
Publicado: (2026) -
Mean-Field Diffuser: Scaling Offline MARL to Thousands of Agents
por: Li, Wenhao, et al.
Publicado: (2026) -
MobileGUI-RL: Advancing Mobile GUI Agent through Reinforcement Learning in Online Environment
por: Shi, Yucheng, et al.
Publicado: (2025)