Enregistré dans:
| Auteurs principaux: | Zhu, Siqi, You, Jiaxuan |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2601.07376 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SRL: Scaling Distributed Reinforcement Learning to Over Ten Thousand Cores
par: Mei, Zhiyu, et autres
Publié: (2023)
par: Mei, Zhiyu, et autres
Publié: (2023)
ARL-Tangram: Unleash the Resource Efficiency in Agentic Reinforcement Learning
par: Xiao, Bangjun, et autres
Publié: (2026)
par: Xiao, Bangjun, et autres
Publié: (2026)
Scepsy: Serving Agentic Workflows Using Aggregate LLM Pipelines
par: Wagenländer, Marcel, et autres
Publié: (2026)
par: Wagenländer, Marcel, et autres
Publié: (2026)
Mesh-Attention: A New Communication-Efficient Distributed Attention with Improved Data Locality
par: Chen, Sirui, et autres
Publié: (2025)
par: Chen, Sirui, et autres
Publié: (2025)
LogAct: Enabling Agentic Reliability via Shared Logs
par: Balakrishnan, Mahesh, et autres
Publié: (2026)
par: Balakrishnan, Mahesh, et autres
Publié: (2026)
MARLaaS: Multi-Tenant Asynchronous Reinforcement Learning as a Service
par: Yu, Timothy Tin Long, et autres
Publié: (2026)
par: Yu, Timothy Tin Long, et autres
Publié: (2026)
Trade-offs in Decentralized Agentic AI Discovery Across the Compute Continuum
par: Dazzi, Patrizio, et autres
Publié: (2026)
par: Dazzi, Patrizio, et autres
Publié: (2026)
KAIROS: Stateful, Context-Aware Power-Efficient Agentic Inference Serving
par: Yuan, Yichao, et autres
Publié: (2026)
par: Yuan, Yichao, et autres
Publié: (2026)
Safactory: A Scalable Agentic Infrastructure for Training Trustworthy Autonomous Intelligence
par: Chen, Xinquan, et autres
Publié: (2026)
par: Chen, Xinquan, et autres
Publié: (2026)
Towards using Reinforcement Learning for Scaling and Data Replication in Cloud Systems
par: Mokadem, Riad, et autres
Publié: (2024)
par: Mokadem, Riad, et autres
Publié: (2024)
The (R)evolution of Scientific Workflows in the Agentic AI Era: Towards Autonomous Science
par: Shin, Woong, et autres
Publié: (2025)
par: Shin, Woong, et autres
Publié: (2025)
Deep Reinforcement Learning for Fault-Adaptive Routing in Eisenstein-Jacobi Interconnection Topologies
par: Charrwi, Mohammad Walid, et autres
Publié: (2026)
par: Charrwi, Mohammad Walid, et autres
Publié: (2026)
Reinforcement Learning-driven Data-intensive Workflow Scheduling for Volunteer Edge-Cloud
par: Mounesan, Motahare, et autres
Publié: (2024)
par: Mounesan, Motahare, et autres
Publié: (2024)
Quantifying Energy and Cost Benefits of Hybrid Edge Cloud: Analysis of Traditional and Agentic Workloads
par: Alamouti, Siavash
Publié: (2025)
par: Alamouti, Siavash
Publié: (2025)
Cooperative Cognitive Dynamic System in UAV Swarms: Reconfigurable Mechanism and Framework
par: Jia, Ziye, et autres
Publié: (2024)
par: Jia, Ziye, et autres
Publié: (2024)
iScheduler: Reinforcement Learning-Driven Continual Optimization for Large-Scale Resource Investment Problems
par: Hu, Yi-Xiang, et autres
Publié: (2026)
par: Hu, Yi-Xiang, et autres
Publié: (2026)
Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review
par: Gu, Yan, et autres
Publié: (2025)
par: Gu, Yan, et autres
Publié: (2025)
ParaGAN: A Scalable Distributed Training Framework for Generative Adversarial Networks
par: Shi, Ziji, et autres
Publié: (2024)
par: Shi, Ziji, et autres
Publié: (2024)
DeF-DReL: Systematic Deployment of Serverless Functions in Fog and Cloud environments using Deep Reinforcement Learning
par: Dehury, Chinmaya Kumar, et autres
Publié: (2021)
par: Dehury, Chinmaya Kumar, et autres
Publié: (2021)
Verify Distributed Deep Learning Model Implementation Refinement with Iterative Relation Inference
par: Wang, Zhanghan, et autres
Publié: (2025)
par: Wang, Zhanghan, et autres
Publié: (2025)
High-Performance Parallel Optimization of the Fish School Behaviour on the Setonix Platform Using OpenMP
par: Wang, Haitian, et autres
Publié: (2025)
par: Wang, Haitian, et autres
Publié: (2025)
PRAGMA: A Profiling-Reasoned Multi-Agent Framework for Automatic Kernel Optimization
par: Lei, Kelun, et autres
Publié: (2025)
par: Lei, Kelun, et autres
Publié: (2025)
An Advanced Reinforcement Learning Framework for Online Scheduling of Deferrable Workloads in Cloud Computing
par: Dong, Hang, et autres
Publié: (2024)
par: Dong, Hang, et autres
Publié: (2024)
Delta Sum Learning: an approach for fast and global convergence in Gossip Learning
par: Goethals, Tom, et autres
Publié: (2025)
par: Goethals, Tom, et autres
Publié: (2025)
Leyline: KV Cache Directives for Agentic Inference
par: Ma, Bole, et autres
Publié: (2026)
par: Ma, Bole, et autres
Publié: (2026)
Pact: A Choreographic Language for Agentic Ecosystems
par: Gopinathan, Kiran, et autres
Publié: (2026)
par: Gopinathan, Kiran, et autres
Publié: (2026)
Efficient and Scalable Agentic AI with Heterogeneous Systems
par: Asgar, Zain, et autres
Publié: (2025)
par: Asgar, Zain, et autres
Publié: (2025)
High-Dimensional Data Processing: Benchmarking Machine Learning and Deep Learning Architectures in Local and Distributed Environments
par: Rodriguez, Julian, et autres
Publié: (2025)
par: Rodriguez, Julian, et autres
Publié: (2025)
Janus: Collaborative Vision Transformer Under Dynamic Network Environment
par: Jiang, Linyi, et autres
Publié: (2025)
par: Jiang, Linyi, et autres
Publié: (2025)
APWA: A Distributed Architecture for Parallelizable Agentic Workflows
par: Rose, Evan, et autres
Publié: (2026)
par: Rose, Evan, et autres
Publié: (2026)
Boosting Asynchronous Decentralized Learning with Model Fragmentation
par: Biswas, Sayan, et autres
Publié: (2024)
par: Biswas, Sayan, et autres
Publié: (2024)
OpenMoE: An Early Effort on Open Mixture-of-Experts Language Models
par: Xue, Fuzhao, et autres
Publié: (2024)
par: Xue, Fuzhao, et autres
Publié: (2024)
Domain-Adaptive Model Merging Across Disconnected Modes
par: Liu, Junming, et autres
Publié: (2026)
par: Liu, Junming, et autres
Publié: (2026)
The intelligent prediction and assessment of financial information risk in the cloud computing model
par: Wang, Yufu, et autres
Publié: (2024)
par: Wang, Yufu, et autres
Publié: (2024)
Loss- and Reward-Weighting for Efficient Distributed Reinforcement Learning
par: Holen, Martin, et autres
Publié: (2023)
par: Holen, Martin, et autres
Publié: (2023)
Deep Reinforcement Learning for System-on-Chip: Myths and Realities
par: Sung, Tegg Taekyong, et autres
Publié: (2022)
par: Sung, Tegg Taekyong, et autres
Publié: (2022)
Interpretable Modeling of Deep Reinforcement Learning Driven Scheduling
par: Li, Boyang, et autres
Publié: (2024)
par: Li, Boyang, et autres
Publié: (2024)
Tesserae: Scalable Placement Policies for Deep Learning Workloads
par: Bian, Song, et autres
Publié: (2025)
par: Bian, Song, et autres
Publié: (2025)
Collaborative Split Federated Learning with Parallel Training and Aggregation
par: Papageorgiou, Yiannis, et autres
Publié: (2025)
par: Papageorgiou, Yiannis, et autres
Publié: (2025)
Sentinel: An Aggregation Function to Secure Decentralized Federated Learning
par: Feng, Chao, et autres
Publié: (2023)
par: Feng, Chao, et autres
Publié: (2023)
Documents similaires
-
SRL: Scaling Distributed Reinforcement Learning to Over Ten Thousand Cores
par: Mei, Zhiyu, et autres
Publié: (2023) -
ARL-Tangram: Unleash the Resource Efficiency in Agentic Reinforcement Learning
par: Xiao, Bangjun, et autres
Publié: (2026) -
Scepsy: Serving Agentic Workflows Using Aggregate LLM Pipelines
par: Wagenländer, Marcel, et autres
Publié: (2026) -
Mesh-Attention: A New Communication-Efficient Distributed Attention with Improved Data Locality
par: Chen, Sirui, et autres
Publié: (2025) -
LogAct: Enabling Agentic Reliability via Shared Logs
par: Balakrishnan, Mahesh, et autres
Publié: (2026)