Speeding up Policy Simulation in Supply Chain RL
Fuente:
arXiv
Salvato in:
| Autori principali: | Farias, Vivek, Gijsbrechts, Joren, Khojandi, Aryan, Peng, Tianyi, Zheng, Andrew |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
RL in the Wild: Characterizing RLVR Training in LLM Deployment
di: Zhou, Jiecheng, et al.
Pubblicazione: (2025)
di: Zhou, Jiecheng, et al.
Pubblicazione: (2025)
Laminar: A Scalable Asynchronous RL Post-Training Framework
di: Sheng, Guangming, et al.
Pubblicazione: (2025)
di: Sheng, Guangming, et al.
Pubblicazione: (2025)
VoltanaLLM: Feedback-Driven Frequency Control and State-Space Routing for Energy-Efficient LLM Serving
di: Yu, Jiahuan, et al.
Pubblicazione: (2025)
di: Yu, Jiahuan, et al.
Pubblicazione: (2025)
RollArt: Scaling Agentic RL Training via Disaggregated Infrastructure
di: Gao, Wei, et al.
Pubblicazione: (2025)
di: Gao, Wei, et al.
Pubblicazione: (2025)
Speed-up of Data Analysis with Kernel Trick in Encrypted Domain
di: Yoo, Joon Soo, et al.
Pubblicazione: (2024)
di: Yoo, Joon Soo, et al.
Pubblicazione: (2024)
Meta-Learning for Speeding Up Large Model Inference in Decentralized Environments
di: Yang, Yuzhe, et al.
Pubblicazione: (2024)
di: Yang, Yuzhe, et al.
Pubblicazione: (2024)
Taming the Long-Tail: Efficient Reasoning RL Training with Adaptive Drafter
di: Hu, Qinghao, et al.
Pubblicazione: (2025)
di: Hu, Qinghao, et al.
Pubblicazione: (2025)
Role-Based Fault Tolerance System for LLM RL Post-Training
di: Chen, Zhenqian, et al.
Pubblicazione: (2025)
di: Chen, Zhenqian, et al.
Pubblicazione: (2025)
A-3PO: Accelerating Asynchronous LLM Training with Staleness-aware Proximal Policy Approximation
di: Li, Xiaocan, et al.
Pubblicazione: (2025)
di: Li, Xiaocan, et al.
Pubblicazione: (2025)
SparseRL-Sync: Lossless Weight Synchronization with ~100x Less Communication
di: Hu, Lucas, et al.
Pubblicazione: (2026)
di: Hu, Lucas, et al.
Pubblicazione: (2026)
EdgeRL: Reinforcement Learning-driven Deep Learning Model Inference Optimization at Edge
di: Mounesan, Motahare, et al.
Pubblicazione: (2024)
di: Mounesan, Motahare, et al.
Pubblicazione: (2024)
Selective Knowledge Sharing for Personalized Federated Learning Under Capacity Heterogeneity
di: Wang, Zheng, et al.
Pubblicazione: (2024)
di: Wang, Zheng, et al.
Pubblicazione: (2024)
Scale-up Unlearnable Examples Learning with High-Performance Computing
di: Zhu, Yanfan, et al.
Pubblicazione: (2025)
di: Zhu, Yanfan, et al.
Pubblicazione: (2025)
Frontier: Simulating the Next Generation of LLM Inference Systems
di: Feng, Yicheng, et al.
Pubblicazione: (2025)
di: Feng, Yicheng, et al.
Pubblicazione: (2025)
Frontier: Towards Comprehensive and Accurate LLM Inference Simulation
di: Feng, Yicheng, et al.
Pubblicazione: (2026)
di: Feng, Yicheng, et al.
Pubblicazione: (2026)
GLow -- A Novel, Flower-Based Simulated Gossip Learning Strategy
di: Belenguer, Aitor, et al.
Pubblicazione: (2025)
di: Belenguer, Aitor, et al.
Pubblicazione: (2025)
UNIFERENCE: A Discrete Event Simulation Framework for Developing Distributed AI Models
di: Eldenk, Doğaç, et al.
Pubblicazione: (2026)
di: Eldenk, Doğaç, et al.
Pubblicazione: (2026)
FedSAC: Dynamic Submodel Allocation for Collaborative Fairness in Federated Learning
di: Wang, Zihui, et al.
Pubblicazione: (2024)
di: Wang, Zihui, et al.
Pubblicazione: (2024)
Speeding up Local Optimization in Vehicle Routing with Tensor-based GPU Acceleration
di: Lei, Zhenyu, et al.
Pubblicazione: (2025)
di: Lei, Zhenyu, et al.
Pubblicazione: (2025)
veScale-FSDP: Flexible and High-Performance FSDP at Scale
di: Wang, Zezhou, et al.
Pubblicazione: (2026)
di: Wang, Zezhou, et al.
Pubblicazione: (2026)
Acceleration for Deep Reinforcement Learning using Parallel and Distributed Computing: A Survey
di: Liu, Zhihong, et al.
Pubblicazione: (2024)
di: Liu, Zhihong, et al.
Pubblicazione: (2024)
Trans-XFed: An Explainable Federated Learning for Supply Chain Credit Assessment
di: Shi, Jie, et al.
Pubblicazione: (2025)
di: Shi, Jie, et al.
Pubblicazione: (2025)
Making Room for AI: Multi-GPU Molecular Dynamics with Deep Potentials in GROMACS
di: Pennati, Luca, et al.
Pubblicazione: (2026)
di: Pennati, Luca, et al.
Pubblicazione: (2026)
LLM-PQ: Serving LLM on Heterogeneous Clusters with Phase-Aware Partition and Adaptive Quantization
di: Zhao, Juntao, et al.
Pubblicazione: (2024)
di: Zhao, Juntao, et al.
Pubblicazione: (2024)
DistrEE: Distributed Early Exit of Deep Neural Network Inference on Edge Devices
di: Peng, Xian, et al.
Pubblicazione: (2025)
di: Peng, Xian, et al.
Pubblicazione: (2025)
Joint Model Assignment and Resource Allocation for Cost-Effective Mobile Generative Services
di: Gao, Shuangwei, et al.
Pubblicazione: (2024)
di: Gao, Shuangwei, et al.
Pubblicazione: (2024)
A Unified Convergence Analysis for Semi-Decentralized Learning: Sampled-to-Sampled vs. Sampled-to-All Communication
di: Rodio, Angelo, et al.
Pubblicazione: (2025)
di: Rodio, Angelo, et al.
Pubblicazione: (2025)
Efficient Training on Multiple Consumer GPUs with RoundPipe
di: Luo, Yibin, et al.
Pubblicazione: (2026)
di: Luo, Yibin, et al.
Pubblicazione: (2026)
LCFed: An Efficient Clustered Federated Learning Framework for Heterogeneous Data
di: Zhang, Yuxin, et al.
Pubblicazione: (2025)
di: Zhang, Yuxin, et al.
Pubblicazione: (2025)
HASFL: Heterogeneity-aware Split Federated Learning over Edge Computing Systems
di: Lin, Zheng, et al.
Pubblicazione: (2025)
di: Lin, Zheng, et al.
Pubblicazione: (2025)
Enhancing Kubernetes Automated Scheduling with Deep Learning and Reinforcement Techniques for Large-Scale Cloud Computing Optimization
di: Xu, Zheng, et al.
Pubblicazione: (2024)
di: Xu, Zheng, et al.
Pubblicazione: (2024)
Semantic Parallelism: Redefining Efficient MoE Inference via Model-Data Co-Scheduling
di: Li, Yan, et al.
Pubblicazione: (2025)
di: Li, Yan, et al.
Pubblicazione: (2025)
FedAC: An Adaptive Clustered Federated Learning Framework for Heterogeneous Data
di: Zhang, Yuxin, et al.
Pubblicazione: (2024)
di: Zhang, Yuxin, et al.
Pubblicazione: (2024)
FedMT: Federated Learning with Mixed-type Labels
di: Zhang, Qiong, et al.
Pubblicazione: (2022)
di: Zhang, Qiong, et al.
Pubblicazione: (2022)
Adaptive Execution Scheduler for DataDios SmartDiff
di: Poduri, Aryan
Pubblicazione: (2025)
di: Poduri, Aryan
Pubblicazione: (2025)
AdaptSFL: Adaptive Split Federated Learning in Resource-constrained Edge Networks
di: Lin, Zheng, et al.
Pubblicazione: (2024)
di: Lin, Zheng, et al.
Pubblicazione: (2024)
Comet: Fine-grained Computation-communication Overlapping for Mixture-of-Experts
di: Zhang, Shulai, et al.
Pubblicazione: (2025)
di: Zhang, Shulai, et al.
Pubblicazione: (2025)
SATER: A Self-Aware and Token-Efficient Approach to Routing and Cascading
di: Shen, Yuanzhe, et al.
Pubblicazione: (2025)
di: Shen, Yuanzhe, et al.
Pubblicazione: (2025)
Cloud Atlas: Efficient Fault Localization for Cloud Systems using Language Models and Causal Insight
di: Xie, Zhiqiang, et al.
Pubblicazione: (2024)
di: Xie, Zhiqiang, et al.
Pubblicazione: (2024)
FedSN: A Federated Learning Framework over Heterogeneous LEO Satellite Networks
di: Lin, Zheng, et al.
Pubblicazione: (2023)
di: Lin, Zheng, et al.
Pubblicazione: (2023)
Documenti analoghi
-
RL in the Wild: Characterizing RLVR Training in LLM Deployment
di: Zhou, Jiecheng, et al.
Pubblicazione: (2025) -
Laminar: A Scalable Asynchronous RL Post-Training Framework
di: Sheng, Guangming, et al.
Pubblicazione: (2025) -
VoltanaLLM: Feedback-Driven Frequency Control and State-Space Routing for Energy-Efficient LLM Serving
di: Yu, Jiahuan, et al.
Pubblicazione: (2025) -
RollArt: Scaling Agentic RL Training via Disaggregated Infrastructure
di: Gao, Wei, et al.
Pubblicazione: (2025) -
Speed-up of Data Analysis with Kernel Trick in Encrypted Domain
di: Yoo, Joon Soo, et al.
Pubblicazione: (2024)