Tabular and Deep Reinforcement Learning for Gittins Index
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Dhankhar, Harshit, Mishra, Kshitij, Bodas, Tejas |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
The Gittins Index: A Design Principle for Decision-Making Under Uncertainty
par: Scully, Ziv, et autres
Publié: (2025)
par: Scully, Ziv, et autres
Publié: (2025)
Greener Deep Reinforcement Learning: Analysis of Energy and Carbon Efficiency Across Atari Benchmarks
par: Gardner, Jason, et autres
Publié: (2025)
par: Gardner, Jason, et autres
Publié: (2025)
SynthEval: A Framework for Detailed Utility and Privacy Evaluation of Tabular Synthetic Data
par: Lautrup, Anton Danholt, et autres
Publié: (2024)
par: Lautrup, Anton Danholt, et autres
Publié: (2024)
Anatomizing Deep Learning Inference in Web Browsers
par: Wang, Qipeng, et autres
Publié: (2024)
par: Wang, Qipeng, et autres
Publié: (2024)
Efficient Reinforcement Learning for Routing Jobs in Heterogeneous Queueing Systems
par: Jali, Neharika, et autres
Publié: (2024)
par: Jali, Neharika, et autres
Publié: (2024)
Forecasting GPU Performance for Deep Learning Training and Inference
par: Lee, Seonho, et autres
Publié: (2024)
par: Lee, Seonho, et autres
Publié: (2024)
Sig2Model: A Boosting-Driven Model for Updatable Learned Indexes
par: Heidari, Alireza, et autres
Publié: (2025)
par: Heidari, Alireza, et autres
Publié: (2025)
Large-Scale Data Parallelization of Product Quantization and Inverted Indexing Using Dask
par: Abraham, Ashley N., et autres
Publié: (2026)
par: Abraham, Ashley N., et autres
Publié: (2026)
oneDNN Graph Compiler: A Hybrid Approach for High-Performance Deep Learning Compilation
par: Li, Jianhui, et autres
Publié: (2023)
par: Li, Jianhui, et autres
Publié: (2023)
DeepSpeed-FastGen: High-throughput Text Generation for LLMs via MII and DeepSpeed-Inference
par: Holmes, Connor, et autres
Publié: (2024)
par: Holmes, Connor, et autres
Publié: (2024)
Rapid Augmentations for Time Series (RATS): A High-Performance Library for Time Series Augmentation
par: Skaf, Wadie, et autres
Publié: (2026)
par: Skaf, Wadie, et autres
Publié: (2026)
Memory Analysis on the Training Course of DeepSeek Models
par: Zhang, Ping, et autres
Publié: (2025)
par: Zhang, Ping, et autres
Publié: (2025)
P-MOSS: Scheduling Main-Memory Indexes Over NUMA Servers Using Next Token Prediction
par: Rayhan, Yeasir, et autres
Publié: (2024)
par: Rayhan, Yeasir, et autres
Publié: (2024)
When Does the Gittins Policy Have Asymptotically Optimal Response Time Tail?
par: Scully, Ziv, et autres
Publié: (2021)
par: Scully, Ziv, et autres
Publié: (2021)
Offline Reinforcement-Learning-Based Power Control for Application-Agnostic Energy Efficiency
par: Raj, Akhilesh, et autres
Publié: (2026)
par: Raj, Akhilesh, et autres
Publié: (2026)
ALERT: Accurate Learning for Energy and Timeliness
par: Wan, Chengcheng, et autres
Publié: (2019)
par: Wan, Chengcheng, et autres
Publié: (2019)
Bayesian Optimization for Dynamic Pricing and Learning
par: Anand, Anush, et autres
Publié: (2025)
par: Anand, Anush, et autres
Publié: (2025)
ASI: Accuracy-Stability Index for Evaluating Deep Learning Models
par: Dai, Wei, et autres
Publié: (2023)
par: Dai, Wei, et autres
Publié: (2023)
A Structure-Aware Framework for Learning Device Placements on Computation Graphs
par: Duan, Shukai, et autres
Publié: (2024)
par: Duan, Shukai, et autres
Publié: (2024)
PrETi: Predicting Execution Time in Early Stage with LLVM and Machine Learning
par: Xu, Risheng, et autres
Publié: (2025)
par: Xu, Risheng, et autres
Publié: (2025)
PixelBrax: Learning Continuous Control from Pixels End-to-End on the GPU
par: McInroe, Trevor, et autres
Publié: (2025)
par: McInroe, Trevor, et autres
Publié: (2025)
Cloud Computing Energy Consumption Prediction Based on Kernel Extreme Learning Machine Algorithm Improved by Vector Weighted Average Algorithm
par: Wang, Yuqing, et autres
Publié: (2025)
par: Wang, Yuqing, et autres
Publié: (2025)
DeepGD: A Multi-Objective Black-Box Test Selection Approach for Deep Neural Networks
par: Aghababaeyan, Zohreh, et autres
Publié: (2023)
par: Aghababaeyan, Zohreh, et autres
Publié: (2023)
Machine Learning Models for Reinforced Concrete Pipes Condition Prediction: The State-of-the-Art Using Artificial Neural Networks and Multiple Linear Regression in a Wisconsin Case Study
par: Mohammadagha, Mohsen, et autres
Publié: (2025)
par: Mohammadagha, Mohsen, et autres
Publié: (2025)
GPU Cluster Scheduling for Network-Sensitive Deep Learning
par: Sharma, Aakash, et autres
Publié: (2024)
par: Sharma, Aakash, et autres
Publié: (2024)
Design Space Exploration of Approximate Computing Techniques with a Reinforcement Learning Approach
par: Saeedi, Sepide, et autres
Publié: (2023)
par: Saeedi, Sepide, et autres
Publié: (2023)
USEFUSE: Uniform Stride for Enhanced Performance in Fused Layer Architecture of Deep Neural Networks
par: Ibrahim, Muhammad Sohail, et autres
Publié: (2024)
par: Ibrahim, Muhammad Sohail, et autres
Publié: (2024)
Towards A Flexible Accuracy-Oriented Deep Learning Module Inference Latency Prediction Framework for Adaptive Optimization Algorithms
par: Shen, Jingran, et autres
Publié: (2023)
par: Shen, Jingran, et autres
Publié: (2023)
Cost-aware Bayesian Optimization via the Pandora's Box Gittins Index
par: Xie, Qian, et autres
Publié: (2024)
par: Xie, Qian, et autres
Publié: (2024)
Enhancing Energy-Awareness in Deep Learning through Fine-Grained Energy Measurement
par: Rajput, Saurabhsingh, et autres
Publié: (2023)
par: Rajput, Saurabhsingh, et autres
Publié: (2023)
A Scalable k-Medoids Clustering via Whale Optimization Algorithm
par: Chenan, Huang, et autres
Publié: (2024)
par: Chenan, Huang, et autres
Publié: (2024)
Parallel Implementations Assessment of a Spatial-Spectral Classifier for Hyperspectral Clinical Applications
par: Lazcano, Raquel, et autres
Publié: (2024)
par: Lazcano, Raquel, et autres
Publié: (2024)
Automating Energy-Efficient GPU Kernel Generation: A Fast Search-Based Compilation Approach
par: Zhang, Yijia, et autres
Publié: (2024)
par: Zhang, Yijia, et autres
Publié: (2024)
Plug-and-Play Performance Estimation for LLM Services without Relying on Labeled Data
par: Wang, Can, et autres
Publié: (2024)
par: Wang, Can, et autres
Publié: (2024)
SAfEPaTh: A System-Level Approach for Efficient Power and Thermal Estimation of Convolutional Neural Network Accelerator
par: Chen, Yukai, et autres
Publié: (2024)
par: Chen, Yukai, et autres
Publié: (2024)
Towards an Integrated Performance Framework for Fire Science and Management Workflows
par: Ahmed, H., et autres
Publié: (2024)
par: Ahmed, H., et autres
Publié: (2024)
Application Research On Real-Time Perception Of Device Performance Status
par: Wang, Zhe, et autres
Publié: (2024)
par: Wang, Zhe, et autres
Publié: (2024)
CEBench: A Benchmarking Toolkit for the Cost-Effectiveness of LLM Pipelines
par: Sun, Wenbo, et autres
Publié: (2024)
par: Sun, Wenbo, et autres
Publié: (2024)
RWKV-edge: Deeply Compressed RWKV for Resource-Constrained Devices
par: Choe, Wonkyo, et autres
Publié: (2024)
par: Choe, Wonkyo, et autres
Publié: (2024)
MoE-Infinity: Efficient MoE Inference on Personal Machines with Sparsity-Aware Expert Cache
par: Xue, Leyang, et autres
Publié: (2024)
par: Xue, Leyang, et autres
Publié: (2024)
Documents similaires
-
The Gittins Index: A Design Principle for Decision-Making Under Uncertainty
par: Scully, Ziv, et autres
Publié: (2025) -
Greener Deep Reinforcement Learning: Analysis of Energy and Carbon Efficiency Across Atari Benchmarks
par: Gardner, Jason, et autres
Publié: (2025) -
SynthEval: A Framework for Detailed Utility and Privacy Evaluation of Tabular Synthetic Data
par: Lautrup, Anton Danholt, et autres
Publié: (2024) -
Anatomizing Deep Learning Inference in Web Browsers
par: Wang, Qipeng, et autres
Publié: (2024) -
Efficient Reinforcement Learning for Routing Jobs in Heterogeneous Queueing Systems
par: Jali, Neharika, et autres
Publié: (2024)