Structured Reinforcement Learning for Media Streaming at the Wireless Edge
Fuente:
arXiv
Salvato in:
| Autori principali: | Bura, Archana, Bobbili, Sarat Chandra, Rameshkumar, Shreyas, Rengarajan, Desik, Kalathil, Dileep, Shakkottai, Srinivas |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Federated Ensemble-Directed Offline Reinforcement Learning
di: Rengarajan, Desik, et al.
Pubblicazione: (2023)
di: Rengarajan, Desik, et al.
Pubblicazione: (2023)
PITA: Preference-Guided Inference-Time Alignment for LLM Post-Training
di: Bobbili, Sarat Chandra, et al.
Pubblicazione: (2025)
di: Bobbili, Sarat Chandra, et al.
Pubblicazione: (2025)
Optimistic World Models: Efficient Exploration in Model-Based Deep Reinforcement Learning
di: Mete, Akshay, et al.
Pubblicazione: (2026)
di: Mete, Akshay, et al.
Pubblicazione: (2026)
Windex: Realtime Neural Whittle Indexing for Scalable Service Guarantees in NextG Cellular Networks
di: Bura, Archana, et al.
Pubblicazione: (2024)
di: Bura, Archana, et al.
Pubblicazione: (2024)
Hierarchical Multi-Agent Framework for Carbon-Efficient Liquid-Cooled Data Center Clusters
di: Sarkar, Soumyendu, et al.
Pubblicazione: (2025)
di: Sarkar, Soumyendu, et al.
Pubblicazione: (2025)
SustainDC: Benchmarking for Sustainable Data Center Control
di: Naug, Avisek, et al.
Pubblicazione: (2024)
di: Naug, Avisek, et al.
Pubblicazione: (2024)
Risk-Averse Finetuning of Large Language Models
di: Chaudhary, Sapana, et al.
Pubblicazione: (2025)
di: Chaudhary, Sapana, et al.
Pubblicazione: (2025)
To Train or Not to Train: Balancing Efficiency and Training Cost in Deep Reinforcement Learning for Mobile Edge Computing
di: Boscaro, Maddalena, et al.
Pubblicazione: (2024)
di: Boscaro, Maddalena, et al.
Pubblicazione: (2024)
PowerMamba: A Deep State Space Model and Comprehensive Benchmark for Time Series Prediction in Electric Power Systems
di: Menati, Ali, et al.
Pubblicazione: (2024)
di: Menati, Ali, et al.
Pubblicazione: (2024)
MAVIS: Multi-Objective Alignment via Inference-Time Value-Guided Selection
di: Carleton, Jeremy, et al.
Pubblicazione: (2025)
di: Carleton, Jeremy, et al.
Pubblicazione: (2025)
Inverse Delayed Reinforcement Learning
di: Zhan, Simon Sinong, et al.
Pubblicazione: (2024)
di: Zhan, Simon Sinong, et al.
Pubblicazione: (2024)
Faster Reinforcement Learning by Freezing Slow States
di: Wang, Yijia, et al.
Pubblicazione: (2023)
di: Wang, Yijia, et al.
Pubblicazione: (2023)
Novelty Detection in Reinforcement Learning with World Models
di: Zollicoffer, Geigh, et al.
Pubblicazione: (2023)
di: Zollicoffer, Geigh, et al.
Pubblicazione: (2023)
Risk-Sensitive Reinforcement Learning with Exponential Criteria
di: Noorani, Erfaun, et al.
Pubblicazione: (2022)
di: Noorani, Erfaun, et al.
Pubblicazione: (2022)
Reinforcement Learning with Partial Parametric Model Knowledge
di: Wang, Shuyuan, et al.
Pubblicazione: (2023)
di: Wang, Shuyuan, et al.
Pubblicazione: (2023)
Learning Hidden Subgoals under Temporal Ordering Constraints in Reinforcement Learning
di: Xu, Duo, et al.
Pubblicazione: (2024)
di: Xu, Duo, et al.
Pubblicazione: (2024)
Temporal Difference Learning with Compressed Updates: Error-Feedback meets Reinforcement Learning
di: Mitra, Aritra, et al.
Pubblicazione: (2023)
di: Mitra, Aritra, et al.
Pubblicazione: (2023)
Approximate Model-Based Shielding for Safe Reinforcement Learning
di: Goodall, Alexander W., et al.
Pubblicazione: (2023)
di: Goodall, Alexander W., et al.
Pubblicazione: (2023)
Meta-Reinforcement Learning for Building Energy Management System
di: Zhang, Huiliang, et al.
Pubblicazione: (2022)
di: Zhang, Huiliang, et al.
Pubblicazione: (2022)
Action Mapping for Reinforcement Learning in Continuous Environments with Constraints
di: Theile, Mirco, et al.
Pubblicazione: (2024)
di: Theile, Mirco, et al.
Pubblicazione: (2024)
Constrained Reinforcement Learning for Safe Heat Pump Control
di: Zhang, Baohe, et al.
Pubblicazione: (2024)
di: Zhang, Baohe, et al.
Pubblicazione: (2024)
Constrained Reinforcement Learning with Smoothed Log Barrier Function
di: Zhang, Baohe, et al.
Pubblicazione: (2024)
di: Zhang, Baohe, et al.
Pubblicazione: (2024)
Oracle-Efficient Reinforcement Learning for Max Value Ensembles
di: Hussing, Marcel, et al.
Pubblicazione: (2024)
di: Hussing, Marcel, et al.
Pubblicazione: (2024)
Improving Mixed-Criticality Scheduling with Reinforcement Learning
di: El-Mahdy, Muhammad, et al.
Pubblicazione: (2025)
di: El-Mahdy, Muhammad, et al.
Pubblicazione: (2025)
Continual Reinforcement Learning for HVAC Systems Control: Integrating Hypernetworks and Transfer Learning
di: Bekal, Gautham Udayakumar, et al.
Pubblicazione: (2025)
di: Bekal, Gautham Udayakumar, et al.
Pubblicazione: (2025)
Facilitating Reinforcement Learning for Process Control Using Transfer Learning: Overview and Perspectives
di: Lin, Runze, et al.
Pubblicazione: (2024)
di: Lin, Runze, et al.
Pubblicazione: (2024)
ReLMXEL: Adaptive RL-Based Memory Controller with Explainable Energy and Latency Optimization
di: Sai, Panuganti Chirag, et al.
Pubblicazione: (2026)
di: Sai, Panuganti Chirag, et al.
Pubblicazione: (2026)
Action Dependency Graphs for Globally Optimal Coordinated Reinforcement Learning
di: Ding, Jianglin, et al.
Pubblicazione: (2025)
di: Ding, Jianglin, et al.
Pubblicazione: (2025)
On-Meter Graph Machine Learning: A Case Study of PV Power Forecasting for Grid Edge Intelligence
di: Huang, Jian, et al.
Pubblicazione: (2026)
di: Huang, Jian, et al.
Pubblicazione: (2026)
Synthesis of Model Predictive Control and Reinforcement Learning: Survey and Classification
di: Reiter, Rudolf, et al.
Pubblicazione: (2025)
di: Reiter, Rudolf, et al.
Pubblicazione: (2025)
Integrating Reinforcement Learning and Model Predictive Control with Applications to Microgrids
di: da Silva, Caio Fabio Oliveira, et al.
Pubblicazione: (2024)
di: da Silva, Caio Fabio Oliveira, et al.
Pubblicazione: (2024)
Offline Reinforcement Learning and Sequence Modeling for Downlink Link Adaptation
di: Peri, Samuele, et al.
Pubblicazione: (2024)
di: Peri, Samuele, et al.
Pubblicazione: (2024)
Safe Deep Model-Based Reinforcement Learning with Lyapunov Functions
di: Zhang, Harry
Pubblicazione: (2024)
di: Zhang, Harry
Pubblicazione: (2024)
Predictable Reinforcement Learning Dynamics through Entropy Rate Minimization
di: Ornia, Daniel Jarne, et al.
Pubblicazione: (2023)
di: Ornia, Daniel Jarne, et al.
Pubblicazione: (2023)
Multi-Objective Reinforcement Learning for Power Grid Topology Control
di: Lautenbacher, Thomas, et al.
Pubblicazione: (2025)
di: Lautenbacher, Thomas, et al.
Pubblicazione: (2025)
ART for Diffusion Sampling: A Reinforcement Learning Approach to Timestep Schedule
di: Huang, Yilie, et al.
Pubblicazione: (2026)
di: Huang, Yilie, et al.
Pubblicazione: (2026)
CORL: Reinforcement Learning of MILP Policies Solved via Branch and Bound
di: Anand, Akhil S, et al.
Pubblicazione: (2025)
di: Anand, Akhil S, et al.
Pubblicazione: (2025)
The Pump Scheduling Problem: A Real-World Scenario for Reinforcement Learning
di: Donâncio, Henrique, et al.
Pubblicazione: (2022)
di: Donâncio, Henrique, et al.
Pubblicazione: (2022)
End-to-End Reinforcement Learning of Curative Curtailment with Partial Measurement Availability
di: Wolf, Hinrikus, et al.
Pubblicazione: (2024)
di: Wolf, Hinrikus, et al.
Pubblicazione: (2024)
Function Approximation for Reinforcement Learning Controller for Energy from Spread Waves
di: Sarkar, Soumyendu, et al.
Pubblicazione: (2024)
di: Sarkar, Soumyendu, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Federated Ensemble-Directed Offline Reinforcement Learning
di: Rengarajan, Desik, et al.
Pubblicazione: (2023) -
PITA: Preference-Guided Inference-Time Alignment for LLM Post-Training
di: Bobbili, Sarat Chandra, et al.
Pubblicazione: (2025) -
Optimistic World Models: Efficient Exploration in Model-Based Deep Reinforcement Learning
di: Mete, Akshay, et al.
Pubblicazione: (2026) -
Windex: Realtime Neural Whittle Indexing for Scalable Service Guarantees in NextG Cellular Networks
di: Bura, Archana, et al.
Pubblicazione: (2024) -
Hierarchical Multi-Agent Framework for Carbon-Efficient Liquid-Cooled Data Center Clusters
di: Sarkar, Soumyendu, et al.
Pubblicazione: (2025)