Enregistré dans:
| Auteurs principaux: | Deshkar, Gaurav, Kshirsagar, Jayanta, Hayatnagarkar, Harshal, Venugopalan, Janani |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2304.04475 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Domain-driven Metrics for Reinforcement Learning: A Case Study on Epidemic Control using Agent-based Simulation
par: Gaur, Rishabh, et autres
Publié: (2025)
par: Gaur, Rishabh, et autres
Publié: (2025)
Model Free Deep Deterministic Policy Gradient Controller for Setpoint Tracking of Non-minimum Phase Systems
par: Tavakkoli, Fatemeh, et autres
Publié: (2024)
par: Tavakkoli, Fatemeh, et autres
Publié: (2024)
Policy Gradient-Based EMT-in-the-Loop Learning to Mitigate Sub-Synchronous Control Interactions
par: Mukherjee, Sayak, et autres
Publié: (2025)
par: Mukherjee, Sayak, et autres
Publié: (2025)
Hierarchical Policy-Gradient Reinforcement Learning for Multi-Agent Shepherding Control of Non-Cohesive Targets
par: Covone, Stefano, et autres
Publié: (2025)
par: Covone, Stefano, et autres
Publié: (2025)
Adaptive Event-Triggered Policy Gradient for Multi-Agent Reinforcement Learning
par: Siddique, Umer, et autres
Publié: (2025)
par: Siddique, Umer, et autres
Publié: (2025)
Simulation-Based Optimistic Policy Iteration For Multi-Agent MDPs with Kullback-Leibler Control Cost
par: Nakhleh, Khaled, et autres
Publié: (2024)
par: Nakhleh, Khaled, et autres
Publié: (2024)
Optimal Control-Based Baseline for Guided Exploration in Policy Gradient Methods
par: Lyu, Xubo, et autres
Publié: (2020)
par: Lyu, Xubo, et autres
Publié: (2020)
Revisiting LQR Control from the Perspective of Receding-Horizon Policy Gradient
par: Zhang, Xiangyuan, et autres
Publié: (2023)
par: Zhang, Xiangyuan, et autres
Publié: (2023)
Combining Large Language Models and Gradient-Free Optimization for Automatic Control Policy Synthesis
par: Bosio, Carlo, et autres
Publié: (2025)
par: Bosio, Carlo, et autres
Publié: (2025)
Synthesizing Interpretable Control Policies through Large Language Model Guided Search
par: Bosio, Carlo, et autres
Publié: (2024)
par: Bosio, Carlo, et autres
Publié: (2024)
DeepSafeMPC: Deep Learning-Based Model Predictive Control for Safe Multi-Agent Reinforcement Learning
par: Wang, Xuefeng, et autres
Publié: (2024)
par: Wang, Xuefeng, et autres
Publié: (2024)
Solving Reach-Avoid-Stay Problems Using Deep Deterministic Policy Gradients
par: Chenevert, Gabriel, et autres
Publié: (2024)
par: Chenevert, Gabriel, et autres
Publié: (2024)
Fixed time convergence guarantees for Higher Order Control Barrier Functions
par: K, Janani S, et autres
Publié: (2025)
par: K, Janani S, et autres
Publié: (2025)
Implicit Bias of Policy Gradient in Linear Quadratic Control: Extrapolation to Unseen Initial States
par: Razin, Noam, et autres
Publié: (2024)
par: Razin, Noam, et autres
Publié: (2024)
PseudoAct: Leveraging Pseudocode Synthesis for Flexible Planning and Action Control in Large Language Model Agents
par: Yihan, et autres
Publié: (2026)
par: Yihan, et autres
Publié: (2026)
Joint Optimization of Multi-Objective Reinforcement Learning with Policy Gradient Based Algorithm
par: Bai, Qinbo, et autres
Publié: (2021)
par: Bai, Qinbo, et autres
Publié: (2021)
Deep Policy Gradient Methods Without Batch Updates, Target Networks, or Replay Buffers
par: Vasan, Gautham, et autres
Publié: (2024)
par: Vasan, Gautham, et autres
Publié: (2024)
Model-Free Load Frequency Control of Nonlinear Power Systems Based on Deep Reinforcement Learning
par: Chen, Xiaodi, et autres
Publié: (2024)
par: Chen, Xiaodi, et autres
Publié: (2024)
Control Industrial Automation System with Large Language Model Agents
par: Xia, Yuchen, et autres
Publié: (2024)
par: Xia, Yuchen, et autres
Publié: (2024)
Sample-Efficient Reinforcement Learning Controller for Deep Brain Stimulation in Parkinson's Disease
par: Ravivarapu, Harsh, et autres
Publié: (2025)
par: Ravivarapu, Harsh, et autres
Publié: (2025)
Modelling, Positioning, and Deep Reinforcement Learning Path Tracking Control of Scaled Robotic Vehicles: Design and Experimental Validation
par: Caponio, Carmine, et autres
Publié: (2024)
par: Caponio, Carmine, et autres
Publié: (2024)
Policy Optimization for PDE Control with a Warm Start
par: Zhang, Xiangyuan, et autres
Publié: (2024)
par: Zhang, Xiangyuan, et autres
Publié: (2024)
Gradient Estimation and Variance Reduction in Stochastic and Deterministic Models
par: Keane, Ronan
Publié: (2024)
par: Keane, Ronan
Publié: (2024)
Network Epidemic Control via Model Predictive Control: Extended Version
par: Talaei, Mahtab, et autres
Publié: (2026)
par: Talaei, Mahtab, et autres
Publié: (2026)
Beyond Conservative Automated Driving in Multi-Agent Scenarios via Coupled Model Predictive Control and Deep Reinforcement Learning
par: Rahmani, Saeed, et autres
Publié: (2026)
par: Rahmani, Saeed, et autres
Publié: (2026)
Stabilizing Policy Gradient Methods via Reward Profiling
par: Ahmed, Shihab, et autres
Publié: (2025)
par: Ahmed, Shihab, et autres
Publié: (2025)
Optimal Control of Behavioral-Feedback SIR Epidemic Model
par: Alutto, Martina, et autres
Publié: (2025)
par: Alutto, Martina, et autres
Publié: (2025)
EnergAIze: Multi Agent Deep Deterministic Policy Gradient for Vehicle to Grid Energy Management
par: Fonseca, Tiago, et autres
Publié: (2024)
par: Fonseca, Tiago, et autres
Publié: (2024)
Towards Safe Reinforcement Learning Using NMPC and Policy Gradients: Part II - Deterministic Case
par: Gros, Sebastien, et autres
Publié: (2019)
par: Gros, Sebastien, et autres
Publié: (2019)
Deep Koopman-based Control of Quality Variation in Multistage Manufacturing Systems
par: Chen, Zhiyi, et autres
Publié: (2024)
par: Chen, Zhiyi, et autres
Publié: (2024)
Hierarchical Analysis and Control of Epidemic Spreading over Networks using Dissipativity and Mesh Stability
par: Welikala, Shirantha, et autres
Publié: (2025)
par: Welikala, Shirantha, et autres
Publié: (2025)
A Twin Delayed Deep Deterministic Policy Gradient Algorithm for Autonomous Ground Vehicle Navigation via Digital Twin Perception Awareness
par: Olayemi, Kabirat, et autres
Publié: (2024)
par: Olayemi, Kabirat, et autres
Publié: (2024)
Grid-Agent: An LLM-Powered Multi-Agent System for Power Grid Control
par: Zhang, Yan, et autres
Publié: (2025)
par: Zhang, Yan, et autres
Publié: (2025)
Explaining Control Policies through Predicate Decision Diagrams
par: Chakraborty, Debraj, et autres
Publié: (2025)
par: Chakraborty, Debraj, et autres
Publié: (2025)
Optimal Control of an Epidemic with Intervention Design
par: Ramezanzadeh, Behrooz Moosavi
Publié: (2025)
par: Ramezanzadeh, Behrooz Moosavi
Publié: (2025)
The Responsibility Vacuum: Organizational Failure in Scaled Agent Systems
par: Romanchuk, Oleg, et autres
Publié: (2026)
par: Romanchuk, Oleg, et autres
Publié: (2026)
Network-Based Epidemic Control Through Optimal Travel and Quarantine Management
par: Talaei, Mahtab, et autres
Publié: (2024)
par: Talaei, Mahtab, et autres
Publié: (2024)
DiffOP: Reinforcement Learning of Optimization-Based Control Policies via Implicit Policy Gradients
par: Bian, Yuexin, et autres
Publié: (2024)
par: Bian, Yuexin, et autres
Publié: (2024)
Model-Free Learning and Optimal Policy Design in Multi-Agent MDPs Under Probabilistic Agent Dropout
par: Fiscko, Carmel, et autres
Publié: (2023)
par: Fiscko, Carmel, et autres
Publié: (2023)
Receding-Horizon Policy Gradient for Polytopic Controller Synthesis
par: Shakeri, Shiva, et autres
Publié: (2026)
par: Shakeri, Shiva, et autres
Publié: (2026)
Documents similaires
-
Domain-driven Metrics for Reinforcement Learning: A Case Study on Epidemic Control using Agent-based Simulation
par: Gaur, Rishabh, et autres
Publié: (2025) -
Model Free Deep Deterministic Policy Gradient Controller for Setpoint Tracking of Non-minimum Phase Systems
par: Tavakkoli, Fatemeh, et autres
Publié: (2024) -
Policy Gradient-Based EMT-in-the-Loop Learning to Mitigate Sub-Synchronous Control Interactions
par: Mukherjee, Sayak, et autres
Publié: (2025) -
Hierarchical Policy-Gradient Reinforcement Learning for Multi-Agent Shepherding Control of Non-Cohesive Targets
par: Covone, Stefano, et autres
Publié: (2025) -
Adaptive Event-Triggered Policy Gradient for Multi-Agent Reinforcement Learning
par: Siddique, Umer, et autres
Publié: (2025)