DR-SAC: Distributionally Robust Soft Actor-Critic for Reinforcement Learning under Uncertainty
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Cui, Mingxuan, Zhou, Duo, Han, Yuxuan, Hanasusanto, Grani A., Wang, Qiong, Zhang, Huan, Zhou, Zhengyuan |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
A Distributionally Robust Optimization Approach to Quick Response Models under Demand Uncertainty
par: Papavassilopoulos, Panayotis P., et autres
Publié: (2025)
par: Papavassilopoulos, Panayotis P., et autres
Publié: (2025)
Sample Complexity of Data-driven Multistage Stochastic Programming under Markovian Uncertainty
par: Park, Hyuk, et autres
Publié: (2024)
par: Park, Hyuk, et autres
Publié: (2024)
Clip-and-Verify: Linear Constraint-Driven Domain Clipping for Accelerating Neural Network Verification
par: Zhou, Duo, et autres
Publié: (2025)
par: Zhou, Duo, et autres
Publié: (2025)
Scalable Neural Network Verification with Branch-and-bound Inferred Cutting Planes
par: Zhou, Duo, et autres
Publié: (2024)
par: Zhou, Duo, et autres
Publié: (2024)
Distributionally Robust Performative Optimization
par: Jia, Zhuangzhuang, et autres
Publié: (2024)
par: Jia, Zhuangzhuang, et autres
Publié: (2024)
Distributionally Robust Optimization with Decision-Dependent Information Discovery
par: Jin, Qing, et autres
Publié: (2024)
par: Jin, Qing, et autres
Publié: (2024)
Distributionally Fair Stochastic Optimization using Wasserstein Distance
par: Ye, Qing, et autres
Publié: (2024)
par: Ye, Qing, et autres
Publié: (2024)
Data-Driven Contextual Optimization with Gaussian Mixtures: Flow-Based Generalization, Robust Models, and Multistage Extensions
par: Yoon, YoungChul, et autres
Publié: (2025)
par: Yoon, YoungChul, et autres
Publié: (2025)
Generalization Bounds for Contextual Stochastic Optimization using Kernel Regression
par: Wang, Yijie, et autres
Publié: (2024)
par: Wang, Yijie, et autres
Publié: (2024)
On the Foundation of Distributionally Robust Reinforcement Learning
par: Wang, Shengbo, et autres
Publié: (2023)
par: Wang, Shengbo, et autres
Publié: (2023)
Learning Fair Policies for Infectious Diseases Mitigation using Path Integral Control
par: Jia, Zhuangzhuang, et autres
Publié: (2025)
par: Jia, Zhuangzhuang, et autres
Publié: (2025)
Learning an Optimal Assortment Policy under Observational Data
par: Han, Yuxuan, et autres
Publié: (2025)
par: Han, Yuxuan, et autres
Publié: (2025)
Adaptively Robust LLM Inference Optimization under Prediction Uncertainty
par: Chen, Zixi, et autres
Publié: (2025)
par: Chen, Zixi, et autres
Publié: (2025)
Multi-Robot Multi-Queue Control via Exhaustive Assignment Actor-Critic Learning
par: Merati, Mohammad, et autres
Publié: (2026)
par: Merati, Mohammad, et autres
Publié: (2026)
Robust Assortment Optimization from Observational Data
par: Lu, Miao, et autres
Publié: (2026)
par: Lu, Miao, et autres
Publié: (2026)
Soft Actor-Critic with Backstepping-Pretrained DeepONet for control of PDEs
par: Wang, Chenchen, et autres
Publié: (2025)
par: Wang, Chenchen, et autres
Publié: (2025)
Optimal Online and Offline Algorithms for Contextual MNL with Applications to Assortment and Pricing
par: Zhang, Yunfan, et autres
Publié: (2026)
par: Zhang, Yunfan, et autres
Publié: (2026)
Harnessing Unimodality in Semiparametric Contextual Pricing via Oracle Price Map Learning
par: Fan, Yingying, et autres
Publié: (2026)
par: Fan, Yingying, et autres
Publié: (2026)
Sample Complexity of Variance-reduced Distributionally Robust Q-learning
par: Wang, Shengbo, et autres
Publié: (2023)
par: Wang, Shengbo, et autres
Publié: (2023)
ACING: Actor-Critic for Instruction Learning in Black-Box LLMs
par: Kharrat, Salma, et autres
Publié: (2024)
par: Kharrat, Salma, et autres
Publié: (2024)
Robust Reinforcement Learning in Finance: Modeling Market Impact with Elliptic Uncertainty Sets
par: Ma, Shaocong, et autres
Publié: (2025)
par: Ma, Shaocong, et autres
Publié: (2025)
Adversarial Reinforcement Learning for Robust Control of Fixed-Wing Aircraft under Model Uncertainty
par: Marquis, Dennis J., et autres
Publié: (2025)
par: Marquis, Dennis J., et autres
Publié: (2025)
Nonconvex Stochastic Optimization under Heavy-Tailed Noises: Optimal Convergence without Gradient Clipping
par: Liu, Zijian, et autres
Publié: (2024)
par: Liu, Zijian, et autres
Publié: (2024)
U-OBCA: Uncertainty-Aware Optimization-Based Collision Avoidance via Wasserstein Distributionally Robust Chance Constraints
par: Wang, Zehao, et autres
Publié: (2026)
par: Wang, Zehao, et autres
Publié: (2026)
Actor-Critic Learning for Risk-Constrained Linear Quadratic Regulation
par: Li, Weijian, et autres
Publié: (2025)
par: Li, Weijian, et autres
Publié: (2025)
DSAC: Distributional Soft Actor-Critic for Risk-Sensitive Reinforcement Learning
par: Ma, Xiaoteng, et autres
Publié: (2020)
par: Ma, Xiaoteng, et autres
Publié: (2020)
Distributionally Robust Control with End-to-End Statistically Guaranteed Metric Learning
par: Wu, Jingyi, et autres
Publié: (2025)
par: Wu, Jingyi, et autres
Publié: (2025)
Natural Policy Gradient and Actor Critic Methods for Constrained Multi-Task Reinforcement Learning
par: Zeng, Sihan, et autres
Publié: (2024)
par: Zeng, Sihan, et autres
Publié: (2024)
Distributionally Robust Optimization for Chemotherapy Scheduling under Asymmetric and Multi-Modal Uncertainty
par: Zhu, Qing, et autres
Publié: (2025)
par: Zhu, Qing, et autres
Publié: (2025)
AI2STOW: End-to-End Deep Reinforcement Learning to Construct Master Stowage Plans under Demand Uncertainty
par: Van Twiller, Jaike, et autres
Publié: (2025)
par: Van Twiller, Jaike, et autres
Publié: (2025)
Safety-Aware Reinforcement Learning for Electric Vehicle Charging Station Management in Distribution Network
par: Fan, Jiarong, et autres
Publié: (2024)
par: Fan, Jiarong, et autres
Publié: (2024)
ART for Diffusion Sampling: A Reinforcement Learning Approach to Timestep Schedule
par: Huang, Yilie, et autres
Publié: (2026)
par: Huang, Yilie, et autres
Publié: (2026)
Deep Reinforcement Learning Optimization for Uncertain Nonlinear Systems via Event-Triggered Robust Adaptive Dynamic Programming
par: Bai, Ningwei, et autres
Publié: (2025)
par: Bai, Ningwei, et autres
Publié: (2025)
Deep Learning for Sequential Decision Making under Uncertainty: Foundations, Frameworks, and Frontiers
par: Buyuktahtakin, I. Esra
Publié: (2026)
par: Buyuktahtakin, I. Esra
Publié: (2026)
Data-Driven Exploration for a Class of Continuous-Time Indefinite Linear--Quadratic Reinforcement Learning Problems
par: Huang, Yilie, et autres
Publié: (2025)
par: Huang, Yilie, et autres
Publié: (2025)
Robust Control with Gradient Uncertainty
par: Qi, Qian
Publié: (2025)
par: Qi, Qian
Publié: (2025)
Q-Learning under Finite Model Uncertainty
par: Sester, Julian, et autres
Publié: (2024)
par: Sester, Julian, et autres
Publié: (2024)
Distributionally Robust Free Energy Principle for Decision-Making
par: Shafiei, Allahkaram, et autres
Publié: (2025)
par: Shafiei, Allahkaram, et autres
Publié: (2025)
Sublinear Regret for a Class of Continuous-Time Linear-Quadratic Reinforcement Learning Problems
par: Huang, Yilie, et autres
Publié: (2024)
par: Huang, Yilie, et autres
Publié: (2024)
Research on Optimal Control Problem Based on Reinforcement Learning under Knightian Uncertainty
par: Li, Ziyu, et autres
Publié: (2025)
par: Li, Ziyu, et autres
Publié: (2025)
Documents similaires
-
A Distributionally Robust Optimization Approach to Quick Response Models under Demand Uncertainty
par: Papavassilopoulos, Panayotis P., et autres
Publié: (2025) -
Sample Complexity of Data-driven Multistage Stochastic Programming under Markovian Uncertainty
par: Park, Hyuk, et autres
Publié: (2024) -
Clip-and-Verify: Linear Constraint-Driven Domain Clipping for Accelerating Neural Network Verification
par: Zhou, Duo, et autres
Publié: (2025) -
Scalable Neural Network Verification with Branch-and-bound Inferred Cutting Planes
par: Zhou, Duo, et autres
Publié: (2024) -
Distributionally Robust Performative Optimization
par: Jia, Zhuangzhuang, et autres
Publié: (2024)