Convergence of Distributionally Robust Q-Learning with Linear Function Approximation
Fuente:
arXiv
Salvato in:
| Autori principali: | Mandal, Saptarshi, Murthy, Yashaswini, Srikant, R. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Fusing Rewards and Preferences in Reinforcement Learning
di: Khorasani, Sadegh, et al.
Pubblicazione: (2025)
di: Khorasani, Sadegh, et al.
Pubblicazione: (2025)
Universal Approximation of Continuous Functionals on Compact Subsets via Linear Measurements and Scalar Nonlinearities
di: Krylov, Andrey, et al.
Pubblicazione: (2026)
di: Krylov, Andrey, et al.
Pubblicazione: (2026)
Learning Can Converge Stably to the Wrong Belief under Latent Reliability
di: Zhang, Zhipeng, et al.
Pubblicazione: (2026)
di: Zhang, Zhipeng, et al.
Pubblicazione: (2026)
2Mamba2Furious: Linear in Complexity, Competitive in Accuracy
di: Mongaras, Gabriel, et al.
Pubblicazione: (2026)
di: Mongaras, Gabriel, et al.
Pubblicazione: (2026)
Implicit Counterfactual Data Augmentation for Robust Learning
di: Zhou, Xiaoling, et al.
Pubblicazione: (2023)
di: Zhou, Xiaoling, et al.
Pubblicazione: (2023)
Hierarchical Universal Value Function Approximators
di: Arora, Rushiv
Pubblicazione: (2024)
di: Arora, Rushiv
Pubblicazione: (2024)
Symbol-Temporal Consistency Self-supervised Learning for Robust Time Series Classification
di: Garcia, Kevin, et al.
Pubblicazione: (2025)
di: Garcia, Kevin, et al.
Pubblicazione: (2025)
Composing Linear Layers from Irreducibles
di: Pence, Travis, et al.
Pubblicazione: (2025)
di: Pence, Travis, et al.
Pubblicazione: (2025)
ES-C51: Expected Sarsa Based C51 Distributional Reinforcement Learning Algorithm
di: Tandon, Rijul, et al.
Pubblicazione: (2025)
di: Tandon, Rijul, et al.
Pubblicazione: (2025)
Evaluating and Learning Robust Bandit Policies Under Uncertain Causal Mechanisms
di: Avery, Katherine, et al.
Pubblicazione: (2025)
di: Avery, Katherine, et al.
Pubblicazione: (2025)
Distributional Reinforcement Learning for Condition-Based Maintenance of Multi-Pump Equipment
di: Yasuno, Takato
Pubblicazione: (2026)
di: Yasuno, Takato
Pubblicazione: (2026)
New Paradigm of Adversarial Training: Releasing Accuracy-Robustness Trade-Off via Dummy Class
di: Wang, Yanyun, et al.
Pubblicazione: (2024)
di: Wang, Yanyun, et al.
Pubblicazione: (2024)
Learning Transferable Predictability Representations
di: Goswami, Diyali, et al.
Pubblicazione: (2026)
di: Goswami, Diyali, et al.
Pubblicazione: (2026)
Understanding Boolean Function Learnability on Deep Neural Networks: PAC Learning Meets Neurosymbolic Models
di: Nicolau, Marcio, et al.
Pubblicazione: (2020)
di: Nicolau, Marcio, et al.
Pubblicazione: (2020)
SQARL: A Size-Agnostic Reinforcement Learning approach for Circuit Allocation in Distributed Quantum Architectures
di: Carballo, Víctor, et al.
Pubblicazione: (2026)
di: Carballo, Víctor, et al.
Pubblicazione: (2026)
How Does the Pretraining Distribution Shape In-Context Learning? Task Selection, Generalization, and Robustness
di: Azizian, Waïss, et al.
Pubblicazione: (2025)
di: Azizian, Waïss, et al.
Pubblicazione: (2025)
Strengthening the Internal Adversarial Robustness in Lifted Neural Networks
di: Zach, Christopher
Pubblicazione: (2025)
di: Zach, Christopher
Pubblicazione: (2025)
How to Boost Any Loss Function
di: Nock, Richard, et al.
Pubblicazione: (2024)
di: Nock, Richard, et al.
Pubblicazione: (2024)
AI and Machine Learning Approaches for Predicting Nanoparticles Toxicity The Critical Role of Physiochemical Properties
di: Yousaf, Iqra
Pubblicazione: (2024)
di: Yousaf, Iqra
Pubblicazione: (2024)
Pruning Spurious Subgraphs for Graph Out-of-Distribution Generalization
di: Yao, Tianjun, et al.
Pubblicazione: (2025)
di: Yao, Tianjun, et al.
Pubblicazione: (2025)
Expressivity of Graph Neural Networks Through the Lens of Adversarial Robustness
di: Campi, Francesco, et al.
Pubblicazione: (2023)
di: Campi, Francesco, et al.
Pubblicazione: (2023)
BOND: License to Train with Black-Box Functions
di: Clark, Andrew, et al.
Pubblicazione: (2025)
di: Clark, Andrew, et al.
Pubblicazione: (2025)
Extrinsicaly Rewarded Soft Q Imitation Learning with Discriminator
di: Furuyama, Ryoma, et al.
Pubblicazione: (2024)
di: Furuyama, Ryoma, et al.
Pubblicazione: (2024)
RobustModelMaker: Coupling Bootstrap Stability Selection with Leakage-Safe Nested Cross-Validation for Scientific Machine Learning
di: Barnard, Amanda S
Pubblicazione: (2026)
di: Barnard, Amanda S
Pubblicazione: (2026)
Deep Memory Search: A Metaheuristic Approach for Optimizing Heuristic Search
di: Hedar, Abdel-Rahman, et al.
Pubblicazione: (2024)
di: Hedar, Abdel-Rahman, et al.
Pubblicazione: (2024)
Enhancing Classifier Evaluation: A Fairer Benchmarking Strategy Based on Ability and Robustness
di: Cardoso, Lucas, et al.
Pubblicazione: (2025)
di: Cardoso, Lucas, et al.
Pubblicazione: (2025)
RobustBlack: Challenging Black-Box Adversarial Attacks on State-of-the-Art Defenses
di: Djilani, Mohamed, et al.
Pubblicazione: (2024)
di: Djilani, Mohamed, et al.
Pubblicazione: (2024)
Adaptive Epsilon Adversarial Training for Robust Gravitational Wave Parameter Estimation Using Normalizing Flows
di: Yang, Yiqian, et al.
Pubblicazione: (2024)
di: Yang, Yiqian, et al.
Pubblicazione: (2024)
Beyond Monotonicity: Revisiting Factorization Principles in Multi-Agent Q-Learning
di: Hu, Tianmeng, et al.
Pubblicazione: (2025)
di: Hu, Tianmeng, et al.
Pubblicazione: (2025)
Symmetric Equilibrium Learning of VAEs
di: Flach, Boris, et al.
Pubblicazione: (2023)
di: Flach, Boris, et al.
Pubblicazione: (2023)
A Comparative Analysis of Reinforcement Learning and Conventional Deep Learning Approaches for Bearing Fault Diagnosis
di: Çakır, Efe, et al.
Pubblicazione: (2025)
di: Çakır, Efe, et al.
Pubblicazione: (2025)
Intervening to Learn and Compose Causally Disentangled Representations
di: Markham, Alex, et al.
Pubblicazione: (2025)
di: Markham, Alex, et al.
Pubblicazione: (2025)
Hierarchical Reinforcement Learning with Targeted Causal Interventions
di: Khorasani, Sadegh, et al.
Pubblicazione: (2025)
di: Khorasani, Sadegh, et al.
Pubblicazione: (2025)
Boosting gets full Attention for Relational Learning
di: Guillame-Bert, Mathieu, et al.
Pubblicazione: (2024)
di: Guillame-Bert, Mathieu, et al.
Pubblicazione: (2024)
Data-Incremental Continual Offline Reinforcement Learning
di: Gai, Sibo, et al.
Pubblicazione: (2024)
di: Gai, Sibo, et al.
Pubblicazione: (2024)
ZClassifier: Temperature Tuning and Manifold Approximation via KL Divergence on Logit Space
di: Yong, Shim Soon
Pubblicazione: (2025)
di: Yong, Shim Soon
Pubblicazione: (2025)
A Survey of Reinforcement Learning from Human Feedback
di: Kaufmann, Timo, et al.
Pubblicazione: (2023)
di: Kaufmann, Timo, et al.
Pubblicazione: (2023)
ArrowFlow: Hierarchical Machine Learning in the Space of Permutations
di: Yilmaz, Ozgur
Pubblicazione: (2026)
di: Yilmaz, Ozgur
Pubblicazione: (2026)
Trusted Multi-view Learning under Noisy Supervision
di: Zhang, Yilin, et al.
Pubblicazione: (2024)
di: Zhang, Yilin, et al.
Pubblicazione: (2024)
Empowering Graph Invariance Learning with Deep Spurious Infomax
di: Yao, Tianjun, et al.
Pubblicazione: (2024)
di: Yao, Tianjun, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Fusing Rewards and Preferences in Reinforcement Learning
di: Khorasani, Sadegh, et al.
Pubblicazione: (2025) -
Universal Approximation of Continuous Functionals on Compact Subsets via Linear Measurements and Scalar Nonlinearities
di: Krylov, Andrey, et al.
Pubblicazione: (2026) -
Learning Can Converge Stably to the Wrong Belief under Latent Reliability
di: Zhang, Zhipeng, et al.
Pubblicazione: (2026) -
2Mamba2Furious: Linear in Complexity, Competitive in Accuracy
di: Mongaras, Gabriel, et al.
Pubblicazione: (2026) -
Implicit Counterfactual Data Augmentation for Robust Learning
di: Zhou, Xiaoling, et al.
Pubblicazione: (2023)