Generalized Random Direction Newton Algorithms for Stochastic Optimization
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Pachal, Soumen, A., Prashanth L., Bhatnagar, Shalabh, Achar, Avinash |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Public Transit Arrival Prediction: a Seq2Seq RNN Approach
par: Bhutani, Nancy, et autres
Publié: (2022)
par: Bhutani, Nancy, et autres
Publié: (2022)
Policy Newton methods for Distortion Riskmetrics
par: Pachal, Soumen, et autres
Publié: (2025)
par: Pachal, Soumen, et autres
Publié: (2025)
Finite-time analysis of Multi-timescale Stochastic Optimization Algorithms
par: Kartikey, Kaustubh, et autres
Publié: (2026)
par: Kartikey, Kaustubh, et autres
Publié: (2026)
Convergent Reinforcement Learning Algorithms for Stochastic Shortest Path Problem
par: Guin, Soumyajit, et autres
Publié: (2025)
par: Guin, Soumyajit, et autres
Publié: (2025)
Finite-Time Analysis of Three-Timescale Constrained Actor-Critic and Constrained Natural Actor-Critic Algorithms
par: Panda, Prashansa, et autres
Publié: (2023)
par: Panda, Prashansa, et autres
Publié: (2023)
Finite Time Analysis of Constrained Natural Critic-Actor Algorithm with Improved Sample Complexity
par: Panda, Prashansa, et autres
Publié: (2025)
par: Panda, Prashansa, et autres
Publié: (2025)
Risk-sensitive reinforcement learning using expectiles, shortfall risk and optimized certainty equivalent risk
par: Gupte, Sumedh, et autres
Publié: (2026)
par: Gupte, Sumedh, et autres
Publié: (2026)
An Actor-Critic Algorithm with Function Approximation for Risk Sensitive Cost Markov Decision Processes
par: Guin, Soumyajit, et autres
Publié: (2025)
par: Guin, Soumyajit, et autres
Publié: (2025)
A policy gradient approach for Finite Horizon Constrained Markov Decision Processes
par: Guin, Soumyajit, et autres
Publié: (2022)
par: Guin, Soumyajit, et autres
Publié: (2022)
Two-Timescale Critic-Actor for Average Reward MDPs with Function Approximation
par: Panda, Prashansa, et autres
Publié: (2024)
par: Panda, Prashansa, et autres
Publié: (2024)
n-Step Temporal Difference Learning with Optimal n
par: Mandal, Lakshmi, et autres
Publié: (2023)
par: Mandal, Lakshmi, et autres
Publié: (2023)
Enabling Off-Policy Imitation Learning with Deep Actor Critic Stabilization
par: Sen, Sayambhu, et autres
Publié: (2025)
par: Sen, Sayambhu, et autres
Publié: (2025)
Convergence of Multiagent Learning Systems for Traffic control
par: Sen, Sayambhu, et autres
Publié: (2025)
par: Sen, Sayambhu, et autres
Publié: (2025)
Actor-Critic or Critic-Actor? A Tale of Two Time Scales
par: Bhatnagar, Shalabh, et autres
Publié: (2022)
par: Bhatnagar, Shalabh, et autres
Publié: (2022)
Deep SOR Minimax Q-learning for Two-player Zero-sum Game
par: Gautam, Saksham, et autres
Publié: (2025)
par: Gautam, Saksham, et autres
Publié: (2025)
Approximate Linear Programming for Decentralized Policy Iteration in Cooperative Multi-agent Markov Decision Processes
par: Mandal, Lakshmi, et autres
Publié: (2023)
par: Mandal, Lakshmi, et autres
Publié: (2023)
A Finite-Sample Analysis of an Actor-Critic Algorithm for Mean-Variance Optimization in a Discounted MDP
par: Sangadi, Tejaram, et autres
Publié: (2024)
par: Sangadi, Tejaram, et autres
Publié: (2024)
Non-Asymptotic Optimization and Generalization Bounds for Stochastic Gauss-Newton in Overparameterized Models
par: Cayci, Semih
Publié: (2025)
par: Cayci, Semih
Publié: (2025)
Optimizing Shortfall Risk Metric for Learning Regression Models
par: Ramaswamy, Harish G., et autres
Publié: (2025)
par: Ramaswamy, Harish G., et autres
Publié: (2025)
High-Probability Bounds for SGD under the Polyak-Lojasiewicz Condition with Markovian Noise
par: Kar, Avik, et autres
Publié: (2026)
par: Kar, Avik, et autres
Publié: (2026)
Concentration Bounds for Optimized Certainty Equivalent Risk Estimation
par: Ghosh, Ayon, et autres
Publié: (2024)
par: Ghosh, Ayon, et autres
Publié: (2024)
Policy Gradient Methods for Non-Markovian Reinforcement Learning
par: Kar, Avik, et autres
Publié: (2026)
par: Kar, Avik, et autres
Publié: (2026)
Reinforcement Learning for Exponential Utility: Algorithms and Convergence in Discounted MDPs
par: Thoppe, Gugan, et autres
Publié: (2026)
par: Thoppe, Gugan, et autres
Publié: (2026)
Markov Chain Variance Estimation: A Stochastic Approximation Approach
par: Agrawal, Shubhada, et autres
Publié: (2024)
par: Agrawal, Shubhada, et autres
Publié: (2024)
Optimization of utility-based shortfall risk: A non-asymptotic viewpoint
par: Gupte, Sumedh, et autres
Publié: (2023)
par: Gupte, Sumedh, et autres
Publié: (2023)
Stochastic Optimization with Random Search
par: Chayti, El Mahdi, et autres
Publié: (2025)
par: Chayti, El Mahdi, et autres
Publié: (2025)
Preference-centric Bandits: Optimality of Mixtures and Regret-efficient Algorithms
par: Tatlı, Meltem, et autres
Publié: (2025)
par: Tatlı, Meltem, et autres
Publié: (2025)
Topological Generalization Bounds for Discrete-Time Stochastic Optimization Algorithms
par: Andreeva, Rayna, et autres
Publié: (2024)
par: Andreeva, Rayna, et autres
Publié: (2024)
Risk-sensitive Bandits: Arm Mixture Optimality and Regret-efficient Algorithms
par: Tatlı, Meltem, et autres
Publié: (2025)
par: Tatlı, Meltem, et autres
Publié: (2025)
Stochastic Newton Proximal Extragradient Method
par: Jiang, Ruichen, et autres
Publié: (2024)
par: Jiang, Ruichen, et autres
Publié: (2024)
Improving Stochastic Cubic Newton with Momentum
par: Chayti, El Mahdi, et autres
Publié: (2024)
par: Chayti, El Mahdi, et autres
Publié: (2024)
A Multi-objective Newton Optimization Algorithm for Hyper-Parameter Search
par: Xu, Qinwu
Publié: (2024)
par: Xu, Qinwu
Publié: (2024)
Random-Bridges as Stochastic Transports for Generative Models
par: Goria, Stefano, et autres
Publié: (2025)
par: Goria, Stefano, et autres
Publié: (2025)
A policy gradient approach for optimization of smooth risk measures
par: Vijayan, Nithia, et autres
Publié: (2022)
par: Vijayan, Nithia, et autres
Publié: (2022)
Policy Gradient Methods for Distortion Risk Measures
par: Vijayan, Nithia, et autres
Publié: (2021)
par: Vijayan, Nithia, et autres
Publié: (2021)
Smoothed functional-based gradient algorithms for off-policy reinforcement learning: A non-asymptotic viewpoint
par: Vijayan, Nithia, et autres
Publié: (2021)
par: Vijayan, Nithia, et autres
Publié: (2021)
Stochastic Mirror Descent under Iterate-Dependent Markov Noise: Analysis in the Asymptotic and Finite Time Regimes
par: Paul, Anik Kumar, et autres
Publié: (2026)
par: Paul, Anik Kumar, et autres
Publié: (2026)
Hyperparameter Optimization for Randomized Algorithms: A Case Study on Random Features
par: Dunbar, Oliver R. A., et autres
Publié: (2024)
par: Dunbar, Oliver R. A., et autres
Publié: (2024)
A Stochastic Quasi-Newton Method for Non-convex Optimization with Non-uniform Smoothness
par: Sun, Zhenyu, et autres
Publié: (2024)
par: Sun, Zhenyu, et autres
Publié: (2024)
Multi Timescale Stochastic Approximation: Stability and Convergence
par: Deb, Rohan, et autres
Publié: (2021)
par: Deb, Rohan, et autres
Publié: (2021)
Documents similaires
-
Public Transit Arrival Prediction: a Seq2Seq RNN Approach
par: Bhutani, Nancy, et autres
Publié: (2022) -
Policy Newton methods for Distortion Riskmetrics
par: Pachal, Soumen, et autres
Publié: (2025) -
Finite-time analysis of Multi-timescale Stochastic Optimization Algorithms
par: Kartikey, Kaustubh, et autres
Publié: (2026) -
Convergent Reinforcement Learning Algorithms for Stochastic Shortest Path Problem
par: Guin, Soumyajit, et autres
Publié: (2025) -
Finite-Time Analysis of Three-Timescale Constrained Actor-Critic and Constrained Natural Actor-Critic Algorithms
par: Panda, Prashansa, et autres
Publié: (2023)