An Improved Finite-time Analysis of Temporal Difference Learning with Deep Neural Networks
Fuente:
arXiv
Salvato in:
| Autori principali: | Ke, Zhifa, Wen, Zaiwen, Zhang, Junyu |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Gauss-Newton Temporal Difference Learning with Nonlinear Function Approximation
di: Ke, Zhifa, et al.
Pubblicazione: (2023)
di: Ke, Zhifa, et al.
Pubblicazione: (2023)
Constructing Industrial-Scale Optimization Modeling Benchmark
di: Li, Zhong, et al.
Pubblicazione: (2026)
di: Li, Zhong, et al.
Pubblicazione: (2026)
Temporal Difference Learning with Compressed Updates: Error-Feedback meets Reinforcement Learning
di: Mitra, Aritra, et al.
Pubblicazione: (2023)
di: Mitra, Aritra, et al.
Pubblicazione: (2023)
Solving Integrated Process Planning and Scheduling Problem via Graph Neural Network Based Deep Reinforcement Learning
di: Li, Hongpei, et al.
Pubblicazione: (2024)
di: Li, Hongpei, et al.
Pubblicazione: (2024)
Non-Asymptotic Global Convergence of PPO-Clip
di: Liu, Yin, et al.
Pubblicazione: (2025)
di: Liu, Yin, et al.
Pubblicazione: (2025)
Learning the Riccati solution operator for time-varying LQR via Deep Operator Networks
di: Chen, Jun, et al.
Pubblicazione: (2026)
di: Chen, Jun, et al.
Pubblicazione: (2026)
PID Accelerated Temporal Difference Algorithms
di: Bedaywi, Mark, et al.
Pubblicazione: (2024)
di: Bedaywi, Mark, et al.
Pubblicazione: (2024)
Asymptotic and Finite Sample Analysis of Nonexpansive Stochastic Approximations with Markovian Noise
di: Blaser, Ethan, et al.
Pubblicazione: (2024)
di: Blaser, Ethan, et al.
Pubblicazione: (2024)
A Convexity-dependent Two-Phase Training Algorithm for Deep Neural Networks
di: Hrycej, Tomas, et al.
Pubblicazione: (2025)
di: Hrycej, Tomas, et al.
Pubblicazione: (2025)
Finite-Time Analysis of Gradient Descent for Shallow Transformers
di: Arda, Enes, et al.
Pubblicazione: (2026)
di: Arda, Enes, et al.
Pubblicazione: (2026)
LMask: Learn to Solve Constrained Routing Problems with Lazy Masking
di: Li, Tianyou, et al.
Pubblicazione: (2025)
di: Li, Tianyou, et al.
Pubblicazione: (2025)
Geometric Neural Operators (GNPs) for Data-Driven Deep Learning of Non-Euclidean Operators
di: Quackenbush, Blaine, et al.
Pubblicazione: (2024)
di: Quackenbush, Blaine, et al.
Pubblicazione: (2024)
Neural Solver Selection for Combinatorial Optimization
di: Gao, Chengrui, et al.
Pubblicazione: (2024)
di: Gao, Chengrui, et al.
Pubblicazione: (2024)
ODE-based Learning to Optimize
di: Xie, Zhonglin, et al.
Pubblicazione: (2024)
di: Xie, Zhonglin, et al.
Pubblicazione: (2024)
On Finding Small Hyper-Gradients in Bilevel Optimization: Hardness Results and Improved Analysis
di: Chen, Lesi, et al.
Pubblicazione: (2023)
di: Chen, Lesi, et al.
Pubblicazione: (2023)
HoP: Homeomorphic Polar Learning for Hard Constrained Optimization
di: Deng, Ke, et al.
Pubblicazione: (2025)
di: Deng, Ke, et al.
Pubblicazione: (2025)
Learning to Solve the Quadratic Assignment Problem with Warm-Started MCMC Finetuning
di: Pan, Yicheng, et al.
Pubblicazione: (2026)
di: Pan, Yicheng, et al.
Pubblicazione: (2026)
A Learning Method with Gap-Aware Generation for Heterogeneous DAG Scheduling
di: Zhou, Ruisong, et al.
Pubblicazione: (2026)
di: Zhou, Ruisong, et al.
Pubblicazione: (2026)
Optimizing the Optimizer for Physics-Informed Neural Networks and Kolmogorov-Arnold Networks
di: Kiyani, Elham, et al.
Pubblicazione: (2025)
di: Kiyani, Elham, et al.
Pubblicazione: (2025)
Bayesian Optimization for Hyperparameters Tuning in Neural Networks
di: Onorato, Gabriele
Pubblicazione: (2024)
di: Onorato, Gabriele
Pubblicazione: (2024)
Optimizing Inventory Routing: A Decision-Focused Learning Approach using Neural Networks
di: Islam, MD Shafikul, et al.
Pubblicazione: (2023)
di: Islam, MD Shafikul, et al.
Pubblicazione: (2023)
Solving Functional Optimization with Deep Networks and Variational Principles
di: Kamtue, Kawisorn, et al.
Pubblicazione: (2024)
di: Kamtue, Kawisorn, et al.
Pubblicazione: (2024)
SPOT: Spatio-Temporal Pattern Mining and Optimization for Load Consolidation in Freight Transportation Networks
di: Cheng, Sikai, et al.
Pubblicazione: (2025)
di: Cheng, Sikai, et al.
Pubblicazione: (2025)
A Deep Q-Network Based on Radial Basis Functions for Multi-Echelon Inventory Management
di: Cheng, Liqiang, et al.
Pubblicazione: (2024)
di: Cheng, Liqiang, et al.
Pubblicazione: (2024)
Training Safe Neural Networks with Global SDP Bounds
di: Soletskyi, Roman, et al.
Pubblicazione: (2024)
di: Soletskyi, Roman, et al.
Pubblicazione: (2024)
Applications of 0-1 Neural Networks in Prescription and Prediction
di: Patil, Vrishabh, et al.
Pubblicazione: (2024)
di: Patil, Vrishabh, et al.
Pubblicazione: (2024)
Taming Binarized Neural Networks and Mixed-Integer Programs
di: Aspman, Johannes, et al.
Pubblicazione: (2023)
di: Aspman, Johannes, et al.
Pubblicazione: (2023)
Global Convergence and Rich Feature Learning in $L$-Layer Infinite-Width Neural Networks under $μ$P Parametrization
di: Chen, Zixiang, et al.
Pubblicazione: (2025)
di: Chen, Zixiang, et al.
Pubblicazione: (2025)
Q-Learning under Finite Model Uncertainty
di: Sester, Julian, et al.
Pubblicazione: (2024)
di: Sester, Julian, et al.
Pubblicazione: (2024)
Towards Efficient Constraint Handling in Neural Solvers for Routing Problems
di: Bi, Jieyi, et al.
Pubblicazione: (2026)
di: Bi, Jieyi, et al.
Pubblicazione: (2026)
LLM Embeddings Improve Test-time Adaptation to Tabular $Y|X$-Shifts
di: Zeng, Yibo, et al.
Pubblicazione: (2024)
di: Zeng, Yibo, et al.
Pubblicazione: (2024)
Closing the Loop: Coordinating Inventory and Recommendation via Deep Reinforcement Learning on Multiple Timescales
di: Jiang, Jinyang, et al.
Pubblicazione: (2025)
di: Jiang, Jinyang, et al.
Pubblicazione: (2025)
T-SKM-Net: Trainable Neural Network Framework for Linear Constraint Satisfaction via Sampling Kaczmarz-Motzkin Method
di: Zhu, Haoyu, et al.
Pubblicazione: (2025)
di: Zhu, Haoyu, et al.
Pubblicazione: (2025)
Understanding Optimization in Deep Learning with Central Flows
di: Cohen, Jeremy M., et al.
Pubblicazione: (2024)
di: Cohen, Jeremy M., et al.
Pubblicazione: (2024)
Deep Reinforcement Learning for Traveling Purchaser Problems
di: Yuan, Haofeng, et al.
Pubblicazione: (2024)
di: Yuan, Haofeng, et al.
Pubblicazione: (2024)
Feed-Forward Neural Networks as a Mixed-Integer Program
di: Aftabi, Navid, et al.
Pubblicazione: (2024)
di: Aftabi, Navid, et al.
Pubblicazione: (2024)
Bridging Control with Neural Network Verifier alpha-beta-CROWN: A Tutorial
di: Li, Haoyu, et al.
Pubblicazione: (2026)
di: Li, Haoyu, et al.
Pubblicazione: (2026)
Graph Neural Networks for the Offline Nanosatellite Task Scheduling Problem
di: Pacheco, Bruno Machado, et al.
Pubblicazione: (2023)
di: Pacheco, Bruno Machado, et al.
Pubblicazione: (2023)
Ginger: An Efficient Curvature Approximation with Linear Complexity for General Neural Networks
di: Hao, Yongchang, et al.
Pubblicazione: (2024)
di: Hao, Yongchang, et al.
Pubblicazione: (2024)
SMiLE: Provably Enforcing Global Relational Properties in Neural Networks
di: Francobaldi, Matteo, et al.
Pubblicazione: (2025)
di: Francobaldi, Matteo, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Gauss-Newton Temporal Difference Learning with Nonlinear Function Approximation
di: Ke, Zhifa, et al.
Pubblicazione: (2023) -
Constructing Industrial-Scale Optimization Modeling Benchmark
di: Li, Zhong, et al.
Pubblicazione: (2026) -
Temporal Difference Learning with Compressed Updates: Error-Feedback meets Reinforcement Learning
di: Mitra, Aritra, et al.
Pubblicazione: (2023) -
Solving Integrated Process Planning and Scheduling Problem via Graph Neural Network Based Deep Reinforcement Learning
di: Li, Hongpei, et al.
Pubblicazione: (2024) -
Non-Asymptotic Global Convergence of PPO-Clip
di: Liu, Yin, et al.
Pubblicazione: (2025)