Risultati della ricerca - Lin, Max
- Mostra 1 - 4 risultati su 4
-
1
Augmented Lagrangian Method for Last-Iterate Convergence for Constrained MDPs Autoría: Lu, Michael, Lin, Max Qiushi, Chen, Mo, Vaswani, Sharan
Pubblicazione 2026Fuente: arXivTipo de material: PreprintAcceso al recurso -
2
UINav: A Practical Approach to Train On-Device Automation Agents Autoría: Li, Wei, Hsu, Fu-Lin, Bishop, Will, Campbell-Ajala, Folawiyo, Lin, Max, Riva, Oriana
Pubblicazione 2023Fuente: arXivTipo de material: PreprintAcceso al recurso -
3
Optimistic Actor-Critic with Parametric Policies for Linear Markov Decision Processes Autoría: Lin, Max Qiushi, Asad, Reza, Tan, Kevin, Ishfaq, Haque, Szepesvari, Csaba, Vaswani, Sharan
Pubblicazione 2026Fuente: arXivTipo de material: PreprintAcceso al recurso -
4
Rethinking the Global Convergence of Softmax Policy Gradient with Linear Function Approximation Autoría: Lin, Max Qiushi, Mei, Jincheng, Aghaei, Matin, Lu, Michael, Dai, Bo, Agarwal, Alekh, Schuurmans, Dale, Szepesvari, Csaba, Vaswani, Sharan
Pubblicazione 2025Fuente: arXivTipo de material: PreprintAcceso al recurso