Guardado en:
| Autores principales: | Chen, Sijia, Zhang, Yu-Jie, Tu, Wei-Wei, Zhao, Peng, Zhang, Lijun |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2302.04552 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
An Optimistic Algorithm for Online Convex Optimization with Adversarial Constraints
por: Lekeufack, Jordan, et al.
Publicado: (2024)
por: Lekeufack, Jordan, et al.
Publicado: (2024)
Improving LLM General Preference Alignment via Optimistic Online Mirror Descent
por: Zhang, Yuheng, et al.
Publicado: (2025)
por: Zhang, Yuheng, et al.
Publicado: (2025)
Adaptivity and Non-stationarity: Problem-dependent Dynamic Regret for Online Convex Optimization
por: Zhao, Peng, et al.
Publicado: (2021)
por: Zhao, Peng, et al.
Publicado: (2021)
Minimizing Weighted Counterfactual Regret with Optimistic Online Mirror Descent
por: Xu, Hang, et al.
Publicado: (2024)
por: Xu, Hang, et al.
Publicado: (2024)
Variational Online Mirror Descent for Robust Learning in Schrödinger Bridge
por: Han, Dong-Sig, et al.
Publicado: (2025)
por: Han, Dong-Sig, et al.
Publicado: (2025)
Universal Online Convex Optimization with $1$ Projection per Round
por: Yang, Wenhao, et al.
Publicado: (2024)
por: Yang, Wenhao, et al.
Publicado: (2024)
Optimal and Efficient Algorithms for Decentralized Online Convex Optimization
por: Wan, Yuanyu, et al.
Publicado: (2024)
por: Wan, Yuanyu, et al.
Publicado: (2024)
Optimistic Safety for Online Convex Optimization with Unknown Linear Constraints
por: Hutchinson, Spencer, et al.
Publicado: (2024)
por: Hutchinson, Spencer, et al.
Publicado: (2024)
Distributed Online Convex Optimization with Efficient Communication: Improved Algorithm and Lower bounds
por: Yang, Sifan, et al.
Publicado: (2026)
por: Yang, Sifan, et al.
Publicado: (2026)
Accelerated Rates between Stochastic and Adversarial Online Convex Optimization
por: Sachs, Sarah, et al.
Publicado: (2023)
por: Sachs, Sarah, et al.
Publicado: (2023)
Distributed Online Convex Optimization with Compressed Communication: Optimal Regret and Applications
por: Yang, Sifan, et al.
Publicado: (2026)
por: Yang, Sifan, et al.
Publicado: (2026)
Optimistic Online-to-Batch Conversions for Accelerated Convergence and Universality
por: Yan, Yu-Hu, et al.
Publicado: (2025)
por: Yan, Yu-Hu, et al.
Publicado: (2025)
Discounted Online Convex Optimization: Uniform Regret Across a Continuous Interval
por: Yang, Wenhao, et al.
Publicado: (2025)
por: Yang, Wenhao, et al.
Publicado: (2025)
The Hidden Cost of Approximation in Online Mirror Descent
por: Schlisselberg, Ofir, et al.
Publicado: (2025)
por: Schlisselberg, Ofir, et al.
Publicado: (2025)
Adaptive Online Mirror Descent for Tchebycheff Scalarization in Multi-Objective Learning
por: Liu, Meitong, et al.
Publicado: (2024)
por: Liu, Meitong, et al.
Publicado: (2024)
Universal Online Convex Optimization Meets Second-order Bounds
por: Zhang, Lijun, et al.
Publicado: (2021)
por: Zhang, Lijun, et al.
Publicado: (2021)
Projection-free Online Learning over Strongly Convex Sets
por: Wan, Yuanyu, et al.
Publicado: (2020)
por: Wan, Yuanyu, et al.
Publicado: (2020)
Policy Mirror Descent with Temporal Difference Learning: Sample Complexity under Online Markov Data
por: Li, Wenye, et al.
Publicado: (2025)
por: Li, Wenye, et al.
Publicado: (2025)
Non-stationary Delayed Online Convex Optimization: From Full-information to Bandit Setting
por: Wan, Yuanyu, et al.
Publicado: (2023)
por: Wan, Yuanyu, et al.
Publicado: (2023)
Nonstationary Generalized Linear Bandits with Discounted Online Mirror Descent
por: Lee, Joongkyu, et al.
Publicado: (2026)
por: Lee, Joongkyu, et al.
Publicado: (2026)
Efficient Stochastic Approximation of Minimax Excess Risk Optimization
por: Zhang, Lijun, et al.
Publicado: (2023)
por: Zhang, Lijun, et al.
Publicado: (2023)
Optimal Algorithms for Online Convex Optimization with Adversarial Constraints
por: Sinha, Abhishek, et al.
Publicado: (2023)
por: Sinha, Abhishek, et al.
Publicado: (2023)
Tight Bounds for Online Convex Optimization with Adversarial Constraints
por: Sinha, Abhishek, et al.
Publicado: (2024)
por: Sinha, Abhishek, et al.
Publicado: (2024)
Optimistic Regret Bounds for Online Learning in Adversarial Markov Decision Processes
por: Moon, Sang Bin, et al.
Publicado: (2024)
por: Moon, Sang Bin, et al.
Publicado: (2024)
Projection-free Algorithms for Online Convex Optimization with Adversarial Constraints
por: Sarkar, Dhruv, et al.
Publicado: (2025)
por: Sarkar, Dhruv, et al.
Publicado: (2025)
Optimal Anytime Algorithms for Online Convex Optimization with Adversarial Constraints
por: Sarkar, Dhruv, et al.
Publicado: (2025)
por: Sarkar, Dhruv, et al.
Publicado: (2025)
Alternating Regret for Online Convex Optimization
por: Hait, Soumita, et al.
Publicado: (2025)
por: Hait, Soumita, et al.
Publicado: (2025)
Online Non-Stationary Stochastic Quasar-Convex Optimization
por: Pun, Yuen-Man, et al.
Publicado: (2024)
por: Pun, Yuen-Man, et al.
Publicado: (2024)
Online Statistical Inference for Contextual Bandits via Stochastic Gradient Descent
por: Chang, Xiangyu, et al.
Publicado: (2022)
por: Chang, Xiangyu, et al.
Publicado: (2022)
Adaptivity and Universality: Problem-dependent Universal Regret for Online Convex Optimization
por: Zhao, Peng, et al.
Publicado: (2025)
por: Zhao, Peng, et al.
Publicado: (2025)
Unconstrained Robust Online Convex Optimization
por: Zhang, Jiujia, et al.
Publicado: (2025)
por: Zhang, Jiujia, et al.
Publicado: (2025)
Multi-Step Alignment as Markov Games: An Optimistic Online Gradient Descent Approach with Convergence Guarantees
por: Wu, Yongtao, et al.
Publicado: (2025)
por: Wu, Yongtao, et al.
Publicado: (2025)
Optimal Bounds for Adversarial Constrained Online Convex Optimization
por: Ferreira, Ricardo N., et al.
Publicado: (2025)
por: Ferreira, Ricardo N., et al.
Publicado: (2025)
Online Convex Optimization with Memory and Limited Predictions
por: Wang, Zhengmiao, et al.
Publicado: (2024)
por: Wang, Zhengmiao, et al.
Publicado: (2024)
Online Nonsubmodular Optimization with Delayed Feedback in the Bandit Setting
por: Yang, Sifan, et al.
Publicado: (2025)
por: Yang, Sifan, et al.
Publicado: (2025)
Exploiting Curvature in Online Convex Optimization with Delayed Feedback
por: Qiu, Hao, et al.
Publicado: (2025)
por: Qiu, Hao, et al.
Publicado: (2025)
Efficient Methods for Non-stationary Online Learning
por: Zhao, Peng, et al.
Publicado: (2023)
por: Zhao, Peng, et al.
Publicado: (2023)
The Sample Complexity of Gradient Descent in Stochastic Convex Optimization
por: Livni, Roi
Publicado: (2024)
por: Livni, Roi
Publicado: (2024)
An Optimistic Algorithm for online CMDPS with Anytime Adversarial Constraints
por: Zhu, Jiahui, et al.
Publicado: (2025)
por: Zhu, Jiahui, et al.
Publicado: (2025)
Fast Rates in Stochastic Online Convex Optimization by Exploiting the Curvature of Feasible Sets
por: Tsuchiya, Taira, et al.
Publicado: (2024)
por: Tsuchiya, Taira, et al.
Publicado: (2024)
Ejemplares similares
-
An Optimistic Algorithm for Online Convex Optimization with Adversarial Constraints
por: Lekeufack, Jordan, et al.
Publicado: (2024) -
Improving LLM General Preference Alignment via Optimistic Online Mirror Descent
por: Zhang, Yuheng, et al.
Publicado: (2025) -
Adaptivity and Non-stationarity: Problem-dependent Dynamic Regret for Online Convex Optimization
por: Zhao, Peng, et al.
Publicado: (2021) -
Minimizing Weighted Counterfactual Regret with Optimistic Online Mirror Descent
por: Xu, Hang, et al.
Publicado: (2024) -
Variational Online Mirror Descent for Robust Learning in Schrödinger Bridge
por: Han, Dong-Sig, et al.
Publicado: (2025)