Comparator-Adaptive $Φ$-Regret: Improved Bounds, Simpler Algorithms, and Applications to Games
Fuente:
arXiv
Salvato in:
| Autori principali: | Hait, Soumita, Li, Ping, Luo, Haipeng, Zhang, Mengxiao |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Alternating Regret for Online Convex Optimization
di: Hait, Soumita, et al.
Pubblicazione: (2025)
di: Hait, Soumita, et al.
Pubblicazione: (2025)
Near-Optimal Last-Iterate Convergence for Zero-Sum Games with Bandit Feedback and Opponent Actions
di: Hait, Soumita, et al.
Pubblicazione: (2026)
di: Hait, Soumita, et al.
Pubblicazione: (2026)
Contextual Multinomial Logit Bandits with General Value Functions
di: Zhang, Mengxiao, et al.
Pubblicazione: (2024)
di: Zhang, Mengxiao, et al.
Pubblicazione: (2024)
No-Regret Learning for Fair Multi-Agent Social Welfare Optimization
di: Zhang, Mengxiao, et al.
Pubblicazione: (2024)
di: Zhang, Mengxiao, et al.
Pubblicazione: (2024)
On Tractable $Φ$-Equilibria in Non-Concave Games
di: Cai, Yang, et al.
Pubblicazione: (2024)
di: Cai, Yang, et al.
Pubblicazione: (2024)
Contextual Linear Bandits with Delay as Payoff
di: Zhang, Mengxiao, et al.
Pubblicazione: (2025)
di: Zhang, Mengxiao, et al.
Pubblicazione: (2025)
Last-Iterate Convergence Properties of Regret-Matching Algorithms in Games
di: Cai, Yang, et al.
Pubblicazione: (2023)
di: Cai, Yang, et al.
Pubblicazione: (2023)
Efficient Contextual Bandits with Uninformed Feedback Graphs
di: Zhang, Mengxiao, et al.
Pubblicazione: (2024)
di: Zhang, Mengxiao, et al.
Pubblicazione: (2024)
Interaction-Grounded Learning for Contextual Markov Decision Processes with Personalized Feedback
di: Zhang, Mengxiao, et al.
Pubblicazione: (2026)
di: Zhang, Mengxiao, et al.
Pubblicazione: (2026)
Provably Efficient Interactive-Grounded Learning with Personalized Reward
di: Zhang, Mengxiao, et al.
Pubblicazione: (2024)
di: Zhang, Mengxiao, et al.
Pubblicazione: (2024)
Improved Bounds for Swap Multicalibration and Swap Omniprediction
di: Luo, Haipeng, et al.
Pubblicazione: (2025)
di: Luo, Haipeng, et al.
Pubblicazione: (2025)
Online Learning for Uninformed Markov Games: Empirical Nash-Value Regret and Non-Stationarity Adaptation
di: Liu, Junyan, et al.
Pubblicazione: (2026)
di: Liu, Junyan, et al.
Pubblicazione: (2026)
Near-Optimal Regret for Distributed Adversarial Bandits: A Black-Box Approach
di: Qiu, Hao, et al.
Pubblicazione: (2026)
di: Qiu, Hao, et al.
Pubblicazione: (2026)
A Short Note on a Variant of the Squint Algorithm
di: Luo, Haipeng
Pubblicazione: (2026)
di: Luo, Haipeng
Pubblicazione: (2026)
Instance-Dependent Regret Bounds for Learning Two-Player Zero-Sum Games with Bandit Feedback
di: Ito, Shinji, et al.
Pubblicazione: (2025)
di: Ito, Shinji, et al.
Pubblicazione: (2025)
Parameter-free Dynamic Regret: Time-varying Movement Costs, Delayed Feedback, and Memory
di: Qiu, Hao, et al.
Pubblicazione: (2026)
di: Qiu, Hao, et al.
Pubblicazione: (2026)
Improved Regret Bounds for Bandits with Expert Advice
di: Cesa-Bianchi, Nicolò, et al.
Pubblicazione: (2024)
di: Cesa-Bianchi, Nicolò, et al.
Pubblicazione: (2024)
Improved Kernel Alignment Regret Bound for Online Kernel Learning
di: Li, Junfan, et al.
Pubblicazione: (2022)
di: Li, Junfan, et al.
Pubblicazione: (2022)
Near-Optimal Regret in Linear MDPs with Aggregate Bandit Feedback
di: Cassel, Asaf, et al.
Pubblicazione: (2024)
di: Cassel, Asaf, et al.
Pubblicazione: (2024)
One Good Source is All You Need: Near-Optimal Regret for Bandits under Heterogeneous Noise
di: Bhat, Amith, et al.
Pubblicazione: (2026)
di: Bhat, Amith, et al.
Pubblicazione: (2026)
A Polynomial-time Algorithm for Online Sparse Linear Regression with Improved Regret Bound under Weaker Conditions
di: Li, Junfan, et al.
Pubblicazione: (2025)
di: Li, Junfan, et al.
Pubblicazione: (2025)
Improved Regret Bounds of (Multinomial) Logistic Bandits via Regret-to-Confidence-Set Conversion
di: Lee, Junghyun, et al.
Pubblicazione: (2023)
di: Lee, Junghyun, et al.
Pubblicazione: (2023)
Dual Adaptivity: Universal Algorithms for Minimizing the Adaptive Regret of Convex Functions
di: Zhang, Lijun, et al.
Pubblicazione: (2025)
di: Zhang, Lijun, et al.
Pubblicazione: (2025)
Swap Regret Minimization Through Response-Based Approachability
di: Anagnostides, Ioannis, et al.
Pubblicazione: (2026)
di: Anagnostides, Ioannis, et al.
Pubblicazione: (2026)
On Improved Regret Bounds In Bayesian Optimization with Gaussian Noise
di: Wang, Jingyi, et al.
Pubblicazione: (2024)
di: Wang, Jingyi, et al.
Pubblicazione: (2024)
Proximal Regret and Proximal Correlated Equilibria: A New Tractable Solution Concept for Online Learning and Games
di: Cai, Yang, et al.
Pubblicazione: (2025)
di: Cai, Yang, et al.
Pubblicazione: (2025)
Autobidders with Budget and ROI Constraints: Efficiency, Regret, and Pacing Dynamics
di: Lucier, Brendan, et al.
Pubblicazione: (2023)
di: Lucier, Brendan, et al.
Pubblicazione: (2023)
Improved Regret Bounds for Gaussian Process Upper Confidence Bound in Bayesian Optimization
di: Iwazaki, Shogo
Pubblicazione: (2025)
di: Iwazaki, Shogo
Pubblicazione: (2025)
Multimodal Bandits: Regret Lower Bounds and Optimal Algorithms
di: Réveillard, William, et al.
Pubblicazione: (2025)
di: Réveillard, William, et al.
Pubblicazione: (2025)
Improved Regret and Contextual Linear Extension for Pandora's Box and Prophet Inequality
di: Liu, Junyan, et al.
Pubblicazione: (2025)
di: Liu, Junyan, et al.
Pubblicazione: (2025)
Simultaneous Swap Regret Minimization via KL-Calibration
di: Luo, Haipeng, et al.
Pubblicazione: (2025)
di: Luo, Haipeng, et al.
Pubblicazione: (2025)
Logarithmic-Regret Quantum Learning Algorithms for Zero-Sum Games
di: Gao, Minbo, et al.
Pubblicazione: (2023)
di: Gao, Minbo, et al.
Pubblicazione: (2023)
Improved Regret Bounds for Online Fair Division with Bandit Learning
di: Schiffer, Benjamin, et al.
Pubblicazione: (2025)
di: Schiffer, Benjamin, et al.
Pubblicazione: (2025)
Revisiting Generative Policies: A Simpler Reinforcement Learning Algorithmic Perspective
di: Zhang, Jinouwen, et al.
Pubblicazione: (2024)
di: Zhang, Jinouwen, et al.
Pubblicazione: (2024)
Computational Lower Bounds for Regret Minimization in Normal-Form Games
di: Anagnostides, Ioannis, et al.
Pubblicazione: (2024)
di: Anagnostides, Ioannis, et al.
Pubblicazione: (2024)
Regret Bounds and Reinforcement Learning Exploration of EXP-based Algorithms
di: Xu, Mengfan, et al.
Pubblicazione: (2020)
di: Xu, Mengfan, et al.
Pubblicazione: (2020)
Learning in Markov Games with Adaptive Adversaries: Policy Regret, Fundamental Barriers, and Efficient Algorithms
di: Nguyen-Tang, Thanh, et al.
Pubblicazione: (2024)
di: Nguyen-Tang, Thanh, et al.
Pubblicazione: (2024)
Quality check of a sample partition using multinomial distribution
di: Modak, Soumita
Pubblicazione: (2024)
di: Modak, Soumita
Pubblicazione: (2024)
Improved Regret Bounds for Linear Bandits with Heavy-Tailed Rewards
di: Tajdini, Artin, et al.
Pubblicazione: (2025)
di: Tajdini, Artin, et al.
Pubblicazione: (2025)
Improved Bayesian Regret Bounds for Thompson Sampling in Reinforcement Learning
di: Moradipari, Ahmadreza, et al.
Pubblicazione: (2023)
di: Moradipari, Ahmadreza, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Alternating Regret for Online Convex Optimization
di: Hait, Soumita, et al.
Pubblicazione: (2025) -
Near-Optimal Last-Iterate Convergence for Zero-Sum Games with Bandit Feedback and Opponent Actions
di: Hait, Soumita, et al.
Pubblicazione: (2026) -
Contextual Multinomial Logit Bandits with General Value Functions
di: Zhang, Mengxiao, et al.
Pubblicazione: (2024) -
No-Regret Learning for Fair Multi-Agent Social Welfare Optimization
di: Zhang, Mengxiao, et al.
Pubblicazione: (2024) -
On Tractable $Φ$-Equilibria in Non-Concave Games
di: Cai, Yang, et al.
Pubblicazione: (2024)