Meta-Learning in Self-Play Regret Minimization
Fuente:
arXiv
Salvato in:
| Autori principali: | Sychrovský, David, Schmid, Martin, Šustr, Michal, Bowling, Michael |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Learning not to Regret
di: Sychrovský, David, et al.
Pubblicazione: (2023)
di: Sychrovský, David, et al.
Pubblicazione: (2023)
Approximating Nash Equilibria in General-Sum Games via Meta-Learning
di: Sychrovský, David, et al.
Pubblicazione: (2025)
di: Sychrovský, David, et al.
Pubblicazione: (2025)
Reducing Optimism Bias in Incomplete Cooperative Games
di: Úradník, Filip, et al.
Pubblicazione: (2024)
di: Úradník, Filip, et al.
Pubblicazione: (2024)
GPU-Accelerated Counterfactual Regret Minimization
di: Kim, Juho
Pubblicazione: (2024)
di: Kim, Juho
Pubblicazione: (2024)
Robust Deep Monte Carlo Counterfactual Regret Minimization: Addressing Theoretical Risks in Neural Fictitious Self-Play
di: Jaafari, Zakaria El
Pubblicazione: (2025)
di: Jaafari, Zakaria El
Pubblicazione: (2025)
Regret Minimization in Stackelberg Games with Side Information
di: Harris, Keegan, et al.
Pubblicazione: (2024)
di: Harris, Keegan, et al.
Pubblicazione: (2024)
Regret Minimization in Bilateral Trade With Perturbed Markets
di: Lunghi, Anna, et al.
Pubblicazione: (2026)
di: Lunghi, Anna, et al.
Pubblicazione: (2026)
Selling Joint Ads: A Regret Minimization Perspective
di: Aggarwal, Gagan, et al.
Pubblicazione: (2024)
di: Aggarwal, Gagan, et al.
Pubblicazione: (2024)
Regret Minimization for Piecewise Linear Rewards: Contracts, Auctions, and Beyond
di: Bacchiocchi, Francesco, et al.
Pubblicazione: (2025)
di: Bacchiocchi, Francesco, et al.
Pubblicazione: (2025)
Computational Lower Bounds for Regret Minimization in Normal-Form Games
di: Anagnostides, Ioannis, et al.
Pubblicazione: (2024)
di: Anagnostides, Ioannis, et al.
Pubblicazione: (2024)
Easy as ABCs: Unifying Boltzmann Q-Learning and Counterfactual Regret Minimization
di: D'Amico-Wong, Luca, et al.
Pubblicazione: (2024)
di: D'Amico-Wong, Luca, et al.
Pubblicazione: (2024)
Comparing Uniform Price and Discriminatory Multi-Unit Auctions through Regret Minimization
di: Potfer, Marius, et al.
Pubblicazione: (2025)
di: Potfer, Marius, et al.
Pubblicazione: (2025)
Efficient Last-Iterate Convergence in Regret Minimization via Adaptive Reward Transformation
di: Ren, Hang, et al.
Pubblicazione: (2025)
di: Ren, Hang, et al.
Pubblicazione: (2025)
An Efficient Black-Box Reduction from Online Learning to Multicalibration, and a New Route to $Φ$-Regret Minimization
di: Farina, Gabriele, et al.
Pubblicazione: (2026)
di: Farina, Gabriele, et al.
Pubblicazione: (2026)
Next-Token Prediction and Regret Minimization
di: Mohri, Mehryar, et al.
Pubblicazione: (2026)
di: Mohri, Mehryar, et al.
Pubblicazione: (2026)
Barriers to Welfare Maximization with No-Regret Learning
di: Anagnostides, Ioannis, et al.
Pubblicazione: (2024)
di: Anagnostides, Ioannis, et al.
Pubblicazione: (2024)
On the Limitations and Possibilities of Nash Regret Minimization in Zero-Sum Matrix Games under Noisy Feedback
di: Maiti, Arnab, et al.
Pubblicazione: (2023)
di: Maiti, Arnab, et al.
Pubblicazione: (2023)
GAE Falls Short in Imperfect-Information Self-Play Reinforcement Learning
di: Fan, Zhiyuan, et al.
Pubblicazione: (2026)
di: Fan, Zhiyuan, et al.
Pubblicazione: (2026)
Deep (Predictive) Discounted Counterfactual Regret Minimization
di: Xu, Hang, et al.
Pubblicazione: (2025)
di: Xu, Hang, et al.
Pubblicazione: (2025)
Real-Time Parallel Counterfactual Regret Minimization
di: Li, Boning, et al.
Pubblicazione: (2026)
di: Li, Boning, et al.
Pubblicazione: (2026)
The Relationship between No-Regret Learning and Online Conformal Prediction
di: Ramalingam, Ramya, et al.
Pubblicazione: (2025)
di: Ramalingam, Ramya, et al.
Pubblicazione: (2025)
Improved Regret Bounds for Online Fair Division with Bandit Learning
di: Schiffer, Benjamin, et al.
Pubblicazione: (2025)
di: Schiffer, Benjamin, et al.
Pubblicazione: (2025)
Last-Iterate Convergence of No-Regret Learning for Equilibria in Bargaining Games
di: Kamp, Serafina, et al.
Pubblicazione: (2025)
di: Kamp, Serafina, et al.
Pubblicazione: (2025)
Honor Among Bandits: No-Regret Learning for Online Fair Division
di: Procaccia, Ariel D., et al.
Pubblicazione: (2024)
di: Procaccia, Ariel D., et al.
Pubblicazione: (2024)
ReLExS: Reinforcement Learning Explanations for Stackelberg No-Regret Learners
di: Huang, Xiangge, et al.
Pubblicazione: (2024)
di: Huang, Xiangge, et al.
Pubblicazione: (2024)
No-Regret Learning in Bilateral Trade via Global Budget Balance
di: Bernasconi, Martino, et al.
Pubblicazione: (2023)
di: Bernasconi, Martino, et al.
Pubblicazione: (2023)
Solving Pasur Using GPU-Accelerated Counterfactual Regret Minimization
di: Baghal, Sina
Pubblicazione: (2025)
di: Baghal, Sina
Pubblicazione: (2025)
Minimizing Weighted Counterfactual Regret with Optimistic Online Mirror Descent
di: Xu, Hang, et al.
Pubblicazione: (2024)
di: Xu, Hang, et al.
Pubblicazione: (2024)
Regret Minimization and Convergence to Equilibria in General-sum Markov Games
di: Erez, Liad, et al.
Pubblicazione: (2022)
di: Erez, Liad, et al.
Pubblicazione: (2022)
Learning to Play Against Unknown Opponents
di: Arunachaleswaran, Eshwar Ram, et al.
Pubblicazione: (2024)
di: Arunachaleswaran, Eshwar Ram, et al.
Pubblicazione: (2024)
Full Swap Regret and Discretized Calibration
di: Fishelson, Maxwell, et al.
Pubblicazione: (2025)
di: Fishelson, Maxwell, et al.
Pubblicazione: (2025)
Regret Analysis of Repeated Delegated Choice
di: Hajiaghayi, MohammadTaghi, et al.
Pubblicazione: (2023)
di: Hajiaghayi, MohammadTaghi, et al.
Pubblicazione: (2023)
Regret Analysis of Sleeping Competing Bandits
di: Uba, Shinnosuke, et al.
Pubblicazione: (2026)
di: Uba, Shinnosuke, et al.
Pubblicazione: (2026)
p-Mean Regret for Stochastic Bandits
di: Krishna, Anand, et al.
Pubblicazione: (2024)
di: Krishna, Anand, et al.
Pubblicazione: (2024)
Simultaneous Swap Regret Minimization via KL-Calibration
di: Luo, Haipeng, et al.
Pubblicazione: (2025)
di: Luo, Haipeng, et al.
Pubblicazione: (2025)
Forecasting for Swap Regret for All Downstream Agents
di: Roth, Aaron, et al.
Pubblicazione: (2024)
di: Roth, Aaron, et al.
Pubblicazione: (2024)
Pure Exploration via Frank-Wolfe Self-Play
di: Liu, Xinyu, et al.
Pubblicazione: (2025)
di: Liu, Xinyu, et al.
Pubblicazione: (2025)
Online Learning for Uninformed Markov Games: Empirical Nash-Value Regret and Non-Stationarity Adaptation
di: Liu, Junyan, et al.
Pubblicazione: (2026)
di: Liu, Junyan, et al.
Pubblicazione: (2026)
Proximal Regret and Proximal Correlated Equilibria: A New Tractable Solution Concept for Online Learning and Games
di: Cai, Yang, et al.
Pubblicazione: (2025)
di: Cai, Yang, et al.
Pubblicazione: (2025)
Cautious Optimism: A Meta-Algorithm for Near-Constant Regret in General Games
di: Soleymani, Ashkan, et al.
Pubblicazione: (2025)
di: Soleymani, Ashkan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Learning not to Regret
di: Sychrovský, David, et al.
Pubblicazione: (2023) -
Approximating Nash Equilibria in General-Sum Games via Meta-Learning
di: Sychrovský, David, et al.
Pubblicazione: (2025) -
Reducing Optimism Bias in Incomplete Cooperative Games
di: Úradník, Filip, et al.
Pubblicazione: (2024) -
GPU-Accelerated Counterfactual Regret Minimization
di: Kim, Juho
Pubblicazione: (2024) -
Robust Deep Monte Carlo Counterfactual Regret Minimization: Addressing Theoretical Risks in Neural Fictitious Self-Play
di: Jaafari, Zakaria El
Pubblicazione: (2025)