Instance-Dependent Regret Bounds for Learning Two-Player Zero-Sum Games with Bandit Feedback
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ito, Shinji, Luo, Haipeng, Tsuchiya, Taira, Wu, Yue |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Adversarial Learning in Games with Bandit Feedback: Logarithmic Pure-Strategy Maximin Regret
par: Ito, Shinji, et autres
Publié: (2026)
par: Ito, Shinji, et autres
Publié: (2026)
Fair Division in a Variable Setting
par: Chandramouleeswaran, Harish, et autres
Publié: (2024)
par: Chandramouleeswaran, Harish, et autres
Publié: (2024)
Improved Approximation Ratio for Strategyproof Facility Location on a Cycle
par: Rogowski, Krzysztof, et autres
Publié: (2025)
par: Rogowski, Krzysztof, et autres
Publié: (2025)
A Parallelizable Approach for Characterizing NE in Zero-Sum Games After a Linear Number of Iterations of Gradient Descent
par: Kim, Taemin, et autres
Publié: (2025)
par: Kim, Taemin, et autres
Publié: (2025)
Regret Bounds for Robust Online Decision Making
par: Appel, Alexander, et autres
Publié: (2025)
par: Appel, Alexander, et autres
Publié: (2025)
Breaking $1/ε$ Barrier in Quantum Zero-Sum Games: Generalizing Metric Subregularity for Spectraplexes
par: Su, Yiheng, et autres
Publié: (2025)
par: Su, Yiheng, et autres
Publié: (2025)
A geometric decomposition of finite games: Convergence vs. recurrence under exponential weights
par: Legacci, Davide, et autres
Publié: (2024)
par: Legacci, Davide, et autres
Publié: (2024)
Reinforcement Learning for Reachability: Guaranteeing Asymptotic Optimality
par: Palasamudram, Amogh, et autres
Publié: (2026)
par: Palasamudram, Amogh, et autres
Publié: (2026)
Backpropagation Through Time For Networks With Long-Term Dependencies
par: Bird, George, et autres
Publié: (2021)
par: Bird, George, et autres
Publié: (2021)
A Quadratic Speedup in Finding Nash Equilibria of Quantum Zero-Sum Games
par: Vasconcelos, Francisca, et autres
Publié: (2023)
par: Vasconcelos, Francisca, et autres
Publié: (2023)
Computing Game Symmetries and Equilibria That Respect Them
par: Tewolde, Emanuel, et autres
Publié: (2025)
par: Tewolde, Emanuel, et autres
Publié: (2025)
Robust equilibria in continuous games: From strategic to dynamic robustness
par: Lotidis, Kyriakos, et autres
Publié: (2025)
par: Lotidis, Kyriakos, et autres
Publié: (2025)
Accelerated regularized learning in finite N-person games
par: Lotidis, Kyriakos, et autres
Publié: (2024)
par: Lotidis, Kyriakos, et autres
Publié: (2024)
EARCP: Self-Regulating Coherence-Aware Ensemble Architecture for Sequential Decision Making -- Ensemble Auto-Regule par Coherence et Performance
par: Amega, Mike
Publié: (2026)
par: Amega, Mike
Publié: (2026)
The Current and Future Perspectives of Zinc Oxide Nanoparticles in the Treatment of Diabetes Mellitus
par: Yousaf, Iqra
Publié: (2024)
par: Yousaf, Iqra
Publié: (2024)
The Coordination Gap: Multi-Agent Alternation Metrics for Temporal Fairness in Repeated Games
par: Papadopoulos, Nikolaos Al., et autres
Publié: (2026)
par: Papadopoulos, Nikolaos Al., et autres
Publié: (2026)
Two-player Domino games
par: de Menibus, Benjamin Hellouin, et autres
Publié: (2023)
par: de Menibus, Benjamin Hellouin, et autres
Publié: (2023)
Temporal Fair Division in Multi-Agent Systems: From Precise Alternation Metrics to Scalable Coordination Proxies
par: Papadopoulos, Nikolaos Al.
Publié: (2026)
par: Papadopoulos, Nikolaos Al.
Publié: (2026)
Online Decision Making with Generative Action Sets
par: Xu, Jianyu, et autres
Publié: (2025)
par: Xu, Jianyu, et autres
Publié: (2025)
Coopetition-Gym v1: A Formally Grounded Platform for Mixed-Motive Multi-Agent Reinforcement Learning under Strategic Coopetition
par: Pant, Vik, et autres
Publié: (2026)
par: Pant, Vik, et autres
Publié: (2026)
Frequency Principle: Fourier Analysis Sheds Light on Deep Neural Networks
par: Xu, Zhi-Qin John, et autres
Publié: (2019)
par: Xu, Zhi-Qin John, et autres
Publié: (2019)
Nash Welfare in Additively Separable Hedonic Games
par: Pagano, Marta, et autres
Publié: (2026)
par: Pagano, Marta, et autres
Publié: (2026)
No-regret learning in harmonic games: Extrapolation in the face of conflicting interests
par: Legacci, Davide, et autres
Publié: (2024)
par: Legacci, Davide, et autres
Publié: (2024)
A Characterization of Complexity in Public Goods Games
par: Gilboa, Matan
Publié: (2023)
par: Gilboa, Matan
Publié: (2023)
The Value of Recall in Extensive-Form Games
par: Berker, Ratip Emin, et autres
Publié: (2024)
par: Berker, Ratip Emin, et autres
Publié: (2024)
Emergent Coordination in Multi-Agent Systems via Pressure Fields and Temporal Decay
par: Rodriguez, Roland
Publié: (2026)
par: Rodriguez, Roland
Publié: (2026)
Sparse Knowledge Distillation: A Mathematical Framework for Probability-Domain Temperature Scaling and Multi-Stage Compression
par: Flouro, Aaron R., et autres
Publié: (2026)
par: Flouro, Aaron R., et autres
Publié: (2026)
Game Intelligence: Theory and Computation
par: Seven, Mehmet Mars
Publié: (2023)
par: Seven, Mehmet Mars
Publié: (2023)
More at Stake: How Payoff and Language Shape LLM Agent Strategies in Cooperation Dilemmas
par: Huynh, Trung-Kiet, et autres
Publié: (2026)
par: Huynh, Trung-Kiet, et autres
Publié: (2026)
Memory-Augmented State Machine Prompting: A Novel LLM Agent Framework for Real-Time Strategy Games
par: Qi, Runnan, et autres
Publié: (2025)
par: Qi, Runnan, et autres
Publié: (2025)
The Power of Matching for Online Fractional Hedonic Games
par: Bullinger, Martin, et autres
Publié: (2025)
par: Bullinger, Martin, et autres
Publié: (2025)
Understanding the Nature of Generative AI as Threshold Logic in High-Dimensional Space
par: Levin, Ilya
Publié: (2026)
par: Levin, Ilya
Publié: (2026)
What Suppresses Nash Equilibrium Play in Large Language Models? Mechanistic Evidence and Causal Control
par: Lekeas, Paraskevas V., et autres
Publié: (2026)
par: Lekeas, Paraskevas V., et autres
Publié: (2026)
Aligning Inductive Bias for Data-Efficient Generalization in State Space Models
par: Chen, Qiyu, et autres
Publié: (2025)
par: Chen, Qiyu, et autres
Publié: (2025)
Ambiguous Online Learning
par: Kosoy, Vanessa
Publié: (2025)
par: Kosoy, Vanessa
Publié: (2025)
Adaptive Discretization in Online Reinforcement Learning
par: Sinclair, Sean R., et autres
Publié: (2021)
par: Sinclair, Sean R., et autres
Publié: (2021)
Federated Domain Generalization with Data-free On-server Matching Gradient
par: Nguyen, Trong-Binh, et autres
Publié: (2025)
par: Nguyen, Trong-Binh, et autres
Publié: (2025)
Imperfect-Recall Games: Equilibrium Concepts and Their Complexity
par: Tewolde, Emanuel, et autres
Publié: (2024)
par: Tewolde, Emanuel, et autres
Publié: (2024)
Low communication protocols for fair allocation of indivisible goods
par: Feige, Uriel
Publié: (2024)
par: Feige, Uriel
Publié: (2024)
Nested replicator dynamics, nested logit choice, and similarity-based learning
par: Mertikopoulos, Panayotis, et autres
Publié: (2024)
par: Mertikopoulos, Panayotis, et autres
Publié: (2024)
Documents similaires
-
Adversarial Learning in Games with Bandit Feedback: Logarithmic Pure-Strategy Maximin Regret
par: Ito, Shinji, et autres
Publié: (2026) -
Fair Division in a Variable Setting
par: Chandramouleeswaran, Harish, et autres
Publié: (2024) -
Improved Approximation Ratio for Strategyproof Facility Location on a Cycle
par: Rogowski, Krzysztof, et autres
Publié: (2025) -
A Parallelizable Approach for Characterizing NE in Zero-Sum Games After a Linear Number of Iterations of Gradient Descent
par: Kim, Taemin, et autres
Publié: (2025) -
Regret Bounds for Robust Online Decision Making
par: Appel, Alexander, et autres
Publié: (2025)