Learning Equilibria in Matching Games with Bandit Feedback
Fuente:
arXiv
Guardado en:
| Autores principales: | Athanasopoulos, Andreas, Dimitrakakis, Christos |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Probably Correct Optimal Stable Matching for Two-Sided Markets Under Uncertainty
por: Athanasopoulos, Andreas, et al.
Publicado: (2025)
por: Athanasopoulos, Andreas, et al.
Publicado: (2025)
Two-Player Zero-Sum Games with Bandit Feedback
por: Yılmaz, Elif, et al.
Publicado: (2025)
por: Yılmaz, Elif, et al.
Publicado: (2025)
Rawlsian many-to-one matching with non-linear utility
por: Nana, Hortence, et al.
Publicado: (2025)
por: Nana, Hortence, et al.
Publicado: (2025)
Strategic Linear Contextual Bandits
por: Buening, Thomas Kleine, et al.
Publicado: (2024)
por: Buening, Thomas Kleine, et al.
Publicado: (2024)
Fair Contracts in Principal-Agent Games with Heterogeneous Types
por: Tłuczek, Jakub, et al.
Publicado: (2025)
por: Tłuczek, Jakub, et al.
Publicado: (2025)
Isoperimetry is All We Need: Langevin Posterior Sampling for RL with Sublinear Regret
por: Jorge, Emilio, et al.
Publicado: (2024)
por: Jorge, Emilio, et al.
Publicado: (2024)
Environment Design for Inverse Reinforcement Learning
por: Buening, Thomas Kleine, et al.
Publicado: (2022)
por: Buening, Thomas Kleine, et al.
Publicado: (2022)
Queueing Matching Bandits with Preference Feedback
por: Kim, Jung-hun, et al.
Publicado: (2024)
por: Kim, Jung-hun, et al.
Publicado: (2024)
Sequential Cohort Selection
por: Nana, Hortence Phalonne, et al.
Publicado: (2025)
por: Nana, Hortence Phalonne, et al.
Publicado: (2025)
Bandits with Preference Feedback: A Stackelberg Game Perspective
por: Pásztor, Barna, et al.
Publicado: (2024)
por: Pásztor, Barna, et al.
Publicado: (2024)
The Harder Path: Last Iterate Convergence for Uncoupled Learning in Zero-Sum Games with Bandit Feedback
por: Fiegel, Côme, et al.
Publicado: (2026)
por: Fiegel, Côme, et al.
Publicado: (2026)
Performative Prediction with Bandit Feedback: Learning through Reparameterization
por: Chen, Yatong, et al.
Publicado: (2023)
por: Chen, Yatong, et al.
Publicado: (2023)
Doubly Optimal No-Regret Online Learning in Strongly Monotone Games with Bandit Feedback
por: Ba, Wenjia, et al.
Publicado: (2021)
por: Ba, Wenjia, et al.
Publicado: (2021)
Near-Optimal Last-Iterate Convergence for Zero-Sum Games with Bandit Feedback and Opponent Actions
por: Hait, Soumita, et al.
Publicado: (2026)
por: Hait, Soumita, et al.
Publicado: (2026)
Nearest Neighbour with Bandit Feedback
por: Pasteris, Stephen, et al.
Publicado: (2023)
por: Pasteris, Stephen, et al.
Publicado: (2023)
Efficient Algorithms for Logistic Contextual Slate Bandits with Bandit Feedback
por: Goyal, Tanmay, et al.
Publicado: (2025)
por: Goyal, Tanmay, et al.
Publicado: (2025)
Deep Learning Methods for Detecting Thermal Runaway Events in Battery Production Lines
por: Athanasopoulos, Athanasios, et al.
Publicado: (2025)
por: Athanasopoulos, Athanasios, et al.
Publicado: (2025)
Constrained Feedback Learning for Non-Stationary Multi-Armed Bandits
por: Li, Shaoang, et al.
Publicado: (2025)
por: Li, Shaoang, et al.
Publicado: (2025)
Learning Markov Decision Processes under Fully Bandit Feedback
por: Zhuo, Zhengjia, et al.
Publicado: (2026)
por: Zhuo, Zhengjia, et al.
Publicado: (2026)
A General Framework for Clustering and Distribution Matching with Bandit Feedback
por: Yavas, Recep Can, et al.
Publicado: (2024)
por: Yavas, Recep Can, et al.
Publicado: (2024)
Lipschitz Bandits with Stochastic Delayed Feedback
por: Liu, Zhongxuan, et al.
Publicado: (2025)
por: Liu, Zhongxuan, et al.
Publicado: (2025)
Graph Feedback Bandits with Similar Arms
por: Qi, Han, et al.
Publicado: (2024)
por: Qi, Han, et al.
Publicado: (2024)
Nonparametric Kernel Clustering with Bandit Feedback
por: Thuot, Victor, et al.
Publicado: (2026)
por: Thuot, Victor, et al.
Publicado: (2026)
Optimal Analysis for Bandit Learning in Matching Markets with Serial Dictatorship
por: Wang, Zilong, et al.
Publicado: (2025)
por: Wang, Zilong, et al.
Publicado: (2025)
Adaptive Client Sampling in Federated Learning via Online Learning with Bandit Feedback
por: Zhao, Boxin, et al.
Publicado: (2021)
por: Zhao, Boxin, et al.
Publicado: (2021)
Last-Iterate Convergence of No-Regret Learning for Equilibria in Bargaining Games
por: Kamp, Serafina, et al.
Publicado: (2025)
por: Kamp, Serafina, et al.
Publicado: (2025)
Nearly Tight Bounds for Cross-Learning Contextual Bandits with Graphical Feedback
por: Huang, Ruiyuan, et al.
Publicado: (2025)
por: Huang, Ruiyuan, et al.
Publicado: (2025)
Pure Exploration for a Good Policy in Reinforcement Learning with Bandit Feedback
por: Li, Zitian, et al.
Publicado: (2026)
por: Li, Zitian, et al.
Publicado: (2026)
Optimal Clustering with Bandit Feedback
por: Yang, Junwen, et al.
Publicado: (2022)
por: Yang, Junwen, et al.
Publicado: (2022)
Operator Splitting for Learning to Predict Equilibria in Convex Games
por: McKenzie, Daniel, et al.
Publicado: (2021)
por: McKenzie, Daniel, et al.
Publicado: (2021)
Learning to Schedule Online Tasks with Bandit Feedback
por: Xu, Yongxin, et al.
Publicado: (2024)
por: Xu, Yongxin, et al.
Publicado: (2024)
Cascading Bandits With Feedback
por: Prakash, R Sri, et al.
Publicado: (2025)
por: Prakash, R Sri, et al.
Publicado: (2025)
Stochastic $k$-Submodular Bandits with Full Bandit Feedback
por: Nie, Guanyu, et al.
Publicado: (2024)
por: Nie, Guanyu, et al.
Publicado: (2024)
Constrained Pareto Set Identification with Bandit Feedback
por: Kone, Cyrille, et al.
Publicado: (2025)
por: Kone, Cyrille, et al.
Publicado: (2025)
Does Feedback Help in Bandits with Arm Erasures?
por: Karakas, Merve, et al.
Publicado: (2025)
por: Karakas, Merve, et al.
Publicado: (2025)
Bandit and Delayed Feedback in Online Structured Prediction
por: Shibukawa, Yuki, et al.
Publicado: (2025)
por: Shibukawa, Yuki, et al.
Publicado: (2025)
Beyond Bandit Feedback in Online Multiclass Classification
por: van der Hoeven, Dirk, et al.
Publicado: (2021)
por: van der Hoeven, Dirk, et al.
Publicado: (2021)
Efficient Contextual Bandits with Uninformed Feedback Graphs
por: Zhang, Mengxiao, et al.
Publicado: (2024)
por: Zhang, Mengxiao, et al.
Publicado: (2024)
Multiclass Online Learnability under Bandit Feedback
por: Raman, Ananth, et al.
Publicado: (2023)
por: Raman, Ananth, et al.
Publicado: (2023)
Biased Dueling Bandits with Stochastic Delayed Feedback
por: Yi, Bongsoo, et al.
Publicado: (2024)
por: Yi, Bongsoo, et al.
Publicado: (2024)
Ejemplares similares
-
Probably Correct Optimal Stable Matching for Two-Sided Markets Under Uncertainty
por: Athanasopoulos, Andreas, et al.
Publicado: (2025) -
Two-Player Zero-Sum Games with Bandit Feedback
por: Yılmaz, Elif, et al.
Publicado: (2025) -
Rawlsian many-to-one matching with non-linear utility
por: Nana, Hortence, et al.
Publicado: (2025) -
Strategic Linear Contextual Bandits
por: Buening, Thomas Kleine, et al.
Publicado: (2024) -
Fair Contracts in Principal-Agent Games with Heterogeneous Types
por: Tłuczek, Jakub, et al.
Publicado: (2025)