Deviation Ratings: A General, Clone-Invariant Rating Method
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Marris, Luke, Liu, Siqi, Gemp, Ian, Piliouras, Georgios, Lanctot, Marc |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Approximating Nash Equilibria in Normal-Form Games via Stochastic Optimization
par: Gemp, Ian, et autres
Publié: (2023)
par: Gemp, Ian, et autres
Publié: (2023)
Convex Markov Games: A New Frontier for Multi-Agent Reinforcement Learning
par: Gemp, Ian, et autres
Publié: (2024)
par: Gemp, Ian, et autres
Publié: (2024)
Re-evaluating Open-ended Evaluation of Large Language Models
par: Liu, Siqi, et autres
Publié: (2025)
par: Liu, Siqi, et autres
Publié: (2025)
Approximating the Core via Iterative Coalition Sampling
par: Gemp, Ian, et autres
Publié: (2024)
par: Gemp, Ian, et autres
Publié: (2024)
Sequential Causal Normal Form Games: Theory, Computation, and Strategic Signaling
par: Thumm, Dennis
Publié: (2025)
par: Thumm, Dennis
Publié: (2025)
NfgTransformer: Equivariant Representation Learning for Normal-form Games
par: Liu, Siqi, et autres
Publié: (2024)
par: Liu, Siqi, et autres
Publié: (2024)
Active Evaluation of General Agents: Problem Definition and Comparison of Baseline Algorithms
par: Lanctot, Marc, et autres
Publié: (2026)
par: Lanctot, Marc, et autres
Publié: (2026)
Nash without Numbers: A Social Choice Approach to Mixed Equilibria in Context-Ordinal Games
par: Gemp, Ian, et autres
Publié: (2026)
par: Gemp, Ian, et autres
Publié: (2026)
Steering Language Models with Game-Theoretic Solvers
par: Gemp, Ian, et autres
Publié: (2024)
par: Gemp, Ian, et autres
Publié: (2024)
Solving Zero-Sum Convex Markov Games
par: Kalogiannis, Fivos, et autres
Publié: (2025)
par: Kalogiannis, Fivos, et autres
Publié: (2025)
Combining Tree-Search, Generative Models, and Nash Bargaining Concepts in Game-Theoretic Reinforcement Learning
par: Li, Zun, et autres
Publié: (2023)
par: Li, Zun, et autres
Publié: (2023)
Multi-Agent Training beyond Zero-Sum with Correlated Equilibrium Meta-Solvers
par: Marris, Luke, et autres
Publié: (2021)
par: Marris, Luke, et autres
Publié: (2021)
Visualizing 2x2 Normal-Form Games: twoxtwogame LaTeX Package
par: Marris, Luke, et autres
Publié: (2024)
par: Marris, Luke, et autres
Publié: (2024)
Evaluating Agents using Social Choice Theory
par: Lanctot, Marc, et autres
Publié: (2023)
par: Lanctot, Marc, et autres
Publié: (2023)
Identifying Imperfect Clones in Elections
par: Faliszewski, Piotr, et autres
Publié: (2025)
par: Faliszewski, Piotr, et autres
Publié: (2025)
Large Deviations Inequalities for Unequal Probability Sampling Without Replacement
par: Foster, Dean P., et autres
Publié: (2024)
par: Foster, Dean P., et autres
Publié: (2024)
Discovering Multiagent Learning Algorithms with Large Language Models
par: Li, Zun, et autres
Publié: (2026)
par: Li, Zun, et autres
Publié: (2026)
AI-Generated Compromises for Coalition Formation: Modeling, Simulation, and a Textual Case Study
par: Briman, Eyal, et autres
Publié: (2025)
par: Briman, Eyal, et autres
Publié: (2025)
Easy as ABCs: Unifying Boltzmann Q-Learning and Counterfactual Regret Minimization
par: D'Amico-Wong, Luca, et autres
Publié: (2024)
par: D'Amico-Wong, Luca, et autres
Publié: (2024)
Dynamic Coalition Structure Detection in Natural Language-based Interactions
par: Kulkarni, Abhishek N., et autres
Publié: (2025)
par: Kulkarni, Abhishek N., et autres
Publié: (2025)
Deep Incentive Design with Differentiable Equilibrium Blocks
par: Thoma, Vinzenz, et autres
Publié: (2026)
par: Thoma, Vinzenz, et autres
Publié: (2026)
Invariant Price of Anarchy: a Metric for Welfarist Traffic Control
par: Shilov, Ilia, et autres
Publié: (2025)
par: Shilov, Ilia, et autres
Publié: (2025)
BEDA: Belief Estimation as Probabilistic Constraints for Performing Strategic Dialogue Acts
par: Li, Hengli, et autres
Publié: (2025)
par: Li, Hengli, et autres
Publié: (2025)
ShortageSim: Simulating Drug Shortages under Information Asymmetry
par: Cui, Mingxuan, et autres
Publié: (2025)
par: Cui, Mingxuan, et autres
Publié: (2025)
Reply to "Emergent LLM behaviors are observationally equivalent to data leakage"
par: Ashery, Ariel Flint, et autres
Publié: (2025)
par: Ashery, Ariel Flint, et autres
Publié: (2025)
From Necklaces to Coalitions: Fair and Self-Interested Distribution of Coalition Value Calculations
par: Payne, Terry R., et autres
Publié: (2026)
par: Payne, Terry R., et autres
Publié: (2026)
Tight Inapproximability for Welfare-Maximizing Autobidding Equilibria
par: Anagnostides, Ioannis, et autres
Publié: (2026)
par: Anagnostides, Ioannis, et autres
Publié: (2026)
Chaos in Autobidding Auctions
par: Anagnostides, Ioannis, et autres
Publié: (2026)
par: Anagnostides, Ioannis, et autres
Publié: (2026)
On the Tractability Landscape of the Conditional Minisum Approval Voting Rule
par: Amanatidis, Georgios, et autres
Publié: (2024)
par: Amanatidis, Georgios, et autres
Publié: (2024)
Breaking Exponential Complexity in Games of Ordered Preference: A Tractable Reformulation
par: Lee, Dong Ho, et autres
Publié: (2026)
par: Lee, Dong Ho, et autres
Publié: (2026)
Reasoning Like an Economist: Post-Training on Economic Problems Induces Strategic Generalization in LLMs
par: Zhou, Yufa, et autres
Publié: (2025)
par: Zhou, Yufa, et autres
Publié: (2025)
The Inversion Paradox and Ranking Methods in Tournaments
par: Chéze, Guillaume, et autres
Publié: (2025)
par: Chéze, Guillaume, et autres
Publié: (2025)
Formal Methods for An Iterated Volunteer's Dilemma
par: Dineen, Jacob, et autres
Publié: (2020)
par: Dineen, Jacob, et autres
Publié: (2020)
Method of Equal Shares with Bounded Overspending
par: Papasotiropoulos, Georgios, et autres
Publié: (2024)
par: Papasotiropoulos, Georgios, et autres
Publié: (2024)
Who Gets the Reward, Who Gets the Blame? Evaluation-Aligned Training Signals for Multi-LLM Agents
par: Yang, Chih-Hsuan, et autres
Publié: (2025)
par: Yang, Chih-Hsuan, et autres
Publié: (2025)
Incentive Design without Hypergradients: A Social-Gradient Method
par: Vasileiou, Georgios, et autres
Publié: (2026)
par: Vasileiou, Georgios, et autres
Publié: (2026)
Facility Location for Congesting Commuters and Generalizing the Cost-Distance Problem
par: Lianeas, Thanasis, et autres
Publié: (2025)
par: Lianeas, Thanasis, et autres
Publié: (2025)
Distributed Generalized Nash Equilibria Seeking Algorithms Involving Synchronous and Asynchronous Schemes
par: Li, Huaqing, et autres
Publié: (2024)
par: Li, Huaqing, et autres
Publié: (2024)
Principal-Agent Hypothesis Testing
par: Bates, Stephen, et autres
Publié: (2022)
par: Bates, Stephen, et autres
Publié: (2022)
The Memory Curse: How Expanded Recall Erodes Cooperative Intent in LLM Agents
par: Liu, Jiayuan, et autres
Publié: (2026)
par: Liu, Jiayuan, et autres
Publié: (2026)
Documents similaires
-
Approximating Nash Equilibria in Normal-Form Games via Stochastic Optimization
par: Gemp, Ian, et autres
Publié: (2023) -
Convex Markov Games: A New Frontier for Multi-Agent Reinforcement Learning
par: Gemp, Ian, et autres
Publié: (2024) -
Re-evaluating Open-ended Evaluation of Large Language Models
par: Liu, Siqi, et autres
Publié: (2025) -
Approximating the Core via Iterative Coalition Sampling
par: Gemp, Ian, et autres
Publié: (2024) -
Sequential Causal Normal Form Games: Theory, Computation, and Strategic Signaling
par: Thumm, Dennis
Publié: (2025)