Code-Space Response Oracles: Generating Interpretable Multi-Agent Policies with Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Hennes, Daniel, Li, Zun, Schultz, John, Lanctot, Marc |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Discovering Multiagent Learning Algorithms with Large Language Models
par: Li, Zun, et autres
Publié: (2026)
par: Li, Zun, et autres
Publié: (2026)
Combining Tree-Search, Generative Models, and Nash Bargaining Concepts in Game-Theoretic Reinforcement Learning
par: Li, Zun, et autres
Publié: (2023)
par: Li, Zun, et autres
Publié: (2023)
Fusion-PSRO: Nash Policy Fusion for Policy Space Response Oracles
par: Lian, Jiesong, et autres
Publié: (2024)
par: Lian, Jiesong, et autres
Publié: (2024)
Active Evaluation of General Agents: Problem Definition and Comparison of Baseline Algorithms
par: Lanctot, Marc, et autres
Publié: (2026)
par: Lanctot, Marc, et autres
Publié: (2026)
Policy Space Response Oracles: A Survey
par: Bighashdel, Ariyan, et autres
Publié: (2024)
par: Bighashdel, Ariyan, et autres
Publié: (2024)
Multi-Agent Training beyond Zero-Sum with Correlated Equilibrium Meta-Solvers
par: Marris, Luke, et autres
Publié: (2021)
par: Marris, Luke, et autres
Publié: (2021)
Evaluating Agents using Social Choice Theory
par: Lanctot, Marc, et autres
Publié: (2023)
par: Lanctot, Marc, et autres
Publié: (2023)
Simulation-Free PSRO: Removing Game Simulation from Policy Space Response Oracles
par: Liu, Yingzhuo, et autres
Publié: (2025)
par: Liu, Yingzhuo, et autres
Publié: (2025)
NePPO: Near-Potential Policy Optimization for General-Sum Multi-Agent Reinforcement Learning
par: Kalanther, Addison, et autres
Publié: (2026)
par: Kalanther, Addison, et autres
Publié: (2026)
Playing Large Games with Oracles and AI Debate
par: Chen, Xinyi, et autres
Publié: (2023)
par: Chen, Xinyi, et autres
Publié: (2023)
Policy-Conditioned Policies for Multi-Agent Task Solving
par: Lin, Yue, et autres
Publié: (2025)
par: Lin, Yue, et autres
Publié: (2025)
On The Truthfulness of 'Surprisingly Likely' Responses of Large Language Models
par: Goel, Naman
Publié: (2023)
par: Goel, Naman
Publié: (2023)
Incentive-Aware Multi-Fidelity Optimization for Generative Advertising in Large Language Models
par: Liu, Jiayuan, et autres
Publié: (2026)
par: Liu, Jiayuan, et autres
Publié: (2026)
Steering Language Models with Game-Theoretic Solvers
par: Gemp, Ian, et autres
Publié: (2024)
par: Gemp, Ian, et autres
Publié: (2024)
An Interpretable Automated Mechanism Design Framework with Large Language Models
par: Liu, Jiayuan, et autres
Publié: (2025)
par: Liu, Jiayuan, et autres
Publié: (2025)
Puzzle it Out: Local-to-Global World Model for Offline Multi-Agent Reinforcement Learning
par: Li, Sijia, et autres
Publié: (2026)
par: Li, Sijia, et autres
Publié: (2026)
SpinGPT: A Large-Language-Model Approach to Playing Poker Correctly
par: Maugin, Narada, et autres
Publié: (2025)
par: Maugin, Narada, et autres
Publié: (2025)
A New Lower Bound for the Random Offerer Mechanism in Bilateral Trade using AI-Guided Evolutionary Search
par: Cai, Yang, et autres
Publié: (2026)
par: Cai, Yang, et autres
Publié: (2026)
Game Theory Meets Large Language Models: A Systematic Survey with Taxonomy and New Frontiers
par: Sun, Haoran, et autres
Publié: (2025)
par: Sun, Haoran, et autres
Publié: (2025)
Cooperative Game-Theoretic Credit Assignment for Multi-Agent Policy Gradients via the Core
par: Ji, Mengda, et autres
Publié: (2025)
par: Ji, Mengda, et autres
Publié: (2025)
Human Choice Prediction in Language-based Persuasion Games: Simulation-based Off-Policy Evaluation
par: Shapira, Eilam, et autres
Publié: (2023)
par: Shapira, Eilam, et autres
Publié: (2023)
From External to Swap Regret 2.0: An Efficient Reduction and Oblivious Adversary for Large Action Spaces
par: Dagan, Yuval, et autres
Publié: (2023)
par: Dagan, Yuval, et autres
Publié: (2023)
Re-evaluating Open-ended Evaluation of Large Language Models
par: Liu, Siqi, et autres
Publié: (2025)
par: Liu, Siqi, et autres
Publié: (2025)
Policy Aggregation
par: Alamdari, Parand A., et autres
Publié: (2024)
par: Alamdari, Parand A., et autres
Publié: (2024)
Agent-Temporal Credit Assignment for Optimal Policy Preservation in Sparse Multi-Agent Reinforcement Learning
par: Kapoor, Aditya, et autres
Publié: (2024)
par: Kapoor, Aditya, et autres
Publié: (2024)
Spot Check Equivalence: an Interpretable Metric for Information Elicitation Mechanisms
par: Xu, Shengwei, et autres
Publié: (2024)
par: Xu, Shengwei, et autres
Publié: (2024)
Conflux-PSRO: Effectively Leveraging Collective Advantages in Policy Space Response Oracles
par: Huang, Yucong, et autres
Publié: (2024)
par: Huang, Yucong, et autres
Publié: (2024)
Bi-Level Policy Optimization with Nyström Hypergradients
par: Prakash, Arjun, et autres
Publié: (2025)
par: Prakash, Arjun, et autres
Publié: (2025)
Model-Based RL for Mean-Field Games is not Statistically Harder than Single-Agent RL
par: Huang, Jiawei, et autres
Publié: (2024)
par: Huang, Jiawei, et autres
Publié: (2024)
Autoformalization of Game Descriptions using Large Language Models
par: Mensfelt, Agnieszka, et autres
Publié: (2024)
par: Mensfelt, Agnieszka, et autres
Publié: (2024)
Incentivizing Truthful Language Models via Peer Elicitation Games
par: Chen, Baiting, et autres
Publié: (2025)
par: Chen, Baiting, et autres
Publié: (2025)
ElicitationGPT: Text Elicitation Mechanisms via Language Models
par: Wu, Yifan, et autres
Publié: (2024)
par: Wu, Yifan, et autres
Publié: (2024)
On the Fundamental Impossibility of Hallucination Control in Large Language Models
par: Karpowicz, Michał P.
Publié: (2025)
par: Karpowicz, Michał P.
Publié: (2025)
LLMs as Strategic Agents: Beliefs, Best Response Behavior, and Emergent Heuristics
par: de Fortuny, Enric Junque, et autres
Publié: (2025)
par: de Fortuny, Enric Junque, et autres
Publié: (2025)
On Corrigibility and Alignment in Multi Agent Games
par: Dable-Heath, Edmund, et autres
Publié: (2025)
par: Dable-Heath, Edmund, et autres
Publié: (2025)
Generalized Principal-Agent Problem with a Learning Agent
par: Lin, Tao, et autres
Publié: (2024)
par: Lin, Tao, et autres
Publié: (2024)
Evaluating LLM Agent Collusion in Double Auctions
par: Agrawal, Kushal, et autres
Publié: (2025)
par: Agrawal, Kushal, et autres
Publié: (2025)
Learning in Games with Progressive Hiding
par: Heymann, Benjamin, et autres
Publié: (2024)
par: Heymann, Benjamin, et autres
Publié: (2024)
Procedural Fairness in Multi-Agent Bandits
par: Caiata, Joshua, et autres
Publié: (2026)
par: Caiata, Joshua, et autres
Publié: (2026)
Strategic Bidding in 6G Spectrum Auctions with Large Language Models
par: Lotfi, Ismail, et autres
Publié: (2026)
par: Lotfi, Ismail, et autres
Publié: (2026)
Documents similaires
-
Discovering Multiagent Learning Algorithms with Large Language Models
par: Li, Zun, et autres
Publié: (2026) -
Combining Tree-Search, Generative Models, and Nash Bargaining Concepts in Game-Theoretic Reinforcement Learning
par: Li, Zun, et autres
Publié: (2023) -
Fusion-PSRO: Nash Policy Fusion for Policy Space Response Oracles
par: Lian, Jiesong, et autres
Publié: (2024) -
Active Evaluation of General Agents: Problem Definition and Comparison of Baseline Algorithms
par: Lanctot, Marc, et autres
Publié: (2026) -
Policy Space Response Oracles: A Survey
par: Bighashdel, Ariyan, et autres
Publié: (2024)