Reward Hacking as Equilibrium under Finite Evaluation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Jiacheng, Huang, Jinbin |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Synthesis of Reward Machines for Multi-Agent Equilibrium Design (Full Version)
par: Najib, Muhammad, et autres
Publié: (2024)
par: Najib, Muhammad, et autres
Publié: (2024)
Equilibrium of Data Markets with Externality
par: Hossain, Safwan, et autres
Publié: (2023)
par: Hossain, Safwan, et autres
Publié: (2023)
Computing Ex Ante Equilibrium in Heterogeneous Zero-Sum Team Games
par: Liu, Naming, et autres
Publié: (2024)
par: Liu, Naming, et autres
Publié: (2024)
Beyond Nash Equilibrium: Bounded Rationality of LLMs and humans in Strategic Decision-making
par: Zheng, Kehan, et autres
Publié: (2025)
par: Zheng, Kehan, et autres
Publié: (2025)
Large Language Models Playing Mixed Strategy Nash Equilibrium Games
par: Silva, Alonso
Publié: (2024)
par: Silva, Alonso
Publié: (2024)
Minimally Modifying a Markov Game to Achieve Any Nash Equilibrium and Value
par: Wu, Young, et autres
Publié: (2023)
par: Wu, Young, et autres
Publié: (2023)
Approximate Nash Equilibrium Learning for n-Player Markov Games in Dynamic Pricing
par: Liu, Larkin
Publié: (2022)
par: Liu, Larkin
Publié: (2022)
Paths to Equilibrium in Games
par: Yongacoglu, Bora, et autres
Publié: (2024)
par: Yongacoglu, Bora, et autres
Publié: (2024)
Explore Reinforced: Equilibrium Approximation with Reinforcement Learning
par: Yu, Ryan, et autres
Publié: (2024)
par: Yu, Ryan, et autres
Publié: (2024)
Path Dependence under Adaptive AI Delegation
par: Huang, Lingxiao, et autres
Publié: (2026)
par: Huang, Lingxiao, et autres
Publié: (2026)
Large-Scale Auto-bidding with Nash Equilibrium Constraints
par: Mou, Zhiyu, et autres
Publié: (2025)
par: Mou, Zhiyu, et autres
Publié: (2025)
Optimal Welfare in Noncooperative Network Formation under Attack
par: Doubez, Natan, et autres
Publié: (2025)
par: Doubez, Natan, et autres
Publié: (2025)
Algorithmic Decision-Making under Agents with Persistent Improvement
par: Xie, Tian, et autres
Publié: (2024)
par: Xie, Tian, et autres
Publié: (2024)
TMGBench: A Systematic Game Benchmark for Evaluating Strategic Reasoning Abilities of LLMs
par: Wang, Haochuan, et autres
Publié: (2024)
par: Wang, Haochuan, et autres
Publié: (2024)
PokerSkill: LLMs Can Play Expert-Level Poker without Training or Solvers
par: Li, Boning, et autres
Publié: (2026)
par: Li, Boning, et autres
Publié: (2026)
A General Equilibrium Theory of Orchestrated AI Agent Systems
par: Garnier, Jean-Philippe
Publié: (2026)
par: Garnier, Jean-Philippe
Publié: (2026)
Nash CoT: Multi-Path Inference with Preference Equilibrium
par: Zhang, Ziqi, et autres
Publié: (2024)
par: Zhang, Ziqi, et autres
Publié: (2024)
Feint Behaviors and Strategies: Formalization, Implementation and Evaluation
par: Liu, Junyu, et autres
Publié: (2024)
par: Liu, Junyu, et autres
Publié: (2024)
Ex Ante Evaluation of AI-Induced Idea Diversity Collapse
par: Azad, Nafis Saami, et autres
Publié: (2026)
par: Azad, Nafis Saami, et autres
Publié: (2026)
Robust Reward Design for Markov Decision Processes
par: Wu, Shuo, et autres
Publié: (2024)
par: Wu, Shuo, et autres
Publié: (2024)
Quadratic Programming Approach for Nash Equilibrium Computation in Multiplayer Imperfect-Information Games
par: Ganzfried, Sam
Publié: (2025)
par: Ganzfried, Sam
Publié: (2025)
Governing Strategic Dynamics: Equilibrium Stabilization via Divergence-Driven Control
par: Shi, Hao, et autres
Publié: (2025)
par: Shi, Hao, et autres
Publié: (2025)
Bounds of Block Rewards in Honest PinFi Systems
par: He, Qi, et autres
Publié: (2024)
par: He, Qi, et autres
Publié: (2024)
In-Context Exploiter for Extensive-Form Games
par: Li, Shuxin, et autres
Publié: (2024)
par: Li, Shuxin, et autres
Publié: (2024)
Accelerating Nash Equilibrium Convergence in Monte Carlo Settings Through Counterfactual Value Based Fictitious Play
par: Qi, Ju, et autres
Publié: (2023)
par: Qi, Ju, et autres
Publié: (2023)
Observable Perfect Equilibrium
par: Ganzfried, Sam
Publié: (2022)
par: Ganzfried, Sam
Publié: (2022)
Who Gets the Reward, Who Gets the Blame? Evaluation-Aligned Training Signals for Multi-LLM Agents
par: Yang, Chih-Hsuan, et autres
Publié: (2025)
par: Yang, Chih-Hsuan, et autres
Publié: (2025)
KrwEmd: Revising the Imperfect-Recall Abstraction from Forgetting Everything
par: Fu, Yanchang, et autres
Publié: (2025)
par: Fu, Yanchang, et autres
Publié: (2025)
Beyond Outcome-Based Imperfect-Recall: Higher-Resolution Abstractions for Imperfect-Information Games
par: Fu, Yanchang, et autres
Publié: (2025)
par: Fu, Yanchang, et autres
Publié: (2025)
Deep Automated Mechanism Design for Integrating Ad Auction and Allocation in Feed
par: Li, Xuejian, et autres
Publié: (2024)
par: Li, Xuejian, et autres
Publié: (2024)
MORE-3S:Multimodal-based Offline Reinforcement Learning with Shared Semantic Spaces
par: Zheng, Tianyu, et autres
Publié: (2024)
par: Zheng, Tianyu, et autres
Publié: (2024)
Mechanism Design Is Not Enough: Prosocial Agents for Cooperative AI
par: Huang, Xuanqiang Angelo, et autres
Publié: (2026)
par: Huang, Xuanqiang Angelo, et autres
Publié: (2026)
The Disparate Effects of Partial Information in Bayesian Strategic Learning
par: Avasarala, Srikanth, et autres
Publié: (2025)
par: Avasarala, Srikanth, et autres
Publié: (2025)
Sponsored Questions and How to Auction Them
par: Bhawalkar, Kshipra, et autres
Publié: (2025)
par: Bhawalkar, Kshipra, et autres
Publié: (2025)
Tiny Multi-Agent DRL for Twins Migration in UAV Metaverses: A Multi-Leader Multi-Follower Stackelberg Game Approach
par: Kang, Jiawen, et autres
Publié: (2024)
par: Kang, Jiawen, et autres
Publié: (2024)
Differentially Private Condorcet Voting
par: Li, Zhechen, et autres
Publié: (2022)
par: Li, Zhechen, et autres
Publié: (2022)
Auctions with LLM Summaries
par: Dubey, Kumar Avinava, et autres
Publié: (2024)
par: Dubey, Kumar Avinava, et autres
Publié: (2024)
Pay for The Second-Best Service: A Game-Theoretic Approach Against Dishonest LLM Providers
par: Cao, Yuhan, et autres
Publié: (2025)
par: Cao, Yuhan, et autres
Publié: (2025)
Multi-Sender Persuasion: A Computational Perspective
par: Hossain, Safwan, et autres
Publié: (2024)
par: Hossain, Safwan, et autres
Publié: (2024)
Information Bargaining: Bilateral Commitment in Bayesian Persuasion
par: Lin, Yue, et autres
Publié: (2025)
par: Lin, Yue, et autres
Publié: (2025)
Documents similaires
-
Synthesis of Reward Machines for Multi-Agent Equilibrium Design (Full Version)
par: Najib, Muhammad, et autres
Publié: (2024) -
Equilibrium of Data Markets with Externality
par: Hossain, Safwan, et autres
Publié: (2023) -
Computing Ex Ante Equilibrium in Heterogeneous Zero-Sum Team Games
par: Liu, Naming, et autres
Publié: (2024) -
Beyond Nash Equilibrium: Bounded Rationality of LLMs and humans in Strategic Decision-making
par: Zheng, Kehan, et autres
Publié: (2025) -
Large Language Models Playing Mixed Strategy Nash Equilibrium Games
par: Silva, Alonso
Publié: (2024)