PokerBench: Training Large Language Models to become Professional Poker Players
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhuang, Richard, Gupta, Akshat, Yang, Richard, Rahane, Aniket, Li, Zhengyu, Anumanchipalli, Gopala |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
PokerSkill: LLMs Can Play Expert-Level Poker without Training or Solvers
por: Li, Boning, et al.
Publicado: (2026)
por: Li, Boning, et al.
Publicado: (2026)
A Survey on Game Theory Optimal Poker
por: Sonawane, Prathamesh, et al.
Publicado: (2024)
por: Sonawane, Prathamesh, et al.
Publicado: (2024)
The Topology of Poker
por: Bartholdi, Laurent, et al.
Publicado: (2023)
por: Bartholdi, Laurent, et al.
Publicado: (2023)
Beyond Game Theory Optimal: Profit-Maximizing Poker Agents for No-Limit Holdem
por: Yi, SeungHyun, et al.
Publicado: (2025)
por: Yi, SeungHyun, et al.
Publicado: (2025)
SpinGPT: A Large-Language-Model Approach to Playing Poker Correctly
por: Maugin, Narada, et al.
Publicado: (2025)
por: Maugin, Narada, et al.
Publicado: (2025)
Limit Continuous Poker: A Variant of Continuous Poker with Limited Bet Sizes
por: Spears, Andrew
Publicado: (2026)
por: Spears, Andrew
Publicado: (2026)
Playing the Player: A Heuristic Framework for Adaptive Poker AI
por: Paterson, Andrew, et al.
Publicado: (2025)
por: Paterson, Andrew, et al.
Publicado: (2025)
von Neumann and Newman Pokers with Finite Decks
por: Krityakierne, Tipaluck, et al.
Publicado: (2024)
por: Krityakierne, Tipaluck, et al.
Publicado: (2024)
Signal Observation Models and Historical Information Integration in Poker Hand Abstraction
por: Fu, Yanchang, et al.
Publicado: (2024)
por: Fu, Yanchang, et al.
Publicado: (2024)
Rebuilding ROME : Resolving Model Collapse during Sequential Model Editing
por: Gupta, Akshat, et al.
Publicado: (2024)
por: Gupta, Akshat, et al.
Publicado: (2024)
Are Large Language Models Strategic Decision Makers? A Study of Performance and Bias in Two-Player Non-Zero-Sum Games
por: Herr, Nathan, et al.
Publicado: (2024)
por: Herr, Nathan, et al.
Publicado: (2024)
A Unified Framework for Model Editing
por: Gupta, Akshat, et al.
Publicado: (2024)
por: Gupta, Akshat, et al.
Publicado: (2024)
Self-Assessment Tests are Unreliable Measures of LLM Personality
por: Gupta, Akshat, et al.
Publicado: (2023)
por: Gupta, Akshat, et al.
Publicado: (2023)
Model Editing at Scale leads to Gradual and Catastrophic Forgetting
por: Gupta, Akshat, et al.
Publicado: (2024)
por: Gupta, Akshat, et al.
Publicado: (2024)
Is Bigger Edit Batch Size Always Better? -- An Empirical Study on Model Editing with Llama-3
por: Yoon, Junsang, et al.
Publicado: (2024)
por: Yoon, Junsang, et al.
Publicado: (2024)
Geometric Interpretation of Layer Normalization and a Comparative Analysis with RMSNorm
por: Gupta, Akshat, et al.
Publicado: (2024)
por: Gupta, Akshat, et al.
Publicado: (2024)
Peer-Predictive Self-Training for Language Model Reasoning
por: Feng, Shi, et al.
Publicado: (2026)
por: Feng, Shi, et al.
Publicado: (2026)
PokerGPT: An End-to-End Lightweight Solver for Multi-Player Texas Hold'em via Large Language Model
por: Huang, Chenghao, et al.
Publicado: (2024)
por: Huang, Chenghao, et al.
Publicado: (2024)
Eliciting Informative Text Evaluations with Large Language Models
por: Lu, Yuxuan, et al.
Publicado: (2024)
por: Lu, Yuxuan, et al.
Publicado: (2024)
Language Self-Play For Data-Free Training
por: Kuba, Jakub Grudzien, et al.
Publicado: (2025)
por: Kuba, Jakub Grudzien, et al.
Publicado: (2025)
Strategic Intelligence in Large Language Models: Evidence from evolutionary Game Theory
por: Payne, Kenneth, et al.
Publicado: (2025)
por: Payne, Kenneth, et al.
Publicado: (2025)
How Do LLMs Use Their Depth?
por: Gupta, Akshat, et al.
Publicado: (2025)
por: Gupta, Akshat, et al.
Publicado: (2025)
Efficient Knowledge Editing via Minimal Precomputation
por: Gupta, Akshat, et al.
Publicado: (2025)
por: Gupta, Akshat, et al.
Publicado: (2025)
Multi-Head Attention Is a Multi-Player Game
por: Chakrabarti, Kushal, et al.
Publicado: (2026)
por: Chakrabarti, Kushal, et al.
Publicado: (2026)
Steering Language Models with Game-Theoretic Solvers
por: Gemp, Ian, et al.
Publicado: (2024)
por: Gemp, Ian, et al.
Publicado: (2024)
On the Fundamental Impossibility of Hallucination Control in Large Language Models
por: Karpowicz, Michał P.
Publicado: (2025)
por: Karpowicz, Michał P.
Publicado: (2025)
On The Truthfulness of 'Surprisingly Likely' Responses of Large Language Models
por: Goel, Naman
Publicado: (2023)
por: Goel, Naman
Publicado: (2023)
Distributive Fairness in Large Language Models: Evaluating Alignment with Human Values
por: Hosseini, Hadi, et al.
Publicado: (2025)
por: Hosseini, Hadi, et al.
Publicado: (2025)
Large Model Strategic Thinking, Small Model Efficiency: Transferring Theory of Mind in Large Language Models
por: Lore, Nunzio, et al.
Publicado: (2024)
por: Lore, Nunzio, et al.
Publicado: (2024)
Fairshare Data Pricing via Data Valuation for Large Language Models
por: Zhang, Luyang, et al.
Publicado: (2025)
por: Zhang, Luyang, et al.
Publicado: (2025)
The Oracle Has Spoken: A Multi-Aspect Evaluation of Dialogue in Pythia
por: Chen, Zixun, et al.
Publicado: (2025)
por: Chen, Zixun, et al.
Publicado: (2025)
The Language of Bargaining: Linguistic Effects in LLM Negotiations
por: Sinha, Stuti, et al.
Publicado: (2026)
por: Sinha, Stuti, et al.
Publicado: (2026)
PrefBench: Evaluating Zero-Shot LLM Agents in Hidden-Preference Personalized Pricing Negotiations
por: Lei, Yingjie
Publicado: (2026)
por: Lei, Yingjie
Publicado: (2026)
Incentivizing Inclusive Contributions in Model Sharing Markets
por: Zhang, Enpei, et al.
Publicado: (2025)
por: Zhang, Enpei, et al.
Publicado: (2025)
Evolving Diverse Red-team Language Models in Multi-round Multi-agent Games
por: Ma, Chengdong, et al.
Publicado: (2023)
por: Ma, Chengdong, et al.
Publicado: (2023)
Personality Modeling for Persuasion of Misinformation using AI Agent
por: Lou, Qianmin, et al.
Publicado: (2025)
por: Lou, Qianmin, et al.
Publicado: (2025)
Identifying Multiple Personalities in Large Language Models with External Evaluation
por: Song, Xiaoyang, et al.
Publicado: (2024)
por: Song, Xiaoyang, et al.
Publicado: (2024)
Prompting Fairness: Artificial Intelligence as Game Players
por: Henry, Jazmia
Publicado: (2024)
por: Henry, Jazmia
Publicado: (2024)
FineZip : Pushing the Limits of Large Language Models for Practical Lossless Text Compression
por: Mittu, Fazal, et al.
Publicado: (2024)
por: Mittu, Fazal, et al.
Publicado: (2024)
Complexity of the Existence of Constrained Secure Equilibria in Multi-Player Games
por: Mizuno, Hiroki, et al.
Publicado: (2025)
por: Mizuno, Hiroki, et al.
Publicado: (2025)
Ejemplares similares
-
PokerSkill: LLMs Can Play Expert-Level Poker without Training or Solvers
por: Li, Boning, et al.
Publicado: (2026) -
A Survey on Game Theory Optimal Poker
por: Sonawane, Prathamesh, et al.
Publicado: (2024) -
The Topology of Poker
por: Bartholdi, Laurent, et al.
Publicado: (2023) -
Beyond Game Theory Optimal: Profit-Maximizing Poker Agents for No-Limit Holdem
por: Yi, SeungHyun, et al.
Publicado: (2025) -
SpinGPT: A Large-Language-Model Approach to Playing Poker Correctly
por: Maugin, Narada, et al.
Publicado: (2025)