Language Self-Play For Data-Free Training
Fuente:
arXiv
Saved in:
| Main Authors: | Kuba, Jakub Grudzien, Gu, Mengting, Ma, Qi, Tian, Yuandong, Mohan, Vijai, Chen, Jason |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Peer-Predictive Self-Training for Language Model Reasoning
by: Feng, Shi, et al.
Published: (2026)
by: Feng, Shi, et al.
Published: (2026)
PokerBench: Training Large Language Models to become Professional Poker Players
by: Zhuang, Richard, et al.
Published: (2025)
by: Zhuang, Richard, et al.
Published: (2025)
Why Do LLMs Struggle in Strategic Play? Broken Links Between Observations, Beliefs, and Actions
by: Sobotka, Jan, et al.
Published: (2026)
by: Sobotka, Jan, et al.
Published: (2026)
The Limits of Preference Data for Post-Training
by: Zhao, Eric, et al.
Published: (2025)
by: Zhao, Eric, et al.
Published: (2025)
Hypergame Rationalisability: Solving Agent Misalignment In Strategic Play
by: Trencsenyi, Vince
Published: (2025)
by: Trencsenyi, Vince
Published: (2025)
The Language of Bargaining: Linguistic Effects in LLM Negotiations
by: Sinha, Stuti, et al.
Published: (2026)
by: Sinha, Stuti, et al.
Published: (2026)
Steering Language Models with Game-Theoretic Solvers
by: Gemp, Ian, et al.
Published: (2024)
by: Gemp, Ian, et al.
Published: (2024)
Eliciting Informative Text Evaluations with Large Language Models
by: Lu, Yuxuan, et al.
Published: (2024)
by: Lu, Yuxuan, et al.
Published: (2024)
Strategic Intelligence in Large Language Models: Evidence from evolutionary Game Theory
by: Payne, Kenneth, et al.
Published: (2025)
by: Payne, Kenneth, et al.
Published: (2025)
Are Large Language Models Strategic Decision Makers? A Study of Performance and Bias in Two-Player Non-Zero-Sum Games
by: Herr, Nathan, et al.
Published: (2024)
by: Herr, Nathan, et al.
Published: (2024)
PokerSkill: LLMs Can Play Expert-Level Poker without Training or Solvers
by: Li, Boning, et al.
Published: (2026)
by: Li, Boning, et al.
Published: (2026)
Playing Large Games with Oracles and AI Debate
by: Chen, Xinyi, et al.
Published: (2023)
by: Chen, Xinyi, et al.
Published: (2023)
Large Language Models Playing Mixed Strategy Nash Equilibrium Games
by: Silva, Alonso
Published: (2024)
by: Silva, Alonso
Published: (2024)
Ad Insertion in LLM-Generated Responses
by: Xu, Shengwei, et al.
Published: (2026)
by: Xu, Shengwei, et al.
Published: (2026)
Incentivizing Inclusive Contributions in Model Sharing Markets
by: Zhang, Enpei, et al.
Published: (2025)
by: Zhang, Enpei, et al.
Published: (2025)
Reasoning Like an Economist: Post-Training on Economic Problems Induces Strategic Generalization in LLMs
by: Zhou, Yufa, et al.
Published: (2025)
by: Zhou, Yufa, et al.
Published: (2025)
Who Gets the Reward, Who Gets the Blame? Evaluation-Aligned Training Signals for Multi-LLM Agents
by: Yang, Chih-Hsuan, et al.
Published: (2025)
by: Yang, Chih-Hsuan, et al.
Published: (2025)
Truthfulness Despite Weak Supervision: Evaluating and Training LLMs Using Peer Prediction
by: Qiu, Tianyi Alex, et al.
Published: (2026)
by: Qiu, Tianyi Alex, et al.
Published: (2026)
Incentive-Aligned Multi-Source LLM Summaries
by: Jiang, Yanchen, et al.
Published: (2025)
by: Jiang, Yanchen, et al.
Published: (2025)
Generating Fair Consensus Statements with Social Choice on Token-Level MDPs
by: Blair, Carter, et al.
Published: (2025)
by: Blair, Carter, et al.
Published: (2025)
Personality Modeling for Persuasion of Misinformation using AI Agent
by: Lou, Qianmin, et al.
Published: (2025)
by: Lou, Qianmin, et al.
Published: (2025)
Framing the Game: How Context Shapes LLM Decision-Making
by: Robinson, Isaac, et al.
Published: (2025)
by: Robinson, Isaac, et al.
Published: (2025)
ALYMPICS: LLM Agents Meet Game Theory -- Exploring Strategic Decision-Making with AI Agents
by: Mao, Shaoguang, et al.
Published: (2023)
by: Mao, Shaoguang, et al.
Published: (2023)
How Well Can LLMs Negotiate? NegotiationArena Platform and Analysis
by: Bianchi, Federico, et al.
Published: (2024)
by: Bianchi, Federico, et al.
Published: (2024)
EconEvals: Benchmarks and Litmus Tests for Economic Decision-Making by LLM Agents
by: Fish, Sara, et al.
Published: (2025)
by: Fish, Sara, et al.
Published: (2025)
Game Reasoning Arena: A Framework and Benchmark for Assessing Reasoning Capabilities of Large Language Models via Game Play
by: Cipolina-Kun, Lucia, et al.
Published: (2025)
by: Cipolina-Kun, Lucia, et al.
Published: (2025)
Playing games with Large language models: Randomness and strategy
by: Vidler, Alicia, et al.
Published: (2025)
by: Vidler, Alicia, et al.
Published: (2025)
Optimal Auction Design in the Joint Advertising
by: Li, Yang, et al.
Published: (2025)
by: Li, Yang, et al.
Published: (2025)
Towards Logically Sound Natural Language Reasoning with Logic-Enhanced Language Model Agents
by: Mensfelt, Agnieszka, et al.
Published: (2024)
by: Mensfelt, Agnieszka, et al.
Published: (2024)
The Attacker in the Mirror: Breaking Self-Consistency in Safety via Anchored Bipolicy Self-Play
by: La Malfa, Gabriele, et al.
Published: (2026)
by: La Malfa, Gabriele, et al.
Published: (2026)
On the Fundamental Impossibility of Hallucination Control in Large Language Models
by: Karpowicz, Michał P.
Published: (2025)
by: Karpowicz, Michał P.
Published: (2025)
From Natural Language to Extensive-Form Game Representations
by: Deng, Shilong, et al.
Published: (2025)
by: Deng, Shilong, et al.
Published: (2025)
On The Truthfulness of 'Surprisingly Likely' Responses of Large Language Models
by: Goel, Naman
Published: (2023)
by: Goel, Naman
Published: (2023)
Language Alignment via Nash-learning and Adaptive feedback
by: Azarafrooz, Ari, et al.
Published: (2024)
by: Azarafrooz, Ari, et al.
Published: (2024)
Integrated Design and Governance of Agentic AI Systems through Adaptive Information Modulation
by: Chen, Qiliang, et al.
Published: (2024)
by: Chen, Qiliang, et al.
Published: (2024)
Strategic Collusion of LLM Agents: Market Division in Multi-Commodity Competitions
by: Lin, Ryan Y., et al.
Published: (2024)
by: Lin, Ryan Y., et al.
Published: (2024)
Distributive Fairness in Large Language Models: Evaluating Alignment with Human Values
by: Hosseini, Hadi, et al.
Published: (2025)
by: Hosseini, Hadi, et al.
Published: (2025)
Iterative Nash Policy Optimization: Aligning LLMs with General Preferences via No-Regret Learning
by: Zhang, Yuheng, et al.
Published: (2024)
by: Zhang, Yuheng, et al.
Published: (2024)
Offline Fictitious Self-Play for Competitive Games
by: Chen, Jingxiao, et al.
Published: (2024)
by: Chen, Jingxiao, et al.
Published: (2024)
Cross-Entropy Games for Language Models: From Implicit Knowledge to General Capability Measures
by: Hongler, Clément, et al.
Published: (2025)
by: Hongler, Clément, et al.
Published: (2025)
Similar Items
-
Peer-Predictive Self-Training for Language Model Reasoning
by: Feng, Shi, et al.
Published: (2026) -
PokerBench: Training Large Language Models to become Professional Poker Players
by: Zhuang, Richard, et al.
Published: (2025) -
Why Do LLMs Struggle in Strategic Play? Broken Links Between Observations, Beliefs, and Actions
by: Sobotka, Jan, et al.
Published: (2026) -
The Limits of Preference Data for Post-Training
by: Zhao, Eric, et al.
Published: (2025) -
Hypergame Rationalisability: Solving Agent Misalignment In Strategic Play
by: Trencsenyi, Vince
Published: (2025)