Efficacy of Language Model Self-Play in Non-Zero-Sum Games
Fuente:
arXiv
Salvato in:
| Autori principali: | Liao, Austen, Tomlin, Nicholas, Klein, Dan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Ghostbuster: Detecting Text Ghostwritten by Large Language Models
di: Verma, Vivek, et al.
Pubblicazione: (2023)
di: Verma, Vivek, et al.
Pubblicazione: (2023)
SPIRAL: Self-Play on Zero-Sum Games Incentivizes Reasoning via Multi-Agent Multi-Turn Reinforcement Learning
di: Liu, Bo, et al.
Pubblicazione: (2025)
di: Liu, Bo, et al.
Pubblicazione: (2025)
Are Large Language Models Strategic Decision Makers? A Study of Performance and Bias in Two-Player Non-Zero-Sum Games
di: Herr, Nathan, et al.
Pubblicazione: (2024)
di: Herr, Nathan, et al.
Pubblicazione: (2024)
Ethical Considerations of Large Language Models in Game Playing
di: Zhang, Qingquan, et al.
Pubblicazione: (2025)
di: Zhang, Qingquan, et al.
Pubblicazione: (2025)
TextGames: Learning to Self-Play Text-Based Puzzle Games via Language Model Reasoning
di: Hudi, Frederikus, et al.
Pubblicazione: (2025)
di: Hudi, Frederikus, et al.
Pubblicazione: (2025)
Enhancing Language Agent Strategic Reasoning through Self-Play in Adversarial Games
di: Zhang, Yikai, et al.
Pubblicazione: (2025)
di: Zhang, Yikai, et al.
Pubblicazione: (2025)
Trans-Zero: Self-Play Incentivizes Large Language Models for Multilingual Translation Without Parallel Data
di: Zou, Wei, et al.
Pubblicazione: (2025)
di: Zou, Wei, et al.
Pubblicazione: (2025)
Characterizing Language Use in a Collaborative Situated Game
di: Tomlin, Nicholas, et al.
Pubblicazione: (2025)
di: Tomlin, Nicholas, et al.
Pubblicazione: (2025)
Calibrate-Then-Act: Cost-Aware Exploration in LLM Agents
di: Ding, Wenxuan, et al.
Pubblicazione: (2026)
di: Ding, Wenxuan, et al.
Pubblicazione: (2026)
Playing Language Game with LLMs Leads to Jailbreaking
di: Peng, Yu, et al.
Pubblicazione: (2024)
di: Peng, Yu, et al.
Pubblicazione: (2024)
RPGBENCH: Evaluating Large Language Models as Role-Playing Game Engines
di: Yu, Pengfei, et al.
Pubblicazione: (2025)
di: Yu, Pengfei, et al.
Pubblicazione: (2025)
VQEL: Enabling Self-Play in Emergent Language Games via Agent-Internal Vector Quantization
di: Paqaleh, Mohammad Mahdi Samiei, et al.
Pubblicazione: (2025)
di: Paqaleh, Mohammad Mahdi Samiei, et al.
Pubblicazione: (2025)
Credence Calibration Game? Calibrating Large Language Models through Structured Play
di: Fang, Ke, et al.
Pubblicazione: (2025)
di: Fang, Ke, et al.
Pubblicazione: (2025)
Decision-Oriented Dialogue for Human-AI Collaboration
di: Lin, Jessy, et al.
Pubblicazione: (2023)
di: Lin, Jessy, et al.
Pubblicazione: (2023)
Play to Generalize: Learning to Reason Through Game Play
di: Xie, Yunfei, et al.
Pubblicazione: (2025)
di: Xie, Yunfei, et al.
Pubblicazione: (2025)
Self-Checker: Plug-and-Play Modules for Fact-Checking with Large Language Models
di: Li, Miaoran, et al.
Pubblicazione: (2023)
di: Li, Miaoran, et al.
Pubblicazione: (2023)
SPELL: Self-Play Reinforcement Learning for Evolving Long-Context Language Models
di: Yang, Ziyi, et al.
Pubblicazione: (2025)
di: Yang, Ziyi, et al.
Pubblicazione: (2025)
What Evidence Do Language Models Find Convincing?
di: Wan, Alexander, et al.
Pubblicazione: (2024)
di: Wan, Alexander, et al.
Pubblicazione: (2024)
Reasoning Capabilities of Large Language Models. Lessons Learned from General Game Playing
di: Świechowski, Maciej, et al.
Pubblicazione: (2026)
di: Świechowski, Maciej, et al.
Pubblicazione: (2026)
Self-Play Preference Optimization for Language Model Alignment
di: Wu, Yue, et al.
Pubblicazione: (2024)
di: Wu, Yue, et al.
Pubblicazione: (2024)
Large Language Models for Zero-Shot Multicultural Name Recognition
di: Phonchai, Thanakorn, et al.
Pubblicazione: (2025)
di: Phonchai, Thanakorn, et al.
Pubblicazione: (2025)
G-Zero: Self-Play for Open-Ended Generation from Zero Data
di: Huang, Chengsong, et al.
Pubblicazione: (2026)
di: Huang, Chengsong, et al.
Pubblicazione: (2026)
EnDive: A Cross-Dialect Benchmark for Fairness and Performance in Large Language Models
di: Gupta, Abhay, et al.
Pubblicazione: (2025)
di: Gupta, Abhay, et al.
Pubblicazione: (2025)
Boosting Self-Efficacy and Performance of Large Language Models via Verbal Efficacy Stimulations
di: Chen, Rui, et al.
Pubblicazione: (2025)
di: Chen, Rui, et al.
Pubblicazione: (2025)
Can Large Language Models Master Complex Card Games?
di: Wang, Wei, et al.
Pubblicazione: (2025)
di: Wang, Wei, et al.
Pubblicazione: (2025)
Better Zero-Shot Reasoning with Role-Play Prompting
di: Kong, Aobo, et al.
Pubblicazione: (2023)
di: Kong, Aobo, et al.
Pubblicazione: (2023)
ZeroSumEval: Scaling LLM Evaluation with Inter-Model Competition
di: Khan, Haidar, et al.
Pubblicazione: (2025)
di: Khan, Haidar, et al.
Pubblicazione: (2025)
Self-Play Fine-Tuning Converts Weak Language Models to Strong Language Models
di: Chen, Zixiang, et al.
Pubblicazione: (2024)
di: Chen, Zixiang, et al.
Pubblicazione: (2024)
Unfamiliar Finetuning Examples Control How Language Models Hallucinate
di: Kang, Katie, et al.
Pubblicazione: (2024)
di: Kang, Katie, et al.
Pubblicazione: (2024)
SPaR: Self-Play with Tree-Search Refinement to Improve Instruction-Following in Large Language Models
di: Cheng, Jiale, et al.
Pubblicazione: (2024)
di: Cheng, Jiale, et al.
Pubblicazione: (2024)
Language Self-Play For Data-Free Training
di: Kuba, Jakub Grudzien, et al.
Pubblicazione: (2025)
di: Kuba, Jakub Grudzien, et al.
Pubblicazione: (2025)
ChronoPlay: A Framework for Modeling Dual Dynamics and Authenticity in Game RAG Benchmarks
di: He, Liyang, et al.
Pubblicazione: (2025)
di: He, Liyang, et al.
Pubblicazione: (2025)
Playing repeated games with Large Language Models
di: Akata, Elif, et al.
Pubblicazione: (2023)
di: Akata, Elif, et al.
Pubblicazione: (2023)
Evaluating Language Translation Models by Playing Telephone
di: Saba, Syeda Jannatus, et al.
Pubblicazione: (2025)
di: Saba, Syeda Jannatus, et al.
Pubblicazione: (2025)
SPC: Evolving Self-Play Critic via Adversarial Games for LLM Reasoning
di: Chen, Jiaqi, et al.
Pubblicazione: (2025)
di: Chen, Jiaqi, et al.
Pubblicazione: (2025)
Role-Play Zero-Shot Prompting with Large Language Models for Open-Domain Human-Machine Conversation
di: Njifenjou, Ahmed, et al.
Pubblicazione: (2024)
di: Njifenjou, Ahmed, et al.
Pubblicazione: (2024)
Self-Improving for Zero-Shot Named Entity Recognition with Large Language Models
di: Xie, Tingyu, et al.
Pubblicazione: (2023)
di: Xie, Tingyu, et al.
Pubblicazione: (2023)
SeRL: Self-Play Reinforcement Learning for Large Language Models with Limited Data
di: Fang, Wenkai, et al.
Pubblicazione: (2025)
di: Fang, Wenkai, et al.
Pubblicazione: (2025)
Learning Concepts, Not Tokens: Self-Supervised Semantic Alignment for Language Models
di: Zhang, Christine, et al.
Pubblicazione: (2026)
di: Zhang, Christine, et al.
Pubblicazione: (2026)
TextAtari: 100K Frames Game Playing with Language Agents
di: Li, Wenhao, et al.
Pubblicazione: (2025)
di: Li, Wenhao, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Ghostbuster: Detecting Text Ghostwritten by Large Language Models
di: Verma, Vivek, et al.
Pubblicazione: (2023) -
SPIRAL: Self-Play on Zero-Sum Games Incentivizes Reasoning via Multi-Agent Multi-Turn Reinforcement Learning
di: Liu, Bo, et al.
Pubblicazione: (2025) -
Are Large Language Models Strategic Decision Makers? A Study of Performance and Bias in Two-Player Non-Zero-Sum Games
di: Herr, Nathan, et al.
Pubblicazione: (2024) -
Ethical Considerations of Large Language Models in Game Playing
di: Zhang, Qingquan, et al.
Pubblicazione: (2025) -
TextGames: Learning to Self-Play Text-Based Puzzle Games via Language Model Reasoning
di: Hudi, Frederikus, et al.
Pubblicazione: (2025)