Can Large Language Models Play Text Games Well? Current State-of-the-Art and Open Questions
Fuente:
arXiv
Salvato in:
| Autori principali: | Tsai, Chen Feng, Zhou, Xiaochen, Liu, Sierra S., Li, Jing, Yu, Mo, Mei, Hongyuan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
MANGO: A Benchmark for Evaluating Mapping and Navigation Abilities of Large Language Models
di: Ding, Peng, et al.
Pubblicazione: (2024)
di: Ding, Peng, et al.
Pubblicazione: (2024)
Playing With AI: How Do State-Of-The-Art Large Language Models Perform in the 1977 Text-Based Adventure Game Zork?
di: Gerrits, Berry
Pubblicazione: (2026)
di: Gerrits, Berry
Pubblicazione: (2026)
TextAtari: 100K Frames Game Playing with Language Agents
di: Li, Wenhao, et al.
Pubblicazione: (2025)
di: Li, Wenhao, et al.
Pubblicazione: (2025)
Ethical Considerations of Large Language Models in Game Playing
di: Zhang, Qingquan, et al.
Pubblicazione: (2025)
di: Zhang, Qingquan, et al.
Pubblicazione: (2025)
GuessingGame: Measuring the Informativeness of Open-Ended Questions in Large Language Models
di: Hutson, Dylan, et al.
Pubblicazione: (2025)
di: Hutson, Dylan, et al.
Pubblicazione: (2025)
Can Large Language Models Replicate ITS Feedback on Open-Ended Math Questions?
di: McNichols, Hunter, et al.
Pubblicazione: (2024)
di: McNichols, Hunter, et al.
Pubblicazione: (2024)
TextGames: Learning to Self-Play Text-Based Puzzle Games via Language Model Reasoning
di: Hudi, Frederikus, et al.
Pubblicazione: (2025)
di: Hudi, Frederikus, et al.
Pubblicazione: (2025)
A Survey on Hallucination in Large Language Models: Principles, Taxonomy, Challenges, and Open Questions
di: Huang, Lei, et al.
Pubblicazione: (2023)
di: Huang, Lei, et al.
Pubblicazione: (2023)
LLMs Can Also Do Well! Breaking Barriers in Semantic Role Labeling via Large Language Models
di: Li, Xinxin, et al.
Pubblicazione: (2025)
di: Li, Xinxin, et al.
Pubblicazione: (2025)
Hypothesis Generation with Large Language Models
di: Zhou, Yangqiaoyu, et al.
Pubblicazione: (2024)
di: Zhou, Yangqiaoyu, et al.
Pubblicazione: (2024)
RPGBENCH: Evaluating Large Language Models as Role-Playing Game Engines
di: Yu, Pengfei, et al.
Pubblicazione: (2025)
di: Yu, Pengfei, et al.
Pubblicazione: (2025)
Can Perplexity Reflect Large Language Model's Ability in Long Text Understanding?
di: Hu, Yutong, et al.
Pubblicazione: (2024)
di: Hu, Yutong, et al.
Pubblicazione: (2024)
Large Language Models in Cybersecurity: State-of-the-Art
di: Motlagh, Farzad Nourmohammadzadeh, et al.
Pubblicazione: (2024)
di: Motlagh, Farzad Nourmohammadzadeh, et al.
Pubblicazione: (2024)
Can Large Language Models Master Complex Card Games?
di: Wang, Wei, et al.
Pubblicazione: (2025)
di: Wang, Wei, et al.
Pubblicazione: (2025)
Playing Language Game with LLMs Leads to Jailbreaking
di: Peng, Yu, et al.
Pubblicazione: (2024)
di: Peng, Yu, et al.
Pubblicazione: (2024)
Natural Language Generation from Visual Events: State-of-the-Art and Key Open Questions
di: Surikuchi, Aditya K, et al.
Pubblicazione: (2025)
di: Surikuchi, Aditya K, et al.
Pubblicazione: (2025)
Enhancing Large Language Models with Pseudo- and Multisource- Knowledge Graphs for Open-ended Question Answering
di: Liu, Jiaxiang, et al.
Pubblicazione: (2024)
di: Liu, Jiaxiang, et al.
Pubblicazione: (2024)
MedPriv-Bench: Benchmarking the Privacy-Utility Trade-off of Large Language Models in Medical Open-End Question Answering
di: Guan, Shaowei, et al.
Pubblicazione: (2026)
di: Guan, Shaowei, et al.
Pubblicazione: (2026)
Credence Calibration Game? Calibrating Large Language Models through Structured Play
di: Fang, Ke, et al.
Pubblicazione: (2025)
di: Fang, Ke, et al.
Pubblicazione: (2025)
Monte Carlo Planning with Large Language Model for Text-Based Game Agents
di: Shi, Zijing, et al.
Pubblicazione: (2025)
di: Shi, Zijing, et al.
Pubblicazione: (2025)
Playing 20 Question Game with Policy-Based Reinforcement Learning
di: Hu, Huang, et al.
Pubblicazione: (2018)
di: Hu, Huang, et al.
Pubblicazione: (2018)
Uncertainty Estimation of Large Language Models in Medical Question Answering
di: Wu, Jiaxin, et al.
Pubblicazione: (2024)
di: Wu, Jiaxin, et al.
Pubblicazione: (2024)
From Passive to Active Reasoning: Can Large Language Models Ask the Right Questions under Incomplete Information?
di: Zhou, Zhanke, et al.
Pubblicazione: (2025)
di: Zhou, Zhanke, et al.
Pubblicazione: (2025)
HoLLMwood: Unleashing the Creativity of Large Language Models in Screenwriting via Role Playing
di: Chen, Jing, et al.
Pubblicazione: (2024)
di: Chen, Jing, et al.
Pubblicazione: (2024)
InsQABench: Benchmarking Chinese Insurance Domain Question Answering with Large Language Models
di: Ding, Jing, et al.
Pubblicazione: (2025)
di: Ding, Jing, et al.
Pubblicazione: (2025)
Large Language Models Are State-of-the-Art Evaluator for Grammatical Error Correction
di: Kobayashi, Masamune, et al.
Pubblicazione: (2024)
di: Kobayashi, Masamune, et al.
Pubblicazione: (2024)
FAMMA: A Benchmark for Financial Domain Multilingual Multimodal Question Answering
di: Xue, Siqiao, et al.
Pubblicazione: (2024)
di: Xue, Siqiao, et al.
Pubblicazione: (2024)
Text2World: Benchmarking Large Language Models for Symbolic World Model Generation
di: Hu, Mengkang, et al.
Pubblicazione: (2025)
di: Hu, Mengkang, et al.
Pubblicazione: (2025)
Can AI Master Construction Management (CM)? Benchmarking State-of-the-Art Large Language Models on CM Certification Exams
di: Xiong, Ruoxin, et al.
Pubblicazione: (2025)
di: Xiong, Ruoxin, et al.
Pubblicazione: (2025)
Open-SQL Framework: Enhancing Text-to-SQL on Open-source Large Language Models
di: Chen, Xiaojun, et al.
Pubblicazione: (2024)
di: Chen, Xiaojun, et al.
Pubblicazione: (2024)
Large Language Models Can Self-Improve in Long-context Reasoning
di: Li, Siheng, et al.
Pubblicazione: (2024)
di: Li, Siheng, et al.
Pubblicazione: (2024)
On the (In)Effectiveness of Large Language Models for Chinese Text Correction
di: Li, Yinghui, et al.
Pubblicazione: (2023)
di: Li, Yinghui, et al.
Pubblicazione: (2023)
Can OpenAI o1 Reason Well in Ophthalmology? A 6,990-Question Head-to-Head Evaluation Study
di: Srinivasan, Sahana, et al.
Pubblicazione: (2025)
di: Srinivasan, Sahana, et al.
Pubblicazione: (2025)
Can Knowledge Graphs Make Large Language Models More Trustworthy? An Empirical Study Over Open-ended Question Answering
di: Sui, Yuan, et al.
Pubblicazione: (2024)
di: Sui, Yuan, et al.
Pubblicazione: (2024)
A Text-to-Game Engine for UGC-Based Role-Playing Games
di: Zhang, Lei, et al.
Pubblicazione: (2024)
di: Zhang, Lei, et al.
Pubblicazione: (2024)
Can Large Language Models Understand Preferences in Personalized Recommendation?
di: Tan, Zhaoxuan, et al.
Pubblicazione: (2025)
di: Tan, Zhaoxuan, et al.
Pubblicazione: (2025)
Can Large Language Models Address Open-Target Stance Detection?
di: Akash, Abu Ubaida, et al.
Pubblicazione: (2024)
di: Akash, Abu Ubaida, et al.
Pubblicazione: (2024)
Dictionary Insertion Prompting for Multilingual Reasoning on Multilingual Large Language Models
di: Lu, Hongyuan, et al.
Pubblicazione: (2024)
di: Lu, Hongyuan, et al.
Pubblicazione: (2024)
Can Large Language Models Self-Correct in Medical Question Answering? An Exploratory Study
di: Zhan, Zaifu, et al.
Pubblicazione: (2026)
di: Zhan, Zaifu, et al.
Pubblicazione: (2026)
Efficacy of Language Model Self-Play in Non-Zero-Sum Games
di: Liao, Austen, et al.
Pubblicazione: (2024)
di: Liao, Austen, et al.
Pubblicazione: (2024)
Documenti analoghi
-
MANGO: A Benchmark for Evaluating Mapping and Navigation Abilities of Large Language Models
di: Ding, Peng, et al.
Pubblicazione: (2024) -
Playing With AI: How Do State-Of-The-Art Large Language Models Perform in the 1977 Text-Based Adventure Game Zork?
di: Gerrits, Berry
Pubblicazione: (2026) -
TextAtari: 100K Frames Game Playing with Language Agents
di: Li, Wenhao, et al.
Pubblicazione: (2025) -
Ethical Considerations of Large Language Models in Game Playing
di: Zhang, Qingquan, et al.
Pubblicazione: (2025) -
GuessingGame: Measuring the Informativeness of Open-Ended Questions in Large Language Models
di: Hutson, Dylan, et al.
Pubblicazione: (2025)