Can Language Models Serve as Text-Based World Simulators?
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Ruoyao, Todd, Graham, Xiao, Ziang, Yuan, Xingdi, Côté, Marc-Alexandre, Clark, Peter, Jansen, Peter |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
TALES: Text Adventure Learning Environment Suite
di: Cui, Christopher Zhang, et al.
Pubblicazione: (2025)
di: Cui, Christopher Zhang, et al.
Pubblicazione: (2025)
Policy Improvement using Language Feedback Models
di: Zhong, Victor, et al.
Pubblicazione: (2024)
di: Zhong, Victor, et al.
Pubblicazione: (2024)
Enhancing Agent Learning through World Dynamics Modeling
di: Sun, Zhiyuan, et al.
Pubblicazione: (2024)
di: Sun, Zhiyuan, et al.
Pubblicazione: (2024)
ByteSized32Refactored: Towards an Extensible Interactive Text Games Corpus for LLM World Modeling and Evaluation
di: Wang, Haonan, et al.
Pubblicazione: (2025)
di: Wang, Haonan, et al.
Pubblicazione: (2025)
Matter-of-Fact: A Benchmark for Verifying the Feasibility of Literature-Supported Claims in Materials Science
di: Jansen, Peter, et al.
Pubblicazione: (2025)
di: Jansen, Peter, et al.
Pubblicazione: (2025)
Language-guided Skill Learning with Temporal Variational Inference
di: Fu, Haotian, et al.
Pubblicazione: (2024)
di: Fu, Haotian, et al.
Pubblicazione: (2024)
debug-gym: A Text-Based Environment for Interactive Debugging
di: Yuan, Xingdi, et al.
Pubblicazione: (2025)
di: Yuan, Xingdi, et al.
Pubblicazione: (2025)
DISCOVERYWORLD: A Virtual Environment for Developing and Evaluating Automated Scientific Discovery Agents
di: Jansen, Peter, et al.
Pubblicazione: (2024)
di: Jansen, Peter, et al.
Pubblicazione: (2024)
OPEx: A Component-Wise Analysis of LLM-Centric Agents in Embodied Instruction Following
di: Shi, Haochen, et al.
Pubblicazione: (2024)
di: Shi, Haochen, et al.
Pubblicazione: (2024)
Generating Literature-Driven Scientific Theories at Scale
di: Jansen, Peter, et al.
Pubblicazione: (2026)
di: Jansen, Peter, et al.
Pubblicazione: (2026)
Guiding Language Model Reasoning with Planning Tokens
di: Wang, Xinyi, et al.
Pubblicazione: (2023)
di: Wang, Xinyi, et al.
Pubblicazione: (2023)
MedCite: Can Language Models Generate Verifiable Text for Medicine?
di: Wang, Xiao, et al.
Pubblicazione: (2025)
di: Wang, Xiao, et al.
Pubblicazione: (2025)
BugPilot: Complex Bug Generation for Efficient Learning of SWE Skills
di: Sonwane, Atharv, et al.
Pubblicazione: (2025)
di: Sonwane, Atharv, et al.
Pubblicazione: (2025)
Language Modeling by Language Models
di: Cheng, Junyan, et al.
Pubblicazione: (2025)
di: Cheng, Junyan, et al.
Pubblicazione: (2025)
Can Large Language Models Understand Real-World Complex Instructions?
di: He, Qianyu, et al.
Pubblicazione: (2023)
di: He, Qianyu, et al.
Pubblicazione: (2023)
Gistify! Codebase-Level Understanding via Runtime Execution
di: Lee, Hyunji, et al.
Pubblicazione: (2025)
di: Lee, Hyunji, et al.
Pubblicazione: (2025)
Missed Connections: Lateral Thinking Puzzles for Large Language Models
di: Todd, Graham, et al.
Pubblicazione: (2024)
di: Todd, Graham, et al.
Pubblicazione: (2024)
Can Large Language Models Infer Causal Relationships from Real-World Text?
di: Saklad, Ryan, et al.
Pubblicazione: (2025)
di: Saklad, Ryan, et al.
Pubblicazione: (2025)
Faux Polyglot: A Study on Information Disparity in Multilingual Large Language Models
di: Sharma, Nikhil, et al.
Pubblicazione: (2024)
di: Sharma, Nikhil, et al.
Pubblicazione: (2024)
Text2World: Benchmarking Large Language Models for Symbolic World Model Generation
di: Hu, Mengkang, et al.
Pubblicazione: (2025)
di: Hu, Mengkang, et al.
Pubblicazione: (2025)
Improving Context-Aware Preference Modeling for Language Models
di: Pitis, Silviu, et al.
Pubblicazione: (2024)
di: Pitis, Silviu, et al.
Pubblicazione: (2024)
Experiments with Large Language Models on Retrieval-Augmented Generation for Closed-Source Simulation Software
di: Baumann, Andreas, et al.
Pubblicazione: (2025)
di: Baumann, Andreas, et al.
Pubblicazione: (2025)
BeSimulator: A Large Language Model Powered Text-based Behavior Simulator
di: Wang, Jianan, et al.
Pubblicazione: (2024)
di: Wang, Jianan, et al.
Pubblicazione: (2024)
Pron vs Prompt: Can Large Language Models already Challenge a World-Class Fiction Author at Creative Text Writing?
di: Marco, Guillermo, et al.
Pubblicazione: (2024)
di: Marco, Guillermo, et al.
Pubblicazione: (2024)
Can Watermarks Survive Translation? On the Cross-lingual Consistency of Text Watermark for Large Language Models
di: He, Zhiwei, et al.
Pubblicazione: (2024)
di: He, Zhiwei, et al.
Pubblicazione: (2024)
HARPA: A Testability-Driven, Literature-Grounded Framework for Research Ideation
di: Vasu, Rosni, et al.
Pubblicazione: (2025)
di: Vasu, Rosni, et al.
Pubblicazione: (2025)
Small Language Model Can Self-correct
di: Han, Haixia, et al.
Pubblicazione: (2024)
di: Han, Haixia, et al.
Pubblicazione: (2024)
Enhancing Systematic Decompositional Natural Language Inference Using Informal Logic
di: Weir, Nathaniel, et al.
Pubblicazione: (2024)
di: Weir, Nathaniel, et al.
Pubblicazione: (2024)
Can Large Language Models Understand, Reason About, and Generate Code-Switched Text?
di: Winata, Genta Indra, et al.
Pubblicazione: (2026)
di: Winata, Genta Indra, et al.
Pubblicazione: (2026)
A Robot Walks into a Bar: Can Language Models Serve as Creativity Support Tools for Comedy? An Evaluation of LLMs' Humour Alignment with Comedians
di: Mirowski, Piotr Wojciech, et al.
Pubblicazione: (2024)
di: Mirowski, Piotr Wojciech, et al.
Pubblicazione: (2024)
Can Large Language Models be Trusted for Evaluation? Scalable Meta-Evaluation of LLMs as Evaluators via Agent Debate
di: Chern, Steffi, et al.
Pubblicazione: (2024)
di: Chern, Steffi, et al.
Pubblicazione: (2024)
Generative Personality Simulation via Theory-Informed Structured Interview
di: Wang, Pengda, et al.
Pubblicazione: (2025)
di: Wang, Pengda, et al.
Pubblicazione: (2025)
Raising the Bar: Investigating the Values of Large Language Models via Generative Evolving Testing
di: Jiang, Han, et al.
Pubblicazione: (2024)
di: Jiang, Han, et al.
Pubblicazione: (2024)
What Makes a Good Response? An Empirical Analysis of Quality in Qualitative Interviews
di: Ivey, Jonathan, et al.
Pubblicazione: (2026)
di: Ivey, Jonathan, et al.
Pubblicazione: (2026)
Using Natural Language for Human-Robot Collaboration in the Real World
di: Lindes, Peter, et al.
Pubblicazione: (2025)
di: Lindes, Peter, et al.
Pubblicazione: (2025)
Population-Aligned Persona Generation for LLM-based Social Simulation
di: Hu, Zhengyu, et al.
Pubblicazione: (2025)
di: Hu, Zhengyu, et al.
Pubblicazione: (2025)
Reverse Probing: Supervised Token-level Uncertainty Quantification for Large Language Models in Clinical Text
di: Xiao, Bushi, et al.
Pubblicazione: (2026)
di: Xiao, Bushi, et al.
Pubblicazione: (2026)
Can Pre-trained Language Models Understand Chinese Humor?
di: Chen, Yuyan, et al.
Pubblicazione: (2024)
di: Chen, Yuyan, et al.
Pubblicazione: (2024)
Can Language Models Take A Hint? Prompting for Controllable Contextualized Commonsense Inference
di: Colon-Hernandez, Pedro, et al.
Pubblicazione: (2024)
di: Colon-Hernandez, Pedro, et al.
Pubblicazione: (2024)
Your Language Model Can Secretly Write Like Humans: Contrastive Paraphrase Attacks on LLM-Generated Text Detectors
di: Fang, Hao, et al.
Pubblicazione: (2025)
di: Fang, Hao, et al.
Pubblicazione: (2025)
Documenti analoghi
-
TALES: Text Adventure Learning Environment Suite
di: Cui, Christopher Zhang, et al.
Pubblicazione: (2025) -
Policy Improvement using Language Feedback Models
di: Zhong, Victor, et al.
Pubblicazione: (2024) -
Enhancing Agent Learning through World Dynamics Modeling
di: Sun, Zhiyuan, et al.
Pubblicazione: (2024) -
ByteSized32Refactored: Towards an Extensible Interactive Text Games Corpus for LLM World Modeling and Evaluation
di: Wang, Haonan, et al.
Pubblicazione: (2025) -
Matter-of-Fact: A Benchmark for Verifying the Feasibility of Literature-Supported Claims in Materials Science
di: Jansen, Peter, et al.
Pubblicazione: (2025)