Predicting vs. Acting: A Trade-off Between World Modeling & Agent Modeling
Fuente:
arXiv
Guardado en:
| Autores principales: | Li, Margaret, Shi, Weijia, Pagnoni, Artidoro, West, Peter, Holtzman, Ari |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Linearly Decoding Refused Knowledge in Aligned Language Models
por: Shrivastava, Aryan, et al.
Publicado: (2025)
por: Shrivastava, Aryan, et al.
Publicado: (2025)
Moral Mazes in the Era of LLMs
por: Nguyen, Dang, et al.
Publicado: (2026)
por: Nguyen, Dang, et al.
Publicado: (2026)
Can You Keep a Secret? Involuntary Information Leakage in Language Model Writing
por: Holtzman, Ari, et al.
Publicado: (2026)
por: Holtzman, Ari, et al.
Publicado: (2026)
Fast Byte Latent Transformer
por: Kallini, Julie, et al.
Publicado: (2026)
por: Kallini, Julie, et al.
Publicado: (2026)
MUSE: Machine Unlearning Six-Way Evaluation for Language Models
por: Shi, Weijia, et al.
Publicado: (2024)
por: Shi, Weijia, et al.
Publicado: (2024)
LLM Probability Concentration: How Alignment Shrinks the Generative Horizon
por: Yang, Chenghao, et al.
Publicado: (2025)
por: Yang, Chenghao, et al.
Publicado: (2025)
Position: Stop Acting Like Language Model Agents Are Normal Agents
por: Perrier, Elija, et al.
Publicado: (2025)
por: Perrier, Elija, et al.
Publicado: (2025)
Dyna-Think: Synergizing Reasoning, Acting, and World Model Simulation in AI Agents
por: Yu, Xiao, et al.
Publicado: (2025)
por: Yu, Xiao, et al.
Publicado: (2025)
AI-LieDar: Examine the Trade-off Between Utility and Truthfulness in LLM Agents
por: Su, Zhe, et al.
Publicado: (2024)
por: Su, Zhe, et al.
Publicado: (2024)
Towards Autonomous Agents: Adaptive-planning, Reasoning, and Acting in Language Models
por: Dutta, Abhishek, et al.
Publicado: (2024)
por: Dutta, Abhishek, et al.
Publicado: (2024)
Rethinking Scale: Deployment Trade-offs of Small Language Models under Agent Paradigms
por: Wang, Xinlin, et al.
Publicado: (2026)
por: Wang, Xinlin, et al.
Publicado: (2026)
Mapping Overlaps in Benchmarks through Perplexity in the Wild
por: Wu, Siyang, et al.
Publicado: (2025)
por: Wu, Siyang, et al.
Publicado: (2025)
Mind the Gap Between Spatial Reasoning and Acting! Step-by-Step Evaluation of Agents With Spatial-Gym
por: Kaesberg, Lars Benedikt, et al.
Publicado: (2026)
por: Kaesberg, Lars Benedikt, et al.
Publicado: (2026)
Emissions and Performance Trade-off Between Small and Large Language Models
por: Garg, Anandita, et al.
Publicado: (2025)
por: Garg, Anandita, et al.
Publicado: (2025)
The Text Uncanny Valley: Non-Monotonic Performance Degradation in LLM Information Retrieval
por: Tong, Zekai, et al.
Publicado: (2026)
por: Tong, Zekai, et al.
Publicado: (2026)
Forking Paths in Neural Text Generation
por: Bigelow, Eric, et al.
Publicado: (2024)
por: Bigelow, Eric, et al.
Publicado: (2024)
Know Thyself? On the Incapability and Implications of AI Self-Recognition
por: Bai, Xiaoyan, et al.
Publicado: (2025)
por: Bai, Xiaoyan, et al.
Publicado: (2025)
Exploring Accuracy-Fairness Trade-off in Large Language Models
por: Zhang, Qingquan, et al.
Publicado: (2024)
por: Zhang, Qingquan, et al.
Publicado: (2024)
LBM: Hierarchical Large Auto-Bidding Model via Reasoning and Acting
por: Li, Yewen, et al.
Publicado: (2026)
por: Li, Yewen, et al.
Publicado: (2026)
Performance Trade-offs of Optimizing Small Language Models for E-Commerce
por: Licardo, Josip Tomo, et al.
Publicado: (2025)
por: Licardo, Josip Tomo, et al.
Publicado: (2025)
Enhancing Agent Learning through World Dynamics Modeling
por: Sun, Zhiyuan, et al.
Publicado: (2024)
por: Sun, Zhiyuan, et al.
Publicado: (2024)
Exploring the Trade-off Between Model Performance and Explanation Plausibility of Text Classifiers Using Human Rationales
por: Resck, Lucas E., et al.
Publicado: (2024)
por: Resck, Lucas E., et al.
Publicado: (2024)
Acting Less is Reasoning More! Teaching Model to Act Efficiently
por: Wang, Hongru, et al.
Publicado: (2025)
por: Wang, Hongru, et al.
Publicado: (2025)
SpeakRL: Synergizing Reasoning, Speaking, and Acting in Language Models with Reinforcement Learning
por: Acikgoz, Emre Can, et al.
Publicado: (2025)
por: Acikgoz, Emre Can, et al.
Publicado: (2025)
Breaking the Trade-Off Between Faithfulness and Expressiveness for Large Language Models
por: Yang, Chenxu, et al.
Publicado: (2025)
por: Yang, Chenxu, et al.
Publicado: (2025)
World-Model-Augmented Web Agents with Action Correction
por: Shen, Zhouzhou, et al.
Publicado: (2026)
por: Shen, Zhouzhou, et al.
Publicado: (2026)
COMAP: Co-Evolving World Models and Agent Policies for LLM Agents
por: Liu, Youwei, et al.
Publicado: (2026)
por: Liu, Youwei, et al.
Publicado: (2026)
Forest vs Tree: The $(N, K)$ Trade-off in Reproducible ML Evaluation
por: Pandita, Deepak, et al.
Publicado: (2025)
por: Pandita, Deepak, et al.
Publicado: (2025)
The Story is Not the Science: Execution-Grounded Evaluation of Mechanistic Interpretability Research
por: Bai, Xiaoyan, et al.
Publicado: (2026)
por: Bai, Xiaoyan, et al.
Publicado: (2026)
Agent2World: Learning to Generate Symbolic World Models via Adaptive Multi-Agent Feedback
por: Hu, Mengkang, et al.
Publicado: (2025)
por: Hu, Mengkang, et al.
Publicado: (2025)
Understanding the Quality-Diversity Trade-off in Diffusion Language Models
por: Buzzard, Zak
Publicado: (2025)
por: Buzzard, Zak
Publicado: (2025)
Trade-offs in Large Reasoning Models: An Empirical Analysis of Deliberative and Adaptive Reasoning over Foundational Capabilities
por: Zhao, Weixiang, et al.
Publicado: (2025)
por: Zhao, Weixiang, et al.
Publicado: (2025)
Communicating Activations Between Language Model Agents
por: Ramesh, Vignav, et al.
Publicado: (2025)
por: Ramesh, Vignav, et al.
Publicado: (2025)
AI as Entertainment
por: Kommers, Cody, et al.
Publicado: (2026)
por: Kommers, Cody, et al.
Publicado: (2026)
VAGEN: Reinforcing World Model Reasoning for Multi-Turn VLM Agents
por: Wang, Kangrui, et al.
Publicado: (2025)
por: Wang, Kangrui, et al.
Publicado: (2025)
Language Agent Tree Search Unifies Reasoning Acting and Planning in Language Models
por: Zhou, Andy, et al.
Publicado: (2023)
por: Zhou, Andy, et al.
Publicado: (2023)
WorldCoder, a Model-Based LLM Agent: Building World Models by Writing Code and Interacting with the Environment
por: Tang, Hao, et al.
Publicado: (2024)
por: Tang, Hao, et al.
Publicado: (2024)
SafePred: A Predictive Guardrail for Computer-Using Agents via World Models
por: Chen, Yurun, et al.
Publicado: (2026)
por: Chen, Yurun, et al.
Publicado: (2026)
Are Smarter LLMs Safer? Exploring Safety-Reasoning Trade-offs in Prompting and Fine-Tuning
por: Li, Ang, et al.
Publicado: (2025)
por: Li, Ang, et al.
Publicado: (2025)
Byte Latent Transformer: Patches Scale Better Than Tokens
por: Pagnoni, Artidoro, et al.
Publicado: (2024)
por: Pagnoni, Artidoro, et al.
Publicado: (2024)
Ejemplares similares
-
Linearly Decoding Refused Knowledge in Aligned Language Models
por: Shrivastava, Aryan, et al.
Publicado: (2025) -
Moral Mazes in the Era of LLMs
por: Nguyen, Dang, et al.
Publicado: (2026) -
Can You Keep a Secret? Involuntary Information Leakage in Language Model Writing
por: Holtzman, Ari, et al.
Publicado: (2026) -
Fast Byte Latent Transformer
por: Kallini, Julie, et al.
Publicado: (2026) -
MUSE: Machine Unlearning Six-Way Evaluation for Language Models
por: Shi, Weijia, et al.
Publicado: (2024)