Learning to Model the World with Language
Fuente:
arXiv
Salvato in:
| Autori principali: | Lin, Jessy, Du, Yuqing, Watkins, Olivia, Hafner, Danijar, Abbeel, Pieter, Klein, Dan, Dragan, Anca |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Q-SFT: Q-Learning for Language Models via Supervised Fine-Tuning
di: Hong, Joey, et al.
Pubblicazione: (2024)
di: Hong, Joey, et al.
Pubblicazione: (2024)
Training Agents Inside of Scalable World Models
di: Hafner, Danijar, et al.
Pubblicazione: (2025)
di: Hafner, Danijar, et al.
Pubblicazione: (2025)
Interactive Dialogue Agents via Reinforcement Learning on Hindsight Regenerations
di: Hong, Joey, et al.
Pubblicazione: (2024)
di: Hong, Joey, et al.
Pubblicazione: (2024)
Mastering Diverse Domains through World Models
di: Hafner, Danijar, et al.
Pubblicazione: (2023)
di: Hafner, Danijar, et al.
Pubblicazione: (2023)
One Step Diffusion via Shortcut Models
di: Frans, Kevin, et al.
Pubblicazione: (2024)
di: Frans, Kevin, et al.
Pubblicazione: (2024)
Discovering Latent Knowledge in Language Models Without Supervision
di: Burns, Collin, et al.
Pubblicazione: (2022)
di: Burns, Collin, et al.
Pubblicazione: (2022)
Explaining Datasets in Words: Statistical Models with Natural Language Parameters
di: Zhong, Ruiqi, et al.
Pubblicazione: (2024)
di: Zhong, Ruiqi, et al.
Pubblicazione: (2024)
CLARINET: Augmenting Language Models to Ask Clarification Questions for Retrieval
di: Chi, Yizhou, et al.
Pubblicazione: (2024)
di: Chi, Yizhou, et al.
Pubblicazione: (2024)
CoLa: Learning to Interactively Collaborate with Large Language Models
di: Sharma, Abhishek, et al.
Pubblicazione: (2025)
di: Sharma, Abhishek, et al.
Pubblicazione: (2025)
Semi-Supervised One-Shot Imitation Learning
di: Wu, Philipp, et al.
Pubblicazione: (2024)
di: Wu, Philipp, et al.
Pubblicazione: (2024)
Agentic Reinforcement Learning for Real-World Code Repair
di: Zhu, Siyu, et al.
Pubblicazione: (2025)
di: Zhu, Siyu, et al.
Pubblicazione: (2025)
Language-Guided World Models: A Model-Based Approach to AI Control
di: Zhang, Alex, et al.
Pubblicazione: (2024)
di: Zhang, Alex, et al.
Pubblicazione: (2024)
Gemma Scope: Open Sparse Autoencoders Everywhere All At Once on Gemma 2
di: Lieberum, Tom, et al.
Pubblicazione: (2024)
di: Lieberum, Tom, et al.
Pubblicazione: (2024)
Language Models Can Learn from Verbal Feedback Without Scalar Rewards
di: Luo, Renjie, et al.
Pubblicazione: (2025)
di: Luo, Renjie, et al.
Pubblicazione: (2025)
When Attention Sink Emerges in Language Models: An Empirical View
di: Gu, Xiangming, et al.
Pubblicazione: (2024)
di: Gu, Xiangming, et al.
Pubblicazione: (2024)
Unlocking Continual Learning Abilities in Language Models
di: Du, Wenyu, et al.
Pubblicazione: (2024)
di: Du, Wenyu, et al.
Pubblicazione: (2024)
Position Engineering: Boosting Large Language Models through Positional Information Manipulation
di: He, Zhiyuan, et al.
Pubblicazione: (2024)
di: He, Zhiyuan, et al.
Pubblicazione: (2024)
Coarse-to-fine Q-Network with Action Sequence for Data-Efficient Reinforcement Learning
di: Seo, Younggyo, et al.
Pubblicazione: (2024)
di: Seo, Younggyo, et al.
Pubblicazione: (2024)
Research on Optimization of Natural Language Processing Model Based on Multimodal Deep Learning
di: Sun, Dan, et al.
Pubblicazione: (2024)
di: Sun, Dan, et al.
Pubblicazione: (2024)
Variational Reasoning for Language Models
di: Zhou, Xiangxin, et al.
Pubblicazione: (2025)
di: Zhou, Xiangxin, et al.
Pubblicazione: (2025)
MLR-Copilot: Autonomous Machine Learning Research based on Large Language Models Agents
di: Li, Ruochen, et al.
Pubblicazione: (2024)
di: Li, Ruochen, et al.
Pubblicazione: (2024)
Dynamic Model Merging Made Slim
di: Du, Guodong, et al.
Pubblicazione: (2026)
di: Du, Guodong, et al.
Pubblicazione: (2026)
A Closer Look at Machine Unlearning for Large Language Models
di: Yuan, Xiaojian, et al.
Pubblicazione: (2024)
di: Yuan, Xiaojian, et al.
Pubblicazione: (2024)
RuAG: Learned-rule-augmented Generation for Large Language Models
di: Zhang, Yudi, et al.
Pubblicazione: (2024)
di: Zhang, Yudi, et al.
Pubblicazione: (2024)
CityGPT: Empowering Urban Spatial Cognition of Large Language Models
di: Feng, Jie, et al.
Pubblicazione: (2024)
di: Feng, Jie, et al.
Pubblicazione: (2024)
NOVER: Incentive Training for Language Models via Verifier-Free Reinforcement Learning
di: Liu, Wei, et al.
Pubblicazione: (2025)
di: Liu, Wei, et al.
Pubblicazione: (2025)
All Language Models Large and Small
di: Chen, Zhixun, et al.
Pubblicazione: (2024)
di: Chen, Zhixun, et al.
Pubblicazione: (2024)
Unified Multi-Task Learning & Model Fusion for Efficient Language Model Guardrailing
di: Neill, James O', et al.
Pubblicazione: (2025)
di: Neill, James O', et al.
Pubblicazione: (2025)
Cold-Start Personalization via Training-Free Priors from Structured World Models
di: Bose, Avinandan, et al.
Pubblicazione: (2026)
di: Bose, Avinandan, et al.
Pubblicazione: (2026)
Training Language Models via Neural Cellular Automata
di: Lee, Dan, et al.
Pubblicazione: (2026)
di: Lee, Dan, et al.
Pubblicazione: (2026)
DreamSmooth: Improving Model-based Reinforcement Learning via Reward Smoothing
di: Lee, Vint, et al.
Pubblicazione: (2023)
di: Lee, Vint, et al.
Pubblicazione: (2023)
ModelingAgent: Bridging LLMs and Mathematical Modeling for Real-World Challenges
di: Qian, Cheng, et al.
Pubblicazione: (2025)
di: Qian, Cheng, et al.
Pubblicazione: (2025)
PAT: Pruning-Aware Tuning for Large Language Models
di: Liu, Yijiang, et al.
Pubblicazione: (2024)
di: Liu, Yijiang, et al.
Pubblicazione: (2024)
RWKU: Benchmarking Real-World Knowledge Unlearning for Large Language Models
di: Jin, Zhuoran, et al.
Pubblicazione: (2024)
di: Jin, Zhuoran, et al.
Pubblicazione: (2024)
The Mouth is Not the Brain: Bridging Energy-Based World Models and Language Generation
di: Niimi, Junichiro
Pubblicazione: (2026)
di: Niimi, Junichiro
Pubblicazione: (2026)
Optimizing Temperature for Language Models with Multi-Sample Inference
di: Du, Weihua, et al.
Pubblicazione: (2025)
di: Du, Weihua, et al.
Pubblicazione: (2025)
Exploring Multilingual Probing in Large Language Models: A Cross-Language Analysis
di: Li, Daoyang, et al.
Pubblicazione: (2024)
di: Li, Daoyang, et al.
Pubblicazione: (2024)
Offline Imitation Learning Through Graph Search and Retrieval
di: Yin, Zhao-Heng, et al.
Pubblicazione: (2024)
di: Yin, Zhao-Heng, et al.
Pubblicazione: (2024)
Coprocessor Actor Critic: A Model-Based Reinforcement Learning Approach For Adaptive Brain Stimulation
di: Pan, Michelle, et al.
Pubblicazione: (2024)
di: Pan, Michelle, et al.
Pubblicazione: (2024)
Managing extreme AI risks amid rapid progress
di: Bengio, Yoshua, et al.
Pubblicazione: (2023)
di: Bengio, Yoshua, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Q-SFT: Q-Learning for Language Models via Supervised Fine-Tuning
di: Hong, Joey, et al.
Pubblicazione: (2024) -
Training Agents Inside of Scalable World Models
di: Hafner, Danijar, et al.
Pubblicazione: (2025) -
Interactive Dialogue Agents via Reinforcement Learning on Hindsight Regenerations
di: Hong, Joey, et al.
Pubblicazione: (2024) -
Mastering Diverse Domains through World Models
di: Hafner, Danijar, et al.
Pubblicazione: (2023) -
One Step Diffusion via Shortcut Models
di: Frans, Kevin, et al.
Pubblicazione: (2024)