Language-Guided World Models: A Model-Based Approach to AI Control
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, Alex, Nguyen, Khanh, Tuyls, Jens, Lin, Albert, Narasimhan, Karthik |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Scaling Laws for Imitation Learning in Single-Agent Games
par: Tuyls, Jens, et autres
Publié: (2023)
par: Tuyls, Jens, et autres
Publié: (2023)
Cognitive Architectures for Language Agents
par: Sumers, Theodore R., et autres
Publié: (2023)
par: Sumers, Theodore R., et autres
Publié: (2023)
QualEval: Qualitative Evaluation for Model Improvement
par: Murahari, Vishvak, et autres
Publié: (2023)
par: Murahari, Vishvak, et autres
Publié: (2023)
CONSCENDI: A Contrastive and Scenario-Guided Distillation Approach to Guardrail Models for Virtual Assistants
par: Sun, Albert Yu, et autres
Publié: (2023)
par: Sun, Albert Yu, et autres
Publié: (2023)
Contextual Experience Replay for Self-Improvement of Language Agents
par: Liu, Yitao, et autres
Publié: (2025)
par: Liu, Yitao, et autres
Publié: (2025)
Learning to Model the World with Language
par: Lin, Jessy, et autres
Publié: (2023)
par: Lin, Jessy, et autres
Publié: (2023)
Language Model Cascades: Token-level uncertainty and beyond
par: Gupta, Neha, et autres
Publié: (2024)
par: Gupta, Neha, et autres
Publié: (2024)
Representation-Based Exploration for Language Models: From Test-Time to Post-Training
par: Tuyls, Jens, et autres
Publié: (2025)
par: Tuyls, Jens, et autres
Publié: (2025)
Boundary-Guided Policy Optimization for Memory-efficient RL of Diffusion Large Language Models
par: Lin, Nianyi, et autres
Publié: (2025)
par: Lin, Nianyi, et autres
Publié: (2025)
Reasoning Planning for Language Models
par: Nguyen, Bao, et autres
Publié: (2025)
par: Nguyen, Bao, et autres
Publié: (2025)
Probabilities of Chat LLMs Are Miscalibrated but Still Predict Correctness on Multiple-Choice Q&A
par: Plaut, Benjamin, et autres
Publié: (2024)
par: Plaut, Benjamin, et autres
Publié: (2024)
Controlled Decoding from Language Models
par: Mudgal, Sidharth, et autres
Publié: (2023)
par: Mudgal, Sidharth, et autres
Publié: (2023)
The Mouth is Not the Brain: Bridging Energy-Based World Models and Language Generation
par: Niimi, Junichiro
Publié: (2026)
par: Niimi, Junichiro
Publié: (2026)
HalluWorld: A Controlled Benchmark for Hallucination via Reference World Models
par: Liu, Emmy, et autres
Publié: (2026)
par: Liu, Emmy, et autres
Publié: (2026)
Text Quality-Based Pruning for Efficient Training of Language Models
par: Sharma, Vasu, et autres
Publié: (2024)
par: Sharma, Vasu, et autres
Publié: (2024)
Evaluating Text Summaries Generated by Large Language Models Using OpenAI's GPT
par: Shakil, Hassan, et autres
Publié: (2024)
par: Shakil, Hassan, et autres
Publié: (2024)
Exploring Gradient-Guided Masked Language Model to Detect Textual Adversarial Attacks
par: Zhang, Xiaomei, et autres
Publié: (2025)
par: Zhang, Xiaomei, et autres
Publié: (2025)
Guiding Language Model Reasoning with Planning Tokens
par: Wang, Xinyi, et autres
Publié: (2023)
par: Wang, Xinyi, et autres
Publié: (2023)
Federated Document Visual Question Answering: A Pilot Study
par: Nguyen, Khanh, et autres
Publié: (2024)
par: Nguyen, Khanh, et autres
Publié: (2024)
Judging Quality Across Languages: A Multilingual Approach to Pretraining Data Filtering with Language Models
par: Ali, Mehdi, et autres
Publié: (2025)
par: Ali, Mehdi, et autres
Publié: (2025)
A Unified Definition of Hallucination: It's The World Model, Stupid!
par: Liu, Emmy, et autres
Publié: (2025)
par: Liu, Emmy, et autres
Publié: (2025)
AttriLens-Mol: Attribute Guided Reinforcement Learning for Molecular Property Prediction with Large Language Models
par: Lin, Xuan, et autres
Publié: (2025)
par: Lin, Xuan, et autres
Publié: (2025)
Values in the Wild: Discovering and Analyzing Values in Real-World Language Model Interactions
par: Huang, Saffron, et autres
Publié: (2025)
par: Huang, Saffron, et autres
Publié: (2025)
Efficient Reasoning for Large Reasoning Language Models via Certainty-Guided Reflection Suppression
par: Huang, Jiameng, et autres
Publié: (2025)
par: Huang, Jiameng, et autres
Publié: (2025)
Param$Δ$ for Direct Weight Mixing: Post-Train Large Language Model at Zero Cost
par: Cao, Sheng, et autres
Publié: (2025)
par: Cao, Sheng, et autres
Publié: (2025)
RLHF Deciphered: A Critical Analysis of Reinforcement Learning from Human Feedback for LLMs
par: Chaudhari, Shreyas, et autres
Publié: (2024)
par: Chaudhari, Shreyas, et autres
Publié: (2024)
Information Guided Regularization for Fine-tuning Language Models
par: Sharma, Mandar, et autres
Publié: (2024)
par: Sharma, Mandar, et autres
Publié: (2024)
UltraFeedback: Boosting Language Models with Scaled AI Feedback
par: Cui, Ganqu, et autres
Publié: (2023)
par: Cui, Ganqu, et autres
Publié: (2023)
MuRating: A High Quality Data Selecting Approach to Multilingual Large Language Model Pretraining
par: Chen, Zhixun, et autres
Publié: (2025)
par: Chen, Zhixun, et autres
Publié: (2025)
Adversarial Attacks on AI-Generated Text Detection Models: A Token Probability-Based Approach Using Embeddings
par: Kadhim, Ahmed K., et autres
Publié: (2025)
par: Kadhim, Ahmed K., et autres
Publié: (2025)
Can Language Models Solve Olympiad Programming?
par: Shi, Quan, et autres
Publié: (2024)
par: Shi, Quan, et autres
Publié: (2024)
LIBMoE: A Library for comprehensive benchmarking Mixture of Experts in Large Language Models
par: Nguyen, Nam V., et autres
Publié: (2024)
par: Nguyen, Nam V., et autres
Publié: (2024)
Understanding World or Predicting Future? A Comprehensive Survey of World Models
par: Ding, Jingtao, et autres
Publié: (2024)
par: Ding, Jingtao, et autres
Publié: (2024)
Agent Context Protocols Enhance Collective Inference
par: Bhardwaj, Devansh, et autres
Publié: (2025)
par: Bhardwaj, Devansh, et autres
Publié: (2025)
GUARD: Guided Unlearning and Retention via Data Attribution for Large Language Models
par: Niu, Peizhi, et autres
Publié: (2025)
par: Niu, Peizhi, et autres
Publié: (2025)
RouterDC: Query-Based Router by Dual Contrastive Learning for Assembling Large Language Models
par: Chen, Shuhao, et autres
Publié: (2024)
par: Chen, Shuhao, et autres
Publié: (2024)
Bone Soups: A Seek-and-Soup Model Merging Approach for Controllable Multi-Objective Generation
par: Xie, Guofu, et autres
Publié: (2025)
par: Xie, Guofu, et autres
Publié: (2025)
AI-Slop to AI-Polish? Aligning Language Models through Edit-Based Writing Rewards and Test-time Computation
par: Chakrabarty, Tuhin, et autres
Publié: (2025)
par: Chakrabarty, Tuhin, et autres
Publié: (2025)
One Model for All: Multi-Objective Controllable Language Models
par: He, Qiang, et autres
Publié: (2026)
par: He, Qiang, et autres
Publié: (2026)
G-Loss: Graph-Guided Fine-Tuning of Language Models
par: Sharma, Aditya, et autres
Publié: (2026)
par: Sharma, Aditya, et autres
Publié: (2026)
Documents similaires
-
Scaling Laws for Imitation Learning in Single-Agent Games
par: Tuyls, Jens, et autres
Publié: (2023) -
Cognitive Architectures for Language Agents
par: Sumers, Theodore R., et autres
Publié: (2023) -
QualEval: Qualitative Evaluation for Model Improvement
par: Murahari, Vishvak, et autres
Publié: (2023) -
CONSCENDI: A Contrastive and Scenario-Guided Distillation Approach to Guardrail Models for Virtual Assistants
par: Sun, Albert Yu, et autres
Publié: (2023) -
Contextual Experience Replay for Self-Improvement of Language Agents
par: Liu, Yitao, et autres
Publié: (2025)