Enregistré dans:
| Auteurs principaux: | Lin, Jessy, Du, Yuqing, Watkins, Olivia, Hafner, Danijar, Abbeel, Pieter, Klein, Dan, Dragan, Anca |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2308.01399 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Q-SFT: Q-Learning for Language Models via Supervised Fine-Tuning
par: Hong, Joey, et autres
Publié: (2024)
par: Hong, Joey, et autres
Publié: (2024)
Training Agents Inside of Scalable World Models
par: Hafner, Danijar, et autres
Publié: (2025)
par: Hafner, Danijar, et autres
Publié: (2025)
One Step Diffusion via Shortcut Models
par: Frans, Kevin, et autres
Publié: (2024)
par: Frans, Kevin, et autres
Publié: (2024)
Interactive Dialogue Agents via Reinforcement Learning on Hindsight Regenerations
par: Hong, Joey, et autres
Publié: (2024)
par: Hong, Joey, et autres
Publié: (2024)
Mastering Diverse Domains through World Models
par: Hafner, Danijar, et autres
Publié: (2023)
par: Hafner, Danijar, et autres
Publié: (2023)
CLARINET: Augmenting Language Models to Ask Clarification Questions for Retrieval
par: Chi, Yizhou, et autres
Publié: (2024)
par: Chi, Yizhou, et autres
Publié: (2024)
Discovering Latent Knowledge in Language Models Without Supervision
par: Burns, Collin, et autres
Publié: (2022)
par: Burns, Collin, et autres
Publié: (2022)
Explaining Datasets in Words: Statistical Models with Natural Language Parameters
par: Zhong, Ruiqi, et autres
Publié: (2024)
par: Zhong, Ruiqi, et autres
Publié: (2024)
Semi-Supervised One-Shot Imitation Learning
par: Wu, Philipp, et autres
Publié: (2024)
par: Wu, Philipp, et autres
Publié: (2024)
Gemma Scope: Open Sparse Autoencoders Everywhere All At Once on Gemma 2
par: Lieberum, Tom, et autres
Publié: (2024)
par: Lieberum, Tom, et autres
Publié: (2024)
CoLa: Learning to Interactively Collaborate with Large Language Models
par: Sharma, Abhishek, et autres
Publié: (2025)
par: Sharma, Abhishek, et autres
Publié: (2025)
Agentic Reinforcement Learning for Real-World Code Repair
par: Zhu, Siyu, et autres
Publié: (2025)
par: Zhu, Siyu, et autres
Publié: (2025)
Language-Guided World Models: A Model-Based Approach to AI Control
par: Zhang, Alex, et autres
Publié: (2024)
par: Zhang, Alex, et autres
Publié: (2024)
Cooperative Inverse Reinforcement Learning
par: Hadfield-Menell, Dylan, et autres
Publié: (2016)
par: Hadfield-Menell, Dylan, et autres
Publié: (2016)
Language Models Can Learn from Verbal Feedback Without Scalar Rewards
par: Luo, Renjie, et autres
Publié: (2025)
par: Luo, Renjie, et autres
Publié: (2025)
Managing extreme AI risks amid rapid progress
par: Bengio, Yoshua, et autres
Publié: (2023)
par: Bengio, Yoshua, et autres
Publié: (2023)
Coarse-to-fine Q-Network with Action Sequence for Data-Efficient Reinforcement Learning
par: Seo, Younggyo, et autres
Publié: (2024)
par: Seo, Younggyo, et autres
Publié: (2024)
When Attention Sink Emerges in Language Models: An Empirical View
par: Gu, Xiangming, et autres
Publié: (2024)
par: Gu, Xiangming, et autres
Publié: (2024)
Position Engineering: Boosting Large Language Models through Positional Information Manipulation
par: He, Zhiyuan, et autres
Publié: (2024)
par: He, Zhiyuan, et autres
Publié: (2024)
Coprocessor Actor Critic: A Model-Based Reinforcement Learning Approach For Adaptive Brain Stimulation
par: Pan, Michelle, et autres
Publié: (2024)
par: Pan, Michelle, et autres
Publié: (2024)
Unlocking Continual Learning Abilities in Language Models
par: Du, Wenyu, et autres
Publié: (2024)
par: Du, Wenyu, et autres
Publié: (2024)
Variational Reasoning for Language Models
par: Zhou, Xiangxin, et autres
Publié: (2025)
par: Zhou, Xiangxin, et autres
Publié: (2025)
Research on Optimization of Natural Language Processing Model Based on Multimodal Deep Learning
par: Sun, Dan, et autres
Publié: (2024)
par: Sun, Dan, et autres
Publié: (2024)
Dynamic Model Merging Made Slim
par: Du, Guodong, et autres
Publié: (2026)
par: Du, Guodong, et autres
Publié: (2026)
A Closer Look at Machine Unlearning for Large Language Models
par: Yuan, Xiaojian, et autres
Publié: (2024)
par: Yuan, Xiaojian, et autres
Publié: (2024)
MLR-Copilot: Autonomous Machine Learning Research based on Large Language Models Agents
par: Li, Ruochen, et autres
Publié: (2024)
par: Li, Ruochen, et autres
Publié: (2024)
DreamSmooth: Improving Model-based Reinforcement Learning via Reward Smoothing
par: Lee, Vint, et autres
Publié: (2023)
par: Lee, Vint, et autres
Publié: (2023)
RuAG: Learned-rule-augmented Generation for Large Language Models
par: Zhang, Yudi, et autres
Publié: (2024)
par: Zhang, Yudi, et autres
Publié: (2024)
CityGPT: Empowering Urban Spatial Cognition of Large Language Models
par: Feng, Jie, et autres
Publié: (2024)
par: Feng, Jie, et autres
Publié: (2024)
Offline Imitation Learning Through Graph Search and Retrieval
par: Yin, Zhao-Heng, et autres
Publié: (2024)
par: Yin, Zhao-Heng, et autres
Publié: (2024)
All Language Models Large and Small
par: Chen, Zhixun, et autres
Publié: (2024)
par: Chen, Zhixun, et autres
Publié: (2024)
Cold-Start Personalization via Training-Free Priors from Structured World Models
par: Bose, Avinandan, et autres
Publié: (2026)
par: Bose, Avinandan, et autres
Publié: (2026)
NOVER: Incentive Training for Language Models via Verifier-Free Reinforcement Learning
par: Liu, Wei, et autres
Publié: (2025)
par: Liu, Wei, et autres
Publié: (2025)
Unified Multi-Task Learning & Model Fusion for Efficient Language Model Guardrailing
par: Neill, James O', et autres
Publié: (2025)
par: Neill, James O', et autres
Publié: (2025)
Training Language Models via Neural Cellular Automata
par: Lee, Dan, et autres
Publié: (2026)
par: Lee, Dan, et autres
Publié: (2026)
TopicProphet: Prophesies on Temporal Topic Trends and Stocks
par: Kim, Olivia
Publié: (2025)
par: Kim, Olivia
Publié: (2025)
ModelingAgent: Bridging LLMs and Mathematical Modeling for Real-World Challenges
par: Qian, Cheng, et autres
Publié: (2025)
par: Qian, Cheng, et autres
Publié: (2025)
PAT: Pruning-Aware Tuning for Large Language Models
par: Liu, Yijiang, et autres
Publié: (2024)
par: Liu, Yijiang, et autres
Publié: (2024)
Optimizing Temperature for Language Models with Multi-Sample Inference
par: Du, Weihua, et autres
Publié: (2025)
par: Du, Weihua, et autres
Publié: (2025)
Exploring Multilingual Probing in Large Language Models: A Cross-Language Analysis
par: Li, Daoyang, et autres
Publié: (2024)
par: Li, Daoyang, et autres
Publié: (2024)
Documents similaires
-
Q-SFT: Q-Learning for Language Models via Supervised Fine-Tuning
par: Hong, Joey, et autres
Publié: (2024) -
Training Agents Inside of Scalable World Models
par: Hafner, Danijar, et autres
Publié: (2025) -
One Step Diffusion via Shortcut Models
par: Frans, Kevin, et autres
Publié: (2024) -
Interactive Dialogue Agents via Reinforcement Learning on Hindsight Regenerations
par: Hong, Joey, et autres
Publié: (2024) -
Mastering Diverse Domains through World Models
par: Hafner, Danijar, et autres
Publié: (2023)