Scaling Laws for Imitation Learning in Single-Agent Games
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Tuyls, Jens, Madeka, Dhruv, Torkkola, Kari, Foster, Dean, Narasimhan, Karthik, Kakade, Sham |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Neural Coordination and Capacity Control for Inventory Management
par: Eisenach, Carson, et autres
Publié: (2024)
par: Eisenach, Carson, et autres
Publié: (2024)
Learning an Inventory Control Policy with General Inventory Arrival Dynamics
par: Andaz, Sohrab, et autres
Publié: (2023)
par: Andaz, Sohrab, et autres
Publié: (2023)
A Study on the Calibration of In-context Learning
par: Zhang, Hanlin, et autres
Publié: (2023)
par: Zhang, Hanlin, et autres
Publié: (2023)
Language-Guided World Models: A Model-Based Approach to AI Control
par: Zhang, Alex, et autres
Publié: (2024)
par: Zhang, Alex, et autres
Publié: (2024)
Loss-to-Loss Prediction: Scaling Laws for All Datasets
par: Brandfonbrener, David, et autres
Publié: (2024)
par: Brandfonbrener, David, et autres
Publié: (2024)
How Does Critical Batch Size Scale in Pre-training?
par: Zhang, Hanlin, et autres
Publié: (2024)
par: Zhang, Hanlin, et autres
Publié: (2024)
Representation-Based Exploration for Language Models: From Test-Time to Post-Training
par: Tuyls, Jens, et autres
Publié: (2025)
par: Tuyls, Jens, et autres
Publié: (2025)
Scaling Laws in Linear Regression: Compute, Parameters, and Data
par: Lin, Licong, et autres
Publié: (2024)
par: Lin, Licong, et autres
Publié: (2024)
Prescriptive Scaling Reveals the Evolution of Language Model Capabilities
par: Zhang, Hanlin, et autres
Publié: (2026)
par: Zhang, Hanlin, et autres
Publié: (2026)
Learning Hidden Markov Models Using Conditional Samples
par: Kakade, Sham M., et autres
Publié: (2023)
par: Kakade, Sham M., et autres
Publié: (2023)
Can a MISL Fly? Analysis and Ingredients for Mutual Information Skill Learning
par: Zheng, Chongyi, et autres
Publié: (2024)
par: Zheng, Chongyi, et autres
Publié: (2024)
Connections between Schedule-Free Optimizers, AdEMAMix, and Accelerated SGD Variants
par: Morwani, Depen, et autres
Publié: (2025)
par: Morwani, Depen, et autres
Publié: (2025)
The Potential of Second-Order Optimization for LLMs: A Study with Full Gauss-Newton
par: Abreu, Natalie, et autres
Publié: (2025)
par: Abreu, Natalie, et autres
Publié: (2025)
Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning
par: Jin, Jikai, et autres
Publié: (2025)
par: Jin, Jikai, et autres
Publié: (2025)
Training LLM Agents to Empower Humans
par: Ellis, Evan, et autres
Publié: (2025)
par: Ellis, Evan, et autres
Publié: (2025)
Flash Inference: Near Linear Time Inference for Long Convolution Sequence Models and Beyond
par: Oncescu, Costin-Andrei, et autres
Publié: (2024)
par: Oncescu, Costin-Andrei, et autres
Publié: (2024)
Learning Representations in Video Game Agents with Supervised Contrastive Imitation Learning
par: Celemin, Carlos, et autres
Publié: (2025)
par: Celemin, Carlos, et autres
Publié: (2025)
Deconstructing What Makes a Good Optimizer for Language Models
par: Zhao, Rosie, et autres
Publié: (2024)
par: Zhao, Rosie, et autres
Publié: (2024)
Adversarial Imitation Learning via Boosting
par: Chang, Jonathan D., et autres
Publié: (2024)
par: Chang, Jonathan D., et autres
Publié: (2024)
Learning Strategy Representation for Imitation Learning in Multi-Agent Games
par: Lei, Shiqi, et autres
Publié: (2024)
par: Lei, Shiqi, et autres
Publié: (2024)
Soup to go: mitigating forgetting during continual learning with model averaging
par: Kleiman, Anat, et autres
Publié: (2025)
par: Kleiman, Anat, et autres
Publié: (2025)
Anytime Pretraining: Horizon-Free Learning-Rate Schedules with Weight Averaging
par: Meterez, Alexandru, et autres
Publié: (2026)
par: Meterez, Alexandru, et autres
Publié: (2026)
Repeat After Me: Transformers are Better than State Space Models at Copying
par: Jelassi, Samy, et autres
Publié: (2024)
par: Jelassi, Samy, et autres
Publié: (2024)
Universal Imitation Games
par: Mahadevan, Sridhar
Publié: (2024)
par: Mahadevan, Sridhar
Publié: (2024)
Imitation Game: Reproducing Deep Learning Bugs Leveraging an Intelligent Agent
par: Shah, Mehil B, et autres
Publié: (2025)
par: Shah, Mehil B, et autres
Publié: (2025)
Odysseus: Scaling VLMs to 100+ Turn Decision-Making in Games via Reinforcement Learning
par: Shi, Chengshuai, et autres
Publié: (2026)
par: Shi, Chengshuai, et autres
Publié: (2026)
Seesaw: Accelerating Training by Balancing Learning Rate and Batch Size Scheduling
par: Meterez, Alexandru, et autres
Publié: (2025)
par: Meterez, Alexandru, et autres
Publié: (2025)
Preference-Based Multi-Agent Reinforcement Learning: Data Coverage and Algorithmic Techniques
par: Zhang, Natalia, et autres
Publié: (2024)
par: Zhang, Natalia, et autres
Publié: (2024)
MAPF-GPT: Imitation Learning for Multi-Agent Pathfinding at Scale
par: Andreychuk, Anton, et autres
Publié: (2024)
par: Andreychuk, Anton, et autres
Publié: (2024)
BuilderBench: The Building Blocks of Intelligent Agents
par: Ghugare, Raj, et autres
Publié: (2025)
par: Ghugare, Raj, et autres
Publié: (2025)
CoLoR-Filter: Conditional Loss Reduction Filtering for Targeted Language Model Pre-training
par: Brandfonbrener, David, et autres
Publié: (2024)
par: Brandfonbrener, David, et autres
Publié: (2024)
The Role of Sparsity for Length Generalization in Transformers
par: Golowich, Noah, et autres
Publié: (2025)
par: Golowich, Noah, et autres
Publié: (2025)
Cognitive Architectures for Language Agents
par: Sumers, Theodore R., et autres
Publié: (2023)
par: Sumers, Theodore R., et autres
Publié: (2023)
Imitation from Diverse Behaviors: Wasserstein Quality Diversity Imitation Learning with Single-Step Archive Exploration
par: Yu, Xingrui, et autres
Publié: (2024)
par: Yu, Xingrui, et autres
Publié: (2024)
Follow My Instruction and Spill the Beans: Scalable Data Extraction from Retrieval-Augmented Generation Systems
par: Qi, Zhenting, et autres
Publié: (2024)
par: Qi, Zhenting, et autres
Publié: (2024)
ALAS: Autonomous Learning Agent for Self-Updating Language Models
par: Atreja, Dhruv
Publié: (2025)
par: Atreja, Dhruv
Publié: (2025)
Is Behavior Cloning All You Need? Understanding Horizon in Imitation Learning
par: Foster, Dylan J., et autres
Publié: (2024)
par: Foster, Dylan J., et autres
Publié: (2024)
SOAP: Improving and Stabilizing Shampoo using Adam
par: Vyas, Nikhil, et autres
Publié: (2024)
par: Vyas, Nikhil, et autres
Publié: (2024)
Contextual Experience Replay for Self-Improvement of Language Agents
par: Liu, Yitao, et autres
Publié: (2025)
par: Liu, Yitao, et autres
Publié: (2025)
Scaling Laws for Pre-training Agents and World Models
par: Pearce, Tim, et autres
Publié: (2024)
par: Pearce, Tim, et autres
Publié: (2024)
Documents similaires
-
Neural Coordination and Capacity Control for Inventory Management
par: Eisenach, Carson, et autres
Publié: (2024) -
Learning an Inventory Control Policy with General Inventory Arrival Dynamics
par: Andaz, Sohrab, et autres
Publié: (2023) -
A Study on the Calibration of In-context Learning
par: Zhang, Hanlin, et autres
Publié: (2023) -
Language-Guided World Models: A Model-Based Approach to AI Control
par: Zhang, Alex, et autres
Publié: (2024) -
Loss-to-Loss Prediction: Scaling Laws for All Datasets
par: Brandfonbrener, David, et autres
Publié: (2024)