Scaling Laws for Pre-training Agents and World Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Pearce, Tim, Rashid, Tabish, Bignell, Dave, Georgescu, Raluca, Devlin, Sam, Hofmann, Katja |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Adapting Vision-Language Models for Evaluating World Models
por: Hendriksen, Mariya, et al.
Publicado: (2025)
por: Hendriksen, Mariya, et al.
Publicado: (2025)
Aligning Agents like Large Language Models
por: Jelley, Adam, et al.
Publicado: (2024)
por: Jelley, Adam, et al.
Publicado: (2024)
Visual Encoders for Data-Efficient Imitation Learning in Modern Video Games
por: Schäfer, Lukas, et al.
Publicado: (2023)
por: Schäfer, Lukas, et al.
Publicado: (2023)
Adapting a World Model for Trajectory Following in a 3D Game
por: Tot, Marko, et al.
Publicado: (2025)
por: Tot, Marko, et al.
Publicado: (2025)
OSF: On Pre-training and Scaling of Sleep Foundation Models
por: Shuai, Zitao, et al.
Publicado: (2026)
por: Shuai, Zitao, et al.
Publicado: (2026)
Power Lines: Scaling Laws for Weight Decay and Batch Size in LLM Pre-training
por: Bergsma, Shane, et al.
Publicado: (2025)
por: Bergsma, Shane, et al.
Publicado: (2025)
The Achilles Heel of AI: Fundamentals of Risk-Aware Training Data for High-Consequence Models
por: Cook, Dave, et al.
Publicado: (2025)
por: Cook, Dave, et al.
Publicado: (2025)
Demystifying Synthetic Data in LLM Pre-training: A Systematic Study of Scaling Laws, Benefits, and Pitfalls
por: Kang, Feiyang, et al.
Publicado: (2025)
por: Kang, Feiyang, et al.
Publicado: (2025)
COSMOS: Cross-Modality Self-Distillation for Vision Language Pre-training
por: Kim, Sanghwan, et al.
Publicado: (2024)
por: Kim, Sanghwan, et al.
Publicado: (2024)
Utilizing Strategic Pre-training to Reduce Overfitting: Baguan -- A Pre-trained Weather Forecasting Model
por: Niu, Peisong, et al.
Publicado: (2025)
por: Niu, Peisong, et al.
Publicado: (2025)
Scaling Laws for Imitation Learning in Single-Agent Games
por: Tuyls, Jens, et al.
Publicado: (2023)
por: Tuyls, Jens, et al.
Publicado: (2023)
Using Scaling Laws for Data Source Utility Estimation in Domain-Specific Pre-Training
por: Ostapenko, Oleksiy, et al.
Publicado: (2025)
por: Ostapenko, Oleksiy, et al.
Publicado: (2025)
Transfer Learning with Pre-trained Conditional Generative Models
por: Yamaguchi, Shin'ya, et al.
Publicado: (2022)
por: Yamaguchi, Shin'ya, et al.
Publicado: (2022)
Scaling Smart: Accelerating Large Language Model Pre-training with Small Model Initialization
por: Samragh, Mohammad, et al.
Publicado: (2024)
por: Samragh, Mohammad, et al.
Publicado: (2024)
Knockoff-Guided Feature Selection via A Single Pre-trained Reinforced Agent
por: Wang, Xinyuan, et al.
Publicado: (2024)
por: Wang, Xinyuan, et al.
Publicado: (2024)
Scaling Law Hypothesis for Multimodal Model
por: Sun, Qingyun, et al.
Publicado: (2024)
por: Sun, Qingyun, et al.
Publicado: (2024)
An Efficient Replay for Class-Incremental Learning with Pre-trained Models
por: Yin, Weimin, et al.
Publicado: (2024)
por: Yin, Weimin, et al.
Publicado: (2024)
How Does Critical Batch Size Scale in Pre-training?
por: Zhang, Hanlin, et al.
Publicado: (2024)
por: Zhang, Hanlin, et al.
Publicado: (2024)
Real-TabPFN: Improving Tabular Foundation Models via Continued Pre-training With Real-World Data
por: Garg, Anurag, et al.
Publicado: (2025)
por: Garg, Anurag, et al.
Publicado: (2025)
Graph Generative Pre-trained Transformer
por: Chen, Xiaohui, et al.
Publicado: (2025)
por: Chen, Xiaohui, et al.
Publicado: (2025)
Pre-trained Large Language Models Learn Hidden Markov Models In-context
por: Dai, Yijia, et al.
Publicado: (2025)
por: Dai, Yijia, et al.
Publicado: (2025)
Priming: Hybrid State Space Models From Pre-trained Transformers
por: Chattopadhyay, Aditya, et al.
Publicado: (2026)
por: Chattopadhyay, Aditya, et al.
Publicado: (2026)
A Pre-trained Data Deduplication Model based on Active Learning
por: Shi, Haochen, et al.
Publicado: (2023)
por: Shi, Haochen, et al.
Publicado: (2023)
IMU-1: Sample-Efficient Pre-training of Small Language Models
por: Grigorev, George
Publicado: (2026)
por: Grigorev, George
Publicado: (2026)
Stabilizing RNN Gradients through Pre-training
por: Herranz-Celotti, Luca, et al.
Publicado: (2023)
por: Herranz-Celotti, Luca, et al.
Publicado: (2023)
An Empirical Study of Pre-trained Model Selection for Out-of-Distribution Generalization and Calibration
por: Naganuma, Hiroki, et al.
Publicado: (2023)
por: Naganuma, Hiroki, et al.
Publicado: (2023)
Compression via Pre-trained Transformers: A Study on Byte-Level Multimodal Data
por: Heurtel-Depeiges, David, et al.
Publicado: (2024)
por: Heurtel-Depeiges, David, et al.
Publicado: (2024)
Towards Neural Scaling Laws for Time Series Foundation Models
por: Yao, Qingren, et al.
Publicado: (2024)
por: Yao, Qingren, et al.
Publicado: (2024)
Gemstones: A Model Suite for Multi-Faceted Scaling Laws
por: McLeish, Sean, et al.
Publicado: (2025)
por: McLeish, Sean, et al.
Publicado: (2025)
World Modelling Improves Language Model Agents
por: Guo, Shangmin, et al.
Publicado: (2025)
por: Guo, Shangmin, et al.
Publicado: (2025)
LLaTTE: Scaling Laws for Multi-Stage Sequence Modeling in Large-Scale Ads Recommendation
por: Xiong, Lee, et al.
Publicado: (2026)
por: Xiong, Lee, et al.
Publicado: (2026)
Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training
por: Yang, Kailai, et al.
Publicado: (2025)
por: Yang, Kailai, et al.
Publicado: (2025)
Measuring Pre-training Data Quality without Labels for Time Series Foundation Models
por: Wen, Songkang, et al.
Publicado: (2024)
por: Wen, Songkang, et al.
Publicado: (2024)
Stanford Sleep Bench: Evaluating Polysomnography Pre-training Methods for Sleep Foundation Models
por: Kjaer, Magnus Ruud, et al.
Publicado: (2025)
por: Kjaer, Magnus Ruud, et al.
Publicado: (2025)
The Multi-Agent Reinforcement Learning in MalmÖ (MARLÖ) Competition
por: Perez-Liebana, Diego, et al.
Publicado: (2019)
por: Perez-Liebana, Diego, et al.
Publicado: (2019)
Multimodal Visual-Tactile Representation Learning through Self-Supervised Contrastive Pre-Training
por: Dave, Vedant, et al.
Publicado: (2024)
por: Dave, Vedant, et al.
Publicado: (2024)
Fast Autoregressive Video Generation with Diagonal Decoding
por: Ye, Yang, et al.
Publicado: (2025)
por: Ye, Yang, et al.
Publicado: (2025)
FGBERT: Function-Driven Pre-trained Gene Language Model for Metagenomics
por: Duan, ChenRui, et al.
Publicado: (2024)
por: Duan, ChenRui, et al.
Publicado: (2024)
Investigating Data Contamination for Pre-training Language Models
por: Jiang, Minhao, et al.
Publicado: (2024)
por: Jiang, Minhao, et al.
Publicado: (2024)
Aligning Pre-trained Models for Spoken Language Translation
por: Sedláček, Šimon, et al.
Publicado: (2024)
por: Sedláček, Šimon, et al.
Publicado: (2024)
Ejemplares similares
-
Adapting Vision-Language Models for Evaluating World Models
por: Hendriksen, Mariya, et al.
Publicado: (2025) -
Aligning Agents like Large Language Models
por: Jelley, Adam, et al.
Publicado: (2024) -
Visual Encoders for Data-Efficient Imitation Learning in Modern Video Games
por: Schäfer, Lukas, et al.
Publicado: (2023) -
Adapting a World Model for Trajectory Following in a 3D Game
por: Tot, Marko, et al.
Publicado: (2025) -
OSF: On Pre-training and Scaling of Sleep Foundation Models
por: Shuai, Zitao, et al.
Publicado: (2026)