Enregistré dans:
| Auteur principal: | Grigorev, George |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2602.02522 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
PhoneLM:an Efficient and Capable Small Language Model Family through Principled Pre-training
par: Yi, Rongjie, et autres
Publié: (2024)
par: Yi, Rongjie, et autres
Publié: (2024)
Scaling Smart: Accelerating Large Language Model Pre-training with Small Model Initialization
par: Samragh, Mohammad, et autres
Publié: (2024)
par: Samragh, Mohammad, et autres
Publié: (2024)
An Efficient Replay for Class-Incremental Learning with Pre-trained Models
par: Yin, Weimin, et autres
Publié: (2024)
par: Yin, Weimin, et autres
Publié: (2024)
Towards Efficient Pre-training: Exploring FP4 Precision in Large Language Models
par: Zhou, Jiecheng, et autres
Publié: (2025)
par: Zhou, Jiecheng, et autres
Publié: (2025)
Pre-trained Large Language Models Learn Hidden Markov Models In-context
par: Dai, Yijia, et autres
Publié: (2025)
par: Dai, Yijia, et autres
Publié: (2025)
Investigating Data Contamination for Pre-training Language Models
par: Jiang, Minhao, et autres
Publié: (2024)
par: Jiang, Minhao, et autres
Publié: (2024)
Aligning Pre-trained Models for Spoken Language Translation
par: Sedláček, Šimon, et autres
Publié: (2024)
par: Sedláček, Šimon, et autres
Publié: (2024)
Sequence-to-Sequence Spanish Pre-trained Language Models
par: Araujo, Vladimir, et autres
Publié: (2023)
par: Araujo, Vladimir, et autres
Publié: (2023)
Utilizing Strategic Pre-training to Reduce Overfitting: Baguan -- A Pre-trained Weather Forecasting Model
par: Niu, Peisong, et autres
Publié: (2025)
par: Niu, Peisong, et autres
Publié: (2025)
FGBERT: Function-Driven Pre-trained Gene Language Model for Metagenomics
par: Duan, ChenRui, et autres
Publié: (2024)
par: Duan, ChenRui, et autres
Publié: (2024)
Integrating Pre-trained Language Model into Neural Machine Translation
par: Hwang, Soon-Jae, et autres
Publié: (2023)
par: Hwang, Soon-Jae, et autres
Publié: (2023)
Mochi: Aligning Pre-training and Inference for Efficient Graph Foundation Models via Meta-Learning
par: Mattos, João, et autres
Publié: (2026)
par: Mattos, João, et autres
Publié: (2026)
Feature Alignment: Rethinking Efficient Active Learning via Proxy in the Context of Pre-trained Models
par: Wen, Ziting, et autres
Publié: (2024)
par: Wen, Ziting, et autres
Publié: (2024)
Pre-training a Transformer-Based Generative Model Using a Small Sepedi Dataset
par: Ramalepe, Simon P., et autres
Publié: (2025)
par: Ramalepe, Simon P., et autres
Publié: (2025)
OSF: On Pre-training and Scaling of Sleep Foundation Models
par: Shuai, Zitao, et autres
Publié: (2026)
par: Shuai, Zitao, et autres
Publié: (2026)
Transfer Learning with Pre-trained Conditional Generative Models
par: Yamaguchi, Shin'ya, et autres
Publié: (2022)
par: Yamaguchi, Shin'ya, et autres
Publié: (2022)
Scaling Laws for Pre-training Agents and World Models
par: Pearce, Tim, et autres
Publié: (2024)
par: Pearce, Tim, et autres
Publié: (2024)
Self-Training for Sample-Efficient Active Learning for Text Classification with Pre-Trained Language Models
par: Schröder, Christopher, et autres
Publié: (2024)
par: Schröder, Christopher, et autres
Publié: (2024)
Simple and Scalable Strategies to Continually Pre-train Large Language Models
par: Ibrahim, Adam, et autres
Publié: (2024)
par: Ibrahim, Adam, et autres
Publié: (2024)
Pre-training Limited Memory Language Models with Internal and External Knowledge
par: Zhao, Linxi, et autres
Publié: (2025)
par: Zhao, Linxi, et autres
Publié: (2025)
Sparse is Enough in Fine-tuning Pre-trained Large Language Models
par: Song, Weixi, et autres
Publié: (2023)
par: Song, Weixi, et autres
Publié: (2023)
Automated Traffic Incident Response Plans using Generative Artificial Intelligence: Part 1 -- Building the Incident Response Benchmark
par: Grigorev, Artur, et autres
Publié: (2025)
par: Grigorev, Artur, et autres
Publié: (2025)
Machine Unlearning of Pre-trained Large Language Models
par: Yao, Jin, et autres
Publié: (2024)
par: Yao, Jin, et autres
Publié: (2024)
The Future of Large Language Model Pre-training is Federated
par: Sani, Lorenzo, et autres
Publié: (2024)
par: Sani, Lorenzo, et autres
Publié: (2024)
Revisiting Pre-trained Language Models for Vulnerability Detection
par: Li, Youpeng, et autres
Publié: (2025)
par: Li, Youpeng, et autres
Publié: (2025)
A Vision-Language Pre-training Model-Guided Approach for Mitigating Backdoor Attacks in Federated Learning
par: Gai, Keke, et autres
Publié: (2025)
par: Gai, Keke, et autres
Publié: (2025)
Reading Your Heart: Learning ECG Words and Sentences via Pre-training ECG Language Model
par: Jin, Jiarui, et autres
Publié: (2025)
par: Jin, Jiarui, et autres
Publié: (2025)
MoMa: Efficient Early-Fusion Pre-training with Mixture of Modality-Aware Experts
par: Lin, Xi Victoria, et autres
Publié: (2024)
par: Lin, Xi Victoria, et autres
Publié: (2024)
Graph Generative Pre-trained Transformer
par: Chen, Xiaohui, et autres
Publié: (2025)
par: Chen, Xiaohui, et autres
Publié: (2025)
HiFloat4 Format for Language Model Pre-training on Ascend NPUs
par: Taghian, Mehran, et autres
Publié: (2026)
par: Taghian, Mehran, et autres
Publié: (2026)
CDGP: Automatic Cloze Distractor Generation based on Pre-trained Language Model
par: Chiang, Shang-Hsuan, et autres
Publié: (2024)
par: Chiang, Shang-Hsuan, et autres
Publié: (2024)
CASE: Efficient Curricular Data Pre-training for Building Assistive Psychology Expert Models
par: Harne, Sarthak, et autres
Publié: (2024)
par: Harne, Sarthak, et autres
Publié: (2024)
Heterogeneous Graph Pre-training Based Model for Secure and Efficient Prediction of Default Risk Propagation among Bond Issuers
par: Li, Xurui, et autres
Publié: (2025)
par: Li, Xurui, et autres
Publié: (2025)
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing
par: Toral, Lukas, et autres
Publié: (2025)
par: Toral, Lukas, et autres
Publié: (2025)
Pre-trained Molecular Language Models with Random Functional Group Masking
par: Peng, Tianhao, et autres
Publié: (2024)
par: Peng, Tianhao, et autres
Publié: (2024)
Priming: Hybrid State Space Models From Pre-trained Transformers
par: Chattopadhyay, Aditya, et autres
Publié: (2026)
par: Chattopadhyay, Aditya, et autres
Publié: (2026)
A Pre-trained Data Deduplication Model based on Active Learning
par: Shi, Haochen, et autres
Publié: (2023)
par: Shi, Haochen, et autres
Publié: (2023)
Efficient Online RL Fine Tuning with Offline Pre-trained Policy Only
par: Xiao, Wei, et autres
Publié: (2025)
par: Xiao, Wei, et autres
Publié: (2025)
Unleashing The Power of Pre-Trained Language Models for Irregularly Sampled Time Series
par: Zhang, Weijia, et autres
Publié: (2024)
par: Zhang, Weijia, et autres
Publié: (2024)
On the Surprising Efficacy of Distillation as an Alternative to Pre-Training Small Models
par: Farhat, Sean, et autres
Publié: (2024)
par: Farhat, Sean, et autres
Publié: (2024)
Documents similaires
-
PhoneLM:an Efficient and Capable Small Language Model Family through Principled Pre-training
par: Yi, Rongjie, et autres
Publié: (2024) -
Scaling Smart: Accelerating Large Language Model Pre-training with Small Model Initialization
par: Samragh, Mohammad, et autres
Publié: (2024) -
An Efficient Replay for Class-Incremental Learning with Pre-trained Models
par: Yin, Weimin, et autres
Publié: (2024) -
Towards Efficient Pre-training: Exploring FP4 Precision in Large Language Models
par: Zhou, Jiecheng, et autres
Publié: (2025) -
Pre-trained Large Language Models Learn Hidden Markov Models In-context
par: Dai, Yijia, et autres
Publié: (2025)