Guardado en:
| Autor principal: | Grigorev, George |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2602.02522 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
PhoneLM:an Efficient and Capable Small Language Model Family through Principled Pre-training
por: Yi, Rongjie, et al.
Publicado: (2024)
por: Yi, Rongjie, et al.
Publicado: (2024)
Scaling Smart: Accelerating Large Language Model Pre-training with Small Model Initialization
por: Samragh, Mohammad, et al.
Publicado: (2024)
por: Samragh, Mohammad, et al.
Publicado: (2024)
An Efficient Replay for Class-Incremental Learning with Pre-trained Models
por: Yin, Weimin, et al.
Publicado: (2024)
por: Yin, Weimin, et al.
Publicado: (2024)
Towards Efficient Pre-training: Exploring FP4 Precision in Large Language Models
por: Zhou, Jiecheng, et al.
Publicado: (2025)
por: Zhou, Jiecheng, et al.
Publicado: (2025)
Pre-trained Large Language Models Learn Hidden Markov Models In-context
por: Dai, Yijia, et al.
Publicado: (2025)
por: Dai, Yijia, et al.
Publicado: (2025)
Investigating Data Contamination for Pre-training Language Models
por: Jiang, Minhao, et al.
Publicado: (2024)
por: Jiang, Minhao, et al.
Publicado: (2024)
Aligning Pre-trained Models for Spoken Language Translation
por: Sedláček, Šimon, et al.
Publicado: (2024)
por: Sedláček, Šimon, et al.
Publicado: (2024)
Sequence-to-Sequence Spanish Pre-trained Language Models
por: Araujo, Vladimir, et al.
Publicado: (2023)
por: Araujo, Vladimir, et al.
Publicado: (2023)
Utilizing Strategic Pre-training to Reduce Overfitting: Baguan -- A Pre-trained Weather Forecasting Model
por: Niu, Peisong, et al.
Publicado: (2025)
por: Niu, Peisong, et al.
Publicado: (2025)
FGBERT: Function-Driven Pre-trained Gene Language Model for Metagenomics
por: Duan, ChenRui, et al.
Publicado: (2024)
por: Duan, ChenRui, et al.
Publicado: (2024)
Integrating Pre-trained Language Model into Neural Machine Translation
por: Hwang, Soon-Jae, et al.
Publicado: (2023)
por: Hwang, Soon-Jae, et al.
Publicado: (2023)
Mochi: Aligning Pre-training and Inference for Efficient Graph Foundation Models via Meta-Learning
por: Mattos, João, et al.
Publicado: (2026)
por: Mattos, João, et al.
Publicado: (2026)
Feature Alignment: Rethinking Efficient Active Learning via Proxy in the Context of Pre-trained Models
por: Wen, Ziting, et al.
Publicado: (2024)
por: Wen, Ziting, et al.
Publicado: (2024)
Pre-training a Transformer-Based Generative Model Using a Small Sepedi Dataset
por: Ramalepe, Simon P., et al.
Publicado: (2025)
por: Ramalepe, Simon P., et al.
Publicado: (2025)
OSF: On Pre-training and Scaling of Sleep Foundation Models
por: Shuai, Zitao, et al.
Publicado: (2026)
por: Shuai, Zitao, et al.
Publicado: (2026)
Transfer Learning with Pre-trained Conditional Generative Models
por: Yamaguchi, Shin'ya, et al.
Publicado: (2022)
por: Yamaguchi, Shin'ya, et al.
Publicado: (2022)
Scaling Laws for Pre-training Agents and World Models
por: Pearce, Tim, et al.
Publicado: (2024)
por: Pearce, Tim, et al.
Publicado: (2024)
Self-Training for Sample-Efficient Active Learning for Text Classification with Pre-Trained Language Models
por: Schröder, Christopher, et al.
Publicado: (2024)
por: Schröder, Christopher, et al.
Publicado: (2024)
Simple and Scalable Strategies to Continually Pre-train Large Language Models
por: Ibrahim, Adam, et al.
Publicado: (2024)
por: Ibrahim, Adam, et al.
Publicado: (2024)
Pre-training Limited Memory Language Models with Internal and External Knowledge
por: Zhao, Linxi, et al.
Publicado: (2025)
por: Zhao, Linxi, et al.
Publicado: (2025)
Sparse is Enough in Fine-tuning Pre-trained Large Language Models
por: Song, Weixi, et al.
Publicado: (2023)
por: Song, Weixi, et al.
Publicado: (2023)
Automated Traffic Incident Response Plans using Generative Artificial Intelligence: Part 1 -- Building the Incident Response Benchmark
por: Grigorev, Artur, et al.
Publicado: (2025)
por: Grigorev, Artur, et al.
Publicado: (2025)
Machine Unlearning of Pre-trained Large Language Models
por: Yao, Jin, et al.
Publicado: (2024)
por: Yao, Jin, et al.
Publicado: (2024)
The Future of Large Language Model Pre-training is Federated
por: Sani, Lorenzo, et al.
Publicado: (2024)
por: Sani, Lorenzo, et al.
Publicado: (2024)
Revisiting Pre-trained Language Models for Vulnerability Detection
por: Li, Youpeng, et al.
Publicado: (2025)
por: Li, Youpeng, et al.
Publicado: (2025)
A Vision-Language Pre-training Model-Guided Approach for Mitigating Backdoor Attacks in Federated Learning
por: Gai, Keke, et al.
Publicado: (2025)
por: Gai, Keke, et al.
Publicado: (2025)
Reading Your Heart: Learning ECG Words and Sentences via Pre-training ECG Language Model
por: Jin, Jiarui, et al.
Publicado: (2025)
por: Jin, Jiarui, et al.
Publicado: (2025)
MoMa: Efficient Early-Fusion Pre-training with Mixture of Modality-Aware Experts
por: Lin, Xi Victoria, et al.
Publicado: (2024)
por: Lin, Xi Victoria, et al.
Publicado: (2024)
Graph Generative Pre-trained Transformer
por: Chen, Xiaohui, et al.
Publicado: (2025)
por: Chen, Xiaohui, et al.
Publicado: (2025)
HiFloat4 Format for Language Model Pre-training on Ascend NPUs
por: Taghian, Mehran, et al.
Publicado: (2026)
por: Taghian, Mehran, et al.
Publicado: (2026)
CDGP: Automatic Cloze Distractor Generation based on Pre-trained Language Model
por: Chiang, Shang-Hsuan, et al.
Publicado: (2024)
por: Chiang, Shang-Hsuan, et al.
Publicado: (2024)
CASE: Efficient Curricular Data Pre-training for Building Assistive Psychology Expert Models
por: Harne, Sarthak, et al.
Publicado: (2024)
por: Harne, Sarthak, et al.
Publicado: (2024)
Heterogeneous Graph Pre-training Based Model for Secure and Efficient Prediction of Default Risk Propagation among Bond Issuers
por: Li, Xurui, et al.
Publicado: (2025)
por: Li, Xurui, et al.
Publicado: (2025)
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing
por: Toral, Lukas, et al.
Publicado: (2025)
por: Toral, Lukas, et al.
Publicado: (2025)
Pre-trained Molecular Language Models with Random Functional Group Masking
por: Peng, Tianhao, et al.
Publicado: (2024)
por: Peng, Tianhao, et al.
Publicado: (2024)
Priming: Hybrid State Space Models From Pre-trained Transformers
por: Chattopadhyay, Aditya, et al.
Publicado: (2026)
por: Chattopadhyay, Aditya, et al.
Publicado: (2026)
A Pre-trained Data Deduplication Model based on Active Learning
por: Shi, Haochen, et al.
Publicado: (2023)
por: Shi, Haochen, et al.
Publicado: (2023)
Efficient Online RL Fine Tuning with Offline Pre-trained Policy Only
por: Xiao, Wei, et al.
Publicado: (2025)
por: Xiao, Wei, et al.
Publicado: (2025)
Unleashing The Power of Pre-Trained Language Models for Irregularly Sampled Time Series
por: Zhang, Weijia, et al.
Publicado: (2024)
por: Zhang, Weijia, et al.
Publicado: (2024)
On the Surprising Efficacy of Distillation as an Alternative to Pre-Training Small Models
por: Farhat, Sean, et al.
Publicado: (2024)
por: Farhat, Sean, et al.
Publicado: (2024)
Ejemplares similares
-
PhoneLM:an Efficient and Capable Small Language Model Family through Principled Pre-training
por: Yi, Rongjie, et al.
Publicado: (2024) -
Scaling Smart: Accelerating Large Language Model Pre-training with Small Model Initialization
por: Samragh, Mohammad, et al.
Publicado: (2024) -
An Efficient Replay for Class-Incremental Learning with Pre-trained Models
por: Yin, Weimin, et al.
Publicado: (2024) -
Towards Efficient Pre-training: Exploring FP4 Precision in Large Language Models
por: Zhou, Jiecheng, et al.
Publicado: (2025) -
Pre-trained Large Language Models Learn Hidden Markov Models In-context
por: Dai, Yijia, et al.
Publicado: (2025)