NukeBERT: A Pre-trained language model for Low Resource Nuclear Domain
Fuente:
arXiv
Guardado en:
| Autores principales: | Jain, Ayush, Meenachi, N. M., Venkatraman, B. |
|---|---|
| Formato: | Preprint |
| Publicado: |
2020
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Chinese MentalBERT: Domain-Adaptive Pre-training on Social Media for Chinese Mental Health Text Analysis
por: Zhai, Wei, et al.
Publicado: (2024)
por: Zhai, Wei, et al.
Publicado: (2024)
MedicalBERT: enhancing biomedical natural language processing using pretrained BERT-based model
por: Reddy, K. Sahit, et al.
Publicado: (2025)
por: Reddy, K. Sahit, et al.
Publicado: (2025)
MLKD-BERT: Multi-level Knowledge Distillation for Pre-trained Language Models
por: Zhang, Ying, et al.
Publicado: (2024)
por: Zhang, Ying, et al.
Publicado: (2024)
Clinical information extraction for Low-resource languages with Few-shot learning using Pre-trained language models and Prompting
por: Richter-Pechanski, Phillip, et al.
Publicado: (2024)
por: Richter-Pechanski, Phillip, et al.
Publicado: (2024)
BERT-like Pre-training for Symbolic Piano Music Classification Tasks
por: Chou, Yi-Hui, et al.
Publicado: (2021)
por: Chou, Yi-Hui, et al.
Publicado: (2021)
LakotaBERT: A Transformer-based Model for Low Resource Lakota Language
por: Parankusham, Kanishka, et al.
Publicado: (2025)
por: Parankusham, Kanishka, et al.
Publicado: (2025)
On Importance of Layer Pruning for Smaller BERT Models and Low Resource Languages
por: Shirke, Mayur, et al.
Publicado: (2025)
por: Shirke, Mayur, et al.
Publicado: (2025)
Adapting Multilingual LLMs to Low-Resource Languages using Continued Pre-training and Synthetic Corpus
por: Joshi, Raviraj, et al.
Publicado: (2024)
por: Joshi, Raviraj, et al.
Publicado: (2024)
Diffusion Domain Expansion: Learning to Coordinate Pre-trained Diffusion Models
por: Lifar, Egor, et al.
Publicado: (2026)
por: Lifar, Egor, et al.
Publicado: (2026)
Pre-trained knowledge elevates large language models beyond traditional chemical reaction optimizers
por: MacKnight, Robert, et al.
Publicado: (2025)
por: MacKnight, Robert, et al.
Publicado: (2025)
Software Vulnerability Prediction in Low-Resource Languages: An Empirical Study of CodeBERT and ChatGPT
por: Le, Triet H. M., et al.
Publicado: (2024)
por: Le, Triet H. M., et al.
Publicado: (2024)
Cross-Domain Pre-training with Language Models for Transferable Time Series Representations
por: Cheng, Mingyue, et al.
Publicado: (2024)
por: Cheng, Mingyue, et al.
Publicado: (2024)
LOST: Low-rank and Sparse Pre-training for Large Language Models
por: Li, Jiaxi, et al.
Publicado: (2025)
por: Li, Jiaxi, et al.
Publicado: (2025)
Explainable AI in Big Data Fraud Detection
por: Jain, Ayush, et al.
Publicado: (2025)
por: Jain, Ayush, et al.
Publicado: (2025)
Unified Multi-Domain Graph Pre-training for Homogeneous and Heterogeneous Graphs via Domain-Specific Expert Encoding
por: Liang, Chundong, et al.
Publicado: (2026)
por: Liang, Chundong, et al.
Publicado: (2026)
Large Pre-trained time series models for cross-domain Time series analysis tasks
por: Kamarthi, Harshavardhan, et al.
Publicado: (2023)
por: Kamarthi, Harshavardhan, et al.
Publicado: (2023)
polyGen: A Learning Framework for Atomic-level Polymer Structure Generation
por: Jain, Ayush, et al.
Publicado: (2025)
por: Jain, Ayush, et al.
Publicado: (2025)
An Empirical Analysis of Forgetting in Pre-trained Models with Incremental Low-Rank Updates
por: Soutif--Cormerais, Albin, et al.
Publicado: (2024)
por: Soutif--Cormerais, Albin, et al.
Publicado: (2024)
C-LoRA: Continual Low-Rank Adaptation for Pre-trained Models
por: Zhang, Xin, et al.
Publicado: (2025)
por: Zhang, Xin, et al.
Publicado: (2025)
Efficient Continual Pre-training of LLMs for Low-resource Languages
por: Nag, Arijit, et al.
Publicado: (2024)
por: Nag, Arijit, et al.
Publicado: (2024)
PreLoRA: Hybrid Pre-training of Vision Transformers with Full Training and Low-Rank Adapters
por: Thapa, Krishu K, et al.
Publicado: (2025)
por: Thapa, Krishu K, et al.
Publicado: (2025)
SmilesT5: Domain-specific pretraining for molecular language models
por: Spence, Philip, et al.
Publicado: (2025)
por: Spence, Philip, et al.
Publicado: (2025)
Parameter Estimation in Quantum Metrology Technique for Time Series Prediction
por: Sharma, Vaidik A, et al.
Publicado: (2024)
por: Sharma, Vaidik A, et al.
Publicado: (2024)
CEEBERT: Cross-Domain Inference in Early Exit BERT
por: Bajpai, Divya Jyoti, et al.
Publicado: (2024)
por: Bajpai, Divya Jyoti, et al.
Publicado: (2024)
Improving training time and GPU utilization in geo-distributed language model training
por: Palak, et al.
Publicado: (2024)
por: Palak, et al.
Publicado: (2024)
Improving Low-Resource Knowledge Tracing Tasks by Supervised Pre-training and Importance Mechanism Fine-tuning
por: Zhang, Hengyuan, et al.
Publicado: (2024)
por: Zhang, Hengyuan, et al.
Publicado: (2024)
Exploring Pre-training Across Domains for Few-Shot Surgical Skill Assessment
por: Anastasiou, Dimitrios, et al.
Publicado: (2025)
por: Anastasiou, Dimitrios, et al.
Publicado: (2025)
Amortizing intractable inference in diffusion models for vision, language, and control
por: Venkatraman, Siddarth, et al.
Publicado: (2024)
por: Venkatraman, Siddarth, et al.
Publicado: (2024)
Train on Validation (ToV): Fast data selection with applications to fine-tuning
por: Jain, Ayush, et al.
Publicado: (2025)
por: Jain, Ayush, et al.
Publicado: (2025)
Scaling laws for learning with real and surrogate data
por: Jain, Ayush, et al.
Publicado: (2024)
por: Jain, Ayush, et al.
Publicado: (2024)
Lightweight reranking for language model generations
por: Jain, Siddhartha, et al.
Publicado: (2023)
por: Jain, Siddhartha, et al.
Publicado: (2023)
LatticeGraphNet: A two-scale graph neural operator for simulating lattice structures
por: Jain, Ayush, et al.
Publicado: (2024)
por: Jain, Ayush, et al.
Publicado: (2024)
GP2F: Cross-Domain Graph Prompting with Adaptive Fusion of Pre-trained Graph Neural Networks
por: He, Dongxiao, et al.
Publicado: (2026)
por: He, Dongxiao, et al.
Publicado: (2026)
GraphControl: Adding Conditional Control to Universal Graph Pre-trained Models for Graph Domain Transfer Learning
por: Zhu, Yun, et al.
Publicado: (2023)
por: Zhu, Yun, et al.
Publicado: (2023)
Pre-training under infinite compute
por: Kim, Konwoo, et al.
Publicado: (2025)
por: Kim, Konwoo, et al.
Publicado: (2025)
BiPFT: Binary Pre-trained Foundation Transformer with Low-rank Estimation of Binarization Residual Polynomials
por: Xing, Xingrun, et al.
Publicado: (2023)
por: Xing, Xingrun, et al.
Publicado: (2023)
Continual Quantization-Aware Pre-Training: When to transition from 16-bit to 1.58-bit pre-training for BitNet language models?
por: Nielsen, Jacob, et al.
Publicado: (2025)
por: Nielsen, Jacob, et al.
Publicado: (2025)
Data filtering methods for training language models
por: Shevchenko, Egor, et al.
Publicado: (2026)
por: Shevchenko, Egor, et al.
Publicado: (2026)
TimesBERT: A BERT-Style Foundation Model for Time Series Understanding
por: Zhang, Haoran, et al.
Publicado: (2025)
por: Zhang, Haoran, et al.
Publicado: (2025)
Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training
por: Yang, Kailai, et al.
Publicado: (2025)
por: Yang, Kailai, et al.
Publicado: (2025)
Ejemplares similares
-
Chinese MentalBERT: Domain-Adaptive Pre-training on Social Media for Chinese Mental Health Text Analysis
por: Zhai, Wei, et al.
Publicado: (2024) -
MedicalBERT: enhancing biomedical natural language processing using pretrained BERT-based model
por: Reddy, K. Sahit, et al.
Publicado: (2025) -
MLKD-BERT: Multi-level Knowledge Distillation for Pre-trained Language Models
por: Zhang, Ying, et al.
Publicado: (2024) -
Clinical information extraction for Low-resource languages with Few-shot learning using Pre-trained language models and Prompting
por: Richter-Pechanski, Phillip, et al.
Publicado: (2024) -
BERT-like Pre-training for Symbolic Piano Music Classification Tasks
por: Chou, Yi-Hui, et al.
Publicado: (2021)