Pre-training data selection for biomedical domain adaptation using journal impact metrics
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Laï-king, Mathieu, Paroubek, Patrick |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Plain language adaptations of biomedical text using LLMs: Comparision of evaluation metrics
par: Kocbek, Primoz, et autres
Publié: (2025)
par: Kocbek, Primoz, et autres
Publié: (2025)
On Initializing Transformers with Pre-trained Embeddings
par: Kim, Ha Young, et autres
Publié: (2024)
par: Kim, Ha Young, et autres
Publié: (2024)
Arabic Hate Speech Identification and Masking in Social Media using Deep Learning Models and Pre-trained Models Fine-tuning
par: Doghmash, Salam Thabet, et autres
Publié: (2025)
par: Doghmash, Salam Thabet, et autres
Publié: (2025)
CRISP: Persistent Concept Unlearning via Sparse Autoencoders
par: Ashuach, Tomer, et autres
Publié: (2025)
par: Ashuach, Tomer, et autres
Publié: (2025)
Influence-driven Curriculum Learning for Pre-training on Limited Data
par: Schoenegger, Loris, et autres
Publié: (2025)
par: Schoenegger, Loris, et autres
Publié: (2025)
WHoW: A Cross-domain Approach for Analysing Conversation Moderation
par: Chen, Ming-Bin, et autres
Publié: (2024)
par: Chen, Ming-Bin, et autres
Publié: (2024)
Towards Effective and Efficient Continual Pre-training of Large Language Models
par: Chen, Jie, et autres
Publié: (2024)
par: Chen, Jie, et autres
Publié: (2024)
Benchmarking the Performance of Pre-trained LLMs across Urdu NLP Tasks
par: Tahir, Munief Hassan, et autres
Publié: (2024)
par: Tahir, Munief Hassan, et autres
Publié: (2024)
Pre-trained Language Model with Prompts for Temporal Knowledge Graph Completion
par: Xu, Wenjie, et autres
Publié: (2023)
par: Xu, Wenjie, et autres
Publié: (2023)
Unstructured Text Enhanced Open-domain Dialogue System: A Systematic Survey
par: Ma, Longxuan, et autres
Publié: (2024)
par: Ma, Longxuan, et autres
Publié: (2024)
Exploiting Pre-trained Encoder-Decoder Transformers for Sequence-to-Sequence Constituent Parsing
par: Fernández-González, Daniel, et autres
Publié: (2026)
par: Fernández-González, Daniel, et autres
Publié: (2026)
Zero-Shot Spam Email Classification Using Pre-trained Large Language Models
par: Rojas-Galeano, Sergio
Publié: (2024)
par: Rojas-Galeano, Sergio
Publié: (2024)
Pre-trained Models Perform the Best When Token Distributions Follow Zipf's Law
par: He, Yanjin, et autres
Publié: (2025)
par: He, Yanjin, et autres
Publié: (2025)
WSM: Decay-Free Learning Rate Schedule via Checkpoint Merging for LLM Pre-training
par: Tian, Changxin, et autres
Publié: (2025)
par: Tian, Changxin, et autres
Publié: (2025)
TrustAI at SemEval-2024 Task 8: A Comprehensive Analysis of Multi-domain Machine Generated Text Detection Techniques
par: Urlana, Ashok, et autres
Publié: (2024)
par: Urlana, Ashok, et autres
Publié: (2024)
RomanLens: The Role Of Latent Romanization In Multilinguality In LLMs
par: Saji, Alan, et autres
Publié: (2025)
par: Saji, Alan, et autres
Publié: (2025)
Text-Based Approaches to Item Difficulty Modeling in Large-Scale Assessments: A Systematic Review
par: Peters, Sydney, et autres
Publié: (2025)
par: Peters, Sydney, et autres
Publié: (2025)
Evaluation of Clinical Trials Reporting Quality using Large Language Models
par: Laï-king, Mathieu, et autres
Publié: (2025)
par: Laï-king, Mathieu, et autres
Publié: (2025)
UM_FHS at TREC 2024 PLABA: Exploration of Fine-tuning and AI agent approach for plain language adaptations of biomedical text
par: Kocbek, Primoz, et autres
Publié: (2025)
par: Kocbek, Primoz, et autres
Publié: (2025)
Breaking Free Transformer Models: Task-specific Context Attribution Promises Improved Generalizability Without Fine-tuning Pre-trained LLMs
par: Tytarenko, Stepan, et autres
Publié: (2024)
par: Tytarenko, Stepan, et autres
Publié: (2024)
Determination of language families using deep learning
par: Lerner, Peter B.
Publié: (2024)
par: Lerner, Peter B.
Publié: (2024)
Towards Fundamental Language Models: Does Linguistic Competence Scale with Model Size?
par: Collado-Montañez, Jaime, et autres
Publié: (2025)
par: Collado-Montañez, Jaime, et autres
Publié: (2025)
SeLeRoSa: Sentence-Level Romanian Satire Detection Dataset
par: Smădu, Răzvan-Alexandru, et autres
Publié: (2025)
par: Smădu, Răzvan-Alexandru, et autres
Publié: (2025)
Measuring text summarization factuality using atomic facts entailment metrics in the context of retrieval augmented generation
par: Kriman, N. E.
Publié: (2024)
par: Kriman, N. E.
Publié: (2024)
Dialect Normalization using Large Language Models and Morphological Rules
par: Dimakis, Antonios, et autres
Publié: (2025)
par: Dimakis, Antonios, et autres
Publié: (2025)
PeLLE: Encoder-based language models for Brazilian Portuguese based on open data
par: de Mello, Guilherme Lamartine, et autres
Publié: (2024)
par: de Mello, Guilherme Lamartine, et autres
Publié: (2024)
LinkNER: Linking Local Named Entity Recognition Models to Large Language Models using Uncertainty
par: Zhang, Zhen, et autres
Publié: (2024)
par: Zhang, Zhen, et autres
Publié: (2024)
"AGI" team at SHROOM-CAP: Data-Centric Approach to Multilingual Hallucination Detection using XLM-RoBERTa
par: Rathva, Harsh, et autres
Publié: (2025)
par: Rathva, Harsh, et autres
Publié: (2025)
Fin-ExBERT: User Intent based Text Extraction in Financial Context using Graph-Augmented BERT and trainable Plugin
par: Sarker, Soumick, et autres
Publié: (2025)
par: Sarker, Soumick, et autres
Publié: (2025)
$FastDoc$: Domain-Specific Fast Continual Pre-training Technique using Document-Level Metadata and Taxonomy
par: Nandy, Abhilash, et autres
Publié: (2023)
par: Nandy, Abhilash, et autres
Publié: (2023)
Graphemic Normalization of the Perso-Arabic Script
par: Doctor, Raiomond, et autres
Publié: (2022)
par: Doctor, Raiomond, et autres
Publié: (2022)
Beyond Arabic: Software for Perso-Arabic Script Manipulation
par: Gutkin, Alexander, et autres
Publié: (2023)
par: Gutkin, Alexander, et autres
Publié: (2023)
Low-resource neural machine translation with morphological modeling
par: Nzeyimana, Antoine
Publié: (2024)
par: Nzeyimana, Antoine
Publié: (2024)
KinyaColBERT: A Lexically Grounded Retrieval Model for Low-Resource Retrieval-Augmented Generation
par: Nzeyimana, Antoine, et autres
Publié: (2025)
par: Nzeyimana, Antoine, et autres
Publié: (2025)
Dynamic Domain Information Modulation Algorithm for Multi-domain Sentiment Analysis
par: Yue, Chunyi, et autres
Publié: (2025)
par: Yue, Chunyi, et autres
Publié: (2025)
Evaluating the Efficacy of Hybrid Deep Learning Models in Distinguishing AI-Generated Text
par: Oketunji, Abiodun Finbarrs
Publié: (2023)
par: Oketunji, Abiodun Finbarrs
Publié: (2023)
PowLU: An Activation Function for Stable Pre-Training of LLMs
par: Jiang, Peijie, et autres
Publié: (2026)
par: Jiang, Peijie, et autres
Publié: (2026)
Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment
par: Zhang, Yizhuo, et autres
Publié: (2025)
par: Zhang, Yizhuo, et autres
Publié: (2025)
Advances in Pre-trained Language Models for Domain-Specific Text Classification: A Systematic Review
par: Rostam, Zhyar Rzgar K., et autres
Publié: (2025)
par: Rostam, Zhyar Rzgar K., et autres
Publié: (2025)
Prompt Compression in Production Task Orchestration: A Pre-Registered Randomized Trial
par: Johnson, Warren, et autres
Publié: (2026)
par: Johnson, Warren, et autres
Publié: (2026)
Documents similaires
-
Plain language adaptations of biomedical text using LLMs: Comparision of evaluation metrics
par: Kocbek, Primoz, et autres
Publié: (2025) -
On Initializing Transformers with Pre-trained Embeddings
par: Kim, Ha Young, et autres
Publié: (2024) -
Arabic Hate Speech Identification and Masking in Social Media using Deep Learning Models and Pre-trained Models Fine-tuning
par: Doghmash, Salam Thabet, et autres
Publié: (2025) -
CRISP: Persistent Concept Unlearning via Sparse Autoencoders
par: Ashuach, Tomer, et autres
Publié: (2025) -
Influence-driven Curriculum Learning for Pre-training on Limited Data
par: Schoenegger, Loris, et autres
Publié: (2025)