It's All in The [MASK]: Simple Instruction-Tuning Enables BERT-like Masked Language Models As Generative Classifiers
Fuente:
arXiv
Salvato in:
| Autori principali: | Clavié, Benjamin, Cooper, Nathan, Warner, Benjamin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Towards Better Monolingual Japanese Retrievers with Multi-Vector Models
di: Clavié, Benjamin
Pubblicazione: (2023)
di: Clavié, Benjamin
Pubblicazione: (2023)
Simple Projection Variants Improve ColBERT Performance
di: Clavié, Benjamin, et al.
Pubblicazione: (2025)
di: Clavié, Benjamin, et al.
Pubblicazione: (2025)
JaColBERTv2.5: Optimising Multi-Vector Retrievers to Create State-of-the-Art Japanese Retrievers with Constrained Resources
di: Clavié, Benjamin
Pubblicazione: (2024)
di: Clavié, Benjamin
Pubblicazione: (2024)
ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models
di: Clavié, Benjamin, et al.
Pubblicazione: (2025)
di: Clavié, Benjamin, et al.
Pubblicazione: (2025)
Conditional [MASK] Discrete Diffusion Language Model
di: Koh, Hyukhun, et al.
Pubblicazione: (2024)
di: Koh, Hyukhun, et al.
Pubblicazione: (2024)
Reducing the Footprint of Multi-Vector Retrieval with Minimal Performance Impact via Token Pooling
di: Clavié, Benjamin, et al.
Pubblicazione: (2024)
di: Clavié, Benjamin, et al.
Pubblicazione: (2024)
Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference
di: Warner, Benjamin, et al.
Pubblicazione: (2024)
di: Warner, Benjamin, et al.
Pubblicazione: (2024)
BPDec: Unveiling the Potential of Masked Language Modeling Decoder in BERT pretraining
di: Liang, Wen, et al.
Pubblicazione: (2024)
di: Liang, Wen, et al.
Pubblicazione: (2024)
Latent Terms: Dense Retrievers Contain Trivially Extractable BM25-ready Zipfian Vocabularies
di: Clavié, Benjamin, et al.
Pubblicazione: (2026)
di: Clavié, Benjamin, et al.
Pubblicazione: (2026)
Chip-Tuning: Classify Before Language Models Say
di: Zhu, Fangwei, et al.
Pubblicazione: (2024)
di: Zhu, Fangwei, et al.
Pubblicazione: (2024)
Fake News Detection: Comparative Evaluation of BERT-like Models and Large Language Models with Generative AI-Annotated Data
di: Raza, Shaina, et al.
Pubblicazione: (2024)
di: Raza, Shaina, et al.
Pubblicazione: (2024)
Chinese ModernBERT with Whole-Word Masking
di: Zhao, Zeyu, et al.
Pubblicazione: (2025)
di: Zhao, Zeyu, et al.
Pubblicazione: (2025)
Simple and Effective Masked Diffusion Language Models
di: Sahoo, Subham Sekhar, et al.
Pubblicazione: (2024)
di: Sahoo, Subham Sekhar, et al.
Pubblicazione: (2024)
Enriched BERT Embeddings for Scholarly Publication Classification
di: Wolff, Benjamin, et al.
Pubblicazione: (2024)
di: Wolff, Benjamin, et al.
Pubblicazione: (2024)
Graph-oriented Instruction Tuning of Large Language Models for Generic Graph Mining
di: Tan, Yanchao, et al.
Pubblicazione: (2024)
di: Tan, Yanchao, et al.
Pubblicazione: (2024)
Mask-guided BERT for Few Shot Text Classification
di: Liao, Wenxiong, et al.
Pubblicazione: (2023)
di: Liao, Wenxiong, et al.
Pubblicazione: (2023)
Phased Instruction Fine-Tuning for Large Language Models
di: Pang, Wei, et al.
Pubblicazione: (2024)
di: Pang, Wei, et al.
Pubblicazione: (2024)
Investigating Instruction Tuning Large Language Models on Graphs
di: Zhu, Kerui, et al.
Pubblicazione: (2024)
di: Zhu, Kerui, et al.
Pubblicazione: (2024)
rerankers: A Lightweight Python Library to Unify Ranking Methods
di: Clavié, Benjamin
Pubblicazione: (2024)
di: Clavié, Benjamin
Pubblicazione: (2024)
Not All Documents Are What You Need for Extracting Instruction Tuning Data
di: Zhang, Chi, et al.
Pubblicazione: (2025)
di: Zhang, Chi, et al.
Pubblicazione: (2025)
Exploring Variability in Fine-Tuned Models for Text Classification with DistilBERT
di: Lorenzoni, Giuliano, et al.
Pubblicazione: (2024)
di: Lorenzoni, Giuliano, et al.
Pubblicazione: (2024)
NeoBERT: A Next-Generation BERT
di: Breton, Lola Le, et al.
Pubblicazione: (2025)
di: Breton, Lola Le, et al.
Pubblicazione: (2025)
GraphGPT: Graph Instruction Tuning for Large Language Models
di: Tang, Jiabin, et al.
Pubblicazione: (2023)
di: Tang, Jiabin, et al.
Pubblicazione: (2023)
Towards Robust Instruction Tuning on Multimodal Large Language Models
di: Han, Wei, et al.
Pubblicazione: (2024)
di: Han, Wei, et al.
Pubblicazione: (2024)
OctoPack: Instruction Tuning Code Large Language Models
di: Muennighoff, Niklas, et al.
Pubblicazione: (2023)
di: Muennighoff, Niklas, et al.
Pubblicazione: (2023)
Optimizing Psychological Counseling with Instruction-Tuned Large Language Models
di: Li, Wenjie, et al.
Pubblicazione: (2024)
di: Li, Wenjie, et al.
Pubblicazione: (2024)
A Fine-Tuned BERT Classifier for Personal-Letter Titles in Late-Ming and Early-Qing Collected Works
di: Luo, Queenie
Pubblicazione: (2026)
di: Luo, Queenie
Pubblicazione: (2026)
Fisher Mask Nodes for Language Model Merging
di: K, Thennal D, et al.
Pubblicazione: (2024)
di: K, Thennal D, et al.
Pubblicazione: (2024)
Boosting Large Language Models with Mask Fine-Tuning
di: Zhang, Mingyuan, et al.
Pubblicazione: (2025)
di: Zhang, Mingyuan, et al.
Pubblicazione: (2025)
Construction Identification and Disambiguation Using BERT: A Case Study of NPN
di: Scivetti, Wesley, et al.
Pubblicazione: (2025)
di: Scivetti, Wesley, et al.
Pubblicazione: (2025)
BioInstruct: Instruction Tuning of Large Language Models for Biomedical Natural Language Processing
di: Tran, Hieu, et al.
Pubblicazione: (2023)
di: Tran, Hieu, et al.
Pubblicazione: (2023)
Controllable Text Generation in the Instruction-Tuning Era
di: Ashok, Dhananjay, et al.
Pubblicazione: (2024)
di: Ashok, Dhananjay, et al.
Pubblicazione: (2024)
Align Anything: Training All-Modality Models to Follow Instructions with Language Feedback
di: Ji, Jiaming, et al.
Pubblicazione: (2024)
di: Ji, Jiaming, et al.
Pubblicazione: (2024)
Instruction Mining: Instruction Data Selection for Tuning Large Language Models
di: Cao, Yihan, et al.
Pubblicazione: (2023)
di: Cao, Yihan, et al.
Pubblicazione: (2023)
Exploration of Masked and Causal Language Modelling for Text Generation
di: Micheletti, Nicolo, et al.
Pubblicazione: (2024)
di: Micheletti, Nicolo, et al.
Pubblicazione: (2024)
Entropy-aware Masking for Masked Language Modeling
di: Srinivasagan, Gokul, et al.
Pubblicazione: (2026)
di: Srinivasagan, Gokul, et al.
Pubblicazione: (2026)
Cross-Lingual Stability and Bias in Instruction-Tuned Language Models for Humanitarian NLP
di: Nemkova, Poli, et al.
Pubblicazione: (2025)
di: Nemkova, Poli, et al.
Pubblicazione: (2025)
Vikhr: The Family of Open-Source Instruction-Tuned Large Language Models for Russian
di: Nikolich, Aleksandr, et al.
Pubblicazione: (2024)
di: Nikolich, Aleksandr, et al.
Pubblicazione: (2024)
EXAONE 3.0 7.8B Instruction Tuned Language Model
di: An, Soyoung, et al.
Pubblicazione: (2024)
di: An, Soyoung, et al.
Pubblicazione: (2024)
Toward Graph-Tokenizing Large Language Models with Reconstructive Graph Instruction Tuning
di: Zhang, Zhongjian, et al.
Pubblicazione: (2026)
di: Zhang, Zhongjian, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Towards Better Monolingual Japanese Retrievers with Multi-Vector Models
di: Clavié, Benjamin
Pubblicazione: (2023) -
Simple Projection Variants Improve ColBERT Performance
di: Clavié, Benjamin, et al.
Pubblicazione: (2025) -
JaColBERTv2.5: Optimising Multi-Vector Retrievers to Create State-of-the-Art Japanese Retrievers with Constrained Resources
di: Clavié, Benjamin
Pubblicazione: (2024) -
ReadBench: Measuring the Dense Text Visual Reading Ability of Vision-Language Models
di: Clavié, Benjamin, et al.
Pubblicazione: (2025) -
Conditional [MASK] Discrete Diffusion Language Model
di: Koh, Hyukhun, et al.
Pubblicazione: (2024)