Enregistré dans:
| Auteurs principaux: | Czinczoll, Tamara, Hönes, Christoph, Schall, Maximilian, de Melo, Gerard |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2402.17682 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
CommitBench: A Benchmark for Commit Message Generation
par: Schall, Maximilian, et autres
Publié: (2024)
par: Schall, Maximilian, et autres
Publié: (2024)
Query-Level Uncertainty in Large Language Models
par: Chen, Lihu, et autres
Publié: (2025)
par: Chen, Lihu, et autres
Publié: (2025)
Learning to Predict Usage Options of Product Reviews with LLM-Generated Labels
par: Kohlenberg, Leo, et autres
Publié: (2024)
par: Kohlenberg, Leo, et autres
Publié: (2024)
NLSR: Neuron-Level Safety Realignment of Large Language Models Against Harmful Fine-Tuning
par: Yi, Xin, et autres
Publié: (2024)
par: Yi, Xin, et autres
Publié: (2024)
TaxonRL: Reinforcement Learning with Intermediate Rewards for Interpretable Fine-Grained Visual Reasoning
par: von Klinski, Maximilian, et autres
Publié: (2026)
par: von Klinski, Maximilian, et autres
Publié: (2026)
ChuLo: Chunk-Level Key Information Representation for Long Document Understanding
par: Li, Yan, et autres
Publié: (2024)
par: Li, Yan, et autres
Publié: (2024)
GraphLSS: Integrating Lexical, Structural, and Semantic Features for Long Document Extractive Summarization
par: Bugueño, Margarita, et autres
Publié: (2024)
par: Bugueño, Margarita, et autres
Publié: (2024)
NeoBERT: A Next-Generation BERT
par: Breton, Lola Le, et autres
Publié: (2025)
par: Breton, Lola Le, et autres
Publié: (2025)
MS-HuBERT: Mitigating Pre-training and Inference Mismatch in Masked Language Modelling methods for learning Speech Representations
par: Yadav, Hemant, et autres
Publié: (2024)
par: Yadav, Hemant, et autres
Publié: (2024)
Connecting the Dots: What Graph-Based Text Representations Work Best for Text Classification Using Graph Neural Networks?
par: Bugueño, Margarita, et autres
Publié: (2023)
par: Bugueño, Margarita, et autres
Publié: (2023)
Rethinking Graph-Based Document Classification: Learning Data-Driven Structures Beyond Heuristic Approaches
par: Bugueño, Margarita, et autres
Publié: (2025)
par: Bugueño, Margarita, et autres
Publié: (2025)
BPDec: Unveiling the Potential of Masked Language Modeling Decoder in BERT pretraining
par: Liang, Wen, et autres
Publié: (2024)
par: Liang, Wen, et autres
Publié: (2024)
Adapting Large Language Models for Document-Level Machine Translation
par: Wu, Minghao, et autres
Publié: (2024)
par: Wu, Minghao, et autres
Publié: (2024)
SD-HuBERT: Sentence-Level Self-Distillation Induces Syllabic Organization in HuBERT
par: Cho, Cheol Jun, et autres
Publié: (2023)
par: Cho, Cheol Jun, et autres
Publié: (2023)
Are Expert-Level Language Models Expert-Level Annotators?
par: Tseng, Yu-Min, et autres
Publié: (2024)
par: Tseng, Yu-Min, et autres
Publié: (2024)
FOCUS: Effective Embedding Initialization for Monolingual Specialization of Multilingual Models
par: Dobler, Konstantin, et autres
Publié: (2023)
par: Dobler, Konstantin, et autres
Publié: (2023)
General Phrase Debiaser: Debiasing Masked Language Models at a Multi-Token Level
par: Shi, Bingkang, et autres
Publié: (2023)
par: Shi, Bingkang, et autres
Publié: (2023)
An Encoder-Integrated PhoBERT with Graph Attention for Vietnamese Token-Level Classification
par: Nguyen, Ba-Quang
Publié: (2025)
par: Nguyen, Ba-Quang
Publié: (2025)
UniBERT: Adversarial Training for Language-Universal Representations
par: Avram, Andrei-Marius, et autres
Publié: (2025)
par: Avram, Andrei-Marius, et autres
Publié: (2025)
Multilingual Contextualization of Large Language Models for Document-Level Machine Translation
par: Ramos, Miguel Moura, et autres
Publié: (2025)
par: Ramos, Miguel Moura, et autres
Publié: (2025)
Beyond Next Token Prediction: Patch-Level Training for Large Language Models
par: Shao, Chenze, et autres
Publié: (2024)
par: Shao, Chenze, et autres
Publié: (2024)
Representation Deficiency in Masked Language Modeling
par: Meng, Yu, et autres
Publié: (2023)
par: Meng, Yu, et autres
Publié: (2023)
Efficient Parallelization Layouts for Large-Scale Distributed Model Training
par: Hagemann, Johannes, et autres
Publié: (2023)
par: Hagemann, Johannes, et autres
Publié: (2023)
DOREMI: Optimizing Long Tail Predictions in Document-Level Relation Extraction
par: Menotti, Laura, et autres
Publié: (2026)
par: Menotti, Laura, et autres
Publié: (2026)
Language Adaptation on a Tight Academic Compute Budget: Tokenizer Swapping Works and Pure bfloat16 Is Enough
par: Dobler, Konstantin, et autres
Publié: (2024)
par: Dobler, Konstantin, et autres
Publié: (2024)
ANGO: A Next-Level Evaluation Benchmark For Generation-Oriented Language Models In Chinese Domain
par: Wang, Bingchao
Publié: (2024)
par: Wang, Bingchao
Publié: (2024)
Chinese ModernBERT with Whole-Word Masking
par: Zhao, Zeyu, et autres
Publié: (2025)
par: Zhao, Zeyu, et autres
Publié: (2025)
AutoRE: Document-Level Relation Extraction with Large Language Models
par: Xue, Lilong, et autres
Publié: (2024)
par: Xue, Lilong, et autres
Publié: (2024)
It's All in The [MASK]: Simple Instruction-Tuning Enables BERT-like Masked Language Models As Generative Classifiers
par: Clavié, Benjamin, et autres
Publié: (2025)
par: Clavié, Benjamin, et autres
Publié: (2025)
MaskMoE: Boosting Token-Level Learning via Routing Mask in Mixture-of-Experts
par: Su, Zhenpeng, et autres
Publié: (2024)
par: Su, Zhenpeng, et autres
Publié: (2024)
Within-Document Event Coreference with BERT-Based Contextualized Representations
par: Ahmed, Shafiuddin Rehan, et autres
Publié: (2021)
par: Ahmed, Shafiuddin Rehan, et autres
Publié: (2021)
ExpertLongBench: Benchmarking Language Models on Expert-Level Long-Form Generation Tasks with Structured Checklists
par: Ruan, Jie, et autres
Publié: (2025)
par: Ruan, Jie, et autres
Publié: (2025)
Cross-Dialect Text-To-Speech in Pitch-Accent Language Incorporating Multi-Dialect Phoneme-Level BERT
par: Yamauchi, Kazuki, et autres
Publié: (2024)
par: Yamauchi, Kazuki, et autres
Publié: (2024)
Efficiently Exploring Large Language Models for Document-Level Machine Translation with In-context Learning
par: Cui, Menglong, et autres
Publié: (2024)
par: Cui, Menglong, et autres
Publié: (2024)
Mask-guided BERT for Few Shot Text Classification
par: Liao, Wenxiong, et autres
Publié: (2023)
par: Liao, Wenxiong, et autres
Publié: (2023)
K-Level Reasoning: Establishing Higher Order Beliefs in Large Language Models for Strategic Reasoning
par: Zhang, Yadong, et autres
Publié: (2024)
par: Zhang, Yadong, et autres
Publié: (2024)
Shaping Human-AI Collaboration: Varied Scaffolding Levels in Co-writing with Language Models
par: Dhillon, Paramveer S., et autres
Publié: (2024)
par: Dhillon, Paramveer S., et autres
Publié: (2024)
MaBERT:A Padding Safe Interleaved Transformer Mamba Hybrid Encoder for Efficient Extended Context Masked Language Modeling
par: Kim, Jinwoong, et autres
Publié: (2026)
par: Kim, Jinwoong, et autres
Publié: (2026)
Enhancing Next-Generation Language Models with Knowledge Graphs: Extending Claude, Mistral IA, and GPT-4 via KG-BERT
par: Chaabene, Nour El Houda Ben, et autres
Publié: (2025)
par: Chaabene, Nour El Houda Ben, et autres
Publié: (2025)
SwissBERT: The Multilingual Language Model for Switzerland
par: Vamvas, Jannis, et autres
Publié: (2023)
par: Vamvas, Jannis, et autres
Publié: (2023)
Documents similaires
-
CommitBench: A Benchmark for Commit Message Generation
par: Schall, Maximilian, et autres
Publié: (2024) -
Query-Level Uncertainty in Large Language Models
par: Chen, Lihu, et autres
Publié: (2025) -
Learning to Predict Usage Options of Product Reviews with LLM-Generated Labels
par: Kohlenberg, Leo, et autres
Publié: (2024) -
NLSR: Neuron-Level Safety Realignment of Large Language Models Against Harmful Fine-Tuning
par: Yi, Xin, et autres
Publié: (2024) -
TaxonRL: Reinforcement Learning with Intermediate Rewards for Interpretable Fine-Grained Visual Reasoning
par: von Klinski, Maximilian, et autres
Publié: (2026)