Token Masking Improves Transformer-Based Text Classification
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Xu, Xianglong, Bowen, John, Taheri, Rojin |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Mask-guided BERT for Few Shot Text Classification
par: Liao, Wenxiong, et autres
Publié: (2023)
par: Liao, Wenxiong, et autres
Publié: (2023)
Advancing Interpretability in Text Classification through Prototype Learning
par: Wei, Bowen, et autres
Publié: (2024)
par: Wei, Bowen, et autres
Publié: (2024)
AI-generated Text Detection: A Multifaceted Approach to Binary and Multiclass Classification
par: Abburi, Harika, et autres
Publié: (2025)
par: Abburi, Harika, et autres
Publié: (2025)
Explainability-Based Token Replacement on LLM-Generated Text
par: Mohammadi, Hadi, et autres
Publié: (2025)
par: Mohammadi, Hadi, et autres
Publié: (2025)
AI Generated Text Detection Using Instruction Fine-tuned Large Language and Transformer-Based Models
par: Guggilla, Chinnappa, et autres
Publié: (2025)
par: Guggilla, Chinnappa, et autres
Publié: (2025)
Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning
par: Su, DiJia, et autres
Publié: (2025)
par: Su, DiJia, et autres
Publié: (2025)
Transformer Enhanced Relation Classification: A Comparative Analysis of Contextuality, Data Efficiency and Sequence Complexity
par: Jing, Bowen, et autres
Publié: (2025)
par: Jing, Bowen, et autres
Publié: (2025)
Targeted Remasking: Replacing Token Editing with Token-to-Mask Refinement in Discrete Diffusion Language Models
par: Yao, Lin
Publié: (2026)
par: Yao, Lin
Publié: (2026)
StableMask: Refining Causal Masking in Decoder-only Transformer
par: Yin, Qingyu, et autres
Publié: (2024)
par: Yin, Qingyu, et autres
Publié: (2024)
Task-Informed Anti-Curriculum by Masking Improves Downstream Performance on Text
par: Jarca, Andrei, et autres
Publié: (2025)
par: Jarca, Andrei, et autres
Publié: (2025)
Beyond Hard Masks: Progressive Token Evolution for Diffusion Language Models
par: Zhong, Linhao, et autres
Publié: (2026)
par: Zhong, Linhao, et autres
Publié: (2026)
Extended Japanese Commonsense Morality Dataset with Masked Token and Label Enhancement
par: Ohashi, Takumi, et autres
Publié: (2024)
par: Ohashi, Takumi, et autres
Publié: (2024)
Reinforcement Learning with Token-level Feedback for Controllable Text Generation
par: Li, Wendi, et autres
Publié: (2024)
par: Li, Wendi, et autres
Publié: (2024)
ConTextual: Improving Clinical Text Summarization in LLMs with Context-preserving Token Filtering and Knowledge Graphs
par: Piya, Fahmida Liza, et autres
Publié: (2025)
par: Piya, Fahmida Liza, et autres
Publié: (2025)
Selective Attention Federated Learning: Improving Privacy and Efficiency for Clinical Text Classification
par: Li, Yue, et autres
Publié: (2025)
par: Li, Yue, et autres
Publié: (2025)
OptBA: Optimizing Hyperparameters with the Bees Algorithm for Improved Medical Text Classification
par: Shaaban, Mai A., et autres
Publié: (2023)
par: Shaaban, Mai A., et autres
Publié: (2023)
Multi-Task Pre-Finetuning of Lightweight Transformer Encoders for Text Classification and NER
par: Zhu, Junyi, et autres
Publié: (2025)
par: Zhu, Junyi, et autres
Publié: (2025)
Concept Based Continuous Prompts for Interpretable Text Classification
par: Chen, Qian, et autres
Publié: (2024)
par: Chen, Qian, et autres
Publié: (2024)
Enabling Autoregressive Models to Fill In Masked Tokens
par: Israel, Daniel, et autres
Publié: (2025)
par: Israel, Daniel, et autres
Publié: (2025)
Exploration of Masked and Causal Language Modelling for Text Generation
par: Micheletti, Nicolo, et autres
Publié: (2024)
par: Micheletti, Nicolo, et autres
Publié: (2024)
Text Generation Beyond Discrete Token Sampling
par: Zhuang, Yufan, et autres
Publié: (2025)
par: Zhuang, Yufan, et autres
Publié: (2025)
General Phrase Debiaser: Debiasing Masked Language Models at a Multi-Token Level
par: Shi, Bingkang, et autres
Publié: (2023)
par: Shi, Bingkang, et autres
Publié: (2023)
One Token Is Enough: Improving Diffusion Language Models with a Sink Token
par: Zhang, Zihou, et autres
Publié: (2026)
par: Zhang, Zihou, et autres
Publié: (2026)
Depth $F_1$: Improving Evaluation of Cross-Domain Text Classification by Measuring Semantic Generalizability
par: Seegmiller, Parker, et autres
Publié: (2024)
par: Seegmiller, Parker, et autres
Publié: (2024)
Thunder-Tok: Minimizing Tokens per Word in Tokenizing Korean Texts for Generative Language Models
par: Cho, Gyeongje, et autres
Publié: (2025)
par: Cho, Gyeongje, et autres
Publié: (2025)
Training Text-to-Molecule Models with Context-Aware Tokenization
par: Kim, Seojin, et autres
Publié: (2025)
par: Kim, Seojin, et autres
Publié: (2025)
PLEX: Perturbation-free Local Explanations for LLM-Based Text Classification
par: Rahulamathavan, Yogachandran, et autres
Publié: (2025)
par: Rahulamathavan, Yogachandran, et autres
Publié: (2025)
Alert-ME: An Explainability-Driven Defense Against Adversarial Examples in Transformer-Based Text Classification
par: Sabir, Bushra, et autres
Publié: (2023)
par: Sabir, Bushra, et autres
Publié: (2023)
KV Prediction for Improved Time to First Token
par: Horton, Maxwell, et autres
Publié: (2024)
par: Horton, Maxwell, et autres
Publié: (2024)
Text or Pixels? It Takes Half: On the Token Efficiency of Visual Text Inputs in Multimodal LLMs
par: Li, Yanhong, et autres
Publié: (2025)
par: Li, Yanhong, et autres
Publié: (2025)
Don't Just Demo, Teach Me the Principles: A Principle-Based Multi-Agent Prompting Strategy for Text Classification
par: Wei, Peipei, et autres
Publié: (2025)
par: Wei, Peipei, et autres
Publié: (2025)
Exploiting Text Semantics for Few and Zero Shot Node Classification on Text-attributed Graph
par: Wang, Yuxiang, et autres
Publié: (2025)
par: Wang, Yuxiang, et autres
Publié: (2025)
Hallucination is Inevitable for LLMs with the Open World Assumption
par: Xu, Bowen
Publié: (2025)
par: Xu, Bowen
Publié: (2025)
Fine-Tuning Causal LLMs for Text Classification: Embedding-Based vs. Instruction-Based Approaches
par: Yousefiramandi, Amirhossein, et autres
Publié: (2025)
par: Yousefiramandi, Amirhossein, et autres
Publié: (2025)
Alternatives To Next Token Prediction In Text Generation -- A Survey
par: Wyatt, Charlie, et autres
Publié: (2025)
par: Wyatt, Charlie, et autres
Publié: (2025)
Sticking to the Mean: Detecting Sticky Tokens in Text Embedding Models
par: Chen, Kexin, et autres
Publié: (2025)
par: Chen, Kexin, et autres
Publié: (2025)
Empowering Character-level Text Infilling by Eliminating Sub-Tokens
par: Ren, Houxing, et autres
Publié: (2024)
par: Ren, Houxing, et autres
Publié: (2024)
SAFT: Structure-aware Transformers for Textual Interaction Classification
par: Wang, Hongtao, et autres
Publié: (2025)
par: Wang, Hongtao, et autres
Publié: (2025)
How Important Is Tokenization in French Medical Masked Language Models?
par: Labrak, Yanis, et autres
Publié: (2024)
par: Labrak, Yanis, et autres
Publié: (2024)
Attribute Structuring Improves LLM-Based Evaluation of Clinical Text Summaries
par: Gero, Zelalem, et autres
Publié: (2024)
par: Gero, Zelalem, et autres
Publié: (2024)
Documents similaires
-
Mask-guided BERT for Few Shot Text Classification
par: Liao, Wenxiong, et autres
Publié: (2023) -
Advancing Interpretability in Text Classification through Prototype Learning
par: Wei, Bowen, et autres
Publié: (2024) -
AI-generated Text Detection: A Multifaceted Approach to Binary and Multiclass Classification
par: Abburi, Harika, et autres
Publié: (2025) -
Explainability-Based Token Replacement on LLM-Generated Text
par: Mohammadi, Hadi, et autres
Publié: (2025) -
AI Generated Text Detection Using Instruction Fine-tuned Large Language and Transformer-Based Models
par: Guggilla, Chinnappa, et autres
Publié: (2025)