Intermittent Semi-Working Mask: A New Masking Paradigm for LLMs
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Hu, HaoYuan, Lu, Mingcong, Luo, Di, Wu, XinYa, Zhu, Jiangcai, Yin, Taoye, Li, Zheng, Wang, Hao, Zhang, Shusheng, Zhang, KeZun, Shao, KaiLai, Chen, Chao, Wang, Feng |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Mask Is What DLLM Needs: A Masked Data Training Paradigm for Diffusion LLMs
par: Ma, Linrui, et autres
Publié: (2026)
par: Ma, Linrui, et autres
Publié: (2026)
ReMoMask: Retrieval-Augmented Masked Motion Generation
par: Li, Zhengdao, et autres
Publié: (2025)
par: Li, Zhengdao, et autres
Publié: (2025)
The Mechanisms of the Masked Priming That Do Not Work Jointly
par: Yongchun Wang, et autres
Publié: (2025)
par: Yongchun Wang, et autres
Publié: (2025)
Masked Image Modeling Boosting Semi-Supervised Semantic Segmentation
par: Li, Yangyang, et autres
Publié: (2024)
par: Li, Yangyang, et autres
Publié: (2024)
Beyond Masked and Unmasked: Discrete Diffusion Models via Partial Masking
par: Chao, Chen-Hao, et autres
Publié: (2025)
par: Chao, Chen-Hao, et autres
Publié: (2025)
ProxSparse: Regularized Learning of Semi-Structured Sparsity Masks for Pretrained LLMs
par: Liu, Hongyi, et autres
Publié: (2025)
par: Liu, Hongyi, et autres
Publié: (2025)
Improving Masked Autoencoders by Learning Where to Mask
par: Chen, Haijian, et autres
Publié: (2023)
par: Chen, Haijian, et autres
Publié: (2023)
GenMask: Adapting DiT for Segmentation via Direct Mask Generation
par: Yang, Yuhuan, et autres
Publié: (2026)
par: Yang, Yuhuan, et autres
Publié: (2026)
Heterogeneous Generative Knowledge Distillation with Masked Image Modeling
par: Wang, Ziming, et autres
Publié: (2023)
par: Wang, Ziming, et autres
Publié: (2023)
Mask-DPO: Generalizable Fine-grained Factuality Alignment of LLMs
par: Gu, Yuzhe, et autres
Publié: (2025)
par: Gu, Yuzhe, et autres
Publié: (2025)
MaskMatch: Boosting Semi-Supervised Learning Through Mask Autoencoder-Driven Feature Learning
par: Zhang, Wenjin, et autres
Publié: (2024)
par: Zhang, Wenjin, et autres
Publié: (2024)
Masked Diffusion Generative Recommendation
par: Mu, Lingyu, et autres
Publié: (2026)
par: Mu, Lingyu, et autres
Publié: (2026)
Entropy-aware Masking for Masked Language Modeling
par: Srinivasagan, Gokul, et autres
Publié: (2026)
par: Srinivasagan, Gokul, et autres
Publié: (2026)
Thinking Inside the Mask: In-Place Prompting in Diffusion LLMs
par: Jin, Xiangqi, et autres
Publié: (2025)
par: Jin, Xiangqi, et autres
Publié: (2025)
Up to 36x Speedup: Mask-based Parallel Inference Paradigm for Key Information Extraction in MLLMs
par: Wang, Xinzhong, et autres
Publié: (2026)
par: Wang, Xinzhong, et autres
Publié: (2026)
Latent Shadows: The Gaussian-Discrete Duality in Masked Diffusion
par: Chen, Guinan, et autres
Publié: (2026)
par: Chen, Guinan, et autres
Publié: (2026)
Graph Transformer GANs with Graph Masked Modeling for Architectural Layout Generation
par: Tang, Hao, et autres
Publié: (2024)
par: Tang, Hao, et autres
Publié: (2024)
Data-efficient Event Camera Pre-training via Disentangled Masked Modeling
par: Huang, Zhenpeng, et autres
Publié: (2024)
par: Huang, Zhenpeng, et autres
Publié: (2024)
SkyMask: Attack-agnostic Robust Federated Learning with Fine-grained Learnable Masks
par: Yan, Peishen, et autres
Publié: (2023)
par: Yan, Peishen, et autres
Publié: (2023)
Where to Mask: Structure-Guided Masking for Graph Masked Autoencoders
par: Liu, Chuang, et autres
Publié: (2024)
par: Liu, Chuang, et autres
Publié: (2024)
Simultaneous Masking, Not Prompting Optimization: A Paradigm Shift in Fine-tuning LLMs for Simultaneous Translation
par: Raffel, Matthew, et autres
Publié: (2024)
par: Raffel, Matthew, et autres
Publié: (2024)
MiM: Mask in Mask Self-Supervised Pre-Training for 3D Medical Image Analysis
par: Zhuang, Jiaxin, et autres
Publié: (2024)
par: Zhuang, Jiaxin, et autres
Publié: (2024)
ResiComp: Loss-Resilient Image Compression via Dual-Functional Masked Visual Token Modeling
par: Wang, Sixian, et autres
Publié: (2025)
par: Wang, Sixian, et autres
Publié: (2025)
MaskGCT: Zero-Shot Text-to-Speech with Masked Generative Codec Transformer
par: Wang, Yuancheng, et autres
Publié: (2024)
par: Wang, Yuancheng, et autres
Publié: (2024)
Masked Latent Transformer with the Random Masking Ratio to Advance the Diagnosis of Dental Fluorosis
par: Wu, Yun, et autres
Publié: (2024)
par: Wu, Yun, et autres
Publié: (2024)
MaskPrune: Mask-based LLM Pruning for Layer-wise Uniform Structures
par: Qin, Jiayu, et autres
Publié: (2025)
par: Qin, Jiayu, et autres
Publié: (2025)
MaskFuser: Masked Fusion of Joint Multi-Modal Tokenization for End-to-End Autonomous Driving
par: Duan, Yiqun, et autres
Publié: (2024)
par: Duan, Yiqun, et autres
Publié: (2024)
DreamSwapV: Mask-guided Subject Swapping for Any Customized Video Editing
par: Wang, Weitao, et autres
Publié: (2025)
par: Wang, Weitao, et autres
Publié: (2025)
GRM: Utility-Aware Jailbreak Attacks on Audio LLMs via Gradient-Ratio Masking
par: Wang, Yunqiang, et autres
Publié: (2026)
par: Wang, Yunqiang, et autres
Publié: (2026)
SAMTok: Representing Any Mask with Two Words
par: Zhou, Yikang, et autres
Publié: (2026)
par: Zhou, Yikang, et autres
Publié: (2026)
ShieldLearner: A New Paradigm for Jailbreak Attack Defense in LLMs
par: Ni, Ziyi, et autres
Publié: (2025)
par: Ni, Ziyi, et autres
Publié: (2025)
MaskSearch: Querying Image Masks at Scale
par: He, Dong, et autres
Publié: (2023)
par: He, Dong, et autres
Publié: (2023)
A Semi-amortized Lifted Learning-to-Optimize Masked (SALLO-M) Transformer Model for Scalable and Generalizable Beamforming
par: Zhang, Yubo, et autres
Publié: (2025)
par: Zhang, Yubo, et autres
Publié: (2025)
SARMAE: Masked Autoencoder for SAR Representation Learning
par: Liu, Danxu, et autres
Publié: (2025)
par: Liu, Danxu, et autres
Publié: (2025)
Infer As You Train: A Symmetric Paradigm of Masked Generative for Click-Through Rate Prediction
par: Zhang, Moyu, et autres
Publié: (2025)
par: Zhang, Moyu, et autres
Publié: (2025)
Masked Self-distilled Transducer-based Keyword Spotting with Semi-autoregressive Decoding
par: Xi, Yu, et autres
Publié: (2025)
par: Xi, Yu, et autres
Publié: (2025)
Masked Autoencoders Are Effective Tokenizers for Diffusion Models
par: Chen, Hao, et autres
Publié: (2025)
par: Chen, Hao, et autres
Publié: (2025)
CM-MaskSD: Cross-Modality Masked Self-Distillation for Referring Image Segmentation
par: Wang, Wenxuan, et autres
Publié: (2023)
par: Wang, Wenxuan, et autres
Publié: (2023)
Triple Point Masking
par: Liu, Jiaming, et autres
Publié: (2024)
par: Liu, Jiaming, et autres
Publié: (2024)
Harnessing Massive Satellite Imagery with Efficient Masked Image Modeling
par: Wang, Fengxiang, et autres
Publié: (2024)
par: Wang, Fengxiang, et autres
Publié: (2024)
Documents similaires
-
Mask Is What DLLM Needs: A Masked Data Training Paradigm for Diffusion LLMs
par: Ma, Linrui, et autres
Publié: (2026) -
ReMoMask: Retrieval-Augmented Masked Motion Generation
par: Li, Zhengdao, et autres
Publié: (2025) -
The Mechanisms of the Masked Priming That Do Not Work Jointly
par: Yongchun Wang, et autres
Publié: (2025) -
Masked Image Modeling Boosting Semi-Supervised Semantic Segmentation
par: Li, Yangyang, et autres
Publié: (2024) -
Beyond Masked and Unmasked: Discrete Diffusion Models via Partial Masking
par: Chao, Chen-Hao, et autres
Publié: (2025)