From Prototypes to General Distributions: An Efficient Curriculum for Masked Image Modeling
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Lin, Jinhong, Wu, Cheng-En, Li, Huanran, Zhang, Jifan, Hu, Yu Hen, Morgado, Pedro |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Patch Ranking: Efficient CLIP by Learning to Rank Local Patches
par: Wu, Cheng-En, et autres
Publié: (2024)
par: Wu, Cheng-En, et autres
Publié: (2024)
Accelerating Augmentation Invariance Pretraining
par: Lin, Jinhong, et autres
Publié: (2024)
par: Lin, Jinhong, et autres
Publié: (2024)
Block Pruning for Enhanced Efficiency in Convolutional Neural Networks
par: Wu, Cheng-En, et autres
Publié: (2023)
par: Wu, Cheng-En, et autres
Publié: (2023)
Scaling Up Audio-Synchronized Visual Animation: An Efficient Training Paradigm
par: Zhang, Lin, et autres
Publié: (2025)
par: Zhang, Lin, et autres
Publié: (2025)
Towards Latent Masked Image Modeling for Self-Supervised Visual Representation Learning
par: Wei, Yibing, et autres
Publié: (2024)
par: Wei, Yibing, et autres
Publié: (2024)
Effective and Efficient Masked Image Generation Models
par: You, Zebin, et autres
Publié: (2025)
par: You, Zebin, et autres
Publié: (2025)
PEM: Prototype-based Efficient MaskFormer for Image Segmentation
par: Cavagnero, Niccolò, et autres
Publié: (2024)
par: Cavagnero, Niccolò, et autres
Publié: (2024)
MaskFocus: Focusing Policy Optimization on Critical Steps for Masked Image Generation
par: Zhang, Guohui, et autres
Publié: (2025)
par: Zhang, Guohui, et autres
Publié: (2025)
Rethinking UMM Visual Generation: Masked Modeling for Efficient Image-Only Pre-training
par: Sun, Peng, et autres
Publié: (2026)
par: Sun, Peng, et autres
Publié: (2026)
Reinforcement Learning Meets Masked Generative Models: Mask-GRPO for Text-to-Image Generation
par: Luo, Yifu, et autres
Publié: (2025)
par: Luo, Yifu, et autres
Publié: (2025)
Autoregressive Image Generation with Masked Bit Modeling
par: Yu, Qihang, et autres
Publié: (2026)
par: Yu, Qihang, et autres
Publié: (2026)
Towards Efficient General Feature Prediction in Masked Skeleton Modeling
par: Sun, Shengkai, et autres
Publié: (2025)
par: Sun, Shengkai, et autres
Publié: (2025)
R2SM: Referring and Reasoning for Selective Masks
par: Shih, Yu-Lin, et autres
Publié: (2025)
par: Shih, Yu-Lin, et autres
Publié: (2025)
MOODv2: Masked Image Modeling for Out-of-Distribution Detection
par: Li, Jingyao, et autres
Publié: (2024)
par: Li, Jingyao, et autres
Publié: (2024)
Resurrect Mask AutoRegressive Modeling for Efficient and Scalable Image Generation
par: Xin, Yi, et autres
Publié: (2025)
par: Xin, Yi, et autres
Publié: (2025)
DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer
par: Wu, Yecheng, et autres
Publié: (2025)
par: Wu, Yecheng, et autres
Publié: (2025)
Prototype-Guided Curriculum Learning for Zero-Shot Learning
par: Wang, Lei, et autres
Publié: (2025)
par: Wang, Lei, et autres
Publié: (2025)
Audio-Synchronized Visual Animation
par: Zhang, Lin, et autres
Publié: (2024)
par: Zhang, Lin, et autres
Publié: (2024)
Restore Anything with Masks: Leveraging Mask Image Modeling for Blind All-in-One Image Restoration
par: Qin, Chu-Jie, et autres
Publié: (2024)
par: Qin, Chu-Jie, et autres
Publié: (2024)
Conditional Panoramic Image Generation via Masked Autoregressive Modeling
par: Wang, Chaoyang, et autres
Publié: (2025)
par: Wang, Chaoyang, et autres
Publié: (2025)
Harnessing Massive Satellite Imagery with Efficient Masked Image Modeling
par: Wang, Fengxiang, et autres
Publié: (2024)
par: Wang, Fengxiang, et autres
Publié: (2024)
ProtoMask: Segmentation-Guided Prototype Learning
par: Meinert, Steffen, et autres
Publié: (2025)
par: Meinert, Steffen, et autres
Publié: (2025)
Wavelet-Driven Masked Image Modeling: A Path to Efficient Visual Representation
par: Xiang, Wenzhao, et autres
Publié: (2025)
par: Xiang, Wenzhao, et autres
Publié: (2025)
Mask Image Watermarking
par: Hu, Runyi, et autres
Publié: (2025)
par: Hu, Runyi, et autres
Publié: (2025)
MaskMamba: A Hybrid Mamba-Transformer Model for Masked Image Generation
par: Chen, Wenchao, et autres
Publié: (2024)
par: Chen, Wenchao, et autres
Publié: (2024)
PR-MIM: Delving Deeper into Partial Reconstruction in Masked Image Modeling
par: Li, Zhong-Yu, et autres
Publié: (2024)
par: Li, Zhong-Yu, et autres
Publié: (2024)
From Prediction to Perfection: Introducing Refinement to Autoregressive Image Generation
par: Cheng, Cheng, et autres
Publié: (2025)
par: Cheng, Cheng, et autres
Publié: (2025)
Interpretable Multimodal Cancer Prototyping with Whole Slide Images and Incompletely Paired Genomics
par: Zhang, Yupei, et autres
Publié: (2025)
par: Zhang, Yupei, et autres
Publié: (2025)
Diffusion Time-step Curriculum for One Image to 3D Generation
par: Yi, Xuanyu, et autres
Publié: (2024)
par: Yi, Xuanyu, et autres
Publié: (2024)
MaskFlow: Discrete Flows For Flexible and Efficient Long Video Generation
par: Fuest, Michael, et autres
Publié: (2025)
par: Fuest, Michael, et autres
Publié: (2025)
Generalized Category Discovery in Hyperspectral Images via Prototype Subspace Modeling
par: Li, Xianlu, et autres
Publié: (2025)
par: Li, Xianlu, et autres
Publié: (2025)
Relational Contrastive Learning and Masked Image Modeling for Scene Text Recognition
par: Lin, Tiancheng, et autres
Publié: (2024)
par: Lin, Tiancheng, et autres
Publié: (2024)
From Text to Mask: Localizing Entities Using the Attention of Text-to-Image Diffusion Models
par: Xiao, Changming, et autres
Publié: (2023)
par: Xiao, Changming, et autres
Publié: (2023)
PRIOR: Prototype Representation Joint Learning from Medical Images and Reports
par: Cheng, Pujin, et autres
Publié: (2023)
par: Cheng, Pujin, et autres
Publié: (2023)
Panorama Generation From NFoV Image Done Right
par: Zheng, Dian, et autres
Publié: (2025)
par: Zheng, Dian, et autres
Publié: (2025)
InterMask: 3D Human Interaction Generation via Collaborative Masked Modeling
par: Javed, Muhammad Gohar, et autres
Publié: (2024)
par: Javed, Muhammad Gohar, et autres
Publié: (2024)
HMAR: Efficient Hierarchical Masked Auto-Regressive Image Generation
par: Kumbong, Hermann, et autres
Publié: (2025)
par: Kumbong, Hermann, et autres
Publié: (2025)
MaskAttn-SDXL: Controllable Region-Level Text-To-Image Generation
par: Chang, Yu, et autres
Publié: (2025)
par: Chang, Yu, et autres
Publié: (2025)
Synthetic Curriculum Reinforces Compositional Text-to-Image Generation
par: Wang, Shijian, et autres
Publié: (2025)
par: Wang, Shijian, et autres
Publié: (2025)
Sampling Strategies for Efficient Training of Deep Learning Object Detection Algorithms
par: Shen, Gefei, et autres
Publié: (2025)
par: Shen, Gefei, et autres
Publié: (2025)
Documents similaires
-
Patch Ranking: Efficient CLIP by Learning to Rank Local Patches
par: Wu, Cheng-En, et autres
Publié: (2024) -
Accelerating Augmentation Invariance Pretraining
par: Lin, Jinhong, et autres
Publié: (2024) -
Block Pruning for Enhanced Efficiency in Convolutional Neural Networks
par: Wu, Cheng-En, et autres
Publié: (2023) -
Scaling Up Audio-Synchronized Visual Animation: An Efficient Training Paradigm
par: Zhang, Lin, et autres
Publié: (2025) -
Towards Latent Masked Image Modeling for Self-Supervised Visual Representation Learning
par: Wei, Yibing, et autres
Publié: (2024)