Improving Generative Pre-Training: An In-depth Study of Masked Image Modeling and Denoising Models
Fuente:
arXiv
Saved in:
| Main Authors: | Choi, Hyesong, Kim, Daeun, Cha, Sungmin, Yi, Kwang Moo, Min, Dongbo |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Salience-Based Adaptive Masking: Revisiting Token Dynamics for Enhanced Pre-training
by: Choi, Hyesong, et al.
Published: (2024)
by: Choi, Hyesong, et al.
Published: (2024)
MaDis-Stereo: Enhanced Stereo Matching via Distilled Masked Image Modeling
by: Ahn, Jihye, et al.
Published: (2024)
by: Ahn, Jihye, et al.
Published: (2024)
SG-MIM: Structured Knowledge Guided Efficient Pre-training for Dense Prediction
by: Son, Sumin, et al.
Published: (2024)
by: Son, Sumin, et al.
Published: (2024)
Emerging Property of Masked Token for Effective Pre-training
by: Choi, Hyesong, et al.
Published: (2024)
by: Choi, Hyesong, et al.
Published: (2024)
UniTT-Stereo: Unified Training of Transformer for Enhanced Stereo Matching
by: Kim, Soomin, et al.
Published: (2024)
by: Kim, Soomin, et al.
Published: (2024)
Enhancing Alignment for Unified Multimodal Models via Semantically-Grounded Supervision
by: Kim, Jiyeong, et al.
Published: (2026)
by: Kim, Jiyeong, et al.
Published: (2026)
iConFormer: Dynamic Parameter-Efficient Tuning with Input-Conditioned Adaptation
by: Jo, Hayeon, et al.
Published: (2024)
by: Jo, Hayeon, et al.
Published: (2024)
RobIA: Robust Instance-aware Continual Test-time Adaptation for Deep Stereo
by: Ko, Jueun, et al.
Published: (2025)
by: Ko, Jueun, et al.
Published: (2025)
Collaborative Learning for Enhanced Unsupervised Domain Adaptation
by: Cho, Minhee, et al.
Published: (2024)
by: Cho, Minhee, et al.
Published: (2024)
TADFormer : Task-Adaptive Dynamic Transformer for Efficient Multi-Task Learning
by: Baek, Seungmin, et al.
Published: (2025)
by: Baek, Seungmin, et al.
Published: (2025)
Are We Truly Forgetting? A Critical Re-examination of Machine Unlearning Evaluation Protocols
by: Kim, Yongwoo, et al.
Published: (2025)
by: Kim, Yongwoo, et al.
Published: (2025)
Hyperparameters in Continual Learning: A Reality Check
by: Cha, Sungmin, et al.
Published: (2024)
by: Cha, Sungmin, et al.
Published: (2024)
ROODI: Reconstructing Occluded Objects with Denoising Inpainters
by: Chang, Yeonjin, et al.
Published: (2025)
by: Chang, Yeonjin, et al.
Published: (2025)
Consistency-Preserving Concept Erasure via Unsafe-Safe Pairing and Directional Fisher-weighted Adaptation
by: Kim, Yongwoo, et al.
Published: (2026)
by: Kim, Yongwoo, et al.
Published: (2026)
Towards Realistic Incremental Scenario in Class Incremental Semantic Segmentation
by: Kwak, Jihwan, et al.
Published: (2024)
by: Kwak, Jihwan, et al.
Published: (2024)
Centered Masking for Language-Image Pre-Training
by: Liang, Mingliang, et al.
Published: (2024)
by: Liang, Mingliang, et al.
Published: (2024)
Denoising Task Difficulty-based Curriculum for Training Diffusion Models
by: Kim, Jin-Young, et al.
Published: (2024)
by: Kim, Jin-Young, et al.
Published: (2024)
HD Maps are Lane Detection Generalizers: A Novel Generative Framework for Single-Source Domain Generalization
by: Lee, Daeun, et al.
Published: (2023)
by: Lee, Daeun, et al.
Published: (2023)
Effective and Efficient Masked Image Generation Models
by: You, Zebin, et al.
Published: (2025)
by: You, Zebin, et al.
Published: (2025)
Masked and Shuffled Blind Spot Denoising for Real-World Images
by: Chihaoui, Hamadi, et al.
Published: (2024)
by: Chihaoui, Hamadi, et al.
Published: (2024)
Difficulty-Aware Label-Guided Denoising for Monocular 3D Object Detection
by: Lee, Soyul, et al.
Published: (2025)
by: Lee, Soyul, et al.
Published: (2025)
Probabilistic Language-Image Pre-Training
by: Chun, Sanghyuk, et al.
Published: (2024)
by: Chun, Sanghyuk, et al.
Published: (2024)
The Rescue Effect: Spatio-Semantic Early Exit Bypasses Quantization Collapse in CLIP
by: Nam, Kahyeon, et al.
Published: (2026)
by: Nam, Kahyeon, et al.
Published: (2026)
Making Video Models Adhere to User Intent with Minor Adjustments
by: Ajisafe, Daniel, et al.
Published: (2026)
by: Ajisafe, Daniel, et al.
Published: (2026)
Pre-Trained Masked Image Model for Mobile Robot Navigation
by: Sharma, Vishnu Dutt, et al.
Published: (2023)
by: Sharma, Vishnu Dutt, et al.
Published: (2023)
Unsupervised Video Domain Adaptation with Masked Pre-Training and Collaborative Self-Training
by: Reddy, Arun, et al.
Published: (2023)
by: Reddy, Arun, et al.
Published: (2023)
Self-Supervised Pre-Training for Deep Image Prior-Based Robust PET Image Denoising
by: Onishi, Yuya, et al.
Published: (2023)
by: Onishi, Yuya, et al.
Published: (2023)
Gradient-Sign Masking for Task Vector Transport Across Pre-Trained Models
by: Rinaldi, Filippo, et al.
Published: (2025)
by: Rinaldi, Filippo, et al.
Published: (2025)
Parameter-Efficient Adaptation of Pre-Trained Vision Foundation Models for Active and Passive Seismic Data Denoising
by: Zhao, Jiahua, et al.
Published: (2026)
by: Zhao, Jiahua, et al.
Published: (2026)
Masked Pre-training Enables Universal Zero-shot Denoiser
by: Ma, Xiaoxiao, et al.
Published: (2024)
by: Ma, Xiaoxiao, et al.
Published: (2024)
An Experimental Study on Exploring Strong Lightweight Vision Transformers via Masked Image Modeling Pre-Training
by: Gao, Jin, et al.
Published: (2024)
by: Gao, Jin, et al.
Published: (2024)
Improving Diffusion-Based Generative Models via Approximated Optimal Transport
by: Kim, Daegyu, et al.
Published: (2024)
by: Kim, Daegyu, et al.
Published: (2024)
Improving Denoising Diffusion Models via Simultaneous Estimation of Image and Noise
by: Zhang, Zhenkai, et al.
Published: (2023)
by: Zhang, Zhenkai, et al.
Published: (2023)
Keypoint Aware Masked Image Modelling
by: Krishna, Madhava, et al.
Published: (2024)
by: Krishna, Madhava, et al.
Published: (2024)
When Eyes Betray AI: Social Gaze Consistency as a Semantic Cue for AI-Generated Image Detection
by: Kim, Jihyeon, et al.
Published: (2026)
by: Kim, Jihyeon, et al.
Published: (2026)
Align Your Tangent: Training Better Consistency Models via Manifold-Aligned Tangents
by: Kim, Beomsu, et al.
Published: (2025)
by: Kim, Beomsu, et al.
Published: (2025)
MMCLIP: Cross-modal Attention Masked Modelling for Medical Language-Image Pre-Training
by: Wu, Biao, et al.
Published: (2024)
by: Wu, Biao, et al.
Published: (2024)
PointFix: Learning to Fix Domain Bias for Robust Online Stereo Adaptation
by: Kim, Kwonyoung, et al.
Published: (2022)
by: Kim, Kwonyoung, et al.
Published: (2022)
Zero-Shot Video Restoration and Enhancement Using Pre-Trained Image Diffusion Model
by: Cao, Cong, et al.
Published: (2024)
by: Cao, Cong, et al.
Published: (2024)
Masked Conditioning for Deep Generative Models
by: Mueller, Phillip, et al.
Published: (2025)
by: Mueller, Phillip, et al.
Published: (2025)
Similar Items
-
Salience-Based Adaptive Masking: Revisiting Token Dynamics for Enhanced Pre-training
by: Choi, Hyesong, et al.
Published: (2024) -
MaDis-Stereo: Enhanced Stereo Matching via Distilled Masked Image Modeling
by: Ahn, Jihye, et al.
Published: (2024) -
SG-MIM: Structured Knowledge Guided Efficient Pre-training for Dense Prediction
by: Son, Sumin, et al.
Published: (2024) -
Emerging Property of Masked Token for Effective Pre-training
by: Choi, Hyesong, et al.
Published: (2024) -
UniTT-Stereo: Unified Training of Transformer for Enhanced Stereo Matching
by: Kim, Soomin, et al.
Published: (2024)