Task-customized Masked AutoEncoder via Mixture of Cluster-conditional Experts
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Liu, Zhili, Chen, Kai, Han, Jianhua, Hong, Lanqing, Xu, Hang, Li, Zhenguo, Kwok, James T. |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Mixture of Cluster-conditional LoRA Experts for Vision-language Instruction Tuning
par: Gou, Yunhao, et autres
Publié: (2023)
par: Gou, Yunhao, et autres
Publié: (2023)
Latent Diffusion Models with Masked AutoEncoders
par: Lee, Junho, et autres
Publié: (2025)
par: Lee, Junho, et autres
Publié: (2025)
Implicit Concept Removal of Diffusion Models
par: Liu, Zhili, et autres
Publié: (2023)
par: Liu, Zhili, et autres
Publié: (2023)
Distribution Matching Variational AutoEncoder
par: Ye, Sen, et autres
Publié: (2025)
par: Ye, Sen, et autres
Publié: (2025)
Eyes Closed, Safety On: Protecting Multimodal LLMs via Image-to-Text Transformation
par: Gou, Yunhao, et autres
Publié: (2024)
par: Gou, Yunhao, et autres
Publié: (2024)
MAESTRO: Masked AutoEncoders for Multimodal, Multitemporal, and Multispectral Earth Observation Data
par: Labatie, Antoine, et autres
Publié: (2025)
par: Labatie, Antoine, et autres
Publié: (2025)
Occlusion-Aware 3D Hand-Object Pose Estimation with Masked AutoEncoders
par: Yang, Hui, et autres
Publié: (2025)
par: Yang, Hui, et autres
Publié: (2025)
Efficient Masked AutoEncoder for Video Object Counting and A Large-Scale Benchmark
par: Cao, Bing, et autres
Publié: (2024)
par: Cao, Bing, et autres
Publié: (2024)
3D Feature Prediction for Masked-AutoEncoder-Based Point Cloud Pretraining
par: Yan, Siming, et autres
Publié: (2023)
par: Yan, Siming, et autres
Publié: (2023)
Reasoning-Aligned Perception Decoupling for Scalable Multi-modal Reasoning
par: Gou, Yunhao, et autres
Publié: (2025)
par: Gou, Yunhao, et autres
Publié: (2025)
Mixed Autoencoder for Self-supervised Visual Representation Learning
par: Chen, Kai, et autres
Publié: (2023)
par: Chen, Kai, et autres
Publié: (2023)
SelfSwapper: Self-Supervised Face Swapping via Shape Agnostic Masked AutoEncoder
par: Lee, Jaeseong, et autres
Publié: (2024)
par: Lee, Jaeseong, et autres
Publié: (2024)
Latent Enhancing AutoEncoder for Occluded Image Classification
par: Kotwal, Ketan, et autres
Publié: (2024)
par: Kotwal, Ketan, et autres
Publié: (2024)
RI-MAE: Rotation-Invariant Masked AutoEncoders for Self-Supervised Point Cloud Representation Learning
par: Su, Kunming, et autres
Publié: (2024)
par: Su, Kunming, et autres
Publié: (2024)
Improved AutoEncoder with LSTM module and KL divergence
par: Huang, Wei, et autres
Publié: (2024)
par: Huang, Wei, et autres
Publié: (2024)
Corrupted but Not Broken: Understanding and Mitigating the Negative Impacts of Corrupted Data in Visual Instruction Tuning
par: Gou, Yunhao, et autres
Publié: (2025)
par: Gou, Yunhao, et autres
Publié: (2025)
ColorMAE: Exploring data-independent masking strategies in Masked AutoEncoders
par: Hinojosa, Carlos, et autres
Publié: (2024)
par: Hinojosa, Carlos, et autres
Publié: (2024)
Detecting AI-Generated Images via Contextual Anomaly Estimation in Masked AutoEncoders
par: Jang, Minsuk, et autres
Publié: (2025)
par: Jang, Minsuk, et autres
Publié: (2025)
Robust Multimodal Survival Prediction with the Latent Differentiation Conditional Variational AutoEncoder
par: Zhou, Junjie, et autres
Publié: (2025)
par: Zhou, Junjie, et autres
Publié: (2025)
Make-A-Protagonist: Generic Video Editing with An Ensemble of Experts
par: Zhao, Yuyang, et autres
Publié: (2023)
par: Zhao, Yuyang, et autres
Publié: (2023)
Detecting AutoEncoder is Enough to Catch LDM Generated Images
par: Vesnin, Dmitry, et autres
Publié: (2024)
par: Vesnin, Dmitry, et autres
Publié: (2024)
SAEdit: Token-level control for continuous image editing via Sparse AutoEncoder
par: Kamenetsky, Ronen, et autres
Publié: (2025)
par: Kamenetsky, Ronen, et autres
Publié: (2025)
Appearance Blur-driven AutoEncoder and Motion-guided Memory Module for Video Anomaly Detection
par: Lyu, Jiahao, et autres
Publié: (2024)
par: Lyu, Jiahao, et autres
Publié: (2024)
SAEN-BGS: Energy-Efficient Spiking AutoEncoder Network for Background Subtraction
par: Zhang, Zhixuan, et autres
Publié: (2025)
par: Zhang, Zhixuan, et autres
Publié: (2025)
CVT-xRF: Contrastive In-Voxel Transformer for 3D Consistent Radiance Fields from Sparse Inputs
par: Zhong, Yingji, et autres
Publié: (2024)
par: Zhong, Yingji, et autres
Publié: (2024)
PaMi-VDPO: Mitigating Video Hallucinations by Prompt-Aware Multi-Instance Video Preference Learning
par: Ding, Xinpeng, et autres
Publié: (2025)
par: Ding, Xinpeng, et autres
Publié: (2025)
NeRF-MAE: Masked AutoEncoders for Self-Supervised 3D Representation Learning for Neural Radiance Fields
par: Irshad, Muhammad Zubair, et autres
Publié: (2024)
par: Irshad, Muhammad Zubair, et autres
Publié: (2024)
CE-VAE: Capsule Enhanced Variational AutoEncoder for Underwater Image Enhancement
par: Pucci, Rita, et autres
Publié: (2024)
par: Pucci, Rita, et autres
Publié: (2024)
MagicDrive-V2: High-Resolution Long Video Generation for Autonomous Driving with Adaptive Control
par: Gao, Ruiyuan, et autres
Publié: (2024)
par: Gao, Ruiyuan, et autres
Publié: (2024)
Physics Informed Capsule Enhanced Variational AutoEncoder for Underwater Image Enhancement
par: Martinel, Niki, et autres
Publié: (2025)
par: Martinel, Niki, et autres
Publié: (2025)
Enhancing Mixture-of-Experts Specialization via Cluster-Aware Upcycling
par: Chu, Sanghyeok, et autres
Publié: (2026)
par: Chu, Sanghyeok, et autres
Publié: (2026)
Enhancing SAR Object Detection with Self-Supervised Pre-training on Masked Auto-Encoders
par: Pu, Xinyang, et autres
Publié: (2025)
par: Pu, Xinyang, et autres
Publié: (2025)
KDC-MAE: Knowledge Distilled Contrastive Mask Auto-Encoder
par: Bora, Maheswar, et autres
Publié: (2024)
par: Bora, Maheswar, et autres
Publié: (2024)
MagicDrive3D: Controllable 3D Generation for Any-View Rendering in Street Scenes
par: Gao, Ruiyuan, et autres
Publié: (2024)
par: Gao, Ruiyuan, et autres
Publié: (2024)
Masked AutoDecoder is Effective Multi-Task Vision Generalist
par: Qiu, Han, et autres
Publié: (2024)
par: Qiu, Han, et autres
Publié: (2024)
H3AE: High Compression, High Speed, and High Quality AutoEncoder for Video Diffusion Models
par: Wu, Yushu, et autres
Publié: (2025)
par: Wu, Yushu, et autres
Publié: (2025)
Multi-modal Intermediate Feature Interaction AutoEncoder for Overall Survival Prediction of Esophageal Squamous Cell Cancer
par: Wu, Chengyu, et autres
Publié: (2024)
par: Wu, Chengyu, et autres
Publié: (2024)
MagicSeg: Open-World Segmentation Pretraining via Counterfactural Diffusion-Based Auto-Generation
par: Cai, Kaixin, et autres
Publié: (2026)
par: Cai, Kaixin, et autres
Publié: (2026)
Empowering Sparse-Input Neural Radiance Fields with Dual-Level Semantic Guidance from Dense Novel Views
par: Zhong, Yingji, et autres
Publié: (2025)
par: Zhong, Yingji, et autres
Publié: (2025)
UNIT: Unifying Image and Text Recognition in One Vision Encoder
par: Zhu, Yi, et autres
Publié: (2024)
par: Zhu, Yi, et autres
Publié: (2024)
Documents similaires
-
Mixture of Cluster-conditional LoRA Experts for Vision-language Instruction Tuning
par: Gou, Yunhao, et autres
Publié: (2023) -
Latent Diffusion Models with Masked AutoEncoders
par: Lee, Junho, et autres
Publié: (2025) -
Implicit Concept Removal of Diffusion Models
par: Liu, Zhili, et autres
Publié: (2023) -
Distribution Matching Variational AutoEncoder
par: Ye, Sen, et autres
Publié: (2025) -
Eyes Closed, Safety On: Protecting Multimodal LLMs via Image-to-Text Transformation
par: Gou, Yunhao, et autres
Publié: (2024)