Enregistré dans:
| Auteurs principaux: | Xu, Shusong, Liu, Peiye |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2405.19085 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Patch-wise Auto-Encoder for Visual Anomaly Detection
par: Cui, Yajie, et autres
Publié: (2023)
par: Cui, Yajie, et autres
Publié: (2023)
Cluster and Predict Latent Patches for Improved Masked Image Modeling
par: Darcet, Timothée, et autres
Publié: (2025)
par: Darcet, Timothée, et autres
Publié: (2025)
HiFA: High-fidelity Text-to-3D Generation with Advanced Diffusion Guidance
par: Zhu, Junzhe, et autres
Publié: (2023)
par: Zhu, Junzhe, et autres
Publié: (2023)
General Purpose Image Encoder DINOv2 for Medical Image Registration
par: Song, Xinrui, et autres
Publié: (2024)
par: Song, Xinrui, et autres
Publié: (2024)
Concept-Based Masking: A Patch-Agnostic Defense Against Adversarial Patch Attacks
par: Mehrotra, Ayushi, et autres
Publié: (2025)
par: Mehrotra, Ayushi, et autres
Publié: (2025)
Symmetric masking strategy enhances the performance of Masked Image Modeling
par: Nguyen, Khanh-Binh, et autres
Publié: (2024)
par: Nguyen, Khanh-Binh, et autres
Publié: (2024)
CertMask: Certifiable Defense Against Adversarial Patches via Theoretically Optimal Mask Coverage
par: Lyu, Xuntao, et autres
Publié: (2025)
par: Lyu, Xuntao, et autres
Publié: (2025)
PromptDresser: Improving the Quality and Controllability of Virtual Try-On via Generative Textual Prompt and Prompt-aware Mask
par: Kim, Jeongho, et autres
Publié: (2024)
par: Kim, Jeongho, et autres
Publié: (2024)
Diffusion Model Patching via Mixture-of-Prompts
par: Ham, Seokil, et autres
Publié: (2024)
par: Ham, Seokil, et autres
Publié: (2024)
GrabDAE: An Innovative Framework for Unsupervised Domain Adaptation Utilizing Grab-Mask and Denoise Auto-Encoder
par: Chen, Junzhou, et autres
Publié: (2024)
par: Chen, Junzhou, et autres
Publié: (2024)
Pixel-Aligned Multi-View Generation with Depth Guided Decoder
par: Tang, Zhenggang, et autres
Publié: (2024)
par: Tang, Zhenggang, et autres
Publié: (2024)
Refer to Any Segmentation Mask Group With Vision-Language Prompts
par: Cao, Shengcao, et autres
Publié: (2025)
par: Cao, Shengcao, et autres
Publié: (2025)
One Layer Is Enough: Adapting Pretrained Visual Encoders for Image Generation
par: Gao, Yuan, et autres
Publié: (2025)
par: Gao, Yuan, et autres
Publié: (2025)
MIMIR: Masked Image Modeling for Mutual Information-based Adversarial Robustness
par: Xu, Xiaoyun, et autres
Publié: (2023)
par: Xu, Xiaoyun, et autres
Publié: (2023)
MCGM: Mask Conditional Text-to-Image Generative Model
par: Skaik, Rami, et autres
Publié: (2024)
par: Skaik, Rami, et autres
Publié: (2024)
Heterogeneous Generative Knowledge Distillation with Masked Image Modeling
par: Wang, Ziming, et autres
Publié: (2023)
par: Wang, Ziming, et autres
Publié: (2023)
Layout-Conditioned Autoregressive Text-to-Image Generation via Structured Masking
par: Zheng, Zirui, et autres
Publié: (2025)
par: Zheng, Zirui, et autres
Publié: (2025)
Car Damage Detection and Patch-to-Patch Self-supervised Image Alignment
par: Chen, Hanxiao
Publié: (2024)
par: Chen, Hanxiao
Publié: (2024)
SelfSwapper: Self-Supervised Face Swapping via Shape Agnostic Masked AutoEncoder
par: Lee, Jaeseong, et autres
Publié: (2024)
par: Lee, Jaeseong, et autres
Publié: (2024)
IPDN: Image-enhanced Prompt Decoding Network for 3D Referring Expression Segmentation
par: Chen, Qi, et autres
Publié: (2025)
par: Chen, Qi, et autres
Publié: (2025)
Vanishing Depth: A Depth Adapter with Positional Depth Encoding for Generalized Image Encoders
par: Koch, Paul, et autres
Publié: (2025)
par: Koch, Paul, et autres
Publié: (2025)
Dynamic Prompt Optimizing for Text-to-Image Generation
par: Mo, Wenyi, et autres
Publié: (2024)
par: Mo, Wenyi, et autres
Publié: (2024)
Near, far: Patch-ordering enhances vision foundation models' scene understanding
par: Pariza, Valentinos, et autres
Publié: (2024)
par: Pariza, Valentinos, et autres
Publié: (2024)
Dual form Complementary Masking for Domain-Adaptive Image Segmentation
par: Wang, Jiawen, et autres
Publié: (2025)
par: Wang, Jiawen, et autres
Publié: (2025)
HMAR: Efficient Hierarchical Masked Auto-Regressive Image Generation
par: Kumbong, Hermann, et autres
Publié: (2025)
par: Kumbong, Hermann, et autres
Publié: (2025)
AEMIM: Adversarial Examples Meet Masked Image Modeling
par: Xiang, Wenzhao, et autres
Publié: (2024)
par: Xiang, Wenzhao, et autres
Publié: (2024)
Detecting AI-Generated Images via Contextual Anomaly Estimation in Masked AutoEncoders
par: Jang, Minsuk, et autres
Publié: (2025)
par: Jang, Minsuk, et autres
Publié: (2025)
Patch Progression Masked Autoencoder with Fusion CNN Network for Classifying Evolution Between Two Pairs of 2D OCT Slices
par: Zhang, Philippe, et autres
Publié: (2025)
par: Zhang, Philippe, et autres
Publié: (2025)
Through-The-Mask: Mask-based Motion Trajectories for Image-to-Video Generation
par: Yariv, Guy, et autres
Publié: (2025)
par: Yariv, Guy, et autres
Publié: (2025)
MarDini: Masked Autoregressive Diffusion for Video Generation at Scale
par: Liu, Haozhe, et autres
Publié: (2024)
par: Liu, Haozhe, et autres
Publié: (2024)
HU-based Foreground Masking for 3D Medical Masked Image Modeling
par: Lee, Jin, et autres
Publié: (2025)
par: Lee, Jin, et autres
Publié: (2025)
Learning Image Priors through Patch-based Diffusion Models for Solving Inverse Problems
par: Hu, Jason, et autres
Publié: (2024)
par: Hu, Jason, et autres
Publié: (2024)
Efficient Vision-and-Language Pre-training with Text-Relevant Image Patch Selection
par: Ye, Wei, et autres
Publié: (2024)
par: Ye, Wei, et autres
Publié: (2024)
TIER: Text-Image Encoder-based Regression for AIGC Image Quality Assessment
par: Yuan, Jiquan, et autres
Publié: (2024)
par: Yuan, Jiquan, et autres
Publié: (2024)
PhyPrompt: RL-based Prompt Refinement for Physically Plausible Text-to-Video Generation
par: Wu, Shang, et autres
Publié: (2026)
par: Wu, Shang, et autres
Publié: (2026)
MaskAnyNet: Rethinking Masked Image Regions as Valuable Information in Supervised Learning
par: Hong, Jingshan, et autres
Publié: (2025)
par: Hong, Jingshan, et autres
Publié: (2025)
TRIPS: Efficient Vision-and-Language Pre-training with Text-Relevant Image Patch Selection
par: Jiang, Chaoya, et autres
Publié: (2023)
par: Jiang, Chaoya, et autres
Publié: (2023)
DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer
par: Wu, Yecheng, et autres
Publié: (2025)
par: Wu, Yecheng, et autres
Publié: (2025)
Reverse Prompt: Cracking the Recipe Inside Text-to-Image Generation
par: Ren, Zhiyao, et autres
Publié: (2025)
par: Ren, Zhiyao, et autres
Publié: (2025)
Long-Text-to-Image Generation via Compositional Prompt Decomposition
par: Huang, Jen-Yuan, et autres
Publié: (2026)
par: Huang, Jen-Yuan, et autres
Publié: (2026)
Documents similaires
-
Patch-wise Auto-Encoder for Visual Anomaly Detection
par: Cui, Yajie, et autres
Publié: (2023) -
Cluster and Predict Latent Patches for Improved Masked Image Modeling
par: Darcet, Timothée, et autres
Publié: (2025) -
HiFA: High-fidelity Text-to-3D Generation with Advanced Diffusion Guidance
par: Zhu, Junzhe, et autres
Publié: (2023) -
General Purpose Image Encoder DINOv2 for Medical Image Registration
par: Song, Xinrui, et autres
Publié: (2024) -
Concept-Based Masking: A Patch-Agnostic Defense Against Adversarial Patch Attacks
par: Mehrotra, Ayushi, et autres
Publié: (2025)