Enregistré dans:
| Auteurs principaux: | Mas, Ignasi, Morros, Ramon, Hidalgo, Javier-Ruiz, Huerta, Ivan |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2603.04568 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
2D Representation for Unguided Single-View 3D Super-Resolution in Real-Time
par: Mas, Ignasi, et autres
Publié: (2025)
par: Mas, Ignasi, et autres
Publié: (2025)
Fast Unsupervised Tensor Restoration via Low-rank Deconvolution
par: Reixach, David, et autres
Publié: (2024)
par: Reixach, David, et autres
Publié: (2024)
Localized Control in Diffusion Models via Latent Vector Prediction
par: Domingo-Gregorio, Pablo, et autres
Publié: (2026)
par: Domingo-Gregorio, Pablo, et autres
Publié: (2026)
Spatial-Mamba: Effective Visual State Space Models via Structure-aware State Fusion
par: Xiao, Chaodong, et autres
Publié: (2024)
par: Xiao, Chaodong, et autres
Publié: (2024)
Trajectory-aware Shifted State Space Models for Online Video Super-Resolution
par: Zhu, Qiang, et autres
Publié: (2025)
par: Zhu, Qiang, et autres
Publié: (2025)
SaMam: Style-aware State Space Model for Arbitrary Image Style Transfer
par: Liu, Hongda, et autres
Publié: (2025)
par: Liu, Hongda, et autres
Publié: (2025)
Linguistics-aware Masked Image Modeling for Self-supervised Scene Text Recognition
par: Zhang, Yifei, et autres
Publié: (2025)
par: Zhang, Yifei, et autres
Publié: (2025)
S4Fusion: Saliency-aware Selective State Space Model for Infrared Visible Image Fusion
par: Ma, Haolong, et autres
Publié: (2024)
par: Ma, Haolong, et autres
Publié: (2024)
Efficient Progressive Image Compression with Variance-aware Masking
par: Presta, Alberto, et autres
Publié: (2024)
par: Presta, Alberto, et autres
Publié: (2024)
Audio-visual Controlled Video Diffusion with Masked Selective State Spaces Modeling for Natural Talking Head Generation
par: Hong, Fa-Ting, et autres
Publié: (2025)
par: Hong, Fa-Ting, et autres
Publié: (2025)
Granular Ball Guided Masking: Structure-aware Data Augmentation
par: Xia, Shuyin, et autres
Publié: (2025)
par: Xia, Shuyin, et autres
Publié: (2025)
MATRIX: Mask Track Alignment for Interaction-aware Video Generation
par: Jin, Siyoon, et autres
Publié: (2025)
par: Jin, Siyoon, et autres
Publié: (2025)
Leveraging Text Localization for Scene Text Removal via Text-aware Masked Image Modeling
par: Wang, Zixiao, et autres
Publié: (2024)
par: Wang, Zixiao, et autres
Publié: (2024)
SAMKD: Spatial-aware Adaptive Masking Knowledge Distillation for Object Detection
par: Zhang, Zhourui, et autres
Publié: (2025)
par: Zhang, Zhourui, et autres
Publié: (2025)
DWIM: Towards Tool-aware Visual Reasoning via Discrepancy-aware Workflow Generation & Instruct-Masking Tuning
par: Ke, Fucai, et autres
Publié: (2025)
par: Ke, Fucai, et autres
Publié: (2025)
MaskRIS: Semantic Distortion-aware Data Augmentation for Referring Image Segmentation
par: Lee, Minhyun, et autres
Publié: (2024)
par: Lee, Minhyun, et autres
Publié: (2024)
Pan-cancer Histopathology WSI Pre-training with Position-aware Masked Autoencoder
par: Wu, Kun, et autres
Publié: (2024)
par: Wu, Kun, et autres
Publié: (2024)
MASA: Motion-aware Masked Autoencoder with Semantic Alignment for Sign Language Recognition
par: Zhao, Weichao, et autres
Publié: (2024)
par: Zhao, Weichao, et autres
Publié: (2024)
DFREC: DeepFake Identity Recovery Based on Identity-aware Masked Autoencoder
par: Yu, Peipeng, et autres
Publié: (2024)
par: Yu, Peipeng, et autres
Publié: (2024)
LADMIM: Logical Anomaly Detection with Masked Image Modeling in Discrete Latent Space
par: Sakai, Shunsuke, et autres
Publié: (2024)
par: Sakai, Shunsuke, et autres
Publié: (2024)
MaskedCLIP: Bridging the Masked and CLIP Space for Semi-Supervised Medical Vision-Language Pre-training
par: Zhu, Lei, et autres
Publié: (2025)
par: Zhu, Lei, et autres
Publié: (2025)
EAST: Early Action Prediction Sampling Strategy with Token Masking
par: Sović, Iva, et autres
Publié: (2026)
par: Sović, Iva, et autres
Publié: (2026)
MC-PanDA: Mask Confidence for Panoptic Domain Adaptation
par: Martinović, Ivan, et autres
Publié: (2024)
par: Martinović, Ivan, et autres
Publié: (2024)
MaskMatch: Boosting Semi-Supervised Learning Through Mask Autoencoder-Driven Feature Learning
par: Zhang, Wenjin, et autres
Publié: (2024)
par: Zhang, Wenjin, et autres
Publié: (2024)
Token-Space Mask Prediction for Efficient Vision Transformer Segmentation
par: Galagain, Calvin, et autres
Publié: (2026)
par: Galagain, Calvin, et autres
Publié: (2026)
AMLRIS: Alignment-aware Masked Learning for Referring Image Segmentation
par: Chen, Tongfei, et autres
Publié: (2026)
par: Chen, Tongfei, et autres
Publié: (2026)
Adaptive Texture-aware Masking for Self-Supervised Learning in 3D Dental CBCT Analysis
par: Yang, Xinquan, et autres
Publié: (2026)
par: Yang, Xinquan, et autres
Publié: (2026)
VMamba: Visual State Space Model
par: Liu, Yue, et autres
Publié: (2024)
par: Liu, Yue, et autres
Publié: (2024)
Event-aided Direct Sparse Odometry
par: Hidalgo-Carrió, Javier, et autres
Publié: (2022)
par: Hidalgo-Carrió, Javier, et autres
Publié: (2022)
Learning Mask Invariant Mutual Information for Masked Image Modeling
par: Huang, Tao, et autres
Publié: (2025)
par: Huang, Tao, et autres
Publié: (2025)
MaTe3D: Mask-guided Text-based 3D-aware Portrait Editing
par: Zhou, Kangneng, et autres
Publié: (2023)
par: Zhou, Kangneng, et autres
Publié: (2023)
Instance-aware Image Colorization with Controllable Textual Descriptions and Segmentation Masks
par: An, Yanru, et autres
Publié: (2025)
par: An, Yanru, et autres
Publié: (2025)
Image Forgery Localization with State Space Models
par: Lou, Zijie, et autres
Publié: (2024)
par: Lou, Zijie, et autres
Publié: (2024)
Flood Data Analysis on SpaceNet 8 Using Apache Sedona
par: Bai, Yanbing, et autres
Publié: (2024)
par: Bai, Yanbing, et autres
Publié: (2024)
MaskDiff: Modeling Mask Distribution with Diffusion Probabilistic Model for Few-Shot Instance Segmentation
par: Le, Minh-Quan, et autres
Publié: (2023)
par: Le, Minh-Quan, et autres
Publié: (2023)
Exploring State Space Model in Wavelet Domain: An Infrared and Visible Image Fusion Network via Wavelet Transform and State Space Model
par: Zhang, Tianpei, et autres
Publié: (2025)
par: Zhang, Tianpei, et autres
Publié: (2025)
MaskMamba: A Hybrid Mamba-Transformer Model for Masked Image Generation
par: Chen, Wenchao, et autres
Publié: (2024)
par: Chen, Wenchao, et autres
Publié: (2024)
MaskGWM: A Generalizable Driving World Model with Video Mask Reconstruction
par: Ni, Jingcheng, et autres
Publié: (2025)
par: Ni, Jingcheng, et autres
Publié: (2025)
Generalizable Deepfake Detection Based on Forgery-aware Layer Masking and Multi-artifact Subspace Decomposition
par: Zhang, Xiang, et autres
Publié: (2026)
par: Zhang, Xiang, et autres
Publié: (2026)
HMID-Net: An Exploration of Masked Image Modeling and Knowledge Distillation in Hyperbolic Space
par: Wang, Changli, et autres
Publié: (2025)
par: Wang, Changli, et autres
Publié: (2025)
Documents similaires
-
2D Representation for Unguided Single-View 3D Super-Resolution in Real-Time
par: Mas, Ignasi, et autres
Publié: (2025) -
Fast Unsupervised Tensor Restoration via Low-rank Deconvolution
par: Reixach, David, et autres
Publié: (2024) -
Localized Control in Diffusion Models via Latent Vector Prediction
par: Domingo-Gregorio, Pablo, et autres
Publié: (2026) -
Spatial-Mamba: Effective Visual State Space Models via Structure-aware State Fusion
par: Xiao, Chaodong, et autres
Publié: (2024) -
Trajectory-aware Shifted State Space Models for Online Video Super-Resolution
par: Zhu, Qiang, et autres
Publié: (2025)