Fractal-IR: A Unified Framework for Efficient and Scalable Image Restoration
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Yawei, Ren, Bin, Liang, Jingyun, Ranjan, Rakesh, Liu, Mengyuan, Sebe, Nicu, Yang, Ming-Hsuan, Benini, Luca |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Hierarchical Information Flow for Generalized Efficient Image Restoration
par: Li, Yawei, et autres
Publié: (2024)
par: Li, Yawei, et autres
Publié: (2024)
Sharing Key Semantics in Transformer Makes Efficient Image Restoration
par: Ren, Bin, et autres
Publié: (2024)
par: Ren, Bin, et autres
Publié: (2024)
Key-Graph Transformer for Image Restoration
par: Ren, Bin, et autres
Publié: (2024)
par: Ren, Bin, et autres
Publié: (2024)
Restore Anything Model via Efficient Degradation Adaptation
par: Ren, Bin, et autres
Publié: (2024)
par: Ren, Bin, et autres
Publié: (2024)
Efficient Degradation-agnostic Image Restoration via Channel-Wise Functional Decomposition and Manifold Regularization
par: Ren, Bin, et autres
Publié: (2025)
par: Ren, Bin, et autres
Publié: (2025)
Any Image Restoration via Efficient Spatial-Frequency Degradation Adaptation
par: Ren, Bin, et autres
Publié: (2025)
par: Ren, Bin, et autres
Publié: (2025)
Q-MambaIR: Accurate Quantized Mamba for Efficient Image Restoration
par: Chen, Yujie, et autres
Publié: (2025)
par: Chen, Yujie, et autres
Publié: (2025)
Asymmetric GANs for Image-to-Image Translation
par: Tang, Hao, et autres
Publié: (2019)
par: Tang, Hao, et autres
Publié: (2019)
Hierarchical Cross-Attention Network for Virtual Try-On
par: Tang, Hao, et autres
Publié: (2024)
par: Tang, Hao, et autres
Publié: (2024)
A Unified Masked Jigsaw Puzzle Framework for Vision and Language Models
par: Ye, Weixin, et autres
Publié: (2026)
par: Ye, Weixin, et autres
Publié: (2026)
Bringing Masked Autoencoders Explicit Contrastive Properties for Point Cloud Self-Supervised Learning
par: Ren, Bin, et autres
Publié: (2024)
par: Ren, Bin, et autres
Publié: (2024)
Masked Clustering Prediction for Unsupervised Point Cloud Pre-training
par: Ren, Bin, et autres
Publié: (2025)
par: Ren, Bin, et autres
Publié: (2025)
Dynamic Pre-training: Towards Efficient and Scalable All-in-One Image Restoration
par: Dudhane, Akshay, et autres
Publié: (2024)
par: Dudhane, Akshay, et autres
Publié: (2024)
Inverse Virtual Try-On: Generating Multi-Category Product-Style Images from Clothed Individuals
par: Lobba, Davide, et autres
Publié: (2025)
par: Lobba, Davide, et autres
Publié: (2025)
Gated Relational Alignment via Confidence-based Distillation for Efficient VLMs
par: Chen, Yanlong, et autres
Publié: (2026)
par: Chen, Yanlong, et autres
Publié: (2026)
H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers
par: Li, Wenhao, et autres
Publié: (2025)
par: Li, Wenhao, et autres
Publié: (2025)
Hourglass Tokenizer for Efficient Transformer-Based 3D Human Pose Estimation
par: Li, Wenhao, et autres
Publié: (2023)
par: Li, Wenhao, et autres
Publié: (2023)
Uni4D: A Unified Self-Supervised Learning Framework for Point Cloud Videos
par: Zuo, Zhi, et autres
Publié: (2025)
par: Zuo, Zhi, et autres
Publié: (2025)
Multi-focal Conditioned Latent Diffusion for Person Image Synthesis
par: Liu, Jiaqi, et autres
Publié: (2025)
par: Liu, Jiaqi, et autres
Publié: (2025)
Token Reduction via Local and Global Contexts Optimization for Efficient Video Large Language Models
par: Li, Jinlong, et autres
Publié: (2026)
par: Li, Jinlong, et autres
Publié: (2026)
ESPLoRA: Enhanced Spatial Precision with Low-Rank Adaption in Text-to-Image Diffusion Models for High-Definition Synthesis
par: Rigo, Andrea, et autres
Publié: (2025)
par: Rigo, Andrea, et autres
Publié: (2025)
Self-Supervised and Generalizable Tokenization for CLIP-Based 3D Understanding
par: Mei, Guofeng, et autres
Publié: (2025)
par: Mei, Guofeng, et autres
Publié: (2025)
AdaIR: Exploiting Underlying Similarities of Image Restoration Tasks with Adapters
par: Chen, Hao-Wei, et autres
Publié: (2024)
par: Chen, Hao-Wei, et autres
Publié: (2024)
CLIP is Strong Enough to Fight Back: Test-time Counterattacks towards Zero-shot Adversarial Robustness of CLIP
par: Xing, Songlong, et autres
Publié: (2025)
par: Xing, Songlong, et autres
Publié: (2025)
Loomis Painter: Reconstructing the Painting Process
par: Pobitzer, Markus, et autres
Publié: (2025)
par: Pobitzer, Markus, et autres
Publié: (2025)
Dress-ED: Instruction-Guided Editing for Virtual Try-On and Try-Off
par: Sanguigni, Fulvio, et autres
Publié: (2026)
par: Sanguigni, Fulvio, et autres
Publié: (2026)
Uncertainty-Aware Testing-Time Optimization for 3D Human Pose Estimation
par: Wang, Ti, et autres
Publié: (2024)
par: Wang, Ti, et autres
Publié: (2024)
Enhanced Multi-Scale Cross-Attention for Person Image Generation
par: Tang, Hao, et autres
Publié: (2025)
par: Tang, Hao, et autres
Publié: (2025)
EarthMind: Leveraging Cross-Sensor Data for Advanced Earth Observation Interpretation with a Unified Multimodal LLM
par: Shu, Yan, et autres
Publié: (2025)
par: Shu, Yan, et autres
Publié: (2025)
Reverse Personalization
par: Kung, Han-Wei, et autres
Publié: (2025)
par: Kung, Han-Wei, et autres
Publié: (2025)
RankFeat&RankWeight: Rank-1 Feature/Weight Removal for Out-of-distribution Detection
par: Song, Yue, et autres
Publié: (2023)
par: Song, Yue, et autres
Publié: (2023)
ControlMambaIR: Conditional Controls with State-Space Model for Image Restoration
par: Yang, Cheng, et autres
Publié: (2025)
par: Yang, Cheng, et autres
Publié: (2025)
DiffIR2VR-Zero: Zero-Shot Video Restoration with Diffusion-based Image Restoration Models
par: Yeh, Chang-Han, et autres
Publié: (2024)
par: Yeh, Chang-Han, et autres
Publié: (2024)
VmambaIR: Visual State Space Model for Image Restoration
par: Shi, Yuan, et autres
Publié: (2024)
par: Shi, Yuan, et autres
Publié: (2024)
DSGC-Net: A Dual-Stream Graph Convolutional Network for Crowd Counting via Feature Correlation Mining
par: Wu, Yihong, et autres
Publié: (2025)
par: Wu, Yihong, et autres
Publié: (2025)
ZeroReg: Zero-Shot Point Cloud Registration with Foundation Models
par: Wang, Weijie, et autres
Publié: (2023)
par: Wang, Weijie, et autres
Publié: (2023)
CityLoc: 6DoF Pose Distributional Localization for Text Descriptions in Large-Scale Scenes with Gaussian Representation
par: Ma, Qi, et autres
Publié: (2025)
par: Ma, Qi, et autres
Publié: (2025)
Multi-task Image Restoration Guided By Robust DINO Features
par: Lin, Xin, et autres
Publié: (2023)
par: Lin, Xin, et autres
Publié: (2023)
Vision+X: A Survey on Multimodal Learning in the Light of Data
par: Zhu, Ye, et autres
Publié: (2022)
par: Zhu, Ye, et autres
Publié: (2022)
Cross-Modal and Uncertainty-Aware Agglomeration for Open-Vocabulary 3D Scene Understanding
par: Li, Jinlong, et autres
Publié: (2025)
par: Li, Jinlong, et autres
Publié: (2025)
Documents similaires
-
Hierarchical Information Flow for Generalized Efficient Image Restoration
par: Li, Yawei, et autres
Publié: (2024) -
Sharing Key Semantics in Transformer Makes Efficient Image Restoration
par: Ren, Bin, et autres
Publié: (2024) -
Key-Graph Transformer for Image Restoration
par: Ren, Bin, et autres
Publié: (2024) -
Restore Anything Model via Efficient Degradation Adaptation
par: Ren, Bin, et autres
Publié: (2024) -
Efficient Degradation-agnostic Image Restoration via Channel-Wise Functional Decomposition and Manifold Regularization
par: Ren, Bin, et autres
Publié: (2025)