Sharing Key Semantics in Transformer Makes Efficient Image Restoration
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ren, Bin, Li, Yawei, Liang, Jingyun, Ranjan, Rakesh, Liu, Mengyuan, Cucchiara, Rita, Van Gool, Luc, Yang, Ming-Hsuan, Sebe, Nicu |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Key-Graph Transformer for Image Restoration
par: Ren, Bin, et autres
Publié: (2024)
par: Ren, Bin, et autres
Publié: (2024)
Hierarchical Information Flow for Generalized Efficient Image Restoration
par: Li, Yawei, et autres
Publié: (2024)
par: Li, Yawei, et autres
Publié: (2024)
Fractal-IR: A Unified Framework for Efficient and Scalable Image Restoration
par: Li, Yawei, et autres
Publié: (2025)
par: Li, Yawei, et autres
Publié: (2025)
Efficient Degradation-agnostic Image Restoration via Channel-Wise Functional Decomposition and Manifold Regularization
par: Ren, Bin, et autres
Publié: (2025)
par: Ren, Bin, et autres
Publié: (2025)
Any Image Restoration via Efficient Spatial-Frequency Degradation Adaptation
par: Ren, Bin, et autres
Publié: (2025)
par: Ren, Bin, et autres
Publié: (2025)
Bringing Masked Autoencoders Explicit Contrastive Properties for Point Cloud Self-Supervised Learning
par: Ren, Bin, et autres
Publié: (2024)
par: Ren, Bin, et autres
Publié: (2024)
Graph Transformer GANs with Graph Masked Modeling for Architectural Layout Generation
par: Tang, Hao, et autres
Publié: (2024)
par: Tang, Hao, et autres
Publié: (2024)
Enhanced Multi-Scale Cross-Attention for Person Image Generation
par: Tang, Hao, et autres
Publié: (2025)
par: Tang, Hao, et autres
Publié: (2025)
Inverse Virtual Try-On: Generating Multi-Category Product-Style Images from Clothed Individuals
par: Lobba, Davide, et autres
Publié: (2025)
par: Lobba, Davide, et autres
Publié: (2025)
Restore Anything Model via Efficient Degradation Adaptation
par: Ren, Bin, et autres
Publié: (2024)
par: Ren, Bin, et autres
Publié: (2024)
Dress-ED: Instruction-Guided Editing for Virtual Try-On and Try-Off
par: Sanguigni, Fulvio, et autres
Publié: (2026)
par: Sanguigni, Fulvio, et autres
Publié: (2026)
MoVideo: Motion-Aware Video Generation with Diffusion Models
par: Liang, Jingyun, et autres
Publié: (2023)
par: Liang, Jingyun, et autres
Publié: (2023)
Spatial-Temporal Graph Mamba for Music-Guided Dance Video Synthesis
par: Tang, Hao, et autres
Publié: (2025)
par: Tang, Hao, et autres
Publié: (2025)
Optimizing Resource Consumption in Diffusion Models through Hallucination Early Detection
par: Betti, Federico, et autres
Publié: (2024)
par: Betti, Federico, et autres
Publié: (2024)
Hallucination Early Detection in Diffusion Models
par: Betti, Federico, et autres
Publié: (2026)
par: Betti, Federico, et autres
Publié: (2026)
CityLoc: 6DoF Pose Distributional Localization for Text Descriptions in Large-Scale Scenes with Gaussian Representation
par: Ma, Qi, et autres
Publié: (2025)
par: Ma, Qi, et autres
Publié: (2025)
MatIR: A Hybrid Mamba-Transformer Image Restoration Model
par: Wen, Juan, et autres
Publié: (2025)
par: Wen, Juan, et autres
Publié: (2025)
A Unified Masked Jigsaw Puzzle Framework for Vision and Language Models
par: Ye, Weixin, et autres
Publié: (2026)
par: Ye, Weixin, et autres
Publié: (2026)
What Changed? Detecting and Evaluating Instruction-Guided Image Edits with Multimodal Large Language Models
par: Baraldi, Lorenzo, et autres
Publié: (2025)
par: Baraldi, Lorenzo, et autres
Publié: (2025)
ShapeSplat: A Large-scale Dataset of Gaussian Splats and Their Self-Supervised Pretraining
par: Ma, Qi, et autres
Publié: (2024)
par: Ma, Qi, et autres
Publié: (2024)
EarthMind: Leveraging Cross-Sensor Data for Advanced Earth Observation Interpretation with a Unified Multimodal LLM
par: Shu, Yan, et autres
Publié: (2025)
par: Shu, Yan, et autres
Publié: (2025)
Asymmetric GANs for Image-to-Image Translation
par: Tang, Hao, et autres
Publié: (2019)
par: Tang, Hao, et autres
Publié: (2019)
H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers
par: Li, Wenhao, et autres
Publié: (2025)
par: Li, Wenhao, et autres
Publié: (2025)
Hourglass Tokenizer for Efficient Transformer-Based 3D Human Pose Estimation
par: Li, Wenhao, et autres
Publié: (2023)
par: Li, Wenhao, et autres
Publié: (2023)
Retrieval Augmented Generation and Understanding in Vision: A Survey and New Outlook
par: Zheng, Xu, et autres
Publié: (2025)
par: Zheng, Xu, et autres
Publié: (2025)
Hierarchical Cross-Attention Network for Virtual Try-On
par: Tang, Hao, et autres
Publié: (2024)
par: Tang, Hao, et autres
Publié: (2024)
Masked Clustering Prediction for Unsupervised Point Cloud Pre-training
par: Ren, Bin, et autres
Publié: (2025)
par: Ren, Bin, et autres
Publié: (2025)
An Efficient Learning-based Solver Comparable to Metaheuristics for the Capacitated Arc Routing Problem
par: Guo, Runze, et autres
Publié: (2024)
par: Guo, Runze, et autres
Publié: (2024)
Shapley Pruning for Neural Network Compression
par: Adamczewski, Kamil, et autres
Publié: (2024)
par: Adamczewski, Kamil, et autres
Publié: (2024)
Empowering Image Recovery_ A Multi-Attention Approach
par: Wen, Juan, et autres
Publié: (2024)
par: Wen, Juan, et autres
Publié: (2024)
Optimizing against Infeasible Inclusions from Data for Semantic Segmentation through Morphology
par: Basu, Shamik, et autres
Publié: (2024)
par: Basu, Shamik, et autres
Publié: (2024)
LocalViT: Analyzing Locality in Vision Transformers
par: Li, Yawei, et autres
Publié: (2021)
par: Li, Yawei, et autres
Publié: (2021)
Uncertainty-Aware Testing-Time Optimization for 3D Human Pose Estimation
par: Wang, Ti, et autres
Publié: (2024)
par: Wang, Ti, et autres
Publié: (2024)
Chorus: Multi-Teacher Pretraining for Holistic 3D Gaussian Scene Encoding
par: Li, Yue, et autres
Publié: (2025)
par: Li, Yue, et autres
Publié: (2025)
Condition-Invariant Semantic Segmentation
par: Sakaridis, Christos, et autres
Publié: (2023)
par: Sakaridis, Christos, et autres
Publié: (2023)
Test-time Training for Hyperspectral Image Super-resolution
par: Li, Ke, et autres
Publié: (2024)
par: Li, Ke, et autres
Publié: (2024)
CE-SDWV: Effective and Efficient Concept Erasure for Text-to-Image Diffusion Models via a Semantic-Driven Word Vocabulary
par: Tu, Jiahang, et autres
Publié: (2025)
par: Tu, Jiahang, et autres
Publié: (2025)
Low-Light Image Enhancement using Event-Based Illumination Estimation
par: Sun, Lei, et autres
Publié: (2025)
par: Sun, Lei, et autres
Publié: (2025)
TrafficBots V1.5: Traffic Simulation via Conditional VAEs and Transformers with Relative Pose Encoding
par: Zhang, Zhejun, et autres
Publié: (2024)
par: Zhang, Zhejun, et autres
Publié: (2024)
Discriminative Anchor Learning for Efficient Multi-view Clustering
par: Qin, Yalan, et autres
Publié: (2024)
par: Qin, Yalan, et autres
Publié: (2024)
Documents similaires
-
Key-Graph Transformer for Image Restoration
par: Ren, Bin, et autres
Publié: (2024) -
Hierarchical Information Flow for Generalized Efficient Image Restoration
par: Li, Yawei, et autres
Publié: (2024) -
Fractal-IR: A Unified Framework for Efficient and Scalable Image Restoration
par: Li, Yawei, et autres
Publié: (2025) -
Efficient Degradation-agnostic Image Restoration via Channel-Wise Functional Decomposition and Manifold Regularization
par: Ren, Bin, et autres
Publié: (2025) -
Any Image Restoration via Efficient Spatial-Frequency Degradation Adaptation
par: Ren, Bin, et autres
Publié: (2025)