Instruct-IPT: All-in-One Image Processing Transformer via Weight Modulation
Fuente:
arXiv
Saved in:
| Main Authors: | Tian, Yuchuan, Han, Jianhong, Chen, Hanting, Xi, Yuanyuan, Ding, Ning, Hu, Jie, Xu, Chao, Wang, Yunhe |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
IPT-V2: Efficient Image Processing Transformer using Hierarchical Attentions
by: Tu, Zhijun, et al.
Published: (2024)
by: Tu, Zhijun, et al.
Published: (2024)
U-DiTs: Downsample Tokens in U-Shaped Diffusion Transformers
by: Tian, Yuchuan, et al.
Published: (2024)
by: Tian, Yuchuan, et al.
Published: (2024)
U-REPA: Aligning Diffusion U-Nets to ViTs
by: Tian, Yuchuan, et al.
Published: (2025)
by: Tian, Yuchuan, et al.
Published: (2025)
Post-Training Quantization for Diffusion Transformer via Hierarchical Timestep Grouping
by: Ding, Ning, et al.
Published: (2025)
by: Ding, Ning, et al.
Published: (2025)
DiC: Rethinking Conv3x3 Designs in Diffusion Models
by: Tian, Yuchuan, et al.
Published: (2024)
by: Tian, Yuchuan, et al.
Published: (2024)
Deferred Commitment Decoding for Diffusion Language Models
by: Shu, Yingte, et al.
Published: (2026)
by: Shu, Yingte, et al.
Published: (2026)
EAM: Enhancing Anything with Diffusion Transformers for Blind Super-Resolution
by: Xie, Haizhen, et al.
Published: (2025)
by: Xie, Haizhen, et al.
Published: (2025)
Visual-Instructed Degradation Diffusion for All-in-One Image Restoration
by: Luo, Wenyang, et al.
Published: (2025)
by: Luo, Wenyang, et al.
Published: (2025)
LIPT: Latency-aware Image Processing Transformer
by: Qiao, Junbo, et al.
Published: (2024)
by: Qiao, Junbo, et al.
Published: (2024)
OS-DiffVSR: Towards One-step Latent Diffusion Model for High-detailed Real-world Video Super-Resolution
by: Li, Hanting, et al.
Published: (2025)
by: Li, Hanting, et al.
Published: (2025)
GPT4Image: Large Pre-trained Models Help Vision Models Learn Better on Perception Task
by: Ding, Ning, et al.
Published: (2023)
by: Ding, Ning, et al.
Published: (2023)
Learning Quantized Adaptive Conditions for Diffusion Models
by: Liang, Yuchen, et al.
Published: (2024)
by: Liang, Yuchen, et al.
Published: (2024)
DSPO: Direct Semantic Preference Optimization for Real-World Image Super-Resolution
by: Cai, Miaomiao, et al.
Published: (2025)
by: Cai, Miaomiao, et al.
Published: (2025)
EvoIR: Towards All-in-One Image Restoration via Evolutionary Frequency Modulation
by: Ma, Jiaqi, et al.
Published: (2025)
by: Ma, Jiaqi, et al.
Published: (2025)
DiJiang: Efficient Large Language Models through Compact Kernelization
by: Chen, Hanting, et al.
Published: (2024)
by: Chen, Hanting, et al.
Published: (2024)
Vision Superalignment: Weak-to-Strong Generalization for Vision Foundation Models
by: Guo, Jianyuan, et al.
Published: (2024)
by: Guo, Jianyuan, et al.
Published: (2024)
Distilling Semantic Priors from SAM to Efficient Image Restoration Models
by: Zhang, Quan, et al.
Published: (2024)
by: Zhang, Quan, et al.
Published: (2024)
Instructing Text-to-Image Diffusion Models via Classifier-Guided Semantic Optimization
by: Chang, Yuanyuan, et al.
Published: (2025)
by: Chang, Yuanyuan, et al.
Published: (2025)
One Token to Seg Them All: Language Instructed Reasoning Segmentation in Videos
by: Bai, Zechen, et al.
Published: (2024)
by: Bai, Zechen, et al.
Published: (2024)
M2IR: Proactive All-in-One Image Restoration via Mamba-style Modulation and Mixture-of-Experts
by: Wang, Shiwei, et al.
Published: (2026)
by: Wang, Shiwei, et al.
Published: (2026)
AdaIR: Adaptive All-in-One Image Restoration via Frequency Mining and Modulation
by: Cui, Yuning, et al.
Published: (2024)
by: Cui, Yuning, et al.
Published: (2024)
TAT: Task-Adaptive Transformer for All-in-One Medical Image Restoration
by: Yang, Zhiwen, et al.
Published: (2025)
by: Yang, Zhiwen, et al.
Published: (2025)
Nexus: Higher-Order Attention Mechanisms in Transformers
by: Chen, Hanting, et al.
Published: (2025)
by: Chen, Hanting, et al.
Published: (2025)
Degradation-Aware Feature Perturbation for All-in-One Image Restoration
by: Tian, Xiangpeng, et al.
Published: (2025)
by: Tian, Xiangpeng, et al.
Published: (2025)
Neural Degradation Representation Learning for All-In-One Image Restoration
by: Yao, Mingde, et al.
Published: (2023)
by: Yao, Mingde, et al.
Published: (2023)
InstructAvatar: Text-Guided Emotion and Motion Control for Avatar Generation
by: Wang, Yuchi, et al.
Published: (2024)
by: Wang, Yuchi, et al.
Published: (2024)
Unified-Width Adaptive Dynamic Network for All-In-One Image Restoration
by: Xu, Yimin, et al.
Published: (2024)
by: Xu, Yimin, et al.
Published: (2024)
Learning Dual Transformers for All-In-One Image Restoration from a Frequency Perspective
by: Chu, Jie, et al.
Published: (2024)
by: Chu, Jie, et al.
Published: (2024)
AllRestorer: All-in-One Transformer for Image Restoration under Composite Degradations
by: Mao, Jiawei, et al.
Published: (2024)
by: Mao, Jiawei, et al.
Published: (2024)
Multiscale Positive-Unlabeled Detection of AI-Generated Texts
by: Tian, Yuchuan, et al.
Published: (2023)
by: Tian, Yuchuan, et al.
Published: (2023)
ParameterNet: Parameters Are All You Need
by: Han, Kai, et al.
Published: (2023)
by: Han, Kai, et al.
Published: (2023)
Revealing the Power of Post-Training for Small Language Models via Knowledge Distillation
by: Rang, Miao, et al.
Published: (2025)
by: Rang, Miao, et al.
Published: (2025)
Atlas is Your Perfect Context: One-Shot Customization for Generalizable Foundational Medical Image Segmentation
by: Zhang, Ziyu, et al.
Published: (2025)
by: Zhang, Ziyu, et al.
Published: (2025)
RAM++: Robust Representation Learning via Adaptive Mask for All-in-One Image Restoration
by: Zhang, Zilong, et al.
Published: (2025)
by: Zhang, Zilong, et al.
Published: (2025)
Prompt-based Ingredient-Oriented All-in-One Image Restoration
by: Gao, Hu, et al.
Published: (2023)
by: Gao, Hu, et al.
Published: (2023)
All-In-One Medical Image Restoration via Task-Adaptive Routing
by: Yang, Zhiwen, et al.
Published: (2024)
by: Yang, Zhiwen, et al.
Published: (2024)
Style-Adaptive Detection Transformer for Single-Source Domain Generalized Object Detection
by: Han, Jianhong, et al.
Published: (2025)
by: Han, Jianhong, et al.
Published: (2025)
Towards All-in-One Medical Image Re-Identification
by: Tian, Yuan, et al.
Published: (2025)
by: Tian, Yuan, et al.
Published: (2025)
TIDE: Achieving Balanced Subject-Driven Image Generation via Target-Instructed Diffusion Enhancement
by: Lin, Jibai, et al.
Published: (2025)
by: Lin, Jibai, et al.
Published: (2025)
From Physical Degradation Models to Task-Aware All-in-One Image Restoration
by: Gao, Hu, et al.
Published: (2026)
by: Gao, Hu, et al.
Published: (2026)
Similar Items
-
IPT-V2: Efficient Image Processing Transformer using Hierarchical Attentions
by: Tu, Zhijun, et al.
Published: (2024) -
U-DiTs: Downsample Tokens in U-Shaped Diffusion Transformers
by: Tian, Yuchuan, et al.
Published: (2024) -
U-REPA: Aligning Diffusion U-Nets to ViTs
by: Tian, Yuchuan, et al.
Published: (2025) -
Post-Training Quantization for Diffusion Transformer via Hierarchical Timestep Grouping
by: Ding, Ning, et al.
Published: (2025) -
DiC: Rethinking Conv3x3 Designs in Diffusion Models
by: Tian, Yuchuan, et al.
Published: (2024)