UltraImage: Rethinking Resolution Extrapolation in Image Diffusion Transformers
Fuente:
arXiv
Saved in:
| Main Authors: | Zhao, Min, Yan, Bokai, Yang, Xue, Zhu, Hongzhou, Zhang, Jintao, Liu, Shilong, Li, Chongxuan, Zhu, Jun |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
UltraViCo: Breaking Extrapolation Limits in Video Diffusion Transformers
by: Zhao, Min, et al.
Published: (2025)
by: Zhao, Min, et al.
Published: (2025)
RIFLEx: A Free Lunch for Length Extrapolation in Video Diffusion Transformers
by: Zhao, Min, et al.
Published: (2025)
by: Zhao, Min, et al.
Published: (2025)
Identifying and Solving Conditional Image Leakage in Image-to-Video Diffusion Model
by: Zhao, Min, et al.
Published: (2024)
by: Zhao, Min, et al.
Published: (2024)
Causal Forcing++: Scalable Few-Step Autoregressive Diffusion Distillation for Real-Time Interactive Video Generation
by: Zhao, Min, et al.
Published: (2026)
by: Zhao, Min, et al.
Published: (2026)
minWM: A Full-Stack Open-Source Framework for Real-Time Interactive Video World Models
by: Zhao, Min, et al.
Published: (2026)
by: Zhao, Min, et al.
Published: (2026)
Vidu: a Highly Consistent, Dynamic and Skilled Text-to-Video Generator with Diffusion Models
by: Bao, Fan, et al.
Published: (2024)
by: Bao, Fan, et al.
Published: (2024)
PEAN: A Diffusion-Based Prior-Enhanced Attention Network for Scene Text Image Super-Resolution
by: Zhao, Zuoyan, et al.
Published: (2023)
by: Zhao, Zuoyan, et al.
Published: (2023)
DyPE: Dynamic Position Extrapolation for Ultra High Resolution Diffusion
by: Issachar, Noam, et al.
Published: (2025)
by: Issachar, Noam, et al.
Published: (2025)
Effective Diffusion Transformer Architecture for Image Super-Resolution
by: Cheng, Kun, et al.
Published: (2024)
by: Cheng, Kun, et al.
Published: (2024)
Ultra-High-Resolution Image Synthesis with Pyramid Diffusion Model
by: Yang, Jiajie
Published: (2024)
by: Yang, Jiajie
Published: (2024)
SEGA: Spectral-Energy Guided Attention for Resolution Extrapolation in Diffusion Transformers
by: Rajabi, Javad, et al.
Published: (2026)
by: Rajabi, Javad, et al.
Published: (2026)
Rethinking Transformer for Long Contextual Histopathology Whole Slide Image Analysis
by: Li, Honglin, et al.
Published: (2024)
by: Li, Honglin, et al.
Published: (2024)
SANA: Efficient High-Resolution Image Synthesis with Linear Diffusion Transformers
by: Xie, Enze, et al.
Published: (2024)
by: Xie, Enze, et al.
Published: (2024)
Diffusion-4K: Ultra-High-Resolution Image Synthesis with Latent Diffusion Models
by: Zhang, Jinjin, et al.
Published: (2025)
by: Zhang, Jinjin, et al.
Published: (2025)
Exploring Frequency-Inspired Optimization in Transformer for Efficient Single Image Super-Resolution
by: Li, Ao, et al.
Published: (2023)
by: Li, Ao, et al.
Published: (2023)
Rethinking Query-based Transformer for Continual Image Segmentation
by: Zhu, Yuchen, et al.
Published: (2025)
by: Zhu, Yuchen, et al.
Published: (2025)
SLA: Beyond Sparsity in Diffusion Transformers via Fine-Tunable Sparse-Linear Attention
by: Zhang, Jintao, et al.
Published: (2025)
by: Zhang, Jintao, et al.
Published: (2025)
Diffusion Transformer meets Multi-level Wavelet Spectrum for Single Image Super-Resolution
by: Du, Peng, et al.
Published: (2025)
by: Du, Peng, et al.
Published: (2025)
DreamSR: Towards Ultra-High-Resolution Image Super-Resolution via a Receptive-Field Enhanced Diffusion Transformer
by: Dong, Qingji, et al.
Published: (2026)
by: Dong, Qingji, et al.
Published: (2026)
CycleDiff: Cycle Diffusion Models for Unpaired Image-to-image Translation
by: Zou, Shilong, et al.
Published: (2025)
by: Zou, Shilong, et al.
Published: (2025)
Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation
by: Yao, Yuan, et al.
Published: (2025)
by: Yao, Yuan, et al.
Published: (2025)
Image-to-Image Translation with Diffusion Transformers and CLIP-Based Image Conditioning
by: Zhu, Qiang, et al.
Published: (2025)
by: Zhu, Qiang, et al.
Published: (2025)
Extrapolating Prospective Glaucoma Fundus Images through Diffusion Model in Irregular Longitudinal Sequences
by: Zhao, Zhihao, et al.
Published: (2024)
by: Zhao, Zhihao, et al.
Published: (2024)
Ultra-High-Definition Reference-Based Landmark Image Super-Resolution with Generative Diffusion Prior
by: Shi, Zhenning, et al.
Published: (2025)
by: Shi, Zhenning, et al.
Published: (2025)
UltraPixel: Advancing Ultra-High-Resolution Image Synthesis to New Peaks
by: Ren, Jingjing, et al.
Published: (2024)
by: Ren, Jingjing, et al.
Published: (2024)
ZipIR: Latent Pyramid Diffusion Transformer for High-Resolution Image Restoration
by: Yu, Yongsheng, et al.
Published: (2025)
by: Yu, Yongsheng, et al.
Published: (2025)
Text Image Inpainting via Global Structure-Guided Diffusion Models
by: Zhu, Shipeng, et al.
Published: (2024)
by: Zhu, Shipeng, et al.
Published: (2024)
FAM Diffusion: Frequency and Attention Modulation for High-Resolution Image Generation with Stable Diffusion
by: Yang, Haosen, et al.
Published: (2024)
by: Yang, Haosen, et al.
Published: (2024)
Amber-Image: Efficient Compression of Large-Scale Diffusion Transformers
by: Yang, Chaojie, et al.
Published: (2026)
by: Yang, Chaojie, et al.
Published: (2026)
Recursive Generalization Transformer for Image Super-Resolution
by: Chen, Zheng, et al.
Published: (2023)
by: Chen, Zheng, et al.
Published: (2023)
Degradation-Aware and Structure-Preserving Diffusion for Real-World Image Super-Resolution
by: Ji, Yang, et al.
Published: (2026)
by: Ji, Yang, et al.
Published: (2026)
Customizing Text-to-Image Diffusion with Object Viewpoint Control
by: Kumari, Nupur, et al.
Published: (2024)
by: Kumari, Nupur, et al.
Published: (2024)
One-Step Diffusion Transformer for Controllable Real-World Image Super-Resolution
by: Fang, Yushun, et al.
Published: (2025)
by: Fang, Yushun, et al.
Published: (2025)
Image Super-Resolution with Text Prompt Diffusion
by: Chen, Zheng, et al.
Published: (2023)
by: Chen, Zheng, et al.
Published: (2023)
Inf-DiT: Upsampling Any-Resolution Image with Memory-Efficient Diffusion Transformer
by: Yang, Zhuoyi, et al.
Published: (2024)
by: Yang, Zhuoyi, et al.
Published: (2024)
Effective and Efficient Masked Image Generation Models
by: You, Zebin, et al.
Published: (2025)
by: You, Zebin, et al.
Published: (2025)
Ultra-High-Resolution Image Synthesis: Data, Method and Evaluation
by: Zhang, Jinjin, et al.
Published: (2025)
by: Zhang, Jinjin, et al.
Published: (2025)
DualTSR: Unified Dual-Diffusion Transformer for Scene Text Image Super-Resolution
by: Niu, Axi, et al.
Published: (2026)
by: Niu, Axi, et al.
Published: (2026)
Scaling Diffusion Transformers Efficiently via $μ$P
by: Zheng, Chenyu, et al.
Published: (2025)
by: Zheng, Chenyu, et al.
Published: (2025)
Every Pixel Has its Moments: Ultra-High-Resolution Unpaired Image-to-Image Translation via Dense Normalization
by: Ho, Ming-Yang, et al.
Published: (2024)
by: Ho, Ming-Yang, et al.
Published: (2024)
Similar Items
-
UltraViCo: Breaking Extrapolation Limits in Video Diffusion Transformers
by: Zhao, Min, et al.
Published: (2025) -
RIFLEx: A Free Lunch for Length Extrapolation in Video Diffusion Transformers
by: Zhao, Min, et al.
Published: (2025) -
Identifying and Solving Conditional Image Leakage in Image-to-Video Diffusion Model
by: Zhao, Min, et al.
Published: (2024) -
Causal Forcing++: Scalable Few-Step Autoregressive Diffusion Distillation for Real-Time Interactive Video Generation
by: Zhao, Min, et al.
Published: (2026) -
minWM: A Full-Stack Open-Source Framework for Real-Time Interactive Video World Models
by: Zhao, Min, et al.
Published: (2026)