Salvato in:
| Autori principali: | Yang, Chaojie, Li, Tian, Zhang, Yue, Gao, Jun |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2602.17047 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
DiT-IC: Aligned Diffusion Transformer for Efficient Image Compression
di: Shi, Junqi, et al.
Pubblicazione: (2026)
di: Shi, Junqi, et al.
Pubblicazione: (2026)
In-Context Edit: Enabling Instructional Image Editing with In-Context Generation in Large Scale Diffusion Transformer
di: Zhang, Zechuan, et al.
Pubblicazione: (2025)
di: Zhang, Zechuan, et al.
Pubblicazione: (2025)
Efficient Scaling of Diffusion Transformers for Text-to-Image Generation
di: Li, Hao, et al.
Pubblicazione: (2024)
di: Li, Hao, et al.
Pubblicazione: (2024)
UniAnimate-DiT: Human Image Animation with Large-Scale Video Diffusion Transformer
di: Wang, Xiang, et al.
Pubblicazione: (2025)
di: Wang, Xiang, et al.
Pubblicazione: (2025)
Scaling Diffusion Transformers Efficiently via $μ$P
di: Zheng, Chenyu, et al.
Pubblicazione: (2025)
di: Zheng, Chenyu, et al.
Pubblicazione: (2025)
COSMIC: Compress Satellite Images Efficiently via Diffusion Compensation
di: Zhang, Ziyuan, et al.
Pubblicazione: (2024)
di: Zhang, Ziyuan, et al.
Pubblicazione: (2024)
LucidFlux: Caption-Free Photo-Realistic Image Restoration via a Large-Scale Diffusion Transformer
di: Fei, Song, et al.
Pubblicazione: (2025)
di: Fei, Song, et al.
Pubblicazione: (2025)
UltraImage: Rethinking Resolution Extrapolation in Image Diffusion Transformers
di: Zhao, Min, et al.
Pubblicazione: (2025)
di: Zhao, Min, et al.
Pubblicazione: (2025)
General Compression Framework for Efficient Transformer Object Tracking
di: Hong, Lingyi, et al.
Pubblicazione: (2024)
di: Hong, Lingyi, et al.
Pubblicazione: (2024)
Task-Aware Dynamic Transformer for Efficient Arbitrary-Scale Image Super-Resolution
di: Xu, Tianyi, et al.
Pubblicazione: (2024)
di: Xu, Tianyi, et al.
Pubblicazione: (2024)
Z-Image: An Efficient Image Generation Foundation Model with Single-Stream Diffusion Transformer
di: Image Team, et al.
Pubblicazione: (2025)
di: Image Team, et al.
Pubblicazione: (2025)
Wuerstchen: An Efficient Architecture for Large-Scale Text-to-Image Diffusion Models
di: Pernias, Pablo, et al.
Pubblicazione: (2023)
di: Pernias, Pablo, et al.
Pubblicazione: (2023)
Scaling Text-to-Image Diffusion Transformers with Representation Autoencoders
di: Tong, Shengbang, et al.
Pubblicazione: (2026)
di: Tong, Shengbang, et al.
Pubblicazione: (2026)
OmniSelect: Dynamic Modality-Aware Token Compression for Efficient Omni-modal Large Language Models
di: Yang, Morunliu, et al.
Pubblicazione: (2026)
di: Yang, Morunliu, et al.
Pubblicazione: (2026)
Scaling Laws For Diffusion Transformers
di: Liang, Zhengyang, et al.
Pubblicazione: (2024)
di: Liang, Zhengyang, et al.
Pubblicazione: (2024)
Forcing-KV: Hybrid KV Cache Compression for Efficient Autoregressive Video Diffusion Models
di: Ji, Yicheng, et al.
Pubblicazione: (2026)
di: Ji, Yicheng, et al.
Pubblicazione: (2026)
Scaling Learned Image Compression Models up to 1 Billion
di: Li, Yuqi, et al.
Pubblicazione: (2025)
di: Li, Yuqi, et al.
Pubblicazione: (2025)
HierarchicalPrune: Position-Aware Compression for Large-Scale Diffusion Models
di: Kwon, Young D., et al.
Pubblicazione: (2025)
di: Kwon, Young D., et al.
Pubblicazione: (2025)
PICD: Versatile Perceptual Image Compression with Diffusion Rendering
di: Xu, Tongda, et al.
Pubblicazione: (2025)
di: Xu, Tongda, et al.
Pubblicazione: (2025)
SANA-WM: Efficient Minute-Scale World Modeling with Hybrid Linear Diffusion Transformer
di: Zhu, Haoyi, et al.
Pubblicazione: (2026)
di: Zhu, Haoyi, et al.
Pubblicazione: (2026)
EDiT: Efficient Diffusion Transformers with Linear Compressed Attention
di: Becker, Philipp, et al.
Pubblicazione: (2025)
di: Becker, Philipp, et al.
Pubblicazione: (2025)
TCSAFormer: Efficient Vision Transformer with Token Compression and Sparse Attention for Medical Image Segmentation
di: Xia, Zunhui, et al.
Pubblicazione: (2025)
di: Xia, Zunhui, et al.
Pubblicazione: (2025)
Dual-Scale Transformer for Large-Scale Single-Pixel Imaging
di: Qu, Gang, et al.
Pubblicazione: (2024)
di: Qu, Gang, et al.
Pubblicazione: (2024)
Unleashing the Power of One-Step Diffusion based Image Super-Resolution via a Large-Scale Diffusion Discriminator
di: Li, Jianze, et al.
Pubblicazione: (2024)
di: Li, Jianze, et al.
Pubblicazione: (2024)
SANA: Efficient High-Resolution Image Synthesis with Linear Diffusion Transformers
di: Xie, Enze, et al.
Pubblicazione: (2024)
di: Xie, Enze, et al.
Pubblicazione: (2024)
Benchmarking and Enhancing VLM for Compressed Image Understanding
di: Zhang, Zifu, et al.
Pubblicazione: (2025)
di: Zhang, Zifu, et al.
Pubblicazione: (2025)
CoD: A Diffusion Foundation Model for Image Compression
di: Jia, Zhaoyang, et al.
Pubblicazione: (2025)
di: Jia, Zhaoyang, et al.
Pubblicazione: (2025)
QuantSparse: Comprehensively Compressing Video Diffusion Transformer with Model Quantization and Attention Sparsification
di: Feng, Weilun, et al.
Pubblicazione: (2025)
di: Feng, Weilun, et al.
Pubblicazione: (2025)
DiTFastAttn: Attention Compression for Diffusion Transformer Models
di: Yuan, Zhihang, et al.
Pubblicazione: (2024)
di: Yuan, Zhihang, et al.
Pubblicazione: (2024)
From Reflection to Perfection: Scaling Inference-Time Optimization for Text-to-Image Diffusion Models via Reflection Tuning
di: Zhuo, Le, et al.
Pubblicazione: (2025)
di: Zhuo, Le, et al.
Pubblicazione: (2025)
Diffusion Model Compression for Image-to-Image Translation
di: Kim, Geonung, et al.
Pubblicazione: (2024)
di: Kim, Geonung, et al.
Pubblicazione: (2024)
A Large-Scale Referring Remote Sensing Image Segmentation Dataset and Benchmark
di: Yang, Zhigang, et al.
Pubblicazione: (2025)
di: Yang, Zhigang, et al.
Pubblicazione: (2025)
Hierarchical Separable Video Transformer for Snapshot Compressive Imaging
di: Wang, Ping, et al.
Pubblicazione: (2024)
di: Wang, Ping, et al.
Pubblicazione: (2024)
Scaling Diffusion Mamba with Bidirectional SSMs for Efficient Image and Video Generation
di: Mo, Shentong, et al.
Pubblicazione: (2024)
di: Mo, Shentong, et al.
Pubblicazione: (2024)
Structure-guided Diffusion Transformer for Low-Light Image Enhancement
di: Yin, Xiangchen, et al.
Pubblicazione: (2025)
di: Yin, Xiangchen, et al.
Pubblicazione: (2025)
CoD-Lite: Real-Time Diffusion-Based Generative Image Compression
di: Jia, Zhaoyang, et al.
Pubblicazione: (2026)
di: Jia, Zhaoyang, et al.
Pubblicazione: (2026)
CC-Pan: Channel-wise Compression based Diffusion for Efficient Pan-Sharpening
di: Li, Junjie, et al.
Pubblicazione: (2026)
di: Li, Junjie, et al.
Pubblicazione: (2026)
StyleBooth: Image Style Editing with Multimodal Instruction
di: Han, Zhen, et al.
Pubblicazione: (2024)
di: Han, Zhen, et al.
Pubblicazione: (2024)
Inf-DiT: Upsampling Any-Resolution Image with Memory-Efficient Diffusion Transformer
di: Yang, Zhuoyi, et al.
Pubblicazione: (2024)
di: Yang, Zhuoyi, et al.
Pubblicazione: (2024)
Efficient One-Step Diffusion Restoration Model with Compact Token Compression and Linear Attention
di: Qiao, Bingtian, et al.
Pubblicazione: (2026)
di: Qiao, Bingtian, et al.
Pubblicazione: (2026)
Documenti analoghi
-
DiT-IC: Aligned Diffusion Transformer for Efficient Image Compression
di: Shi, Junqi, et al.
Pubblicazione: (2026) -
In-Context Edit: Enabling Instructional Image Editing with In-Context Generation in Large Scale Diffusion Transformer
di: Zhang, Zechuan, et al.
Pubblicazione: (2025) -
Efficient Scaling of Diffusion Transformers for Text-to-Image Generation
di: Li, Hao, et al.
Pubblicazione: (2024) -
UniAnimate-DiT: Human Image Animation with Large-Scale Video Diffusion Transformer
di: Wang, Xiang, et al.
Pubblicazione: (2025) -
Scaling Diffusion Transformers Efficiently via $μ$P
di: Zheng, Chenyu, et al.
Pubblicazione: (2025)