Amber-Image: Efficient Compression of Large-Scale Diffusion Transformers
Fuente:
arXiv
Guardado en:
| Autores principales: | Yang, Chaojie, Li, Tian, Zhang, Yue, Gao, Jun |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
In-Context Edit: Enabling Instructional Image Editing with In-Context Generation in Large Scale Diffusion Transformer
por: Zhang, Zechuan, et al.
Publicado: (2025)
por: Zhang, Zechuan, et al.
Publicado: (2025)
DiT-IC: Aligned Diffusion Transformer for Efficient Image Compression
por: Shi, Junqi, et al.
Publicado: (2026)
por: Shi, Junqi, et al.
Publicado: (2026)
UniAnimate-DiT: Human Image Animation with Large-Scale Video Diffusion Transformer
por: Wang, Xiang, et al.
Publicado: (2025)
por: Wang, Xiang, et al.
Publicado: (2025)
Efficient Scaling of Diffusion Transformers for Text-to-Image Generation
por: Li, Hao, et al.
Publicado: (2024)
por: Li, Hao, et al.
Publicado: (2024)
LucidFlux: Caption-Free Photo-Realistic Image Restoration via a Large-Scale Diffusion Transformer
por: Fei, Song, et al.
Publicado: (2025)
por: Fei, Song, et al.
Publicado: (2025)
COSMIC: Compress Satellite Images Efficiently via Diffusion Compensation
por: Zhang, Ziyuan, et al.
Publicado: (2024)
por: Zhang, Ziyuan, et al.
Publicado: (2024)
Scaling Diffusion Transformers Efficiently via $μ$P
por: Zheng, Chenyu, et al.
Publicado: (2025)
por: Zheng, Chenyu, et al.
Publicado: (2025)
UltraImage: Rethinking Resolution Extrapolation in Image Diffusion Transformers
por: Zhao, Min, et al.
Publicado: (2025)
por: Zhao, Min, et al.
Publicado: (2025)
General Compression Framework for Efficient Transformer Object Tracking
por: Hong, Lingyi, et al.
Publicado: (2024)
por: Hong, Lingyi, et al.
Publicado: (2024)
Task-Aware Dynamic Transformer for Efficient Arbitrary-Scale Image Super-Resolution
por: Xu, Tianyi, et al.
Publicado: (2024)
por: Xu, Tianyi, et al.
Publicado: (2024)
Wuerstchen: An Efficient Architecture for Large-Scale Text-to-Image Diffusion Models
por: Pernias, Pablo, et al.
Publicado: (2023)
por: Pernias, Pablo, et al.
Publicado: (2023)
Z-Image: An Efficient Image Generation Foundation Model with Single-Stream Diffusion Transformer
por: Image Team, et al.
Publicado: (2025)
por: Image Team, et al.
Publicado: (2025)
Scaling Text-to-Image Diffusion Transformers with Representation Autoencoders
por: Tong, Shengbang, et al.
Publicado: (2026)
por: Tong, Shengbang, et al.
Publicado: (2026)
Scaling Laws For Diffusion Transformers
por: Liang, Zhengyang, et al.
Publicado: (2024)
por: Liang, Zhengyang, et al.
Publicado: (2024)
Scaling Learned Image Compression Models up to 1 Billion
por: Li, Yuqi, et al.
Publicado: (2025)
por: Li, Yuqi, et al.
Publicado: (2025)
PICD: Versatile Perceptual Image Compression with Diffusion Rendering
por: Xu, Tongda, et al.
Publicado: (2025)
por: Xu, Tongda, et al.
Publicado: (2025)
TCSAFormer: Efficient Vision Transformer with Token Compression and Sparse Attention for Medical Image Segmentation
por: Xia, Zunhui, et al.
Publicado: (2025)
por: Xia, Zunhui, et al.
Publicado: (2025)
OmniSelect: Dynamic Modality-Aware Token Compression for Efficient Omni-modal Large Language Models
por: Yang, Morunliu, et al.
Publicado: (2026)
por: Yang, Morunliu, et al.
Publicado: (2026)
Forcing-KV: Hybrid KV Cache Compression for Efficient Autoregressive Video Diffusion Models
por: Ji, Yicheng, et al.
Publicado: (2026)
por: Ji, Yicheng, et al.
Publicado: (2026)
SANA-WM: Efficient Minute-Scale World Modeling with Hybrid Linear Diffusion Transformer
por: Zhu, Haoyi, et al.
Publicado: (2026)
por: Zhu, Haoyi, et al.
Publicado: (2026)
Dual-Scale Transformer for Large-Scale Single-Pixel Imaging
por: Qu, Gang, et al.
Publicado: (2024)
por: Qu, Gang, et al.
Publicado: (2024)
HierarchicalPrune: Position-Aware Compression for Large-Scale Diffusion Models
por: Kwon, Young D., et al.
Publicado: (2025)
por: Kwon, Young D., et al.
Publicado: (2025)
SANA: Efficient High-Resolution Image Synthesis with Linear Diffusion Transformers
por: Xie, Enze, et al.
Publicado: (2024)
por: Xie, Enze, et al.
Publicado: (2024)
Unleashing the Power of One-Step Diffusion based Image Super-Resolution via a Large-Scale Diffusion Discriminator
por: Li, Jianze, et al.
Publicado: (2024)
por: Li, Jianze, et al.
Publicado: (2024)
EDiT: Efficient Diffusion Transformers with Linear Compressed Attention
por: Becker, Philipp, et al.
Publicado: (2025)
por: Becker, Philipp, et al.
Publicado: (2025)
CoD: A Diffusion Foundation Model for Image Compression
por: Jia, Zhaoyang, et al.
Publicado: (2025)
por: Jia, Zhaoyang, et al.
Publicado: (2025)
Benchmarking and Enhancing VLM for Compressed Image Understanding
por: Zhang, Zifu, et al.
Publicado: (2025)
por: Zhang, Zifu, et al.
Publicado: (2025)
QuantSparse: Comprehensively Compressing Video Diffusion Transformer with Model Quantization and Attention Sparsification
por: Feng, Weilun, et al.
Publicado: (2025)
por: Feng, Weilun, et al.
Publicado: (2025)
DiTFastAttn: Attention Compression for Diffusion Transformer Models
por: Yuan, Zhihang, et al.
Publicado: (2024)
por: Yuan, Zhihang, et al.
Publicado: (2024)
Diffusion Model Compression for Image-to-Image Translation
por: Kim, Geonung, et al.
Publicado: (2024)
por: Kim, Geonung, et al.
Publicado: (2024)
A Large-Scale Referring Remote Sensing Image Segmentation Dataset and Benchmark
por: Yang, Zhigang, et al.
Publicado: (2025)
por: Yang, Zhigang, et al.
Publicado: (2025)
Hierarchical Separable Video Transformer for Snapshot Compressive Imaging
por: Wang, Ping, et al.
Publicado: (2024)
por: Wang, Ping, et al.
Publicado: (2024)
CC-Pan: Channel-wise Compression based Diffusion for Efficient Pan-Sharpening
por: Li, Junjie, et al.
Publicado: (2026)
por: Li, Junjie, et al.
Publicado: (2026)
CoD-Lite: Real-Time Diffusion-Based Generative Image Compression
por: Jia, Zhaoyang, et al.
Publicado: (2026)
por: Jia, Zhaoyang, et al.
Publicado: (2026)
Inf-DiT: Upsampling Any-Resolution Image with Memory-Efficient Diffusion Transformer
por: Yang, Zhuoyi, et al.
Publicado: (2024)
por: Yang, Zhuoyi, et al.
Publicado: (2024)
From Reflection to Perfection: Scaling Inference-Time Optimization for Text-to-Image Diffusion Models via Reflection Tuning
por: Zhuo, Le, et al.
Publicado: (2025)
por: Zhuo, Le, et al.
Publicado: (2025)
Structure-guided Diffusion Transformer for Low-Light Image Enhancement
por: Yin, Xiangchen, et al.
Publicado: (2025)
por: Yin, Xiangchen, et al.
Publicado: (2025)
ViDiT-Q: Efficient and Accurate Quantization of Diffusion Transformers for Image and Video Generation
por: Zhao, Tianchen, et al.
Publicado: (2024)
por: Zhao, Tianchen, et al.
Publicado: (2024)
Efficient-vDiT: Efficient Video Diffusion Transformers With Attention Tile
por: Ding, Hangliang, et al.
Publicado: (2025)
por: Ding, Hangliang, et al.
Publicado: (2025)
Efficient Diffusion Transformer with Step-wise Dynamic Attention Mediators
por: Pu, Yifan, et al.
Publicado: (2024)
por: Pu, Yifan, et al.
Publicado: (2024)
Ejemplares similares
-
In-Context Edit: Enabling Instructional Image Editing with In-Context Generation in Large Scale Diffusion Transformer
por: Zhang, Zechuan, et al.
Publicado: (2025) -
DiT-IC: Aligned Diffusion Transformer for Efficient Image Compression
por: Shi, Junqi, et al.
Publicado: (2026) -
UniAnimate-DiT: Human Image Animation with Large-Scale Video Diffusion Transformer
por: Wang, Xiang, et al.
Publicado: (2025) -
Efficient Scaling of Diffusion Transformers for Text-to-Image Generation
por: Li, Hao, et al.
Publicado: (2024) -
LucidFlux: Caption-Free Photo-Realistic Image Restoration via a Large-Scale Diffusion Transformer
por: Fei, Song, et al.
Publicado: (2025)