Salvato in:
| Autori principali: | Ma, Jian, Peng, Qirong, Guo, Xu, Chen, Chen, Lu, Haonan, Yang, Zhenyu |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2503.06134 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Pluggable Pruning with Contiguous Layer Distillation for Diffusion Transformers
di: Ma, Jian, et al.
Pubblicazione: (2025)
di: Ma, Jian, et al.
Pubblicazione: (2025)
X2Edit: Revisiting Arbitrary-Instruction Image Editing through Self-Constructed Data and Task-Aware Representation Learning
di: Ma, Jian, et al.
Pubblicazione: (2025)
di: Ma, Jian, et al.
Pubblicazione: (2025)
PEA-Diffusion: Parameter-Efficient Adapter with Knowledge Distillation in non-English Text-to-Image Generation
di: Ma, Jian, et al.
Pubblicazione: (2023)
di: Ma, Jian, et al.
Pubblicazione: (2023)
GlyphDraw2: Automatic Generation of Complex Glyph Posters with Diffusion Models and Large Language Models
di: Ma, Jian, et al.
Pubblicazione: (2024)
di: Ma, Jian, et al.
Pubblicazione: (2024)
Subject-Diffusion:Open Domain Personalized Text-to-Image Generation without Test-time Fine-tuning
di: Ma, Jian, et al.
Pubblicazione: (2023)
di: Ma, Jian, et al.
Pubblicazione: (2023)
Cross-Resolution Distribution Matching for Diffusion Distillation
di: Chen, Feiyang, et al.
Pubblicazione: (2026)
di: Chen, Feiyang, et al.
Pubblicazione: (2026)
HermesFlow: Seamlessly Closing the Gap in Multimodal Understanding and Generation
di: Yang, Ling, et al.
Pubblicazione: (2025)
di: Yang, Ling, et al.
Pubblicazione: (2025)
Efficient Dataset Distillation via Minimax Diffusion
di: Gu, Jianyang, et al.
Pubblicazione: (2023)
di: Gu, Jianyang, et al.
Pubblicazione: (2023)
LAPTOP-Diff: Layer Pruning and Normalized Distillation for Compressing Diffusion Models
di: Zhang, Dingkun, et al.
Pubblicazione: (2024)
di: Zhang, Dingkun, et al.
Pubblicazione: (2024)
Simple and Fast Distillation of Diffusion Models
di: Zhou, Zhenyu, et al.
Pubblicazione: (2024)
di: Zhou, Zhenyu, et al.
Pubblicazione: (2024)
FIAS: Feature Imbalance-Aware Medical Image Segmentation with Dynamic Fusion and Mixing Attention
di: Liu, Xiwei, et al.
Pubblicazione: (2024)
di: Liu, Xiwei, et al.
Pubblicazione: (2024)
Understanding Generalization in Diffusion Distillation via Probability Flow Distance
di: Zhang, Huijie, et al.
Pubblicazione: (2025)
di: Zhang, Huijie, et al.
Pubblicazione: (2025)
Dynamic-I2V: Exploring Image-to-Video Generation Models via Multimodal LLM
di: Liu, Peng, et al.
Pubblicazione: (2025)
di: Liu, Peng, et al.
Pubblicazione: (2025)
SCott: Accelerating Diffusion Models with Stochastic Consistency Distillation
di: Liu, Hongjian, et al.
Pubblicazione: (2024)
di: Liu, Hongjian, et al.
Pubblicazione: (2024)
AddSR: Accelerating Diffusion-based Blind Super-Resolution with Adversarial Diffusion Distillation
di: Xie, Rui, et al.
Pubblicazione: (2024)
di: Xie, Rui, et al.
Pubblicazione: (2024)
Spiking Transformer:Introducing Accurate Addition-Only Spiking Self-Attention for Transformer
di: Guo, Yufei, et al.
Pubblicazione: (2025)
di: Guo, Yufei, et al.
Pubblicazione: (2025)
CONCORD: Concept-Informed Diffusion for Dataset Distillation
di: Gu, Jianyang, et al.
Pubblicazione: (2025)
di: Gu, Jianyang, et al.
Pubblicazione: (2025)
Breaking the Encoder Barrier for Seamless Video-Language Understanding
di: Li, Handong, et al.
Pubblicazione: (2025)
di: Li, Handong, et al.
Pubblicazione: (2025)
Veda: Scalable Video Diffusion via Distilled Sparse Attention
di: Han, Shihao, et al.
Pubblicazione: (2026)
di: Han, Shihao, et al.
Pubblicazione: (2026)
Multimodal Dataset Distillation via Phased Teacher Models
di: Guo, Shengbin, et al.
Pubblicazione: (2026)
di: Guo, Shengbin, et al.
Pubblicazione: (2026)
X-OmniClaw Technical Report: A Unified Mobile Agent for Multimodal Understanding and Interaction
di: Ren, Xiaoming, et al.
Pubblicazione: (2026)
di: Ren, Xiaoming, et al.
Pubblicazione: (2026)
NaTex: Seamless Texture Generation as Latent Color Diffusion
di: Lai, Zeqiang, et al.
Pubblicazione: (2025)
di: Lai, Zeqiang, et al.
Pubblicazione: (2025)
Muon-Accelerated Attention Distillation for Real-Time Edge Synthesis via Optimized Latent Diffusion
di: Chen, Weiye, et al.
Pubblicazione: (2025)
di: Chen, Weiye, et al.
Pubblicazione: (2025)
Distillation Dynamics: Towards Understanding Feature-Based Distillation in Vision Transformers
di: Tian, Huiyuan, et al.
Pubblicazione: (2025)
di: Tian, Huiyuan, et al.
Pubblicazione: (2025)
Efficient Diffusion Distillation via Embedding Loss
di: Ying, Jincheng, et al.
Pubblicazione: (2026)
di: Ying, Jincheng, et al.
Pubblicazione: (2026)
LAMIC: Layout-Aware Multi-Image Composition via Scalability of Multimodal Diffusion Transformer
di: Chen, Yuzhuo, et al.
Pubblicazione: (2025)
di: Chen, Yuzhuo, et al.
Pubblicazione: (2025)
Fine-Grained Prototypes Distillation for Few-Shot Object Detection
di: Wang, Zichen, et al.
Pubblicazione: (2024)
di: Wang, Zichen, et al.
Pubblicazione: (2024)
Attention Distillation: A Unified Approach to Visual Characteristics Transfer
di: Zhou, Yang, et al.
Pubblicazione: (2025)
di: Zhou, Yang, et al.
Pubblicazione: (2025)
PaceVGGT: Pre-Alternating-Attention Token Pruning for Visual Geometry Transformers
di: Li, Haotang, et al.
Pubblicazione: (2026)
di: Li, Haotang, et al.
Pubblicazione: (2026)
Noise-Informed Diffusion-Generated Image Detection with Anomaly Attention
di: Guan, Weinan, et al.
Pubblicazione: (2025)
di: Guan, Weinan, et al.
Pubblicazione: (2025)
MammothModa2: A Unified AR-Diffusion Framework for Multimodal Understanding and Generation
di: Shen, Tao, et al.
Pubblicazione: (2025)
di: Shen, Tao, et al.
Pubblicazione: (2025)
AMFD: Distillation via Adaptive Multimodal Fusion for Multispectral Pedestrian Detection
di: Chen, Zizhao, et al.
Pubblicazione: (2024)
di: Chen, Zizhao, et al.
Pubblicazione: (2024)
HANet: A Hierarchical Attention Network for Change Detection With Bitemporal Very-High-Resolution Remote Sensing Images
di: Han, Chengxi, et al.
Pubblicazione: (2024)
di: Han, Chengxi, et al.
Pubblicazione: (2024)
Exploring Local Memorization in Diffusion Models via Bright Ending Attention
di: Chen, Chen, et al.
Pubblicazione: (2024)
di: Chen, Chen, et al.
Pubblicazione: (2024)
Vivid-VR: Distilling Concepts from Text-to-Video Diffusion Transformer for Photorealistic Video Restoration
di: Bai, Haoran, et al.
Pubblicazione: (2025)
di: Bai, Haoran, et al.
Pubblicazione: (2025)
DaMo: Data Mixing Optimizer in Fine-tuning Multimodal LLMs for Mobile Phone Agents
di: Shi, Kai, et al.
Pubblicazione: (2025)
di: Shi, Kai, et al.
Pubblicazione: (2025)
Channel Attention-Guided Cross-Modal Knowledge Distillation for Referring Image Segmentation
di: Yang, Chen
Pubblicazione: (2026)
di: Yang, Chen
Pubblicazione: (2026)
Understanding Attention Mechanism in Video Diffusion Models
di: Liu, Bingyan, et al.
Pubblicazione: (2025)
di: Liu, Bingyan, et al.
Pubblicazione: (2025)
Autoregressive Distillation of Diffusion Transformers
di: Kim, Yeongmin, et al.
Pubblicazione: (2025)
di: Kim, Yeongmin, et al.
Pubblicazione: (2025)
UniVidX: A Unified Multimodal Framework for Versatile Video Generation via Diffusion Priors
di: Chen, Houyuan, et al.
Pubblicazione: (2026)
di: Chen, Houyuan, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Pluggable Pruning with Contiguous Layer Distillation for Diffusion Transformers
di: Ma, Jian, et al.
Pubblicazione: (2025) -
X2Edit: Revisiting Arbitrary-Instruction Image Editing through Self-Constructed Data and Task-Aware Representation Learning
di: Ma, Jian, et al.
Pubblicazione: (2025) -
PEA-Diffusion: Parameter-Efficient Adapter with Knowledge Distillation in non-English Text-to-Image Generation
di: Ma, Jian, et al.
Pubblicazione: (2023) -
GlyphDraw2: Automatic Generation of Complex Glyph Posters with Diffusion Models and Large Language Models
di: Ma, Jian, et al.
Pubblicazione: (2024) -
Subject-Diffusion:Open Domain Personalized Text-to-Image Generation without Test-time Fine-tuning
di: Ma, Jian, et al.
Pubblicazione: (2023)