Attention Distillation: A Unified Approach to Visual Characteristics Transfer
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhou, Yang, Gao, Xu, Chen, Zichong, Huang, Hui |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Deformable One-shot Face Stylization via DINO Semantic Guidance
di: Zhou, Yang, et al.
Pubblicazione: (2024)
di: Zhou, Yang, et al.
Pubblicazione: (2024)
SPG: Style-Prompting Guidance for Style-Specific Content Creation
di: Liang, Qian, et al.
Pubblicazione: (2025)
di: Liang, Qian, et al.
Pubblicazione: (2025)
StyleBlend: Enhancing Style-Specific Content Creation in Text-to-Image Diffusion Models
di: Chen, Zichong, et al.
Pubblicazione: (2025)
di: Chen, Zichong, et al.
Pubblicazione: (2025)
Harmonizing knowledge Transfer in Neural Network with Unified Distillation
di: Huang, Yaomin, et al.
Pubblicazione: (2024)
di: Huang, Yaomin, et al.
Pubblicazione: (2024)
Elevating Visual Perception in Multimodal LLMs with Visual Embedding Distillation
di: Jain, Jitesh, et al.
Pubblicazione: (2024)
di: Jain, Jitesh, et al.
Pubblicazione: (2024)
Stereo-based 3D Anomaly Object Detection for Autonomous Driving: A New Dataset and Baseline
di: Mu, Shiyi, et al.
Pubblicazione: (2025)
di: Mu, Shiyi, et al.
Pubblicazione: (2025)
Multi-Teacher Knowledge Distillation with Reinforcement Learning for Visual Recognition
di: Yang, Chuanguang, et al.
Pubblicazione: (2025)
di: Yang, Chuanguang, et al.
Pubblicazione: (2025)
Channel Attention-Guided Cross-Modal Knowledge Distillation for Referring Image Segmentation
di: Yang, Chen
Pubblicazione: (2026)
di: Yang, Chen
Pubblicazione: (2026)
Linear-Time Global Visual Modeling without Explicit Attention
di: He, Ruize, et al.
Pubblicazione: (2026)
di: He, Ruize, et al.
Pubblicazione: (2026)
Drive-JEPA: Video JEPA Meets Multimodal Trajectory Distillation for End-to-End Driving
di: Wang, Linhan, et al.
Pubblicazione: (2026)
di: Wang, Linhan, et al.
Pubblicazione: (2026)
Unveil: Unified Visual-Textual Integration and Distillation for Multi-modal Document Retrieval
di: Sun, Hao, et al.
Pubblicazione: (2026)
di: Sun, Hao, et al.
Pubblicazione: (2026)
Distillation Improves Visual Place Recognition for Low Quality Images
di: Yang, Anbang, et al.
Pubblicazione: (2023)
di: Yang, Anbang, et al.
Pubblicazione: (2023)
X2I: Seamless Integration of Multimodal Understanding into Diffusion Transformer via Attention Distillation
di: Ma, Jian, et al.
Pubblicazione: (2025)
di: Ma, Jian, et al.
Pubblicazione: (2025)
Single Trajectory Distillation for Accelerating Image and Video Style Transfer
di: Xu, Sijie, et al.
Pubblicazione: (2024)
di: Xu, Sijie, et al.
Pubblicazione: (2024)
StyDeco: Unsupervised Style Transfer with Distilling Priors and Semantic Decoupling
di: Yang, Yuanlin, et al.
Pubblicazione: (2025)
di: Yang, Yuanlin, et al.
Pubblicazione: (2025)
MRStyle: A Unified Framework for Color Style Transfer with Multi-Modality Reference
di: Huang, Jiancheng, et al.
Pubblicazione: (2024)
di: Huang, Jiancheng, et al.
Pubblicazione: (2024)
WPT: World-to-Policy Transfer via Online World Model Distillation
di: Jiang, Guangfeng, et al.
Pubblicazione: (2025)
di: Jiang, Guangfeng, et al.
Pubblicazione: (2025)
Visual Text Processing: A Comprehensive Review and Unified Evaluation
di: Shu, Yan, et al.
Pubblicazione: (2025)
di: Shu, Yan, et al.
Pubblicazione: (2025)
Competitive Distillation: A Simple Learning Strategy for Improving Visual Classification
di: Shi, Daqian, et al.
Pubblicazione: (2025)
di: Shi, Daqian, et al.
Pubblicazione: (2025)
DORAEMON: A Unified Library for Visual Object Modeling and Representation Learning at Scale
di: Du, Ke, et al.
Pubblicazione: (2025)
di: Du, Ke, et al.
Pubblicazione: (2025)
ETC: Extreme Token Compression via Task-aware Visual Information Distillation in VLMs
di: Gao, Yiling, et al.
Pubblicazione: (2026)
di: Gao, Yiling, et al.
Pubblicazione: (2026)
Token Coordinated Prompt Attention is Needed for Visual Prompting
di: Liu, Zichen, et al.
Pubblicazione: (2025)
di: Liu, Zichen, et al.
Pubblicazione: (2025)
Unveiling Visual Perception in Language Models: An Attention Head Analysis Approach
di: Bi, Jing, et al.
Pubblicazione: (2024)
di: Bi, Jing, et al.
Pubblicazione: (2024)
IKOD: Mitigating Visual Attention Degradation in Large Vision-Language Models
di: Yang, Jiabing, et al.
Pubblicazione: (2025)
di: Yang, Jiabing, et al.
Pubblicazione: (2025)
StereoDETR: Stereo-based Transformer for 3D Object Detection
di: Mu, Shiyi, et al.
Pubblicazione: (2025)
di: Mu, Shiyi, et al.
Pubblicazione: (2025)
Sampling to Distill: Knowledge Transfer from Open-World Data
di: Wang, Yuzheng, et al.
Pubblicazione: (2023)
di: Wang, Yuzheng, et al.
Pubblicazione: (2023)
ProxyTransformation: Preshaping Point Cloud Manifold With Proxy Attention For 3D Visual Grounding
di: Peng, Qihang, et al.
Pubblicazione: (2025)
di: Peng, Qihang, et al.
Pubblicazione: (2025)
Latent Danger Zone: Distilling Unified Attention for Cross-Architecture Black-box Attacks
di: Li, Yang, et al.
Pubblicazione: (2025)
di: Li, Yang, et al.
Pubblicazione: (2025)
Boosting Adversarial Transferability via Ensemble Non-Attention
di: Zou, Yipeng, et al.
Pubblicazione: (2025)
di: Zou, Yipeng, et al.
Pubblicazione: (2025)
VDOT: Efficient Unified Video Creation via Optimal Transport Distillation
di: Wang, Yutong, et al.
Pubblicazione: (2025)
di: Wang, Yutong, et al.
Pubblicazione: (2025)
Estimating Human Poses Across Datasets: A Unified Skeleton and Multi-Teacher Distillation Approach
di: Khan, Muhammad Saif Ullah, et al.
Pubblicazione: (2024)
di: Khan, Muhammad Saif Ullah, et al.
Pubblicazione: (2024)
HAM: A Training-Free Style Transfer Approach via Heterogeneous Attention Modulation for Diffusion Models
di: He, Yeqi, et al.
Pubblicazione: (2026)
di: He, Yeqi, et al.
Pubblicazione: (2026)
TUNA: Taming Unified Visual Representations for Native Unified Multimodal Models
di: Liu, Zhiheng, et al.
Pubblicazione: (2025)
di: Liu, Zhiheng, et al.
Pubblicazione: (2025)
Uni-Animator: Towards Unified Visual Colorization
di: Chen, Xinyuan, et al.
Pubblicazione: (2026)
di: Chen, Xinyuan, et al.
Pubblicazione: (2026)
Unified Language-Vision Pretraining in LLM with Dynamic Discrete Visual Tokenization
di: Jin, Yang, et al.
Pubblicazione: (2023)
di: Jin, Yang, et al.
Pubblicazione: (2023)
Images in Sentences: Scaling Interleaved Instructions for Unified Visual Generation
di: Zhang, Yabo, et al.
Pubblicazione: (2026)
di: Zhang, Yabo, et al.
Pubblicazione: (2026)
Frequency Attention for Knowledge Distillation
di: Pham, Cuong, et al.
Pubblicazione: (2024)
di: Pham, Cuong, et al.
Pubblicazione: (2024)
A Unified Framework for Stealthy Adversarial Generation via Latent Optimization and Transferability Enhancement
di: Pei, Gaozheng, et al.
Pubblicazione: (2025)
di: Pei, Gaozheng, et al.
Pubblicazione: (2025)
Visual-Advantage On-Policy Distillation for Vision-Language Models
di: Liu, Ruiqi, et al.
Pubblicazione: (2026)
di: Liu, Ruiqi, et al.
Pubblicazione: (2026)
Can We Achieve Efficient Diffusion without Self-Attention? Distilling Self-Attention into Convolutions
di: Dong, ZiYi, et al.
Pubblicazione: (2025)
di: Dong, ZiYi, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Deformable One-shot Face Stylization via DINO Semantic Guidance
di: Zhou, Yang, et al.
Pubblicazione: (2024) -
SPG: Style-Prompting Guidance for Style-Specific Content Creation
di: Liang, Qian, et al.
Pubblicazione: (2025) -
StyleBlend: Enhancing Style-Specific Content Creation in Text-to-Image Diffusion Models
di: Chen, Zichong, et al.
Pubblicazione: (2025) -
Harmonizing knowledge Transfer in Neural Network with Unified Distillation
di: Huang, Yaomin, et al.
Pubblicazione: (2024) -
Elevating Visual Perception in Multimodal LLMs with Visual Embedding Distillation
di: Jain, Jitesh, et al.
Pubblicazione: (2024)