Distillation of Diffusion Features for Semantic Correspondence
Fuente:
arXiv
Salvato in:
| Autori principali: | Fundel, Frank, Schusterbauer, Johannes, Hu, Vincent Tao, Ommer, Björn |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Diff2Flow: Training Flow Matching Models via Diffusion Model Alignment
di: Schusterbauer, Johannes, et al.
Pubblicazione: (2025)
di: Schusterbauer, Johannes, et al.
Pubblicazione: (2025)
CleanDIFT: Diffusion Features without Noise
di: Stracke, Nick, et al.
Pubblicazione: (2024)
di: Stracke, Nick, et al.
Pubblicazione: (2024)
Diffusion Models and Representation Learning: A Survey
di: Fuest, Michael, et al.
Pubblicazione: (2024)
di: Fuest, Michael, et al.
Pubblicazione: (2024)
Guiding Token-Sparse Diffusion Models
di: Krause, Felix, et al.
Pubblicazione: (2026)
di: Krause, Felix, et al.
Pubblicazione: (2026)
Boosting Latent Diffusion with Flow Matching
di: Schusterbauer, Johannes, et al.
Pubblicazione: (2023)
di: Schusterbauer, Johannes, et al.
Pubblicazione: (2023)
Probabilistic Precipitation Nowcasting with Rectified Flow Transformers
di: Schusterbauer, Johannes, et al.
Pubblicazione: (2026)
di: Schusterbauer, Johannes, et al.
Pubblicazione: (2026)
ZigMa: A DiT-style Zigzag Mamba Diffusion Model
di: Hu, Vincent Tao, et al.
Pubblicazione: (2024)
di: Hu, Vincent Tao, et al.
Pubblicazione: (2024)
[MASK] is All You Need
di: Hu, Vincent Tao, et al.
Pubblicazione: (2024)
di: Hu, Vincent Tao, et al.
Pubblicazione: (2024)
Denoising, Fast and Slow: Difficulty-Aware Adaptive Sampling for Image Generation
di: Schusterbauer, Johannes, et al.
Pubblicazione: (2026)
di: Schusterbauer, Johannes, et al.
Pubblicazione: (2026)
MaskFlow: Discrete Flows For Flexible and Efficient Long Video Generation
di: Fuest, Michael, et al.
Pubblicazione: (2025)
di: Fuest, Michael, et al.
Pubblicazione: (2025)
Does VLM Classification Benefit from LLM Description Semantics?
di: Ma, Pingchuan, et al.
Pubblicazione: (2024)
di: Ma, Pingchuan, et al.
Pubblicazione: (2024)
DepthFM: Fast Monocular Depth Estimation with Flow Matching
di: Gui, Ming, et al.
Pubblicazione: (2024)
di: Gui, Ming, et al.
Pubblicazione: (2024)
Adapting Self-Supervised Representations as a Latent Space for Efficient Generation
di: Gui, Ming, et al.
Pubblicazione: (2025)
di: Gui, Ming, et al.
Pubblicazione: (2025)
DisMo: Disentangled Motion Representations for Open-World Motion Transfer
di: Ressler-Antal, Thomas, et al.
Pubblicazione: (2025)
di: Ressler-Antal, Thomas, et al.
Pubblicazione: (2025)
SCFlow: Implicitly Learning Style and Content Disentanglement with Flow Models
di: Ma, Pingchuan, et al.
Pubblicazione: (2025)
di: Ma, Pingchuan, et al.
Pubblicazione: (2025)
TREAD: Token Routing for Efficient Architecture-agnostic Diffusion Training
di: Krause, Felix, et al.
Pubblicazione: (2025)
di: Krause, Felix, et al.
Pubblicazione: (2025)
ActAlign: Zero-Shot Fine-Grained Video Classification via Language-Guided Sequence Alignment
di: Aghdam, Amir, et al.
Pubblicazione: (2025)
di: Aghdam, Amir, et al.
Pubblicazione: (2025)
Unsupervised View-Invariant Human Posture Representation
di: Sardari, Faegheh, et al.
Pubblicazione: (2021)
di: Sardari, Faegheh, et al.
Pubblicazione: (2021)
Continuous, Subject-Specific Attribute Control in T2I Models by Identifying Semantic Directions
di: Baumann, Stefan Andreas, et al.
Pubblicazione: (2024)
di: Baumann, Stefan Andreas, et al.
Pubblicazione: (2024)
CAGE: Unsupervised Visual Composition and Animation for Controllable Video Generation
di: Davtyan, Aram, et al.
Pubblicazione: (2024)
di: Davtyan, Aram, et al.
Pubblicazione: (2024)
Scaling Image Tokenizers with Grouped Spherical Quantization
di: Wang, Jiangtao, et al.
Pubblicazione: (2024)
di: Wang, Jiangtao, et al.
Pubblicazione: (2024)
Unifying Feature and Cost Aggregation with Transformers for Semantic and Visual Correspondence
di: Hong, Sunghwan, et al.
Pubblicazione: (2024)
di: Hong, Sunghwan, et al.
Pubblicazione: (2024)
What If : Understanding Motion Through Sparse Interactions
di: Baumann, Stefan Andreas, et al.
Pubblicazione: (2025)
di: Baumann, Stefan Andreas, et al.
Pubblicazione: (2025)
Quantum Denoising Diffusion Models
di: Kölle, Michael, et al.
Pubblicazione: (2024)
di: Kölle, Michael, et al.
Pubblicazione: (2024)
Diffusion Hyperfeatures: Searching Through Time and Space for Semantic Correspondence
di: Luo, Grace, et al.
Pubblicazione: (2023)
di: Luo, Grace, et al.
Pubblicazione: (2023)
COVE: Unleashing the Diffusion Feature Correspondence for Consistent Video Editing
di: Wang, Jiangshan, et al.
Pubblicazione: (2024)
di: Wang, Jiangshan, et al.
Pubblicazione: (2024)
Stable-Pose: Leveraging Transformers for Pose-Guided Text-to-Image Generation
di: Wang, Jiajun, et al.
Pubblicazione: (2024)
di: Wang, Jiajun, et al.
Pubblicazione: (2024)
Attention-guided Feature Distillation for Semantic Segmentation
di: Mansourian, Amir M., et al.
Pubblicazione: (2024)
di: Mansourian, Amir M., et al.
Pubblicazione: (2024)
Hierarchical Neural Semantic Representation for 3D Semantic Correspondence
di: Du, Keyu, et al.
Pubblicazione: (2025)
di: Du, Keyu, et al.
Pubblicazione: (2025)
Diffusion 3D Features (Diff3F): Decorating Untextured Shapes with Distilled Semantic Features
di: Dutt, Niladri Shekhar, et al.
Pubblicazione: (2023)
di: Dutt, Niladri Shekhar, et al.
Pubblicazione: (2023)
Leveraging Semantic Cues from Foundation Vision Models for Enhanced Local Feature Correspondence
di: Cadar, Felipe, et al.
Pubblicazione: (2024)
di: Cadar, Felipe, et al.
Pubblicazione: (2024)
Diffusion Bridge Networks Simulate Clinical-grade PET from MRI for Dementia Diagnostics
di: Li, Yitong, et al.
Pubblicazione: (2025)
di: Li, Yitong, et al.
Pubblicazione: (2025)
Surface-Aware Distilled 3D Semantic Features
di: Uzolas, Lukas, et al.
Pubblicazione: (2025)
di: Uzolas, Lukas, et al.
Pubblicazione: (2025)
Eye-for-an-eye: Appearance Transfer with Semantic Correspondence in Diffusion Models
di: Go, Sooyeon, et al.
Pubblicazione: (2024)
di: Go, Sooyeon, et al.
Pubblicazione: (2024)
CTRLorALTer: Conditional LoRAdapter for Efficient 0-Shot Control & Altering of T2I Models
di: Stracke, Nick, et al.
Pubblicazione: (2024)
di: Stracke, Nick, et al.
Pubblicazione: (2024)
Teacher-Feature Drifting: One-Step Diffusion Distillation with Pretrained Diffusion Representations
di: Zhang, Yuan, et al.
Pubblicazione: (2026)
di: Zhang, Yuan, et al.
Pubblicazione: (2026)
Latent Drifting in Diffusion Models for Counterfactual Medical Image Synthesis
di: Yeganeh, Yousef, et al.
Pubblicazione: (2024)
di: Yeganeh, Yousef, et al.
Pubblicazione: (2024)
FreeKD: Knowledge Distillation via Semantic Frequency Prompt
di: Zhang, Yuan, et al.
Pubblicazione: (2023)
di: Zhang, Yuan, et al.
Pubblicazione: (2023)
Improving Multimodal Distillation for 3D Semantic Segmentation under Domain Shift
di: Michele, Björn, et al.
Pubblicazione: (2025)
di: Michele, Björn, et al.
Pubblicazione: (2025)
Incorporating Visual Correspondence into Diffusion Model for Virtual Try-On
di: Wan, Siqi, et al.
Pubblicazione: (2025)
di: Wan, Siqi, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Diff2Flow: Training Flow Matching Models via Diffusion Model Alignment
di: Schusterbauer, Johannes, et al.
Pubblicazione: (2025) -
CleanDIFT: Diffusion Features without Noise
di: Stracke, Nick, et al.
Pubblicazione: (2024) -
Diffusion Models and Representation Learning: A Survey
di: Fuest, Michael, et al.
Pubblicazione: (2024) -
Guiding Token-Sparse Diffusion Models
di: Krause, Felix, et al.
Pubblicazione: (2026) -
Boosting Latent Diffusion with Flow Matching
di: Schusterbauer, Johannes, et al.
Pubblicazione: (2023)