Learning on the Manifold: Unlocking Standard Diffusion Transformers with Representation Encoders
Fuente:
arXiv
Salvato in:
| Autori principali: | Kumar, Amandeep, Patel, Vishal M. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Scale-Wise VAR is Secretly Discrete Diffusion
di: Kumar, Amandeep, et al.
Pubblicazione: (2025)
di: Kumar, Amandeep, et al.
Pubblicazione: (2025)
A Manifold Representation of the Key in Vision Transformers
di: Meng, Li, et al.
Pubblicazione: (2024)
di: Meng, Li, et al.
Pubblicazione: (2024)
DiffEnc: Variational Diffusion with a Learned Encoder
di: Nielsen, Beatrix M. G., et al.
Pubblicazione: (2023)
di: Nielsen, Beatrix M. G., et al.
Pubblicazione: (2023)
Face-to-Face: A Video Dataset for Multi-Person Interaction Modeling
di: Chu, Ernie, et al.
Pubblicazione: (2026)
di: Chu, Ernie, et al.
Pubblicazione: (2026)
DDPM-CD: Denoising Diffusion Probabilistic Models as Feature Extractors for Change Detection
di: Bandara, Wele Gedara Chaminda, et al.
Pubblicazione: (2022)
di: Bandara, Wele Gedara Chaminda, et al.
Pubblicazione: (2022)
SINR: Sparsity Driven Compressed Implicit Neural Representations
di: Jayasundara, Dhananjaya, et al.
Pubblicazione: (2025)
di: Jayasundara, Dhananjaya, et al.
Pubblicazione: (2025)
Diffusion Transformers with Representation Autoencoders
di: Zheng, Boyang, et al.
Pubblicazione: (2025)
di: Zheng, Boyang, et al.
Pubblicazione: (2025)
Adaptive Batch Normalization Networks for Adversarial Robustness
di: Lo, Shao-Yuan, et al.
Pubblicazione: (2024)
di: Lo, Shao-Yuan, et al.
Pubblicazione: (2024)
Bigger is not Always Better: Scaling Properties of Latent Diffusion Models
di: Mei, Kangfu, et al.
Pubblicazione: (2024)
di: Mei, Kangfu, et al.
Pubblicazione: (2024)
REPA-E: Unlocking VAE for End-to-End Tuning with Latent Diffusion Transformers
di: Leng, Xingjian, et al.
Pubblicazione: (2025)
di: Leng, Xingjian, et al.
Pubblicazione: (2025)
Flows and Diffusions on the Neural Manifold
di: Saragih, Daniel, et al.
Pubblicazione: (2025)
di: Saragih, Daniel, et al.
Pubblicazione: (2025)
Diffusion-Based Representation Learning
di: Mittal, Sarthak, et al.
Pubblicazione: (2021)
di: Mittal, Sarthak, et al.
Pubblicazione: (2021)
Your Text Encoder Can Be An Object-Level Watermarking Controller
di: Devulapally, Naresh Kumar, et al.
Pubblicazione: (2025)
di: Devulapally, Naresh Kumar, et al.
Pubblicazione: (2025)
ManifoldGD: Training-Free Hierarchical Manifold Guidance for Diffusion-Based Dataset Distillation
di: Roy, Ayush, et al.
Pubblicazione: (2026)
di: Roy, Ayush, et al.
Pubblicazione: (2026)
L-VAE: Variational Auto-Encoder with Learnable Beta for Disentangled Representation
di: Ozcan, Hazal Mogultay, et al.
Pubblicazione: (2025)
di: Ozcan, Hazal Mogultay, et al.
Pubblicazione: (2025)
BridgeTower: Building Bridges Between Encoders in Vision-Language Representation Learning
di: Xu, Xiao, et al.
Pubblicazione: (2022)
di: Xu, Xiao, et al.
Pubblicazione: (2022)
TABLET: Table Structure Recognition using Encoder-only Transformers
di: Hou, Qiyu, et al.
Pubblicazione: (2025)
di: Hou, Qiyu, et al.
Pubblicazione: (2025)
Image-Specific Adaptation of Transformer Encoders for Compute-Efficient Segmentation
di: Yao, Manyi, et al.
Pubblicazione: (2024)
di: Yao, Manyi, et al.
Pubblicazione: (2024)
SpaceMesh: A Continuous Representation for Learning Manifold Surface Meshes
di: Shen, Tianchang, et al.
Pubblicazione: (2024)
di: Shen, Tianchang, et al.
Pubblicazione: (2024)
Representation Alignment for Generation: Training Diffusion Transformers Is Easier Than You Think
di: Yu, Sihyun, et al.
Pubblicazione: (2024)
di: Yu, Sihyun, et al.
Pubblicazione: (2024)
Manifold Learning for Hyperspectral Images
di: Harkat, Fethi, et al.
Pubblicazione: (2025)
di: Harkat, Fethi, et al.
Pubblicazione: (2025)
Gradient-Regularized Out-of-Distribution Detection
di: Sharifi, Sina, et al.
Pubblicazione: (2024)
di: Sharifi, Sina, et al.
Pubblicazione: (2024)
Derivative-Free Diffusion Manifold-Constrained Gradient for Unified XAI
di: Kim, Won Jun, et al.
Pubblicazione: (2024)
di: Kim, Won Jun, et al.
Pubblicazione: (2024)
Unlocking the Potential of Text-to-Image Diffusion with PAC-Bayesian Theory
di: Jiang, Eric Hanchen, et al.
Pubblicazione: (2024)
di: Jiang, Eric Hanchen, et al.
Pubblicazione: (2024)
Unsupervised Representation Learning from Sparse Transformation Analysis
di: Song, Yue, et al.
Pubblicazione: (2024)
di: Song, Yue, et al.
Pubblicazione: (2024)
Automated Learning of Semantic Embedding Representations for Diffusion Models
di: Jiang, Limai, et al.
Pubblicazione: (2025)
di: Jiang, Limai, et al.
Pubblicazione: (2025)
Tuning Just Enough: Lightweight Backdoor Attacks on Multi-Encoder Diffusion Models
di: Chen, Ziyuan, et al.
Pubblicazione: (2026)
di: Chen, Ziyuan, et al.
Pubblicazione: (2026)
CoDi: Conditional Diffusion Distillation for Higher-Fidelity and Faster Image Generation
di: Mei, Kangfu, et al.
Pubblicazione: (2023)
di: Mei, Kangfu, et al.
Pubblicazione: (2023)
NeuralRemaster: Phase-Preserving Diffusion for Structure-Aligned Generation
di: Zeng, Yu, et al.
Pubblicazione: (2025)
di: Zeng, Yu, et al.
Pubblicazione: (2025)
Varying Manifolds in Diffusion: From Time-varying Geometries to Visual Saliency
di: Chen, Junhao, et al.
Pubblicazione: (2024)
di: Chen, Junhao, et al.
Pubblicazione: (2024)
MUST: Modality-Specific Representation-Aware Transformer for Diffusion-Enhanced Survival Prediction with Missing Modality
di: Kim, Kyungwon, et al.
Pubblicazione: (2026)
di: Kim, Kyungwon, et al.
Pubblicazione: (2026)
Isometric Representation Learning for Disentangled Latent Space of Diffusion Models
di: Hahm, Jaehoon, et al.
Pubblicazione: (2024)
di: Hahm, Jaehoon, et al.
Pubblicazione: (2024)
Diffusing Differentiable Representations
di: Savani, Yash, et al.
Pubblicazione: (2024)
di: Savani, Yash, et al.
Pubblicazione: (2024)
Do VLMs Need Vision Transformers? Evaluating State Space Models as Vision Encoders
di: Kuo, Shang-Jui Ray, et al.
Pubblicazione: (2026)
di: Kuo, Shang-Jui Ray, et al.
Pubblicazione: (2026)
Bi-Encoder Contrastive Learning for Fingerprint and Iris Biometrics
di: So, Matthew, et al.
Pubblicazione: (2025)
di: So, Matthew, et al.
Pubblicazione: (2025)
Efficient Few-shot Identity Preserving Attribute Editing for 3D-aware Deep Generative Models
di: Vinod, Vishal
Pubblicazione: (2025)
di: Vinod, Vishal
Pubblicazione: (2025)
ADROIT: A Self-Supervised Framework for Learning Robust Representations for Active Learning
di: Banerjee, Soumya, et al.
Pubblicazione: (2025)
di: Banerjee, Soumya, et al.
Pubblicazione: (2025)
Applications of No-Collision Transportation Maps in Manifold Learning
di: Negrini, Elisa, et al.
Pubblicazione: (2023)
di: Negrini, Elisa, et al.
Pubblicazione: (2023)
Revisiting Transformation Invariant Geometric Deep Learning: An Initial Representation Perspective
di: Zhang, Ziwei, et al.
Pubblicazione: (2021)
di: Zhang, Ziwei, et al.
Pubblicazione: (2021)
Learning to Think in Physics: Breaking Shortcut Learning in Scientific Diffusion via Representation Alignment
di: Jia, Haozhe, et al.
Pubblicazione: (2026)
di: Jia, Haozhe, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Scale-Wise VAR is Secretly Discrete Diffusion
di: Kumar, Amandeep, et al.
Pubblicazione: (2025) -
A Manifold Representation of the Key in Vision Transformers
di: Meng, Li, et al.
Pubblicazione: (2024) -
DiffEnc: Variational Diffusion with a Learned Encoder
di: Nielsen, Beatrix M. G., et al.
Pubblicazione: (2023) -
Face-to-Face: A Video Dataset for Multi-Person Interaction Modeling
di: Chu, Ernie, et al.
Pubblicazione: (2026) -
DDPM-CD: Denoising Diffusion Probabilistic Models as Feature Extractors for Change Detection
di: Bandara, Wele Gedara Chaminda, et al.
Pubblicazione: (2022)