Equivariant Image Modeling
Fuente:
arXiv
Salvato in:
| Autori principali: | Dong, Ruixiao, Xu, Mengde, Geng, Zigang, Li, Li, Hu, Han, Gu, Shuyang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Tokenize Image as a Set
di: Geng, Zigang, et al.
Pubblicazione: (2025)
di: Geng, Zigang, et al.
Pubblicazione: (2025)
Understanding vs. Generation: Navigating Optimization Dilemma in Multimodal Models
di: Ye, Sen, et al.
Pubblicazione: (2026)
di: Ye, Sen, et al.
Pubblicazione: (2026)
Distribution Matching Variational AutoEncoder
di: Ye, Sen, et al.
Pubblicazione: (2025)
di: Ye, Sen, et al.
Pubblicazione: (2025)
X-Omni: Reinforcement Learning Makes Discrete Autoregressive Image Generative Models Great Again
di: Geng, Zigang, et al.
Pubblicazione: (2025)
di: Geng, Zigang, et al.
Pubblicazione: (2025)
CCA: Collaborative Competitive Agents for Image Editing
di: Hang, Tiankai, et al.
Pubblicazione: (2024)
di: Hang, Tiankai, et al.
Pubblicazione: (2024)
Optimal Stepsize for Diffusion Sampling
di: Pei, Jianning, et al.
Pubblicazione: (2025)
di: Pei, Jianning, et al.
Pubblicazione: (2025)
Efficient Diffusion Training via Min-SNR Weighting Strategy
di: Hang, Tiankai, et al.
Pubblicazione: (2023)
di: Hang, Tiankai, et al.
Pubblicazione: (2023)
DesignDiffusion: High-Quality Text-to-Design Image Generation with Diffusion Models
di: Wang, Zhendong, et al.
Pubblicazione: (2025)
di: Wang, Zhendong, et al.
Pubblicazione: (2025)
ProGVC: Progressive-based Generative Video Compression via Auto-Regressive Context Modeling
di: Li, Daowen, et al.
Pubblicazione: (2026)
di: Li, Daowen, et al.
Pubblicazione: (2026)
Several questions of visual generation in 2024
di: Gu, Shuyang
Pubblicazione: (2024)
di: Gu, Shuyang
Pubblicazione: (2024)
Improved Noise Schedule for Diffusion Training
di: Hang, Tiankai, et al.
Pubblicazione: (2024)
di: Hang, Tiankai, et al.
Pubblicazione: (2024)
KIND: Knowledge Integration and Diversion for Training Decomposable Models
di: Xie, Yucheng, et al.
Pubblicazione: (2024)
di: Xie, Yucheng, et al.
Pubblicazione: (2024)
ScaleWeaver: Weaving Efficient Controllable T2I Generation with Multi-Scale Reference Attention
di: Liu, Keli, et al.
Pubblicazione: (2025)
di: Liu, Keli, et al.
Pubblicazione: (2025)
FontStudio: Shape-Adaptive Diffusion Model for Coherent and Consistent Font Effect Generation
di: Mu, Xinzhi, et al.
Pubblicazione: (2024)
di: Mu, Xinzhi, et al.
Pubblicazione: (2024)
EchoGen: Generating Visual Echoes in Any Scene via Feed-Forward Subject-Driven Auto-Regressive Model
di: Dong, Ruixiao, et al.
Pubblicazione: (2025)
di: Dong, Ruixiao, et al.
Pubblicazione: (2025)
Uncertainty Estimation for Pretrained Medical Image Registration Models via Transformation Equivariance
di: Tian, Lin, et al.
Pubblicazione: (2025)
di: Tian, Lin, et al.
Pubblicazione: (2025)
A Creative Agent is Worth a 64-Token Template
di: Shi, Ruixiao, et al.
Pubblicazione: (2026)
di: Shi, Ruixiao, et al.
Pubblicazione: (2026)
Controllable Generative Video Compression
di: Ding, Ding, et al.
Pubblicazione: (2026)
di: Ding, Ding, et al.
Pubblicazione: (2026)
ReDiffuse: Rotation Equivariant Diffusion Model for Multi-focus Image Fusion
di: Li, Bo, et al.
Pubblicazione: (2026)
di: Li, Bo, et al.
Pubblicazione: (2026)
DivControl: Knowledge Diversion for Controllable Image Generation
di: Xie, Yucheng, et al.
Pubblicazione: (2025)
di: Xie, Yucheng, et al.
Pubblicazione: (2025)
Equivariant Multi-Modality Image Fusion
di: Zhao, Zixiang, et al.
Pubblicazione: (2023)
di: Zhao, Zixiang, et al.
Pubblicazione: (2023)
FINE: Factorizing Knowledge for Initialization of Variable-sized Diffusion Models
di: Xie, Yucheng, et al.
Pubblicazione: (2024)
di: Xie, Yucheng, et al.
Pubblicazione: (2024)
Rotation Equivariant Arbitrary-scale Image Super-Resolution
di: Xie, Qi, et al.
Pubblicazione: (2025)
di: Xie, Qi, et al.
Pubblicazione: (2025)
Semantic Localization Guiding Segment Anything Model For Reference Remote Sensing Image Segmentation
di: Li, Shuyang, et al.
Pubblicazione: (2025)
di: Li, Shuyang, et al.
Pubblicazione: (2025)
Enhancing Image Restoration Transformer via Adaptive Translation Equivariance
di: Hu, JiaKui, et al.
Pubblicazione: (2025)
di: Hu, JiaKui, et al.
Pubblicazione: (2025)
Incorporating Pre-trained Diffusion Models in Solving the Schrödinger Bridge Problem
di: Tang, Zhicong, et al.
Pubblicazione: (2025)
di: Tang, Zhicong, et al.
Pubblicazione: (2025)
GenArena: How Can We Achieve Human-Aligned Evaluation for Visual Generation Tasks?
di: Li, Ruihang, et al.
Pubblicazione: (2026)
di: Li, Ruihang, et al.
Pubblicazione: (2026)
Equivariant Sampling for Improving Diffusion Model-based Image Restoration
di: Wu, Chenxu, et al.
Pubblicazione: (2025)
di: Wu, Chenxu, et al.
Pubblicazione: (2025)
A Hypertoroidal Covering for Perfect Color Equivariance
di: Yang, Yulong, et al.
Pubblicazione: (2026)
di: Yang, Yulong, et al.
Pubblicazione: (2026)
Reversible Efficient Diffusion for Image Fusion
di: Xu, Xingxin, et al.
Pubblicazione: (2026)
di: Xu, Xingxin, et al.
Pubblicazione: (2026)
REMM:Rotation-Equivariant Framework for End-to-End Multimodal Image Matching
di: Nie, Han, et al.
Pubblicazione: (2024)
di: Nie, Han, et al.
Pubblicazione: (2024)
SynArtifact: Classifying and Alleviating Artifacts in Synthetic Images via Vision-Language Model
di: Cao, Bin, et al.
Pubblicazione: (2024)
di: Cao, Bin, et al.
Pubblicazione: (2024)
Self-Supervised Weight Templates for Scalable Vision Model Initialization
di: Xie, Yucheng, et al.
Pubblicazione: (2026)
di: Xie, Yucheng, et al.
Pubblicazione: (2026)
Deep Lossless Image Compression via Masked Sampling and Coarse-to-Fine Auto-Regression
di: Li, Tiantian, et al.
Pubblicazione: (2025)
di: Li, Tiantian, et al.
Pubblicazione: (2025)
PeftCD: Leveraging Vision Foundation Models with Parameter-Efficient Fine-Tuning for Remote Sensing Change Detection
di: Dong, Sijun, et al.
Pubblicazione: (2025)
di: Dong, Sijun, et al.
Pubblicazione: (2025)
LHM++: An Efficient Large Human Reconstruction Model for Pose-free Images to 3D
di: Qiu, Lingteng, et al.
Pubblicazione: (2025)
di: Qiu, Lingteng, et al.
Pubblicazione: (2025)
Towards Robust Image Denoising with Scale Equivariance
di: Zhang, Dawei, et al.
Pubblicazione: (2025)
di: Zhang, Dawei, et al.
Pubblicazione: (2025)
CARL: A Framework for Equivariant Image Registration
di: Greer, Hastings, et al.
Pubblicazione: (2024)
di: Greer, Hastings, et al.
Pubblicazione: (2024)
FAD: Frequency Adaptation and Diversion for Cross-domain Few-shot Learning
di: Shi, Ruixiao, et al.
Pubblicazione: (2025)
di: Shi, Ruixiao, et al.
Pubblicazione: (2025)
Aesthetic Post-Training Diffusion Models from Generic Preferences with Step-by-step Preference Optimization
di: Liang, Zhanhao, et al.
Pubblicazione: (2024)
di: Liang, Zhanhao, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Tokenize Image as a Set
di: Geng, Zigang, et al.
Pubblicazione: (2025) -
Understanding vs. Generation: Navigating Optimization Dilemma in Multimodal Models
di: Ye, Sen, et al.
Pubblicazione: (2026) -
Distribution Matching Variational AutoEncoder
di: Ye, Sen, et al.
Pubblicazione: (2025) -
X-Omni: Reinforcement Learning Makes Discrete Autoregressive Image Generative Models Great Again
di: Geng, Zigang, et al.
Pubblicazione: (2025) -
CCA: Collaborative Competitive Agents for Image Editing
di: Hang, Tiankai, et al.
Pubblicazione: (2024)