Latent Guidance in Diffusion Models for Perceptual Evaluations
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Saini, Shreshth, Liao, Ru-Ling, Ye, Yan, Bovik, Alan C. |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
LumaFlux: Lifting 8-Bit Worlds to HDR Reality with Physically-Guided Diffusion Transformers
par: Saini, Shreshth, et autres
Publié: (2026)
par: Saini, Shreshth, et autres
Publié: (2026)
CHUG: Crowdsourced User-Generated HDR Video Quality Dataset
par: Saini, Shreshth, et autres
Publié: (2025)
par: Saini, Shreshth, et autres
Publié: (2025)
Seeing Beyond 8bits: Subjective and Objective Quality Assessment of HDR-UGC Videos
par: Saini, Shreshth, et autres
Publié: (2026)
par: Saini, Shreshth, et autres
Publié: (2026)
Rectified-CFG++ for Flow Based Models
par: Saini, Shreshth, et autres
Publié: (2025)
par: Saini, Shreshth, et autres
Publié: (2025)
GameScope: A Multi-Attribute, Multi-Codec Benchmark Dataset for Gaming Video Quality Assessment
par: Sureddi, Rajesh, et autres
Publié: (2026)
par: Sureddi, Rajesh, et autres
Publié: (2026)
ACPO: Anchor-Constrained Perceptual Optimization for Diffusion Models with No-Reference Quality Guidance
par: Yang, Yang, et autres
Publié: (2026)
par: Yang, Yang, et autres
Publié: (2026)
Perceptual Evaluation of GANs and Diffusion Models for Generating X-rays
par: Schuit, Gregory, et autres
Publié: (2025)
par: Schuit, Gregory, et autres
Publié: (2025)
Uncertainty-Gated Region-Level Retrieval for Robust Semantic Segmentation
par: Rajan, Shreshth, et autres
Publié: (2025)
par: Rajan, Shreshth, et autres
Publié: (2025)
SAMScore: A Content Structural Similarity Metric for Image Translation Evaluation
par: Li, Yunxiang, et autres
Publié: (2023)
par: Li, Yunxiang, et autres
Publié: (2023)
Scaling Properties of Diffusion Models for Perceptual Tasks
par: Ravishankar, Rahul, et autres
Publié: (2024)
par: Ravishankar, Rahul, et autres
Publié: (2024)
Frame Guidance: Training-Free Guidance for Frame-Level Control in Video Diffusion Models
par: Jang, Sangwon, et autres
Publié: (2025)
par: Jang, Sangwon, et autres
Publié: (2025)
BudgetFusion: Perceptually-Guided Adaptive Diffusion Models
par: Li, Qinchan, et autres
Publié: (2024)
par: Li, Qinchan, et autres
Publié: (2024)
Diffusion Model with Perceptual Loss
par: Lin, Shanchuan, et autres
Publié: (2023)
par: Lin, Shanchuan, et autres
Publié: (2023)
Perceptual Classifiers: Detecting Generative Images using Perceptual Features
par: Durbha, Krishna Srikar, et autres
Publié: (2025)
par: Durbha, Krishna Srikar, et autres
Publié: (2025)
Latent-based Diffusion Model for Long-tailed Recognition
par: Han, Pengxiao, et autres
Publié: (2024)
par: Han, Pengxiao, et autres
Publié: (2024)
Entropy Rectifying Guidance for Diffusion and Flow Models
par: Ifriqi, Tariq Berrada, et autres
Publié: (2025)
par: Ifriqi, Tariq Berrada, et autres
Publié: (2025)
PixelGen: Improving Pixel Diffusion with Perceptual Supervision
par: Ma, Zehong, et autres
Publié: (2026)
par: Ma, Zehong, et autres
Publié: (2026)
Don't Play Favorites: Minority Guidance for Diffusion Models
par: Um, Soobin, et autres
Publié: (2023)
par: Um, Soobin, et autres
Publié: (2023)
Gradient-Free Classifier Guidance for Diffusion Model Sampling
par: Shenoy, Rahul, et autres
Publié: (2024)
par: Shenoy, Rahul, et autres
Publié: (2024)
Semantic Guidance Tuning for Text-To-Image Diffusion Models
par: Kang, Hyun, et autres
Publié: (2023)
par: Kang, Hyun, et autres
Publié: (2023)
DocShaDiffusion: Diffusion Model in Latent Space for Document Image Shadow Removal
par: Liu, Wenjie, et autres
Publié: (2025)
par: Liu, Wenjie, et autres
Publié: (2025)
Parallel Rescaling: Rebalancing Consistency Guidance for Personalized Diffusion Models
par: Chae, JungWoo, et autres
Publié: (2025)
par: Chae, JungWoo, et autres
Publié: (2025)
Upsample Guidance: Scale Up Diffusion Models without Training
par: Hwang, Juno, et autres
Publié: (2024)
par: Hwang, Juno, et autres
Publié: (2024)
Latent Diffusion Model without Variational Autoencoder
par: Shi, Minglei, et autres
Publié: (2025)
par: Shi, Minglei, et autres
Publié: (2025)
Fuse Your Latents: Video Editing with Multi-source Latent Diffusion Models
par: Lu, Tianyi, et autres
Publié: (2023)
par: Lu, Tianyi, et autres
Publié: (2023)
CFG++: Manifold-constrained Classifier Free Guidance for Diffusion Models
par: Chung, Hyungjin, et autres
Publié: (2024)
par: Chung, Hyungjin, et autres
Publié: (2024)
FairGen: Controlling Sensitive Attributes for Fair Generations in Diffusion Models via Adaptive Latent Guidance
par: Kang, Mintong, et autres
Publié: (2025)
par: Kang, Mintong, et autres
Publié: (2025)
DGAE: Diffusion-Guided Autoencoder for Efficient Latent Representation Learning
par: Liu, Dongxu, et autres
Publié: (2025)
par: Liu, Dongxu, et autres
Publié: (2025)
Enhancing Spatiotemporal Disease Progression Models via Latent Diffusion and Prior Knowledge
par: Puglisi, Lemuel, et autres
Publié: (2024)
par: Puglisi, Lemuel, et autres
Publié: (2024)
Color encoding in Latent Space of Stable Diffusion Models
par: Arias, Guillem, et autres
Publié: (2025)
par: Arias, Guillem, et autres
Publié: (2025)
Latent Diffusion Models for Attribute-Preserving Image Anonymization
par: Piano, Luca, et autres
Publié: (2024)
par: Piano, Luca, et autres
Publié: (2024)
Latent Feature-Guided Diffusion Models for Shadow Removal
par: Mei, Kangfu, et autres
Publié: (2023)
par: Mei, Kangfu, et autres
Publié: (2023)
Latent-Compressed Variational Autoencoder for Video Diffusion Models
par: Guan, Jiarui, et autres
Publié: (2026)
par: Guan, Jiarui, et autres
Publié: (2026)
WF-VAE: Enhancing Video VAE by Wavelet-Driven Energy Flow for Latent Video Diffusion Model
par: Li, Zongjian, et autres
Publié: (2024)
par: Li, Zongjian, et autres
Publié: (2024)
Training-Free Representation Guidance for Diffusion Models with a Representation Alignment Projector
par: Zu, Wenqiang, et autres
Publié: (2026)
par: Zu, Wenqiang, et autres
Publié: (2026)
Probing Perceptual Constancy in Large Vision-Language Models
par: Sun, Haoran, et autres
Publié: (2025)
par: Sun, Haoran, et autres
Publié: (2025)
Variational Control for Guidance in Diffusion Models
par: Pandey, Kushagra, et autres
Publié: (2025)
par: Pandey, Kushagra, et autres
Publié: (2025)
Diffusion Fuzzy System: Fuzzy Rule Guided Latent Multi-Path Diffusion Modeling
par: Yang, Hailong, et autres
Publié: (2025)
par: Yang, Hailong, et autres
Publié: (2025)
StereoDiffusion: Training-Free Stereo Image Generation Using Latent Diffusion Models
par: Wang, Lezhong, et autres
Publié: (2024)
par: Wang, Lezhong, et autres
Publié: (2024)
Diffusion Model in Latent Space for Medical Image Segmentation Task
par: Ngoc, Huynh Trinh, et autres
Publié: (2025)
par: Ngoc, Huynh Trinh, et autres
Publié: (2025)
Documents similaires
-
LumaFlux: Lifting 8-Bit Worlds to HDR Reality with Physically-Guided Diffusion Transformers
par: Saini, Shreshth, et autres
Publié: (2026) -
CHUG: Crowdsourced User-Generated HDR Video Quality Dataset
par: Saini, Shreshth, et autres
Publié: (2025) -
Seeing Beyond 8bits: Subjective and Objective Quality Assessment of HDR-UGC Videos
par: Saini, Shreshth, et autres
Publié: (2026) -
Rectified-CFG++ for Flow Based Models
par: Saini, Shreshth, et autres
Publié: (2025) -
GameScope: A Multi-Attribute, Multi-Codec Benchmark Dataset for Gaming Video Quality Assessment
par: Sureddi, Rajesh, et autres
Publié: (2026)