Leveraging Vision-Language Models to Select Trustworthy Super-Resolution Samples Generated by Diffusion Models
Fuente:
arXiv
Saved in:
| Main Authors: | Korkmaz, Cansu, Tekalp, Ahmet Murat, Dogan, Zafer |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Training Generative Image Super-Resolution Models by Wavelet-Domain Losses Enables Better Control of Artifacts
by: Korkmaz, Cansu, et al.
Published: (2024)
by: Korkmaz, Cansu, et al.
Published: (2024)
Trustworthy SR: Resolving Ambiguity in Image Super-resolution via Diffusion Models and Human Feedback
by: Korkmaz, Cansu, et al.
Published: (2024)
by: Korkmaz, Cansu, et al.
Published: (2024)
Image-Difficulty-Aware Evaluation of Super-Resolution Models
by: Topaloglu, Atakan, et al.
Published: (2025)
by: Topaloglu, Atakan, et al.
Published: (2025)
Training Transformer Models by Wavelet Losses Improves Quantitative and Visual Performance in Single Image Super-Resolution
by: Korkmaz, Cansu, et al.
Published: (2024)
by: Korkmaz, Cansu, et al.
Published: (2024)
An Empirical Study of Sampling Hyperparameters in Diffusion-Based Super-Resolution
by: Wibowo, Yudhistira Arief
Published: (2025)
by: Wibowo, Yudhistira Arief
Published: (2025)
DiMoSR: Feature Modulation via Multi-Branch Dilated Convolutions for Efficient Image Super-Resolution
by: Yilmaz, M. Akin, et al.
Published: (2025)
by: Yilmaz, M. Akin, et al.
Published: (2025)
Self-Cascaded Diffusion Models for Arbitrary-Scale Image Super-Resolution
by: Bang, Junseo, et al.
Published: (2025)
by: Bang, Junseo, et al.
Published: (2025)
Trustworthy Large Models in Vision: A Survey
by: Guo, Ziyan, et al.
Published: (2023)
by: Guo, Ziyan, et al.
Published: (2023)
QUSR: Quality-Aware and Uncertainty-Guided Image Super-Resolution Diffusion Model
by: Yin, Junjie, et al.
Published: (2026)
by: Yin, Junjie, et al.
Published: (2026)
The Double-Edged Sword of Data-Driven Super-Resolution: Adversarial Super-Resolution Models
by: Duba-Sullivan, Haley, et al.
Published: (2026)
by: Duba-Sullivan, Haley, et al.
Published: (2026)
Hybrid Training for Vision-Language-Action Models
by: Mazzaglia, Pietro, et al.
Published: (2025)
by: Mazzaglia, Pietro, et al.
Published: (2025)
SuperGaussian: Repurposing Video Models for 3D Super Resolution
by: Shen, Yuan, et al.
Published: (2024)
by: Shen, Yuan, et al.
Published: (2024)
ORL-LDM: Offline Reinforcement Learning Guided Latent Diffusion Model Super-Resolution Reconstruction
by: Lyu, Shijie
Published: (2025)
by: Lyu, Shijie
Published: (2025)
Boosting Flow-based Generative Super-Resolution Models via Learned Prior
by: Tsao, Li-Yuan, et al.
Published: (2024)
by: Tsao, Li-Yuan, et al.
Published: (2024)
Leveraging Vision-Language Models to Detect Attention in Educational Videos
by: Becquet, Gabriel, et al.
Published: (2026)
by: Becquet, Gabriel, et al.
Published: (2026)
Improving Medical Diagnostics with Vision-Language Models: Convex Hull-Based Uncertainty Analysis
by: Catak, Ferhat Ozgur, et al.
Published: (2024)
by: Catak, Ferhat Ozgur, et al.
Published: (2024)
AdaptSR: Low-Rank Adaptation for Efficient and Scalable Real-World Super-Resolution
by: Korkmaz, Cansu, et al.
Published: (2025)
by: Korkmaz, Cansu, et al.
Published: (2025)
Leveraging Vision-Language Models for Visual Grounding and Analysis of Automotive UI
by: Ernhofer, Benjamin Raphael, et al.
Published: (2025)
by: Ernhofer, Benjamin Raphael, et al.
Published: (2025)
Ultra-High-Definition Reference-Based Landmark Image Super-Resolution with Generative Diffusion Prior
by: Shi, Zhenning, et al.
Published: (2025)
by: Shi, Zhenning, et al.
Published: (2025)
Dragonfly: Multi-Resolution Zoom-In Encoding Enhances Vision-Language Models
by: Thapa, Rahul, et al.
Published: (2024)
by: Thapa, Rahul, et al.
Published: (2024)
From Captions to Rewards (CAREVL): Leveraging Large Language Model Experts for Enhanced Reward Modeling in Large Vision-Language Models
by: Dai, Muzhi, et al.
Published: (2025)
by: Dai, Muzhi, et al.
Published: (2025)
Diffusion Prior Interpolation for Flexibility Real-World Face Super-Resolution
by: Yang, Jiarui, et al.
Published: (2024)
by: Yang, Jiarui, et al.
Published: (2024)
Diffusion Models, Image Super-Resolution And Everything: A Survey
by: Moser, Brian B., et al.
Published: (2024)
by: Moser, Brian B., et al.
Published: (2024)
LMLT: Low-to-high Multi-Level Vision Transformer for Image Super-Resolution
by: Kim, Jeongsoo, et al.
Published: (2024)
by: Kim, Jeongsoo, et al.
Published: (2024)
MVL-Loc: Leveraging Vision-Language Model for Generalizable Multi-Scene Camera Relocalization
by: Xiao, Zhendong, et al.
Published: (2025)
by: Xiao, Zhendong, et al.
Published: (2025)
Beyond Cross-Modal Alignment: Measuring and Leveraging Modality Gap in Vision-Language Models
by: Yan, Hanqi, et al.
Published: (2025)
by: Yan, Hanqi, et al.
Published: (2025)
Leveraging Chat-Based Large Vision Language Models for Multimodal Out-Of-Context Detection
by: Shalabi, Fatma, et al.
Published: (2024)
by: Shalabi, Fatma, et al.
Published: (2024)
Vision Language Model-based Caption Evaluation Method Leveraging Visual Context Extraction
by: Maeda, Koki, et al.
Published: (2024)
by: Maeda, Koki, et al.
Published: (2024)
Leveraging Diffusion Perturbations for Measuring Fairness in Computer Vision
by: Lui, Nicholas, et al.
Published: (2023)
by: Lui, Nicholas, et al.
Published: (2023)
One-Step Diffusion for Detail-Rich and Temporally Consistent Video Super-Resolution
by: Sun, Yujing, et al.
Published: (2025)
by: Sun, Yujing, et al.
Published: (2025)
Realism Control One-step Diffusion for Real-World Image Super-Resolution
by: Wu, Zongliang, et al.
Published: (2025)
by: Wu, Zongliang, et al.
Published: (2025)
Exploring Sparsity for Parameter Efficient Fine Tuning Using Wavelets
by: Bilican, Ahmet, et al.
Published: (2025)
by: Bilican, Ahmet, et al.
Published: (2025)
MROVSeg: Breaking the Resolution Curse of Vision-Language Models in Open-Vocabulary Image Segmentation
by: Zhu, Yuanbing, et al.
Published: (2024)
by: Zhu, Yuanbing, et al.
Published: (2024)
Neural Residual Diffusion Models for Deep Scalable Vision Generation
by: Ma, Zhiyuan, et al.
Published: (2024)
by: Ma, Zhiyuan, et al.
Published: (2024)
RASLF: Representation-Aware State Space Model for Light Field Super-Resolution
by: Wei, Zeqiang, et al.
Published: (2026)
by: Wei, Zeqiang, et al.
Published: (2026)
Think or Not? Selective Reasoning via Reinforcement Learning for Vision-Language Models
by: Wang, Jiaqi, et al.
Published: (2025)
by: Wang, Jiaqi, et al.
Published: (2025)
SAUCE: Selective Concept Unlearning in Vision-Language Models with Sparse Autoencoders
by: Li, Qing, et al.
Published: (2025)
by: Li, Qing, et al.
Published: (2025)
Text-to-CT Generation via 3D Latent Diffusion Model with Contrastive Vision-Language Pretraining
by: Molino, Daniele, et al.
Published: (2025)
by: Molino, Daniele, et al.
Published: (2025)
LLaVA-SG: Leveraging Scene Graphs as Visual Semantic Expression in Vision-Language Models
by: Wang, Jingyi, et al.
Published: (2024)
by: Wang, Jingyi, et al.
Published: (2024)
Bootstrapping Diffusion: Diffusion Model Training Leveraging Partial and Corrupted Data
by: Ma, Xudong
Published: (2025)
by: Ma, Xudong
Published: (2025)
Similar Items
-
Training Generative Image Super-Resolution Models by Wavelet-Domain Losses Enables Better Control of Artifacts
by: Korkmaz, Cansu, et al.
Published: (2024) -
Trustworthy SR: Resolving Ambiguity in Image Super-resolution via Diffusion Models and Human Feedback
by: Korkmaz, Cansu, et al.
Published: (2024) -
Image-Difficulty-Aware Evaluation of Super-Resolution Models
by: Topaloglu, Atakan, et al.
Published: (2025) -
Training Transformer Models by Wavelet Losses Improves Quantitative and Visual Performance in Single Image Super-Resolution
by: Korkmaz, Cansu, et al.
Published: (2024) -
An Empirical Study of Sampling Hyperparameters in Diffusion-Based Super-Resolution
by: Wibowo, Yudhistira Arief
Published: (2025)