Detail++: Training-Free Detail Enhancer for Text-to-Image Diffusion Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Chen, Lifeng, Wang, Jiner, Pan, Zihao, Zhu, Beier, Yang, Xiaofeng, Zhang, Chi |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Mind the Generative Details: Direct Localized Detail Preference Optimization for Video Diffusion Models
par: Huang, Zitong, et autres
Publié: (2026)
par: Huang, Zitong, et autres
Publié: (2026)
DPDEdit: Detail-Preserved Diffusion Models for Multimodal Fashion Image Editing
par: Wang, Xiaolong, et autres
Publié: (2024)
par: Wang, Xiaolong, et autres
Publié: (2024)
Restoring Real-World Images with an Internal Detail Enhancement Diffusion Model
par: Xiao, Peng, et autres
Publié: (2025)
par: Xiao, Peng, et autres
Publié: (2025)
DetailMaster: Can Your Text-to-Image Model Handle Long Prompts?
par: Jiao, Qirui, et autres
Publié: (2025)
par: Jiao, Qirui, et autres
Publié: (2025)
Progressive Prompt Detailing for Improved Alignment in Text-to-Image Generative Models
par: Saichandran, Ketan Suhaas, et autres
Publié: (2025)
par: Saichandran, Ketan Suhaas, et autres
Publié: (2025)
DP-MDM: Detail-Preserving MR Reconstruction via Multiple Diffusion Models
par: Geng, Mengxiao, et autres
Publié: (2024)
par: Geng, Mengxiao, et autres
Publié: (2024)
From Structure to Detail: Hierarchical Distillation for Efficient Diffusion Model
par: Cheng, Hanbo, et autres
Publié: (2025)
par: Cheng, Hanbo, et autres
Publié: (2025)
DetailFusion: A Dual-branch Framework with Detail Enhancement for Composed Image Retrieval
par: Yang, Yuxin, et autres
Publié: (2025)
par: Yang, Yuxin, et autres
Publié: (2025)
CorrDetail: Visual Detail Enhanced Self-Correction for Face Forgery Detection
par: Zhou, Binjia, et autres
Publié: (2025)
par: Zhou, Binjia, et autres
Publié: (2025)
Efficient Diffusion as Low Light Enhancer
par: Lan, Guanzhou, et autres
Publié: (2024)
par: Lan, Guanzhou, et autres
Publié: (2024)
Diffusion for World Modeling: Visual Details Matter in Atari
par: Alonso, Eloi, et autres
Publié: (2024)
par: Alonso, Eloi, et autres
Publié: (2024)
ReflectCAP: Detailed Image Captioning with Reflective Memory
par: Min, Kyungmin, et autres
Publié: (2026)
par: Min, Kyungmin, et autres
Publié: (2026)
Describe Anything: Detailed Localized Image and Video Captioning
par: Lian, Long, et autres
Publié: (2025)
par: Lian, Long, et autres
Publié: (2025)
Generating Accurate and Detailed Captions for High-Resolution Images
par: Lee, Hankyeol, et autres
Publié: (2025)
par: Lee, Hankyeol, et autres
Publié: (2025)
One-Step Diffusion for Detail-Rich and Temporally Consistent Video Super-Resolution
par: Sun, Yujing, et autres
Publié: (2025)
par: Sun, Yujing, et autres
Publié: (2025)
Training-Free Watermarking for Autoregressive Image Generation
par: Tong, Yu, et autres
Publié: (2025)
par: Tong, Yu, et autres
Publié: (2025)
Diffusion-guided Generalizable Enhancer for Urban Scene Reconstruction
par: Che, Henry, et autres
Publié: (2026)
par: Che, Henry, et autres
Publié: (2026)
GLoD: Composing Global Contexts and Local Details in Image Generation
par: Yamada, Moyuru
Publié: (2024)
par: Yamada, Moyuru
Publié: (2024)
Generate Point Clouds with Multiscale Details from Graph-Represented Structures
par: Yang, Ximing, et autres
Publié: (2021)
par: Yang, Ximing, et autres
Publié: (2021)
Do More Details Always Introduce More Hallucinations in LVLM-based Image Captioning?
par: Feng, Mingqian, et autres
Publié: (2024)
par: Feng, Mingqian, et autres
Publié: (2024)
DS$^2$Net: Detail-Semantic Deep Supervision Network for Medical Image Segmentation
par: Huang, Zhaohong, et autres
Publié: (2025)
par: Huang, Zhaohong, et autres
Publié: (2025)
Training-Free Text-Guided Image Editing with Visual Autoregressive Model
par: Wang, Yufei, et autres
Publié: (2025)
par: Wang, Yufei, et autres
Publié: (2025)
SynPO: Synergizing Descriptiveness and Preference Optimization for Video Detailed Captioning
par: Dang, Jisheng, et autres
Publié: (2025)
par: Dang, Jisheng, et autres
Publié: (2025)
FAIRT2V: Training-Free Debiasing for Text-to-Video Diffusion Models
par: Zhong, Haonan, et autres
Publié: (2026)
par: Zhong, Haonan, et autres
Publié: (2026)
Beyond Wide-Angle Images: Structure-to-Detail Video Portrait Correction via Unsupervised Spatiotemporal Adaptation
par: Nie, Wenbo, et autres
Publié: (2025)
par: Nie, Wenbo, et autres
Publié: (2025)
Image Tiling for High-Resolution Reasoning: Balancing Local Detail with Global Context
par: de Margerie, Anatole Jacquin, et autres
Publié: (2025)
par: de Margerie, Anatole Jacquin, et autres
Publié: (2025)
good4cir: Generating Detailed Synthetic Captions for Composed Image Retrieval
par: Kolouju, Pranavi, et autres
Publié: (2025)
par: Kolouju, Pranavi, et autres
Publié: (2025)
Global Context or Local Detail? Adaptive Visual Grounding for Hallucination Mitigation
par: Jiang, Yubo, et autres
Publié: (2026)
par: Jiang, Yubo, et autres
Publié: (2026)
Free Lunch Alignment of Text-to-Image Diffusion Models without Preference Image Pairs
par: Xian, Jia Jun Cheng, et autres
Publié: (2025)
par: Xian, Jia Jun Cheng, et autres
Publié: (2025)
StereoDiffusion: Training-Free Stereo Image Generation Using Latent Diffusion Models
par: Wang, Lezhong, et autres
Publié: (2024)
par: Wang, Lezhong, et autres
Publié: (2024)
Localized Concept Erasure for Text-to-Image Diffusion Models Using Training-Free Gated Low-Rank Adaptation
par: Lee, Byung Hyun, et autres
Publié: (2025)
par: Lee, Byung Hyun, et autres
Publié: (2025)
Token Merging for Training-Free Semantic Binding in Text-to-Image Synthesis
par: Hu, Taihang, et autres
Publié: (2024)
par: Hu, Taihang, et autres
Publié: (2024)
Elucidating and Endowing the Diffusion Training Paradigm for General Image Restoration
par: Lu, Xin, et autres
Publié: (2025)
par: Lu, Xin, et autres
Publié: (2025)
GenDR: Lighten Generative Detail Restoration
par: Wang, Yan, et autres
Publié: (2025)
par: Wang, Yan, et autres
Publié: (2025)
Tarsier2: Advancing Large Vision-Language Models from Detailed Video Description to Comprehensive Video Understanding
par: Yuan, Liping, et autres
Publié: (2025)
par: Yuan, Liping, et autres
Publié: (2025)
Multi-Knowledge-oriented Nighttime Haze Imaging Enhancer for Vision-driven Intelligent Systems
par: Chen, Ai, et autres
Publié: (2025)
par: Chen, Ai, et autres
Publié: (2025)
Coupled Diffusion Sampling for Training-Free Multi-View Image Editing
par: Alzayer, Hadi, et autres
Publié: (2025)
par: Alzayer, Hadi, et autres
Publié: (2025)
Finer-CAM: Spotting the Difference Reveals Finer Details for Visual Explanation
par: Zhang, Ziheng, et autres
Publié: (2025)
par: Zhang, Ziheng, et autres
Publié: (2025)
LACON: Training Text-to-Image Model from Uncurated Data
par: Liang, Zhiyang, et autres
Publié: (2026)
par: Liang, Zhiyang, et autres
Publié: (2026)
Training-Free Text-Guided Color Editing with Multi-Modal Diffusion Transformer
par: Yin, Zixin, et autres
Publié: (2025)
par: Yin, Zixin, et autres
Publié: (2025)
Documents similaires
-
Mind the Generative Details: Direct Localized Detail Preference Optimization for Video Diffusion Models
par: Huang, Zitong, et autres
Publié: (2026) -
DPDEdit: Detail-Preserved Diffusion Models for Multimodal Fashion Image Editing
par: Wang, Xiaolong, et autres
Publié: (2024) -
Restoring Real-World Images with an Internal Detail Enhancement Diffusion Model
par: Xiao, Peng, et autres
Publié: (2025) -
DetailMaster: Can Your Text-to-Image Model Handle Long Prompts?
par: Jiao, Qirui, et autres
Publié: (2025) -
Progressive Prompt Detailing for Improved Alignment in Text-to-Image Generative Models
par: Saichandran, Ketan Suhaas, et autres
Publié: (2025)