Restore Text First, Enhance Image Later: Two-Stage Scene Text Image Super-Resolution with Glyph Structure Guidance
Fuente:
arXiv
Saved in:
| Main Authors: | Luo, Minxing, Fan, Linlong, Qiushi, Wang, Wu, Ge, Luo, Yiyan, Yu, Yuhang, Chen, Jinwei, Wang, Yaxing, Fan, Qingnan, Yang, Jian |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Text-Aware Real-World Image Super-Resolution via Diffusion Model with Joint Segmentation Decoders
by: Hu, Qiming, et al.
Published: (2025)
by: Hu, Qiming, et al.
Published: (2025)
TinySR: Pruning Diffusion for Real-World Image Super-Resolution
by: Dong, Linwei, et al.
Published: (2025)
by: Dong, Linwei, et al.
Published: (2025)
RAP-SR: RestorAtion Prior Enhancement in Diffusion Models for Realistic Image Super-Resolution
by: Wang, Jiangang, et al.
Published: (2024)
by: Wang, Jiangang, et al.
Published: (2024)
Beyond Flat Text: Dual Self-inherited Guidance for Visual Text Generation
by: Luo, Minxing, et al.
Published: (2025)
by: Luo, Minxing, et al.
Published: (2025)
TSD-SR: One-Step Diffusion with Target Score Distillation for Real-World Image Super-Resolution
by: Dong, Linwei, et al.
Published: (2024)
by: Dong, Linwei, et al.
Published: (2024)
Hero-SR: One-Step Diffusion for Super-Resolution with Human Perception Priors
by: Wang, Jiangang, et al.
Published: (2024)
by: Wang, Jiangang, et al.
Published: (2024)
Ultra-High-Definition Reference-Based Landmark Image Super-Resolution with Generative Diffusion Prior
by: Shi, Zhenning, et al.
Published: (2025)
by: Shi, Zhenning, et al.
Published: (2025)
GlyphMastero: A Glyph Encoder for High-Fidelity Scene Text Editing
by: Wang, Tong, et al.
Published: (2025)
by: Wang, Tong, et al.
Published: (2025)
Refining Text-to-Image Generation: Towards Accurate Training-Free Glyph-Enhanced Image Generation
by: Lakhanpal, Sanyam, et al.
Published: (2024)
by: Lakhanpal, Sanyam, et al.
Published: (2024)
TextDiff: Mask-Guided Residual Diffusion Models for Scene Text Image Super-Resolution
by: Liu, Baolin, et al.
Published: (2023)
by: Liu, Baolin, et al.
Published: (2023)
Uncovering the Text Embedding in Text-to-Image Diffusion Models
by: Yu, Hu, et al.
Published: (2024)
by: Yu, Hu, et al.
Published: (2024)
One Model for Two Tasks: Cooperatively Recognizing and Recovering Low-Resolution Scene Text Images by Iterative Mutual Guidance
by: Zhao, Minyi, et al.
Published: (2024)
by: Zhao, Minyi, et al.
Published: (2024)
NCAP: Scene Text Image Super-Resolution with Non-CAtegorical Prior
by: Park, Dongwoo, et al.
Published: (2025)
by: Park, Dongwoo, et al.
Published: (2025)
SG-Adapter: Enhancing Text-to-Image Generation with Scene Graph Guidance
by: Shen, Guibao, et al.
Published: (2024)
by: Shen, Guibao, et al.
Published: (2024)
Diffusion-based Blind Text Image Super-Resolution
by: Zhang, Yuzhe, et al.
Published: (2023)
by: Zhang, Yuzhe, et al.
Published: (2023)
NTIRE 2025 Challenge on RAW Image Restoration and Super-Resolution
by: Conde, Marcos V., et al.
Published: (2025)
by: Conde, Marcos V., et al.
Published: (2025)
Text Data-Centric Image Captioning with Interactive Prompts
by: Wang, Yiyu, et al.
Published: (2024)
by: Wang, Yiyu, et al.
Published: (2024)
RotationDrag: Point-based Image Editing with Rotated Diffusion Features
by: Luo, Minxing, et al.
Published: (2024)
by: Luo, Minxing, et al.
Published: (2024)
Image Super-Resolution with Text Prompt Diffusion
by: Chen, Zheng, et al.
Published: (2023)
by: Chen, Zheng, et al.
Published: (2023)
DualTSR: Unified Dual-Diffusion Transformer for Scene Text Image Super-Resolution
by: Niu, Axi, et al.
Published: (2026)
by: Niu, Axi, et al.
Published: (2026)
AuthFace: Towards Authentic Blind Face Restoration with Face-oriented Generative Diffusion Prior
by: Liang, Guoqiang, et al.
Published: (2024)
by: Liang, Guoqiang, et al.
Published: (2024)
Setting the Stage: Text-Driven Scene-Consistent Image Generation
by: Xie, Cong, et al.
Published: (2025)
by: Xie, Cong, et al.
Published: (2025)
Glyph-ByT5: A Customized Text Encoder for Accurate Visual Text Rendering
by: Liu, Zeyu, et al.
Published: (2024)
by: Liu, Zeyu, et al.
Published: (2024)
TextMaster: A Unified Framework for Realistic Text Editing via Glyph-Style Dual-Control
by: Yan, Zhenyu, et al.
Published: (2024)
by: Yan, Zhenyu, et al.
Published: (2024)
LiveMoments: Reselected Key Photo Restoration in Live Photos via Reference-guided Diffusion
by: Xue, Clara, et al.
Published: (2026)
by: Xue, Clara, et al.
Published: (2026)
Adaptive Context Matters: Towards Provable Multi-Modality Guidance for Super-Resolution
by: Luo, Jinyi, et al.
Published: (2026)
by: Luo, Jinyi, et al.
Published: (2026)
TextSR: Diffusion Super-Resolution with Multilingual OCR Guidance
by: Ye, Keren, et al.
Published: (2025)
by: Ye, Keren, et al.
Published: (2025)
Conditional Text-to-Image Generation with Reference Guidance
by: Kim, Taewook, et al.
Published: (2024)
by: Kim, Taewook, et al.
Published: (2024)
PEAN: A Diffusion-Based Prior-Enhanced Attention Network for Scene Text Image Super-Resolution
by: Zhao, Zuoyan, et al.
Published: (2023)
by: Zhao, Zuoyan, et al.
Published: (2023)
SDT-DCSCN for Simultaneous Super-Resolution and Deblurring of Text Images
by: Neji, Hala, et al.
Published: (2022)
by: Neji, Hala, et al.
Published: (2022)
Hierarchical Similarity Learning for Aliasing Suppression Image Super-Resolution
by: Liu, Yuqing, et al.
Published: (2022)
by: Liu, Yuqing, et al.
Published: (2022)
GLDesigner: Leveraging Multi-Modal LLMs as Designer for Enhanced Aesthetic Text Glyph Layouts
by: He, Junwen, et al.
Published: (2024)
by: He, Junwen, et al.
Published: (2024)
Tuning-Free Image Customization with Image and Text Guidance
by: Li, Pengzhi, et al.
Published: (2024)
by: Li, Pengzhi, et al.
Published: (2024)
Enhanced Semantic Extraction and Guidance for UGC Image Super Resolution
by: Wang, Yiwen, et al.
Published: (2025)
by: Wang, Yiwen, et al.
Published: (2025)
CoMPaSS: Enhancing Spatial Understanding in Text-to-Image Diffusion Models
by: Zhang, Gaoyang, et al.
Published: (2024)
by: Zhang, Gaoyang, et al.
Published: (2024)
DEMO: A Statistical Perspective for Efficient Image-Text Matching
by: Zhang, Fan, et al.
Published: (2024)
by: Zhang, Fan, et al.
Published: (2024)
Instance Data Condensation for Image Super-Resolution
by: Peng, Tianhao, et al.
Published: (2025)
by: Peng, Tianhao, et al.
Published: (2025)
VICR: Visual In-Context Restoration for Real-World Image Super-Resolution
by: Zhang, Qichang, et al.
Published: (2026)
by: Zhang, Qichang, et al.
Published: (2026)
Learning the Degradation Distribution for Blind Image Super-Resolution
by: Luo, Zhengxiong, et al.
Published: (2022)
by: Luo, Zhengxiong, et al.
Published: (2022)
Iterative Network for Image Super-Resolution
by: Liu, Yuqing, et al.
Published: (2020)
by: Liu, Yuqing, et al.
Published: (2020)
Similar Items
-
Text-Aware Real-World Image Super-Resolution via Diffusion Model with Joint Segmentation Decoders
by: Hu, Qiming, et al.
Published: (2025) -
TinySR: Pruning Diffusion for Real-World Image Super-Resolution
by: Dong, Linwei, et al.
Published: (2025) -
RAP-SR: RestorAtion Prior Enhancement in Diffusion Models for Realistic Image Super-Resolution
by: Wang, Jiangang, et al.
Published: (2024) -
Beyond Flat Text: Dual Self-inherited Guidance for Visual Text Generation
by: Luo, Minxing, et al.
Published: (2025) -
TSD-SR: One-Step Diffusion with Target Score Distillation for Real-World Image Super-Resolution
by: Dong, Linwei, et al.
Published: (2024)