IPAD: Iterative, Parallel, and Diffusion-based Network for Scene Text Recognition
Fuente:
arXiv
Guardado en:
| Autores principales: | Yang, Xiaomeng, Qiao, Zhi, Zhou, Yu |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Masked and Permuted Implicit Context Learning for Scene Text Recognition
por: Yang, Xiaomeng, et al.
Publicado: (2023)
por: Yang, Xiaomeng, et al.
Publicado: (2023)
Linguistics-aware Masked Image Modeling for Self-supervised Scene Text Recognition
por: Zhang, Yifei, et al.
Publicado: (2025)
por: Zhang, Yifei, et al.
Publicado: (2025)
TextSSR: Diffusion-based Data Synthesis for Scene Text Recognition
por: Ye, Xingsong, et al.
Publicado: (2024)
por: Ye, Xingsong, et al.
Publicado: (2024)
TextCtrl: Diffusion-based Scene Text Editing with Prior Guidance Control
por: Zeng, Weichao, et al.
Publicado: (2024)
por: Zeng, Weichao, et al.
Publicado: (2024)
IPAD: Industrial Process Anomaly Detection Dataset
por: Liu, Jinfan, et al.
Publicado: (2024)
por: Liu, Jinfan, et al.
Publicado: (2024)
MDiff4STR: Mask Diffusion Model for Scene Text Recognition
por: Du, Yongkun, et al.
Publicado: (2025)
por: Du, Yongkun, et al.
Publicado: (2025)
Instruction-Guided Scene Text Recognition
por: Du, Yongkun, et al.
Publicado: (2024)
por: Du, Yongkun, et al.
Publicado: (2024)
Recognition-Synergistic Scene Text Editing
por: Fang, Zhengyao, et al.
Publicado: (2025)
por: Fang, Zhengyao, et al.
Publicado: (2025)
TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition
por: Yang, Xiahan, et al.
Publicado: (2025)
por: Yang, Xiahan, et al.
Publicado: (2025)
Decoder Pre-Training with only Text for Scene Text Recognition
por: Zhao, Shuai, et al.
Publicado: (2024)
por: Zhao, Shuai, et al.
Publicado: (2024)
Masked Next-Scale Prediction for Self-supervised Scene Text Recognition
por: Chen, Zhuohao, et al.
Publicado: (2026)
por: Chen, Zhuohao, et al.
Publicado: (2026)
CMFN: Cross-Modal Fusion Network for Irregular Scene Text Recognition
por: Zheng, Jinzhi, et al.
Publicado: (2024)
por: Zheng, Jinzhi, et al.
Publicado: (2024)
SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation
por: Chai, Shang, et al.
Publicado: (2025)
por: Chai, Shang, et al.
Publicado: (2025)
IPAD-CLIP: Teaching CLIP to Detect Image Local Perceptual Artifacts
por: Wang, Juan, et al.
Publicado: (2026)
por: Wang, Juan, et al.
Publicado: (2026)
One Model for Two Tasks: Cooperatively Recognizing and Recovering Low-Resolution Scene Text Images by Iterative Mutual Guidance
por: Zhao, Minyi, et al.
Publicado: (2024)
por: Zhao, Minyi, et al.
Publicado: (2024)
SVIPTR: Fast and Efficient Scene Text Recognition with Vision Permutable Extractor
por: Cheng, Xianfu, et al.
Publicado: (2024)
por: Cheng, Xianfu, et al.
Publicado: (2024)
Class-Aware Mask-Guided Feature Refinement for Scene Text Recognition
por: Yang, Mingkun, et al.
Publicado: (2024)
por: Yang, Mingkun, et al.
Publicado: (2024)
Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing
por: Qu, Yadong, et al.
Publicado: (2024)
por: Qu, Yadong, et al.
Publicado: (2024)
Focus on the Whole Character: Discriminative Character Modeling for Scene Text Recognition
por: Zhou, Bangbang, et al.
Publicado: (2024)
por: Zhou, Bangbang, et al.
Publicado: (2024)
Unveiling Structural Memorization: Structural Membership Inference Attack for Text-to-Image Diffusion Models
por: Li, Qiao, et al.
Publicado: (2024)
por: Li, Qiao, et al.
Publicado: (2024)
Dual-IPO: Dual-Iterative Preference Optimization for Text-to-Video Generation
por: Yang, Xiaomeng, et al.
Publicado: (2025)
por: Yang, Xiaomeng, et al.
Publicado: (2025)
TextDiff: Mask-Guided Residual Diffusion Models for Scene Text Image Super-Resolution
por: Liu, Baolin, et al.
Publicado: (2023)
por: Liu, Baolin, et al.
Publicado: (2023)
Reading in the Dark: Low-light Scene Text Recognition
por: Fu, Xuanshuo, et al.
Publicado: (2026)
por: Fu, Xuanshuo, et al.
Publicado: (2026)
Efficient and Accurate Scene Text Recognition with Cascaded-Transformers
por: Ozkan, Savas, et al.
Publicado: (2025)
por: Ozkan, Savas, et al.
Publicado: (2025)
SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition
por: Du, Yongkun, et al.
Publicado: (2024)
por: Du, Yongkun, et al.
Publicado: (2024)
On Manipulating Scene Text in the Wild with Diffusion Models
por: Santoso, Joshua, et al.
Publicado: (2023)
por: Santoso, Joshua, et al.
Publicado: (2023)
Layout Agnostic Scene Text Image Synthesis with Diffusion Models
por: Zhangli, Qilong, et al.
Publicado: (2024)
por: Zhangli, Qilong, et al.
Publicado: (2024)
StyleTextGen: Style-Conditioned Multilingual Scene Text Generation
por: Chen, Zeyu, et al.
Publicado: (2026)
por: Chen, Zeyu, et al.
Publicado: (2026)
Generating Human Motion in 3D Scenes from Text Descriptions
por: Cen, Zhi, et al.
Publicado: (2024)
por: Cen, Zhi, et al.
Publicado: (2024)
The First Swahili Language Scene Text Detection and Recognition Dataset
por: Douamba, Fadila Wendigoundi, et al.
Publicado: (2024)
por: Douamba, Fadila Wendigoundi, et al.
Publicado: (2024)
Arbitrary Reading Order Scene Text Spotter with Local Semantics Guidance
por: Lyu, Jiahao, et al.
Publicado: (2024)
por: Lyu, Jiahao, et al.
Publicado: (2024)
TextFlux: An OCR-Free DiT Model for High-Fidelity Multilingual Scene Text Synthesis
por: Xie, Yu, et al.
Publicado: (2025)
por: Xie, Yu, et al.
Publicado: (2025)
Aggregated Text Transformer for Scene Text Detection
por: Zhou, Zhao, et al.
Publicado: (2022)
por: Zhou, Zhao, et al.
Publicado: (2022)
IndicSTR12: A Dataset for Indic Scene Text Recognition
por: Lunia, Harsh, et al.
Publicado: (2024)
por: Lunia, Harsh, et al.
Publicado: (2024)
Relational Contrastive Learning and Masked Image Modeling for Scene Text Recognition
por: Lin, Tiancheng, et al.
Publicado: (2024)
por: Lin, Tiancheng, et al.
Publicado: (2024)
FastScene: Text-Driven Fast 3D Indoor Scene Generation via Panoramic Gaussian Splatting
por: Ma, Yikun, et al.
Publicado: (2024)
por: Ma, Yikun, et al.
Publicado: (2024)
TextSculptor: Training and Benchmarking Scene Text Editing
por: Lin, Yiheng, et al.
Publicado: (2026)
por: Lin, Yiheng, et al.
Publicado: (2026)
A Parallel Attention Network for Cattle Face Recognition
por: Li, Jiayu, et al.
Publicado: (2024)
por: Li, Jiayu, et al.
Publicado: (2024)
FITA: Fine-grained Image-Text Aligner for Radiology Report Generation
por: Yang, Honglong, et al.
Publicado: (2024)
por: Yang, Honglong, et al.
Publicado: (2024)
LRANet: Towards Accurate and Efficient Scene Text Detection with Low-Rank Approximation Network
por: Su, Yuchen, et al.
Publicado: (2023)
por: Su, Yuchen, et al.
Publicado: (2023)
Ejemplares similares
-
Masked and Permuted Implicit Context Learning for Scene Text Recognition
por: Yang, Xiaomeng, et al.
Publicado: (2023) -
Linguistics-aware Masked Image Modeling for Self-supervised Scene Text Recognition
por: Zhang, Yifei, et al.
Publicado: (2025) -
TextSSR: Diffusion-based Data Synthesis for Scene Text Recognition
por: Ye, Xingsong, et al.
Publicado: (2024) -
TextCtrl: Diffusion-based Scene Text Editing with Prior Guidance Control
por: Zeng, Weichao, et al.
Publicado: (2024) -
IPAD: Industrial Process Anomaly Detection Dataset
por: Liu, Jinfan, et al.
Publicado: (2024)