IPAD: Iterative, Parallel, and Diffusion-based Network for Scene Text Recognition
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yang, Xiaomeng, Qiao, Zhi, Zhou, Yu |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Masked and Permuted Implicit Context Learning for Scene Text Recognition
par: Yang, Xiaomeng, et autres
Publié: (2023)
par: Yang, Xiaomeng, et autres
Publié: (2023)
Linguistics-aware Masked Image Modeling for Self-supervised Scene Text Recognition
par: Zhang, Yifei, et autres
Publié: (2025)
par: Zhang, Yifei, et autres
Publié: (2025)
TextSSR: Diffusion-based Data Synthesis for Scene Text Recognition
par: Ye, Xingsong, et autres
Publié: (2024)
par: Ye, Xingsong, et autres
Publié: (2024)
TextCtrl: Diffusion-based Scene Text Editing with Prior Guidance Control
par: Zeng, Weichao, et autres
Publié: (2024)
par: Zeng, Weichao, et autres
Publié: (2024)
IPAD: Industrial Process Anomaly Detection Dataset
par: Liu, Jinfan, et autres
Publié: (2024)
par: Liu, Jinfan, et autres
Publié: (2024)
MDiff4STR: Mask Diffusion Model for Scene Text Recognition
par: Du, Yongkun, et autres
Publié: (2025)
par: Du, Yongkun, et autres
Publié: (2025)
Instruction-Guided Scene Text Recognition
par: Du, Yongkun, et autres
Publié: (2024)
par: Du, Yongkun, et autres
Publié: (2024)
Recognition-Synergistic Scene Text Editing
par: Fang, Zhengyao, et autres
Publié: (2025)
par: Fang, Zhengyao, et autres
Publié: (2025)
TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition
par: Yang, Xiahan, et autres
Publié: (2025)
par: Yang, Xiahan, et autres
Publié: (2025)
Decoder Pre-Training with only Text for Scene Text Recognition
par: Zhao, Shuai, et autres
Publié: (2024)
par: Zhao, Shuai, et autres
Publié: (2024)
Masked Next-Scale Prediction for Self-supervised Scene Text Recognition
par: Chen, Zhuohao, et autres
Publié: (2026)
par: Chen, Zhuohao, et autres
Publié: (2026)
CMFN: Cross-Modal Fusion Network for Irregular Scene Text Recognition
par: Zheng, Jinzhi, et autres
Publié: (2024)
par: Zheng, Jinzhi, et autres
Publié: (2024)
SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation
par: Chai, Shang, et autres
Publié: (2025)
par: Chai, Shang, et autres
Publié: (2025)
IPAD-CLIP: Teaching CLIP to Detect Image Local Perceptual Artifacts
par: Wang, Juan, et autres
Publié: (2026)
par: Wang, Juan, et autres
Publié: (2026)
One Model for Two Tasks: Cooperatively Recognizing and Recovering Low-Resolution Scene Text Images by Iterative Mutual Guidance
par: Zhao, Minyi, et autres
Publié: (2024)
par: Zhao, Minyi, et autres
Publié: (2024)
SVIPTR: Fast and Efficient Scene Text Recognition with Vision Permutable Extractor
par: Cheng, Xianfu, et autres
Publié: (2024)
par: Cheng, Xianfu, et autres
Publié: (2024)
Class-Aware Mask-Guided Feature Refinement for Scene Text Recognition
par: Yang, Mingkun, et autres
Publié: (2024)
par: Yang, Mingkun, et autres
Publié: (2024)
Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing
par: Qu, Yadong, et autres
Publié: (2024)
par: Qu, Yadong, et autres
Publié: (2024)
Focus on the Whole Character: Discriminative Character Modeling for Scene Text Recognition
par: Zhou, Bangbang, et autres
Publié: (2024)
par: Zhou, Bangbang, et autres
Publié: (2024)
Unveiling Structural Memorization: Structural Membership Inference Attack for Text-to-Image Diffusion Models
par: Li, Qiao, et autres
Publié: (2024)
par: Li, Qiao, et autres
Publié: (2024)
Dual-IPO: Dual-Iterative Preference Optimization for Text-to-Video Generation
par: Yang, Xiaomeng, et autres
Publié: (2025)
par: Yang, Xiaomeng, et autres
Publié: (2025)
TextDiff: Mask-Guided Residual Diffusion Models for Scene Text Image Super-Resolution
par: Liu, Baolin, et autres
Publié: (2023)
par: Liu, Baolin, et autres
Publié: (2023)
Reading in the Dark: Low-light Scene Text Recognition
par: Fu, Xuanshuo, et autres
Publié: (2026)
par: Fu, Xuanshuo, et autres
Publié: (2026)
Efficient and Accurate Scene Text Recognition with Cascaded-Transformers
par: Ozkan, Savas, et autres
Publié: (2025)
par: Ozkan, Savas, et autres
Publié: (2025)
SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition
par: Du, Yongkun, et autres
Publié: (2024)
par: Du, Yongkun, et autres
Publié: (2024)
On Manipulating Scene Text in the Wild with Diffusion Models
par: Santoso, Joshua, et autres
Publié: (2023)
par: Santoso, Joshua, et autres
Publié: (2023)
Layout Agnostic Scene Text Image Synthesis with Diffusion Models
par: Zhangli, Qilong, et autres
Publié: (2024)
par: Zhangli, Qilong, et autres
Publié: (2024)
StyleTextGen: Style-Conditioned Multilingual Scene Text Generation
par: Chen, Zeyu, et autres
Publié: (2026)
par: Chen, Zeyu, et autres
Publié: (2026)
Generating Human Motion in 3D Scenes from Text Descriptions
par: Cen, Zhi, et autres
Publié: (2024)
par: Cen, Zhi, et autres
Publié: (2024)
The First Swahili Language Scene Text Detection and Recognition Dataset
par: Douamba, Fadila Wendigoundi, et autres
Publié: (2024)
par: Douamba, Fadila Wendigoundi, et autres
Publié: (2024)
Arbitrary Reading Order Scene Text Spotter with Local Semantics Guidance
par: Lyu, Jiahao, et autres
Publié: (2024)
par: Lyu, Jiahao, et autres
Publié: (2024)
TextFlux: An OCR-Free DiT Model for High-Fidelity Multilingual Scene Text Synthesis
par: Xie, Yu, et autres
Publié: (2025)
par: Xie, Yu, et autres
Publié: (2025)
Aggregated Text Transformer for Scene Text Detection
par: Zhou, Zhao, et autres
Publié: (2022)
par: Zhou, Zhao, et autres
Publié: (2022)
IndicSTR12: A Dataset for Indic Scene Text Recognition
par: Lunia, Harsh, et autres
Publié: (2024)
par: Lunia, Harsh, et autres
Publié: (2024)
Relational Contrastive Learning and Masked Image Modeling for Scene Text Recognition
par: Lin, Tiancheng, et autres
Publié: (2024)
par: Lin, Tiancheng, et autres
Publié: (2024)
FastScene: Text-Driven Fast 3D Indoor Scene Generation via Panoramic Gaussian Splatting
par: Ma, Yikun, et autres
Publié: (2024)
par: Ma, Yikun, et autres
Publié: (2024)
TextSculptor: Training and Benchmarking Scene Text Editing
par: Lin, Yiheng, et autres
Publié: (2026)
par: Lin, Yiheng, et autres
Publié: (2026)
A Parallel Attention Network for Cattle Face Recognition
par: Li, Jiayu, et autres
Publié: (2024)
par: Li, Jiayu, et autres
Publié: (2024)
FITA: Fine-grained Image-Text Aligner for Radiology Report Generation
par: Yang, Honglong, et autres
Publié: (2024)
par: Yang, Honglong, et autres
Publié: (2024)
LRANet: Towards Accurate and Efficient Scene Text Detection with Low-Rank Approximation Network
par: Su, Yuchen, et autres
Publié: (2023)
par: Su, Yuchen, et autres
Publié: (2023)
Documents similaires
-
Masked and Permuted Implicit Context Learning for Scene Text Recognition
par: Yang, Xiaomeng, et autres
Publié: (2023) -
Linguistics-aware Masked Image Modeling for Self-supervised Scene Text Recognition
par: Zhang, Yifei, et autres
Publié: (2025) -
TextSSR: Diffusion-based Data Synthesis for Scene Text Recognition
par: Ye, Xingsong, et autres
Publié: (2024) -
TextCtrl: Diffusion-based Scene Text Editing with Prior Guidance Control
par: Zeng, Weichao, et autres
Publié: (2024) -
IPAD: Industrial Process Anomaly Detection Dataset
par: Liu, Jinfan, et autres
Publié: (2024)