Focus on the Whole Character: Discriminative Character Modeling for Scene Text Recognition
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhou, Bangbang, Qu, Yadong, Wang, Zixiao, Li, Zicheng, Zhang, Boqiang, Xie, Hongtao |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing
di: Qu, Yadong, et al.
Pubblicazione: (2024)
di: Qu, Yadong, et al.
Pubblicazione: (2024)
Self-Supervised Pre-training with Symmetric Superimposition Modeling for Scene Text Recognition
di: Gao, Zuan, et al.
Pubblicazione: (2024)
di: Gao, Zuan, et al.
Pubblicazione: (2024)
How Control Information Influences Multilingual Text Image Generation and Editing?
di: Zhang, Boqiang, et al.
Pubblicazione: (2024)
di: Zhang, Boqiang, et al.
Pubblicazione: (2024)
Leveraging Text Localization for Scene Text Removal via Text-aware Masked Image Modeling
di: Wang, Zixiao, et al.
Pubblicazione: (2024)
di: Wang, Zixiao, et al.
Pubblicazione: (2024)
Choose What You Need: Disentangled Representation Learning for Scene Text Recognition, Removal and Editing
di: Zhang, Boqiang, et al.
Pubblicazione: (2024)
di: Zhang, Boqiang, et al.
Pubblicazione: (2024)
Autonomous Character-Scene Interaction Synthesis from Text Instruction
di: Jiang, Nan, et al.
Pubblicazione: (2024)
di: Jiang, Nan, et al.
Pubblicazione: (2024)
Char-SAM: Turning Segment Anything Model into Scene Text Segmentation Annotator with Character-level Visual Prompts
di: Xie, Enze, et al.
Pubblicazione: (2024)
di: Xie, Enze, et al.
Pubblicazione: (2024)
Multi-Modal Character Localization and Extraction for Chinese Text Recognition
di: Li, Qilong, et al.
Pubblicazione: (2026)
di: Li, Qilong, et al.
Pubblicazione: (2026)
Focus on Neighbors and Know the Whole: Towards Consistent Dense Multiview Text-to-Image Generator for 3D Creation
di: Li, Bonan, et al.
Pubblicazione: (2024)
di: Li, Bonan, et al.
Pubblicazione: (2024)
CharacterFactory: Sampling Consistent Characters with GANs for Diffusion Models
di: Wang, Qinghe, et al.
Pubblicazione: (2024)
di: Wang, Qinghe, et al.
Pubblicazione: (2024)
Seeing is Improving: Visual Feedback for Iterative Text Layout Refinement
di: Guo, Junrong, et al.
Pubblicazione: (2026)
di: Guo, Junrong, et al.
Pubblicazione: (2026)
Image Over Text: Transforming Formula Recognition Evaluation with Character Detection Matching
di: Wang, Bin, et al.
Pubblicazione: (2024)
di: Wang, Bin, et al.
Pubblicazione: (2024)
Zero-Shot Chinese Character Recognition with Hierarchical Multi-Granularity Image-Text Aligning
di: Zhu, Yinglian, et al.
Pubblicazione: (2025)
di: Zhu, Yinglian, et al.
Pubblicazione: (2025)
SVTRv2: CTC Beats Encoder-Decoder Models in Scene Text Recognition
di: Du, Yongkun, et al.
Pubblicazione: (2024)
di: Du, Yongkun, et al.
Pubblicazione: (2024)
InstantCharacter: Personalize Any Characters with a Scalable Diffusion Transformer Framework
di: Tao, Jiale, et al.
Pubblicazione: (2025)
di: Tao, Jiale, et al.
Pubblicazione: (2025)
FocusedAD: Character-centric Movie Audio Description
di: Ye, Xiaojun, et al.
Pubblicazione: (2025)
di: Ye, Xiaojun, et al.
Pubblicazione: (2025)
StoryMaker: Towards Holistic Consistent Characters in Text-to-image Generation
di: Zhou, Zhengguang, et al.
Pubblicazione: (2024)
di: Zhou, Zhengguang, et al.
Pubblicazione: (2024)
Character Mixing for Video Generation
di: Liao, Tingting, et al.
Pubblicazione: (2025)
di: Liao, Tingting, et al.
Pubblicazione: (2025)
Character-Centric Understanding of Animated Movies
di: Gui, Zhongrui, et al.
Pubblicazione: (2025)
di: Gui, Zhongrui, et al.
Pubblicazione: (2025)
CharacterShot: Controllable and Consistent 4D Character Animation
di: Gao, Junyao, et al.
Pubblicazione: (2025)
di: Gao, Junyao, et al.
Pubblicazione: (2025)
Character-Centered Dialogue Generation from Scene-Level Prompts
di: Kang, Taewon, et al.
Pubblicazione: (2025)
di: Kang, Taewon, et al.
Pubblicazione: (2025)
Character Recognition in Byzantine Seals with Deep Neural Networks
di: Rageau, Théophile, et al.
Pubblicazione: (2024)
di: Rageau, Théophile, et al.
Pubblicazione: (2024)
DiffSplat: Repurposing Image Diffusion Models for Scalable Gaussian Splat Generation
di: Lin, Chenguo, et al.
Pubblicazione: (2025)
di: Lin, Chenguo, et al.
Pubblicazione: (2025)
Rotate Your Character: Revisiting Video Diffusion Models for High-Quality 3D Character Generation
di: Wang, Jin, et al.
Pubblicazione: (2026)
di: Wang, Jin, et al.
Pubblicazione: (2026)
Unsupervised Attention Regularization Based Domain Adaptation for Oracle Character Recognition
di: Wang, Mei, et al.
Pubblicazione: (2024)
di: Wang, Mei, et al.
Pubblicazione: (2024)
Learning to Align: Addressing Character Frequency Distribution Shifts in Handwritten Text Recognition
di: Kaliosis, Panagiotis, et al.
Pubblicazione: (2025)
di: Kaliosis, Panagiotis, et al.
Pubblicazione: (2025)
AMR-CCR: Anchored Modular Retrieval for Continual Chinese Character Recognition
di: Wu, Yuchuan, et al.
Pubblicazione: (2026)
di: Wu, Yuchuan, et al.
Pubblicazione: (2026)
MovieCharacter: A Tuning-Free Framework for Controllable Character Video Synthesis
di: Qiu, Di, et al.
Pubblicazione: (2024)
di: Qiu, Di, et al.
Pubblicazione: (2024)
Benchmarking Vision-Language Models on Optical Character Recognition in Dynamic Video Environments
di: Nagaonkar, Sankalp, et al.
Pubblicazione: (2025)
di: Nagaonkar, Sankalp, et al.
Pubblicazione: (2025)
Invizo: Arabic Handwritten Document Optical Character Recognition Solution
di: Waly, Alhossien, et al.
Pubblicazione: (2025)
di: Waly, Alhossien, et al.
Pubblicazione: (2025)
Make-A-Character 2: Animatable 3D Character Generation From a Single Image
di: Liu, Lin, et al.
Pubblicazione: (2025)
di: Liu, Lin, et al.
Pubblicazione: (2025)
LOCR: Location-Guided Transformer for Optical Character Recognition
di: Sun, Yu, et al.
Pubblicazione: (2024)
di: Sun, Yu, et al.
Pubblicazione: (2024)
Focus on Local: Finding Reliable Discriminative Regions for Visual Place Recognition
di: Wang, Changwei, et al.
Pubblicazione: (2025)
di: Wang, Changwei, et al.
Pubblicazione: (2025)
High Cursive Complex Character Recognition using GAN External Classifier
di: Rafiuddin, S M
Pubblicazione: (2025)
di: Rafiuddin, S M
Pubblicazione: (2025)
Restoration-Guided Kuzushiji Character Recognition Framework under Seal Interference
di: Ju, Rui-Yang, et al.
Pubblicazione: (2026)
di: Ju, Rui-Yang, et al.
Pubblicazione: (2026)
CharGen: High Accurate Character-Level Visual Text Generation Model with MultiModal Encoder
di: Ma, Lichen, et al.
Pubblicazione: (2024)
di: Ma, Lichen, et al.
Pubblicazione: (2024)
Make-It-Poseable: Feed-forward Latent Posing Model for 3D Characters
di: Guo, Zhiyang, et al.
Pubblicazione: (2025)
di: Guo, Zhiyang, et al.
Pubblicazione: (2025)
Inter-object Discriminative Graph Modeling for Indoor Scene Recognition
di: Song, Chuanxin, et al.
Pubblicazione: (2023)
di: Song, Chuanxin, et al.
Pubblicazione: (2023)
Make-It-Vivid: Dressing Your Animatable Biped Cartoon Characters from Text
di: Tang, Junshu, et al.
Pubblicazione: (2024)
di: Tang, Junshu, et al.
Pubblicazione: (2024)
AnimationBench: Are Video Models Good at Character-Centric Animation?
di: Wu, Leyi, et al.
Pubblicazione: (2026)
di: Wu, Leyi, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing
di: Qu, Yadong, et al.
Pubblicazione: (2024) -
Self-Supervised Pre-training with Symmetric Superimposition Modeling for Scene Text Recognition
di: Gao, Zuan, et al.
Pubblicazione: (2024) -
How Control Information Influences Multilingual Text Image Generation and Editing?
di: Zhang, Boqiang, et al.
Pubblicazione: (2024) -
Leveraging Text Localization for Scene Text Removal via Text-aware Masked Image Modeling
di: Wang, Zixiao, et al.
Pubblicazione: (2024) -
Choose What You Need: Disentangled Representation Learning for Scene Text Recognition, Removal and Editing
di: Zhang, Boqiang, et al.
Pubblicazione: (2024)