SemiETS: Integrating Spatial and Content Consistencies for Semi-Supervised End-to-end Text Spotting
Fuente:
arXiv
Saved in:
| Main Authors: | Luo, Dongliang, Zhu, Hanshen, Zhang, Ziyang, Liang, Dingkang, Xie, Xudong, Liu, Yuliang, Bai, Xiang |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Bridging the Gap Between End-to-End and Two-Step Text Spotting
by: Huang, Mingxin, et al.
Published: (2024)
by: Huang, Mingxin, et al.
Published: (2024)
Sequential Visual and Semantic Consistency for Semi-supervised Text Recognition
by: Yang, Mingkun, et al.
Published: (2024)
by: Yang, Mingkun, et al.
Published: (2024)
TextPecker: Rewarding Structural Anomaly Quantification for Enhancing Visual Text Rendering
by: Zhu, Hanshen, et al.
Published: (2026)
by: Zhu, Hanshen, et al.
Published: (2026)
Consistent-Point: Consistent Pseudo-Points for Semi-Supervised Crowd Counting and Localization
by: Zou, Yuda, et al.
Published: (2025)
by: Zou, Yuda, et al.
Published: (2025)
MSTAR: Box-free Multi-query Scene Text Retrieval with Attention Recycling
by: Yin, Liang, et al.
Published: (2025)
by: Yin, Liang, et al.
Published: (2025)
Training-free Geometric Image Editing on Diffusion Models
by: Zhu, Hanshen, et al.
Published: (2025)
by: Zhu, Hanshen, et al.
Published: (2025)
Mini-Monkey: Alleviating the Semantic Sawtooth Effect for Lightweight MLLMs via Complementary Image Pyramid
by: Huang, Mingxin, et al.
Published: (2024)
by: Huang, Mingxin, et al.
Published: (2024)
Semi-Mamba-UNet: Pixel-Level Contrastive and Pixel-Level Cross-Supervised Visual Mamba-based UNet for Semi-Supervised Medical Image Segmentation
by: Ma, Chao, et al.
Published: (2024)
by: Ma, Chao, et al.
Published: (2024)
Progressive Evolution from Single-Point to Polygon for Scene Text
by: Deng, Linger, et al.
Published: (2023)
by: Deng, Linger, et al.
Published: (2023)
MoE Jetpack: From Dense Checkpoints to Adaptive Mixture of Experts for Vision Tasks
by: Zhu, Xingkui, et al.
Published: (2024)
by: Zhu, Xingkui, et al.
Published: (2024)
Toward Real Text Manipulation Detection: New Dataset and New Solution
by: Luo, Dongliang, et al.
Published: (2023)
by: Luo, Dongliang, et al.
Published: (2023)
TokBench: Evaluating Your Visual Tokenizer before Visual Generation
by: Wu, Junfeng, et al.
Published: (2025)
by: Wu, Junfeng, et al.
Published: (2025)
Semi-rPPG: Semi-Supervised Remote Physiological Measurement with Curriculum Pseudo-Labeling
by: Wu, Bingjie, et al.
Published: (2025)
by: Wu, Bingjie, et al.
Published: (2025)
Hierarchical Semi-Supervised Active Learning for Remote Sensing
by: Huang, Wei, et al.
Published: (2025)
by: Huang, Wei, et al.
Published: (2025)
Boosting Semi-Supervised Scene Text Recognition via Viewing and Summarizing
by: Qu, Yadong, et al.
Published: (2024)
by: Qu, Yadong, et al.
Published: (2024)
Boundary-Refined Prototype Generation: A General End-to-End Paradigm for Semi-Supervised Semantic Segmentation
by: Dong, Junhao, et al.
Published: (2023)
by: Dong, Junhao, et al.
Published: (2023)
SemiSAM: Enhancing Semi-Supervised Medical Image Segmentation via SAM-Assisted Consistency Regularization
by: Zhang, Yichi, et al.
Published: (2023)
by: Zhang, Yichi, et al.
Published: (2023)
PDF-WuKong: A Large Multimodal Model for Efficient Long PDF Reading with End-to-End Sparse Sampling
by: Xie, Xudong, et al.
Published: (2024)
by: Xie, Xudong, et al.
Published: (2024)
CORA: Consistency-Guided Semi-Supervised Framework for Reasoning Segmentation
by: Howlader, Prantik, et al.
Published: (2025)
by: Howlader, Prantik, et al.
Published: (2025)
LCGC: Learning from Consistency Gradient Conflicting for Class-Imbalanced Semi-Supervised Debiasing
by: Xing, Weiwei, et al.
Published: (2025)
by: Xing, Weiwei, et al.
Published: (2025)
Context Consistency Learning via Sentence Removal for Semi-Supervised Video Paragraph Grounding
by: Zhong, Yaokun, et al.
Published: (2025)
by: Zhong, Yaokun, et al.
Published: (2025)
Towards End-to-End Semi-Supervised Table Detection with Semantic Aligned Matching Transformer
by: Shehzadi, Tahira, et al.
Published: (2024)
by: Shehzadi, Tahira, et al.
Published: (2024)
End-to-End Semi-Supervised approach with Modulated Object Queries for Table Detection in Documents
by: Ehsan, Iqraa, et al.
Published: (2024)
by: Ehsan, Iqraa, et al.
Published: (2024)
UWFormer: Underwater Image Enhancement via a Semi-Supervised Multi-Scale Transformer
by: Chen, Weiwen, et al.
Published: (2023)
by: Chen, Weiwen, et al.
Published: (2023)
SwinTextSpotter v2: Towards Better Synergy for Scene Text Spotting
by: Huang, Mingxin, et al.
Published: (2024)
by: Huang, Mingxin, et al.
Published: (2024)
Video Streaming Thinking: VideoLLMs Can Watch and Think Simultaneously
by: Guan, Yiran, et al.
Published: (2026)
by: Guan, Yiran, et al.
Published: (2026)
Style-Aware Blending and Prototype-Based Cross-Contrast Consistency for Semi-Supervised Medical Image Segmentation
by: Chen, Chaowei, et al.
Published: (2025)
by: Chen, Chaowei, et al.
Published: (2025)
Leveraging Textual Anatomical Knowledge for Class-Imbalanced Semi-Supervised Multi-Organ Segmentation
by: Gu, Yuliang, et al.
Published: (2025)
by: Gu, Yuliang, et al.
Published: (2025)
Shape Transformation Driven by Active Contour for Class-Imbalanced Semi-Supervised Medical Image Segmentation
by: Gu, Yuliang, et al.
Published: (2024)
by: Gu, Yuliang, et al.
Published: (2024)
Instance Consistency Regularization for Semi-Supervised 3D Instance Segmentation
by: Wu, Yizheng, et al.
Published: (2024)
by: Wu, Yizheng, et al.
Published: (2024)
A Multi-View Consistency Framework with Semi-Supervised Domain Adaptation
by: Hong, Yuting, et al.
Published: (2026)
by: Hong, Yuting, et al.
Published: (2026)
PixelDINO: Semi-Supervised Semantic Segmentation for Detecting Permafrost Disturbances
by: Heidler, Konrad, et al.
Published: (2024)
by: Heidler, Konrad, et al.
Published: (2024)
Weakly Semi-supervised Whole Slide Image Classification by Two-level Cross Consistency Supervision
by: Qu, Linhao, et al.
Published: (2025)
by: Qu, Linhao, et al.
Published: (2025)
More Than Generation: Unifying Generation and Depth Estimation via Text-to-Image Diffusion Models
by: Lin, Hongkai, et al.
Published: (2025)
by: Lin, Hongkai, et al.
Published: (2025)
UdeerLID+: Integrating LiDAR, Image, and Relative Depth with Semi-Supervised
by: Ni, Tao, et al.
Published: (2024)
by: Ni, Tao, et al.
Published: (2024)
Semi-Supervised Adaptation of Diffusion Models for Handwritten Text Generation
by: Brandenbusch, Kai
Published: (2024)
by: Brandenbusch, Kai
Published: (2024)
Utilizing Weak-to-Strong Consistency for Semi-Supervised Glomeruli Segmentation
by: Zhang, Irina, et al.
Published: (2024)
by: Zhang, Irina, et al.
Published: (2024)
Semi-SMD: Semi-Supervised Metric Depth Estimation via Surrounding Cameras for Autonomous Driving
by: Xie, Yusen, et al.
Published: (2025)
by: Xie, Yusen, et al.
Published: (2025)
Boosting Semi-Supervised 2D Human Pose Estimation by Revisiting Data Augmentation and Consistency Training
by: Zhou, Huayi, et al.
Published: (2024)
by: Zhou, Huayi, et al.
Published: (2024)
ThinkOmni: Lifting Textual Reasoning to Omni-modal Scenarios via Guidance Decoding
by: Guan, Yiran, et al.
Published: (2026)
by: Guan, Yiran, et al.
Published: (2026)
Similar Items
-
Bridging the Gap Between End-to-End and Two-Step Text Spotting
by: Huang, Mingxin, et al.
Published: (2024) -
Sequential Visual and Semantic Consistency for Semi-supervised Text Recognition
by: Yang, Mingkun, et al.
Published: (2024) -
TextPecker: Rewarding Structural Anomaly Quantification for Enhancing Visual Text Rendering
by: Zhu, Hanshen, et al.
Published: (2026) -
Consistent-Point: Consistent Pseudo-Points for Semi-Supervised Crowd Counting and Localization
by: Zou, Yuda, et al.
Published: (2025) -
MSTAR: Box-free Multi-query Scene Text Retrieval with Attention Recycling
by: Yin, Liang, et al.
Published: (2025)