TextShield-R1: Reinforced Reasoning for Tampered Text Detection
Fuente:
arXiv
Guardado en:
| Autores principales: | Qu, Chenfan, Zhong, Yiwu, Liu, Jian, Zhu, Xuekang, Yu, Bohan, Jin, Lianwen |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Revisiting Tampered Scene Text Detection in the Era of Generative AI
por: Qu, Chenfan, et al.
Publicado: (2024)
por: Qu, Chenfan, et al.
Publicado: (2024)
TextSleuth: Towards Explainable Tampered Text Detection
por: Qu, Chenfan, et al.
Publicado: (2024)
por: Qu, Chenfan, et al.
Publicado: (2024)
Omni-IML: Towards Unified Image Manipulation Localization
por: Qu, Chenfan, et al.
Publicado: (2024)
por: Qu, Chenfan, et al.
Publicado: (2024)
Webly-Supervised Image Manipulation Localization via Category-Aware Auto-Annotation
por: Qu, Chenfan, et al.
Publicado: (2025)
por: Qu, Chenfan, et al.
Publicado: (2025)
ForensicHub: A Unified Benchmark & Codebase for All-Domain Fake Image Detection and Localization
por: Du, Bo, et al.
Publicado: (2025)
por: Du, Bo, et al.
Publicado: (2025)
Revisiting Image Manipulation Localization under Realistic Manipulation Scenarios
por: Zhu, Xuekang, et al.
Publicado: (2025)
por: Zhu, Xuekang, et al.
Publicado: (2025)
LEGO: Self-Supervised Representation Learning for Scene Text Images
por: Ren, Yujin, et al.
Publicado: (2024)
por: Ren, Yujin, et al.
Publicado: (2024)
ViTEraser: Harnessing the Power of Vision Transformers for Scene Text Removal with SegMIM Pretraining
por: Peng, Dezhi, et al.
Publicado: (2023)
por: Peng, Dezhi, et al.
Publicado: (2023)
Can We Build a Monolithic Model for Fake Image Detection? SICA: Semantic-Induced Constrained Adaptation for Unified-Yet-Discriminative Artifact Feature Space Reconstruction
por: Du, Bo, et al.
Publicado: (2026)
por: Du, Bo, et al.
Publicado: (2026)
A Two-Stage Dual-Path Framework for Text Tampering Detection and Recognition
por: Li, Guandong, et al.
Publicado: (2024)
por: Li, Guandong, et al.
Publicado: (2024)
Bridging the Gap Between End-to-End and Two-Step Text Spotting
por: Huang, Mingxin, et al.
Publicado: (2024)
por: Huang, Mingxin, et al.
Publicado: (2024)
Progressive Evolution from Single-Point to Polygon for Scene Text
por: Deng, Linger, et al.
Publicado: (2023)
por: Deng, Linger, et al.
Publicado: (2023)
SwinTextSpotter v2: Towards Better Synergy for Scene Text Spotting
por: Huang, Mingxin, et al.
Publicado: (2024)
por: Huang, Mingxin, et al.
Publicado: (2024)
World-R1: Reinforcing 3D Constraints for Text-to-Video Generation
por: Wang, Weijie, et al.
Publicado: (2026)
por: Wang, Weijie, et al.
Publicado: (2026)
DiffInk: Glyph- and Style-Aware Latent Diffusion Transformer for Text to Online Handwriting Generation
por: Pan, Wei, et al.
Publicado: (2025)
por: Pan, Wei, et al.
Publicado: (2025)
DiffChat: Learning to Chat with Text-to-Image Synthesis Models for Interactive Image Creation
por: Wang, Jiapeng, et al.
Publicado: (2024)
por: Wang, Jiapeng, et al.
Publicado: (2024)
HierCode: A Lightweight Hierarchical Codebook for Zero-shot Chinese Text Recognition
por: Zhang, Yuyi, et al.
Publicado: (2024)
por: Zhang, Yuyi, et al.
Publicado: (2024)
Video-R4: Reinforcing Text-Rich Video Reasoning with Visual Rumination
por: Tang, Yolo Y., et al.
Publicado: (2025)
por: Tang, Yolo Y., et al.
Publicado: (2025)
DocLayLLM: An Efficient Multi-modal Extension of Large Language Models for Text-rich Document Understanding
por: Liao, Wenhui, et al.
Publicado: (2024)
por: Liao, Wenhui, et al.
Publicado: (2024)
Online Writer Retrieval with Chinese Handwritten Phrases: A Synergistic Temporal-Frequency Representation Learning Approach
por: Zhang, Peirong, et al.
Publicado: (2024)
por: Zhang, Peirong, et al.
Publicado: (2024)
Aggregated Text Transformer for Scene Text Detection
por: Zhou, Zhao, et al.
Publicado: (2022)
por: Zhou, Zhao, et al.
Publicado: (2022)
Leveraging Text Localization for Scene Text Removal via Text-aware Masked Image Modeling
por: Wang, Zixiao, et al.
Publicado: (2024)
por: Wang, Zixiao, et al.
Publicado: (2024)
BioTamperNet: Affinity-Guided State-Space Model Detecting Tampered Biomedical Images
por: Nandi, Soumyaroop, et al.
Publicado: (2026)
por: Nandi, Soumyaroop, et al.
Publicado: (2026)
VisionReasoner: Unified Reasoning-Integrated Visual Perception via Reinforcement Learning
por: Liu, Yuqi, et al.
Publicado: (2025)
por: Liu, Yuqi, et al.
Publicado: (2025)
Visual Text Processing: A Comprehensive Review and Unified Evaluation
por: Shu, Yan, et al.
Publicado: (2025)
por: Shu, Yan, et al.
Publicado: (2025)
Touch-R1: Reinforcing Touch Reasoning in MLLMs
por: Lai, Yingxin, et al.
Publicado: (2026)
por: Lai, Yingxin, et al.
Publicado: (2026)
TextMastero: Mastering High-Quality Scene Text Editing in Diverse Languages and Styles
por: Wang, Tong, et al.
Publicado: (2024)
por: Wang, Tong, et al.
Publicado: (2024)
Omni-R1: Reinforcement Learning for Omnimodal Reasoning via Two-System Collaboration
por: Zhong, Hao, et al.
Publicado: (2025)
por: Zhong, Hao, et al.
Publicado: (2025)
Explicit Relational Reasoning Network for Scene Text Detection
por: Su, Yuchen, et al.
Publicado: (2024)
por: Su, Yuchen, et al.
Publicado: (2024)
Research about the Ability of LLM in the Tamper-Detection Area
por: Yang, Xinyu, et al.
Publicado: (2024)
por: Yang, Xinyu, et al.
Publicado: (2024)
Detecting Dataset Abuse in Fine-Tuning Stable Diffusion Models for Text-to-Image Synthesis
por: Wang, Songrui, et al.
Publicado: (2024)
por: Wang, Songrui, et al.
Publicado: (2024)
Think-Then-Generate: Reasoning-Aware Text-to-Image Diffusion with LLM Encoders
por: Kou, Siqi, et al.
Publicado: (2026)
por: Kou, Siqi, et al.
Publicado: (2026)
MCCD: A Multi-Attribute Chinese Calligraphy Character Dataset Annotated with Script Styles, Dynasties, and Calligraphers
por: Zhao, Yixin, et al.
Publicado: (2025)
por: Zhao, Yixin, et al.
Publicado: (2025)
VimTS: A Unified Video and Image Text Spotter for Enhancing the Cross-domain Generalization
por: Liu, Yuliang, et al.
Publicado: (2024)
por: Liu, Yuliang, et al.
Publicado: (2024)
TextBlockV2: Towards Precise-Detection-Free Scene Text Spotting with Pre-trained Language Model
por: Lyu, Jiahao, et al.
Publicado: (2024)
por: Lyu, Jiahao, et al.
Publicado: (2024)
Wan-R1: Verifiable-Reinforcement Learning for Video Reasoning
por: Liu, Ming, et al.
Publicado: (2026)
por: Liu, Ming, et al.
Publicado: (2026)
CAPO: Reinforcing Consistent Reasoning in Medical Decision-Making
por: Jiang, Songtao, et al.
Publicado: (2025)
por: Jiang, Songtao, et al.
Publicado: (2025)
Text2LiDAR: Text-guided LiDAR Point Cloud Generation via Equirectangular Transformer
por: Wu, Yang, et al.
Publicado: (2024)
por: Wu, Yang, et al.
Publicado: (2024)
Synthetic Curriculum Reinforces Compositional Text-to-Image Generation
por: Wang, Shijian, et al.
Publicado: (2025)
por: Wang, Shijian, et al.
Publicado: (2025)
StyleTextGen: Style-Conditioned Multilingual Scene Text Generation
por: Chen, Zeyu, et al.
Publicado: (2026)
por: Chen, Zeyu, et al.
Publicado: (2026)
Ejemplares similares
-
Revisiting Tampered Scene Text Detection in the Era of Generative AI
por: Qu, Chenfan, et al.
Publicado: (2024) -
TextSleuth: Towards Explainable Tampered Text Detection
por: Qu, Chenfan, et al.
Publicado: (2024) -
Omni-IML: Towards Unified Image Manipulation Localization
por: Qu, Chenfan, et al.
Publicado: (2024) -
Webly-Supervised Image Manipulation Localization via Category-Aware Auto-Annotation
por: Qu, Chenfan, et al.
Publicado: (2025) -
ForensicHub: A Unified Benchmark & Codebase for All-Domain Fake Image Detection and Localization
por: Du, Bo, et al.
Publicado: (2025)