Uni-DocDiff: A Unified Document Restoration Model Based on Diffusion
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Zhao, Fangmin, Zeng, Weichao, Li, Zhenhang, Yang, Dongbao, Li, Binbin, Bi, Xiaojun, Zhou, Yu |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
TADoc: Robust Time-Aware Document Image Dewarping
von: Zhao, Fangmin, et al.
Veröffentlicht: (2025)
von: Zhao, Fangmin, et al.
Veröffentlicht: (2025)
TextCtrl: Diffusion-based Scene Text Editing with Prior Guidance Control
von: Zeng, Weichao, et al.
Veröffentlicht: (2024)
von: Zeng, Weichao, et al.
Veröffentlicht: (2024)
First Creating Backgrounds Then Rendering Texts: A New Paradigm for Visual Text Blending
von: Li, Zhenhang, et al.
Veröffentlicht: (2024)
von: Li, Zhenhang, et al.
Veröffentlicht: (2024)
Visual Text Meets Low-level Vision: A Comprehensive Survey on Visual Text Processing
von: Shu, Yan, et al.
Veröffentlicht: (2024)
von: Shu, Yan, et al.
Veröffentlicht: (2024)
Visual Text Processing: A Comprehensive Review and Unified Evaluation
von: Shu, Yan, et al.
Veröffentlicht: (2025)
von: Shu, Yan, et al.
Veröffentlicht: (2025)
The Role of Video Generation in Enhancing Data-Limited Action Understanding
von: Li, Wei, et al.
Veröffentlicht: (2025)
von: Li, Wei, et al.
Veröffentlicht: (2025)
Uni-Sign: Toward Unified Sign Language Understanding at Scale
von: Li, Zecheng, et al.
Veröffentlicht: (2025)
von: Li, Zecheng, et al.
Veröffentlicht: (2025)
DocRevive: A Unified Pipeline for Document Text Restoration
von: Purkayastha, Kunal, et al.
Veröffentlicht: (2026)
von: Purkayastha, Kunal, et al.
Veröffentlicht: (2026)
UniLayDiff: A Unified Diffusion Transformer for Content-Aware Layout Generation
von: Liu, Zeyang, et al.
Veröffentlicht: (2025)
von: Liu, Zeyang, et al.
Veröffentlicht: (2025)
DocRes: A Generalist Model Toward Unifying Document Image Restoration Tasks
von: Zhang, Jiaxin, et al.
Veröffentlicht: (2024)
von: Zhang, Jiaxin, et al.
Veröffentlicht: (2024)
DocR1: Evidence Page-Guided GRPO for Multi-Page Document Understanding
von: Xiong, Junyu, et al.
Veröffentlicht: (2025)
von: Xiong, Junyu, et al.
Veröffentlicht: (2025)
UniVid: Pyramid Diffusion Model for High Quality Video Generation
von: Xiao, Xinyu, et al.
Veröffentlicht: (2026)
von: Xiao, Xinyu, et al.
Veröffentlicht: (2026)
IG-Diff: Complex Night Scene Restoration with Illumination-Guided Diffusion Model
von: Chen, Yifan, et al.
Veröffentlicht: (2026)
von: Chen, Yifan, et al.
Veröffentlicht: (2026)
CogDoc: Towards Unified thinking in Documents
von: Xu, Qixin, et al.
Veröffentlicht: (2025)
von: Xu, Qixin, et al.
Veröffentlicht: (2025)
UniSegDiff: Boosting Unified Lesion Segmentation via a Staged Diffusion Model
von: Hu, Yilong, et al.
Veröffentlicht: (2025)
von: Hu, Yilong, et al.
Veröffentlicht: (2025)
Diff-Restorer: Unleashing Visual Prompts for Diffusion-based Universal Image Restoration
von: Zhang, Yuhong, et al.
Veröffentlicht: (2024)
von: Zhang, Yuhong, et al.
Veröffentlicht: (2024)
DiffMAC: Diffusion Manifold Hallucination Correction for High Generalization Blind Face Restoration
von: Gao, Nan, et al.
Veröffentlicht: (2024)
von: Gao, Nan, et al.
Veröffentlicht: (2024)
Live2Diff: Live Stream Translation via Uni-directional Attention in Video Diffusion Models
von: Xing, Zhening, et al.
Veröffentlicht: (2024)
von: Xing, Zhening, et al.
Veröffentlicht: (2024)
DiffIR2VR-Zero: Zero-Shot Video Restoration with Diffusion-based Image Restoration Models
von: Yeh, Chang-Han, et al.
Veröffentlicht: (2024)
von: Yeh, Chang-Han, et al.
Veröffentlicht: (2024)
Reti-Diff: Illumination Degradation Image Restoration with Retinex-based Latent Diffusion Model
von: He, Chunming, et al.
Veröffentlicht: (2023)
von: He, Chunming, et al.
Veröffentlicht: (2023)
DualDiff: Dual-branch Diffusion Model for Autonomous Driving with Semantic Fusion
von: Li, Haoteng, et al.
Veröffentlicht: (2025)
von: Li, Haoteng, et al.
Veröffentlicht: (2025)
AdaQual-Diff: Diffusion-Based Image Restoration via Adaptive Quality Prompting
von: Su, Xin, et al.
Veröffentlicht: (2025)
von: Su, Xin, et al.
Veröffentlicht: (2025)
DiffStereo: High-Frequency Aware Diffusion Model for Stereo Image Restoration
von: Cao, Huiyun, et al.
Veröffentlicht: (2025)
von: Cao, Huiyun, et al.
Veröffentlicht: (2025)
IMTBench: A Multi-Scenario Cross-Modal Collaborative Evaluation Benchmark for In-Image Machine Translation
von: Lyu, Jiahao, et al.
Veröffentlicht: (2026)
von: Lyu, Jiahao, et al.
Veröffentlicht: (2026)
Beyond Flat Text: Dual Self-inherited Guidance for Visual Text Generation
von: Luo, Minxing, et al.
Veröffentlicht: (2025)
von: Luo, Minxing, et al.
Veröffentlicht: (2025)
AortaDiff: A Unified Multitask Diffusion Framework For Contrast-Free AAA Imaging
von: Ou, Yuxuan, et al.
Veröffentlicht: (2025)
von: Ou, Yuxuan, et al.
Veröffentlicht: (2025)
DiffBIR: Towards Blind Image Restoration with Generative Diffusion Prior
von: Lin, Xinqi, et al.
Veröffentlicht: (2023)
von: Lin, Xinqi, et al.
Veröffentlicht: (2023)
DiffBody: Human Body Restoration by Imagining with Generative Diffusion Prior
von: Zhang, Yiming, et al.
Veröffentlicht: (2024)
von: Zhang, Yiming, et al.
Veröffentlicht: (2024)
UniFL: Improve Latent Diffusion Model via Unified Feedback Learning
von: Zhang, Jiacheng, et al.
Veröffentlicht: (2024)
von: Zhang, Jiacheng, et al.
Veröffentlicht: (2024)
DiffAD: A Unified Diffusion Modeling Approach for Autonomous Driving
von: Wang, Tao, et al.
Veröffentlicht: (2025)
von: Wang, Tao, et al.
Veröffentlicht: (2025)
UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis
von: Wang, Yuanrui, et al.
Veröffentlicht: (2025)
von: Wang, Yuanrui, et al.
Veröffentlicht: (2025)
mPLUG-DocOwl 1.5: Unified Structure Learning for OCR-free Document Understanding
von: Hu, Anwen, et al.
Veröffentlicht: (2024)
von: Hu, Anwen, et al.
Veröffentlicht: (2024)
HIR-Diff: Unsupervised Hyperspectral Image Restoration Via Improved Diffusion Models
von: Pang, Li, et al.
Veröffentlicht: (2024)
von: Pang, Li, et al.
Veröffentlicht: (2024)
UniGeo: Taming Video Diffusion for Unified Consistent Geometry Estimation
von: Sun, Yang-Tian, et al.
Veröffentlicht: (2025)
von: Sun, Yang-Tian, et al.
Veröffentlicht: (2025)
UniLDiff: Unlocking the Power of Diffusion Priors for All-in-One Image Restoration
von: Cheng, Zihan, et al.
Veröffentlicht: (2025)
von: Cheng, Zihan, et al.
Veröffentlicht: (2025)
UniISP: A Unified ISP Framework for Both Human and Machine Vision
von: Li, Hanxi, et al.
Veröffentlicht: (2026)
von: Li, Hanxi, et al.
Veröffentlicht: (2026)
UniCoRN: Latent Diffusion-based Unified Controllable Image Restoration Network across Multiple Degradations
von: Mandal, Debabrata, et al.
Veröffentlicht: (2025)
von: Mandal, Debabrata, et al.
Veröffentlicht: (2025)
MoE-DiffIR: Task-customized Diffusion Priors for Universal Compressed Image Restoration
von: Ren, Yulin, et al.
Veröffentlicht: (2024)
von: Ren, Yulin, et al.
Veröffentlicht: (2024)
SynthDoc: Bilingual Documents Synthesis for Visual Document Understanding
von: Ding, Chuanghao, et al.
Veröffentlicht: (2024)
von: Ding, Chuanghao, et al.
Veröffentlicht: (2024)
Diff-Reg v2: Diffusion-Based Matching Matrix Estimation for Image Matching and 3D Registration
von: Wu, Qianliang, et al.
Veröffentlicht: (2025)
von: Wu, Qianliang, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
TADoc: Robust Time-Aware Document Image Dewarping
von: Zhao, Fangmin, et al.
Veröffentlicht: (2025) -
TextCtrl: Diffusion-based Scene Text Editing with Prior Guidance Control
von: Zeng, Weichao, et al.
Veröffentlicht: (2024) -
First Creating Backgrounds Then Rendering Texts: A New Paradigm for Visual Text Blending
von: Li, Zhenhang, et al.
Veröffentlicht: (2024) -
Visual Text Meets Low-level Vision: A Comprehensive Survey on Visual Text Processing
von: Shu, Yan, et al.
Veröffentlicht: (2024) -
Visual Text Processing: A Comprehensive Review and Unified Evaluation
von: Shu, Yan, et al.
Veröffentlicht: (2025)