Binarizing Documents by Leveraging both Space and Frequency
Fuente:
arXiv
Salvato in:
| Autori principali: | Quattrini, Fabio, Pippi, Vittorio, Cascianelli, Silvia, Cucchiara, Rita |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Merging and Splitting Diffusion Paths for Semantically Coherent Panoramas
di: Quattrini, Fabio, et al.
Pubblicazione: (2024)
di: Quattrini, Fabio, et al.
Pubblicazione: (2024)
Alfie: Democratising RGBA Image Generation With No $$$
di: Quattrini, Fabio, et al.
Pubblicazione: (2024)
di: Quattrini, Fabio, et al.
Pubblicazione: (2024)
Zero-Shot Styled Text Image Generation, but Make It Autoregressive
di: Pippi, Vittorio, et al.
Pubblicazione: (2025)
di: Pippi, Vittorio, et al.
Pubblicazione: (2025)
Autoregressive Styled Text Image Generation, but Make it Reliable
di: Zaccagnino, Carmine, et al.
Pubblicazione: (2025)
di: Zaccagnino, Carmine, et al.
Pubblicazione: (2025)
μgat: Improving Single-Page Document Parsing by Providing Multi-Page Context
di: Quattrini, Fabio, et al.
Pubblicazione: (2024)
di: Quattrini, Fabio, et al.
Pubblicazione: (2024)
ToFu: Visual Tokens Reduction via Fusion for Multi-modal, Multi-patch, Multi-image Task
di: Pippi, Vittorio, et al.
Pubblicazione: (2025)
di: Pippi, Vittorio, et al.
Pubblicazione: (2025)
VATr++: Choose Your Words Wisely for Handwritten Text Generation
di: Vanherle, Bram, et al.
Pubblicazione: (2024)
di: Vanherle, Bram, et al.
Pubblicazione: (2024)
Quo Vadis Handwritten Text Generation for Handwritten Text Recognition?
di: Pippi, Vittorio, et al.
Pubblicazione: (2025)
di: Pippi, Vittorio, et al.
Pubblicazione: (2025)
Shifting the Breaking Point of Flow Matching for Multi-Instance Editing
di: Zaccagnino, Carmine, et al.
Pubblicazione: (2026)
di: Zaccagnino, Carmine, et al.
Pubblicazione: (2026)
Dual Orthogonal Guidance for Robust Diffusion-based Handwritten Text Generation
di: Nikolaidou, Konstantina, et al.
Pubblicazione: (2025)
di: Nikolaidou, Konstantina, et al.
Pubblicazione: (2025)
Embodied Agents for Efficient Exploration and Smart Scene Description
di: Bigazzi, Roberto, et al.
Pubblicazione: (2023)
di: Bigazzi, Roberto, et al.
Pubblicazione: (2023)
Spot the Difference: A Novel Task for Embodied Agents in Changing Environments
di: Landi, Federico, et al.
Pubblicazione: (2022)
di: Landi, Federico, et al.
Pubblicazione: (2022)
Embodied Navigation at the Art Gallery
di: Bigazzi, Roberto, et al.
Pubblicazione: (2022)
di: Bigazzi, Roberto, et al.
Pubblicazione: (2022)
Explore and Explain: Self-supervised Navigation and Recounting
di: Bigazzi, Roberto, et al.
Pubblicazione: (2020)
di: Bigazzi, Roberto, et al.
Pubblicazione: (2020)
Zero-Shot Synthetic-to-Real Handwritten Text Recognition via Task Analogies
di: Garrido-Munoz, Carlos, et al.
Pubblicazione: (2026)
di: Garrido-Munoz, Carlos, et al.
Pubblicazione: (2026)
Unveiling the Truth: Exploring Human Gaze Patterns in Fake Images
di: Cartella, Giuseppe, et al.
Pubblicazione: (2024)
di: Cartella, Giuseppe, et al.
Pubblicazione: (2024)
TPP-Gaze: Modelling Gaze Dynamics in Space and Time with Neural Temporal Point Processes
di: D'Amelio, Alessandro, et al.
Pubblicazione: (2024)
di: D'Amelio, Alessandro, et al.
Pubblicazione: (2024)
BDC-Occ: Binarized Deep Convolution Unit For Binarized Occupancy Network
di: Zhang, Zongkai, et al.
Pubblicazione: (2024)
di: Zhang, Zongkai, et al.
Pubblicazione: (2024)
Fluent and Accurate Image Captioning with a Self-Trained Reward Model
di: Moratelli, Nicholas, et al.
Pubblicazione: (2024)
di: Moratelli, Nicholas, et al.
Pubblicazione: (2024)
Modeling Human Gaze Behavior with Diffusion Models for Unified Scanpath Prediction
di: Cartella, Giuseppe, et al.
Pubblicazione: (2025)
di: Cartella, Giuseppe, et al.
Pubblicazione: (2025)
DKDS: A Benchmark Dataset of Degraded Kuzushiji Documents with Seals for Detection and Binarization
di: Ju, Rui-Yang, et al.
Pubblicazione: (2025)
di: Ju, Rui-Yang, et al.
Pubblicazione: (2025)
Neuromorphic Synergy for Video Binarization
di: Lin, Shijie, et al.
Pubblicazione: (2024)
di: Lin, Shijie, et al.
Pubblicazione: (2024)
A Fair Evaluation of Various Deep Learning-Based Document Image Binarization Approaches
di: Sukesh, Richin, et al.
Pubblicazione: (2024)
di: Sukesh, Richin, et al.
Pubblicazione: (2024)
Image Captioning Evaluation in the Age of Multimodal LLMs: Challenges and Future Perspectives
di: Sarto, Sara, et al.
Pubblicazione: (2025)
di: Sarto, Sara, et al.
Pubblicazione: (2025)
Recurrence-Enhanced Vision-and-Language Transformers for Robust Multimodal Document Retrieval
di: Caffagni, Davide, et al.
Pubblicazione: (2025)
di: Caffagni, Davide, et al.
Pubblicazione: (2025)
BiDense: Binarization for Dense Prediction
di: Yin, Rui, et al.
Pubblicazione: (2024)
di: Yin, Rui, et al.
Pubblicazione: (2024)
BHViT: Binarized Hybrid Vision Transformer
di: Gao, Tian, et al.
Pubblicazione: (2025)
di: Gao, Tian, et al.
Pubblicazione: (2025)
Trends, Applications, and Challenges in Human Attention Modelling
di: Cartella, Giuseppe, et al.
Pubblicazione: (2024)
di: Cartella, Giuseppe, et al.
Pubblicazione: (2024)
Optimizing Resource Consumption in Diffusion Models through Hallucination Early Detection
di: Betti, Federico, et al.
Pubblicazione: (2024)
di: Betti, Federico, et al.
Pubblicazione: (2024)
Multimodal-Conditioned Latent Diffusion Models for Fashion Image Editing
di: Baldrati, Alberto, et al.
Pubblicazione: (2024)
di: Baldrati, Alberto, et al.
Pubblicazione: (2024)
Training-Free Open-Vocabulary Segmentation with Offline Diffusion-Augmented Prototype Generation
di: Barsellotti, Luca, et al.
Pubblicazione: (2024)
di: Barsellotti, Luca, et al.
Pubblicazione: (2024)
Hallucination Early Detection in Diffusion Models
di: Betti, Federico, et al.
Pubblicazione: (2026)
di: Betti, Federico, et al.
Pubblicazione: (2026)
Efficient Multitask Dense Predictor via Binarization
di: Shang, Yuzhang, et al.
Pubblicazione: (2024)
di: Shang, Yuzhang, et al.
Pubblicazione: (2024)
Binarized Diffusion Model for Image Super-Resolution
di: Chen, Zheng, et al.
Pubblicazione: (2024)
di: Chen, Zheng, et al.
Pubblicazione: (2024)
Efficient Generative Adversarial Networks for Color Document Image Enhancement and Binarization Using Multi-scale Feature Extraction
di: Ju, Rui-Yang, et al.
Pubblicazione: (2024)
di: Ju, Rui-Yang, et al.
Pubblicazione: (2024)
BiNet: Degraded-Manuscript Binarization in Diverse Document Textures and Layouts using Deep Encoder-Decoder Networks
di: Dhali, Maruf A., et al.
Pubblicazione: (2019)
di: Dhali, Maruf A., et al.
Pubblicazione: (2019)
MFE-GAN: Efficient GAN-based Framework for Document Image Enhancement and Binarization with Multi-scale Feature Extraction
di: Ju, Rui-Yang, et al.
Pubblicazione: (2025)
di: Ju, Rui-Yang, et al.
Pubblicazione: (2025)
Arabic Handwritten Document OCR Solution with Binarization and Adaptive Scale Fusion Detection
di: Waly, Alhossien, et al.
Pubblicazione: (2024)
di: Waly, Alhossien, et al.
Pubblicazione: (2024)
BinaryDemoire: Moiré-Aware Binarization for Image Demoiréing
di: Chen, Zheng, et al.
Pubblicazione: (2026)
di: Chen, Zheng, et al.
Pubblicazione: (2026)
Assessing the impact of Binarization for Writer Identification in Greek Papyrus
di: Akt, Dominic, et al.
Pubblicazione: (2025)
di: Akt, Dominic, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Merging and Splitting Diffusion Paths for Semantically Coherent Panoramas
di: Quattrini, Fabio, et al.
Pubblicazione: (2024) -
Alfie: Democratising RGBA Image Generation With No $$$
di: Quattrini, Fabio, et al.
Pubblicazione: (2024) -
Zero-Shot Styled Text Image Generation, but Make It Autoregressive
di: Pippi, Vittorio, et al.
Pubblicazione: (2025) -
Autoregressive Styled Text Image Generation, but Make it Reliable
di: Zaccagnino, Carmine, et al.
Pubblicazione: (2025) -
μgat: Improving Single-Page Document Parsing by Providing Multi-Page Context
di: Quattrini, Fabio, et al.
Pubblicazione: (2024)