FASTER: A Font-Agnostic Scene Text Editing and Rendering Framework
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Das, Alloy, Biswas, Sanket, Roy, Prasun, Ghosh, Subhankar, Pal, Umapada, Blumenstein, Michael, Lladós, Josep, Bhattacharya, Saumik |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
STEFANN: Scene Text Editor using Font Adaptive Neural Network
par: Roy, Prasun, et autres
Publié: (2019)
par: Roy, Prasun, et autres
Publié: (2019)
Scene Aware Person Image Generation through Global Contextual Conditioning
par: Roy, Prasun, et autres
Publié: (2022)
par: Roy, Prasun, et autres
Publié: (2022)
TIPS: Text-Induced Pose Synthesis
par: Roy, Prasun, et autres
Publié: (2022)
par: Roy, Prasun, et autres
Publié: (2022)
Exploring Mutual Cross-Modal Attention for Context-Aware Human Affordance Generation
par: Roy, Prasun, et autres
Publié: (2025)
par: Roy, Prasun, et autres
Publié: (2025)
Semantically Consistent Person Image Generation
par: Roy, Prasun, et autres
Publié: (2023)
par: Roy, Prasun, et autres
Publié: (2023)
d-Sketch: Improving Visual Fidelity of Sketch-to-Image Translation with Pretrained Latent Diffusion Models without Retraining
par: Roy, Prasun, et autres
Publié: (2025)
par: Roy, Prasun, et autres
Publié: (2025)
FastTextSpotter: A High-Efficiency Transformer for Multilingual Scene Text Spotting
par: Das, Alloy, et autres
Publié: (2024)
par: Das, Alloy, et autres
Publié: (2024)
Multi-scale Attention Guided Pose Transfer
par: Roy, Prasun, et autres
Publié: (2022)
par: Roy, Prasun, et autres
Publié: (2022)
Diving into the Depths of Spotting Text in Multi-Domain Noisy Scenes
par: Das, Alloy, et autres
Publié: (2023)
par: Das, Alloy, et autres
Publié: (2023)
Effects of Degradations on Deep Neural Network Architectures
par: Roy, Prasun, et autres
Publié: (2018)
par: Roy, Prasun, et autres
Publié: (2018)
DRG-Font: Dynamic Reference-Guided Few-shot Font Generation via Contrastive Style-Content Disentanglement
par: Chakraborty, Rejoy, et autres
Publié: (2026)
par: Chakraborty, Rejoy, et autres
Publié: (2026)
NoTeS-Bank: Benchmarking Neural Transcription and Search for Scientific Notes Understanding
par: Pal, Aniket, et autres
Publié: (2025)
par: Pal, Aniket, et autres
Publié: (2025)
A CNN Based Framework for Unistroke Numeral Recognition in Air-Writing
par: Roy, Prasun, et autres
Publié: (2023)
par: Roy, Prasun, et autres
Publié: (2023)
GraphKD: Exploring Knowledge Distillation Towards Document Object Detection with Structured Graph Creation
par: Banerjee, Ayan, et autres
Publié: (2024)
par: Banerjee, Ayan, et autres
Publié: (2024)
Position and Rotation Invariant Sign Language Recognition from 3D Kinect Data with Recurrent Neural Networks
par: Roy, Prasun, et autres
Publié: (2020)
par: Roy, Prasun, et autres
Publié: (2020)
ControlText: Unlocking Controllable Fonts in Multilingual Text Rendering without Font Annotations
par: Jiang, Bowen, et autres
Publié: (2025)
par: Jiang, Bowen, et autres
Publié: (2025)
TaleDiffusion: Multi-Character Story Generation with Dialogue Rendering
par: Banerjee, Ayan, et autres
Publié: (2025)
par: Banerjee, Ayan, et autres
Publié: (2025)
RenderBox: Expressive Performance Rendering with Text Control
par: Zhang, Huan, et autres
Publié: (2025)
par: Zhang, Huan, et autres
Publié: (2025)
DocRevive: A Unified Pipeline for Document Text Restoration
par: Purkayastha, Kunal, et autres
Publié: (2026)
par: Purkayastha, Kunal, et autres
Publié: (2026)
MIO : Mutual Information Optimization using Self-Supervised Binary Contrastive Learning
par: Manna, Siladittya, et autres
Publié: (2021)
par: Manna, Siladittya, et autres
Publié: (2021)
Correlation Weighted Prototype-based Self-Supervised One-Shot Segmentation of Medical Images
par: Manna, Siladittya, et autres
Publié: (2024)
par: Manna, Siladittya, et autres
Publié: (2024)
GeoContrastNet: Contrastive Key-Value Edge Learning for Language-Agnostic Document Understanding
par: Biescas, Nil, et autres
Publié: (2024)
par: Biescas, Nil, et autres
Publié: (2024)
Photoshop Batch Rendering Using Actions for Stylistic Video Editing
par: De La Fuente, Tessa
Publié: (2025)
par: De La Fuente, Tessa
Publié: (2025)
Streaming Real-Time Rendered Scenes as 3D Gaussians
par: Siekkinen, Matti, et autres
Publié: (2026)
par: Siekkinen, Matti, et autres
Publié: (2026)
What's Wrong with the Bottom-up Methods in Arbitrary-shape Scene Text Detection
par: Xu, Chengpei, et autres
Publié: (2021)
par: Xu, Chengpei, et autres
Publié: (2021)
SketchGPT: Autoregressive Modeling for Sketch Generation and Recognition
par: Tiwari, Adarsh, et autres
Publié: (2024)
par: Tiwari, Adarsh, et autres
Publié: (2024)
DeepTextMark: A Deep Learning-Driven Text Watermarking Approach for Identifying Large Language Model Generated Text
par: Munyer, Travis, et autres
Publié: (2023)
par: Munyer, Travis, et autres
Publié: (2023)
Evaluating the Usability of Microgestures for Text Editing Tasks in Virtual Reality
par: Li, Xiang, et autres
Publié: (2025)
par: Li, Xiang, et autres
Publié: (2025)
Scene-Text Grounding for Text-Based Video Question Answering
par: Zhou, Sheng, et autres
Publié: (2024)
par: Zhou, Sheng, et autres
Publié: (2024)
CraftSVG: Multi-Object Text-to-SVG Synthesis via Layout Guided Diffusion
par: Banerjee, Ayan, et autres
Publié: (2024)
par: Banerjee, Ayan, et autres
Publié: (2024)
A Unified Framework for Modality-Agnostic Deepfakes Detection
par: Yu, Cai, et autres
Publié: (2023)
par: Yu, Cai, et autres
Publié: (2023)
Editing on the Generative Manifold: A Theoretical and Empirical Study of General Diffusion-Based Image Editing Trade-offs
par: Hu, Yi, et autres
Publié: (2026)
par: Hu, Yi, et autres
Publié: (2026)
Globally and Locally Optimized Pannini Projection for High FoV Rendering of 360-degree Images
par: Jabar, Falah, et autres
Publié: (2024)
par: Jabar, Falah, et autres
Publié: (2024)
RenCon 2025: Revival of the Expressive Performance Rendering Competition
par: Zhang, Huan, et autres
Publié: (2026)
par: Zhang, Huan, et autres
Publié: (2026)
ChartEditor: A Reinforcement Learning Framework for Robust Chart Editing
par: Chen, Liangyu, et autres
Publié: (2025)
par: Chen, Liangyu, et autres
Publié: (2025)
Towards Unified Representation of Multi-Modal Pre-training for 3D Understanding via Differentiable Rendering
par: Fei, Ben, et autres
Publié: (2024)
par: Fei, Ben, et autres
Publié: (2024)
MorphText: Deep Morphology Regularized Arbitrary-shape Scene Text Detection
par: Xu, Chengpei, et autres
Publié: (2024)
par: Xu, Chengpei, et autres
Publié: (2024)
Vidformer: Drop-in Declarative Optimization for Rendering Video-Native Query Results
par: Winecki, Dominik, et autres
Publié: (2026)
par: Winecki, Dominik, et autres
Publié: (2026)
3DMambaIPF: A State Space Model for Iterative Point Cloud Filtering via Differentiable Rendering
par: Zhou, Qingyuan, et autres
Publié: (2024)
par: Zhou, Qingyuan, et autres
Publié: (2024)
When and How to Cut Classical Concerts? A Multimodal Automated Video Editing Approach
par: Gonzálbez-Biosca, Daniel, et autres
Publié: (2025)
par: Gonzálbez-Biosca, Daniel, et autres
Publié: (2025)
Documents similaires
-
STEFANN: Scene Text Editor using Font Adaptive Neural Network
par: Roy, Prasun, et autres
Publié: (2019) -
Scene Aware Person Image Generation through Global Contextual Conditioning
par: Roy, Prasun, et autres
Publié: (2022) -
TIPS: Text-Induced Pose Synthesis
par: Roy, Prasun, et autres
Publié: (2022) -
Exploring Mutual Cross-Modal Attention for Context-Aware Human Affordance Generation
par: Roy, Prasun, et autres
Publié: (2025) -
Semantically Consistent Person Image Generation
par: Roy, Prasun, et autres
Publié: (2023)