Enregistré dans:
| Auteurs principaux: | Wang, Haofan, Xu, Yujia, Li, Yimeng, Li, Junchen, Zhang, Chaowei, Wang, Jing, Yang, Kejia, Chen, Zhibo |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2504.19724 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
EasyText: Controllable Diffusion Transformer for Multilingual Text Rendering
par: Lu, Runnan, et autres
Publié: (2025)
par: Lu, Runnan, et autres
Publié: (2025)
Region-Aware Text-to-Image Generation via Hard Binding and Soft Refinement
par: Chen, Zhennan, et autres
Publié: (2024)
par: Chen, Zhennan, et autres
Publié: (2024)
First Creating Backgrounds Then Rendering Texts: A New Paradigm for Visual Text Blending
par: Li, Zhenhang, et autres
Publié: (2024)
par: Li, Zhenhang, et autres
Publié: (2024)
TextPecker: Rewarding Structural Anomaly Quantification for Enhancing Visual Text Rendering
par: Zhu, Hanshen, et autres
Publié: (2026)
par: Zhu, Hanshen, et autres
Publié: (2026)
Visual Text Generation in the Wild
par: Zhu, Yuanzhi, et autres
Publié: (2024)
par: Zhu, Yuanzhi, et autres
Publié: (2024)
TextGround4M: A Prompt-Aligned Dataset for Layout-Aware Text Rendering
par: Mao, Dongxing, et autres
Publié: (2026)
par: Mao, Dongxing, et autres
Publié: (2026)
InstantStyle: Free Lunch towards Style-Preserving in Text-to-Image Generation
par: Wang, Haofan, et autres
Publié: (2024)
par: Wang, Haofan, et autres
Publié: (2024)
Glyph-ByT5: A Customized Text Encoder for Accurate Visual Text Rendering
par: Liu, Zeyu, et autres
Publié: (2024)
par: Liu, Zeyu, et autres
Publié: (2024)
CSGO: Content-Style Composition in Text-to-Image Generation
par: Xing, Peng, et autres
Publié: (2024)
par: Xing, Peng, et autres
Publié: (2024)
FreeText: Training-Free Text Rendering in Diffusion Transformers via Attention Localization and Spectral Glyph Injection
par: Zhang, Ruiqiang, et autres
Publié: (2026)
par: Zhang, Ruiqiang, et autres
Publié: (2026)
TextAlign: Preference Alignment for Text Rendering with Hierarchical Rewards
par: Cui, Mingxuan, et autres
Publié: (2026)
par: Cui, Mingxuan, et autres
Publié: (2026)
SceneVTG++: Controllable Multilingual Visual Text Generation in the Wild
par: Liu, Jiawei, et autres
Publié: (2025)
par: Liu, Jiawei, et autres
Publié: (2025)
InstantStyle-Plus: Style Transfer with Content-Preserving in Text-to-Image Generation
par: Wang, Haofan, et autres
Publié: (2024)
par: Wang, Haofan, et autres
Publié: (2024)
BizGen: Advancing Article-level Visual Text Rendering for Infographics Generation
par: Peng, Yuyang, et autres
Publié: (2025)
par: Peng, Yuyang, et autres
Publié: (2025)
Towards High-Fidelity CAD Generation via LLM-Driven Program Generation and Text-Based B-Rep Primitive Grounding
par: Li, Jiahao, et autres
Publié: (2026)
par: Li, Jiahao, et autres
Publié: (2026)
TextEditBench: Evaluating Reasoning-aware Text Editing Beyond Rendering
par: Gui, Rui, et autres
Publié: (2025)
par: Gui, Rui, et autres
Publié: (2025)
IntroSVG: Learning from Rendering Feedback for Text-to-SVG Generation via an Introspective Generator-Critic Framework
par: Wang, Feiyu, et autres
Publié: (2026)
par: Wang, Feiyu, et autres
Publié: (2026)
Glyph-ByT5-v2: A Strong Aesthetic Baseline for Accurate Multilingual Visual Text Rendering
par: Liu, Zeyu, et autres
Publié: (2024)
par: Liu, Zeyu, et autres
Publié: (2024)
SkyReels-Text: Fine-Grained Font-Controllable Text Editing for Poster Design
par: Yu, Yunjie, et autres
Publié: (2025)
par: Yu, Yunjie, et autres
Publié: (2025)
TextGuider: Training-Free Guidance for Text Rendering via Attention Alignment
par: Baek, Kanghyun, et autres
Publié: (2025)
par: Baek, Kanghyun, et autres
Publié: (2025)
RealRep: Generalized SDR-to-HDR Conversion via Attribute-Disentangled Representation Learning
par: Xu, Li, et autres
Publié: (2025)
par: Xu, Li, et autres
Publié: (2025)
Beyond Flat Text: Dual Self-inherited Guidance for Visual Text Generation
par: Luo, Minxing, et autres
Publié: (2025)
par: Luo, Minxing, et autres
Publié: (2025)
GlyphPrinter: Region-Grouped Direct Preference Optimization for Glyph-Accurate Visual Text Rendering
par: Shuai, Xincheng, et autres
Publié: (2026)
par: Shuai, Xincheng, et autres
Publié: (2026)
Text2Lip: Progressive Lip-Synced Talking Face Generation from Text via Viseme-Guided Rendering
par: Wang, Xu, et autres
Publié: (2025)
par: Wang, Xu, et autres
Publié: (2025)
Render-of-Thought: Rendering Textual Chain-of-Thought as Images for Visual Latent Reasoning
par: Wang, Yifan, et autres
Publié: (2026)
par: Wang, Yifan, et autres
Publié: (2026)
Calligrapher: Freestyle Text Image Customization
par: Ma, Yue, et autres
Publié: (2025)
par: Ma, Yue, et autres
Publié: (2025)
Render-in-the-Loop: Vector Graphics Generation via Visual Self-Feedback
par: Liang, Guotao, et autres
Publié: (2026)
par: Liang, Guotao, et autres
Publié: (2026)
Enhancing Visual Representation for Text-based Person Searching
par: Shen, Wei, et autres
Publié: (2024)
par: Shen, Wei, et autres
Publié: (2024)
Swap Attention in Spatiotemporal Diffusions for Text-to-Video Generation
par: Wang, Wenjing, et autres
Publié: (2023)
par: Wang, Wenjing, et autres
Publié: (2023)
Investigating Text Insulation and Attention Mechanisms for Complex Visual Text Generation
par: Tai, Ying, et autres
Publié: (2025)
par: Tai, Ying, et autres
Publié: (2025)
VL-Reader: Vision and Language Reconstructor is an Effective Scene Text Recognizer
par: Zhong, Humen, et autres
Publié: (2024)
par: Zhong, Humen, et autres
Publié: (2024)
Platypus: A Generalized Specialist Model for Reading Text in Various Forms
par: Wang, Peng, et autres
Publié: (2024)
par: Wang, Peng, et autres
Publié: (2024)
Hear the Scene: Audio-Enhanced Text Spotting
par: Li, Jing, et autres
Publié: (2024)
par: Li, Jing, et autres
Publié: (2024)
Training-Free Occluded Text Rendering via Glyph Priors and Attention-Guided Semantic Blending
par: Hou, Jingqi, et autres
Publié: (2026)
par: Hou, Jingqi, et autres
Publié: (2026)
TIV-Diffusion: Towards Object-Centric Movement for Text-driven Image to Video Generation
par: Wang, Xingrui, et autres
Publié: (2024)
par: Wang, Xingrui, et autres
Publié: (2024)
DreamRenderer: Taming Multi-Instance Attribute Control in Large-Scale Text-to-Image Models
par: Zhou, Dewei, et autres
Publié: (2025)
par: Zhou, Dewei, et autres
Publié: (2025)
CLII: Visual-Text Inpainting via Cross-Modal Predictive Interaction
par: Zhao, Liang, et autres
Publié: (2024)
par: Zhao, Liang, et autres
Publié: (2024)
FlashVLM: Text-Guided Visual Token Selection for Large Multimodal Models
par: Cai, Kaitong, et autres
Publié: (2025)
par: Cai, Kaitong, et autres
Publié: (2025)
Visual-RAG: Benchmarking Text-to-Image Retrieval Augmented Generation for Visual Knowledge Intensive Queries
par: Wu, Yin, et autres
Publié: (2025)
par: Wu, Yin, et autres
Publié: (2025)
MathGen: Revealing the Illusion of Mathematical Competence through Text-to-Image Generation
par: Liu, Ruiyao, et autres
Publié: (2026)
par: Liu, Ruiyao, et autres
Publié: (2026)
Documents similaires
-
EasyText: Controllable Diffusion Transformer for Multilingual Text Rendering
par: Lu, Runnan, et autres
Publié: (2025) -
Region-Aware Text-to-Image Generation via Hard Binding and Soft Refinement
par: Chen, Zhennan, et autres
Publié: (2024) -
First Creating Backgrounds Then Rendering Texts: A New Paradigm for Visual Text Blending
par: Li, Zhenhang, et autres
Publié: (2024) -
TextPecker: Rewarding Structural Anomaly Quantification for Enhancing Visual Text Rendering
par: Zhu, Hanshen, et autres
Publié: (2026) -
Visual Text Generation in the Wild
par: Zhu, Yuanzhi, et autres
Publié: (2024)