GlyphBanana: Advancing Precise Text Rendering Through Agentic Workflows
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Yan, Zexuan, Jin, Jiarui, Ma, Yue, Wang, Shijian, Hu, Jiahui, Jiao, Wenxiang, Lu, Yuan, Zhang, Linfeng |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
AgentDisCo: Towards Disentanglement and Collaboration in Open-ended Deep Research Agents
von: Jin, Jiarui, et al.
Veröffentlicht: (2026)
von: Jin, Jiarui, et al.
Veröffentlicht: (2026)
GlyphPrinter: Region-Grouped Direct Preference Optimization for Glyph-Accurate Visual Text Rendering
von: Shuai, Xincheng, et al.
Veröffentlicht: (2026)
von: Shuai, Xincheng, et al.
Veröffentlicht: (2026)
Glyph-ByT5: A Customized Text Encoder for Accurate Visual Text Rendering
von: Liu, Zeyu, et al.
Veröffentlicht: (2024)
von: Liu, Zeyu, et al.
Veröffentlicht: (2024)
TextMaster: A Unified Framework for Realistic Text Editing via Glyph-Style Dual-Control
von: Yan, Zhenyu, et al.
Veröffentlicht: (2024)
von: Yan, Zhenyu, et al.
Veröffentlicht: (2024)
UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis
von: Wang, Yuanrui, et al.
Veröffentlicht: (2025)
von: Wang, Yuanrui, et al.
Veröffentlicht: (2025)
MuSEAgent: A Multimodal Reasoning Agent with Stateful Experiences
von: Wang, Shijian, et al.
Veröffentlicht: (2026)
von: Wang, Shijian, et al.
Veröffentlicht: (2026)
FreeText: Training-Free Text Rendering in Diffusion Transformers via Attention Localization and Spectral Glyph Injection
von: Zhang, Ruiqiang, et al.
Veröffentlicht: (2026)
von: Zhang, Ruiqiang, et al.
Veröffentlicht: (2026)
GlyphMastero: A Glyph Encoder for High-Fidelity Scene Text Editing
von: Wang, Tong, et al.
Veröffentlicht: (2025)
von: Wang, Tong, et al.
Veröffentlicht: (2025)
Glyph-ByT5-v2: A Strong Aesthetic Baseline for Accurate Multilingual Visual Text Rendering
von: Liu, Zeyu, et al.
Veröffentlicht: (2024)
von: Liu, Zeyu, et al.
Veröffentlicht: (2024)
Training-Free Occluded Text Rendering via Glyph Priors and Attention-Guided Semantic Blending
von: Hou, Jingqi, et al.
Veröffentlicht: (2026)
von: Hou, Jingqi, et al.
Veröffentlicht: (2026)
HDGlyph: A Hierarchical Disentangled Glyph-Based Framework for Long-Tail Text Rendering in Diffusion Models
von: Zhuang, Shuhan, et al.
Veröffentlicht: (2025)
von: Zhuang, Shuhan, et al.
Veröffentlicht: (2025)
AnyArtisticGlyph: Multilingual Controllable Artistic Glyph Generation
von: Lu, Xiongbo, et al.
Veröffentlicht: (2025)
von: Lu, Xiongbo, et al.
Veröffentlicht: (2025)
SOGS: Second-Order Anchor for Advanced 3D Gaussian Splatting
von: Zhang, Jiahui, et al.
Veröffentlicht: (2025)
von: Zhang, Jiahui, et al.
Veröffentlicht: (2025)
GLDesigner: Leveraging Multi-Modal LLMs as Designer for Enhanced Aesthetic Text Glyph Layouts
von: He, Junwen, et al.
Veröffentlicht: (2024)
von: He, Junwen, et al.
Veröffentlicht: (2024)
EEdit: Rethinking the Spatial and Temporal Redundancy for Efficient Image Editing
von: Yan, Zexuan, et al.
Veröffentlicht: (2025)
von: Yan, Zexuan, et al.
Veröffentlicht: (2025)
GlyphDraw2: Automatic Generation of Complex Glyph Posters with Diffusion Models and Large Language Models
von: Ma, Jian, et al.
Veröffentlicht: (2024)
von: Ma, Jian, et al.
Veröffentlicht: (2024)
Synthetic Curriculum Reinforces Compositional Text-to-Image Generation
von: Wang, Shijian, et al.
Veröffentlicht: (2025)
von: Wang, Shijian, et al.
Veröffentlicht: (2025)
OmniGAIA: Towards Native Omni-Modal AI Agents
von: Li, Xiaoxi, et al.
Veröffentlicht: (2026)
von: Li, Xiaoxi, et al.
Veröffentlicht: (2026)
DiffInk: Glyph- and Style-Aware Latent Diffusion Transformer for Text to Online Handwriting Generation
von: Pan, Wei, et al.
Veröffentlicht: (2025)
von: Pan, Wei, et al.
Veröffentlicht: (2025)
Tool-Genesis: A Task-Driven Tool Creation Benchmark for Self-Evolving Language Agent
von: Xia, Bowei, et al.
Veröffentlicht: (2026)
von: Xia, Bowei, et al.
Veröffentlicht: (2026)
Agent Banana: High-Fidelity Image Editing with Agentic Thinking and Tooling
von: Ye, Ruijie, et al.
Veröffentlicht: (2026)
von: Ye, Ruijie, et al.
Veröffentlicht: (2026)
WaveShot: A Compact Portable Unmanned Surface Vessel for Dynamic Water Surface Videography and Media Production
von: Ma, Shijian, et al.
Veröffentlicht: (2024)
von: Ma, Shijian, et al.
Veröffentlicht: (2024)
LOGO: Video Text Spotting with Language Collaboration and Glyph Perception Model
von: Liu, Hongen, et al.
Veröffentlicht: (2024)
von: Liu, Hongen, et al.
Veröffentlicht: (2024)
Glyph: Scaling Context Windows via Visual-Text Compression
von: Cheng, Jiale, et al.
Veröffentlicht: (2025)
von: Cheng, Jiale, et al.
Veröffentlicht: (2025)
BizGen: Advancing Article-level Visual Text Rendering for Infographics Generation
von: Peng, Yuyang, et al.
Veröffentlicht: (2025)
von: Peng, Yuyang, et al.
Veröffentlicht: (2025)
LoSh: Long-Short Text Joint Prediction Network for Referring Video Object Segmentation
von: Yuan, Linfeng, et al.
Veröffentlicht: (2023)
von: Yuan, Linfeng, et al.
Veröffentlicht: (2023)
Decoupling Layout from Glyph in Online Chinese Handwriting Generation
von: Ren, Min-Si, et al.
Veröffentlicht: (2024)
von: Ren, Min-Si, et al.
Veröffentlicht: (2024)
WeEdit: A Dataset, Benchmark and Glyph-Guided Framework for Text-centric Image Editing
von: Zhang, Hui, et al.
Veröffentlicht: (2026)
von: Zhang, Hui, et al.
Veröffentlicht: (2026)
EasyText: Controllable Diffusion Transformer for Multilingual Text Rendering
von: Lu, Runnan, et al.
Veröffentlicht: (2025)
von: Lu, Runnan, et al.
Veröffentlicht: (2025)
Stroke Modeling Enables Vectorized Character Generation with Large Vectorized Glyph Model
von: Zhang, Xinyue, et al.
Veröffentlicht: (2025)
von: Zhang, Xinyue, et al.
Veröffentlicht: (2025)
FreGS: 3D Gaussian Splatting with Progressive Frequency Regularization
von: Zhang, Jiahui, et al.
Veröffentlicht: (2024)
von: Zhang, Jiahui, et al.
Veröffentlicht: (2024)
Versatile Transition Generation with Image-to-Video Diffusion
von: Yang, Zuhao, et al.
Veröffentlicht: (2025)
von: Yang, Zuhao, et al.
Veröffentlicht: (2025)
PCR-GS: COLMAP-Free 3D Gaussian Splatting via Pose Co-Regularizations
von: Wei, Yu, et al.
Veröffentlicht: (2025)
von: Wei, Yu, et al.
Veröffentlicht: (2025)
Pico-Banana-400K: A Large-Scale Dataset for Text-Guided Image Editing
von: Qian, Yusu, et al.
Veröffentlicht: (2025)
von: Qian, Yusu, et al.
Veröffentlicht: (2025)
Restore Text First, Enhance Image Later: Two-Stage Scene Text Image Super-Resolution with Glyph Structure Guidance
von: Luo, Minxing, et al.
Veröffentlicht: (2025)
von: Luo, Minxing, et al.
Veröffentlicht: (2025)
TextPixs: Glyph-Conditioned Diffusion with Character-Aware Attention and OCR-Guided Supervision
von: Gillani, Syeda Anshrah, et al.
Veröffentlicht: (2025)
von: Gillani, Syeda Anshrah, et al.
Veröffentlicht: (2025)
Empowering Backbone Models for Visual Text Generation with Input Granularity Control and Glyph-Aware Training
von: Li, Wenbo, et al.
Veröffentlicht: (2024)
von: Li, Wenbo, et al.
Veröffentlicht: (2024)
Refining Text-to-Image Generation: Towards Accurate Training-Free Glyph-Enhanced Image Generation
von: Lakhanpal, Sanyam, et al.
Veröffentlicht: (2024)
von: Lakhanpal, Sanyam, et al.
Veröffentlicht: (2024)
ControlText: Unlocking Controllable Fonts in Multilingual Text Rendering without Font Annotations
von: Jiang, Bowen, et al.
Veröffentlicht: (2025)
von: Jiang, Bowen, et al.
Veröffentlicht: (2025)
Video-Thinker: Sparking "Thinking with Videos" via Reinforcement Learning
von: Wang, Shijian, et al.
Veröffentlicht: (2025)
von: Wang, Shijian, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
AgentDisCo: Towards Disentanglement and Collaboration in Open-ended Deep Research Agents
von: Jin, Jiarui, et al.
Veröffentlicht: (2026) -
GlyphPrinter: Region-Grouped Direct Preference Optimization for Glyph-Accurate Visual Text Rendering
von: Shuai, Xincheng, et al.
Veröffentlicht: (2026) -
Glyph-ByT5: A Customized Text Encoder for Accurate Visual Text Rendering
von: Liu, Zeyu, et al.
Veröffentlicht: (2024) -
TextMaster: A Unified Framework for Realistic Text Editing via Glyph-Style Dual-Control
von: Yan, Zhenyu, et al.
Veröffentlicht: (2024) -
UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis
von: Wang, Yuanrui, et al.
Veröffentlicht: (2025)