VitaGlyph: Vitalizing Artistic Typography with Flexible Dual-branch Diffusion Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Feng, Kailai, Zhang, Yabo, Yu, Haodong, Ji, Zhilong, Bai, Jinfeng, Zhang, Hongzhi, Zuo, Wangmeng |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MasterWeaver: Taming Editability and Face Identity for Personalized Text-to-Image Generation
par: Wei, Yuxiang, et autres
Publié: (2024)
par: Wei, Yuxiang, et autres
Publié: (2024)
ScrollScape: Unlocking 32K Image Generation With Video Diffusion Priors
par: Yu, Haodong, et autres
Publié: (2026)
par: Yu, Haodong, et autres
Publié: (2026)
AnyArtisticGlyph: Multilingual Controllable Artistic Glyph Generation
par: Lu, Xiongbo, et autres
Publié: (2025)
par: Lu, Xiongbo, et autres
Publié: (2025)
Personalized Image Generation with Deep Generative Models: A Decade Survey
par: Wei, Yuxiang, et autres
Publié: (2025)
par: Wei, Yuxiang, et autres
Publié: (2025)
Intelligent Artistic Typography: A Comprehensive Review of Artistic Text Design and Generation
par: Bai, Yuhang, et autres
Publié: (2024)
par: Bai, Yuhang, et autres
Publié: (2024)
Self-Supervised Learning for Real-World Super-Resolution from Dual and Multiple Zoomed Observations
par: Zhang, Zhilu, et autres
Publié: (2024)
par: Zhang, Zhilu, et autres
Publié: (2024)
LLM as a Complementary Optimizer to Gradient Descent: A Case Study in Prompt Tuning
par: Guo, Zixian, et autres
Publié: (2024)
par: Guo, Zixian, et autres
Publié: (2024)
MDIQA: Unified Image Quality Assessment for Multi-dimensional Evaluation and Restoration
par: Yao, Shunyu, et autres
Publié: (2025)
par: Yao, Shunyu, et autres
Publié: (2025)
WordCraft: Interactive Artistic Typography with Attention Awareness and Noise Blending
par: Wang, Zhe, et autres
Publié: (2025)
par: Wang, Zhe, et autres
Publié: (2025)
MC$^2$: Multi-concept Guidance for Customized Multi-concept Generation
par: Jiang, Jiaxiu, et autres
Publié: (2024)
par: Jiang, Jiaxiu, et autres
Publié: (2024)
FramePainter: Endowing Interactive Image Editing with Video Diffusion Priors
par: Zhang, Yabo, et autres
Publié: (2025)
par: Zhang, Yabo, et autres
Publié: (2025)
WordArt Designer API: User-Driven Artistic Typography Synthesis with Large Language Models on ModelScope
par: He, Jun-Yan, et autres
Publié: (2024)
par: He, Jun-Yan, et autres
Publié: (2024)
VideoElevator: Elevating Video Generation Quality with Versatile Text-to-Image Diffusion Models
par: Zhang, Yabo, et autres
Publié: (2024)
par: Zhang, Yabo, et autres
Publié: (2024)
Dual-Camera Smooth Zoom on Mobile Phones
par: Wu, Renlong, et autres
Publié: (2024)
par: Wu, Renlong, et autres
Publié: (2024)
Kinetic Typography Diffusion Model
par: Park, Seonmi, et autres
Publié: (2024)
par: Park, Seonmi, et autres
Publié: (2024)
Image Demoiréing Using Dual Camera Fusion on Mobile Phones
par: Mei, Yanting, et autres
Publié: (2025)
par: Mei, Yanting, et autres
Publié: (2025)
Premier: Personalized Preference Modulation with Learnable User Embedding in Text-to-Image Generation
par: Wang, Zihao, et autres
Publié: (2026)
par: Wang, Zihao, et autres
Publié: (2026)
Tool-R1: Sample-Efficient Reinforcement Learning for Agentic Tool Use
par: Zhang, Yabo, et autres
Publié: (2025)
par: Zhang, Yabo, et autres
Publié: (2025)
Pseudo-Label Guided Real-World Image De-weathering: A Learning Framework with Imperfect Supervision
par: Xu, Heming, et autres
Publié: (2025)
par: Xu, Heming, et autres
Publié: (2025)
Bridging Geometry-Coherent Text-to-3D Generation with Multi-View Diffusion Priors and Gaussian Splatting
par: Yang, Feng, et autres
Publié: (2025)
par: Yang, Feng, et autres
Publié: (2025)
Dynamic Typography: Bringing Text to Life via Video Diffusion Prior
par: Liu, Zichen, et autres
Publié: (2024)
par: Liu, Zichen, et autres
Publié: (2024)
MV-VTON: Multi-View Virtual Try-On with Diffusion Models
par: Wang, Haoyu, et autres
Publié: (2024)
par: Wang, Haoyu, et autres
Publié: (2024)
AnE: Pushing the Reasoning Frontier of Multimodal LLMs via Anchor Evolution
par: Wang, Zehao, et autres
Publié: (2026)
par: Wang, Zehao, et autres
Publié: (2026)
FedSmoothLoRA: Toward Smoother and Faster Convergence in Federated Low-Rank Adaptation
par: Wang, Zehao, et autres
Publié: (2026)
par: Wang, Zehao, et autres
Publié: (2026)
PhysChoreo: Physics-Controllable Video Generation with Part-Aware Semantic Grounding
par: Zhang, Haoze, et autres
Publié: (2025)
par: Zhang, Haoze, et autres
Publié: (2025)
UniRestorer: Universal Image Restoration via Adaptively Estimating Image Degradation at Proper Granularity
par: Lin, Jingbo, et autres
Publié: (2024)
par: Lin, Jingbo, et autres
Publié: (2024)
GlyphDraw2: Automatic Generation of Complex Glyph Posters with Diffusion Models and Large Language Models
par: Ma, Jian, et autres
Publié: (2024)
par: Ma, Jian, et autres
Publié: (2024)
HPNet: Dynamic Trajectory Forecasting with Historical Prediction Attention
par: Tang, Xiaolong, et autres
Publié: (2024)
par: Tang, Xiaolong, et autres
Publié: (2024)
AnimateAnywhere: Rouse the Background in Human Image Animation
par: Liu, Xiaoyu, et autres
Publié: (2025)
par: Liu, Xiaoyu, et autres
Publié: (2025)
ArtNVG: Content-Style Separated Artistic Neighboring-View Gaussian Stylization
par: Gu, Zixiao, et autres
Publié: (2024)
par: Gu, Zixiao, et autres
Publié: (2024)
Rethinking Transformer-Based Blind-Spot Network for Self-Supervised Image Denoising
par: Li, Junyi, et autres
Publié: (2024)
par: Li, Junyi, et autres
Publié: (2024)
WordCon: Word-level Typography Control in Scene Text Rendering
par: Shi, Wenda, et autres
Publié: (2025)
par: Shi, Wenda, et autres
Publié: (2025)
EmoArt: A Multidimensional Dataset for Emotion-Aware Artistic Generation
par: Zhang, Cheng, et autres
Publié: (2025)
par: Zhang, Cheng, et autres
Publié: (2025)
Dual-branch Prompting for Multimodal Machine Translation
par: Wang, Jie, et autres
Publié: (2025)
par: Wang, Jie, et autres
Publié: (2025)
Explicit Relational Reasoning Network for Scene Text Detection
par: Su, Yuchen, et autres
Publié: (2024)
par: Su, Yuchen, et autres
Publié: (2024)
GlyphMastero: A Glyph Encoder for High-Fidelity Scene Text Editing
par: Wang, Tong, et autres
Publié: (2025)
par: Wang, Tong, et autres
Publié: (2025)
ConSept: Continual Semantic Segmentation via Adapter-based Vision Transformer
par: Dong, Bowen, et autres
Publié: (2024)
par: Dong, Bowen, et autres
Publié: (2024)
Responsible Visual Editing
par: Ni, Minheng, et autres
Publié: (2024)
par: Ni, Minheng, et autres
Publié: (2024)
Visual-O1: Understanding Ambiguous Instructions via Multi-modal Multi-turn Chain-of-thoughts Reasoning
par: Ni, Minheng, et autres
Publié: (2024)
par: Ni, Minheng, et autres
Publié: (2024)
NIR-Assisted Image Denoising: A Selective Fusion Approach and A Real-World Benchmark Dataset
par: Xu, Rongjian, et autres
Publié: (2024)
par: Xu, Rongjian, et autres
Publié: (2024)
Documents similaires
-
MasterWeaver: Taming Editability and Face Identity for Personalized Text-to-Image Generation
par: Wei, Yuxiang, et autres
Publié: (2024) -
ScrollScape: Unlocking 32K Image Generation With Video Diffusion Priors
par: Yu, Haodong, et autres
Publié: (2026) -
AnyArtisticGlyph: Multilingual Controllable Artistic Glyph Generation
par: Lu, Xiongbo, et autres
Publié: (2025) -
Personalized Image Generation with Deep Generative Models: A Decade Survey
par: Wei, Yuxiang, et autres
Publié: (2025) -
Intelligent Artistic Typography: A Comprehensive Review of Artistic Text Design and Generation
par: Bai, Yuhang, et autres
Publié: (2024)