Fine-Tuning Stable Diffusion XL for Stylistic Icon Generation: A Comparison of Caption Size
Fuente:
arXiv
Saved in:
| Main Authors: | Sultan, Youssef, Ma, Jiangqin, Liao, Yu-Ying |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Deep Image-to-Recipe Translation
by: Ma, Jiangqin, et al.
Published: (2024)
by: Ma, Jiangqin, et al.
Published: (2024)
Stylistic Attribute Control in Latent Diffusion Models
by: Reimann, Max, et al.
Published: (2026)
by: Reimann, Max, et al.
Published: (2026)
Efficient Image Restoration through Low-Rank Adaptation and Stable Diffusion XL
by: Zhao, Haiyang
Published: (2024)
by: Zhao, Haiyang
Published: (2024)
Generalized SAM: Efficient Fine-Tuning of SAM for Variable Input Image Sizes
by: Kato, Sota, et al.
Published: (2024)
by: Kato, Sota, et al.
Published: (2024)
Stylecodes: Encoding Stylistic Information For Image Generation
by: Rowles, Ciara
Published: (2024)
by: Rowles, Ciara
Published: (2024)
FeRA: Frequency-Energy Constrained Routing for Effective Diffusion Adaptation Fine-Tuning
by: Yin, Bo, et al.
Published: (2025)
by: Yin, Bo, et al.
Published: (2025)
DeepIcon: A Hierarchical Network for Layer-wise Icon Vectorization
by: Bing, Qi, et al.
Published: (2024)
by: Bing, Qi, et al.
Published: (2024)
Detecting Dataset Abuse in Fine-Tuning Stable Diffusion Models for Text-to-Image Synthesis
by: Wang, Songrui, et al.
Published: (2024)
by: Wang, Songrui, et al.
Published: (2024)
Diffusion-RSCC: Diffusion Probabilistic Model for Change Captioning in Remote Sensing Images
by: Yu, Xiaofei, et al.
Published: (2024)
by: Yu, Xiaofei, et al.
Published: (2024)
EasyTune: Efficient Step-Aware Fine-Tuning for Diffusion-Based Motion Generation
by: Tan, Xiaofeng, et al.
Published: (2026)
by: Tan, Xiaofeng, et al.
Published: (2026)
DomainStudio: Fine-Tuning Diffusion Models for Domain-Driven Image Generation using Limited Data
by: Zhu, Jingyuan, et al.
Published: (2023)
by: Zhu, Jingyuan, et al.
Published: (2023)
Enhancing Scientific Visual Question Answering via Vision-Caption aware Supervised Fine-Tuning
by: Kapuriya, Janak, et al.
Published: (2025)
by: Kapuriya, Janak, et al.
Published: (2025)
Gungnir: Exploiting Stylistic Features in Images for Backdoor Attacks on Diffusion Models
by: Zhang, Lei, et al.
Published: (2025)
by: Zhang, Lei, et al.
Published: (2025)
Quantitative Comparison of Fine-Tuning Techniques for Pretrained Latent Diffusion Models in the Generation of Unseen SAR Images
by: Debuysère, Solène, et al.
Published: (2025)
by: Debuysère, Solène, et al.
Published: (2025)
Sparse Fine-Tuning of Transformers for Generative Tasks
by: Chen, Wei, et al.
Published: (2025)
by: Chen, Wei, et al.
Published: (2025)
Progressive Knowledge Distillation Of Stable Diffusion XL Using Layer Level Loss
by: Gupta, Yatharth, et al.
Published: (2024)
by: Gupta, Yatharth, et al.
Published: (2024)
CycleCap: Improving VLMs Captioning Performance via Self-Supervised Cycle Consistency Fine-Tuning
by: Krestenitis, Marios, et al.
Published: (2026)
by: Krestenitis, Marios, et al.
Published: (2026)
DiffPoseTalk: Speech-Driven Stylistic 3D Facial Animation and Head Pose Generation via Diffusion Models
by: Sun, Zhiyao, et al.
Published: (2023)
by: Sun, Zhiyao, et al.
Published: (2023)
Unconditional Priors Matter! Improving Conditional Generation of Fine-Tuned Diffusion Models
by: Phunyaphibarn, Prin, et al.
Published: (2025)
by: Phunyaphibarn, Prin, et al.
Published: (2025)
COCONut-PanCap: Joint Panoptic Segmentation and Grounded Captions for Fine-Grained Understanding and Generation
by: Deng, Xueqing, et al.
Published: (2025)
by: Deng, Xueqing, et al.
Published: (2025)
Only-Style: Stylistic Consistency in Image Generation without Content Leakage
by: Aravanis, Tilemachos, et al.
Published: (2025)
by: Aravanis, Tilemachos, et al.
Published: (2025)
Peregrine: One-Shot Fine-Tuning for FHE Inference of General Deep CNNs
by: Ling, Huaming, et al.
Published: (2025)
by: Ling, Huaming, et al.
Published: (2025)
MultiModal Fine-tuning with Synthetic Captions
by: Enomoto, Shohei, et al.
Published: (2026)
by: Enomoto, Shohei, et al.
Published: (2026)
Synthetically Trained Icon Proposals for Parsing and Summarizing Infographics
by: Madan, Spandan, et al.
Published: (2018)
by: Madan, Spandan, et al.
Published: (2018)
Fine-Tuning Text-To-Image Diffusion Models for Class-Wise Spurious Feature Generation
by: MaungMaung, AprilPyone, et al.
Published: (2024)
by: MaungMaung, AprilPyone, et al.
Published: (2024)
FreeFix: Boosting 3D Gaussian Splatting via Fine-Tuning-Free Diffusion Models
by: Zhou, Hongyu, et al.
Published: (2026)
by: Zhou, Hongyu, et al.
Published: (2026)
Caption Anything in Video: Fine-grained Object-centric Captioning via Spatiotemporal Multimodal Prompting
by: Tang, Yunlong, et al.
Published: (2025)
by: Tang, Yunlong, et al.
Published: (2025)
Disentangling Fine-Tuning from Pre-Training in Visual Captioning with Hybrid Markov Logic
by: Shah, Monika, et al.
Published: (2025)
by: Shah, Monika, et al.
Published: (2025)
Bridging the Visual Gap: Fine-Tuning Multimodal Models with Knowledge-Adapted Captions
by: Yanuka, Moran, et al.
Published: (2024)
by: Yanuka, Moran, et al.
Published: (2024)
DECap: Towards Generalized Explicit Caption Editing via Diffusion Mechanism
by: Wang, Zhen, et al.
Published: (2023)
by: Wang, Zhen, et al.
Published: (2023)
Diffusion-DRF: Free, Rich, and Differentiable Reward for Video Diffusion Fine-Tuning
by: Wang, Yifan, et al.
Published: (2026)
by: Wang, Yifan, et al.
Published: (2026)
Scene Graph-guided SegCaptioning Transformer with Fine-grained Alignment for Controllable Video Segmentation and Captioning
by: Zhang, Xu, et al.
Published: (2026)
by: Zhang, Xu, et al.
Published: (2026)
FingerCap: Fine-grained Finger-level Hand Motion Captioning
by: Shen, Xin, et al.
Published: (2025)
by: Shen, Xin, et al.
Published: (2025)
Grounding Stylistic Domain Generalization with Quantitative Domain Shift Measures and Synthetic Scene Images
by: Luo, Yiran, et al.
Published: (2024)
by: Luo, Yiran, et al.
Published: (2024)
Mesh-RFT: Enhancing Mesh Generation via Fine-grained Reinforcement Fine-Tuning
by: Liu, Jian, et al.
Published: (2025)
by: Liu, Jian, et al.
Published: (2025)
MeshXL: Neural Coordinate Field for Generative 3D Foundation Models
by: Chen, Sijin, et al.
Published: (2024)
by: Chen, Sijin, et al.
Published: (2024)
VARD: Efficient and Dense Fine-Tuning for Diffusion Models with Value-based RL
by: Dai, Fengyuan, et al.
Published: (2025)
by: Dai, Fengyuan, et al.
Published: (2025)
Image-Caption Encoding for Improving Zero-Shot Generalization
by: Yu, Eric Yang, et al.
Published: (2024)
by: Yu, Eric Yang, et al.
Published: (2024)
Step-level Reward for Free in RL-based T2I Diffusion Model Fine-tuning
by: Liao, Xinyao, et al.
Published: (2025)
by: Liao, Xinyao, et al.
Published: (2025)
Fine Tuning Text-to-Image Diffusion Models for Correcting Anomalous Images
by: Yoo, Hyunwoo
Published: (2024)
by: Yoo, Hyunwoo
Published: (2024)
Similar Items
-
Deep Image-to-Recipe Translation
by: Ma, Jiangqin, et al.
Published: (2024) -
Stylistic Attribute Control in Latent Diffusion Models
by: Reimann, Max, et al.
Published: (2026) -
Efficient Image Restoration through Low-Rank Adaptation and Stable Diffusion XL
by: Zhao, Haiyang
Published: (2024) -
Generalized SAM: Efficient Fine-Tuning of SAM for Variable Input Image Sizes
by: Kato, Sota, et al.
Published: (2024) -
Stylecodes: Encoding Stylistic Information For Image Generation
by: Rowles, Ciara
Published: (2024)