Can We Change the Stroke Size for Easier Diffusion?
Fuente:
arXiv
Saved in:
| Main Authors: | Bai, Yunwei, Tan, Ying Kiat, Shu, Yao, Chen, Tsuhan |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
1S-DAug: One-Shot Data Augmentation for Robust Few-Shot Generalization
by: Bai, Yunwei, et al.
Published: (2026)
by: Bai, Yunwei, et al.
Published: (2026)
FSL-Rectifier: Rectify Outliers in Few-Shot Learning via Test-Time Augmentation
by: Bai, Yunwei, et al.
Published: (2024)
by: Bai, Yunwei, et al.
Published: (2024)
Aligning Text to Image in Diffusion Models is Easier Than You Think
by: Lee, Jaa-Yeon, et al.
Published: (2025)
by: Lee, Jaa-Yeon, et al.
Published: (2025)
Pixel is a Barrier: Diffusion Models Are More Adversarially Robust Than We Think
by: Xue, Haotian, et al.
Published: (2024)
by: Xue, Haotian, et al.
Published: (2024)
Organic or Diffused: Can We Distinguish Human Art from AI-generated Images?
by: Ha, Anna Yoo Jeong, et al.
Published: (2024)
by: Ha, Anna Yoo Jeong, et al.
Published: (2024)
ObjChangeVR: Object State Change Reasoning from Continuous Egocentric Views in VR Environments
by: Ding, Shiyi, et al.
Published: (2026)
by: Ding, Shiyi, et al.
Published: (2026)
Guess the Unified Model: How Much Can We Recover from Generated Images?
by: Cekinmez, Jasin, et al.
Published: (2026)
by: Cekinmez, Jasin, et al.
Published: (2026)
From Sora What We Can See: A Survey of Text-to-Video Generation
by: Sun, Rui, et al.
Published: (2024)
by: Sun, Rui, et al.
Published: (2024)
DiT-VTON: Diffusion Transformer Framework for Unified Multi-Category Virtual Try-On and Virtual Try-All with Integrated Image Editing
by: Li, Qi, et al.
Published: (2025)
by: Li, Qi, et al.
Published: (2025)
How Lightweight Can A Vision Transformer Be
by: Tan, Jen Hong
Published: (2024)
by: Tan, Jen Hong
Published: (2024)
GLYPH-SR: Can We Achieve Both High-Quality Image Super-Resolution and High-Fidelity Text Recovery via VLM-guided Latent Diffusion Model?
by: Sung, Mingyu, et al.
Published: (2025)
by: Sung, Mingyu, et al.
Published: (2025)
VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models
by: Neo, Dexter, et al.
Published: (2024)
by: Neo, Dexter, et al.
Published: (2024)
UniWeTok: An Unified Binary Tokenizer with Codebook Size $\mathit{2^{128}}$ for Unified Multimodal Large Language Model
by: Zhuang, Shaobin, et al.
Published: (2026)
by: Zhuang, Shaobin, et al.
Published: (2026)
GenArena: How Can We Achieve Human-Aligned Evaluation for Visual Generation Tasks?
by: Li, Ruihang, et al.
Published: (2026)
by: Li, Ruihang, et al.
Published: (2026)
Who Can We Trust? Scope-Aware Video Moment Retrieval with Multi-Agent Conflict
by: Wu, Chaochen, et al.
Published: (2025)
by: Wu, Chaochen, et al.
Published: (2025)
Learn the Force We Can: Enabling Sparse Motion Control in Multi-Object Video Generation
by: Davtyan, Aram, et al.
Published: (2023)
by: Davtyan, Aram, et al.
Published: (2023)
Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring
by: Chen, Guanxu, et al.
Published: (2025)
by: Chen, Guanxu, et al.
Published: (2025)
Personalized Safety Alignment for Text-to-Image Diffusion Models
by: Lei, Yu, et al.
Published: (2025)
by: Lei, Yu, et al.
Published: (2025)
SeFi-CD: A Semantic First Change Detection Paradigm That Can Detect Any Change You Want
by: Zhao, Ling, et al.
Published: (2024)
by: Zhao, Ling, et al.
Published: (2024)
Can Multi-modal (reasoning) LLMs work as deepfake detectors?
by: Ren, Simiao, et al.
Published: (2025)
by: Ren, Simiao, et al.
Published: (2025)
Unleashing Diffusion and State Space Models for Medical Image Segmentation
by: Wu, Rong, et al.
Published: (2025)
by: Wu, Rong, et al.
Published: (2025)
DetailMaster: Can Your Text-to-Image Model Handle Long Prompts?
by: Jiao, Qirui, et al.
Published: (2025)
by: Jiao, Qirui, et al.
Published: (2025)
Can VLMs Truly Forget? Benchmarking Training-Free Visual Concept Unlearning
by: Tan, Zhangyun, et al.
Published: (2026)
by: Tan, Zhangyun, et al.
Published: (2026)
AsyncDiff: Parallelizing Diffusion Models by Asynchronous Denoising
by: Chen, Zigeng, et al.
Published: (2024)
by: Chen, Zigeng, et al.
Published: (2024)
Can We Edit Multimodal Large Language Models?
by: Cheng, Siyuan, et al.
Published: (2023)
by: Cheng, Siyuan, et al.
Published: (2023)
LatentRouter: Can We Choose the Right Multimodal Model Before Seeing Its Answer?
by: Cheng, Xueqi, et al.
Published: (2026)
by: Cheng, Xueqi, et al.
Published: (2026)
Can We Generate Images with CoT? Let's Verify and Reinforce Image Generation Step by Step
by: Guo, Ziyu, et al.
Published: (2025)
by: Guo, Ziyu, et al.
Published: (2025)
Can Diffusion Models Learn Hidden Inter-Feature Rules Behind Images?
by: Han, Yujin, et al.
Published: (2025)
by: Han, Yujin, et al.
Published: (2025)
GarmentDiffusion: 3D Garment Sewing Pattern Generation with Multimodal Diffusion Transformers
by: Li, Xinyu, et al.
Published: (2025)
by: Li, Xinyu, et al.
Published: (2025)
BD-MSA: Body decouple VHR Remote Sensing Image Change Detection method guided by multi-scale feature information aggregation
by: Tan, Yonghui, et al.
Published: (2024)
by: Tan, Yonghui, et al.
Published: (2024)
DiffRegCD: Integrated Registration and Change Detection with Diffusion Features
by: Madani, Seyedehanita, et al.
Published: (2025)
by: Madani, Seyedehanita, et al.
Published: (2025)
Real-Time AI-Driven People Tracking and Counting Using Overhead Cameras
by: Ahamed, Ishrath, et al.
Published: (2024)
by: Ahamed, Ishrath, et al.
Published: (2024)
Vision-Core Guided Contrastive Learning for Balanced Multi-modal Prognosis Prediction of Stroke
by: Chen, Liren, et al.
Published: (2026)
by: Chen, Liren, et al.
Published: (2026)
MTMamba++: Enhancing Multi-Task Dense Scene Understanding via Mamba-Based Decoders
by: Lin, Baijiong, et al.
Published: (2024)
by: Lin, Baijiong, et al.
Published: (2024)
Can Shape-Infused Joint Embeddings Improve Image-Conditioned 3D Diffusion?
by: Sbrolli, Cristian, et al.
Published: (2024)
by: Sbrolli, Cristian, et al.
Published: (2024)
ChangeDiff: A Multi-Temporal Change Detection Data Generator with Flexible Text Prompts via Diffusion Model
by: Zang, Qi, et al.
Published: (2024)
by: Zang, Qi, et al.
Published: (2024)
How Far Are We from Intelligent Visual Deductive Reasoning?
by: Zhang, Yizhe, et al.
Published: (2024)
by: Zhang, Yizhe, et al.
Published: (2024)
Paired Image Generation with Diffusion-Guided Diffusion Models
by: Zhang, Haoxuan, et al.
Published: (2025)
by: Zhang, Haoxuan, et al.
Published: (2025)
MagicTailor: Component-Controllable Personalization in Text-to-Image Diffusion Models
by: Zhou, Donghao, et al.
Published: (2024)
by: Zhou, Donghao, et al.
Published: (2024)
SDiT: Spiking Diffusion Model with Transformer
by: Yang, Shu, et al.
Published: (2024)
by: Yang, Shu, et al.
Published: (2024)
Similar Items
-
1S-DAug: One-Shot Data Augmentation for Robust Few-Shot Generalization
by: Bai, Yunwei, et al.
Published: (2026) -
FSL-Rectifier: Rectify Outliers in Few-Shot Learning via Test-Time Augmentation
by: Bai, Yunwei, et al.
Published: (2024) -
Aligning Text to Image in Diffusion Models is Easier Than You Think
by: Lee, Jaa-Yeon, et al.
Published: (2025) -
Pixel is a Barrier: Diffusion Models Are More Adversarially Robust Than We Think
by: Xue, Haotian, et al.
Published: (2024) -
Organic or Diffused: Can We Distinguish Human Art from AI-generated Images?
by: Ha, Anna Yoo Jeong, et al.
Published: (2024)