Guardado en:
| Autores principales: | Chen, Hongyu, Gao, Yiqi, Zhou, Min, Wang, Peng, Li, Xubin, Ge, Tiezheng, Zheng, Bo |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2404.14768 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Differentiable Solver Search for Fast Diffusion Sampling
por: Wang, Shuai, et al.
Publicado: (2025)
por: Wang, Shuai, et al.
Publicado: (2025)
RHanDS: Refining Malformed Hands for Generated Images with Decoupled Structure and Style Guidance
por: Wang, Chengrui, et al.
Publicado: (2024)
por: Wang, Chengrui, et al.
Publicado: (2024)
Accelerating Image Generation with Sub-path Linear Approximation Model
por: Xu, Chen, et al.
Publicado: (2024)
por: Xu, Chen, et al.
Publicado: (2024)
FlowDCN: Exploring DCN-like Architectures for Fast Image Generation with Arbitrary Resolution
por: Wang, Shuai, et al.
Publicado: (2024)
por: Wang, Shuai, et al.
Publicado: (2024)
DMM: Building a Versatile Image Generation Model via Distillation-Based Model Merging
por: Song, Tianhui, et al.
Publicado: (2025)
por: Song, Tianhui, et al.
Publicado: (2025)
T-Stars-Poster: A Framework for Product-Centric Advertising Image Design
por: Chen, Hongyu, et al.
Publicado: (2025)
por: Chen, Hongyu, et al.
Publicado: (2025)
Rethinking Scribble-Guided Image Editing: Generalization, Instruction Adherence, and Multi-Tasking
por: Xu, Mingyi, et al.
Publicado: (2026)
por: Xu, Mingyi, et al.
Publicado: (2026)
PosterMaker: Towards High-Quality Product Poster Generation with Accurate Text Rendering
por: Gao, Yifan, et al.
Publicado: (2025)
por: Gao, Yifan, et al.
Publicado: (2025)
TBStar-Edit: From Image Editing Pattern Shifting to Consistency Enhancement
por: Fang, Hao, et al.
Publicado: (2025)
por: Fang, Hao, et al.
Publicado: (2025)
Hierarchical Masked 3D Diffusion Model for Video Outpainting
por: Fan, Fanda, et al.
Publicado: (2023)
por: Fan, Fanda, et al.
Publicado: (2023)
Tuning-Free Noise Rectification for High Fidelity Image-to-Video Generation
por: Li, Weijie, et al.
Publicado: (2024)
por: Li, Weijie, et al.
Publicado: (2024)
Identity-Preserving Image-to-Video Generation via Reward-Guided Optimization
por: Shen, Liao, et al.
Publicado: (2025)
por: Shen, Liao, et al.
Publicado: (2025)
Flowing Backwards: Improving Normalizing Flows via Reverse Representation Alignment
por: Chen, Yang, et al.
Publicado: (2025)
por: Chen, Yang, et al.
Publicado: (2025)
RedVTP: Training-Free Acceleration of Diffusion Vision-Language Models Inference via Masked Token-Guided Visual Token Pruning
por: Xu, Jingqi, et al.
Publicado: (2025)
por: Xu, Jingqi, et al.
Publicado: (2025)
Seg-Agent: Test-Time Multimodal Reasoning for Training-Free Language-Guided Segmentation
por: Hao, Chao, et al.
Publicado: (2026)
por: Hao, Chao, et al.
Publicado: (2026)
PEO: Training-Free Aesthetic Quality Enhancement in Pre-Trained Text-to-Image Diffusion Models with Prompt Embedding Optimization
por: Margaryan, Hovhannes, et al.
Publicado: (2025)
por: Margaryan, Hovhannes, et al.
Publicado: (2025)
CF-Font: Content Fusion for Few-shot Font Generation
por: Wang, Chi, et al.
Publicado: (2023)
por: Wang, Chi, et al.
Publicado: (2023)
Prompt-Guided Image Editing with Masked Logit Nudging in Visual Autoregressive Models
por: El-Ghoussani, Amir, et al.
Publicado: (2026)
por: El-Ghoussani, Amir, et al.
Publicado: (2026)
ControlMLLM: Training-Free Visual Prompt Learning for Multimodal Large Language Models
por: Wu, Mingrui, et al.
Publicado: (2024)
por: Wu, Mingrui, et al.
Publicado: (2024)
MADiff: Text-Guided Fashion Image Editing with Mask Prediction and Attention-Enhanced Diffusion
por: Zhan, Zechao, et al.
Publicado: (2024)
por: Zhan, Zechao, et al.
Publicado: (2024)
Beyond Point-Wise Matching: Structural Representation Alignment for Accelerating Diffusion Transformers
por: Xu, Shaodong, et al.
Publicado: (2026)
por: Xu, Shaodong, et al.
Publicado: (2026)
Decoupling Training-Free Guided Diffusion by ADMM
por: Zhang, Youyuan, et al.
Publicado: (2024)
por: Zhang, Youyuan, et al.
Publicado: (2024)
Edit-GRPO: A Locality-Preserving Policy Optimization Framework for Image Editing
por: Xu, Shaodong, et al.
Publicado: (2026)
por: Xu, Shaodong, et al.
Publicado: (2026)
ConditionVideo: Training-Free Condition-Guided Text-to-Video Generation
por: Peng, Bo, et al.
Publicado: (2023)
por: Peng, Bo, et al.
Publicado: (2023)
CtrlFuse: Mask-Prompt Guided Controllable Infrared and Visible Image Fusion
por: Sun, Yiming, et al.
Publicado: (2026)
por: Sun, Yiming, et al.
Publicado: (2026)
SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation
por: Chai, Shang, et al.
Publicado: (2025)
por: Chai, Shang, et al.
Publicado: (2025)
AtomoVideo: High Fidelity Image-to-Video Generation
por: Gong, Litong, et al.
Publicado: (2024)
por: Gong, Litong, et al.
Publicado: (2024)
Diff-Prompt: Diffusion-Driven Prompt Generator with Mask Supervision
por: Yan, Weicai, et al.
Publicado: (2025)
por: Yan, Weicai, et al.
Publicado: (2025)
Follow-Your-Shape: Shape-Aware Image Editing via Trajectory-Guided Region Control
por: Long, Zeqian, et al.
Publicado: (2025)
por: Long, Zeqian, et al.
Publicado: (2025)
Training-Free Sketch-Guided Diffusion with Latent Optimization
por: Ding, Sandra Zhang, et al.
Publicado: (2024)
por: Ding, Sandra Zhang, et al.
Publicado: (2024)
Instruction-Guided Visual Masking
por: Zheng, Jinliang, et al.
Publicado: (2024)
por: Zheng, Jinliang, et al.
Publicado: (2024)
NANO3D: A Training-Free Approach for Efficient 3D Editing Without Masks
por: Ye, Junliang, et al.
Publicado: (2025)
por: Ye, Junliang, et al.
Publicado: (2025)
GOOD: Training-Free Guided Diffusion Sampling for Out-of-Distribution Detection
por: Gao, Xin, et al.
Publicado: (2025)
por: Gao, Xin, et al.
Publicado: (2025)
Enhancing Medical Visual Grounding via Knowledge-guided Spatial Prompts
por: Gao, Yifan, et al.
Publicado: (2026)
por: Gao, Yifan, et al.
Publicado: (2026)
Token Painter: Training-Free Text-Guided Image Inpainting via Mask Autoregressive Models
por: Jiang, Longtao, et al.
Publicado: (2025)
por: Jiang, Longtao, et al.
Publicado: (2025)
Precise Action-to-Video Generation Through Visual Action Prompts
por: Wang, Yuang, et al.
Publicado: (2025)
por: Wang, Yuang, et al.
Publicado: (2025)
Beyond and Free from Diffusion: Invertible Guided Consistency Training
por: Hsu, Chia-Hong, et al.
Publicado: (2025)
por: Hsu, Chia-Hong, et al.
Publicado: (2025)
Diffusion-Guided Mask-Consistent Paired Mixing for Endoscopic Image Segmentation
por: Jie, Pengyu, et al.
Publicado: (2025)
por: Jie, Pengyu, et al.
Publicado: (2025)
PiCo: Enhancing Text-Image Alignment with Improved Noise Selection and Precise Mask Control in Diffusion Models
por: Xie, Chang, et al.
Publicado: (2025)
por: Xie, Chang, et al.
Publicado: (2025)
SEDiT: Mask-Free Video Subtitle Erasure via One-step Diffusion Transformer
por: Hui, Zheng, et al.
Publicado: (2026)
por: Hui, Zheng, et al.
Publicado: (2026)
Ejemplares similares
-
Differentiable Solver Search for Fast Diffusion Sampling
por: Wang, Shuai, et al.
Publicado: (2025) -
RHanDS: Refining Malformed Hands for Generated Images with Decoupled Structure and Style Guidance
por: Wang, Chengrui, et al.
Publicado: (2024) -
Accelerating Image Generation with Sub-path Linear Approximation Model
por: Xu, Chen, et al.
Publicado: (2024) -
FlowDCN: Exploring DCN-like Architectures for Fast Image Generation with Arbitrary Resolution
por: Wang, Shuai, et al.
Publicado: (2024) -
DMM: Building a Versatile Image Generation Model via Distillation-Based Model Merging
por: Song, Tianhui, et al.
Publicado: (2025)