StochSync: Stochastic Diffusion Synchronization for Image Generation in Arbitrary Spaces
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yeo, Kyeongmin, Kim, Jaihoon, Sung, Minhyuk |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SyncTweedies: A General Generative Framework Based on Synchronized Diffusions
par: Kim, Jaihoon, et autres
Publié: (2024)
par: Kim, Jaihoon, et autres
Publié: (2024)
MatLat: Material Latent Space for PBR Texture Generation
par: Yeo, Kyeongmin, et autres
Publié: (2025)
par: Yeo, Kyeongmin, et autres
Publié: (2025)
Moment- and Power-Spectrum-Based Gaussianity Regularization for Text-to-Image Models
par: Hwang, Jisung, et autres
Publié: (2025)
par: Hwang, Jisung, et autres
Publié: (2025)
Psi-Sampler: Initial Particle Sampling for SMC-Based Inference-Time Reward Alignment in Score Models
par: Yoon, Taehoon, et autres
Publié: (2025)
par: Yoon, Taehoon, et autres
Publié: (2025)
Inference-Time Scaling for Flow Models via Stochastic Generation and Rollover Budget Forcing
par: Kim, Jaihoon, et autres
Publié: (2025)
par: Kim, Jaihoon, et autres
Publié: (2025)
Unconditional Priors Matter! Improving Conditional Generation of Fine-Tuned Diffusion Models
par: Phunyaphibarn, Prin, et autres
Publié: (2025)
par: Phunyaphibarn, Prin, et autres
Publié: (2025)
Neural Pose Representation Learning for Generating and Transferring Non-Rigid Object Poses
par: Yoo, Seungwoo, et autres
Publié: (2024)
par: Yoo, Seungwoo, et autres
Publié: (2024)
ORIGEN: Zero-Shot 3D Orientation Grounding in Text-to-Image Generation
par: Min, Yunhong, et autres
Publié: (2025)
par: Min, Yunhong, et autres
Publié: (2025)
AlignDiT: Multimodal Aligned Diffusion Transformer for Synchronized Speech Generation
par: Choi, Jeongsoo, et autres
Publié: (2025)
par: Choi, Jeongsoo, et autres
Publié: (2025)
SyncMask: Synchronized Attentional Masking for Fashion-centric Vision-Language Pretraining
par: Song, Chull Hwan, et autres
Publié: (2024)
par: Song, Chull Hwan, et autres
Publié: (2024)
SyncVSR: Data-Efficient Visual Speech Recognition with End-to-End Crossmodal Audio Token Synchronization
par: Ahn, Young Jin, et autres
Publié: (2024)
par: Ahn, Young Jin, et autres
Publié: (2024)
SyncDiff: Synchronized Motion Diffusion for Multi-Body Human-Object Interaction Synthesis
par: He, Wenkun, et autres
Publié: (2024)
par: He, Wenkun, et autres
Publié: (2024)
SyncDreamer: Generating Multiview-consistent Images from a Single-view Image
par: Liu, Yuan, et autres
Publié: (2023)
par: Liu, Yuan, et autres
Publié: (2023)
StorySync: Training-Free Subject Consistency in Text-to-Image Generation via Region Harmonization
par: Gaur, Gopalji, et autres
Publié: (2025)
par: Gaur, Gopalji, et autres
Publié: (2025)
Self-Cascaded Diffusion Models for Arbitrary-Scale Image Super-Resolution
par: Bang, Junseo, et autres
Publié: (2025)
par: Bang, Junseo, et autres
Publié: (2025)
Diffuse Everything: Multimodal Diffusion Models on Arbitrary State Spaces
par: Rojas, Kevin, et autres
Publié: (2025)
par: Rojas, Kevin, et autres
Publié: (2025)
Audio-Sync Video Generation with Multi-Stream Temporal Control
par: Weng, Shuchen, et autres
Publié: (2025)
par: Weng, Shuchen, et autres
Publié: (2025)
Visual Sync: Multi-Camera Synchronization via Cross-View Object Motion
par: Liu, Shaowei, et autres
Publié: (2025)
par: Liu, Shaowei, et autres
Publié: (2025)
MoonMetaSync: Lunar Image Registration Analysis
par: Kumar, Ashutosh, et autres
Publié: (2024)
par: Kumar, Ashutosh, et autres
Publié: (2024)
VideoICL: Confidence-based Iterative In-context Learning for Out-of-Distribution Video Understanding
par: Kim, Kangsan, et autres
Publié: (2024)
par: Kim, Kangsan, et autres
Publié: (2024)
Conditional Diffusion Model for Longitudinal Medical Image Generation
par: Dao, Duy-Phuong, et autres
Publié: (2024)
par: Dao, Duy-Phuong, et autres
Publié: (2024)
LSSGen: Leveraging Latent Space Scaling in Flow and Diffusion for Efficient Text to Image Generation
par: Tang, Jyun-Ze, et autres
Publié: (2025)
par: Tang, Jyun-Ze, et autres
Publié: (2025)
APT: Improving Diffusion Models for High Resolution Image Generation with Adaptive Path Tracing
par: Han, Sangmin, et autres
Publié: (2025)
par: Han, Sangmin, et autres
Publié: (2025)
H2-Cache: A Novel Hierarchical Dual-Stage Cache for High-Performance Acceleration of Generative Diffusion Models
par: Sung, Mingyu, et autres
Publié: (2025)
par: Sung, Mingyu, et autres
Publié: (2025)
Leveraging Generative AI Models to Explore Human Identity
par: Yeo, Yunha, et autres
Publié: (2025)
par: Yeo, Yunha, et autres
Publié: (2025)
Normalization Equivariance for Arbitrary Backbones, with Application to Image Denoising
par: Saied, Youssef, et autres
Publié: (2026)
par: Saied, Youssef, et autres
Publié: (2026)
MA-EgoQA: Question Answering over Egocentric Videos from Multiple Embodied Agents
par: Kim, Kangsan, et autres
Publié: (2026)
par: Kim, Kangsan, et autres
Publié: (2026)
Any-to-Bokeh: Arbitrary-Subject Video Refocusing with Video Diffusion Model
par: Yang, Yang, et autres
Publié: (2025)
par: Yang, Yang, et autres
Publié: (2025)
LIFT and PLACE: A Simple, Stable, and Effective Knowledge Distillation Framework for Lightweight Diffusion Models
par: Han, Hyunsoo, et autres
Publié: (2026)
par: Han, Hyunsoo, et autres
Publié: (2026)
DocShaDiffusion: Diffusion Model in Latent Space for Document Image Shadow Removal
par: Liu, Wenjie, et autres
Publié: (2025)
par: Liu, Wenjie, et autres
Publié: (2025)
RIHA: Report-Image Hierarchical Alignment for Radiology Report Generation
par: Chen, Yucheng, et autres
Publié: (2026)
par: Chen, Yucheng, et autres
Publié: (2026)
Diffusion Model in Latent Space for Medical Image Segmentation Task
par: Ngoc, Huynh Trinh, et autres
Publié: (2025)
par: Ngoc, Huynh Trinh, et autres
Publié: (2025)
Unleashing Diffusion and State Space Models for Medical Image Segmentation
par: Wu, Rong, et autres
Publié: (2025)
par: Wu, Rong, et autres
Publié: (2025)
Text2Lip: Progressive Lip-Synced Talking Face Generation from Text via Viseme-Guided Rendering
par: Wang, Xu, et autres
Publié: (2025)
par: Wang, Xu, et autres
Publié: (2025)
Omni-Dish: Photorealistic and Faithful Image Generation and Editing for Arbitrary Chinese Dishes
par: Liu, Huijie, et autres
Publié: (2025)
par: Liu, Huijie, et autres
Publié: (2025)
Paired Image Generation with Diffusion-Guided Diffusion Models
par: Zhang, Haoxuan, et autres
Publié: (2025)
par: Zhang, Haoxuan, et autres
Publié: (2025)
D2Styler: Advancing Arbitrary Style Transfer with Discrete Diffusion Methods
par: Susladkar, Onkar, et autres
Publié: (2024)
par: Susladkar, Onkar, et autres
Publié: (2024)
In-Context Sync-LoRA for Portrait Video Editing
par: Polaczek, Sagi, et autres
Publié: (2025)
par: Polaczek, Sagi, et autres
Publié: (2025)
GLYPH-SR: Can We Achieve Both High-Quality Image Super-Resolution and High-Fidelity Text Recovery via VLM-guided Latent Diffusion Model?
par: Sung, Mingyu, et autres
Publié: (2025)
par: Sung, Mingyu, et autres
Publié: (2025)
HiCAST: Highly Customized Arbitrary Style Transfer with Adapter Enhanced Diffusion Models
par: Wang, Hanzhang, et autres
Publié: (2024)
par: Wang, Hanzhang, et autres
Publié: (2024)
Documents similaires
-
SyncTweedies: A General Generative Framework Based on Synchronized Diffusions
par: Kim, Jaihoon, et autres
Publié: (2024) -
MatLat: Material Latent Space for PBR Texture Generation
par: Yeo, Kyeongmin, et autres
Publié: (2025) -
Moment- and Power-Spectrum-Based Gaussianity Regularization for Text-to-Image Models
par: Hwang, Jisung, et autres
Publié: (2025) -
Psi-Sampler: Initial Particle Sampling for SMC-Based Inference-Time Reward Alignment in Score Models
par: Yoon, Taehoon, et autres
Publié: (2025) -
Inference-Time Scaling for Flow Models via Stochastic Generation and Rollover Budget Forcing
par: Kim, Jaihoon, et autres
Publié: (2025)