Salvato in:
| Autori principali: | Shen, Fei, Ye, Hu, Liu, Sibo, Zhang, Jun, Wang, Cong, Han, Xiao, Yang, Wei |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2407.02482 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Advancing Pose-Guided Image Synthesis with Progressive Conditional Diffusion Models
di: Shen, Fei, et al.
Pubblicazione: (2023)
di: Shen, Fei, et al.
Pubblicazione: (2023)
StoryGPT-V: Large Language Models as Consistent Story Visualizers
di: Shen, Xiaoqian, et al.
Pubblicazione: (2023)
di: Shen, Xiaoqian, et al.
Pubblicazione: (2023)
Adaptive Visual Conditioning for Semantic Consistency in Diffusion-Based Story Continuation
di: Mousavi, Seyed Mohammad, et al.
Pubblicazione: (2025)
di: Mousavi, Seyed Mohammad, et al.
Pubblicazione: (2025)
ReDiStory: Region-Disentangled Diffusion for Consistent Visual Story Generation
di: Sarkar, Ayushman, et al.
Pubblicazione: (2026)
di: Sarkar, Ayushman, et al.
Pubblicazione: (2026)
Object Isolated Attention for Consistent Story Visualization
di: Luo, Xiangyang, et al.
Pubblicazione: (2025)
di: Luo, Xiangyang, et al.
Pubblicazione: (2025)
StoryTailor:A Zero-Shot Pipeline for Action-Rich Multi-Subject Visual Narratives
di: Hu, Jinghao, et al.
Pubblicazione: (2026)
di: Hu, Jinghao, et al.
Pubblicazione: (2026)
DreamStory: Open-Domain Story Visualization by LLM-Guided Multi-Subject Consistent Diffusion
di: He, Huiguo, et al.
Pubblicazione: (2024)
di: He, Huiguo, et al.
Pubblicazione: (2024)
ContextualStory: Consistent Visual Storytelling with Spatially-Enhanced and Storyline Context
di: Zheng, Sixiao, et al.
Pubblicazione: (2024)
di: Zheng, Sixiao, et al.
Pubblicazione: (2024)
Visual-Aware CoT: Achieving High-Fidelity Visual Consistency in Unified Models
di: Ye, Zixuan, et al.
Pubblicazione: (2025)
di: Ye, Zixuan, et al.
Pubblicazione: (2025)
Audit & Repair: An Agentic Framework for Consistent Story Visualization in Text-to-Image Diffusion Models
di: Akdemir, Kiymet, et al.
Pubblicazione: (2025)
di: Akdemir, Kiymet, et al.
Pubblicazione: (2025)
MegaStyle: Constructing Diverse and Scalable Style Dataset via Consistent Text-to-Image Style Mapping
di: Gao, Junyao, et al.
Pubblicazione: (2026)
di: Gao, Junyao, et al.
Pubblicazione: (2026)
ViSTA: Visual Storytelling using Multi-modal Adapters for Text-to-Image Diffusion Models
di: Dong, Sibo, et al.
Pubblicazione: (2025)
di: Dong, Sibo, et al.
Pubblicazione: (2025)
V-Express: Conditional Dropout for Progressive Training of Portrait Video Generation
di: Wang, Cong, et al.
Pubblicazione: (2024)
di: Wang, Cong, et al.
Pubblicazione: (2024)
SceneDecorator: Towards Scene-Oriented Story Generation with Scene Planning and Scene Consistency
di: Song, Quanjian, et al.
Pubblicazione: (2025)
di: Song, Quanjian, et al.
Pubblicazione: (2025)
ConsistI2V: Enhancing Visual Consistency for Image-to-Video Generation
di: Ren, Weiming, et al.
Pubblicazione: (2024)
di: Ren, Weiming, et al.
Pubblicazione: (2024)
HDR Reconstruction Boosting with Training-Free and Exposure-Consistent Diffusion
di: Lin, Yo-Tin, et al.
Pubblicazione: (2026)
di: Lin, Yo-Tin, et al.
Pubblicazione: (2026)
Ensembling Diffusion Models via Adaptive Feature Aggregation
di: Wang, Cong, et al.
Pubblicazione: (2024)
di: Wang, Cong, et al.
Pubblicazione: (2024)
Generative Compositor for Few-Shot Visual Information Extraction
di: Yang, Zhibo, et al.
Pubblicazione: (2025)
di: Yang, Zhibo, et al.
Pubblicazione: (2025)
Long-Term TalkingFace Generation via Motion-Prior Conditional Diffusion Model
di: Shen, Fei, et al.
Pubblicazione: (2025)
di: Shen, Fei, et al.
Pubblicazione: (2025)
Few-shot Defect Image Generation based on Consistency Modeling
di: Shi, Qingfeng, et al.
Pubblicazione: (2024)
di: Shi, Qingfeng, et al.
Pubblicazione: (2024)
D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples
di: Hu, Zijing, et al.
Pubblicazione: (2025)
di: Hu, Zijing, et al.
Pubblicazione: (2025)
UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis
di: Wang, Yuanrui, et al.
Pubblicazione: (2025)
di: Wang, Yuanrui, et al.
Pubblicazione: (2025)
ViStoryBench: Comprehensive Benchmark Suite for Story Visualization
di: Zhuang, Cailin, et al.
Pubblicazione: (2025)
di: Zhuang, Cailin, et al.
Pubblicazione: (2025)
Bayesian-Optimized One-Step Diffusion Model with Knowledge Distillation for Real-Time 3D Human Motion Prediction
di: Tian, Sibo, et al.
Pubblicazione: (2024)
di: Tian, Sibo, et al.
Pubblicazione: (2024)
LTRL: Boosting Long-tail Recognition via Reflective Learning
di: Zhao, Qihao, et al.
Pubblicazione: (2024)
di: Zhao, Qihao, et al.
Pubblicazione: (2024)
Towards Multi-View Consistent Style Transfer with One-Step Diffusion via Vision Conditioning
di: Zuo, Yushen, et al.
Pubblicazione: (2024)
di: Zuo, Yushen, et al.
Pubblicazione: (2024)
Relation-Rich Visual Document Generator for Visual Information Extraction
di: Jiang, Zi-Han, et al.
Pubblicazione: (2025)
di: Jiang, Zi-Han, et al.
Pubblicazione: (2025)
Magic-Boost: Boost 3D Generation with Multi-View Conditioned Diffusion
di: Yang, Fan, et al.
Pubblicazione: (2024)
di: Yang, Fan, et al.
Pubblicazione: (2024)
Semantically Consistent Video Inpainting with Conditional Diffusion Models
di: Green, Dylan, et al.
Pubblicazione: (2024)
di: Green, Dylan, et al.
Pubblicazione: (2024)
ACT-Diffusion: Efficient Adversarial Consistency Training for One-step Diffusion Models
di: Kong, Fei, et al.
Pubblicazione: (2023)
di: Kong, Fei, et al.
Pubblicazione: (2023)
One-Step Diffusion for Detail-Rich and Temporally Consistent Video Super-Resolution
di: Sun, Yujing, et al.
Pubblicazione: (2025)
di: Sun, Yujing, et al.
Pubblicazione: (2025)
DCI: Dual-Conditional Inversion for Boosting Diffusion-Based Image Editing
di: Li, Zixiang, et al.
Pubblicazione: (2025)
di: Li, Zixiang, et al.
Pubblicazione: (2025)
DC-ControlNet: Decoupling Inter- and Intra-Element Conditions in Image Generation with Diffusion Models
di: Yang, Hongji, et al.
Pubblicazione: (2025)
di: Yang, Hongji, et al.
Pubblicazione: (2025)
Generalized Visual Relation Detection with Diffusion Models
di: Gao, Kaifeng, et al.
Pubblicazione: (2025)
di: Gao, Kaifeng, et al.
Pubblicazione: (2025)
Solving Inverse Problems with Latent Diffusion Models via Hard Data Consistency
di: Song, Bowen, et al.
Pubblicazione: (2023)
di: Song, Bowen, et al.
Pubblicazione: (2023)
StoryDiffusion: Consistent Self-Attention for Long-Range Image and Video Generation
di: Zhou, Yupeng, et al.
Pubblicazione: (2024)
di: Zhou, Yupeng, et al.
Pubblicazione: (2024)
D-Feat Occlusions: Diffusion Features for Robustness to Partial Visual Occlusions in Object Recognition
di: Mallick, Rupayan, et al.
Pubblicazione: (2025)
di: Mallick, Rupayan, et al.
Pubblicazione: (2025)
Boost 3D Reconstruction using Diffusion-based Monocular Camera Calibration
di: Deng, Junyuan, et al.
Pubblicazione: (2024)
di: Deng, Junyuan, et al.
Pubblicazione: (2024)
Contextualized Visual Personalization in Vision-Language Models
di: Oh, Yeongtak, et al.
Pubblicazione: (2026)
di: Oh, Yeongtak, et al.
Pubblicazione: (2026)
ConsistTalk: Intensity Controllable Temporally Consistent Talking Head Generation with Diffusion Noise Search
di: Liu, Zhenjie, et al.
Pubblicazione: (2025)
di: Liu, Zhenjie, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Advancing Pose-Guided Image Synthesis with Progressive Conditional Diffusion Models
di: Shen, Fei, et al.
Pubblicazione: (2023) -
StoryGPT-V: Large Language Models as Consistent Story Visualizers
di: Shen, Xiaoqian, et al.
Pubblicazione: (2023) -
Adaptive Visual Conditioning for Semantic Consistency in Diffusion-Based Story Continuation
di: Mousavi, Seyed Mohammad, et al.
Pubblicazione: (2025) -
ReDiStory: Region-Disentangled Diffusion for Consistent Visual Story Generation
di: Sarkar, Ayushman, et al.
Pubblicazione: (2026) -
Object Isolated Attention for Consistent Story Visualization
di: Luo, Xiangyang, et al.
Pubblicazione: (2025)