HieraFashDiff: Hierarchical Fashion Design with Multi-stage Diffusion Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Xie, Zhifeng, Li, Hao, Ding, Huiming, Li, Mengtian, Di, Xinhan, Cao, Ying |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
FoleyDesigner: Immersive Stereo Foley Generation with Precise Spatio-Temporal Alignment for Film Clips
di: Li, Mengtian, et al.
Pubblicazione: (2026)
di: Li, Mengtian, et al.
Pubblicazione: (2026)
HieraVid: Hierarchical Token Pruning for Fast Video Large Language Models
di: Guo, Yansong, et al.
Pubblicazione: (2026)
di: Guo, Yansong, et al.
Pubblicazione: (2026)
GaussianBody: Clothed Human Reconstruction via 3d Gaussian Splatting
di: Li, Mengtian, et al.
Pubblicazione: (2024)
di: Li, Mengtian, et al.
Pubblicazione: (2024)
HieraSurg: Hierarchy-Aware Diffusion Model for Surgical Video Generation
di: Biagini, Diego, et al.
Pubblicazione: (2025)
di: Biagini, Diego, et al.
Pubblicazione: (2025)
OCC-MLLM-Alpha:Empowering Multi-modal Large Language Model for the Understanding of Occluded Objects with Self-Supervised Test-Time Learning
di: Yang, Shuxin, et al.
Pubblicazione: (2024)
di: Yang, Shuxin, et al.
Pubblicazione: (2024)
GardenDesigner: Encoding Aesthetic Principles into Jiangnan Garden Construction via a Chain of Agents
di: Li, Mengtian, et al.
Pubblicazione: (2026)
di: Li, Mengtian, et al.
Pubblicazione: (2026)
FilmSceneDesigner: Chaining Set Design for Procedural Film Scene Generation
di: Xie, Zhifeng, et al.
Pubblicazione: (2025)
di: Xie, Zhifeng, et al.
Pubblicazione: (2025)
OCC-MLLM-CoT-Alpha: Towards Multi-stage Occlusion Recognition Based on Large Language Models via 3D-Aware Supervision and Chain-of-Thoughts Guidance
di: Wang, Chaoyi, et al.
Pubblicazione: (2025)
di: Wang, Chaoyi, et al.
Pubblicazione: (2025)
HieraMamba: Video Temporal Grounding via Hierarchical Anchor-Mamba Pooling
di: An, Joungbin, et al.
Pubblicazione: (2025)
di: An, Joungbin, et al.
Pubblicazione: (2025)
OCC-MLLM:Empowering Multimodal Large Language Model For the Understanding of Occluded Objects
di: Qiu, Wenmo, et al.
Pubblicazione: (2024)
di: Qiu, Wenmo, et al.
Pubblicazione: (2024)
Low-Rank Adaptation with Task-Relevant Feature Enhancement for Fine-tuning Language Models
di: Li, Changqun, et al.
Pubblicazione: (2024)
di: Li, Changqun, et al.
Pubblicazione: (2024)
HieraRS: A Hierarchical Segmentation Paradigm for Remote Sensing Enabling Multi-Granularity Interpretation and Cross-Domain Transfer
di: Ai, Tianlong, et al.
Pubblicazione: (2025)
di: Ai, Tianlong, et al.
Pubblicazione: (2025)
DeepDubber-V1: Towards High Quality and Dialogue, Narration, Monologue Adaptive Movie Dubbing Via Multi-Modal Chain-of-Thoughts Reasoning Guidance
di: Zheng, Junjie, et al.
Pubblicazione: (2025)
di: Zheng, Junjie, et al.
Pubblicazione: (2025)
Diff-Reg v1: Diffusion Matching Model for Registration Problem
di: Wu, Qianliang, et al.
Pubblicazione: (2024)
di: Wu, Qianliang, et al.
Pubblicazione: (2024)
EpiDiff: Enhancing Multi-View Synthesis via Localized Epipolar-Constrained Diffusion
di: Huang, Zehuan, et al.
Pubblicazione: (2023)
di: Huang, Zehuan, et al.
Pubblicazione: (2023)
HieraTok: Multi-Scale Visual Tokenizer Improves Image Reconstruction and Generation
di: Chen, Cong, et al.
Pubblicazione: (2025)
di: Chen, Cong, et al.
Pubblicazione: (2025)
Infinite Motion: Extended Motion Generation via Long Text Instructions
di: Li, Mengtian, et al.
Pubblicazione: (2024)
di: Li, Mengtian, et al.
Pubblicazione: (2024)
VERTIGO: Visual Preference Optimization for Cinematic Camera Trajectory Generation
di: Li, Mengtian, et al.
Pubblicazione: (2026)
di: Li, Mengtian, et al.
Pubblicazione: (2026)
OmniFashion: Towards Generalist Fashion Intelligence via Multi-Task Vision-Language Learning
di: Yang, Zhengwei, et al.
Pubblicazione: (2026)
di: Yang, Zhengwei, et al.
Pubblicazione: (2026)
LAPTOP-Diff: Layer Pruning and Normalized Distillation for Compressing Diffusion Models
di: Zhang, Dingkun, et al.
Pubblicazione: (2024)
di: Zhang, Dingkun, et al.
Pubblicazione: (2024)
SemMorph3D: Unsupervised Semantic-Aware 3D Morphing via Mesh-Guided Gaussians
di: Li, Mengtian, et al.
Pubblicazione: (2025)
di: Li, Mengtian, et al.
Pubblicazione: (2025)
AniGaussian: Animatable Gaussian Avatar with Pose-guided Deformation
di: Li, Mengtian, et al.
Pubblicazione: (2025)
di: Li, Mengtian, et al.
Pubblicazione: (2025)
DiffProxy: Multi-View Human Mesh Recovery via Diffusion-Generated Dense Proxies
di: Wang, Renke, et al.
Pubblicazione: (2026)
di: Wang, Renke, et al.
Pubblicazione: (2026)
Fashion-VDM: Video Diffusion Model for Virtual Try-On
di: Karras, Johanna, et al.
Pubblicazione: (2024)
di: Karras, Johanna, et al.
Pubblicazione: (2024)
RoomDiffusion: A Specialized Diffusion Model in the Interior Design Industry
di: Wang, Zhaowei, et al.
Pubblicazione: (2024)
di: Wang, Zhaowei, et al.
Pubblicazione: (2024)
DiffIER: Optimizing Diffusion Models with Iterative Error Reduction
di: Chen, Ao, et al.
Pubblicazione: (2025)
di: Chen, Ao, et al.
Pubblicazione: (2025)
AdaDiff: Accelerating Diffusion Models through Step-Wise Adaptive Computation
di: Tang, Shengkun, et al.
Pubblicazione: (2023)
di: Tang, Shengkun, et al.
Pubblicazione: (2023)
MM-MovieDubber: Towards Multi-Modal Learning for Multi-Modal Movie Dubbing
di: Zheng, Junjie, et al.
Pubblicazione: (2025)
di: Zheng, Junjie, et al.
Pubblicazione: (2025)
FilmComposer: LLM-Driven Music Production for Silent Film Clips
di: Xie, Zhifeng, et al.
Pubblicazione: (2025)
di: Xie, Zhifeng, et al.
Pubblicazione: (2025)
DiffKD-DCIS: Predicting Upgrade of Ductal Carcinoma In Situ with Diffusion Augmentation and Knowledge Distillation
di: Li, Tao, et al.
Pubblicazione: (2026)
di: Li, Tao, et al.
Pubblicazione: (2026)
Raccoon: Multi-stage Diffusion Training with Coarse-to-Fine Curating Videos
di: Tan, Zhiyu, et al.
Pubblicazione: (2025)
di: Tan, Zhiyu, et al.
Pubblicazione: (2025)
DiffPCN: Latent Diffusion Model Based on Multi-view Depth Images for Point Cloud Completion
di: Li, Zijun, et al.
Pubblicazione: (2025)
di: Li, Zijun, et al.
Pubblicazione: (2025)
FedDiff: Diffusion Model Driven Federated Learning for Multi-Modal and Multi-Clients
di: Li, DaiXun, et al.
Pubblicazione: (2023)
di: Li, DaiXun, et al.
Pubblicazione: (2023)
FashionFlow: Leveraging Diffusion Models for Dynamic Fashion Video Synthesis from Static Imagery
di: Islam, Tasin, et al.
Pubblicazione: (2023)
di: Islam, Tasin, et al.
Pubblicazione: (2023)
FOD-Diff: 3D Multi-Channel Patch Diffusion Model for Fiber Orientation Distribution
di: Tang, Hao, et al.
Pubblicazione: (2025)
di: Tang, Hao, et al.
Pubblicazione: (2025)
DiffSensei: Bridging Multi-Modal LLMs and Diffusion Models for Customized Manga Generation
di: Wu, Jianzong, et al.
Pubblicazione: (2024)
di: Wu, Jianzong, et al.
Pubblicazione: (2024)
DiffOSeg: Omni Medical Image Segmentation via Multi-Expert Collaboration Diffusion Model
di: Zhang, Han, et al.
Pubblicazione: (2025)
di: Zhang, Han, et al.
Pubblicazione: (2025)
DiffFNO: Diffusion Fourier Neural Operator
di: Liu, Xiaoyi, et al.
Pubblicazione: (2024)
di: Liu, Xiaoyi, et al.
Pubblicazione: (2024)
HAIFIT: Human-to-AI Fashion Image Translation
di: Jiang, Jianan, et al.
Pubblicazione: (2024)
di: Jiang, Jianan, et al.
Pubblicazione: (2024)
DiffPortrait360: Consistent Portrait Diffusion for 360 View Synthesis
di: Gu, Yuming, et al.
Pubblicazione: (2025)
di: Gu, Yuming, et al.
Pubblicazione: (2025)
Documenti analoghi
-
FoleyDesigner: Immersive Stereo Foley Generation with Precise Spatio-Temporal Alignment for Film Clips
di: Li, Mengtian, et al.
Pubblicazione: (2026) -
HieraVid: Hierarchical Token Pruning for Fast Video Large Language Models
di: Guo, Yansong, et al.
Pubblicazione: (2026) -
GaussianBody: Clothed Human Reconstruction via 3d Gaussian Splatting
di: Li, Mengtian, et al.
Pubblicazione: (2024) -
HieraSurg: Hierarchy-Aware Diffusion Model for Surgical Video Generation
di: Biagini, Diego, et al.
Pubblicazione: (2025) -
OCC-MLLM-Alpha:Empowering Multi-modal Large Language Model for the Understanding of Occluded Objects with Self-Supervised Test-Time Learning
di: Yang, Shuxin, et al.
Pubblicazione: (2024)