HieraFashDiff: Hierarchical Fashion Design with Multi-stage Diffusion Models
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Xie, Zhifeng, Li, Hao, Ding, Huiming, Li, Mengtian, Di, Xinhan, Cao, Ying |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
FoleyDesigner: Immersive Stereo Foley Generation with Precise Spatio-Temporal Alignment for Film Clips
von: Li, Mengtian, et al.
Veröffentlicht: (2026)
von: Li, Mengtian, et al.
Veröffentlicht: (2026)
HieraVid: Hierarchical Token Pruning for Fast Video Large Language Models
von: Guo, Yansong, et al.
Veröffentlicht: (2026)
von: Guo, Yansong, et al.
Veröffentlicht: (2026)
GaussianBody: Clothed Human Reconstruction via 3d Gaussian Splatting
von: Li, Mengtian, et al.
Veröffentlicht: (2024)
von: Li, Mengtian, et al.
Veröffentlicht: (2024)
HieraSurg: Hierarchy-Aware Diffusion Model for Surgical Video Generation
von: Biagini, Diego, et al.
Veröffentlicht: (2025)
von: Biagini, Diego, et al.
Veröffentlicht: (2025)
OCC-MLLM-Alpha:Empowering Multi-modal Large Language Model for the Understanding of Occluded Objects with Self-Supervised Test-Time Learning
von: Yang, Shuxin, et al.
Veröffentlicht: (2024)
von: Yang, Shuxin, et al.
Veröffentlicht: (2024)
GardenDesigner: Encoding Aesthetic Principles into Jiangnan Garden Construction via a Chain of Agents
von: Li, Mengtian, et al.
Veröffentlicht: (2026)
von: Li, Mengtian, et al.
Veröffentlicht: (2026)
FilmSceneDesigner: Chaining Set Design for Procedural Film Scene Generation
von: Xie, Zhifeng, et al.
Veröffentlicht: (2025)
von: Xie, Zhifeng, et al.
Veröffentlicht: (2025)
OCC-MLLM-CoT-Alpha: Towards Multi-stage Occlusion Recognition Based on Large Language Models via 3D-Aware Supervision and Chain-of-Thoughts Guidance
von: Wang, Chaoyi, et al.
Veröffentlicht: (2025)
von: Wang, Chaoyi, et al.
Veröffentlicht: (2025)
HieraMamba: Video Temporal Grounding via Hierarchical Anchor-Mamba Pooling
von: An, Joungbin, et al.
Veröffentlicht: (2025)
von: An, Joungbin, et al.
Veröffentlicht: (2025)
OCC-MLLM:Empowering Multimodal Large Language Model For the Understanding of Occluded Objects
von: Qiu, Wenmo, et al.
Veröffentlicht: (2024)
von: Qiu, Wenmo, et al.
Veröffentlicht: (2024)
Low-Rank Adaptation with Task-Relevant Feature Enhancement for Fine-tuning Language Models
von: Li, Changqun, et al.
Veröffentlicht: (2024)
von: Li, Changqun, et al.
Veröffentlicht: (2024)
HieraRS: A Hierarchical Segmentation Paradigm for Remote Sensing Enabling Multi-Granularity Interpretation and Cross-Domain Transfer
von: Ai, Tianlong, et al.
Veröffentlicht: (2025)
von: Ai, Tianlong, et al.
Veröffentlicht: (2025)
DeepDubber-V1: Towards High Quality and Dialogue, Narration, Monologue Adaptive Movie Dubbing Via Multi-Modal Chain-of-Thoughts Reasoning Guidance
von: Zheng, Junjie, et al.
Veröffentlicht: (2025)
von: Zheng, Junjie, et al.
Veröffentlicht: (2025)
Diff-Reg v1: Diffusion Matching Model for Registration Problem
von: Wu, Qianliang, et al.
Veröffentlicht: (2024)
von: Wu, Qianliang, et al.
Veröffentlicht: (2024)
EpiDiff: Enhancing Multi-View Synthesis via Localized Epipolar-Constrained Diffusion
von: Huang, Zehuan, et al.
Veröffentlicht: (2023)
von: Huang, Zehuan, et al.
Veröffentlicht: (2023)
HieraTok: Multi-Scale Visual Tokenizer Improves Image Reconstruction and Generation
von: Chen, Cong, et al.
Veröffentlicht: (2025)
von: Chen, Cong, et al.
Veröffentlicht: (2025)
Infinite Motion: Extended Motion Generation via Long Text Instructions
von: Li, Mengtian, et al.
Veröffentlicht: (2024)
von: Li, Mengtian, et al.
Veröffentlicht: (2024)
VERTIGO: Visual Preference Optimization for Cinematic Camera Trajectory Generation
von: Li, Mengtian, et al.
Veröffentlicht: (2026)
von: Li, Mengtian, et al.
Veröffentlicht: (2026)
OmniFashion: Towards Generalist Fashion Intelligence via Multi-Task Vision-Language Learning
von: Yang, Zhengwei, et al.
Veröffentlicht: (2026)
von: Yang, Zhengwei, et al.
Veröffentlicht: (2026)
LAPTOP-Diff: Layer Pruning and Normalized Distillation for Compressing Diffusion Models
von: Zhang, Dingkun, et al.
Veröffentlicht: (2024)
von: Zhang, Dingkun, et al.
Veröffentlicht: (2024)
SemMorph3D: Unsupervised Semantic-Aware 3D Morphing via Mesh-Guided Gaussians
von: Li, Mengtian, et al.
Veröffentlicht: (2025)
von: Li, Mengtian, et al.
Veröffentlicht: (2025)
AniGaussian: Animatable Gaussian Avatar with Pose-guided Deformation
von: Li, Mengtian, et al.
Veröffentlicht: (2025)
von: Li, Mengtian, et al.
Veröffentlicht: (2025)
DiffProxy: Multi-View Human Mesh Recovery via Diffusion-Generated Dense Proxies
von: Wang, Renke, et al.
Veröffentlicht: (2026)
von: Wang, Renke, et al.
Veröffentlicht: (2026)
Fashion-VDM: Video Diffusion Model for Virtual Try-On
von: Karras, Johanna, et al.
Veröffentlicht: (2024)
von: Karras, Johanna, et al.
Veröffentlicht: (2024)
RoomDiffusion: A Specialized Diffusion Model in the Interior Design Industry
von: Wang, Zhaowei, et al.
Veröffentlicht: (2024)
von: Wang, Zhaowei, et al.
Veröffentlicht: (2024)
DiffIER: Optimizing Diffusion Models with Iterative Error Reduction
von: Chen, Ao, et al.
Veröffentlicht: (2025)
von: Chen, Ao, et al.
Veröffentlicht: (2025)
AdaDiff: Accelerating Diffusion Models through Step-Wise Adaptive Computation
von: Tang, Shengkun, et al.
Veröffentlicht: (2023)
von: Tang, Shengkun, et al.
Veröffentlicht: (2023)
MM-MovieDubber: Towards Multi-Modal Learning for Multi-Modal Movie Dubbing
von: Zheng, Junjie, et al.
Veröffentlicht: (2025)
von: Zheng, Junjie, et al.
Veröffentlicht: (2025)
FilmComposer: LLM-Driven Music Production for Silent Film Clips
von: Xie, Zhifeng, et al.
Veröffentlicht: (2025)
von: Xie, Zhifeng, et al.
Veröffentlicht: (2025)
DiffKD-DCIS: Predicting Upgrade of Ductal Carcinoma In Situ with Diffusion Augmentation and Knowledge Distillation
von: Li, Tao, et al.
Veröffentlicht: (2026)
von: Li, Tao, et al.
Veröffentlicht: (2026)
Raccoon: Multi-stage Diffusion Training with Coarse-to-Fine Curating Videos
von: Tan, Zhiyu, et al.
Veröffentlicht: (2025)
von: Tan, Zhiyu, et al.
Veröffentlicht: (2025)
DiffPCN: Latent Diffusion Model Based on Multi-view Depth Images for Point Cloud Completion
von: Li, Zijun, et al.
Veröffentlicht: (2025)
von: Li, Zijun, et al.
Veröffentlicht: (2025)
FedDiff: Diffusion Model Driven Federated Learning for Multi-Modal and Multi-Clients
von: Li, DaiXun, et al.
Veröffentlicht: (2023)
von: Li, DaiXun, et al.
Veröffentlicht: (2023)
FashionFlow: Leveraging Diffusion Models for Dynamic Fashion Video Synthesis from Static Imagery
von: Islam, Tasin, et al.
Veröffentlicht: (2023)
von: Islam, Tasin, et al.
Veröffentlicht: (2023)
FOD-Diff: 3D Multi-Channel Patch Diffusion Model for Fiber Orientation Distribution
von: Tang, Hao, et al.
Veröffentlicht: (2025)
von: Tang, Hao, et al.
Veröffentlicht: (2025)
DiffSensei: Bridging Multi-Modal LLMs and Diffusion Models for Customized Manga Generation
von: Wu, Jianzong, et al.
Veröffentlicht: (2024)
von: Wu, Jianzong, et al.
Veröffentlicht: (2024)
DiffOSeg: Omni Medical Image Segmentation via Multi-Expert Collaboration Diffusion Model
von: Zhang, Han, et al.
Veröffentlicht: (2025)
von: Zhang, Han, et al.
Veröffentlicht: (2025)
DiffFNO: Diffusion Fourier Neural Operator
von: Liu, Xiaoyi, et al.
Veröffentlicht: (2024)
von: Liu, Xiaoyi, et al.
Veröffentlicht: (2024)
HAIFIT: Human-to-AI Fashion Image Translation
von: Jiang, Jianan, et al.
Veröffentlicht: (2024)
von: Jiang, Jianan, et al.
Veröffentlicht: (2024)
DiffPortrait360: Consistent Portrait Diffusion for 360 View Synthesis
von: Gu, Yuming, et al.
Veröffentlicht: (2025)
von: Gu, Yuming, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
FoleyDesigner: Immersive Stereo Foley Generation with Precise Spatio-Temporal Alignment for Film Clips
von: Li, Mengtian, et al.
Veröffentlicht: (2026) -
HieraVid: Hierarchical Token Pruning for Fast Video Large Language Models
von: Guo, Yansong, et al.
Veröffentlicht: (2026) -
GaussianBody: Clothed Human Reconstruction via 3d Gaussian Splatting
von: Li, Mengtian, et al.
Veröffentlicht: (2024) -
HieraSurg: Hierarchy-Aware Diffusion Model for Surgical Video Generation
von: Biagini, Diego, et al.
Veröffentlicht: (2025) -
OCC-MLLM-Alpha:Empowering Multi-modal Large Language Model for the Understanding of Occluded Objects with Self-Supervised Test-Time Learning
von: Yang, Shuxin, et al.
Veröffentlicht: (2024)