Saved in:
| Main Authors: | Shen, Fei, Jiang, Xin, He, Xin, Ye, Hu, Wang, Cong, Du, Xiaoyu, Li, Zechao, Tang, Jinhui |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | https://arxiv.org/abs/2407.12705 |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
IMAGGarment: Fine-Grained Garment Generation for Controllable Fashion Design
by: Shen, Fei, et al.
Published: (2025)
by: Shen, Fei, et al.
Published: (2025)
AnyDressing: Customizable Multi-Garment Virtual Dressing via Latent Diffusion Models
by: Li, Xinghui, et al.
Published: (2024)
by: Li, Xinghui, et al.
Published: (2024)
VersaVogue: Visual Expert Orchestration and Preference Alignment for Unified Fashion Synthesis
by: Yu, Jian, et al.
Published: (2026)
by: Yu, Jian, et al.
Published: (2026)
DVF: Advancing Robust and Accurate Fine-Grained Image Retrieval with Retrieval Guidelines
by: Jiang, Xin, et al.
Published: (2024)
by: Jiang, Xin, et al.
Published: (2024)
Fine-grained Image Retrieval via Dual-Vision Adaptation
by: Jiang, Xin, et al.
Published: (2025)
by: Jiang, Xin, et al.
Published: (2025)
Diff-MM: Exploring Pre-trained Text-to-Image Generation Model for Unified Multi-modal Object Tracking
by: Xuan, Shiyu, et al.
Published: (2025)
by: Xuan, Shiyu, et al.
Published: (2025)
Zero-shot HOI Detection with MLLM-based Detector-agnostic Interaction Recognition
by: Xuan, Shiyu, et al.
Published: (2026)
by: Xuan, Shiyu, et al.
Published: (2026)
IMAGHarmony: Controllable Image Editing with Consistent Object Quantity and Layout
by: Shen, Fei, et al.
Published: (2025)
by: Shen, Fei, et al.
Published: (2025)
IMAGAgent: Orchestrating Multi-Turn Image Editing via Constraint-Aware Planning and Reflection
by: Shen, Fei, et al.
Published: (2026)
by: Shen, Fei, et al.
Published: (2026)
Divide-and-Conquer: Confluent Triple-Flow Network for RGB-T Salient Object Detection
by: Tang, Hao, et al.
Published: (2024)
by: Tang, Hao, et al.
Published: (2024)
Learning Contrastive Self-Distillation for Ultra-Fine-Grained Visual Categorization Targeting Limited Samples
by: Fang, Ziye, et al.
Published: (2023)
by: Fang, Ziye, et al.
Published: (2023)
A Recover-then-Discriminate Framework for Robust Anomaly Detection
by: Xing, Peng, et al.
Published: (2024)
by: Xing, Peng, et al.
Published: (2024)
Combating Noisy Labels through Fostering Self- and Neighbor-Consistency
by: Sun, Zeren, et al.
Published: (2026)
by: Sun, Zeren, et al.
Published: (2026)
LeCoT: revisiting network architecture for two-view correspondence pruning
by: Dai, Luanyuan, et al.
Published: (2025)
by: Dai, Luanyuan, et al.
Published: (2025)
See the Text: From Tokenization to Visual Reading
by: Xing, Ling, et al.
Published: (2025)
by: Xing, Ling, et al.
Published: (2025)
MGNet: Learning Correspondences via Multiple Graphs
by: Dai, Luanyuan, et al.
Published: (2024)
by: Dai, Luanyuan, et al.
Published: (2024)
Spatial Structure Constraints for Weakly Supervised Semantic Segmentation
by: Chen, Tao, et al.
Published: (2024)
by: Chen, Tao, et al.
Published: (2024)
EventCrab: Harnessing Frame and Point Synergy for Event-based Action Recognition and Beyond
by: Cao, Meiqi, et al.
Published: (2024)
by: Cao, Meiqi, et al.
Published: (2024)
Long-Term TalkingFace Generation via Motion-Prior Conditional Diffusion Model
by: Shen, Fei, et al.
Published: (2025)
by: Shen, Fei, et al.
Published: (2025)
Shape-Guided Clothing Warping for Virtual Try-On
by: Han, Xiaoyu, et al.
Published: (2025)
by: Han, Xiaoyu, et al.
Published: (2025)
MADiff: Text-Guided Fashion Image Editing with Mask Prediction and Attention-Enhanced Diffusion
by: Zhan, Zechao, et al.
Published: (2024)
by: Zhan, Zechao, et al.
Published: (2024)
FashionFAE: Fine-grained Attributes Enhanced Fashion Vision-Language Pre-training
by: Huang, Jiale, et al.
Published: (2024)
by: Huang, Jiale, et al.
Published: (2024)
Beyond Single-Sample: Reliable Multi-Sample Distillation for Video Understanding
by: Li, Songlin, et al.
Published: (2026)
by: Li, Songlin, et al.
Published: (2026)
UniFit: Towards Universal Virtual Try-on with MLLM-Guided Semantic Alignment
by: Zhang, Wei, et al.
Published: (2025)
by: Zhang, Wei, et al.
Published: (2025)
TEST-V: TEst-time Support-set Tuning for Zero-shot Video Classification
by: Yan, Rui, et al.
Published: (2025)
by: Yan, Rui, et al.
Published: (2025)
BEHAVIOR Vision Suite: Customizable Dataset Generation via Simulation
by: Ge, Yunhao, et al.
Published: (2024)
by: Ge, Yunhao, et al.
Published: (2024)
Advancing Pose-Guided Image Synthesis with Progressive Conditional Diffusion Models
by: Shen, Fei, et al.
Published: (2023)
by: Shen, Fei, et al.
Published: (2023)
OmniFashion: Towards Generalist Fashion Intelligence via Multi-Task Vision-Language Learning
by: Yang, Zhengwei, et al.
Published: (2026)
by: Yang, Zhengwei, et al.
Published: (2026)
URSimulator: Human-Perception-Driven Prompt Tuning for Enhanced Virtual Urban Renewal via Diffusion Models
by: Hu, Chuanbo, et al.
Published: (2024)
by: Hu, Chuanbo, et al.
Published: (2024)
DreamVAR: Taming Reinforced Visual Autoregressive Model for High-Fidelity Subject-Driven Image Generation
by: Jiang, Xin, et al.
Published: (2026)
by: Jiang, Xin, et al.
Published: (2026)
SSP-SAM: SAM with Semantic-Spatial Prompt for Referring Expression Segmentation
by: Tang, Wei, et al.
Published: (2026)
by: Tang, Wei, et al.
Published: (2026)
Dress-1-to-3: Single Image to Simulation-Ready 3D Outfit with Diffusion Prior and Differentiable Physics
by: Li, Xuan, et al.
Published: (2025)
by: Li, Xuan, et al.
Published: (2025)
CNCA: Toward Customizable and Natural Generation of Adversarial Camouflage for Vehicle Detectors
by: Lyu, Linye, et al.
Published: (2024)
by: Lyu, Linye, et al.
Published: (2024)
FoundIR-v2: Optimizing Pre-Training Data Mixtures for Image Restoration Foundation Model
by: Chen, Xiang, et al.
Published: (2025)
by: Chen, Xiang, et al.
Published: (2025)
Dress-ED: Instruction-Guided Editing for Virtual Try-On and Try-Off
by: Sanguigni, Fulvio, et al.
Published: (2026)
by: Sanguigni, Fulvio, et al.
Published: (2026)
Context-Semantic Quality Awareness Network for Fine-Grained Visual Categorization
by: Xu, Qin, et al.
Published: (2024)
by: Xu, Qin, et al.
Published: (2024)
Boosting Consistency in Story Visualization with Rich-Contextual Conditional Diffusion Models
by: Shen, Fei, et al.
Published: (2024)
by: Shen, Fei, et al.
Published: (2024)
Blind Bitstream-corrupted Video Recovery via Metadata-guided Diffusion Model
by: Wang, Shuyun, et al.
Published: (2026)
by: Wang, Shuyun, et al.
Published: (2026)
A Detector-oblivious Multi-arm Network for Keypoint Matching
by: Shen, Xuelun, et al.
Published: (2021)
by: Shen, Xuelun, et al.
Published: (2021)
PC-Diffusion: Aligning Diffusion Models with Human Preferences via Preference Classifier
by: Wang, Shaomeng, et al.
Published: (2025)
by: Wang, Shaomeng, et al.
Published: (2025)
Similar Items
-
IMAGGarment: Fine-Grained Garment Generation for Controllable Fashion Design
by: Shen, Fei, et al.
Published: (2025) -
AnyDressing: Customizable Multi-Garment Virtual Dressing via Latent Diffusion Models
by: Li, Xinghui, et al.
Published: (2024) -
VersaVogue: Visual Expert Orchestration and Preference Alignment for Unified Fashion Synthesis
by: Yu, Jian, et al.
Published: (2026) -
DVF: Advancing Robust and Accurate Fine-Grained Image Retrieval with Retrieval Guidelines
by: Jiang, Xin, et al.
Published: (2024) -
Fine-grained Image Retrieval via Dual-Vision Adaptation
by: Jiang, Xin, et al.
Published: (2025)