Replace Anyone in Videos
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Xiang, Zhang, Shiwei, Qiu, Haonan, Chu, Ruihang, Li, Zekun, Zhang, Yingya, Gao, Changxin, Wang, Yuehuan, Shen, Chunhua, Sang, Nong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
UniAnimate-DiT: Human Image Animation with Large-Scale Video Diffusion Transformer
di: Wang, Xiang, et al.
Pubblicazione: (2025)
di: Wang, Xiang, et al.
Pubblicazione: (2025)
Taming Consistency Distillation for Accelerated Human Image Animation
di: Wang, Xiang, et al.
Pubblicazione: (2025)
di: Wang, Xiang, et al.
Pubblicazione: (2025)
UniAnimate: Taming Unified Video Diffusion Models for Consistent Human Image Animation
di: Wang, Xiang, et al.
Pubblicazione: (2024)
di: Wang, Xiang, et al.
Pubblicazione: (2024)
CLIP-guided Prototype Modulating for Few-shot Action Recognition
di: Wang, Xiang, et al.
Pubblicazione: (2023)
di: Wang, Xiang, et al.
Pubblicazione: (2023)
FreeScale: Unleashing the Resolution of Diffusion Models via Tuning-Free Scale Fusion
di: Qiu, Haonan, et al.
Pubblicazione: (2024)
di: Qiu, Haonan, et al.
Pubblicazione: (2024)
PersonalVideo: High ID-Fidelity Video Customization without Dynamic and Semantic Degradation
di: Li, Hengjia, et al.
Pubblicazione: (2024)
di: Li, Hengjia, et al.
Pubblicazione: (2024)
GlanceVAD: Exploring Glance Supervision for Label-efficient Video Anomaly Detection
di: Zhang, Huaxin, et al.
Pubblicazione: (2024)
di: Zhang, Huaxin, et al.
Pubblicazione: (2024)
Holmes-VAD: Towards Unbiased and Explainable Video Anomaly Detection via Multi-modal LLM
di: Zhang, Huaxin, et al.
Pubblicazione: (2024)
di: Zhang, Huaxin, et al.
Pubblicazione: (2024)
DreamVideo-Omni: Omni-Motion Controlled Multi-Subject Video Customization with Latent Identity Reinforcement Learning
di: Wei, Yujie, et al.
Pubblicazione: (2026)
di: Wei, Yujie, et al.
Pubblicazione: (2026)
TTS-VAR: A Test-Time Scaling Framework for Visual Auto-Regressive Generation
di: Chen, Zhekai, et al.
Pubblicazione: (2025)
di: Chen, Zhekai, et al.
Pubblicazione: (2025)
Object-Aware Video Matting with Cross-Frame Guidance
di: Zhang, Huayu, et al.
Pubblicazione: (2025)
di: Zhang, Huayu, et al.
Pubblicazione: (2025)
Exploiting Discriminative Codebook Prior for Autoregressive Image Generation
di: Tang, Longxiang, et al.
Pubblicazione: (2025)
di: Tang, Longxiang, et al.
Pubblicazione: (2025)
HBridge: H-Shape Bridging of Heterogeneous Experts for Unified Multimodal Understanding and Generation
di: Wang, Xiang, et al.
Pubblicazione: (2025)
di: Wang, Xiang, et al.
Pubblicazione: (2025)
DreamRelation: Relation-Centric Video Customization
di: Wei, Yujie, et al.
Pubblicazione: (2025)
di: Wei, Yujie, et al.
Pubblicazione: (2025)
Timestep Embedding Tells: It's Time to Cache for Video Diffusion Model
di: Liu, Feng, et al.
Pubblicazione: (2024)
di: Liu, Feng, et al.
Pubblicazione: (2024)
HR-Pro: Point-supervised Temporal Action Localization via Hierarchical Reliability Propagation
di: Zhang, Huaxin, et al.
Pubblicazione: (2023)
di: Zhang, Huaxin, et al.
Pubblicazione: (2023)
Holmes-VAU: Towards Long-term Video Anomaly Understanding at Any Granularity
di: Zhang, Huaxin, et al.
Pubblicazione: (2024)
di: Zhang, Huaxin, et al.
Pubblicazione: (2024)
DreamVideo-2: Zero-Shot Subject-Driven Video Customization with Precise Motion Control
di: Wei, Yujie, et al.
Pubblicazione: (2024)
di: Wei, Yujie, et al.
Pubblicazione: (2024)
REPAIR: Rank Correlation and Noisy Pair Half-replacing with Memory for Noisy Correspondence
di: Zheng, Ruochen, et al.
Pubblicazione: (2024)
di: Zheng, Ruochen, et al.
Pubblicazione: (2024)
DFIMat: Decoupled Flexible Interactive Matting in Multi-Person Scenarios
di: Jiao, Siyi, et al.
Pubblicazione: (2024)
di: Jiao, Siyi, et al.
Pubblicazione: (2024)
Learning to Tell Apart: Weakly Supervised Video Anomaly Detection via Disentangled Semantic Alignment
di: Yin, Wenti, et al.
Pubblicazione: (2025)
di: Yin, Wenti, et al.
Pubblicazione: (2025)
DreamTalk: When Emotional Talking Head Generation Meets Diffusion Probabilistic Models
di: Ma, Yifeng, et al.
Pubblicazione: (2023)
di: Ma, Yifeng, et al.
Pubblicazione: (2023)
Wan-Move: Motion-controllable Video Generation via Latent Trajectory Guidance
di: Chu, Ruihang, et al.
Pubblicazione: (2025)
di: Chu, Ruihang, et al.
Pubblicazione: (2025)
SCTNet: Single-Branch CNN with Transformer Semantic Information for Real-Time Segmentation
di: Xu, Zhengze, et al.
Pubblicazione: (2023)
di: Xu, Zhengze, et al.
Pubblicazione: (2023)
Structural Pruning via Spatial-aware Information Redundancy for Semantic Segmentation
di: Wu, Dongyue, et al.
Pubblicazione: (2024)
di: Wu, Dongyue, et al.
Pubblicazione: (2024)
DenseGRPO: From Sparse to Dense Reward for Flow Matching Model Alignment
di: Deng, Haoyou, et al.
Pubblicazione: (2026)
di: Deng, Haoyou, et al.
Pubblicazione: (2026)
Partial Forward Blocking: A Novel Data Pruning Paradigm for Lossless Training Acceleration
di: Wu, Dongyue, et al.
Pubblicazione: (2025)
di: Wu, Dongyue, et al.
Pubblicazione: (2025)
Adaptive Prototype Replay for Class Incremental Semantic Segmentation
di: Zhu, Guilin, et al.
Pubblicazione: (2024)
di: Zhu, Guilin, et al.
Pubblicazione: (2024)
VideoLucy: Deep Memory Backtracking for Long Video Understanding
di: Zuo, Jialong, et al.
Pubblicazione: (2025)
di: Zuo, Jialong, et al.
Pubblicazione: (2025)
FreeMask: Rethinking the Importance of Attention Masks for Zero-Shot Video Editing
di: Cai, Lingling, et al.
Pubblicazione: (2024)
di: Cai, Lingling, et al.
Pubblicazione: (2024)
Tunnel Try-on: Excavating Spatial-temporal Tunnels for High-quality Virtual Try-on in Videos
di: Xu, Zhengze, et al.
Pubblicazione: (2024)
di: Xu, Zhengze, et al.
Pubblicazione: (2024)
MP-Mat: A 3D-and-Instance-Aware Human Matting and Editing Framework with Multiplane Representation
di: Jiao, Siyi, et al.
Pubblicazione: (2025)
di: Jiao, Siyi, et al.
Pubblicazione: (2025)
Cross-video Identity Correlating for Person Re-identification Pre-training
di: Zuo, Jialong, et al.
Pubblicazione: (2024)
di: Zuo, Jialong, et al.
Pubblicazione: (2024)
PLIP: Language-Image Pre-training for Person Representation Learning
di: Zuo, Jialong, et al.
Pubblicazione: (2023)
di: Zuo, Jialong, et al.
Pubblicazione: (2023)
UFineBench: Towards Text-based Person Retrieval with Ultra-fine Granularity
di: Zuo, Jialong, et al.
Pubblicazione: (2023)
di: Zuo, Jialong, et al.
Pubblicazione: (2023)
Animate Anyone: Consistent and Controllable Image-to-Video Synthesis for Character Animation
di: Hu, Li, et al.
Pubblicazione: (2023)
di: Hu, Li, et al.
Pubblicazione: (2023)
Open-Vocabulary Semantic Segmentation with Image Embedding Balancing
di: Shan, Xiangheng, et al.
Pubblicazione: (2024)
di: Shan, Xiangheng, et al.
Pubblicazione: (2024)
Spatial Cascaded Clustering and Weighted Memory for Unsupervised Person Re-identification
di: Hong, Jiahao, et al.
Pubblicazione: (2024)
di: Hong, Jiahao, et al.
Pubblicazione: (2024)
MSAVBench: Towards Comprehensive and Reliable Evaluation of Multi-Shot Audio-Video Generation
di: Wei, Yujie, et al.
Pubblicazione: (2026)
di: Wei, Yujie, et al.
Pubblicazione: (2026)
Animate Anyone 2: High-Fidelity Character Image Animation with Environment Affordance
di: Hu, Li, et al.
Pubblicazione: (2025)
di: Hu, Li, et al.
Pubblicazione: (2025)
Documenti analoghi
-
UniAnimate-DiT: Human Image Animation with Large-Scale Video Diffusion Transformer
di: Wang, Xiang, et al.
Pubblicazione: (2025) -
Taming Consistency Distillation for Accelerated Human Image Animation
di: Wang, Xiang, et al.
Pubblicazione: (2025) -
UniAnimate: Taming Unified Video Diffusion Models for Consistent Human Image Animation
di: Wang, Xiang, et al.
Pubblicazione: (2024) -
CLIP-guided Prototype Modulating for Few-shot Action Recognition
di: Wang, Xiang, et al.
Pubblicazione: (2023) -
FreeScale: Unleashing the Resolution of Diffusion Models via Tuning-Free Scale Fusion
di: Qiu, Haonan, et al.
Pubblicazione: (2024)