Object-Aware Video Matting with Cross-Frame Guidance
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Huayu, Wu, Dongyue, Shao, Yuanjie, Sang, Nong, Gao, Changxin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Open-Vocabulary Semantic Segmentation with Image Embedding Balancing
di: Shan, Xiangheng, et al.
Pubblicazione: (2024)
di: Shan, Xiangheng, et al.
Pubblicazione: (2024)
MP-Mat: A 3D-and-Instance-Aware Human Matting and Editing Framework with Multiplane Representation
di: Jiao, Siyi, et al.
Pubblicazione: (2025)
di: Jiao, Siyi, et al.
Pubblicazione: (2025)
DFIMat: Decoupled Flexible Interactive Matting in Multi-Person Scenarios
di: Jiao, Siyi, et al.
Pubblicazione: (2024)
di: Jiao, Siyi, et al.
Pubblicazione: (2024)
Partial Forward Blocking: A Novel Data Pruning Paradigm for Lossless Training Acceleration
di: Wu, Dongyue, et al.
Pubblicazione: (2025)
di: Wu, Dongyue, et al.
Pubblicazione: (2025)
Structural Pruning via Spatial-aware Information Redundancy for Semantic Segmentation
di: Wu, Dongyue, et al.
Pubblicazione: (2024)
di: Wu, Dongyue, et al.
Pubblicazione: (2024)
SCTNet: Single-Branch CNN with Transformer Semantic Information for Real-Time Segmentation
di: Xu, Zhengze, et al.
Pubblicazione: (2023)
di: Xu, Zhengze, et al.
Pubblicazione: (2023)
Adaptive Prototype Replay for Class Incremental Semantic Segmentation
di: Zhu, Guilin, et al.
Pubblicazione: (2024)
di: Zhu, Guilin, et al.
Pubblicazione: (2024)
Adaptive Semantic Consistency for Cross-domain Few-shot Classification
di: Lu, Hengchu, et al.
Pubblicazione: (2023)
di: Lu, Hengchu, et al.
Pubblicazione: (2023)
ReID5o: Achieving Omni Multi-modal Person Re-identification in a Single Model
di: Zuo, Jialong, et al.
Pubblicazione: (2025)
di: Zuo, Jialong, et al.
Pubblicazione: (2025)
Learning Unpaired Image Dehazing with Physics-based Rehazy Generation
di: Deng, Haoyou, et al.
Pubblicazione: (2025)
di: Deng, Haoyou, et al.
Pubblicazione: (2025)
REPAIR: Rank Correlation and Noisy Pair Half-replacing with Memory for Noisy Correspondence
di: Zheng, Ruochen, et al.
Pubblicazione: (2024)
di: Zheng, Ruochen, et al.
Pubblicazione: (2024)
UniAnimate-DiT: Human Image Animation with Large-Scale Video Diffusion Transformer
di: Wang, Xiang, et al.
Pubblicazione: (2025)
di: Wang, Xiang, et al.
Pubblicazione: (2025)
UniAnimate: Taming Unified Video Diffusion Models for Consistent Human Image Animation
di: Wang, Xiang, et al.
Pubblicazione: (2024)
di: Wang, Xiang, et al.
Pubblicazione: (2024)
Cross-video Identity Correlating for Person Re-identification Pre-training
di: Zuo, Jialong, et al.
Pubblicazione: (2024)
di: Zuo, Jialong, et al.
Pubblicazione: (2024)
HR-Pro: Point-supervised Temporal Action Localization via Hierarchical Reliability Propagation
di: Zhang, Huaxin, et al.
Pubblicazione: (2023)
di: Zhang, Huaxin, et al.
Pubblicazione: (2023)
Replace Anyone in Videos
di: Wang, Xiang, et al.
Pubblicazione: (2024)
di: Wang, Xiang, et al.
Pubblicazione: (2024)
Holmes-VAU: Towards Long-term Video Anomaly Understanding at Any Granularity
di: Zhang, Huaxin, et al.
Pubblicazione: (2024)
di: Zhang, Huaxin, et al.
Pubblicazione: (2024)
GlanceVAD: Exploring Glance Supervision for Label-efficient Video Anomaly Detection
di: Zhang, Huaxin, et al.
Pubblicazione: (2024)
di: Zhang, Huaxin, et al.
Pubblicazione: (2024)
VideoLucy: Deep Memory Backtracking for Long Video Understanding
di: Zuo, Jialong, et al.
Pubblicazione: (2025)
di: Zuo, Jialong, et al.
Pubblicazione: (2025)
TRACE: Object Motion Editing in Videos with First-Frame Trajectory Guidance
di: Phung, Quynh, et al.
Pubblicazione: (2026)
di: Phung, Quynh, et al.
Pubblicazione: (2026)
Holmes-VAD: Towards Unbiased and Explainable Video Anomaly Detection via Multi-modal LLM
di: Zhang, Huaxin, et al.
Pubblicazione: (2024)
di: Zhang, Huaxin, et al.
Pubblicazione: (2024)
CLIP-guided Prototype Modulating for Few-shot Action Recognition
di: Wang, Xiang, et al.
Pubblicazione: (2023)
di: Wang, Xiang, et al.
Pubblicazione: (2023)
Tunnel Try-on: Excavating Spatial-temporal Tunnels for High-quality Virtual Try-on in Videos
di: Xu, Zhengze, et al.
Pubblicazione: (2024)
di: Xu, Zhengze, et al.
Pubblicazione: (2024)
Learning to Tell Apart: Weakly Supervised Video Anomaly Detection via Disentangled Semantic Alignment
di: Yin, Wenti, et al.
Pubblicazione: (2025)
di: Yin, Wenti, et al.
Pubblicazione: (2025)
MatPhys: Learning Material-Aware Physics Parameters for Deformable Object Simulation from Videos
di: Yang, Yang, et al.
Pubblicazione: (2026)
di: Yang, Yang, et al.
Pubblicazione: (2026)
Spatial Cascaded Clustering and Weighted Memory for Unsupervised Person Re-identification
di: Hong, Jiahao, et al.
Pubblicazione: (2024)
di: Hong, Jiahao, et al.
Pubblicazione: (2024)
DenseGRPO: From Sparse to Dense Reward for Flow Matching Model Alignment
di: Deng, Haoyou, et al.
Pubblicazione: (2026)
di: Deng, Haoyou, et al.
Pubblicazione: (2026)
Taming Consistency Distillation for Accelerated Human Image Animation
di: Wang, Xiang, et al.
Pubblicazione: (2025)
di: Wang, Xiang, et al.
Pubblicazione: (2025)
PLIP: Language-Image Pre-training for Person Representation Learning
di: Zuo, Jialong, et al.
Pubblicazione: (2023)
di: Zuo, Jialong, et al.
Pubblicazione: (2023)
UFineBench: Towards Text-based Person Retrieval with Ultra-fine Granularity
di: Zuo, Jialong, et al.
Pubblicazione: (2023)
di: Zuo, Jialong, et al.
Pubblicazione: (2023)
Towards Reliable and Holistic Visual In-Context Learning Prompt Selection
di: Wu, Wenxiao, et al.
Pubblicazione: (2025)
di: Wu, Wenxiao, et al.
Pubblicazione: (2025)
Enhancing Video Inpainting with Aligned Frame Interval Guidance
di: Xie, Ming, et al.
Pubblicazione: (2025)
di: Xie, Ming, et al.
Pubblicazione: (2025)
Motion-Aware Video Frame Interpolation
di: Han, Pengfei, et al.
Pubblicazione: (2024)
di: Han, Pengfei, et al.
Pubblicazione: (2024)
Frame Guidance: Training-Free Guidance for Frame-Level Control in Video Diffusion Models
di: Jang, Sangwon, et al.
Pubblicazione: (2025)
di: Jang, Sangwon, et al.
Pubblicazione: (2025)
Generative Video Matting
di: Ge, Yongtao, et al.
Pubblicazione: (2025)
di: Ge, Yongtao, et al.
Pubblicazione: (2025)
MatAnyone: Stable Video Matting with Consistent Memory Propagation
di: Yang, Peiqing, et al.
Pubblicazione: (2025)
di: Yang, Peiqing, et al.
Pubblicazione: (2025)
Few-Shot Object Detection: Research Advances and Challenges
di: Xin, Zhimeng, et al.
Pubblicazione: (2024)
di: Xin, Zhimeng, et al.
Pubblicazione: (2024)
Lookup Table meets Local Laplacian Filter: Pyramid Reconstruction Network for Tone Mapping
di: Zhang, Feng, et al.
Pubblicazione: (2023)
di: Zhang, Feng, et al.
Pubblicazione: (2023)
Shot-Aware Frame Sampling for Video Understanding
di: Zhao, Mengyu, et al.
Pubblicazione: (2026)
di: Zhao, Mengyu, et al.
Pubblicazione: (2026)
FlexEvent: Towards Flexible Event-Frame Object Detection at Varying Operational Frequencies
di: Lu, Dongyue, et al.
Pubblicazione: (2024)
di: Lu, Dongyue, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Open-Vocabulary Semantic Segmentation with Image Embedding Balancing
di: Shan, Xiangheng, et al.
Pubblicazione: (2024) -
MP-Mat: A 3D-and-Instance-Aware Human Matting and Editing Framework with Multiplane Representation
di: Jiao, Siyi, et al.
Pubblicazione: (2025) -
DFIMat: Decoupled Flexible Interactive Matting in Multi-Person Scenarios
di: Jiao, Siyi, et al.
Pubblicazione: (2024) -
Partial Forward Blocking: A Novel Data Pruning Paradigm for Lossless Training Acceleration
di: Wu, Dongyue, et al.
Pubblicazione: (2025) -
Structural Pruning via Spatial-aware Information Redundancy for Semantic Segmentation
di: Wu, Dongyue, et al.
Pubblicazione: (2024)