Generative Video Matting
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ge, Yongtao, Xie, Kangyang, Xu, Guangkai, Liu, Mingyu, Ke, Li, Huang, Longtao, Xue, Hui, Chen, Hao, Shen, Chunhua |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
What Matters When Repurposing Diffusion Models for General Dense Perception Tasks?
par: Xu, Guangkai, et autres
Publié: (2024)
par: Xu, Guangkai, et autres
Publié: (2024)
GeoBench: Benchmarking and Analyzing Monocular Geometry Estimation Models
par: Ge, Yongtao, et autres
Publié: (2024)
par: Ge, Yongtao, et autres
Publié: (2024)
POMATO: Marrying Pointmap Matching with Temporal Motion for Dynamic 3D Reconstruction
par: Zhang, Songyan, et autres
Publié: (2025)
par: Zhang, Songyan, et autres
Publié: (2025)
Zero-Shot Video Editing Using Off-The-Shelf Image Diffusion Models
par: Wang, Wen, et autres
Publié: (2023)
par: Wang, Wen, et autres
Publié: (2023)
Zippo: Zipping Color and Transparency Distributions into a Single Diffusion Model
par: Xie, Kangyang, et autres
Publié: (2024)
par: Xie, Kangyang, et autres
Publié: (2024)
Diffusion Models are Efficient Data Generators for Human Mesh Recovery
par: Ge, Yongtao, et autres
Publié: (2024)
par: Ge, Yongtao, et autres
Publié: (2024)
Unlocking the Power of Critical Factors for 3D Visual Geometry Estimation
par: Xu, Guangkai, et autres
Publié: (2026)
par: Xu, Guangkai, et autres
Publié: (2026)
Unleashing the Potential of the Diffusion Model in Few-shot Semantic Segmentation
par: Zhu, Muzhi, et autres
Publié: (2024)
par: Zhu, Muzhi, et autres
Publié: (2024)
CG-MLLM: Captioning and Generating 3D content via Multi-modal Large Language Models
par: Huang, Junming, et autres
Publié: (2026)
par: Huang, Junming, et autres
Publié: (2026)
MovieDreamer: Hierarchical Generation for Coherent Long Visual Sequence
par: Zhao, Canyu, et autres
Publié: (2024)
par: Zhao, Canyu, et autres
Publié: (2024)
MatAnyone: Stable Video Matting with Consistent Memory Propagation
par: Yang, Peiqing, et autres
Publié: (2025)
par: Yang, Peiqing, et autres
Publié: (2025)
MatAnyone 2: Scaling Video Matting via a Learned Quality Evaluator
par: Yang, Peiqing, et autres
Publié: (2025)
par: Yang, Peiqing, et autres
Publié: (2025)
VRMDiff: Text-Guided Video Referring Matting Generation of Diffusion
par: Yang, Lehan, et autres
Publié: (2025)
par: Yang, Lehan, et autres
Publié: (2025)
Matting by Generation
par: Wang, Zhixiang, et autres
Publié: (2024)
par: Wang, Zhixiang, et autres
Publié: (2024)
MMControl: Unified Multi-Modal Control for Joint Audio-Video Generation
par: Li, Liyang, et autres
Publié: (2026)
par: Li, Liyang, et autres
Publié: (2026)
VideoNeuMat: Neural Material Extraction from Generative Video Models
par: Xue, Bowen, et autres
Publié: (2026)
par: Xue, Bowen, et autres
Publié: (2026)
DiffCalib: Reformulating Monocular Camera Calibration as Diffusion-Based Dense Incident Map Generation
par: He, Xiankang, et autres
Publié: (2024)
par: He, Xiankang, et autres
Publié: (2024)
BiVM: Accurate Binarized Neural Network for Efficient Video Matting
par: Qin, Haotong, et autres
Publié: (2025)
par: Qin, Haotong, et autres
Publié: (2025)
Dynamic Mixture of Curriculum LoRA Experts for Continual Multimodal Instruction Tuning
par: Ge, Chendi, et autres
Publié: (2025)
par: Ge, Chendi, et autres
Publié: (2025)
MovieBench: A Hierarchical Movie Level Dataset for Long Video Generation
par: Wu, Weijia, et autres
Publié: (2024)
par: Wu, Weijia, et autres
Publié: (2024)
SDMatte: Grafting Diffusion Models for Interactive Matting
par: Huang, Longfei, et autres
Publié: (2025)
par: Huang, Longfei, et autres
Publié: (2025)
Omni-R1: Reinforcement Learning for Omnimodal Reasoning via Two-System Collaboration
par: Zhong, Hao, et autres
Publié: (2025)
par: Zhong, Hao, et autres
Publié: (2025)
Geo-Align: Video Generation Alignment via Metric Geometry Reward
par: Li, Zizun, et autres
Publié: (2026)
par: Li, Zizun, et autres
Publié: (2026)
StaMo: Unsupervised Learning of Generalizable Robot Motion from Compact State Representation
par: Liu, Mingyu, et autres
Publié: (2025)
par: Liu, Mingyu, et autres
Publié: (2025)
VideoMat: Extracting PBR Materials from Video Diffusion Models
par: Munkberg, Jacob, et autres
Publié: (2025)
par: Munkberg, Jacob, et autres
Publié: (2025)
Morpho-Aware Global Attention for Image Matting
par: Yang, Jingru, et autres
Publié: (2024)
par: Yang, Jingru, et autres
Publié: (2024)
Scalable Adaptation of 3D Geometric Foundation Models via Weak Supervision from Internet Video
par: Gao, Zihui, et autres
Publié: (2026)
par: Gao, Zihui, et autres
Publié: (2026)
Generative Active Learning for Long-tailed Instance Segmentation
par: Zhu, Muzhi, et autres
Publié: (2024)
par: Zhu, Muzhi, et autres
Publié: (2024)
In-Context Matting
par: Guo, He, et autres
Publié: (2024)
par: Guo, He, et autres
Publié: (2024)
Training-Free Motion Customization for Distilled Video Generators with Adaptive Test-Time Distillation
par: Rong, Jintao, et autres
Publié: (2025)
par: Rong, Jintao, et autres
Publié: (2025)
Character Mixing for Video Generation
par: Liao, Tingting, et autres
Publié: (2025)
par: Liao, Tingting, et autres
Publié: (2025)
MaSS13K: A Matting-level Semantic Segmentation Benchmark
par: Xie, Chenxi, et autres
Publié: (2025)
par: Xie, Chenxi, et autres
Publié: (2025)
VideoMaMa: Mask-Guided Video Matting via Generative Prior
par: Lim, Sangbeom, et autres
Publié: (2026)
par: Lim, Sangbeom, et autres
Publié: (2026)
Diffusion Probe: Generated Image Result Prediction Using CNN Probes
par: Cui, Benlei, et autres
Publié: (2026)
par: Cui, Benlei, et autres
Publié: (2026)
DualMat: PBR Material Estimation via Coherent Dual-Path Diffusion
par: Huang, Yifeng, et autres
Publié: (2025)
par: Huang, Yifeng, et autres
Publié: (2025)
VimTS: A Unified Video and Image Text Spotter for Enhancing the Cross-domain Generalization
par: Liu, Yuliang, et autres
Publié: (2024)
par: Liu, Yuliang, et autres
Publié: (2024)
FreeCompose: Generic Zero-Shot Image Composition with Diffusion Prior
par: Chen, Zhekai, et autres
Publié: (2024)
par: Chen, Zhekai, et autres
Publié: (2024)
Making Training-Free Diffusion Segmentors Scale with the Generative Power
par: Meng, Benyuan, et autres
Publié: (2026)
par: Meng, Benyuan, et autres
Publié: (2026)
Post-Training Quantization for Video Matting
par: Zhu, Tianrui, et autres
Publié: (2025)
par: Zhu, Tianrui, et autres
Publié: (2025)
R$^{2}$Seg: Training-Free OOD Medical Tumor Segmentation via Anatomical Reasoning and Statistical Rejection
par: Shen, Shuaike, et autres
Publié: (2025)
par: Shen, Shuaike, et autres
Publié: (2025)
Documents similaires
-
What Matters When Repurposing Diffusion Models for General Dense Perception Tasks?
par: Xu, Guangkai, et autres
Publié: (2024) -
GeoBench: Benchmarking and Analyzing Monocular Geometry Estimation Models
par: Ge, Yongtao, et autres
Publié: (2024) -
POMATO: Marrying Pointmap Matching with Temporal Motion for Dynamic 3D Reconstruction
par: Zhang, Songyan, et autres
Publié: (2025) -
Zero-Shot Video Editing Using Off-The-Shelf Image Diffusion Models
par: Wang, Wen, et autres
Publié: (2023) -
Zippo: Zipping Color and Transparency Distributions into a Single Diffusion Model
par: Xie, Kangyang, et autres
Publié: (2024)